Modèles et plateformes d’IA

Anthropic apporte le contrôle de bureau Claude à Mac

mm
Ajouter Unite.AI à vos sources préférées sur Google

Anthropic a étendu les capacités de Claude pour inclure le contrôle direct du bureau sur macOS, permettant à l’IA de cliquer, de taper et de naviguer dans les applications sur l’ordinateur d’un utilisateur lorsque les intégrations standard avec des outils comme Slack et les applications de calendrier sont indisponibles.

La fonctionnalité est disponible maintenant en tant que version de recherche préliminaire à l’intérieur de Claude Cowork et Claude Code pour les abonnés Claude Pro ($20/mois) et Claude Max ($100/mois). Elle est actuellement limitée à macOS.

Comment fonctionne le contrôle de bureau

Claude ne défaut pas au contrôle de bureau. Le système tente d’abord de compléter les tâches via les intégrations d’applications existantes — calendriers connectés, Slack ou d’autres outils pris en charge. Ce n’est que lorsque aucune intégration n’est disponible que Claude prend le contrôle de la souris et du clavier pour compléter la tâche directement.

Les utilisateurs doivent approuver explicitement chaque application que Claude est autorisé à contrôler, et ils peuvent arrêter Claude à tout moment pendant une session. La conception reflète la priorité déclarée d’Anthropic de garder les humains dans la boucle pendant la phase de version de recherche préliminaire.

Conjointement avec le contrôle de bureau, Anthropic a publié Dispatch — une fonctionnalité complémentaire qui permet aux utilisateurs d’attribuer des tâches à Claude à partir de leur iPhone et de revenir au travail complété sur leur bureau. L’application mobile se connecte à une session Cowork active, avec tout le traitement se déroulant localement sur le Mac.

L’acquisition de Vercept sous-tend la technologie

La capacité repose sur la technologie de Vercept AI, une startup basée à Seattle que Anthropic a acquis en février 2026. Vercept a été fondée en novembre 2024 par des chercheurs de l’Institut Allen pour l’IA, Kiana Ehsani, Luca Weihs, Ross Girshick et Matt Deitke, et avait levé 16 millions de dollars dans un cycle de financement initial mené par Fifty Years avant la clôture de l’accord. Les investisseurs providentiels incluaient l’ancien PDG de Google (GOOGL ) Eric Schmidt, le chef des sciences de Google DeepMind Jeff Dean, le fondateur de Cruise Kyle Vogt et le co-fondateur de Dropbox (DBX ) Arash Ferdowsi.

Le produit de Vercept, Vy, fonctionnait comme un agent de contrôle d’ordinateur basé sur le cloud pour Mac. Anthropic a donné aux utilisateurs de Vercept 30 jours de préavis avant de fermer Vy le 25 mars et a absorbé l’équipe. La co-fondatrice Ehsani a déclaré que son équipe « a lancé son premier produit moins de quatre semaines après avoir rejoint Anthropic », en pointant Dispatch comme le résultat de cette course.

Les performances de l’utilisation de l’ordinateur de Claude ont considérablement amélioré depuis qu’Anthropic a tout d’abord introduit la fonctionnalité à la fin de 2024. Sur OSWorld Verified — une évaluation standard pour les modèles d’IA qui opèrent des ordinateurs — les modèles Claude Sonnet ont obtenu un score inférieur à 15 % lors de la publication initiale. Avec Claude Sonnet 4.6, ce chiffre a atteint 72,5 %, approchant la référence humaine d’environ 70-75 % sur la même référence. Les scores Opus 4.6 atteignent 72,7 % sur le même test.

La sécurité et la fiabilité restent des questions ouvertes

Le contrôle de bureau crée des risques que les intégrations basées sur le navigateur ou l’API ne présentent pas. Lorsque Claude opère un bureau en direct, il obtient l’accès à toutes les données visibles sur l’écran, les fichiers ouverts et les applications que l’utilisateur a approuvées. Les recherches antérieures d’Anthropic sur l’utilisation de l’ordinateur ont identifié l’injection de commande — où des instructions malveillantes intégrées dans le contenu à l’écran pouvaient outrepasser l’intention de l’utilisateur — comme une surface d’attaque principale, et Sonnet 4.6 montre une résistance améliorée à cela par rapport aux versions précédentes.

La fiabilité est une préoccupation supplémentaire. L’architecture d’utilisation de l’ordinateur de Claude dans les versions précédentes traitait des captures d’écran séquentielles plutôt que d’un flux vidéo continu, ce qui faisait qu’elle manquait des actions ou des notifications à court terme. Que l’approche de l’équipe Vercept résolve cela à grande échelle n’est pas encore documenté publiquement.

L’agent macOS basé sur le navigateur d’OpenAI et des produits similaires ont rencontré des frictions d’adoption, en partie parce que l’automatisation de bureau se brise facilement lorsque les interfaces logicielles changent. Le choix d’Anthropic de limiter le contrôle de bureau à une position de repli — activé uniquement lorsque les intégrations standard échouent — réduit la surface d’erreur mais réduit également la portée de la fonctionnalité par rapport à un agent de bureau entièrement autonome.

La question plus large est de savoir si les agents d’IA pour l’automatisation des entreprises peuvent passer de manière fiable des démonstrations contrôlées aux environnements de production en direct. Le score de référence de l’utilisation de l’ordinateur de Claude a amélioré de cinq fois en environ 16 mois, ce qui est une trajectoire significative. Mais les gains de référence sur des tâches curatoriales ne prédisent pas toujours les performances dans la réalité plus complexe des environnements macOS en direct — les dialogues inattendus, les mises à jour d’applications et les changements d’état que aucune évaluation ne capture entièrement. La manière dont Anthropic gère les divulgations de sécurité une fois que les chercheurs commencent à tester la fonctionnalité de manière plus systématique sera le premier véritable test de savoir si le contrôle de bureau est prêt à quitter son statut de version de recherche préliminaire. Les ironments — les dialogues inattendus, les mises à jour d’applications et les changements d’état que aucune évaluation ne capture entièrement — seront le premier véritable test de savoir si le contrôle de bureau est prêt à quitter son statut de version de recherche préliminaire.

Alex McFarland est un journaliste et écrivain en intelligence artificielle qui explore les derniers développements en intelligence artificielle. Il a collaboré avec de nombreuses startups et publications en intelligence artificielle dans le monde entier.