Modele i platformy AI

Anthropic Przynosi Kontrolę Pulpitu Claude na Mac

mm
Dodaj Unite.AI do preferowanych źródeł w Google

Anthropic rozszerzył możliwości Claude’a, aby obejmowały bezpośrednią kontrolę pulpitu na macOS, pozwalając AI na klikanie, wprowadzanie tekstu i nawigację w aplikacjach na komputerze użytkownika, gdy standardowe integracje z narzędziami takimi jak Slack i aplikacje kalendarza są niedostępne.

Funkcja jest dostępna teraz jako podgląd badań wewnątrz Claude Cowork i Claude Code dla subskrybentów Claude Pro ($20/miesiąc) i Claude Max ($100/miesiąc). Obecnie jest ograniczona do macOS.

Jak Działa Kontrola Pulpitu

Claude nie domyślnie korzysta z kontroli pulpitu. System najpierw próbuje wykonać zadania za pomocą istniejących integracji z aplikacjami — połączonych kalendarzy, Slacka lub innych obsługiwanych narzędzi. Dopiero gdy nie ma dostępnej integracji, Claude przejmuje kontrolę nad myszą i klawiaturą, aby wykonać zadanie bezpośrednio.

Użytkownicy muszą wyraźnie zatwierdzić każdą aplikację, której Claude jest dozwolony kontrolować, i mogą zatrzymać Claude’a w dowolnym momencie podczas sesji. Projekt odzwierciedla deklarowaną przez Anthropic priorytet utrzymania ludzi w pętli podczas fazy podglądu badań.

Wraz z kontrolą pulpitu Anthropic wydał Dispatch — funkcję towarzyszącą, która pozwala użytkownikom przypisać zadania do Claude’a z ich iPhone’a i wrócić do ukończonej pracy na swoim pulpicie. Aplikacja mobilna łączy się z aktywną sesją Cowork, a wszystkie przetwarzanie odbywa się lokalnie na Macu.

Nabycie Vercept Stanowi Podstawę Technologii

Możliwość ta opiera się na technologii od Vercept AI, startupu z Seattle, który Anthropic nabył w lutym 2026. Vercept został założony w listopadzie 2024 roku przez byłych badaczy Allen Institute for AI: Kianę Ehsani, Lucę Weihsa, Rossa Girshicka i Matta Deitke, i zebrał 16 milionów dolarów w rundzie seedowej pod przewodnictwem Fifty Years przed zamknięciem transakcji. Inwestorzy aniołowie obejmowali byłego CEO Google’ (GOOGL ) a Erica Schmidta, głównego naukowca Google DeepMind Jeffa Deana, założyciela Cruise Kyle’a Vogta i współzałożyciela Dropboxa Arasha Ferdowsiego.

Produkt Vercept, Vy, działał jako agent kontroli komputera oparty na chmurze dla Mac. Anthropic dał użytkownikom Vercept 30 dni na powiadomienie przed zamknięciem Vy 25 marca i wchłonął zespół. Założycielka Ehsani powiedziała, że jej zespół “wydał swój pierwszy produkt mniej niż cztery tygodnie po dołączeniu do Anthropic”, wskazując na Dispatch jako efekt tego sprintu.

Wydajność użycia komputera przez Claude’a znacznie się poprawiła od czasu, gdy Anthropic po raz pierwszy wprowadził tę funkcjonalność pod koniec 2024 roku. Na OSWorld Verified — standardowej ocenie dla modeli AI, które operują komputerami — modele Claude Sonnet uzyskały wynik poniżej 15% przy pierwszym wydaniu. Z modelem Claude Sonnet 4.6 ten wskaźnik wyniósł 72,5%, zbliżając się do ludzkiej bazy odniesienia wynoszącej około 70–75% w tym samym teście. Modele Opus 4.6 uzyskały wynik 72,7% w tym samym teście.

Bezpieczeństwo i Niezawodność Pozostają Otwartymi Pytaniami

Kontrola pulpitu tworzy ryzyka, których nie ma kontrola oparta na przeglądarce lub integracjach API. Gdy Claude operuje na żywo pulpitem, uzyskuje dostęp do wszelkich widocznych danych na ekranie, otwartych plików i aplikacji, które użytkownik zatwierdził. Poprzednie badania Anthropic nad użyciem komputera zidentyfikowały wstrzyknięcie podpowiedzi — gdzie złe instrukcje osadzone w zawartości na ekranie mogą zastąpić intencję użytkownika — jako główną powierzchnię ataku, a model Sonnet 4.6 wykazuje poprawioną odporność na to w porównaniu z wcześniejszymi wersjami.

Niezawodność jest dodatkową kwestią. Poprzednia architektura użycia komputera przez Claude’a przetwarzała sekwencję zrzutów ekranu zamiast ciągłego strumienia wideo, powodując, że przegapił krótkotrwałe akcje lub powiadomienia. Czy podejście zespołu Vercept rozwiązuje to w skali, nie jest jeszcze udokumentowane publicznie.

Własny agent macOS oparty na przeglądarce OpenAI i podobne produkty spotkały się z oporem wdrożeniowym, częściowo dlatego, że automatyzacja pulpitu łatwo ulega awariom, gdy interfejsy oprogramowania ulegają zmianie. Wybór Anthropic, aby ograniczyć kontrolę pulpitu do pozycji awaryjnej — aktywowanej tylko wtedy, gdy standardowe integracje nie powiodą się — redukuje powierzchnię błędów, ale także zawęża zakres funkcji w porównaniu z w pełni autonomicznym agentem pulpitu.

(DBX )

Większe pytanie brzmi, czy agenci AI do automatyzacji biznesu mogą niezawodnie przechodzić od kontrolowanych demonstracji do środowisk produkcyjnych. Wynik punktowy użycia komputera przez Claude’a poprawił się pięciokrotnie w ciągu około 16 miesięcy, co jest znaczącą trajektorią. Ale zyski punktowe na zadaniach opracowanych nie zawsze przewidują wyniki w rzeczywistości środowisk macOS — nieoczekiwane dialogi, aktualizacje aplikacji i zmiany stanu, których żadna ocena w pełni nie ujmuje. Jak Anthropic zajmie się ujawnieniami bezpieczeństwa, gdy badacze zaczną badać tę funkcję bardziej systematycznie, będzie pierwszym prawdziwym testem, czy kontrola pulpitu jest gotowa opuścić swój status podglądu badań.

Alex prowadzi operacje informacyjne zasilane AI w Unite.AI, łącząc dziennikarstwo, badania i automatyzację, aby wspierać terminowe i skalowalne relacjonowanie sztucznej inteligencji. Jego praca pomaga zapewnić, że nowe osiągnięcia w dziedzinie AI są prezentowane efektywnie, przy zachowaniu standardów redakcyjnych publikacji.