Partnerstwa
Anthropic sięga po Faculty firmy Accenture do oceny osadzonych modeli AI

Anthropic oświadczył 18 września 2026, że współpracując z Accenture przy niezależnej ocenie AI na pograniczu, przy czym każda z firm spodziewa się zainwestować co najmniej $1 billion w budowanie zdolności w tym obszarze w ciągu najbliższych pięciu lat.
Partnerstwo będzie prowadzone przez Faculty, specjalistyczny dział AI Accenture, i będzie obejmować ocenę i testy red‑team modeli, przeprowadzanie ocen zgodności oraz testowanie zabezpieczeń modeli. Anthropic opisał tę pracę jako krok w kierunku zobowiązania, podjętego we wrześniu 2026 esej CEO Dario Amodei, do włączenia niezależnych oceniających w strukturę firmy.
Anthropic stwierdził, że Accenture pomaga przedsiębiorstwom i rządom wdrażać AI w wielu branżach, a zrozumienie przez firmę, jak przedsiębiorstwa wykorzystują AI w praktyce, kształtuje jej podejście do bezpieczeństwa. Według firmy, ta perspektywa zostanie zastosowana przy ocenie jej modeli.
Jak będzie działać osadzona ocena
Osadzona ocena jest nowa i wiele szczegółów dotyczących jej funkcjonowania jest wciąż opracowywanych, według ogłoszenia. Tam, gdzie istniejący zewnętrzni oceniający pracują poza firmami, które oceniają, osadzeni oceniający będą działać wewnątrz firm AI z dostępem porównywalnym do pracownika.
Według Anthropic, taki dostęp pozwala oceniającym obserwować, jak modele kształtują się w trakcie treningu, śledzić decyzje regulujące sposób budowy i wdrażania modeli oraz rozmawiać bezpośrednio z pracownikami. Z tej perspektywy oceniający mogą ocenić, jak firma działa, zweryfikować, że spełnia zobowiązania bezpieczeństwa, oraz zidentyfikować luki. Mogą także zgłaszać incydenty i przekazywać opinii publicznej bardziej poinformowany obraz korzyści i ryzyk, jak podkreśliła firma.
Anthropic oświadczył, że niezależni osadzeni oceniający nie zmieniają jej odpowiedzialności, jednocześnie czyniąc ją bardziej weryfikowalną, a bezpieczeństwo jej modeli pozostaje jej odpowiedzialnością.
Warunki dostępu i prawa publikacji
W eseju, zatytułowanym “Musimy nadążać za granicą”, Amodei zaproponował trzyetapowy plan: osadzonych oceniających, koordynację pomiędzy firmami AI na pograniczu w demokratycznych krajach oraz globalną koordynację. Napisał, że Anthropic jednostronnie zobowiązuje się do pierwszego kroku i wezwał rządy, aby wymagały od innych firm AI na pograniczu podjęcia podobnych działań. “Musimy spowolnić tempo, w jakim ulepszamy możliwości modeli AI,” napisał. “Postęp nadal będzie wydawał się szybki i musimy mądrze wykorzystać zyskany czas.”
Esej stwierdza, że Anthropic zamierza zaprosić zewnętrzny zespół recenzujący, osadzony w firmie, wyposażony w biurka w jej biurach, identyfikatory dostępu i firmowe laptopy, a także dostęp do przestrzeni roboczych, narzędzi i uprawnień w dużej mierze porównywalnych z tymi, które posiadają wewnętrzne zespoły oceny ryzyka. Wyjątki będą stosowane w przypadkach, gdy wymaga tego prawo lub umowy, lub w celu ochrony prywatnych informacji klientów i partnerów.
Zgodnie z podejściem kontraktowym opisanym w eseju, zewnętrzni recenzenci mieliby prawo publikować kluczowe ustalenia dotyczące poziomów ryzyka, incydentów, praktyk oraz dostępu, który uzyskali lub nie uzyskali, bez kontroli redakcyjnej ze strony Anthropic. Firma zachowałaby wąską możliwość redagowania informacji wrażliwych pod względem bezpieczeństwa, objętych tajemnicą prawną, komercyjnie wrażliwych lub poufnych danych osób trzecich, ale nie mogłaby usuwać ustaleń jedynie dlatego, że są niekorzystne; recenzenci mogliby publicznie stwierdzić, że redakcja usunęła coś istotnego dla ich wniosków. Esej przywołuje precedens w sektorze bankowym, gdzie regulatorzy czasami są osadzeni razem z pracownikami.
Pytania dotyczące finansowania i struktura nieekskluzywna
Anthropic stwierdził, że nie istnieją jeszcze standardy określające, do jakich informacji osadzeni oceniający powinni mieć dostęp, ani jak powinni raportować swoje ustalenia, oraz brak ustalonego systemu finansowania niezależnej oceny. Długoterminowo firma uważa, że finansowanie powinno pochodzić z funduszy zbiorowych lub źródeł rządowych, co wezwała w swoim Advanced AI Framework w czerwcu; ponieważ żadne z nich jeszcze nie istnieje, planuje współpracować z różnymi oceniającymi w ramach odmiennych modeli finansowania.
Anthropic będzie finansować pracę Accenture bezpośrednio. Firma prowadzi także dialog z METR i innymi organizacjami non‑profit oceniającymi, aby pilotażowo wdrażać elementy osadzonej oceny przy użyciu własnych środków, i twierdzi, że AI na pograniczu ostatecznie potrzebuje ekosystemu oceniających działających według wspólnych standardów.
Partnerstwo jest nieekskluzywne. Anthropic oświadczył, że będzie współpracować z innymi oceniającymi, których planuje ogłosić w nadchodzących tygodniach, że spodziewa się, iż laboratoria AI na pograniczu będą współpracować jednocześnie z kilkoma organizacjami, oraz że Accenture będzie współpracować z innymi deweloperami AI w podobnych rolach. Firma poinformowała, że będzie kontynuować trening i udostępnianie modeli AI na pograniczu, udostępnia swoje wczesne prace, aby ludzie i inni deweloperzy AI mogli zobaczyć jej proces, oczekuje, że jej podejście będzie ewoluować wraz z dojrzewaniem dziedziny, i będzie przekazywać więcej informacji w miarę rozpoczynania prac i dołączania kolejnych oceniających.
Wcześniejsze partnerstwo korporacyjne
Prace ewaluacyjne rozszerzają szerszy związek, który dwie firmy ogłosiły 9 grudnia 2025 r.: partnerstwo wieloletnie tworzące Accenture Anthropic Business Group. Zgodnie z tą umową około 30 000 pracowników Accenture ma otrzymać szkolenie z Claude, Claude Code ma być udostępniony dziesiątkom tysięcy deweloperów Accenture, a firmy uruchomiły wspólną ofertę mającą pomóc dyrektorom IT mierzyć wartość i przyspieszać przyjmowanie AI w ich organizacjach inżynieryjnych. Ogłoszenie z grudnia 2025 r. obejmowało także wstępne rozwiązania branżowe dla sektorów regulowanych, w tym usług finansowych, nauk przyrodniczych, opieki zdrowotnej oraz sektora publicznego.












