Партнерства

Anthropic залучає Faculty компанії Accenture для вбудованої оцінки моделей ШІ

mm
Додайте Unite.AI до бажаних джерел у Google

Anthropic заявив 18 вересня 2026 року, що співпрацює з Accenture над незалежною оцінкою передових ШІ, причому кожна компанія очікує інвестувати щонайменше $1 billion у створення потужностей у цій галузі протягом наступних п’яти років.

Партнерство буде очолювати Faculty, спеціалізований підрозділ ШІ компанії Accenture, і включатиме оцінку та “red‑team” моделей, проведення оцінок узгодженості та тестування захисних механізмів моделей. Anthropic описав цю роботу як крок до зобов’язання, викладеного у вересневому 2026 року есе від CEO Dario Amodei, вбудувати незалежних оцінювачів у компанію.

Anthropic зазначив, що Accenture допомагає підприємствам і урядам впроваджувати ШІ в різних галузях, а розуміння фірмою того, як компанії використовують ШІ на практиці, формує її підхід до безпеки. За словами компанії, ця перспектива буде застосована під час оцінки її моделей.

Як працюватиме вбудована оцінка

Вбудована оцінка є новою, і багато деталей щодо її функціонування ще уточнюються, згідно з оголошенням. У той час як зовнішні оцінювачі працюють поза компаніями, які вони оцінюють, вбудовані оцінювачі працюватимуть всередині компаній ШІ з доступом, подібним до доступу співробітника.

За словами Anthropic, такий доступ дозволяє оцінювачам спостерігати за формуванням моделей під час навчання, слідкувати за рішеннями, які визначають, як моделі створюються та впроваджуються, і спілкуватися безпосередньо з працівниками. З такої позиції оцінювачі можуть оцінювати роботу компанії, перевіряти дотримання нею зобов’язань щодо безпеки та виявляти «сліпі зони». Вони також можуть повідомляти про інциденти та надавати громадськості більш інформовану оцінку переваг і ризиків, зазначає компанія.

Anthropic зазначив, що незалежні вбудовані оцінювачі не змінюють його підзвітність, а лише роблять її більш перевіряємою, і що безпека його моделей залишається його відповідальністю.

Умови доступу та права на публікацію

У есе під назвою “Ми маємо регулювати темп фронтиру” Амодей запропонував трьохетапний план: вбудовані оцінювачі, координація між компаніями передового ШІ у демократичних країнах та глобальна координація. Він зазначив, що Anthropic односторонньо зобов’язується до першого кроку і закликав уряди вимагати від інших компаній передового ШІ відповідності цьому. “Ми повинні сповільнити темп, з яким ми покращуємо можливості моделей ШІ”, — написав він. “Прогрес все одно виглядатиме швидким, і ми маємо розумно використовувати отриманий час”.

У есе зазначається, що Anthropic планує запросити вбудовану зовнішню команду рецензентів, обладнану робочими місцями в його офісах, пропускними картками та корпоративними ноутбуками, а також доступом до робочих просторів, інструментів і прав, переважно порівнянними з тими, що мають внутрішні команди оцінки ризиків. Винятки будуть застосовуватись у випадках, коли це вимагає закон або контракти, або для захисту конфіденційної інформації клієнтів та партнерів.

За контрактним підходом, описаним у есе, зовнішні рецензенти матимуть право публікувати ключові висновки щодо рівнів ризику, інцидентів, практик та доступу, який вони отримали або не отримали, без редакційного контролю з боку Anthropic. Компанія залишатиме обмежену можливість редагувати інформацію, чутливу до безпеки, юридично привілейовану, комерційно конфіденційну або конфіденційну третіх осіб, але не зможе редагувати висновки лише через їхню несприятливість; рецензенти зможуть публічно заявити, якщо редагування прибрало щось важливе для їхніх висновків. У есе згадується прецедент у банківській індустрії, де регуляторні наглядові органи іноді вбудовуються разом із працівниками.

Питання фінансування та неексклюзивна структура

Anthropic зазначив, що наразі не існує стандартів щодо того, до якої інформації мають мати доступ вбудовані оцінювачі, або як вони мають повідомляти про свої знахідки, а також немає встановленої системи фінансування незалежної оцінки. У довгостроковій перспективі компанія вважає, що фінансування має надходити з об’єднаних або державних джерел, як це було зазначено у її Advanced AI Framework у червні; оскільки жодного з цих джерел ще не існує, вона планує співпрацювати з різними оцінювачами за різними фінансовими умовами.

Anthropic буде фінансувати роботу Accenture безпосередньо. Компанія також веде діалог з METR та іншими некомерційними оцінювачами щодо пілотного впровадження елементів вбудованої оцінки за їх власне фінансування, і зазначила, що вважає, що передовий ШІ зрештою потребує екосистеми оцінювачів, які працюватимуть за спільними стандартами.

Партнерство є неексклюзивним. Anthropic заявив, що буде співпрацювати з іншими оцінювачами, яких планує оголосити протягом наступних тижнів, що очікує, що передові лабораторії працюватимуть одночасно з кількома організаціями, і що Accenture співпрацюватиме з іншими розробниками ШІ у подібних ролях. Компанія зазначила, що продовжуватиме навчати та випускати передові моделі, ділиться своїми початковими зусиллями, щоб люди та інші розробники ШІ могли бачити її процес, очікує, що її підхід буде розвиватися зі зрілістю галузі, і поділиться додатковою інформацією, коли робота розпочнеться і приєднаються нові оцінювачі.

Попереднє корпоративне партнерство

Робота з оцінки розширює ширшу взаємодію, яку дві компанії оголосили 9 грудня 2025 року: багаторічне партнерство, яке створило Accenture Anthropic Business Group. За цим договором приблизно 30,000 професіоналів Accenture мають пройти навчання з Claude, Claude Code стає доступним для десятків тисяч розробників Accenture, і компанії запустили спільну пропозицію, розроблену для допомоги CIO у вимірюванні вартості та впровадженні ШІ в їхніх інженерних організаціях. Оголошення грудня 2025 року також включало початкові галузеві рішення для регульованих секторів, серед яких фінансові послуги, науки про життя, охорона здоров’я та державний сектор.

Ейден Кросс - стратег, створений штучним інтелектом у Unite.AI, який охоплює стратегію продукції штучного інтелекту, виконання та практичні виклики перетворення експериментальних моделей у масштабовані, готові до ринку продукти. Його робота зосереджена на тому, як стартапи та підприємства переходять від прототипів та демонстрацій до надійних систем, які використовують реальні клієнти.
З прагматичною та детальною перспективою Ейден аналізує дорожні карти продукції, стратегії виходу на ринок, рішення щодо платформи та організаційні компроміси, які визначають, чи успішні чи застряють ініціативи штучного інтелекту. Він приділяє особливу увагу реаліям розгортання, прийняттю користувачами, обмеженням інфраструктури та узгодженню між технічними можливостями та бізнес-цінністю.
Статті, написані Ейденом Кроссом, створені штучним інтелектом та перевірені редакційною командою Unite.AI, щоб забезпечити ясність, точність та відповідальне висвітлення того, як продукти штучного інтелекту створюються, відправляються та масштабуються у реальному світі.