Partnerskap

Anthropic benytter Accenture’s Faculty for innebygd AI-modellvurdering

mm
Legg til Unite.AI blant dine foretrukne kilder på Google

Anthropic sa 18. september 2026 at de samarbeider med Accenture om uavhengig evaluering av frontier‑AI, med at hvert selskap forventer å investere minst $1 milliard i å bygge kapasitet på området i løpet av de neste fem årene.

Partnerskapet vil bli ledet av Faculty, Accenture’s spesialiserte AI‑virksomhet, og vil omfatte evaluering og red‑team‑testing av modeller, gjennomføring av justeringsvurderinger og testing av modellbeskyttelser. Anthropic beskrev arbeidet som et steg mot en forpliktelse, gjort i et september 2026 essay av CEO Dario Amodei, om å integrere uavhengige evaluatorer i selskapet.

Anthropic sa at Accenture hjelper bedrifter og myndigheter med å implementere AI på tvers av mange industrier, og at selskapets forståelse av hvordan virksomheter bruker AI i praksis informerer deres sikkerhetstilnærming. Det perspektivet, sa selskapet, vil bli brukt til å evaluere deres modeller.

Hvordan innebygd evaluering vil fungere

Innebygd evaluering er ny, og mange av detaljene om hvordan den vil fungere er fortsatt under utarbeidelse, ifølge kunngjøringen. Hvor eksisterende eksterne evaluatorer arbeider utenfor selskapene de vurderer, vil innebygde evaluatorer arbeide innen AI‑selskaper med tilgang som er sammenlignbar med en ansatts.

Den tilgangen, sa Anthropic, gjør det mulig for evaluatorer å observere modeller mens de formes i trening, følge beslutningene som styrer hvordan modeller bygges og distribueres, og snakke direkte med ansatte. Fra dette ståstedet kan evaluatorer vurdere hvordan et selskap opererer, verifisere at det holder sine sikkerhetsforpliktelser, og identifisere blindsoner. De kan også rapportere hendelser og gi publikum en mer informert redegjørelse for fordeler og risikoer, sa selskapet.

Anthropic uttalte at uavhengige innebygde evaluatorer ikke endrer selskapets ansvar, men gjør dette ansvaret mer etterprøvelig, og at sikkerheten til modellene fortsatt er selskapets ansvar.

Tilgangsvilkår og publiseringsrettigheter

I essayet, med tittelen “Vi må holde tempoet i frontlinjen”, foreslo Amodei en tretrinnsplan: innebygde evaluatorer, koordinering blant frontier‑AI‑selskaper i demokratiske land, og global koordinering. Han skrev at Anthropic ensidig forpliktet seg til det første trinnet og oppfordret myndighetene til å kreve at andre frontier‑AI‑selskaper gjør det samme. «Vi må senke tempoet vi forbedrer AI‑modellers evner på», skrev han. «Fremdriften vil fortsatt virke rask, og vi må bruke den tiden vi får på en klok måte.»

Essayet sier at Anthropic har til hensikt å invitere et innebygd eksternt gjennomgangsteam utstyrt med skrivebord på sine kontorer, adgangskort og selskapets bærbare PC‑er, samt tilgang til arbeidsområder, verktøy og tillatelser som for det meste er sammenlignbare med det interne risikovurderingsteamet har. Unntak vil gjelde i tilfeller som der loven eller kontrakter krever det, eller for å beskytte kunders og partneres private informasjon.

I henhold til kontraktstilnærmingen beskrevet i essayet, ville eksterne gjennomgangere ha rett til å publisere nøkkelfunn om risikonivåer, hendelser, praksiser og den tilgangen de fikk eller ikke fikk, uten redaksjonell kontroll fra Anthropic. Selskapet ville beholde en begrenset mulighet til å redigere sikkerhets‑sensitive, juridisk privilegerte, kommersielt sensitive eller tredjeparts‑konfidensielle opplysninger, men kunne ikke fjerne funn kun fordi de er ugunstige; gjennomgangere kunne offentlig si dersom en redigering fjernet noe viktig for deres konklusjoner. Essayet peker på presedens i banksektoren, hvor regulatoriske tilsynsmyndigheter noen ganger er innebygd sammen med ansatte.

Finansieringsspørsmål og en ikke‑eksklusiv struktur

Anthropic sa at det foreløpig ikke finnes noen standarder for hvilken informasjon innebygde evaluatorer skal ha tilgang til, eller hvordan de skal rapportere sine funn, og at det ikke finnes et etablert system for finansiering av uavhengig evaluering. På lang sikt mener selskapet at finansiering bør komme fra samlete eller offentlige kilder, som de etterlyste i sin Advanced AI Framework i juni; siden ingen slike kilder finnes ennå, planlegger de å samarbeide med ulike evaluatorer under ulike finansieringsordninger.

Anthropic vil finansiere Accenture sitt arbeid direkte. Selskapet er også i dialog med METR og andre ideelle evaluatorer for å pilotere elementer av innebygd evaluering med deres egen finansiering, og de sa at de tror frontier‑AI på sikt trenger et økosystem av evaluatorer som opererer med felles standarder.

Partnerskapet er ikke‑eksklusivt. Anthropic sa at de vil samarbeide med andre evaluatorer de planlegger å kunngjøre i løpet av de kommende ukene, at de forventer at frontier‑labber vil arbeide med flere organisasjoner samtidig, og at Accenture vil samarbeide med andre AI‑utviklere i lignende roller. Selskapet sa at de vil fortsette å trene og slippe frontier‑modeller, deler sine tidlige innsatsområder slik at folk og andre AI‑utviklere kan se prosessen, forventer at tilnærmingen vil utvikle seg etter hvert som feltet modnes, og vil dele mer etter hvert som arbeidet starter og flere evaluatorer blir med.

Tidligere bedriftspartnerskap

Evalueringen utvider et bredere forhold de to selskapene kunngjorde 9. desember 2025: et flereårig partnerskap som dannet Accenture Anthropic Business Group. I henhold til avtalen skal omtrent 30 000 Accenture‑ansatte få opplæring i Claude, Claude Code gjøres tilgjengelig for titusenvis av Accenture‑utviklere, og selskapene lanserte et felles tilbud designet for å hjelpe CIOs med å måle verdi og drive AI‑adopsjon i deres ingeniørorganisasjoner. Kunngjøringen i desember 2025 inkluderte også innledende bransjeløsninger for regulerte sektorer, blant dem finansielle tjenester, livsvitenskap, helsevesen og offentlig sektor.

Aiden Cross er en AI-generert strateg hos Unite.AI, som dekker AI-produktstrategi, gjennomføring og de praktiske utfordringene ved å omdanne eksperimentelle modeller til skalerbare, markedsklare produkter. Hans arbeid fokuserer på hvordan startups og bedrifter går fra prototyper og demonstrasjoner til pålitelige systemer som brukes av ekte kunder.
Med en pragmatisk og detaljorientert perspektiv, analyserer Aiden produktveikart, markedsstrategier, plattformbeslutninger og organisatoriske kompromisser som avgjør om AI-initiativer lykkes eller stopper. Han legger særlig vekt på deployeringsrealiteter, brukeradopsjon, infrastrukturbegrensninger og sammenligningen mellom teknisk evne og forretningsverdi.
Artikler skrevet av Aiden Cross er AI-generert og gjennomgått av Unite.AIs redaksjonsteam for å sikre klarhet, nøyaktighet og ansvarlig dekning av hvordan AI-produkter bygges, sendes og skaleres i den virkelige verden.