파트너십
Anthropic, 임베디드 AI 모델 평가를 위해 Accenture의 Faculty와 협업

Anthropic는 2026년 9월 18일에 Accenture와 최전선 AI에 대한 독립 평가를 위해 파트너십을 맺고 있다고 밝혔으며, 양사는 향후 5년 동안 해당 분야에 최소 10억 달러를 투자할 예정이라고 밝혔다.
이 파트너십은 Accenture의 전문 AI 사업부인 Faculty가 주도하며, 모델 평가 및 레드팀 작업, 정렬 평가 수행, 모델 안전장치 테스트 등을 포함합니다. Anthropic는 이 작업을 2026년 9월에 발표된 CEO Dario Amodei가 쓴 에세이에서 제시한 독립 평가자를 회사 내에 배치하겠다는 약속을 향한 단계라고 설명했습니다.
Anthropic는 Accenture가 다양한 산업 분야에서 기업과 정부가 AI를 배포하도록 지원하며, 기업이 실제로 AI를 어떻게 활용하는지에 대한 이해가 자사의 안전 접근 방식에 반영된다고 밝혔습니다. 회사는 이 관점을 자사 모델 평가에 적용할 것이라고 말했습니다.
임베디드 평가가 작동하는 방식
임베디드 평가는 새로운 개념이며, 어떻게 운영될지에 대한 세부 사항 대부분이 아직 논의 중이라고 발표는 전했습니다. 기존 외부 평가자는 평가 대상 기업 외부에서 활동하지만, 임베디드 평가는 AI 기업 내부에서 직원과 유사한 접근 권한을 가지고 작업하게 됩니다.
Anthropic는 이러한 접근 권한을 통해 평가자는 모델이 훈련되는 과정을 관찰하고, 모델이 구축·배포되는 방식을 결정하는 의사결정을 추적하며, 직원과 직접 대화할 수 있다고 밝혔습니다. 이러한 위치에서 평가자는 기업 운영 방식을 평가하고, 안전 약속을 이행하고 있는지 확인하며, 사각지대를 식별할 수 있습니다. 또한 평가자는 사건을 보고하고, 대중에게 혜택과 위험에 대한 보다 정보에 기반한 설명을 제공할 수 있다고 회사는 말했습니다.
Anthropic는 독립적인 임베디드 평가자가 책임성을 변경하지 않으면서도 그 책임성을 보다 검증 가능하게 만든다고 밝히며, 모델의 안전은 여전히 자사의 책임이라고 강조했습니다.
접근 조건 및 공개 권리
에세이에서 제목이 “우리는 전선의 속도를 맞춰야 한다”인 이 글에서, Amodei는 세 단계 계획을 제안했습니다: 임베디드 평가자, 민주주의 국가의 최전선 AI 기업 간 협조, 그리고 전 세계적 협조. 그는 Anthropic가 첫 번째 단계에 대해 일방적으로 약속하고 있으며, 다른 최전선 기업도 이를 따라야 한다고 정부에 요구했습니다. “우리는 AI 모델의 능력 향상 속도를 늦춰야 합니다,”라고 그는 적었습니다. “진보는 여전히 빠르게 보일 것이며, 우리는 얻은 시간을 현명하게 활용해야 합니다.”
이 에세이는 Anthropic가 사무실에 책상이 배치된 외부 임베디드 검토 팀을 초대하고, 접근 배지와 회사 노트북을 제공하며, 내부 위험 평가 팀이 갖는 대부분의 작업 공간, 도구 및 권한에 비슷한 접근을 허용할 계획이라고 명시합니다. 법률이나 계약상 요구가 있거나 고객 및 파트너의 개인정보를 보호해야 하는 경우와 같은 예외는 적용될 것입니다.
에세이에 설명된 계약 방식에 따르면, 외부 검토자는 위험 수준, 사건, 관행 및 그들이 받은(또는 받지 못한) 접근에 관한 주요 결과를 Anthropic의 편집 통제 없이 공개할 권리를 가집니다. 회사는 보안에 민감한, 법적 특권이 있는, 상업적으로 민감한 또는 제3자 기밀 정보를 제한적으로 삭제할 수는 있지만, 불리한 결과라서 삭제할 수는 없습니다; 검토자는 삭제가 그들의 결론에 중요한 내용을 제거했다면 공개적으로 이를 밝힐 수 있습니다. 이 에세이는 은행업계의 선례를 언급하는데, 규제 감독기관이 때때로 직원과 함께 임베디드되는 경우가 있습니다.
자금 조달 질문 및 비독점 구조
Anthropic는 아직 임베디드 평가자가 어떤 정보에 접근해야 하는지, 발견을 어떻게 보고해야 하는지에 대한 표준이 없으며, 독립 평가를 위한 자금 조달 체계도 확립되지 않았다고 밝혔습니다. 장기적으로는 6월에 발표한 Advanced AI Framework에서 제시한 바와 같이, 자금은 풀링된 자원이나 정부 출처에서 나와야 한다고 믿고 있습니다; 아직 그런 체계가 존재하지 않으므로, 다양한 자금 조달 방식을 가진 평가자들과 협력할 계획입니다.
Anthropic는 Accenture의 작업을 직접 자금 지원할 예정입니다. 또한 METR 및 기타 비영리 평가자들과 대화를 나누며 자체 자금을 이용한 임베디드 평가 요소를 파일럿으로 진행하고 있으며, 최전선 AI에는 궁극적으로 공유 표준을 갖춘 평가자 생태계가 필요하다고 믿는다고 밝혔습니다.
이 파트너십은 비독점적입니다. Anthropic는 향후 몇 주 안에 발표할 다른 평가자들과도 협력할 것이며, 최전선 연구소들이 동시에 여러 조직과 협력할 것으로 예상하고, Accenture도 유사한 역할로 다른 AI 개발자들과 협력할 것이라고 밝혔습니다. 회사는 최전선 모델을 계속 교육·출시하고, 초기 작업을 공유하여 사람들과 다른 AI 개발자들이 그 과정을 볼 수 있게 하며, 분야가 성숙함에 따라 접근 방식이 진화할 것이며, 작업이 시작되고 추가 평가자가 참여함에 따라 더 많은 정보를 공유할 것이라고 전했습니다.
이전 기업 파트너십
평가 작업은 두 회사가 2025년 12월 9일에 발표한 보다 넓은 관계를 확장합니다: 다년 파트너십을 통해 Accenture Anthropic Business Group이 형성되었습니다. 해당 계약에 따라 약 30,000명의 Accenture 전문가가 Claude 교육을 받게 되며, Claude Code는 수만 명의 Accenture 개발자에게 제공되고, 양사는 CIO가 가치를 측정하고 엔지니어링 조직 전반에 AI 도입을 촉진하도록 설계된 공동 솔루션을 출시했습니다. 2025년 12월 발표에는 규제 부문을 위한 초기 산업 솔루션도 포함되었으며, 여기에는 금융 서비스, 생명 과학, 의료, 공공 부문이 포함됩니다.












