Alianzas

Anthropic recurre a Faculty de Accenture para la evaluación de modelos de IA integrados

mm
Añade Unite.AI a tus fuentes preferidas en Google

Anthropic dijo el 18 de septiembre de 2026 que está asociándose con Accenture en la evaluación independiente de IA de frontera, y que cada empresa espera invertir al menos $1 billion en desarrollar capacidad en el área durante los próximos cinco años.

La asociación será liderada por Faculty, el negocio especializado en IA de Accenture, e incluirá la evaluación y pruebas de resistencia de los modelos, la realización de evaluaciones de alineación y la prueba de salvaguardas de los modelos. Anthropic describió el trabajo como un paso hacia un compromiso, realizado en un ensayo del CEO Dario Amodei de septiembre de 2026, para incorporar evaluadores independientes dentro de la empresa.

Anthropic dijo que Accenture ayuda a empresas y gobiernos a implementar IA en numerosos sectores, y que la comprensión de la firma sobre cómo las organizaciones utilizan la IA en la práctica informa su enfoque de seguridad. Según la compañía, esa perspectiva se aplicará a la evaluación de sus modelos.

Cómo funcionará la evaluación integrada

La evaluación integrada es nueva, y muchos de los detalles sobre su funcionamiento aún se están definiendo, según el anuncio. Mientras que los evaluadores externos existentes trabajan fuera de las empresas que evalúan, los evaluadores integrados trabajarán dentro de las compañías de IA con un acceso comparable al de un empleado.

Anthropic dijo que ese acceso permite a los evaluadores observar cómo los modelos se forman durante el entrenamiento, seguir las decisiones que rigen cómo se construyen y despliegan los modelos, y comunicarse directamente con los empleados. Desde esa posición, los evaluadores pueden evaluar el funcionamiento de una empresa, verificar que cumpla sus compromisos de seguridad e identificar puntos ciegos. También pueden informar incidentes y ofrecer al público una descripción más informada de los beneficios y riesgos, según la compañía.

Anthropic declaró que los evaluadores independientes integrados mantienen su responsabilidad sin cambios, al tiempo que hacen esa responsabilidad más verificable, y que la seguridad de sus modelos sigue siendo su responsabilidad.

Términos de acceso y derechos de publicación

En el ensayo, titulado \”Debemos marcar el ritmo de la frontera\”, Amodei propuso un plan de tres pasos: evaluadores integrados, coordinación entre empresas de IA de frontera en países democráticos y coordinación global. Escribió que Anthropic se comprometía unilateralmente con el primer paso y pidió a los gobiernos que exijan a otras empresas de frontera que lo igualen. \”Debemos ralentizar el ritmo al que mejoramos las capacidades de los modelos de IA\”, escribió. \”El progreso seguirá pareciendo rápido, y debemos hacer un uso prudente del tiempo que ganemos.\”

El ensayo indica que Anthropic pretende invitar a un equipo externo de revisión integrado, equipado con escritorios en sus oficinas, credenciales de acceso y portátiles de la empresa, además de acceso a espacios de trabajo, herramientas y permisos mayormente comparables a los que tienen los equipos internos de evaluación de riesgos. Se aplicarían excepciones en casos como cuando la ley o los contratos lo exijan, o para proteger la información privada de clientes y socios.

Según el enfoque contractual descrito en el ensayo, los revisores externos tendrían el derecho de publicar hallazgos clave sobre niveles de riesgo, incidentes, prácticas y el acceso que recibieron o no, sin control editorial por parte de Anthropic. La compañía mantendría una capacidad limitada para redactar información sensible a la seguridad, legalmente privilegiada, comercialmente confidencial o de terceros, pero no podría redactar hallazgos solo porque sean desfavorables; los revisores podrían declarar públicamente si una redacción eliminó algo importante para sus conclusiones. El ensayo alude a precedentes en la industria bancaria, donde los supervisores regulatorios a veces se integran junto a los empleados.

Preguntas sobre financiación y una estructura no exclusiva

Anthropic dijo que aún no existen normas sobre a qué información deben tener acceso los evaluadores integrados, ni sobre cómo deben informar sus hallazgos, y no hay un sistema definido para financiar la evaluación independiente. A largo plazo, la compañía cree que la financiación debería provenir de fuentes agrupadas o gubernamentales, como solicitó en su Marco de IA Avanzada en junio; como ninguna de estas existe todavía, planea trabajar con diferentes evaluadores bajo distintos esquemas de financiación.

Anthropic financiará directamente el trabajo de Accenture. La compañía también está en diálogo con METR y otros evaluadores sin fines de lucro para pilotar elementos de la evaluación integrada utilizando su propio financiamiento, y declaró que cree que la IA de frontera necesita, en última instancia, un ecosistema de evaluadores que operen con estándares compartidos.

La asociación no es exclusiva. Anthropic dijo que trabajará con otros evaluadores que planea anunciar en las próximas semanas, que espera que los laboratorios de frontera colaboren con varias organizaciones simultáneamente, y que Accenture trabajará con otros desarrolladores de IA en capacidades similares. La compañía afirmó que continuará entrenando y lanzando modelos de frontera, que está compartiendo sus primeros esfuerzos para que personas y otros desarrolladores de IA puedan ver su proceso, que espera que su enfoque evolucione a medida que el campo madure, y que compartirá más a medida que el trabajo comience y se incorporen evaluadores adicionales.

Asociación empresarial anterior

El trabajo de evaluación amplía una relación más amplia que las dos compañías anunciaron el 9 de diciembre de 2025: una asociación plurianual que dio origen al Accenture Anthropic Business Group. Según ese acuerdo, aproximadamente 30 000 profesionales de Accenture recibirán capacitación sobre Claude, Claude Code se pondrá a disposición de decenas de miles de desarrolladores de Accenture, y las compañías lanzaron una oferta conjunta diseñada para ayudar a los CIO a medir el valor y fomentar la adopción de IA en sus organizaciones de ingeniería. El anuncio de diciembre de 2025 también incluyó soluciones iniciales para industrias reguladas, entre ellas servicios financieros, ciencias de la vida, salud y el sector público.

Aiden Cross es un estratega generado por IA en Unite.AI, que cubre la estrategia de productos de IA, la ejecución y los desafíos prácticos de convertir modelos experimentales en productos escalables y listos para el mercado. Su trabajo se centra en cómo los equipos de startups y empresas pasan de prototipos y demos a sistemas confiables utilizados por clientes reales.
Con una perspectiva pragmática y detallada, Aiden analiza las hojas de ruta de productos, las estrategias de lanzamiento al mercado, las decisiones de plataforma y las compensaciones organizativas que determinan si las iniciativas de IA tienen éxito o se estancan. Presta especial atención a las realidades de la implementación, la adopción de los usuarios, las limitaciones de la infraestructura y la alineación entre la capacidad técnica y el valor empresarial.
Los artículos escritos por Aiden Cross son generados por IA y revisados por el equipo editorial de Unite.AI para garantizar la claridad, la precisión y la cobertura responsable de cómo se crean, envían y escalan los productos de IA en el mundo real.