BookinglyTech News
Inteligencia artificial

Anthropic ficha a Accenture como evaluador embebido de sus modelos de frontera

Las dos compañías invertirán al menos 1.000 millones de dólares en cinco años en auditar modelos desde dentro, con un acceso comparable al de un empleado.

2 min de lecturaITPro0 vistas

Anthropic ha firmado con Accenture un acuerdo para que la consultora evalúe sus modelos de frontera desde dentro. Accenture hará de evaluador embebido y será Faculty, su división especializada en IA, la que dirija el trabajo. Las dos compañías calculan una inversión conjunta de al menos 1.000 millones de dólares en cinco años para ampliar capacidad en esta área.

El alcance incluye red-teaming de modelos, evaluaciones de alineación y pruebas de las salvaguardas. Anthropic lo explica en el anuncio: Accenture conoce cómo las empresas y los gobiernos despliegan IA en muchos sectores, y esa perspectiva es la que aportará a la evaluación de sus modelos.

Cómo se evalúa un modelo desde dentro

El mecanismo consiste en meter especialistas de Accenture dentro de las organizaciones, en lugar de dejarlos como evaluadores externos. Anthropic dice que tendrán un acceso "comparable al de un empleado" durante las pruebas: eso les permite ver el modelo formarse mientras se entrena, seguir las decisiones que gobiernan cómo se construye y despliega, y hablar directamente con la plantilla. Desde esa posición, el evaluador puede comprobar cómo opera la compañía, verificar que cumple sus compromisos de seguridad, detectar puntos ciegos y reportar incidentes.

La propia Anthropic admite que esto es nuevo y que los detalles concretos están "todavía por definir". También deja claro que el acuerdo no es exclusivo: espera que los laboratorios de frontera trabajen con varios evaluadores a la vez y anuncia que habrá más nombres en las próximas semanas. Accenture hará lo propio con otros desarrolladores.

El contexto

El anuncio llega en un momento de presión sobre la seguridad en IA. Este mes, el consejero delegado de Anthropic, Dario Amodei, publicó un ensayo en el que pedía frenar el ritmo de desarrollo, con el respaldo de figuras como Sam Altman y Elon Musk. No todos están de acuerdo: en Dreamforce 2026, Jensen Huang defendió que la responsabilidad recae en cada compañía. "Si no confiamos en la seguridad de los productos, como todas las empresas, si construyes un producto o un servicio y no confías en su funcionalidad, capacidad o seguridad, no lo lances", dijo.

Lo relevante para quien despliega IA en una empresa es que la evaluación con acceso interno se está convirtiendo en un producto. Anthropic no ha detallado cómo se gobierna la relación entre quien audita y quien encarga la auditoría, ni qué parte de cada informe acaba publicándose. Sin eso, el evaluador embebido es todavía una estructura sin reglas conocidas.