Anthropic publica tres métricas que revelan el papel de Claude en I+D, supervisión de agentes y cómputo de seguridad
Anthropic dio a conocer el 17 de septiembre de 2026 tres métricas internas que cuantifican la contribución de Claude a la investigación, la escala de supervisión de agentes y la parte del cómputo destinada a la seguridad, ofreciendo un referente directo para los laboratorios de IA.

El 17 de septiembre de 2026 Anthropic publicó tres métricas diseñadas para medir el ritmo del desarrollo de IA en los principales laboratorios. Las métricas se centran en tres áreas: la proporción del trabajo de investigación y desarrollo (I+D) impulsado directamente por el modelo insignia Claude, el número de agentes autónomos que operan en la plataforma interna de Anthropic y la fracción del cómputo asignada a tareas relacionadas con la seguridad.
Participación de Claude en el trabajo de I+D
Según los datos de la compañía, Claude lidera actualmente el 26 % de la carga de trabajo de I+D medida. En la práctica, esto significa que Claude recibe una instrucción de alto nivel, ejecuta la mayor parte de la tarea de principio a fin y luego entrega el resultado a un revisor humano para su validación.
Anthropic también indica que Claude aporta de forma sustancial a más del 90 % de la I+D medida, aunque nunca opera de forma totalmente autónoma en ninguna parte evaluada del trabajo. La distinción es importante: el modelo puede manejar el núcleo de una tarea, pero la responsabilidad final sigue recayendo en supervisores humanos.
Los puntos de referencia históricos muestran un crecimiento rápido. En febrero de 2026 la métrica de trabajo dirigido por Claude se registró en cero. En marzo de 2026 otra medición citada por Bright situó la cifra en el 1 %. La métrica de septiembre de 2026, por tanto, refleja un aumento pronunciado, aunque los dos valores anteriores usaron una metodología distinta y no pueden combinarse directamente con los datos más recientes.
Escala de supervisión de agentes
La plataforma interna de Anthropic alberga aproximadamente 30 000 agentes que realizan simultáneamente tareas de investigación e ingeniería. Estos agentes son monitorizados por una versión de Claude que clasifica cada pieza de trabajo según la escala de automatización Epoch AI, tras lo cual los humanos verifican las clasificaciones.
Bright informó que en agosto se tomaron más de mil millones de decisiones por el sistema, y solo una decisión de cada 47 000 fue bloqueada por los controles internos de seguridad. Esta cifra proviene de los propios controles internos de Anthropic y muestra la baja tasa de intervención manual a gran escala.
Cómputo dedicado a la seguridad
Una captura tomada entre el 13 y el 20 de julio de 2026 muestra que el 6 % del cómputo total asignado a la I+D de IA se destinó a actividades relacionadas con la seguridad. Cuando el cómputo se limita a la parte de I+D realizada por sistemas de IA, la proporción de seguridad aumenta al 12 %.
Anthropic subraya que las tres métricas se generan con sus datos y modelos propios. Son un punto de partida para el debate sectorial y aún no han sido validadas por auditores externos, ni pretenden ser medidas universales del progreso.
- Claude lidera el 26 % del trabajo de I+D medido
- Claude contribuye a más del 90 % de las tareas de I+D medidas
- 30 000 agentes operan simultáneamente en la plataforma interna
- 6 % del cómputo total de I+D, 12 % del cómputo de I+D impulsado por IA, asignado a seguridad
La publicación de estas métricas indica el intento de Anthropic de aportar transparencia a un campo donde rara vez se comparten referencias internas. Al cuantificar el papel de Claude, la empresa ofrece un dato concreto que puede compararse con otros laboratorios que experimentan con investigación asistida por modelos a gran escala.
Para las organizaciones de habla hispana, la implicación práctica es clara: las métricas ofrecen una plantilla para seguir cuánto de su propia cadena de I+D está automatizada, cuántos agentes autónomos están en operación y qué proporción del cómputo se destina a la seguridad. Las empresas pueden adoptar marcos de medición similares, adaptar la clasificación de la escala de automatización y establecer umbrales internos de revisión humana basados en la baja frecuencia de bloqueos reportada por Anthropic.
En resumen, las tres métricas de Anthropic proporcionan una instantánea medible de la investigación impulsada por IA en un laboratorio líder. Aunque los números son internos y esperan verificación externa, ofrecen a otras firmas una referencia para crear sus propios paneles de control, calibrar procesos con humanos en el bucle y asegurar que la seguridad siga siendo una parte visible del presupuesto de cómputo.
Fuentes
- Anthropic shares 3 metrics to help AI companies monitor pace of developmentCNBC · 17 de septiembre de 2026
- Anthropic revela três métricas para medir o ritmo da corrida da IAOlhar Digital · 17 de septiembre de 2026
- AI bouwt AI: Claude leidt al een kwart van het werk aan zijn opvolgerBright · 18 de septiembre de 2026



