Anthropic dio a conocer nuevas métricas sobre el uso de inteligencia artificial dentro de sus propios equipos de investigación y desarrollo y expuso un dato que marca la velocidad con la que avanzan los sistemas de IA: Claude ya lidera el 26% de las tareas de I+D relacionadas con el desarrollo de nuevos modelos de inteligencia artificial.
El dato corresponde a agosto de 2026 y surge de un índice experimental desarrollado por Anthropic para medir qué proporción del trabajo de investigación y desarrollo de modelos es realizada por sus propios sistemas de IA. En febrero, esa participación era inferior al 1%, según la compañía.
El anuncio adquiere especial relevancia porque Anthropic utiliza estas métricas para seguir la distancia que existe hasta un escenario de “mejora recursiva”, es decir, el momento en que un sistema de IA pueda construir de manera completamente autónoma una nueva versión de sí mismo.
Sin embargo, la compañía aclaró que Claude todavía no trabaja de manera totalmente autónoma en ninguna de las áreas de I+D analizadas. En la escala utilizada por Anthropic, el modelo se encuentra en un nivel en el que puede “liderar” determinadas tareas: completa gran parte del trabajo a partir de una instrucción general, mientras una persona mantiene la supervisión.
Claude participa cada vez más en el desarrollo de IA
El crecimiento de la participación de Claude en la investigación interna de Anthropic muestra un cambio acelerado en la relación entre los investigadores y los modelos de inteligencia artificial.
Según la empresa, más del 90% del trabajo de I+D analizado ya incluye algún grado de colaboración con IA. Esto significa que Claude no necesariamente realiza de principio a fin las tareas, pero sí interviene en una parte significativa del proceso.
Anthropic explicó que elaboró su índice a partir de miles de tareas realizadas por empleados durante julio de 2026. Posteriormente, agentes basados en Claude analizaron esas actividades y las clasificaron de acuerdo con distintos niveles de automatización.
La metodología utiliza una escala desarrollada por Epoch AI que va desde un nivel sin participación de IA hasta otro en el que el sistema opera completamente de manera autónoma. La categoría en la que actualmente se encuentra Claude implica que la IA puede completar la mayor parte de una tarea con una supervisión humana de alto nivel.
30.000 agentes de IA trabajando en Anthropic
El avance no se limita al chatbot Claude utilizado para interactuar con usuarios. Anthropic informó que, durante agosto, aproximadamente 30.000 agentes de inteligencia artificial trabajaban simultáneamente en tareas de investigación e ingeniería dentro de la compañía.
La empresa también publicó información sobre los mecanismos utilizados para supervisar a esos agentes. Todas sus acciones pasan por sistemas de monitoreo automatizado y son registradas para su posterior análisis.
Durante agosto, los sistemas analizaron más de mil millones de decisiones tomadas por estos agentes. Según Anthropic, aproximadamente una de cada 47.000 decisiones fue bloqueada por el sistema de monitoreo preventivo. Además, alrededor de 100.000 transcripciones semanales fueron marcadas para una revisión adicional y unas 50 por semana fueron elevadas a revisión humana por tratarse de los casos considerados prioritarios.
La compañía reconoció, de todos modos, que estos mecanismos de supervisión todavía están en desarrollo y que resulta difícil garantizar que puedan detectar todos los comportamientos potencialmente problemáticos.
El desafío de controlar una IA que ayuda a crear nuevas IA
La publicación de Anthropic llega en medio de un debate creciente sobre la velocidad del desarrollo de modelos avanzados. La propia compañía sostiene que compartir estas métricas permite que investigadores, gobiernos y la sociedad puedan conocer mejor cuánto de la construcción de nuevos sistemas está siendo automatizado.
El CEO de Anthropic, Dario Amodei, también ha planteado la necesidad de discutir mecanismos para desacelerar el desarrollo de la IA de frontera y dedicar más recursos a la seguridad.
En paralelo, el jefe de inteligencia artificial de Microsoft, Mustafa Suleyman, cuestionó públicamente algunos aspectos del enfoque de Anthropic para entrenar a Claude. Su crítica se centró especialmente en la utilización de conceptos como conciencia, bienestar y consideración moral de los sistemas de IA.
Suleyman sostuvo que entrenar un modelo para hablar sobre estos conceptos no constituye evidencia de que una IA tenga sentimientos o conciencia, sino que puede hacer que el sistema genere respuestas relacionadas con esas ideas.
Cuánta computación dedica Anthropic a la seguridad
El informe también aporta datos sobre los recursos informáticos destinados a seguridad. Anthropic indicó que, durante una semana analizada de julio, aproximadamente el 6% de la capacidad de cómputo utilizada para I+D estuvo destinada a tareas de seguridad. En el caso específico de la investigación y desarrollo impulsados por IA, la proporción llegó al 12%.
La empresa aclaró que se trata de estimaciones conservadoras y que el porcentaje de cómputo no representa por sí solo toda la inversión en seguridad, ya que muchas actividades requieren principalmente trabajo humano y no grandes cantidades de procesamiento.
El objetivo declarado por Anthropic es continuar publicando estas mediciones y sumar evaluadores externos que puedan verificar sus prácticas. Así, el dato más relevante del informe no es que Claude ya pueda construir por sí solo su sucesor, algo que todavía no ocurre, sino la velocidad con la que la IA está asumiendo tareas que hasta hace poco estaban reservadas casi exclusivamente a investigadores humanos.
Leer más
- OpenAI, Google y Anthropic avanzan hacia una autorregulación de la IA
- La alarmante advertencia desde Anthropic: estiman más de 10% de riesgo de que la IA destruya a la humanidad
- OpenAI lanza GPT-6 Astra: la nueva IA que desafía a Anthropic y busca liderar el mercado