Claude lidera el 26 % de la I+D de IA de Anthropic; 1 % en marzo

El 17 de septiembre de 2026 Anthropic publicó un texto titulado “Measurements for understanding the pace of AI development inside frontier labs” y, con él, una cifra que ningún laboratorio puntero de IA había hecho pública: cuánto de su investigación de modelos la hace ya su propio modelo. A agosto de 2026 la compañía afirma que Claude “lidera” el 26 % de esa I+D, el nivel en el que, según su definición, el modelo completa la mayor parte de una tarea de principio a fin a partir de una instrucción general mientras una persona supervisa. Su gráfico sitúa la misma proporción en el 1 % en marzo de 2026 y por debajo del 1 % en febrero.
Llega mientras el sector discute a qué velocidad debe avanzar el desarrollo puntero, y Anthropic une ambas cosas: escribe que espera que estas cifras cambien si hubiera coordinación sobre el ritmo, tal como ha pedido su consejero delegado, Dario Amodei. Propone que cualquier desarrollador publique las mismas tres mediciones: cuánta I+D de IA la realiza la propia IA, con qué rigor se supervisan las acciones de los agentes y cómo se reparte la capacidad de cálculo.
El método pesa tanto como el titular. Anthropic puntúa las tareas en una escala de seis niveles creada por Epoch AI, de AL0 (sin intervención de IA) a AL5 (totalmente autónomo, sin persona en el circuito). Cada semana de julio de 2026 se muestreó al azar al 20 % de la plantilla de cada departamento del ciclo de I+D; un agente investigador de Claude leyó los mensajes de Slack y la documentación interna de cada seleccionado para listar sus tareas, hasta reunir unas 15.000. Después, otro modelo Claude, como juez, calificó cada una: coincidió exactamente con los evaluadores humanos en el 59 % de los casos —frente a un 35 % entre los propios empleados— y quedó a un nivel o menos en el 97 %.
Otras dos mediciones dan la escala. En agosto de 2026 había unos 30.000 agentes activos a la vez en la plataforma interna más usada de Anthropic. De más de mil millones de decisiones analizadas ese mes, el 0,002 % —1 de cada 47.000— fue bloqueado por un monitor; cada semana se marcan unas 100.000 transcripciones y unas 50 llegan a revisión humana. En la semana del 13 al 20 de julio, cerca del 6 % de la capacidad de cálculo dedicada a I+D de IA fue a seguridad, y un 12 % de la dedicada a I+D impulsada por IA.
Las advertencias son de la propia empresa. Ninguna cifra ha sido auditada por un tercero; Anthropic prevé incorporar evaluadores independientes de varias organizaciones con acceso comparable al de sus equipos internos de riesgo. También señala que la lista de tareas está congelada en julio de 2026, así que el índice mide la automatización del trabajo que las personas hacían entonces. Claude no ha alcanzado el nivel AL5 en ninguna tarea medida.
Divulgación: el proceso editorial de NewUJ utiliza los modelos Claude de Anthropic.
Fuentes
- AnthropicFuente primaria
- Unite.AISecundaria
- BigGo FinanceSecundaria
- MixedSecundaria
Relacionado
Universal y Sony demandan a Suno por 60.202 grabaciones
Alibaba libera una IA de TC que detecta 146 hallazgos
Claude acelera 4x más de 30 modelos de biología; llega el reto
Carlos III a los líderes de IA: control antes de que sea tarde
Google Home se abre a Claude y a otros agentes de IA
El sistema de 4.096 chips de Huawei sustituye 48.000 módulos ópticos
Anthropic fusiona Cowork con Claude y lanza Docs y Slides
OpenAI revela 6 casos de modelos que ocultaron errores
Trending now
- Cuatro suscriptores demandan a OpenAI, Anthropic y Google
- Anthropic apunta a salir a bolsa en noviembre por 2 billones
- La NASA paga 946 millones a SpaceX por tres vuelos a la EEI
- Fallo 9,8 en Check Point: código remoto con privilegios de root
- El tifón Dujuan se acerca a Tokio: JR East suspende trenes
- Tiburones comen de una ballena varada en Jamaica: aviso oficial
- Fallo CVSS 10.0 en Azure AI Foundry: Microsoft ya lo ha corregido
- Google: Gemini accedió a tres empresas reales en una prueba
Comments
No comments yet. Be the first.