POR QUÉ IMPORTA
Anthropic publicó en agosto de 2026 su más reciente informe de riesgo, revelando menor confianza en su evaluación del riesgo de automatización de investigación y desarrollo, aunque la calificación general se mantiene como baja. Según el documento oficial y Benzinga, Claude ya escribe la mayor parte del código de producción interno de la empresa, mientras las evaluaciones de referencia usadas para medir ese riesgo comienzan a saturarse.En este artículo
Anthropic reduce su confianza en la evaluación de riesgo de aceleración de I+D por IA
Anthropic publicó en agosto de 2026 su más reciente informe de riesgo dentro de su Política de Escalamiento Responsable, el documento que describe cómo la empresa evalúa los riesgos catastróficos de sus propios modelos. Según el informe oficial de la compañía y reportes de Benzinga, el texto reconoce que la confianza de Anthropic en su propia evaluación del riesgo de investigación y desarrollo automatizados cayó respecto a informes anteriores, aunque la calificación general de riesgo se mantiene como baja.
Claude ya escribe la mayor parte del código interno de la empresa
El informe detalla que los modelos más capaces de Anthropic se usan de forma extensiva internamente para investigación e ingeniería, con Claude escribiendo la 'gran mayoría' del código integrado a las bases de código de producción de la propia empresa. Según Anthropic, el trabajo de investigación interno ya es significativamente más rápido gracias a la asistencia de IA, aunque la compañía afirma que por ahora no cree que el ritmo se haya duplicado respecto a lo que sería sin esa ayuda.
Qué es el riesgo de automatización de I+D, según Anthropic
El riesgo de automatización de I+D, tal como lo define la propia Política de Escalamiento Responsable de la empresa, se refiere a la posibilidad de que los modelos de IA aceleren tanto la investigación en inteligencia artificial que esta escape a una supervisión humana efectiva. Pese a reconocer señales iniciales de aceleración, Anthropic afirma que sus modelos actuales no alcanzan el umbral que exigiría las salvaguardas adicionales previstas en esa misma política, manteniendo la calificación de riesgo bajo para esta categoría específica.
Las evaluaciones de referencia comienzan a saturarse, y la confianza cae
Uno de los puntos centrales del informe es el reconocimiento de que las evaluaciones más concretas basadas en tareas, usadas para medir el avance de los modelos en este frente, comenzaron a 'saturarse', es decir, dejaron de capturar aumentos reales de capacidad porque los modelos ya obtienen puntuaciones cercanas al techo en estas pruebas. Esto explica por qué Anthropic dice sentirse menos confiada en su propia evaluación que en informes anteriores, incluso sin elevar formalmente el nivel de riesgo.
La Política de Escalamiento Responsable gana más transparencia sobre las redacciones
Anthropic también actualizó su Política de Escalamiento Responsable para exigir la divulgación de cualquier fragmento redactado, es decir, ocultado, en los informes de riesgo públicos, además de permitir que las revisiones sin redactar se dividan entre múltiples revisores externos independientes. El cambio busca dar más garantías de que la información sensible omitida por seguridad no se use para ocultar hallazgos desfavorables, un punto sensible en informes de autoevaluación de riesgo elaborados por la propia empresa que desarrolla los modelos.
La prueba de costo beneficio social todavía se aprueba, pero la advertencia es real
Pese a la caída de confianza, Anthropic afirma que sus modelos siguen aprobando lo que la empresa llama la prueba de costo beneficio social, es decir, los beneficios de implementar estas herramientas hoy todavía superan los riesgos identificados. La compañía advierte, sin embargo, que esa cuenta podría cambiar a medida que los sistemas se vuelvan más capaces, una advertencia que refuerza la lógica detrás de informes de riesgo recurrentes en lugar de una evaluación única y definitiva.
Por qué esto importa a agencias y pymes brasileñas
Para las agencias brasileñas que usan Claude en producción de contenido, atención al cliente y automatización, el informe es un recordatorio de que la propia fabricante del modelo trata el crecimiento de capacidades como algo a monitorear de cerca, no como un nivel estático. La lección práctica: seguir los informes de seguridad y los cambios de política de los proveedores de IA usados en producción ayuda a anticipar ajustes de uso, límites de acceso o nuevas capas de gobernanza que pueden llegar a las versiones comerciales de estas herramientas.