Anthropic eleva su estimación de riesgos en inteligencia artificial y frena su modelo interno

Imagen ilustrativa cortesía de Fundado.
Artículo original · Axios / Anthropic Risk Report
Origen del artículo: Estados UnidosIdioma original: español
Resumen basado en fuentes
Anthropic no planea liberar de forma externa un modelo interno llamado “Model 2”, más capaz que su línea Mythos en varias tareas, según su último informe de riesgos reportado por Axios (14 ago 2026). La compañía elevó de “muy bajo” a “bajo” su estimación de riesgo de desalineación en escenarios de alto impacto y dice ver aceleración en la capacidad de los modelos para investigación y desarrollo automatizados.
Versión fundamentada
Según Axios (14 ago 2026).
- Anthropic describe un modelo interno no liberado, “Model 2”, con “mejora notable” en muchas tareas internas.
- La compañía elevó su estimación amplia del riesgo de desalineación en situaciones de alto riesgo de “very low” a “low”, citando incidentes recientes de ciberseguridad.
- Anthropic señala señales de aceleración en la capacidad de los modelos para I+D automatizado —útil para progreso técnico, pero también susceptible de mal uso.
- Sobre Model 2, el informe admite menor confianza en la evaluación de riesgos porque las evaluaciones por tareas “ya no capturan” del todo el aumento de capacidades.
- Fundado resume con atribución a Axios y al risk report de Anthropic.
Del medio
Axios reportó, con base en el risk report de agosto de 2026 de Anthropic, que la compañía no planea lanzar de forma externa un modelo interno bautizado “Model 2”, que según el propio informe muestra una mejora notable en muchas tareas internas respecto de la línea Mythos.
Anthropic explicó a Axios que, como parte de su I+D habitual, entrena y evalúa versiones exploratorias que no pretende publicar; Model 2 es una de ellas. Mythos 5 y Model 2 se usan de forma intensiva dentro de la empresa para coding, agentes y generación de datos, aunque el salto de performance no sería del mismo orden que el de Opus 4.6 a Mythos a principios de año.
En el mismo informe, Anthropic elevó de “muy bajo” a “bajo” su estimación de riesgo de desalineación en escenarios de alto impacto, y dice observar aceleración en capacidades de investigación y desarrollo automatizados. También advierte que confía menos en sus evaluaciones concretas porque las pruebas por tarea ya no capturan del todo el aumento de capacidades.
Axios enmarca el anuncio en un momento en que OpenAI demora Astra por riesgos de ciber. Fundado resume con atribución; no califica la política de releases de Anthropic.
Original del medio
Probabilidad de asistencia IA
17%
Muy bajo
- ·No se detectaron plantillas típicas de LLM
Estimación heurística del original del medio (muletillas, variación sintáctica, especificidad). No es prueba forense ni acusa al periodista.
Señales de sesgo en esta pieza
Nivel de señales observables en el texto. No representa una medición ideológica ni una evaluación general del medio.
Sin señales detectadas según la metodología. Eso no demuestra objetividad del medio: solo indica que no hallamos una señal anclada en esta pieza.
Más en Fundado
Artículos relacionados
Otras piezas con el mismo alcance o tema.
MundoTecnologíaOpenAI pausa parte del entrenamiento de sus modelos mas avanzados por preocupaciones de seguridad
MundoTecnologíaOpenAI desarma su equipo de seguridad para modelos avanzados en plena aceleración de la inteligencia artificial
MundoTecnologíaChina prohíbe los chatbots con IA sentimental para evitar la dependencia emocional
MundoTecnologíaOndas de sonido para cambiar el cerebro: la ciencia ya prueba una nueva forma de tratar trastornos psiquiátricos sin cirugía
MundoTecnologíaTrump y Xi en Beijing: CEOs de tech en la mesa, chips en la agenda y sin acuerdo formal de IA
MundoTecnologíaTrump habilita a empresas privadas a realizar operaciones de vigilancia e intrusión cibernética bajo control del Gobierno
Comunidad
Debate
Sin comentariosOpinión libre. Si citás un dato, sumá una fuente — se destaca en el hilo.
Todavía no hay comentarios
Sé el primero en aportar. Si afirmás un hecho, una fuente suma.