La IA empieza a dar miedo: Anthropic tiene un modelo mejor que Mythos y no quiere lanzarlo

Nuevo modelo de IA de Anthropic, llamado Model 2
Nuevo modelo de IA de Anthropic, llamado Model 2Anthropic
Noticia
Añádenos en Google

Elígenos como tu fuente preferida en Google.

La empresa tecnológica ha impulsado un nuevo modelo de inteligencia artificial más poderoso que Mythos y que, por el momento, usará a nivel interno.

Anthropic ha creado una auténtica bestia que supera las capacidades de Mythos 5 y que ha decidido mantener en el anonimato, con el nombre de Model 2, para evitar riesgos innecesarios derivados de su uso público.

La compañía ha publicado un documento en el que reúne los riesgos percibidos en el mes de agosto y donde ha hecho referencia a un nuevo modelo de inteligencia artificial al que no se había referido anteriormente.

Se trata de Model 2, un modelo que, según su criterio, "es más capaz que Mythos 5" y que "supone una mejora notable" con respecto a éste en muchas tareas relevantes para el uso interno, tal y como se indica en este informe.

A pesar de ello, este modelo "no muestra un salto en la capacidad del mismo nivel que el observado entre Claude Opus 4.6 y Mythos Preview". Eso no significa, no obstante, que se vaya a publicar y probar en este tiempo, sino que la empresa ha tomado la determinación de mantenerlo en el anonimato.

"Actualmente no tenemos planes de lanzar este modelo al público y no hemos llevado a cabo todas nuestras pruebas habituales de evaluación previas a la implementación, de modo que nuestra confianza en nuestras conclusiones sobre sus capacidades es algo menor", ha puntualizado OpenAI en este comunicado.

Usos de Model 2 y primeros resultados del modelo

En el informe, OpenAI ha reconocido que tanto Mythos 5 como Model 2 se están utilizando a nivel interno y de manera "intensiva" para la programación, la generación de datos y otros casos de uso relacionados con agentes que no se han especificado.

A pesar de que en este ámbito están respondiendo como se esperaba, desde la compañía han señalado que consideran que es "muy improbable" que ambos modelos "presenten una desalineación generalizada que aumente el riesgo de nuestras vías prioritarias". En cualquier caso, han puntualizado que el riesgo de daños catastróficos que plantean estas formas conocidas de desalineación es "bajo".

En cualquier caso, la compañía ha dejado caer que no tiene idea de ponerlo en manos de los usuarios y que, por el momento, se utilizará únicamente a nivel interna, además de que ha pasado por una evaluación "menos exhaustiva" que otros modelos y que solo con ella lo podría "comparar a otras" de su versiones de producción.

Qué es Mythos y por qué da tanto miedo

Clayde Mythos es la versión más avanzada y experimental de la inteligencia artificial desarrollada por Anthropic. No es una IA conversacional, esto es, pensada para razonar y responder preguntas, sino que se centra en analizar código y sistemas.

Una de las características que mejor lo definen es su agilidad para detectar fallos. Esto significa que tiene una tasa alta de éxito en la detección de vulnerabilidades y que, mientras otros modelos pueden ofrecer mejoras o encontrar errores básicos, ésta puede entender la lógica de un sistema operativo completo.

Sus altísimas capacidades han llevado a Anthropic decir de él que es un modelo de razonamiento "de alta fidelidad", que no solo adivina qué palabras vienen después de una determinada orden, como habitualmente hacen los chatbots normales. 

De ese modo, simula de manera interna cómo funcionaría un programa y es capaz de detectar dónde se puede romper por bugs, aunque también puede plantear cómo aprovecharlos en caso de encontrarlos.

Así, Mythos ha demostrado ser capaz de encontrar vulnerabilidades zero day, incluso si estos no son recientes, debido a que no busca patrones, como hacen los humanos, sino que entienden la intención de estos fallos.

Esto puede ser muy favorable en el ámbito de la ciberseguridad, pero también puede suponer un problema si alguien consigue liberarlo para que recaiga por completo en manos de los ciberdelincuentes, que podrían crear ataques en apariencia irreversibles e inmanejables por otras IAs.

Más información sobre:

Ver sus artículos

Noelia Murillo

Redactora

Noelia Murillo, redactora de Computer Hoy. Realiza pruebas de producto, reportajes y noticias de actualidad relacionadas con el sector. También te cuenta lo que ha analizado en redes sociales.