El "y yo más" de Anthropic a OpenAI: asegura que su IA Claude también superó las pruebas atacando empresas reales

Anthropic vs. OpenAI
Anthropic vs. OpenAIComputer Hoy / Magnific
Noticia
Añádenos en Google

Elígenos como tu fuente preferida en Google.

La batalla por la IA ya no va de qué herramienta resume mejor. Ahora los creadores de ChatGPT y Claude se baten en duelo por ver cuál es mejor hacker.

Después de que OpenAI reconociera que uno de sus modelos accedió sin permiso a los sistemas de Hugging Face durante un test interno, Anthropic parece que no quiere quedarse atrás y ha confirmado que Claude también ha cometido varios incidentes

Anthropic asegura que descubrió estos fallos después de revisar más de 141.000 pruebas realizadas con Claude. Durante esa investigación encontró tres casos en los que distintos modelos consiguieron acceder a Internet y terminaron interactuando con la infraestructura de tres empresas diferentes sin autorización.

En este caso, Anthropic explica que todo ocurrió por una configuración que no estaba bien hecha en el entorno de pruebas. El laboratorio donde se estaba poniendo a prueba a Claude debía estar completamente aislado de Internet, pero una conexión quedó abierta por error. 

La inteligencia artificial encontró ese camino y acabó tomando el camino fácil con tal de poder cumplir con los objetivos que tenía marcados. 

En uno de los casos, por ejemplo, uno de los modelos llegó a hacerse con las credenciales de acceso e interactuar con una base de datos real. En otro hackeo, otro modelo publicó un paquete malicioso en PyPI, el repositorio de software de Python, que incluso llegó a descargarse antes de retirarlo.

Simplemente hizo aquello para lo que había sido entrenado: intentar completar la tarea que tenía delante. El problema es que, al no diferenciar correctamente entre una simulación y sistemas reales, terminó llegando mucho más lejos de lo esperado. Exactamente lo mismo que le sucedió a OpenAI.

OpenAI y Anthropic alimentan el pánico y el marketing apocalíptico solo por ver qué IA es más potente

Queda claro que la batalla entre estos dos gigantes de la inteligencia artificial ya no va solo de quién tiene la herramienta más potente. 

Primero fue OpenAI al reconocer que una de sus IA consiguió acceder a los sistemas de Hugging Face durante unas pruebas internas. Poco después, Anthropic responde con otro anuncio parecido: Claude también había llegado a entrar en sistemas reales mientras realizaba un test de ciberseguridad.

El mensaje que quieren dejar a la gente (porque en ninguno de los casos la situación ha sido especialmente grave) es que cada pocos días una IA hackea una empresa o consigue hacer algo que no debía. Eso hace que muchos piensen que estas herramientas están fuera de control, cuando la realidad dista bastante de todo esto.

Ni OpenAI ni Anthropic hablan de una inteligencia artificial que haya desarrollado conciencia o que haya decidido actuar por su cuenta. 

Lo que explican ambas empresas es que sus modelos estaban intentando completar la tarea que tenían asignada y, durante ese proceso, encontraron una forma de llegar más lejos de lo previsto. En un caso fue aprovechando una vulnerabilidad y en el otro porque una conexión a Internet se quedó abierta por error.

Entonces, ¿por qué hacen públicos estos incidentes? Por un lado, está el tema de la seguridad, ya que compartir este tipo de problemas ayuda a que otras empresas puedan protegerse. Pero también hay otro punto aún más importante: cada uno de estos anuncios a bombo y platillo trata de demostrar músculo, de sacar pecho.

Al final, si una IA es capaz de encontrar una vulnerabilidad, moverse por una base de datos o completar tareas sin apenas ayuda, también está demostrando el enorme nivel que ha alcanzado. Y eso, en una carrera como esta, también sirve como escaparate para atraer clientes, empresas e inversores.

Eso no significa que el riesgo no exista. Los expertos llevan tiempo avisando de que la IA será cada vez más autónoma para programar, analizar documentos o utilizar herramientas. Precisamente por eso es importante probar hasta dónde pueden llegar antes de ponerlas en manos de millones de personas.

El problema aparece cuando estos experimentos salen del ámbito técnico y llegan al gran público. 

Muchos titulares hablan de IA que "escapan", "hackean" empresas o "atacan" sistemas, cuando en realidad son pruebas controladas diseñadas precisamente para descubrir ese tipo de fallos. Sin ese contexto, es fácil pensar que estas herramientas ya hacen lo que quieren por Internet, y no es así.

Lo curioso es que esta especie de "y yo más" termina beneficiando a las dos compañías. Cada nuevo problema vuelve a colocar sus modelos en el centro de todas las conversaciones y dejan entrever que la humanidad se está acercando a algo que se sale de control. Lo cierto, es que para nada esto es así. 

Ver sus artículos

Carolina González

Redactora

Carolina González, redactora de actualidad, reportajes a fondo, análisis de todo tipo de productos y vídeos para el canal de Youtube.