En las últimas semanas, el mundo de la IA ha estado revolucionado tras las afirmaciones realizadas por la empresa líder Anthropic en relación con su nuevo modelo, Claude Mythos.
La empresa afirma haber descubierto que la herramienta puede superar a los humanos en algunas tareas de piratería informática y ciberseguridad, lo que ha suscitado debates entre reguladores, legisladores e instituciones financieras sobre los peligros que podría suponer para los servicios digitales.
Varios gigantes tecnológicos han obtenido acceso a Mythos a través de una iniciativa llamada Proyecto Glasswing, diseñada para fortalecer la resistencia frente al propio Mythos.
Pero otros señalan que a Anthropic le conviene sugerir que su herramienta tiene capacidades nunca antes vistas, lo que significa que, como siempre ocurre con la IA, la tarea de distinguir entre afirmaciones justificadas y exageraciones puede ser complicada.
¿Qué es Claude Mythos?
Mythos es uno de los modelos más recientes de Anthropic, desarrollado como parte de su sistema de IA más amplio llamado Claude. Este sistema engloba el asistente de IA de la compañía y su familia de modelos, compitiendo con ChatGPT de OpenAI y Gemini de Google.
Anthropic lo reveló a principios de abril como «Avance de Mythos».
Los investigadores que prueban cómo los modelos de IA manejan solicitudes o tareas específicas, conocidos como «equipos rojos», afirmaron en un informe que Mythos era «sorprendentemente capaz en tareas de seguridad informática».
Descubrieron que la herramienta podía localizar errores latentes ocultos en código de décadas de antigüedad y explotarlos fácilmente.
En lugar de ponerlo a disposición de todos los usuarios de Claude, Anthropic dio acceso a 12 empresas tecnológicas a través del Proyecto Glasswing, que describió como «un esfuerzo por proteger el software más crítico del mundo».
Entre ellas se encuentran el gigante de la computación en la nube Amazon Web Services, los fabricantes de dispositivos Apple, Microsoft y Google, y los fabricantes de chips Nvidia y Broadcom.
Crowdstrike, cuya actualización de software defectuosa provocó una importante interrupción global en julio de 2024 , también se encuentra entre los socios del proyecto. Anthropic afirma haber dado acceso a Mythos a más de 40 organizaciones responsables de software crítico.
En un vídeo publicado junto con el lanzamiento del Proyecto Glasswing, el director de Anthropic, Dario Amodei, afirmó que se habían ofrecido a colaborar con funcionarios del gobierno estadounidense para «ayudar a defenderse del riesgo que suponen estos modelos».
¿Por qué existen estas preocupaciones?
Anthropic afirma que, durante las pruebas, descubrió que el modelo era muy hábil en tareas de ciberseguridad y piratería informática, superando a los humanos.
«Mythos Preview ya ha encontrado miles de vulnerabilidades de alta gravedad, incluidas algunas en todos los principales sistemas operativos y navegadores web», afirmó Anthropic el 7 de abril .
«Dado el ritmo de progreso de la IA, no pasará mucho tiempo antes de que dichas capacidades proliferen, potencialmente más allá de los actores comprometidos con su despliegue seguro.»
Afirmó que podía localizar, sin mucha supervisión, fallos críticos que requerían una actuación inmediata en sistemas antiguos, incluida una vulnerabilidad que había estado presente en un sistema durante 27 años, y sugerir formas de explotarlos.
ReutersAlgunos ministros de finanzas, banqueros centrales y financieros han expresado desde entonces su seria preocupación al respecto , temiendo que el modelo pueda socavar la seguridad de los sistemas financieros.
El ministro de Finanzas canadiense, François-Philippe Champagne, declaró a la BBC que el proyecto Mythos se había tratado en una reunión del Fondo Monetario Internacional (FMI) celebrada esta semana en Washington D.C.
«Sin duda, es un asunto lo suficientemente serio como para merecer la atención de todos los ministros de finanzas», dijo, describiendo la tecnología como una «incógnita desconocida».
El gobernador del Banco de Inglaterra, Andrew Bailey, declaró a la BBC: «Ahora tenemos que analizar con mucha atención qué podría significar este último avance en inteligencia artificial para el riesgo de ciberdelincuencia».
Mientras tanto, la UE ha declarado que también está en conversaciones con Anthropic sobre sus preocupaciones en torno a Mythos.
- Escucha: El modelo de IA que es «demasiado poderoso» para ser lanzado al público.
¿Qué han dicho al respecto los expertos en ciberseguridad?
Ciaran Martin, exdirector del Centro Nacional de Ciberseguridad del Reino Unido, declaró a la BBC a principios de esta semana que la afirmación de que Mythos podía descubrir vulnerabilidades críticas mucho más rápidamente que otros modelos de IA había «conmocionado a la gente».
«Lo segundo es que, incluso con las vulnerabilidades existentes que conocemos, pero contra las que las organizaciones quizás no hayan aplicado parches o no estén bien protegidas, se trata simplemente de un hacker realmente bueno», dijo.
Muchos analistas y expertos independientes en ciberseguridad aún no han podido probarlo por sí mismos y algunos siguen mostrándose escépticos sobre el rendimiento de Mythos.
El Instituto de Seguridad de la IA del Reino Unido concluyó recientemente que, si bien se trata de un modelo muy potente, su mayor amenaza residiría en los sistemas vulnerables y mal protegidos.
«No podemos afirmar con certeza si Mythos Preview sería capaz de atacar sistemas bien defendidos», declararon sus investigadores .
Por lo tanto, donde exista una buena ciberseguridad, en teoría, este modelo debería ser detenido.
¿Deberíamos preocuparnos por ello?
Los temores relacionados con la IA no son nada nuevo.
Constantemente aparecen nuevos modelos y herramientas, y a menudo vienen acompañados de promesas de revolucionar nuestras vidas, para bien o para mal.
Aprovechar esta mezcla de miedo y entusiasmo por la IA y su impacto futuro se ha convertido también en un sello distintivo del sector y de sus estrategias de marketing en los últimos años.
En el caso de Mythos, todavía no sabemos lo suficiente como para determinar si estas esperanzas o temores están justificados, o si son más bien un reflejo de la exageración que rodea a la industria.