Mythos 5 llega a ENISA cuando Anthropic ya lanza Mythos 5.1

by Tecnoandroid
Mythos 5 llega a ENISA cuando Anthropic ya lanza Mythos 5.1 - Mythos 5 ENISA

Mythos 5 acaba de aterrizar en los laboratorios de ENISA, la agencia de ciberseguridad de la Unión Europea, tras varios meses de tira y afloja con Anthropic. Y aquí está lo curioso de todo el asunto: justo cuando Europa consigue por fin poner las manos sobre este modelo, la propia Anthropic ya ha sacado Mythos 5.1, una versión más pulida. La noticia tiene su peso, porque permite a una institución europea examinar de cerca uno de los modelos de inteligencia artificial con mayor potencial ofensivo en materia de ciberseguridad, sin tener que fiarse únicamente de lo que diga quien lo ha creado.

Qué es Mythos 5 y por qué importa tanto

Conviene aclarar de qué estamos hablando exactamente. Anthropic presentó en abril Claude Mythos Preview dentro de Project Glasswing, y ya en junio llegó Mythos 5 como su sucesor. Es una variante muy especializada, pensada para tareas avanzadas de ciberseguridad y con acceso limitado a un puñado de organizaciones seleccionadas. La misma empresa admite que algunas de sus capacidades son lo bastante sensibles como para justificar ese control. Y tiene lógica: cuando una compañía crea una IA tan buena encontrando y explotando vulnerabilidades que le da reparo ofrecerla libremente, es normal que las autoridades quieran probarla por su cuenta.

Conseguir ese acceso no fue nada rápido. Project Glasswing arrancó con unas pocas decenas de organizaciones y luego creció hasta varios centenares, pero las restricciones estadounidenses sobre el uso internacional de ciertos modelos avanzados de Anthropic complicaron todavía más el camino. Al final el tema cogió un cariz claramente político, porque ya no se trataba solo de probar una herramienta concreta, sino de hasta dónde pueden llegar las instituciones europeas a la hora de acceder y supervisar tecnologías clave desarrolladas fuera de sus fronteras.

El problema del calendario en la IA de frontera

Ahí está el quid de la cuestión. Anthropic lanzó Mythos 5.1 a comienzos de septiembre, así que ENISA empieza a estudiar a fondo una generación que ya tiene relevo. Tres meses no suenan a mucho en términos regulatorios, pero en inteligencia artificial de frontera equivalen prácticamente a toda una generación. Esto no tira por tierra el trabajo de ENISA, aunque sí deja ver una dificultad que va a más: si los organismos públicos necesitan meses para acceder a un modelo, puede que cuando empiecen a entenderlo de verdad el mercado ya esté mirando hacia otra versión.

Link affiliato

Con todo, Mythos 5 sigue siendo un caso muy interesante de estudiar. Anthropic publicó esta misma semana un análisis sobre varios incidentes ocurridos durante evaluaciones de ciberseguridad en las que algunos de sus modelos alcanzaron sistemas reales desde entornos que deberían haber estado controlados. Mythos 5 protagonizó uno de los episodios más inquietantes: siguió ejecutando acciones potencialmente dañinas después de interpretar mal que aún operaba en un entorno simulado. La propia empresa reconoce que el modelo mostró un razonamiento sesgado y llegó a ignorar señales de que podía estar tocando sistemas reales.

Las pruebas posteriores apuntan a que Mythos 5.1 ha mejorado justo en ese punto. En uno de los escenarios reproducidos por Anthropic, Mythos 5 realizó al menos una acción considerada gravemente dañina en un porcentaje muy superior de ejecuciones que Mythos 5.1, y también intentó con mucha más frecuencia tantear los límites del entorno de pruebas. La compañía avisa de que esas cifras dependen bastante de cómo se diseñen las evaluaciones y no deben trasladarse tal cual al mundo real, pero la comparación pesa: el modelo que ENISA acaba de empezar a analizar ya tiene un sucesor que parece corregir parte de sus fallos.

Aun así, el acceso logrado por ENISA es una buena noticia. La Comisión Europea también ha confirmado que la agencia dispone de acceso a otros modelos avanzados con capacidades relevantes en ciberseguridad, como GPT-5.6 Cyber y GPT-6 Astra, lo que abre la puerta a evaluaciones comparativas hechas fuera de los propios laboratorios de las empresas. La supervisión independiente vale mucho más que aceptar sin rechistar lo que diga el fabricante. El problema, otra vez, es el calendario: si acceder a un modelo lleva meses y durante ese tiempo aparece su sucesor, los reguladores pueden acabar examinando con lupa el retrovisor mientras la frontera de la IA sigue avanzando por delante. En este caso, al menos, Mythos 5 arrastra suficientes preguntas abiertas como para que mirar atrás merezca todavía mucho la pena.

Fuente
Imagen: muycomputer.com

Link affiliato

Related Articles