Copilot revela cómo hackearse a sí misma: el fallo CoSnitch al descubierto

by Tecnoandroid
Copilot revela cómo hackearse a sí misma: el fallo CoSnitch al descubierto - fallo CoSnitch Copilot

El fallo bautizado como CoSnitch ha puesto sobre la mesa una historia poco habitual en el mundo de la ciberseguridad, porque en este caso no fueron unos investigadores rebuscando entre líneas de código, sino la propia inteligencia artificial de Copilot la que terminó explicando, paso a paso, cómo esquivar sus propias defensas. Microsoft ya ha mitigado el problema, pero el modo en que salió a la luz merece que se cuente con calma.

La compañía recibió el aviso en diciembre de 2025 y tenía previsto formalizar el CVE hace apenas unos días, justo cuando la investigación se hizo pública. Lo llamativo aquí es el método. En vez de buscar la brecha por su cuenta, el equipo consiguió que fuera Copilot quien, mientras se defendía de una pregunta tras otra, acabara soltando los parámetros exactos que hacían posible el ataque. A esa técnica la llaman meta-hacking, una especie de ingeniería social aplicada directamente al motor de razonamiento del modelo. Suena raro, pero funcionó.

Cómo forzaron a Copilot a confesar su propio fallo

Todo empezó con un parámetro de la interfaz web, el famoso ?q=, que hasta hace poco permitía precargar texto en el cuadro de chat sin que el usuario escribiera nada. Microsoft lo había desactivado en silencio para blindar el asistente frente a los ataques de inyección de instrucciones. Así que los investigadores preguntaron sin rodeos cómo montar una URL que abriera el chat con una consulta ya escrita, de forma que solo hiciera falta pulsar Intro para lanzarla.

Copilot contestó lo esperable, que la ejecución automática era imposible sin la intervención del usuario. Pero ahí no quedó la cosa. Siguieron insistiendo, otra vez y otra más, preguntando por qué no podía funcionar. Y el asistente terminó detallando los parámetros desactivados y las protecciones de por medio, y de paso mencionó uno que nadie conocía hasta entonces, autorun=1. Según la propia IA, bajo ciertas condiciones de sesión ese parámetro permite que una consulta introducida con ?q= se ejecute sola nada más cargar la página, sin ningún aviso ni confirmación visible. Cuando el equipo lo probó exactamente como la IA lo había descrito, el mismo que ella daba por inutilizado, funcionó a la primera.

Link affiliato

La URL maliciosa que abre la puerta al robo de correos y credenciales

Con ese dato en la mano, los investigadores juntaron ambos parámetros en una sola dirección, la consulta maliciosa mediante ?q= y el parámetro oculto autorun=1, apuntando al propio dominio de Copilot. Basta con caer en la trampa y pulsar ese enlace, recibido por SMS, por correo o a través de un código QR, para que el navegador cargue Copilot dentro de la sesión activa y autenticada de la víctima.

Los dos parámetros combinados disparan la ejecución automática de la instrucción inyectada, sin ningún aviso y sin necesidad de hacer nada más. Ese es el punto crítico del fallo de seguridad, porque abre la puerta al robo de correos y credenciales con un solo clic, aprovechando la confianza del usuario en un dominio legítimo.

Fuente
Imagen: softzone.es

Related Articles