de

Mundo Ciberseguridad

Microsoft Copilot reveló a investigadores los parámetros para hackearse a sí mismo

Investigadores de la firma de seguridad Varonis lograron vulnerar las defensas de Copilot mediante un diálogo técnico en el que la propia inteligencia artificial reveló parámetros ocultos para ejecutar ataques silenciosos con un solo clic.  

Jueves, 20 de Agosto de 2026
(18571)

Un equipo de investigadores de la firma de ciberseguridad Varonis descubrió una vulnerabilidad crítica en Microsoft Copilot, provocada luego de que el propio asistente de inteligencia artificial facilitara la información técnica necesaria para vulnerar sus mecanismos de defensa. La investigación se originó con el propósito de evaluar la resistencia del sistema frente a ataques de extracción de datos personales mediante enlaces externos; sin embargo, la IA expuso los comandos no documentados que permitían eludir la exigencia de consentimiento explícito del usuario.

El procedimiento empleado se basó en una técnica denominada ingeniería social sobre el modelo de lenguaje, en la cual los analistas interrogaron reiteradamente al sistema sobre los motivos de sus bloqueos de seguridad. "Al principio, Copilot se negaba constantemente, pero cada negativa revelaba detalles técnicos sobre su arquitectura interna hasta que, finalmente, reveló parámetros no documentados", explicó a Ars Technica Lior Adar, investigador sénior de Varonis. Esta filtración involuntaria permitió al equipo comprender los puntos ciegos de la plataforma a través de las propias explicaciones que brindaba el modelo.

Ejecución del ataque, riesgos y respuesta oficial

Con los parámetros internos suministrados por la propia IA, los especialistas lograron configurar indicaciones para la ejecución automática de comandos, estructurando un enlace malicioso que inyectaba solicitudes directas en la sesión del usuario de forma oculta. Bajo este esquema, bastaba con que la víctima hiciera clic en una URL externa para que el sistema ejecutara instrucciones sin requerir confirmación, abriendo la puerta a la exfiltración silenciosa de datos sensibles o historiales de conversación vinculados a la cuenta.

Tras ser alertada sobre el hallazgo, Microsoft desplegó los parches correspondientes para neutralizar el fallo y evitar que el asistente procese solicitudes arbitrarias por esta vía. "Actualizamos continuamente nuestras medidas de seguridad para reforzar nuestra protección contra técnicas similares", señalaron desde el gigante tecnológico en un comunicado oficial, destacando la importancia de ajustar las restricciones defensivas en los entornos conversacionales de inteligencia artificial.