Microsoft no puede corregir la vulnerabilidad en 144 días: cómo un documento de Word puede engañar a todo lo que genera Copilot
Microsoft
OpenAI
El investigador de seguridad independiente Hakon Moloy descubrió que en Copilot for Word es posible una inyección de prompt a través de texto invisible en documentos, que se auto-replica e infecta otros archivos. Microsoft reconoció el problema y lanzó dos correcciones, incluida una actualización del modelo a GPT-5.5, pero el ataque sigue funcionando. El experto considera que la vulnerabilidad es un problema arquitectónico de todos los LLM.
El investigador independiente de seguridad Håkon Møløy publicó el 28 de julio de 2026 los resultados de una investigación de varios meses sobre una vulnerabilidad en Copilot for Word. Descubrió que un atacante podría insertar instrucciones maliciosas en un documento de Word escribiéndolas en texto blanco sobre fondo blanco, invisibles para el ser humano pero legibles por el modelo. Cuando el usuario utiliza dicho documento como fuente en Copilot, las instrucciones se ejecutan de manera imperceptible, y el documento generado se convierte en un nuevo vector de ataque, permitiendo la propagación de la infección sin la intervención del atacante. Microsoft reconoció el problema a finales de marzo de 2026 y lanzó dos parches, el segundo de los cuales incluía la actualización del modelo a GPT-5.5, pero Møløy logró reproducir el ataque con un prompt ligeramente modificado. El investigador considera que el problema es de naturaleza arquitectónica y es inherente a todos los LLM modernos, requiriendo investigación profunda para una solución completa. Mientras tanto, Microsoft recomienda tratar los documentos externos como no confiables y verificar los archivos generados antes de enviarlos.
Fuente: Numerama —
original
