Microsoft kan kwetsbaarheid 144 dagen niet verhelpen: hoe een Word-document alles kan misleiden wat Copilot vervolgens genereert
Microsoft
OpenAI
Onafhankelijk beveiligingsonderzoeker Håkon Møller ontdekte dat in Copilot for Word een prompt-injectie mogelijk is via onzichtbare tekst in documenten, die zichzelf repliceert en andere bestanden infecteert. Microsoft erkende het probleem en bracht twee fixes uit, waaronder een modelupdate naar GPT-5.5, maar de aanval werkt nog steeds. De expert is van mening dat de kwetsbaarheid een architectonisch probleem is van alle LLM's.
Onafhankelijk veiligheidsonderzoeker Haakon Moloy publiceerde op 28 juli 2026 de resultaten van een maandenlang onderzoek naar een kwetsbaarheid in Copilot for Word. Hij ontdekte dat een kwaadwillende schadelijke instructies in een Word-document kan injecteren door ze in witte tekst op een witte achtergrond te schrijven, onzichtbaar voor mensen maar leesbaar voor het model. Wanneer een gebruiker zo'n document als bron gebruikt in Copilot, worden de instructies onopgemerkt uitgevoerd en wordt het gegenereerde document een nieuw aanvalsvector, waardoor de infectie zich kan verspreiden zonder tussenkomst van de aanvaller. Microsoft erkende het probleem eind maart 2026 en bracht twee patches uit, waarvan de tweede een modelupdate naar GPT-5.5 omvatte, maar Moloy kon de aanval reproduceren met een licht gewijzigde prompt. De onderzoeker is van mening dat het probleem architectonisch van aard is en inherent aan alle moderne grote taalmodellen (LLM's), en dat diepgaand onderzoek nodig is voor een volledige oplossing. Vooralsnog raadt Microsoft aan om externe documenten als onbetrouwbaar te behandelen en gegenereerde bestanden te controleren voordat ze worden verzonden.
Bron: Numerama —
origineel
