In het kort
- Grote AI-chatbots verspreiden Russische propaganda van organisaties waarvoor sancties gelden.
- Met ‘Generative Engine Optimization’ kunnen kwaadwillenden de resultaten van modellen manipuleren.
- Door technische spoofing-trucs zien LLM’s nep-ngo’s als betrouwbare bronnen.
Uit een recent onderzoek van de Britse denktank Demos blijkt dat populaire AI-chatbots Russische propaganda overnemen van organisaties die door de EU zijn gesanctioneerd. Deze ontdekking wijst op een groeiende kwetsbaarheid in grote taalmodellen (LLM’s) en suggereert dat hybride oorlogsvoering zich ontwikkelt om AI-gestuurde informatiestromen aan te vallen. Dat meldt Euronews.
Het onderzoek richtte zich op de „Foundation to Battle Injustice“ (r-FBI), een groep die zichzelf voordoet als een mensenrechten-ngo, maar in werkelijkheid is opgericht door wijlen Yevgeny Prigozhin, de oprichter van de Wagner-groep. Ondanks dat deze organisatie op de zwarte lijst van de VS en de EU staat, werden de verzinsels ervan – waaronder extreme beweringen over Oekraïense functionarissen en het misbruik van menselijke stoffelijke resten – door verschillende AI-systemen als geloofwaardig beschouwd.
Analyse van de prestaties en nauwkeurigheid van LLM’s
Onderzoekers testten vijf grote LLM’s van Google, OpenAI, Anthropic, Mistral AI en xAI met behulp van prompts in het Frans, Duits en Engels. Ze ontdekten dat elk model r-FBI als een betrouwbare bron beschouwde. Ongeveer 16,6 procent van de AI-antwoorden onderschreef deze verhalen of presenteerde ze als legitieme argumenten.
Nog eens 30,9 procent van de antwoorden ging in op de onderwerpen zonder te vermelden dat de informatie afkomstig was van een gesanctioneerde beïnvloedingsoperatie, terwijl slechts 52 procent van de antwoorden de onwaarheden met succes ontkrachtte.
Gedocumenteerde mislukkingen bij het filteren van content
Concrete voorbeelden van deze mislukkingen zijn onder meer GPT 4.1 Mini, die r-FBI aanhaalde om beweringen over mensenvlees in Oekraïne te ondersteunen, en Mistral Small 3.2, die beschuldigingen bevestigde dat de crypto-activiteiten van president Zelensky energietekorten veroorzaakten.
Experts waarschuwen dat dit samenhangt met de opkomst van Generative Engine Optimization (GEO). Terwijl SEO is ontworpen voor traditionele zoekmachines, is GEO een nieuwe strategie die wordt gebruikt om te manipuleren hoe AI-modellen gegevens ophalen en presenteren. Hannah Perry van Demos Digital merkt op dat GEO momenteel weliswaar wordt gebruikt voor branding en marketing, maar dat de technieken die worden ingezet om content beter zichtbaar te maken voor AI, ook als wapen kunnen worden ingezet. Carl Miller van het Centre for the Analysis of Social Media (CASM) legde uit dat „technische spoofing“ Russische agenten in staat stelt om AI te misleiden, zodat deze nep-ngo’s als legitiem beschouwt, waardoor commerciële optimalisatietools in feite worden omgevormd tot instrumenten voor informatieoorlogvoering.
Reacties uit de sector op de bevindingen
In reactie op de bevindingen kwamen de techbedrijven met verschillende verklaringen. Mistral zegt dat het zich inzet tegen desinformatie en maakt een onderscheid tussen zijn ruwe modellen en de meer verfijnde Vibe Work-agent. OpenAI stelt dat het model in het onderzoek een verouderde API‑versie was en niet de huidige ChatGPT.
Anthropic laat weten dat het speciale teams voor dreigingsinformatie inzet om buitenlandse beïnvloedingsoperaties te verstoren en een evenwichtige weergave van standpunten te waarborgen. Google en xAI gaven geen commentaar.
