NPR-NewsGuard : les chatbots IA démentent 75 % des faux récits
TL;DR
- Sur 30 requêtes bâties sur de fausses informations chinoises, iraniennes et russes (déc. 2025 - juil. 2026), les chatbots IA débusquent le piège dans environ 75 % des cas.
- Les résumés IA de Bing échouent le plus souvent à corriger le faux ; Google AI Overview fait mieux, mais une affirmation sur neuf n'y est adossée à aucune source.
- Gemini a attribué une fausse info sur l'Ukraine à « une campagne de désinformation russe » ; ChatGPT a signalé des chiffres venus « des médias d'État chinois ».
Sur 30 requêtes bâties à partir de 15 fausses informations diffusées par la Chine, l'Iran et la Russie entre décembre 2025 et juillet 2026, les chatbots IA testés par NPR et NewsGuard ont correctement démenti le récit environ 75 % du temps — mieux que les moteurs de recherche classiques. L'étude compare ChatGPT, Gemini, Copilot, Meta AI, Grok et Claude à Google, Microsoft Bing, DuckDuckGo et au russe Yandex.
Interrogé sur un supposé bombardement d'un monastère par l'Ukraine, Gemini a répondu que l'affirmation « stems from a Russian disinformation campaign aimed at deflecting blame ». À propos de chiffres de pétition, ChatGPT a signalé qu'ils « appear to originate from Chinese state media » plutôt que de sources auditées.
Mike Caulfield, chercheur en littératie numérique à l'Université de Washington à Bothell, pose la barre : si un enseignant voyait trois quarts de ses élèves réussir un même exercice, « you would be ecstatic ». Il conseille de redemander une synthèse au chatbot pour affiner la réponse.
Le tableau se gâte dès qu'on quitte les chatbots dédiés. Les résumés IA en haut des pages de résultats font moins bien : Google AI Overview démasque la plupart des récits, mais ceux de Microsoft Bing « failed to debunk most of the time », DuckDuckGo se situant entre les deux. Environ une affirmation sur neuf dans les Google AI Overviews n'est adossée à aucune source, relève NPR.
Google conteste la méthode et juge les requêtes testées « rares » ; Microsoft rappelle que ses services s'appuient sur les résultats de recherche et invite à vérifier les sources ; Anthropic dit que Claude est conçu pour signaler les affirmations contestées. Morgan Wack, postdoctorant à l'Université de Zurich, remet la performance en perspective : les outils de recherche classiques « were never perfectly useful or neutral ». Une étude Nature citée par NPR relève par ailleurs que les modèles renvoient des réponses plus positives sur le gouvernement chinois lorsqu'on les interroge en chinois plutôt qu'en anglais.
Shared on Bluesky by 4 AI experts
-
Yes, I am quoted in this. But more generally this is the kind of detailed indepth reporting on AI we need so much more of, reporting that doesn't stop at "I saw this error in a response" but contextualizes when and where…
View on Bluesky →
Article original publié par npr.org
Lire l'article original →Titre original : NPR : les chatbots IA se révèlent plus résistants à la propagande étrangère que les moteurs de recherche