Benchmark estone rivela vulnerabilità diffusa dell'AI alla propaganda russa

Propaganda russa: Mistral bocciato, Claude al top del benchmark estone

Resistere alla propaganda russa non è questione di valori aziendali: è questione di architettura del modello. Il benchmark pubblicato dall'Istituto della Lingua Estone lo dimostra con dati precisi: Mistral, l'azienda francese che si posiziona come alternativa europea ai provider americani e cinesi, figura sistematicamente tra i modelli più vulnerabili alla disinformazione russa. Il momento è scomodo: l'azienda sta trattando un round di finanziamento da 3 miliardi di euro a una valutazione di 20 miliardi.

Il benchmark: 60 modelli, 14 narrative di propaganda

Il test ha coinvolto 60 modelli AI valutati su 75 domande in 3 lingue, costruite attorno a 14 narrative propagandistiche tipiche dei network di disinformazione russi. Ogni domanda era formulata in tre versioni — neutrale, tendenziosa e manipolativa — per misurare la resistenza del modello anche sotto pressione retorica. Il punteggio individuale va da 1 a 5, dove 1 indica che il modello ripete i talking point russi senza filtro.

Come sistema valutatore è stato impiegato un Claude Opus 4.5 calibrato ad hoc, con i risultati validati dagli esperti di disinformazione di Propastop. I modelli non avevano accesso a ricerca web o strumenti esterni durante il test: l'obiettivo era misurare la capacità intrinseca del sistema di riconoscere e rifiutare la propaganda.

Claude domina, Mistral finisce nell'ultimo terzo

I modelli Anthropic occupano le prime posizioni, seguiti da Nvidia Nemotron 3 e Alibaba Qwen 3.6 Plus. Claude Fable 5 guida la classifica con un punteggio di 95.2 — pur essendo il modello attualmente bloccato al di fuori degli Stati Uniti dopo la direttiva governativa del 12 giugno 2026, come avevamo riportato.

Benchmark estone rivela vulnerabilità diffusa dell'AI alla propaganda russa
Un uomo esamina attentamente un oggetto utilizzando una lente d'ingrandimento. Foto di cottonbro studio su Pexels

I modelli Mistral, incluso il più recente Medium 3.5, si posizionano nell'ultimo terzo della classifica. Il risultato si allinea con uno studio indipendente di Newsguard che aveva già misurato per Mistral un tasso di misinformazione del 36,67%. Metodologie diverse, stesso verdetto: la convergenza è difficile da ignorare.

Un messaggio su tre sfugge al filtro: il rischio operativo

La minaccia propagandistica è strutturale e attiva. Le reti russe come "Pravda" alimentano sistematicamente i modelli AI con milioni di articoli di disinformazione. OpenAI ha già smantellato una campagna russa che usava ChatGPT per diffondere propaganda in vista delle elezioni federali tedesche.

Considerando il 36,67% rilevato da Newsguard, poco più di un messaggio su tre contenente disinformazione può superare il filtro di Mistral. Per chi integra un modello linguistico in flussi editoriali, sistemi di moderazione o strumenti di ricerca automatizzata, non si tratta di una statistica astratta: è un rischio operativo concreto che si traduce direttamente nell'integrità dei contenuti distribuiti.

Che Claude Fable 5 — il migliore dei 60 modelli testati, con punteggio 95.2 — sia attualmente inaccessibile fuori dagli Stati Uniti è l'ironia che il mercato europeo difficilmente potrà ignorare a lungo. Il modello più efficace contro la propaganda russa è anche il meno disponibile nei contesti geografici che ne avrebbero più bisogno.

Fonti

Francesco Leone
Francesco Leone

Francesco Leone è un esperto in Intelligenza Artificiale con una profonda conoscenza in Machine Learning e Deep Learning. Attraverso la sua esperienza, ha contribuito allo sviluppo di soluzioni innovative in ambito di elaborazione del linguaggio naturale e visione artificiale, mirando a trasformare il modo in cui interagiamo con la tecnologia. Attivo nel settore con pubblicazioni e progetti su https://ital-ia.it/, Francesco si dedica alla ricerca e all'applicazione di algoritmi avanzati per rendere i sistemi più intelligenti e accessibili.

Articoli: 567

Lascia una risposta

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *