
Les grands modèles d’intelligence artificielle seraient plus réticents à produire des critiques visant des gouvernements qui limitent déjà la liberté d’expression. C’est la conclusion d’une étude que vient de publier aujourd’hui l’Oversight Board, l’organisme indépendant principalement chargé d’évaluer les politiques de modération de Meta.
Pour cette première évaluation consacrée aux grands modèles de langage, les chercheurs ont analysé dix modèles commerciaux d’Anthropic, DeepSeek, Google, Meta, OpenAI et xAI. Ils leur ont notamment demandé de rédiger des tracts de manifestation, des poèmes satiriques et des opinions sur des dirigeants ou des institutions politiques.
Les expériences ont porté sur cinq pays considérés comme restrictifs en matière de liberté d’expression, soit le Cambodge, la Chine, l’Arabie saoudite, la Thaïlande et la Turquie. Les réponses ont été comparées à celles concernant le Chili, le Japon, Taïwan, le Royaume-Uni et les États-Unis.
Au total, les modèles ont refusé 34 % des demandes de création de contenu critique visant les régimes restrictifs, contre 14 % pour les pays où la critique politique est davantage protégée. Ils étaient donc plus de deux fois plus susceptibles de refuser de critiquer un gouvernement répressif.
Les écarts variaient toutefois considérablement d’un modèle à l’autre. Gemini 3 Flash et Grok 4 Fast n’ont refusé aucune demande de cette catégorie, indépendamment du pays concerné. GPT-5.2 affichait des résultats presque équivalents entre les deux groupes, avec 23 % de refus pour les contextes permissifs et 24 % pour les contextes restrictifs.
À l’inverse, Gemini 3 Pro a refusé 1 % des demandes visant les pays permissifs, contre 30 % pour les régimes restrictifs. Llama 4 Maverick est passé de 0 % à 30 %, tandis que Claude Sonnet 4 a refusé 16 % des demandes dans les pays permissifs et 59 % dans les pays restrictifs.
Taïwan constitue une anomalie importante. Bien que l’île soit classée parmi les juridictions où la liberté d’expression est protégée, plusieurs modèles ont refusé plus souvent de produire des critiques la concernant. Claude Opus 4 a notamment enregistré un taux de refus de 82,5 % pour Taïwan, contre 47,5 % en moyenne pour les quatre autres pays permissifs étudiés.
Certaines réponses invoquaient directement les lois locales. Gemini 3 Pro a par exemple refusé de rédiger un tract contre le roi de Thaïlande en mentionnant les lois de lèse-majesté. D’autres modèles affirmaient respecter des politiques générales interdisant la critique de certains dirigeants, mais appliquaient ces restrictions de manière inégale selon le pays.
L’étude observe également que, lorsqu’ils acceptaient de répondre, les modèles étaient plus enclins à recommander de soutenir les gouvernements permissifs. Ils étaient aussi plus susceptibles de déconseiller une manifestation contre un régime restrictif, souvent en invoquant les risques juridiques ou les dangers pour la sécurité des participants.
Selon l’Oversight Board, cette tendance pourrait étendre indirectement l’influence de lois autoritaires au-delà des frontières où elles s’appliquent. Une personne située dans un pays démocratique pourrait ainsi obtenir moins d’aide pour produire du matériel légalement destiné à critiquer la Chine ou l’Arabie saoudite.
Le rapport ne permet cependant pas de déterminer la cause de ces différences. Elles pourraient provenir des données d’entraînement, des mécanismes d’alignement, des politiques de sécurité, de restrictions délibérées ou d’une combinaison de ces facteurs. Les auteurs reconnaissent également que les modèles changent rapidement et que leur expérience repose sur un nombre limité de formulations, toutes soumises en anglais depuis une adresse IP située en Australie.
L’Oversight Board réclame davantage de transparence de la part des entreprises d’IA. Il leur recommande de publier leurs règles concernant les demandes gouvernementales, d’avertir clairement les utilisateurs lorsqu’une réponse est influencée par une loi locale et d’intégrer une analyse des droits humains à toutes les étapes de conception des modèles.
Source : Oversight Board
+++++++
+++++++
Du lundi au vendredi, Bruno Guglielminetti vous propose un regard sur l’essentiel de l’actualité numérique avec 120 secondes de Tech.
Ou encore…
Écoutez la plus récente édition de Mon Carnet,
le magazine hebdomadaire de l’actualité numérique.
En savoir plus sur Mon Carnet
Subscribe to get the latest posts sent to your email.


