Zürcher Nachrichten - L'intoxication des données, la menace invisible qui cible les chatbots IA

EUR -
AED 4.10979
AFN 72.739575
ALL 91.707515
AMD 402.618171
ANG 2.003547
AOA 1027.307766
ARS 1698.154545
AUD 1.610639
AWG 2.014329
AZN 1.910751
BAM 1.954441
BBD 2.252364
BDT 137.744196
BGN 1.883891
BHD 0.421705
BIF 3358.64898
BMD 1.119072
BND 1.431598
BOB 13.418607
BRL 5.619196
BSD 1.118237
BTN 108.149297
BWP 15.459455
BYN 3.429515
BYR 21933.80456
BZD 2.249066
CAD 1.596792
CDF 2590.651175
CHF 0.932718
CLF 0.027688
CLP 1093.276849
CNY 7.502872
CNH 7.500897
COP 3635.248338
CRC 510.542625
CUC 1.119072
CUP 26.838333
CVE 110.18787
CZK 24.415514
DJF 199.134167
DKK 7.474593
DOP 67.412812
DZD 150.584522
EGP 58.606341
ERN 16.786075
ETB 180.629154
FJD 2.521041
FKP 0.842872
GBP 0.848116
GEL 2.903987
GGP 0.842872
GHS 13.217748
GIP 0.842872
GMD 82.811063
GNF 9838.113421
GTQ 8.541021
GYD 233.886282
HKD 8.782161
HNL 30.019523
HRK 7.533141
HTG 146.434226
HUF 366.228489
IDR 20063.835814
ILS 3.437956
IMP 0.842872
INR 108.266323
IQD 1466.543412
IRR 1938399.978216
ISK 136.996684
JEP 0.842872
JMD 177.648823
JOD 0.793409
JPY 177.003008
KES 145.154841
KGS 97.861141
KHR 4552.711441
KMF 492.391187
KPW 1007.164851
KRW 1498.341881
KWD 0.347662
KYD 0.931952
KZT 499.872328
LAK 25076.558705
LBP 100190.027331
LKR 369.972676
LRD 191.226144
LSL 18.667217
LTL 3.304327
LVL 0.676915
LYD 7.1841
MAD 11.151794
MDL 19.916148
MGA 4986.598552
MKD 61.532203
MMK 2349.707655
MNT 4025.290259
MOP 9.039672
MRU 44.774658
MUR 53.178293
MVR 17.244706
MWK 1939.077321
MXN 20.151744
MYR 4.573872
MZN 71.519404
NAD 18.667217
NGN 1487.492748
NIO 41.204584
NOK 10.718583
NPR 173.041965
NZD 2.000722
OMR 0.430287
PAB 1.118217
PEN 3.849523
PGK 4.981267
PHP 70.273785
PKR 309.678263
PLN 4.379722
PYG 6524.549488
QAR 4.077046
RON 5.35062
RSD 117.374947
RUB 95.124916
RWF 1651.673364
SAR 4.200585
SBD 8.953146
SCR 15.570006
SDG 673.094347
SEK 11.20226
SGD 1.433514
SHP 0.846659
SLE 27.607944
SLL 23466.364114
SOS 639.064083
SRD 42.380339
STD 23162.52399
STN 24.703507
SVC 9.785194
SYP 14550.170024
SZL 18.598672
THB 37.65703
TJS 10.321475
TMT 3.927942
TND 3.358892
TOP 2.694456
TRY 55.074586
TTD 7.585724
TWD 35.716317
TZS 2968.263694
UAH 50.177373
UGX 4556.810279
USD 1.119072
UYU 44.849007
UZS 13189.826188
VES 977.664367
VND 29057.814755
VUV 134.492732
WST 3.116292
XAF 655.957
XAG 0.018878
XAU 0.000271703748
XCD 3.024347
XCG 2.015398
XDR 0.791242
XOF 655.957
XPF 119.331742
YER 264.32451
ZAR 18.640913
ZMK 10072.998058
ZMW 22.242828
ZWL 360.340618
SSP 6432.133462
MXV 2.277139
  • AEX

    -10.6100

    1117.75

    -0.94%

  • BEL20

    -42.3300

    5527.87

    -0.76%

  • PX1

    -95.9600

    7769.21

    -1.22%

  • ISEQ

    -125.8900

    14344.11

    -0.87%

  • OSEBX

    -15.6500

    2043.68

    -0.76%

  • PSI20

    -86.6700

    9333.76

    -0.92%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    0.4400

    4400.22

    +0.01%

  • N150

    -41.6100

    4160.98

    -0.99%

L'intoxication des données, la menace invisible qui cible les chatbots IA
L'intoxication des données, la menace invisible qui cible les chatbots IA / Photo: Nicolas TUCAT - AFP/Archives

L'intoxication des données, la menace invisible qui cible les chatbots IA

Le recours aux agents conversationnels basés sur l'intelligence artificielle occupe une place croissante dans le rapport des utilisateurs à l'information. Mais aux biais et aux erreurs des "chatbots" s'ajoute la menace de manipulation des données sur lesquels ils sont entraînés.

Taille du texte:

. L'IA, cible de choix

ChatGPT, Mistral, Claude ou Gemini... Prisés des utilisateurs pour leur rapidité et leur facilité d'utilisation, les "chatbots" IA sont entraînés à formuler leurs réponses à partir de gigantesques bases de données regroupant des milliards de documents, inlassablement compilés et archivés par des "robots" qui parcourent internet en quête de données.

Il y apprennent comment, statistiquement, les mots s'enchaînent pour former des phrases et des idées, afin de pouvoir ensuite générer des réponses cohérentes qui ont le plus de chances de correspondre à la requête de l'usager.

Mais ce mode de collecte et d'entraînement expose les "chatbots" à de possibles manipulations par des acteurs malveillants, susceptibles d'introduire dans leurs données d'entraînement des éléments indésirables comme de la désinformation, de la propagande ou du code informatique malveillant.

. Empoisonnement, conditionnement

Chercheurs au Laboratoire d'investigation numérique de l'Atlantic council, un think tank d'étude des relations internationales, Valentin Châletet et Esteban Ponce de León distinguent deux concepts:

L'empoisonnement de données des grands modèles de langage (LLM) sur lesquels reposent les chatbots ("LLM poisoning") se produit en amont, lors de l'entraînement, via l'injection d'éléments non désirés. Ces manipulations sont pensées pour contourner les mécanismes de filtrage mis en place par les entreprises pour garantir des données fiables.

Le conditionnement ("LLM grooming") intervient plus tard, alors que le chatbot est déjà déployé: des acteurs malveillants diffusent massivement du contenu en ligne pour qu'il soit intégré par les modèles IA.

Ainsi, des tests menés par l'entreprise d'analyse de la fiabilité des contenus en ligne Newsguard ont montré que, dans diverses circonstances, les principaux chabots commerciaux pouvaient répondre en s'appuyant sur de fausses informations du réseau Pravda, une nébuleuse de sites web destinés à amplifier la propagande prorusse.

Ces manipulations peuvent être difficiles à repérer et endiguer, notamment parce que le fonctionnement de ces modèles est volontairement rendu opaque par leurs concepteurs: "On a affaire à un réseau de neurones qui fonctionne comme une boîte noire", explique Valentin Châtelet.

Expurger les données en question nécessiterait le plus souvent un réentraînement complet du modèle, estime le chercheur, et présenterait "un coût extrême" en temps et en ressources. La complexité de ces systèmes algorithmiques rend également très ardus leur audit ou leur régulation.

. "Désinformation à la demande"

Le phénomène est difficile à mesurer et son impact sur les utilisateurs complexe voire impossible à démontrer. Mais, difficilement traçables et relativement peu coûteuses, ces opérations ont de quoi séduire les acteurs qui souhaiteraient promouvoir leurs narratifs, qu'il s'agisse d'Etats, de lobbies ou d'entreprises.

"Ce type d'opération pourrait être mené par un groupe industriel qui veut enterrer les résultats d'une étude médicale scientifique qui ne va pas dans leur sens, par un homme politique qui veut pousser un récit qui va servir sa campagne...", énumère Chine Labbé, rédactrice en chef française de Newsguard.

Esteban Ponce de León observe pour sa part le développement d'un écosystème de "désinformation à la demande", au sein duquel des Etats ou des entités "délègueraient (...) l'opération à une autre entité, probablement privée, qui dispose déjà de l'expertise technologique nécessaire pour mener à bien" une campagne d'influence visant les LLM.

En septembre 2025, une entreprise dirigée par l'ancien directeur de campagne de Donald Trump a ainsi reçu plusieurs millions de dollars d'entreprises liées à l'Etat israélien pour diffuser des éléments de langage favorables via un réseau de sites web, avec pour objectif notamment d'influencer les réponses des chatbots, selon le think tank américain Quincy Institute for Responsible Statecraft.

Face au risque, les entreprises d'IA sont les premières concernées: il est ainsi crucial d'"apprendre aux chatbots à distinguer et à ne pas pondérer de la même manière les sources fiables et les sources de propagande étrangère ou de désinformation", argue Chine Labbé.

D.Smith--NZN