The Prague Post - L'intoxication des données, la menace invisible qui cible les chatbots IA

EUR -
AED 4.248105
AFN 75.770596
ALL 92.762559
AMD 422.720519
ANG 2.0703
AOA 1061.880869
ARS 1706.354669
AUD 1.637736
AWG 2.083564
AZN 1.971037
BAM 1.955432
BBD 2.326962
BDT 141.823334
BGN 1.962242
BHD 0.435718
BIF 3453.950583
BMD 1.156733
BND 1.477822
BOB 13.465468
BRL 6.040925
BSD 1.155383
BTN 110.192281
BWP 15.565073
BYN 3.514139
BYR 22671.957183
BZD 2.323663
CAD 1.60514
CDF 2629.253412
CHF 0.941189
CLF 0.026851
CLP 1056.7913
CNY 7.800083
CNH 7.801606
COP 3603.822404
CRC 519.802266
CUC 1.156733
CUP 30.653411
CVE 110.244272
CZK 24.210763
DJF 205.741316
DKK 7.473191
DOP 67.627285
DZD 152.299364
EGP 57.668157
ERN 17.350988
ETB 186.897659
FJD 2.584377
FKP 0.854867
GBP 0.85516
GEL 3.019524
GGP 0.854867
GHS 12.651621
GIP 0.854867
GMD 85.024294
GNF 10149.091752
GTQ 8.815343
GYD 241.67456
HKD 9.077054
HNL 30.972177
HRK 7.532994
HTG 151.121586
HUF 363.017812
IDR 20622.34285
ILS 3.418265
IMP 0.854867
INR 110.410701
IQD 1513.515426
IRR 1590030.052589
ISK 142.166837
JEP 0.854867
JMD 182.965599
JOD 0.820169
JPY 184.272161
KES 149.331922
KGS 101.156702
KHR 4675.120976
KMF 493.925187
KPW 1041.059598
KRW 1638.477341
KWD 0.357061
KYD 0.962819
KZT 536.1092
LAK 26076.097131
LBP 103462.246866
LKR 384.457714
LRD 209.700572
LSL 18.691186
LTL 3.415531
LVL 0.699696
LYD 7.356617
MAD 10.715985
MDL 20.034233
MGA 4974.064769
MKD 61.513434
MMK 2428.897217
MNT 4159.622075
MOP 9.338444
MRU 46.399276
MUR 54.486429
MVR 17.871955
MWK 2003.423313
MXN 19.69164
MYR 4.726298
MZN 73.927211
NAD 18.691186
NGN 1572.659254
NIO 42.522005
NOK 10.922567
NPR 176.30785
NZD 1.940013
OMR 0.441007
PAB 1.155383
PEN 3.896867
PGK 5.190024
PHP 71.098608
PKR 320.900664
PLN 4.306226
PYG 6934.696128
QAR 4.211808
RON 5.236186
RSD 117.317942
RUB 97.161731
RWF 1698.980555
SAR 4.340955
SBD 9.310058
SCR 15.912008
SDG 694.622124
SEK 11.020235
SGD 1.480159
SHP 0.856984
SLE 28.344188
SLL 24256.10146
SOS 660.275854
SRD 43.926343
STD 23942.02751
STN 24.495394
SVC 10.109099
SYP 15039.835978
SZL 18.688486
THB 38.337629
TJS 10.669694
TMT 4.060131
TND 3.387463
TOP 2.785134
TRY 55.369898
TTD 7.827528
TWD 37.04043
TZS 3061.72433
UAH 51.684982
UGX 4292.192975
USD 1.156733
UYU 46.291296
UZS 13754.413873
VES 890.810236
VND 30246.82002
VUV 136.425482
WST 3.163074
XAF 655.833689
XAG 0.017878
XAU 0.000264
XCD 3.126128
XCG 2.082208
XDR 0.81787
XOF 655.833689
XPF 119.331742
YER 274.381102
ZAR 18.703474
ZMK 10411.984809
ZMW 21.835894
ZWL 372.467396
  • AEX

    -1.7900

    1117.82

    -0.16%

  • BEL20

    -43.9500

    5664.48

    -0.77%

  • PX1

    -13.8400

    8636.8

    -0.16%

  • ISEQ

    -53.2200

    14331.67

    -0.37%

  • OSEBX

    19.4200

    2085.84

    +0.94%

  • PSI20

    0.0000

    9254.52

    0%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    -130.9900

    4192.21

    -3.03%

  • N150

    14.3400

    4360.83

    +0.33%

L'intoxication des données, la menace invisible qui cible les chatbots IA
L'intoxication des données, la menace invisible qui cible les chatbots IA / Photo: Nicolas TUCAT - AFP/Archives

L'intoxication des données, la menace invisible qui cible les chatbots IA

Le recours aux agents conversationnels basés sur l'intelligence artificielle occupe une place croissante dans le rapport des utilisateurs à l'information. Mais aux biais et aux erreurs des "chatbots" s'ajoute la menace de manipulation des données sur lesquels ils sont entraînés.

Taille du texte:

. L'IA, cible de choix

ChatGPT, Mistral, Claude ou Gemini... Prisés des utilisateurs pour leur rapidité et leur facilité d'utilisation, les "chatbots" IA sont entraînés à formuler leurs réponses à partir de gigantesques bases de données regroupant des milliards de documents, inlassablement compilés et archivés par des "robots" qui parcourent internet en quête de données.

Il y apprennent comment, statistiquement, les mots s'enchaînent pour former des phrases et des idées, afin de pouvoir ensuite générer des réponses cohérentes qui ont le plus de chances de correspondre à la requête de l'usager.

Mais ce mode de collecte et d'entraînement expose les "chatbots" à de possibles manipulations par des acteurs malveillants, susceptibles d'introduire dans leurs données d'entraînement des éléments indésirables comme de la désinformation, de la propagande ou du code informatique malveillant.

. Empoisonnement, conditionnement

Chercheurs au Laboratoire d'investigation numérique de l'Atlantic council, un think tank d'étude des relations internationales, Valentin Châletet et Esteban Ponce de León distinguent deux concepts:

L'empoisonnement de données des grands modèles de langage (LLM) sur lesquels reposent les chatbots ("LLM poisoning") se produit en amont, lors de l'entraînement, via l'injection d'éléments non désirés. Ces manipulations sont pensées pour contourner les mécanismes de filtrage mis en place par les entreprises pour garantir des données fiables.

Le conditionnement ("LLM grooming") intervient plus tard, alors que le chatbot est déjà déployé: des acteurs malveillants diffusent massivement du contenu en ligne pour qu'il soit intégré par les modèles IA.

Ainsi, des tests menés par l'entreprise d'analyse de la fiabilité des contenus en ligne Newsguard ont montré que, dans diverses circonstances, les principaux chabots commerciaux pouvaient répondre en s'appuyant sur de fausses informations du réseau Pravda, une nébuleuse de sites web destinés à amplifier la propagande prorusse.

Ces manipulations peuvent être difficiles à repérer et endiguer, notamment parce que le fonctionnement de ces modèles est volontairement rendu opaque par leurs concepteurs: "On a affaire à un réseau de neurones qui fonctionne comme une boîte noire", explique Valentin Châtelet.

Expurger les données en question nécessiterait le plus souvent un réentraînement complet du modèle, estime le chercheur, et présenterait "un coût extrême" en temps et en ressources. La complexité de ces systèmes algorithmiques rend également très ardus leur audit ou leur régulation.

. "Désinformation à la demande"

Le phénomène est difficile à mesurer et son impact sur les utilisateurs complexe voire impossible à démontrer. Mais, difficilement traçables et relativement peu coûteuses, ces opérations ont de quoi séduire les acteurs qui souhaiteraient promouvoir leurs narratifs, qu'il s'agisse d'Etats, de lobbies ou d'entreprises.

"Ce type d'opération pourrait être mené par un groupe industriel qui veut enterrer les résultats d'une étude médicale scientifique qui ne va pas dans leur sens, par un homme politique qui veut pousser un récit qui va servir sa campagne...", énumère Chine Labbé, rédactrice en chef française de Newsguard.

Esteban Ponce de León observe pour sa part le développement d'un écosystème de "désinformation à la demande", au sein duquel des Etats ou des entités "délègueraient (...) l'opération à une autre entité, probablement privée, qui dispose déjà de l'expertise technologique nécessaire pour mener à bien" une campagne d'influence visant les LLM.

En septembre 2025, une entreprise dirigée par l'ancien directeur de campagne de Donald Trump a ainsi reçu plusieurs millions de dollars d'entreprises liées à l'Etat israélien pour diffuser des éléments de langage favorables via un réseau de sites web, avec pour objectif notamment d'influencer les réponses des chatbots, selon le think tank américain Quincy Institute for Responsible Statecraft.

Face au risque, les entreprises d'IA sont les premières concernées: il est ainsi crucial d'"apprendre aux chatbots à distinguer et à ne pas pondérer de la même manière les sources fiables et les sources de propagande étrangère ou de désinformation", argue Chine Labbé.

D.Kovar--TPP