The Prague Post - IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni

EUR -
AED 4.243454
AFN 75.681362
ALL 93.352162
AMD 422.408246
AOA 1059.564012
ARS 1729.138262
AUD 1.638404
AWG 2.079843
AZN 1.963661
BAM 1.957305
BBD 2.325988
BDT 142.949883
BHD 0.435533
BIF 3446.033988
BMD 1.155468
BND 1.480838
BOB 14.025478
BRL 5.907559
BSD 1.154888
BTN 109.790919
BWP 15.660971
BYN 3.415626
BYR 22647.176448
BZD 2.322635
CAD 1.623083
CDF 2611.357712
CHF 0.934236
CLF 0.026744
CLP 1056.005978
CNY 7.803513
CNH 7.79714
COP 3704.015036
CRC 523.70256
CUC 1.155468
CUP 30.619907
CVE 110.349824
CZK 24.193207
DJF 205.640063
DKK 7.475174
DOP 67.351772
DZD 153.410303
EGP 57.527756
ERN 17.332023
ETB 186.394945
FJD 2.555838
FKP 0.858771
GBP 0.857178
GEL 3.015959
GGP 0.858771
GHS 13.539881
GIP 0.858771
GMD 85.504071
GNF 10143.797342
GTQ 8.808771
GYD 241.576287
HKD 9.062464
HNL 30.953794
HRK 7.536772
HTG 150.996068
HUF 362.11799
IDR 20648.216486
ILS 3.468136
IMP 0.858771
INR 109.855387
IQD 1512.862909
IRR 1588913.18939
ISK 141.811219
JEP 0.858771
JMD 183.521069
JOD 0.819249
JPY 182.057301
KES 149.574978
KGS 101.045388
KHR 4680.577616
KMF 494.540184
KRW 1644.82625
KWD 0.357167
KYD 0.962436
KZT 541.934229
LAK 26105.501972
LBP 103414.555274
LKR 387.537893
LRD 208.449329
LSL 18.945963
LTL 3.411798
LVL 0.698931
LYD 7.35065
MAD 10.763574
MDL 20.065337
MGA 4915.672226
MKD 61.577333
MMK 2425.677069
MNT 4157.602989
MOP 9.330031
MRU 46.309597
MUR 53.68301
MVR 17.86373
MWK 2002.461267
MXN 19.887335
MYR 4.730258
MZN 73.830248
NAD 18.945963
NGN 1574.211541
NIO 42.502671
NOK 10.985539
NPR 175.666792
NZD 1.967803
OMR 0.444286
PAB 1.154863
PEN 3.909405
PGK 5.17798
PHP 70.182561
PKR 320.672995
PLN 4.305413
PYG 6887.29413
QAR 4.222145
RON 5.247328
RSD 117.367819
RUB 93.588103
RWF 1696.496723
SAR 4.335928
SBD 9.32642
SCR 15.50525
SDG 693.843401
SEK 10.96306
SGD 1.480553
SLE 27.615748
SOS 660.010193
SRD 43.781846
STD 23915.858572
STN 24.518847
SVC 10.104767
SZL 18.930634
THB 38.287014
TJS 10.659063
TMT 4.055693
TND 3.388605
TRY 54.972826
TTD 7.834022
TWD 37.330285
TZS 3061.988403
UAH 51.680025
UGX 4307.310947
USD 1.155468
UYU 46.435694
UZS 13728.552874
VES 871.467105
VND 30332.195355
VUV 138.152408
WST 3.16223
XAF 656.458767
XAG 0.018593
XAU 0.000275
XCD 3.12271
XCG 2.081309
XDR 0.81744
XOF 656.461609
XPF 119.331742
YER 275.405769
ZAR 18.893401
ZMK 10400.608613
ZMW 22.045469
ZWL 372.060285
  • AEX

    -1.1100

    1111.41

    -0.1%

  • BEL20

    65.6300

    5773

    +1.15%

  • PX1

    6.9300

    8673.74

    +0.08%

  • ISEQ

    142.1400

    13941.7

    +1.03%

  • OSEBX

    -5.6500

    2013.36

    -0.28%

  • PSI20

    1.8300

    9170.48

    +0.02%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    33.0300

    4214.68

    +0.79%

  • N150

    9.0400

    4313.48

    +0.21%

IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni
IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni / Photo: Nicolas TUCAT - AFP/Archives

IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni

L'institut britannique de sécurité de l'IA (AISI) a dit avoir rencontré un "incident sérieux" lors d'une évaluation de routine au cours de laquelle Mythos 5 d'Anthropic a créé de fausses identités en ligne pour écrire à des développeurs afin de les convaincre d'intégrer du code malveillant.

Taille du texte:

Cette information, qui provient d'un rapport publié mardi par cet organisme qui dépend du gouvernement britannique, intervient après une série d'incidents aux Etats-Unis qui ont vu les modèles les plus puissants d'OpenAI (GPT-5.6 Sol) et d'Anthropic (Mythos 5) s'introduire sans autorisation chez d'autres entreprises.

Lors de l'évaluation britannique, menée avec un accès à internet ouvert et certains filtres de sécurité désactivés, des agents d'IA ont mené "des actions dirigées contre des personnes et des organisations réelles", explique l'AISI dans un compte rendu publié sur son site internet.

Les tentatives des modèles d'IA "n'ont pas abouti et nos investigations n'ont mis en évidence aucun dommage dans le monde réel", précise l'organisme.

"Mais c'est la première fois que nous voyons des risques liés à l'autonomie et à un comportement de dissimulation se manifester aussi clairement, sans sollicitation spécifique, dans le monde réel."

La semaine dernière, Anthropic avait déjà indiqué que ses modèles avaient "obtenu un accès non autorisé" à trois organisations lors de tests pourtant censés les empêcher d'accéder à des systèmes "réels".

Cette annonce était intervenue quelques jours seulement après que son rival OpenAI a révélé que deux de ses modèles étaient sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face.

L'incident britannique, détecté et rapidement contenu le 28 juillet, a visé la plateforme destinée aux développeurs GitHub.

"Il a pour origine une seule évaluation, au cours de laquelle des agents se sont vu confier la tâche de résoudre un défi en cybersécurité", à plusieurs reprises, a précisé l'AISI.

Les incidents détectés l'ont été presque exclusivement avec Mythos 5 et, de façon plus marginale, avec GPT-5.6 Sol.

"Il ne s'agit pas d'un cas où un modèle se serait échappé de son environnement de test sécurisé" car "nous avions intentionnellement autorisé l’accès à internet" et désactivé des sécurités, "des conditions qui ne reflètent pas la manière dont les modèles de pointe sont mis à la disposition du public", insiste l'AISI.

Cet incident "met en évidence la nécessité d'un débat plus large sur la manière d'évaluer en toute sécurité des agents d'IA de plus en plus capables", a réagi Anthropic dans une déclaration transmise à l'AFP.

"Les tests indépendants sont essentiels pour comprendre le comportement de modèles de plus en plus performants", a pour sa part estimé OpenAI, disant vouloir travailler avec les différents acteurs du secteur "pour mener des évaluations en toute sécurité".

P.Svatek--TPP