Dubai Telegraph - IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni

EUR -
AED 4.211461
AFN 73.958377
ALL 91.364823
AMD 416.583653
ANG 2.052866
AOA 1052.595761
ARS 1736.247183
AUD 1.609696
AWG 2.06678
AZN 1.951786
BAM 1.952902
BBD 2.308884
BDT 140.661274
BGN 1.930265
BHD 0.432287
BIF 3434.122543
BMD 1.146619
BND 1.462031
BOB 11.257344
BRL 5.857269
BSD 1.146404
BTN 109.778579
BWP 15.557982
BYN 3.456371
BYR 22473.723486
BZD 2.305589
CAD 1.608729
CDF 2648.688472
CHF 0.941672
CLF 0.027522
CLP 1086.810858
CNY 7.677063
CNH 7.674192
COP 3672.882923
CRC 512.841237
CUC 1.146619
CUP 30.385391
CVE 110.530642
CZK 24.320278
DJF 203.776578
DKK 7.475437
DOP 63.614575
DZD 153.448136
EGP 59.532204
ERN 17.199278
ETB 187.204825
FJD 2.565791
FKP 0.856136
GBP 0.857527
GEL 2.987221
GGP 0.856136
GHS 13.203321
GIP 0.856136
GMD 84.274016
GNF 10038.645391
GTQ 8.749017
GYD 239.795216
HKD 8.996048
HNL 30.773336
HRK 7.534082
HTG 149.827672
HUF 361.519083
IDR 20499.246351
ILS 3.455966
IMP 0.856136
INR 109.858497
IQD 1501.771538
IRR 1576428.506705
ISK 138.190106
JEP 0.856136
JMD 180.671903
JOD 0.812938
JPY 180.560888
KES 148.488653
KGS 100.27122
KHR 4645.127402
KMF 493.045652
KPW 1031.957055
KRW 1575.912761
KWD 0.353651
KYD 0.955287
KZT 514.339021
LAK 25680.0057
LBP 102656.017498
LKR 378.927713
LRD 198.316585
LSL 18.652921
LTL 3.385667
LVL 0.693578
LYD 7.302164
MAD 10.924689
MDL 20.135209
MGA 5003.597036
MKD 61.428846
MMK 2407.466318
MNT 4123.17963
MOP 9.263694
MRU 46.072633
MUR 54.647977
MVR 17.715436
MWK 1987.759054
MXN 19.74934
MYR 4.675931
MZN 73.280348
NAD 18.652921
NGN 1524.120027
NIO 42.187399
NOK 10.826883
NPR 175.646127
NZD 2.005333
OMR 0.440878
PAB 1.146304
PEN 3.869758
PGK 5.105424
PHP 71.950568
PKR 317.681995
PLN 4.345512
PYG 6822.875609
QAR 4.190082
RON 5.264079
RSD 117.291164
RUB 96.028103
RWF 1686.305064
SAR 4.305631
SBD 9.173535
SCR 15.91291
SDG 689.689981
SEK 11.280617
SGD 1.463475
SHP 0.857125
SLE 28.263822
SLL 24044.008274
SOS 655.130715
SRD 43.239563
STD 23732.688872
STN 24.463805
SVC 10.030116
SYP 14908.334616
SZL 18.650406
THB 38.122207
TJS 10.575154
TMT 4.024631
TND 3.375391
TOP 2.760782
TRY 55.957048
TTD 7.789475
TWD 36.386334
TZS 3027.076426
UAH 51.320646
UGX 4505.33423
USD 1.146619
UYU 46.06165
UZS 13560.877162
VES 971.742136
VND 29837.881092
VUV 135.207603
WST 3.15353
XAF 655.957
XAG 0.017385
XAU 0.000264
XCD 3.098794
XCG 2.066043
XDR 0.810719
XOF 655.957
XPF 119.331742
YER 271.232889
ZAR 18.633068
ZMK 10320.942332
ZMW 22.382884
ZWL 369.210704
SSP 6549.501148
MXV 2.2386
  • AEX

    7.2300

    1102.35

    +0.66%

  • BEL20

    50.2800

    5763.48

    +0.88%

  • PX1

    74.2000

    8138.94

    +0.92%

  • ISEQ

    120.7900

    14331.48

    +0.85%

  • OSEBX

    -9.9500

    2107.46

    -0.47%

  • PSI20

    75.3800

    9617.39

    +0.79%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    -20.9400

    4631.6

    -0.45%

  • N150

    25.0900

    4277.39

    +0.59%

IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni
IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni / Photo: Nicolas TUCAT - AFP/Archives

IA : Mythos 5 d'Anthropic crée de fausses identités lors d'un test au Royaume-Uni

L'institut britannique de sécurité de l'IA (AISI) a dit avoir rencontré un "incident sérieux" lors d'une évaluation de routine au cours de laquelle Mythos 5 d'Anthropic a créé de fausses identités en ligne pour écrire à des développeurs afin de les convaincre d'intégrer du code malveillant.

Taille du texte:

Cette information, qui provient d'un rapport publié mardi par cet organisme qui dépend du gouvernement britannique, intervient après une série d'incidents aux Etats-Unis qui ont vu les modèles les plus puissants d'OpenAI (GPT-5.6 Sol) et d'Anthropic (Mythos 5) s'introduire sans autorisation chez d'autres entreprises.

Lors de l'évaluation britannique, menée avec un accès à internet ouvert et certains filtres de sécurité désactivés, des agents d'IA ont mené "des actions dirigées contre des personnes et des organisations réelles", explique l'AISI dans un compte rendu publié sur son site internet.

Les tentatives des modèles d'IA "n'ont pas abouti et nos investigations n'ont mis en évidence aucun dommage dans le monde réel", précise l'organisme.

"Mais c'est la première fois que nous voyons des risques liés à l'autonomie et à un comportement de dissimulation se manifester aussi clairement, sans sollicitation spécifique, dans le monde réel."

La semaine dernière, Anthropic avait déjà indiqué que ses modèles avaient "obtenu un accès non autorisé" à trois organisations lors de tests pourtant censés les empêcher d'accéder à des systèmes "réels".

Cette annonce était intervenue quelques jours seulement après que son rival OpenAI a révélé que deux de ses modèles étaient sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face.

L'incident britannique, détecté et rapidement contenu le 28 juillet, a visé la plateforme destinée aux développeurs GitHub.

"Il a pour origine une seule évaluation, au cours de laquelle des agents se sont vu confier la tâche de résoudre un défi en cybersécurité", à plusieurs reprises, a précisé l'AISI.

Les incidents détectés l'ont été presque exclusivement avec Mythos 5 et, de façon plus marginale, avec GPT-5.6 Sol.

"Il ne s'agit pas d'un cas où un modèle se serait échappé de son environnement de test sécurisé" car "nous avions intentionnellement autorisé l’accès à internet" et désactivé des sécurités, "des conditions qui ne reflètent pas la manière dont les modèles de pointe sont mis à la disposition du public", insiste l'AISI.

Cet incident "met en évidence la nécessité d'un débat plus large sur la manière d'évaluer en toute sécurité des agents d'IA de plus en plus capables", a réagi Anthropic dans une déclaration transmise à l'AFP.

"Les tests indépendants sont essentiels pour comprendre le comportement de modèles de plus en plus performants", a pour sa part estimé OpenAI, disant vouloir travailler avec les différents acteurs du secteur "pour mener des évaluations en toute sécurité".

V.Munir--DT