Dubai Telegraph - Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes

EUR -
AED 4.230163
AFN 74.869924
ALL 94.163774
AMD 419.604558
AOA 1057.396177
ARS 1715.05003
AUD 1.636147
AWG 2.074765
AZN 1.959774
BAM 1.95577
BBD 2.310565
BDT 141.667849
BHD 0.432575
BIF 3406.496896
BMD 1.151848
BND 1.477869
BOB 13.50856
BRL 5.836758
BSD 1.147233
BTN 109.713192
BWP 15.676082
BYN 3.357003
BYR 22576.211211
BZD 2.307265
CAD 1.613456
CDF 2620.453223
CHF 0.928907
CLF 0.027087
CLP 1066.081169
CNY 7.781018
CNH 7.77
COP 3598.003032
CRC 521.56944
CUC 1.151848
CUP 30.523959
CVE 110.266198
CZK 24.205845
DJF 204.28803
DKK 7.475041
DOP 66.766088
DZD 153.020642
EGP 58.915387
ERN 17.277713
ETB 185.165351
FJD 2.550708
FKP 0.866914
GBP 0.855621
GEL 3.012129
GGP 0.866914
GHS 13.405564
GIP 0.866914
GMD 85.237231
GNF 10070.103981
GTQ 8.754095
GYD 240.022188
HKD 9.033232
HNL 30.927264
HRK 7.538958
HTG 149.996003
HUF 363.346866
IDR 20763.088044
ILS 3.512617
IMP 0.866914
INR 109.841964
IQD 1508.920239
IRR 1583790.327513
ISK 142.58771
JEP 0.866914
JMD 181.439369
JOD 0.816676
JPY 183.258362
KES 148.991386
KGS 100.729338
KHR 4653.464038
KMF 495.867821
KRW 1647.567861
KWD 0.356428
KYD 0.956027
KZT 544.199216
LAK 26123.901678
LBP 102730.69703
LKR 385.335714
LRD 207.662256
LSL 19.132798
LTL 3.401107
LVL 0.696741
LYD 7.34257
MAD 10.809515
MDL 20.20229
MGA 4955.805601
MKD 61.524066
MMK 2418.699258
MNT 4142.301378
MOP 9.269257
MRU 46.20079
MUR 54.136978
MVR 17.807972
MWK 1999.607005
MXN 19.950692
MYR 4.702423
MZN 73.614423
NAD 19.132317
NGN 1566.444055
NIO 42.216244
NOK 10.97038
NPR 175.528715
NZD 1.957605
OMR 0.442933
PAB 1.147283
PEN 3.903705
PGK 5.06155
PHP 70.535634
PKR 318.608332
PLN 4.313427
PYG 6856.598257
QAR 4.197561
RON 5.246206
RSD 117.385954
RUB 91.487908
RWF 1688.701055
SAR 4.29831
SBD 9.308201
SCR 16.082665
SDG 691.108683
SEK 10.964021
SGD 1.476478
SLE 28.44258
SOS 655.661583
SRD 43.476446
STD 23840.917902
STN 24.49782
SVC 10.038238
SZL 19.027885
THB 38.418147
TJS 10.595215
TMT 4.042985
TND 3.397378
TRY 54.741785
TTD 7.786273
TWD 37.154684
TZS 3051.834967
UAH 51.181801
UGX 4296.86015
USD 1.151848
UYU 46.150501
UZS 13772.67131
VES 858.928544
VND 30286.678448
VUV 137.681807
WST 3.170487
XAF 655.918568
XAG 0.019831
XAU 0.000284
XCD 3.112925
XCG 2.067543
XDR 0.815752
XOF 660.008488
XPF 119.331742
YER 274.474351
ZAR 19.006755
ZMK 10368.006288
ZMW 21.423745
ZWL 370.894429
  • AEX

    -0.6600

    1104

    -0.06%

  • BEL20

    65.6000

    5720.82

    +1.16%

  • PX1

    58.5500

    8544.31

    +0.69%

  • ISEQ

    31.4100

    13685.95

    +0.23%

  • OSEBX

    9.8700

    2024.33

    +0.49%

  • PSI20

    -3.6600

    9142.52

    -0.04%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    -113.3500

    4297.09

    -2.57%

  • N150

    21.7500

    4285.93

    +0.51%

Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes
Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes / Photo: MARCO BERTORELLO - AFP/Archives

Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes

Les deux modèles d'intelligence artificielle (IA) d'OpenAI qui sont sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face, ont également fait intrusion sur d'autres plateformes, selon le créateur de ChatGPT.

Taille du texte:

L'une d'entre elle a servi de relais pour préparer l'attaque sur Hugging Face, une bibliothèque IA que les deux modèles ont fouillée pour trouver les réponses aux tests soumis par les développeurs d'OpenAI.

Au total, quatre comptes associés à d'autres plateformes ont été piratés. OpenAI n'a pas révélé les noms des entités visées. Ces manoeuvres ont été effectuées avec le même objectif que celui poursuivi lors de l'offensive contre Hugging Face.

Selon une actualisation du compte rendu de l'incident, publiée dans la nuit de mardi à mercredi, les deux IA ont également utilisé plusieurs sites en accès libre pour copier du code de programmation ou le tester, mais sans aller plus loin qu'un utilisateur ordinaire.

Pour Hugging Face, qui a mis en ligne, de son côté, un long récit des événements, l'effraction dont elle a été victime relevait d'une "tentative (des deux modèles) de tricher à l'évaluation" d'OpenAI.

Les IA ont voulu "dérober les solutions aux tests plutôt que d'essayer d'y répondre par elles-mêmes".

Pour les besoins du test, les informaticiens d'OpenAI avaient réduit les garde-fous pour juger du potentiel des modèles en matière de cybersécurité.

L'entreprise a révélé qu'outre son modèle le plus avancé, GPT-5.6 Sol, l'autre IA mêlée à l'incident n'avait pas vocation à être commercialisée et était uniquement destinée à un usage interne.

Le rapport d'Hugging Face indique que l'attaque a duré pas moins de cinq jours avant que le site ne parvienne à la contenir.

Aucun des deux documents ne le mentionne clairement et la société n'a pas répondu à une question de l'AFP sur ce point, mais il semble qu'OpenAI n'ait pris conscience de l'évasion que plusieurs jours après les faits.

- Une IA auto-programmée -

"Un pirate (informatique) humain aurait pu trouver et exploiter les mêmes vulnérabilités", explique l'entreprise.

Ce qui a fait la différence, c'est le volume des tentatives, avec pas moins de 17.600 actions contre Hugging Face, marquées par beaucoup d'échecs, mais suffisamment de réussites pour que les modèles parviennent à leurs fins.

"L'échelle et la vitesse de ces actions dépassent de loin les capacités d'un humain qui opérerait manuellement", a fait valoir Hugging Face.

Le chercheur en IA Daniel Kokotajlo a plaidé pour une analyse de l'incident menée par un laboratoire indépendant, une démarche "qui devrait devenir systématique" pour des cas similaires, selon lui.

Cette évasion de modèles n'est pas la première à être documentée, mais elle est considérée comme, de loin, la plus sérieuse à ce jour.

Elle a donné un écho supplémentaire au débat, déjà nourri, sur l'accélération de l'IA, aux capacités de plus en plus étendues, et sur la difficulté de la contrôler.

Lors de l'épisode OpenAI, les modèles ont utilisé des méthodes dont ils savaient qu'elles étaient en contradiction avec le scénario du test, sans en informer les développeurs.

Mardi, plus d'un millier d'employés de géants de l'IA, dont plusieurs dirigeants de premier plan, ont demandé au gouvernement américain d'aider à "temporiser" la sortie des nouveaux modèles, pour laisser le temps à l'écosystème informatique de s'y préparer.

Ils plaident, dans une pétition, pour que les États-Unis soient moteur dans la création d'une instance internationale de référence en matière d'évaluation et de supervision de l'IA.

Interrogé sur la question, le président américain Donald Trump a estimé qu'il "fallait être prudent", et trouver un équilibre entre le contrôle des agents et le fait de ne pas être devancé par la Chine dans le développement de l'IA.

"Nous ne voulons pas les limiter, et que l'on se retrouve d'un seul coup derrière la Chine", a-t-il déclaré, "celui qui l'emportera" dans cette course à l'IA "pourrait très bien ramasser toute la mise".

Le milieu s'inquiète d'autant plus qu'il voit approcher le stade dit de "l'auto-amélioration récursive" (recursive self-improvement), au-delà duquel l'intelligence artificielle serait en mesure de concevoir seule son successeur, une séquence qui pourrait se répéter à l'infini.

Les derniers modèles d'OpenAI et Anthropic ont été en partie programmés par l'IA elle-même.

Le "RSI", son abréviation, rendrait plus difficile les vérifications et l'évaluation de nouveaux modèles par des informaticiens humains, car ils n'auraient pas participé directement à leur élaboration.

H.Nadeem--DT