Dubai Telegraph - Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes

EUR -
AED 4.238811
AFN 75.022966
ALL 91.672628
AMD 419.537692
ANG 2.066447
AOA 1059.55903
ARS 1739.351817
AUD 1.619413
AWG 2.07901
AZN 1.957383
BAM 1.956934
BBD 2.324627
BDT 142.102356
BGN 1.943034
BHD 0.435048
BIF 3450.970122
BMD 1.154204
BND 1.468738
BOB 13.33061
BRL 5.938261
BSD 1.154159
BTN 110.753228
BWP 15.620918
BYN 3.504601
BYR 22622.396885
BZD 2.321225
CAD 1.607968
CDF 2669.093803
CHF 0.945126
CLF 0.027889
CLP 1101.203245
CNY 7.746382
CNH 7.746544
COP 3605.53684
CRC 516.494861
CUC 1.154204
CUP 30.586404
CVE 110.327507
CZK 24.306268
DJF 205.527333
DKK 7.475508
DOP 67.868746
DZD 154.356205
EGP 59.774608
ERN 17.313059
ETB 185.827115
FJD 2.567526
FKP 0.855416
GBP 0.856252
GEL 2.989216
GGP 0.855416
GHS 13.25551
GIP 0.855416
GMD 84.83445
GNF 10148.793838
GTQ 8.81103
GYD 241.467851
HKD 9.05417
HNL 31.071061
HRK 7.534598
HTG 150.846116
HUF 365.292269
IDR 20419.021596
ILS 3.512185
IMP 0.855416
INR 110.699119
IQD 1512.584241
IRR 1586568.712443
ISK 139.820478
JEP 0.855416
JMD 181.782203
JOD 0.818363
JPY 179.229979
KES 149.422829
KGS 100.934904
KHR 4675.66929
KMF 492.845335
KPW 1038.783897
KRW 1577.940296
KWD 0.356256
KYD 0.961849
KZT 516.204696
LAK 25829.745926
LBP 103354.904211
LKR 380.75737
LRD 201.515043
LSL 18.778905
LTL 3.408064
LVL 0.698166
LYD 7.317715
MAD 10.91233
MDL 20.065455
MGA 5049.641947
MKD 61.561745
MMK 2423.199621
MNT 4154.59545
MOP 9.325424
MRU 46.225673
MUR 54.039998
MVR 17.77448
MWK 2004.271858
MXN 19.783361
MYR 4.668291
MZN 73.765567
NAD 18.769115
NGN 1529.554162
NIO 42.25512
NOK 10.78124
NPR 177.205165
NZD 2.008309
OMR 0.443795
PAB 1.154159
PEN 3.872336
PGK 5.127547
PHP 72.433244
PKR 319.961663
PLN 4.342075
PYG 6869.921965
QAR 4.203553
RON 5.260055
RSD 117.373314
RUB 97.18192
RWF 1695.453227
SAR 4.331814
SBD 9.256137
SCR 16.02754
SDG 694.306762
SEK 11.28161
SGD 1.469515
SHP 0.856679
SLE 28.439506
SLL 24203.069786
SOS 659.570827
SRD 43.570862
STD 23889.690871
STN 24.873095
SVC 10.098765
SYP 15006.959696
SZL 18.744258
THB 38.370374
TJS 10.647078
TMT 4.051256
TND 3.363062
TOP 2.779046
TRY 56.159985
TTD 7.832471
TWD 36.768321
TZS 3053.59421
UAH 51.524515
UGX 4535.56966
USD 1.154204
UYU 46.416499
UZS 13578.869679
VES 970.897898
VND 29987.372116
VUV 136.297398
WST 3.152705
XAF 655.957
XAG 0.017855
XAU 0.000267
XCD 3.119294
XCG 2.080124
XDR 0.816082
XOF 655.957
XPF 119.331742
YER 273.035606
ZAR 18.741265
ZMK 10389.219903
ZMW 22.534865
ZWL 371.653192
SSP 6516.900596
MXV 2.243306
  • AEX

    -2.5300

    1095.87

    -0.23%

  • BEL20

    -5.1600

    5724.35

    -0.09%

  • PX1

    -27.6000

    8090.28

    -0.34%

  • ISEQ

    -102.4500

    14126.68

    -0.72%

  • OSEBX

    3.1600

    2113.06

    +0.15%

  • PSI20

    66.6000

    9446.63

    +0.71%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    -81.6800

    4612.85

    -1.74%

  • N150

    0.8500

    4250.27

    +0.02%

Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes
Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes / Photo: MARCO BERTORELLO - AFP/Archives

Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes

Les deux modèles d'intelligence artificielle (IA) d'OpenAI qui sont sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face, ont également fait intrusion sur d'autres plateformes, selon le créateur de ChatGPT.

Taille du texte:

L'une d'entre elle a servi de relais pour préparer l'attaque sur Hugging Face, une bibliothèque IA que les deux modèles ont fouillée pour trouver les réponses aux tests soumis par les développeurs d'OpenAI.

Au total, quatre comptes associés à d'autres plateformes ont été piratés. OpenAI n'a pas révélé les noms des entités visées. Ces manoeuvres ont été effectuées avec le même objectif que celui poursuivi lors de l'offensive contre Hugging Face.

Selon une actualisation du compte rendu de l'incident, publiée dans la nuit de mardi à mercredi, les deux IA ont également utilisé plusieurs sites en accès libre pour copier du code de programmation ou le tester, mais sans aller plus loin qu'un utilisateur ordinaire.

Pour Hugging Face, qui a mis en ligne, de son côté, un long récit des événements, l'effraction dont elle a été victime relevait d'une "tentative (des deux modèles) de tricher à l'évaluation" d'OpenAI.

Les IA ont voulu "dérober les solutions aux tests plutôt que d'essayer d'y répondre par elles-mêmes".

Pour les besoins du test, les informaticiens d'OpenAI avaient réduit les garde-fous pour juger du potentiel des modèles en matière de cybersécurité.

L'entreprise a révélé qu'outre son modèle le plus avancé, GPT-5.6 Sol, l'autre IA mêlée à l'incident n'avait pas vocation à être commercialisée et était uniquement destinée à un usage interne.

Le rapport d'Hugging Face indique que l'attaque a duré pas moins de cinq jours avant que le site ne parvienne à la contenir.

Aucun des deux documents ne le mentionne clairement et la société n'a pas répondu à une question de l'AFP sur ce point, mais il semble qu'OpenAI n'ait pris conscience de l'évasion que plusieurs jours après les faits.

- Une IA auto-programmée -

"Un pirate (informatique) humain aurait pu trouver et exploiter les mêmes vulnérabilités", explique l'entreprise.

Ce qui a fait la différence, c'est le volume des tentatives, avec pas moins de 17.600 actions contre Hugging Face, marquées par beaucoup d'échecs, mais suffisamment de réussites pour que les modèles parviennent à leurs fins.

"L'échelle et la vitesse de ces actions dépassent de loin les capacités d'un humain qui opérerait manuellement", a fait valoir Hugging Face.

Le chercheur en IA Daniel Kokotajlo a plaidé pour une analyse de l'incident menée par un laboratoire indépendant, une démarche "qui devrait devenir systématique" pour des cas similaires, selon lui.

Cette évasion de modèles n'est pas la première à être documentée, mais elle est considérée comme, de loin, la plus sérieuse à ce jour.

Elle a donné un écho supplémentaire au débat, déjà nourri, sur l'accélération de l'IA, aux capacités de plus en plus étendues, et sur la difficulté de la contrôler.

Lors de l'épisode OpenAI, les modèles ont utilisé des méthodes dont ils savaient qu'elles étaient en contradiction avec le scénario du test, sans en informer les développeurs.

Mardi, plus d'un millier d'employés de géants de l'IA, dont plusieurs dirigeants de premier plan, ont demandé au gouvernement américain d'aider à "temporiser" la sortie des nouveaux modèles, pour laisser le temps à l'écosystème informatique de s'y préparer.

Ils plaident, dans une pétition, pour que les États-Unis soient moteur dans la création d'une instance internationale de référence en matière d'évaluation et de supervision de l'IA.

Interrogé sur la question, le président américain Donald Trump a estimé qu'il "fallait être prudent", et trouver un équilibre entre le contrôle des agents et le fait de ne pas être devancé par la Chine dans le développement de l'IA.

"Nous ne voulons pas les limiter, et que l'on se retrouve d'un seul coup derrière la Chine", a-t-il déclaré, "celui qui l'emportera" dans cette course à l'IA "pourrait très bien ramasser toute la mise".

Le milieu s'inquiète d'autant plus qu'il voit approcher le stade dit de "l'auto-amélioration récursive" (recursive self-improvement), au-delà duquel l'intelligence artificielle serait en mesure de concevoir seule son successeur, une séquence qui pourrait se répéter à l'infini.

Les derniers modèles d'OpenAI et Anthropic ont été en partie programmés par l'IA elle-même.

Le "RSI", son abréviation, rendrait plus difficile les vérifications et l'évaluation de nouveaux modèles par des informaticiens humains, car ils n'auraient pas participé directement à leur élaboration.

H.Nadeem--DT