Zürcher Nachrichten - Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes

EUR -
AED 4.213321
AFN 74.571701
ALL 90.861804
AMD 416.926657
ANG 2.054019
AOA 1052.03923
ARS 1735.478891
AUD 1.617686
AWG 2.065073
AZN 1.952068
BAM 1.945309
BBD 2.311345
BDT 141.297347
BGN 1.931349
BHD 0.43256
BIF 3436.051628
BMD 1.147263
BND 1.461313
BOB 12.618004
BRL 5.912074
BSD 1.147616
BTN 110.118754
BWP 15.564988
BYN 3.48499
BYR 22486.347882
BZD 2.308002
CAD 1.604625
CDF 2650.176934
CHF 0.946543
CLF 0.027736
CLP 1095.154294
CNY 7.693999
CNH 7.696876
COP 3595.245793
CRC 513.329304
CUC 1.147263
CUP 30.40246
CVE 110.137329
CZK 24.322484
DJF 203.891119
DKK 7.475299
DOP 67.51585
DZD 153.596535
EGP 59.880911
ERN 17.20894
ETB 184.651776
FJD 2.570728
FKP 0.851196
GBP 0.856948
GEL 2.988584
GGP 0.851196
GHS 13.199235
GIP 0.851196
GMD 84.897261
GNF 10070.098771
GTQ 8.76079
GYD 240.096173
HKD 8.999467
HNL 30.861969
HRK 7.536385
HTG 149.991727
HUF 365.266055
IDR 20338.672206
ILS 3.473339
IMP 0.851196
INR 110.289398
IQD 1503.487699
IRR 1576998.553227
ISK 139.793961
JEP 0.851196
JMD 181.103284
JOD 0.81341
JPY 178.880624
KES 148.639
KGS 100.328007
KHR 4649.855724
KMF 491.028502
KPW 1032.536747
KRW 1577.842381
KWD 0.354401
KYD 0.956338
KZT 510.27246
LAK 25681.473913
LBP 102737.369786
LKR 380.368617
LRD 200.36991
LSL 18.698163
LTL 3.387568
LVL 0.693967
LYD 7.279404
MAD 10.861149
MDL 20.008007
MGA 5025.010377
MKD 61.574251
MMK 2408.820842
MNT 4124.495422
MOP 9.272689
MRU 45.959716
MUR 54.254157
MVR 17.679448
MWK 1992.223355
MXN 19.774609
MYR 4.700564
MZN 73.314223
NAD 18.69523
NGN 1526.58248
NIO 42.081311
NOK 10.810428
NPR 176.196515
NZD 2.004954
OMR 0.441118
PAB 1.147586
PEN 3.852534
PGK 5.101017
PHP 72.07149
PKR 318.121805
PLN 4.36456
PYG 6790.378509
QAR 4.180626
RON 5.263756
RSD 117.360382
RUB 96.654381
RWF 1686.476091
SAR 4.294407
SBD 9.178689
SCR 15.884606
SDG 690.075525
SEK 11.303635
SGD 1.465479
SHP 0.856966
SLE 28.268254
SLL 24057.514762
SOS 655.859994
SRD 43.312039
STD 23746.020479
STN 24.838236
SVC 10.041799
SYP 14916.709228
SZL 18.803998
THB 38.29498
TJS 10.58467
TMT 4.015419
TND 3.355683
TOP 2.762333
TRY 55.843358
TTD 7.7808
TWD 36.570107
TZS 3034.513178
UAH 51.178686
UGX 4492.769844
USD 1.147263
UYU 46.170993
UZS 13531.962978
VES 969.958883
VND 29828.828822
VUV 135.557126
WST 3.139753
XAF 655.957
XAG 0.018147
XAU 0.000269
XCD 3.100535
XCG 2.068237
XDR 0.811174
XOF 655.957
XPF 119.331742
YER 271.499231
ZAR 18.786271
ZMK 10326.735622
ZMW 22.52144
ZWL 369.418104
SSP 6488.095514
MXV 2.242171
  • AEX

    0.2200

    1096.14

    +0.02%

  • BEL20

    9.1600

    5733.49

    +0.16%

  • PX1

    50.1600

    8140.59

    +0.62%

  • ISEQ

    213.3200

    14340.23

    +1.51%

  • OSEBX

    10.3500

    2123.43

    +0.49%

  • PSI20

    94.4600

    9540.66

    +1%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    -60.8900

    4552.19

    -1.32%

  • N150

    24.2300

    4274.61

    +0.57%

Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes
Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes / Photo: MARCO BERTORELLO - AFP/Archives

Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes

Les deux modèles d'intelligence artificielle (IA) d'OpenAI qui sont sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face, ont également fait intrusion sur d'autres plateformes, selon le créateur de ChatGPT.

Taille du texte:

L'une d'entre elle a servi de relais pour préparer l'attaque sur Hugging Face, une bibliothèque IA que les deux modèles ont fouillée pour trouver les réponses aux tests soumis par les développeurs d'OpenAI.

Au total, quatre comptes associés à d'autres plateformes ont été piratés. OpenAI n'a pas révélé les noms des entités visées. Ces manoeuvres ont été effectuées avec le même objectif que celui poursuivi lors de l'offensive contre Hugging Face.

Selon une actualisation du compte rendu de l'incident, publiée dans la nuit de mardi à mercredi, les deux IA ont également utilisé plusieurs sites en accès libre pour copier du code de programmation ou le tester, mais sans aller plus loin qu'un utilisateur ordinaire.

Pour Hugging Face, qui a mis en ligne, de son côté, un long récit des événements, l'effraction dont elle a été victime relevait d'une "tentative (des deux modèles) de tricher à l'évaluation" d'OpenAI.

Les IA ont voulu "dérober les solutions aux tests plutôt que d'essayer d'y répondre par elles-mêmes".

Pour les besoins du test, les informaticiens d'OpenAI avaient réduit les garde-fous pour juger du potentiel des modèles en matière de cybersécurité.

L'entreprise a révélé qu'outre son modèle le plus avancé, GPT-5.6 Sol, l'autre IA mêlée à l'incident n'avait pas vocation à être commercialisée et était uniquement destinée à un usage interne.

Le rapport d'Hugging Face indique que l'attaque a duré pas moins de cinq jours avant que le site ne parvienne à la contenir.

Aucun des deux documents ne le mentionne clairement et la société n'a pas répondu à une question de l'AFP sur ce point, mais il semble qu'OpenAI n'ait pris conscience de l'évasion que plusieurs jours après les faits.

- Une IA auto-programmée -

"Un pirate (informatique) humain aurait pu trouver et exploiter les mêmes vulnérabilités", explique l'entreprise.

Ce qui a fait la différence, c'est le volume des tentatives, avec pas moins de 17.600 actions contre Hugging Face, marquées par beaucoup d'échecs, mais suffisamment de réussites pour que les modèles parviennent à leurs fins.

"L'échelle et la vitesse de ces actions dépassent de loin les capacités d'un humain qui opérerait manuellement", a fait valoir Hugging Face.

Le chercheur en IA Daniel Kokotajlo a plaidé pour une analyse de l'incident menée par un laboratoire indépendant, une démarche "qui devrait devenir systématique" pour des cas similaires, selon lui.

Cette évasion de modèles n'est pas la première à être documentée, mais elle est considérée comme, de loin, la plus sérieuse à ce jour.

Elle a donné un écho supplémentaire au débat, déjà nourri, sur l'accélération de l'IA, aux capacités de plus en plus étendues, et sur la difficulté de la contrôler.

Lors de l'épisode OpenAI, les modèles ont utilisé des méthodes dont ils savaient qu'elles étaient en contradiction avec le scénario du test, sans en informer les développeurs.

Mardi, plus d'un millier d'employés de géants de l'IA, dont plusieurs dirigeants de premier plan, ont demandé au gouvernement américain d'aider à "temporiser" la sortie des nouveaux modèles, pour laisser le temps à l'écosystème informatique de s'y préparer.

Ils plaident, dans une pétition, pour que les États-Unis soient moteur dans la création d'une instance internationale de référence en matière d'évaluation et de supervision de l'IA.

Interrogé sur la question, le président américain Donald Trump a estimé qu'il "fallait être prudent", et trouver un équilibre entre le contrôle des agents et le fait de ne pas être devancé par la Chine dans le développement de l'IA.

"Nous ne voulons pas les limiter, et que l'on se retrouve d'un seul coup derrière la Chine", a-t-il déclaré, "celui qui l'emportera" dans cette course à l'IA "pourrait très bien ramasser toute la mise".

Le milieu s'inquiète d'autant plus qu'il voit approcher le stade dit de "l'auto-amélioration récursive" (recursive self-improvement), au-delà duquel l'intelligence artificielle serait en mesure de concevoir seule son successeur, une séquence qui pourrait se répéter à l'infini.

Les derniers modèles d'OpenAI et Anthropic ont été en partie programmés par l'IA elle-même.

Le "RSI", son abréviation, rendrait plus difficile les vérifications et l'évaluation de nouveaux modèles par des informaticiens humains, car ils n'auraient pas participé directement à leur élaboration.

E.Leuenberger--NZN