Zürcher Nachrichten - Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes

EUR -
AED 4.215065
AFN 75.168785
ALL 93.601097
AMD 419.829186
AOA 1053.622486
ARS 1716.388248
AUD 1.643768
AWG 2.06736
AZN 1.959209
BAM 1.956843
BBD 2.311912
BDT 141.745527
BHD 0.432849
BIF 3408.616226
BMD 1.147737
BND 1.478788
BOB 13.516614
BRL 5.855412
BSD 1.147902
BTN 109.77336
BWP 15.685563
BYN 3.35899
BYR 22495.636433
BZD 2.308731
CAD 1.611864
CDF 2622.577591
CHF 0.932243
CLF 0.027198
CLP 1070.585832
CNY 7.765925
CNH 7.74876
COP 3680.561577
CRC 521.873525
CUC 1.147737
CUP 30.415019
CVE 110.323784
CZK 24.167372
DJF 204.414262
DKK 7.474743
DOP 66.805596
DZD 152.682514
EGP 58.64647
ERN 17.216048
ETB 185.280574
FJD 2.552279
FKP 0.86382
GBP 0.857193
GEL 3.007323
GGP 0.86382
GHS 13.413556
GIP 0.86382
GMD 84.932277
GNF 10076.369029
GTQ 8.758667
GYD 240.164245
HKD 9.002851
HNL 30.755388
HRK 7.538221
HTG 150.089973
HUF 361.812834
IDR 20747.920597
ILS 3.523091
IMP 0.86382
INR 109.704563
IQD 1503.701223
IRR 1578424.693651
ISK 142.617752
JEP 0.86382
JMD 181.546734
JOD 0.8138
JPY 186.962269
KES 148.470729
KGS 100.369516
KHR 4615.620218
KMF 493.527193
KRW 1645.498132
KWD 0.356119
KYD 0.956622
KZT 544.563885
LAK 26022.659305
LBP 102796.408145
LKR 385.575448
LRD 207.773424
LSL 19.034442
LTL 3.388967
LVL 0.694255
LYD 7.346915
MAD 10.770639
MDL 20.215035
MGA 4907.764684
MKD 61.552797
MMK 2410.06689
MNT 4127.517453
MOP 9.274863
MRU 45.892453
MUR 54.184419
MVR 17.744059
MWK 1990.512641
MXN 19.965999
MYR 4.685752
MZN 73.35168
NAD 19.034442
NGN 1564.743826
NIO 42.243797
NOK 10.97402
NPR 175.631052
NZD 1.964144
OMR 0.441307
PAB 1.147947
PEN 3.889773
PGK 5.064699
PHP 70.597712
PKR 318.796866
PLN 4.307702
PYG 6860.655588
QAR 4.18453
RON 5.243782
RSD 117.40889
RUB 91.821724
RWF 1689.722424
SAR 4.282969
SBD 9.264014
SCR 15.422918
SDG 689.219802
SEK 11.010082
SGD 1.477653
SLE 27.68907
SOS 656.043846
SRD 43.32361
STD 23755.82937
STN 24.512848
SVC 10.044352
SZL 19.039145
THB 38.499104
TJS 10.600656
TMT 4.028555
TND 3.394008
TRY 54.419699
TTD 7.791389
TWD 37.281464
TZS 3038.546481
UAH 51.212088
UGX 4299.290807
USD 1.147737
UYU 46.174603
UZS 13780.342631
VES 853.108105
VND 30164.23821
VUV 137.190419
WST 3.159172
XAF 656.329588
XAG 0.019715
XAU 0.000281
XCD 3.101816
XCG 2.068865
XDR 0.817186
XOF 656.306702
XPF 119.331742
YER 273.534377
ZAR 19.033258
ZMK 10330.996629
ZMW 21.437076
ZWL 369.570702
  • AEX

    13.9900

    1107.04

    +1.28%

  • BEL20

    -54.9900

    5673.1

    -0.96%

  • PX1

    86.6000

    8494.73

    +1.03%

  • ISEQ

    84.0700

    13644.36

    +0.62%

  • OSEBX

    7.2200

    2013.71

    +0.36%

  • PSI20

    115.8400

    9165.46

    +1.28%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    14.0700

    4410.44

    +0.32%

  • N150

    32.6700

    4275.93

    +0.77%

Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes
Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes / Photo: MARCO BERTORELLO - AFP/Archives

Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes

Les deux modèles d'intelligence artificielle (IA) d'OpenAI qui sont sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face, ont également fait intrusion sur d'autres plateformes, selon le créateur de ChatGPT.

Taille du texte:

L'une d'entre elle a servi de relais pour préparer l'attaque sur Hugging Face, une bibliothèque IA que les deux modèles ont fouillée pour trouver les réponses aux tests soumis par les développeurs d'OpenAI.

Au total, quatre comptes associés à d'autres plateformes ont été piratés. OpenAI n'a pas révélé les noms des entités visées. Ces manoeuvres ont été effectuées avec le même objectif que celui poursuivi lors de l'offensive contre Hugging Face.

Selon une actualisation du compte rendu de l'incident, publiée dans la nuit de mardi à mercredi, les deux IA ont également utilisé plusieurs sites en accès libre pour copier du code de programmation ou le tester, mais sans aller plus loin qu'un utilisateur ordinaire.

Pour Hugging Face, qui a mis en ligne, de son côté, un long récit des événements, l'effraction dont elle a été victime relevait d'une "tentative (des deux modèles) de tricher à l'évaluation" d'OpenAI.

Les IA ont voulu "dérober les solutions aux tests plutôt que d'essayer d'y répondre par elles-mêmes".

Pour les besoins du test, les informaticiens d'OpenAI avaient réduit les garde-fous pour juger du potentiel des modèles en matière de cybersécurité.

L'entreprise a révélé qu'outre son modèle le plus avancé, GPT-5.6 Sol, l'autre IA mêlée à l'incident n'avait pas vocation à être commercialisée et était uniquement destinée à un usage interne.

Le rapport d'Hugging Face indique que l'attaque a duré pas moins de cinq jours avant que le site ne parvienne à la contenir.

Aucun des deux documents ne le mentionne clairement et la société n'a pas répondu à une question de l'AFP sur ce point, mais il semble qu'OpenAI n'ait pris conscience de l'évasion que plusieurs jours après les faits.

- Une IA auto-programmée -

"Un pirate (informatique) humain aurait pu trouver et exploiter les mêmes vulnérabilités", explique l'entreprise.

Ce qui a fait la différence, c'est le volume des tentatives, avec pas moins de 17.600 actions contre Hugging Face, marquées par beaucoup d'échecs, mais suffisamment de réussites pour que les modèles parviennent à leurs fins.

"L'échelle et la vitesse de ces actions dépassent de loin les capacités d'un humain qui opérerait manuellement", a fait valoir Hugging Face.

Le chercheur en IA Daniel Kokotajlo a plaidé pour une analyse de l'incident menée par un laboratoire indépendant, une démarche "qui devrait devenir systématique" pour des cas similaires, selon lui.

Cette évasion de modèles n'est pas la première à être documentée, mais elle est considérée comme, de loin, la plus sérieuse à ce jour.

Elle a donné un écho supplémentaire au débat, déjà nourri, sur l'accélération de l'IA, aux capacités de plus en plus étendues, et sur la difficulté de la contrôler.

Lors de l'épisode OpenAI, les modèles ont utilisé des méthodes dont ils savaient qu'elles étaient en contradiction avec le scénario du test, sans en informer les développeurs.

Mardi, plus d'un millier d'employés de géants de l'IA, dont plusieurs dirigeants de premier plan, ont demandé au gouvernement américain d'aider à "temporiser" la sortie des nouveaux modèles, pour laisser le temps à l'écosystème informatique de s'y préparer.

Ils plaident, dans une pétition, pour que les États-Unis soient moteur dans la création d'une instance internationale de référence en matière d'évaluation et de supervision de l'IA.

Interrogé sur la question, le président américain Donald Trump a estimé qu'il "fallait être prudent", et trouver un équilibre entre le contrôle des agents et le fait de ne pas être devancé par la Chine dans le développement de l'IA.

"Nous ne voulons pas les limiter, et que l'on se retrouve d'un seul coup derrière la Chine", a-t-il déclaré, "celui qui l'emportera" dans cette course à l'IA "pourrait très bien ramasser toute la mise".

Le milieu s'inquiète d'autant plus qu'il voit approcher le stade dit de "l'auto-amélioration récursive" (recursive self-improvement), au-delà duquel l'intelligence artificielle serait en mesure de concevoir seule son successeur, une séquence qui pourrait se répéter à l'infini.

Les derniers modèles d'OpenAI et Anthropic ont été en partie programmés par l'IA elle-même.

Le "RSI", son abréviation, rendrait plus difficile les vérifications et l'évaluation de nouveaux modèles par des informaticiens humains, car ils n'auraient pas participé directement à leur élaboration.

E.Leuenberger--NZN