Berliner Boersenzeitung - Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes

EUR -
AED 4.238267
AFN 75.0137
ALL 91.850368
AMD 420.283899
ANG 2.066179
AOA 1058.267988
ARS 1740.213385
AUD 1.619521
AWG 2.077298
AZN 1.964098
BAM 1.955732
BBD 2.323239
BDT 142.016261
BGN 1.942783
BHD 0.434792
BIF 3448.939091
BMD 1.154055
BND 1.467861
BOB 13.322592
BRL 5.938533
BSD 1.15347
BTN 110.686607
BWP 15.611724
BYN 3.502508
BYR 22619.470537
BZD 2.319839
CAD 1.606455
CDF 2665.865954
CHF 0.944288
CLF 0.027935
CLP 1102.895467
CNY 7.744287
CNH 7.746972
COP 3594.095382
CRC 516.186411
CUC 1.154055
CUP 30.582447
CVE 110.260664
CZK 24.291292
DJF 205.403703
DKK 7.475331
DOP 67.828802
DZD 154.339792
EGP 59.92221
ERN 17.310819
ETB 188.41074
FJD 2.551574
FKP 0.855305
GBP 0.855899
GEL 3.016939
GGP 0.855305
GHS 13.247594
GIP 0.855305
GMD 85.399668
GNF 10142.73299
GTQ 8.805844
GYD 241.322602
HKD 9.053143
HNL 30.958453
HRK 7.536091
HTG 150.757338
HUF 365.739538
IDR 20400.223504
ILS 3.509884
IMP 0.855305
INR 110.634081
IQD 1511.073314
IRR 1586334.628035
ISK 139.964061
JEP 0.855305
JMD 181.673643
JOD 0.818249
JPY 178.869811
KES 149.530655
KGS 100.921847
KHR 4672.876985
KMF 491.627179
KPW 1038.649524
KRW 1568.533162
KWD 0.356118
KYD 0.961283
KZT 515.900889
LAK 25814.320432
LBP 103292.733273
LKR 380.529982
LRD 201.396443
LSL 18.758069
LTL 3.407623
LVL 0.698076
LYD 7.328744
MAD 10.905813
MDL 20.053646
MGA 4978.86893
MKD 61.527581
MMK 2422.886165
MNT 4154.058028
MOP 9.319935
MRU 46.185184
MUR 54.344388
MVR 17.784687
MWK 2000.13868
MXN 19.797143
MYR 4.667691
MZN 73.743622
NAD 18.758069
NGN 1529.987744
NIO 42.448883
NOK 10.787814
NPR 177.104709
NZD 2.004033
OMR 0.443733
PAB 1.15347
PEN 3.870798
PGK 5.214863
PHP 72.443504
PKR 319.770582
PLN 4.33973
PYG 6865.73002
QAR 4.204535
RON 5.259253
RSD 117.354648
RUB 97.352542
RWF 1694.470075
SAR 4.331254
SBD 9.25494
SCR 15.853377
SDG 694.173223
SEK 11.27419
SGD 1.468333
SHP 0.854824
SLE 28.447624
SLL 24199.938968
SOS 659.202639
SRD 43.585175
STD 23886.600591
STN 24.499355
SVC 10.092603
SYP 15005.018453
SZL 18.763669
THB 38.421931
TJS 10.640674
TMT 4.039191
TND 3.378996
TOP 2.778686
TRY 56.132985
TTD 7.82776
TWD 36.785468
TZS 3053.199161
UAH 51.493075
UGX 4532.821756
USD 1.154055
UYU 46.388377
UZS 13570.760339
VES 970.77227
VND 29963.874134
VUV 136.279767
WST 3.152298
XAF 655.957
XAG 0.018244
XAU 0.00027
XCD 3.11889
XCG 2.078845
XDR 0.815976
XOF 655.957
XPF 119.331742
YER 272.962742
ZAR 18.774749
ZMK 10387.873873
ZMW 22.521407
ZWL 371.605117
SSP 6516.057594
MXV 2.244869
  • AEX

    -5.1600

    1093.23

    -0.47%

  • BEL20

    -20.0500

    5709.41

    -0.35%

  • PX1

    -25.1700

    8092.71

    -0.31%

  • ISEQ

    -27.0400

    14202

    -0.19%

  • OSEBX

    1.6900

    2111.7

    +0.08%

  • PSI20

    37.5200

    9418.07

    +0.4%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    39.5700

    4694.75

    +0.85%

  • N150

    -2.1200

    4247.32

    -0.05%

Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes
Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes / Photo: MARCO BERTORELLO - AFP/Archives

Incident OpenAI: les modèles IA ont fait intrusion sur d'autres plateformes

Les deux modèles d'intelligence artificielle (IA) d'OpenAI qui sont sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face, ont également fait intrusion sur d'autres plateformes, selon le créateur de ChatGPT.

Taille du texte:

L'une d'entre elle a servi de relais pour préparer l'attaque sur Hugging Face, une bibliothèque IA que les deux modèles ont fouillée pour trouver les réponses aux tests soumis par les développeurs d'OpenAI.

Au total, quatre comptes associés à d'autres plateformes ont été piratés. OpenAI n'a pas révélé les noms des entités visées. Ces manoeuvres ont été effectuées avec le même objectif que celui poursuivi lors de l'offensive contre Hugging Face.

Selon une actualisation du compte rendu de l'incident, publiée dans la nuit de mardi à mercredi, les deux IA ont également utilisé plusieurs sites en accès libre pour copier du code de programmation ou le tester, mais sans aller plus loin qu'un utilisateur ordinaire.

Pour Hugging Face, qui a mis en ligne, de son côté, un long récit des événements, l'effraction dont elle a été victime relevait d'une "tentative (des deux modèles) de tricher à l'évaluation" d'OpenAI.

Les IA ont voulu "dérober les solutions aux tests plutôt que d'essayer d'y répondre par elles-mêmes".

Pour les besoins du test, les informaticiens d'OpenAI avaient réduit les garde-fous pour juger du potentiel des modèles en matière de cybersécurité.

L'entreprise a révélé qu'outre son modèle le plus avancé, GPT-5.6 Sol, l'autre IA mêlée à l'incident n'avait pas vocation à être commercialisée et était uniquement destinée à un usage interne.

Le rapport d'Hugging Face indique que l'attaque a duré pas moins de cinq jours avant que le site ne parvienne à la contenir.

Aucun des deux documents ne le mentionne clairement et la société n'a pas répondu à une question de l'AFP sur ce point, mais il semble qu'OpenAI n'ait pris conscience de l'évasion que plusieurs jours après les faits.

- Une IA auto-programmée -

"Un pirate (informatique) humain aurait pu trouver et exploiter les mêmes vulnérabilités", explique l'entreprise.

Ce qui a fait la différence, c'est le volume des tentatives, avec pas moins de 17.600 actions contre Hugging Face, marquées par beaucoup d'échecs, mais suffisamment de réussites pour que les modèles parviennent à leurs fins.

"L'échelle et la vitesse de ces actions dépassent de loin les capacités d'un humain qui opérerait manuellement", a fait valoir Hugging Face.

Le chercheur en IA Daniel Kokotajlo a plaidé pour une analyse de l'incident menée par un laboratoire indépendant, une démarche "qui devrait devenir systématique" pour des cas similaires, selon lui.

Cette évasion de modèles n'est pas la première à être documentée, mais elle est considérée comme, de loin, la plus sérieuse à ce jour.

Elle a donné un écho supplémentaire au débat, déjà nourri, sur l'accélération de l'IA, aux capacités de plus en plus étendues, et sur la difficulté de la contrôler.

Lors de l'épisode OpenAI, les modèles ont utilisé des méthodes dont ils savaient qu'elles étaient en contradiction avec le scénario du test, sans en informer les développeurs.

Mardi, plus d'un millier d'employés de géants de l'IA, dont plusieurs dirigeants de premier plan, ont demandé au gouvernement américain d'aider à "temporiser" la sortie des nouveaux modèles, pour laisser le temps à l'écosystème informatique de s'y préparer.

Ils plaident, dans une pétition, pour que les États-Unis soient moteur dans la création d'une instance internationale de référence en matière d'évaluation et de supervision de l'IA.

Interrogé sur la question, le président américain Donald Trump a estimé qu'il "fallait être prudent", et trouver un équilibre entre le contrôle des agents et le fait de ne pas être devancé par la Chine dans le développement de l'IA.

"Nous ne voulons pas les limiter, et que l'on se retrouve d'un seul coup derrière la Chine", a-t-il déclaré, "celui qui l'emportera" dans cette course à l'IA "pourrait très bien ramasser toute la mise".

Le milieu s'inquiète d'autant plus qu'il voit approcher le stade dit de "l'auto-amélioration récursive" (recursive self-improvement), au-delà duquel l'intelligence artificielle serait en mesure de concevoir seule son successeur, une séquence qui pourrait se répéter à l'infini.

Les derniers modèles d'OpenAI et Anthropic ont été en partie programmés par l'IA elle-même.

Le "RSI", son abréviation, rendrait plus difficile les vérifications et l'évaluation de nouveaux modèles par des informaticiens humains, car ils n'auraient pas participé directement à leur élaboration.

(B.Hartmann--BBZ)