Berliner Boersenzeitung - Expertos preocupados porque la inteligencia artificial ya engaña a humanos

EUR -
AED 4.243163
AFN 76.836825
ALL 93.168392
AMD 422.683441
AOA 1059.490664
ARS 1731.895657
AUD 1.635936
AWG 2.081143
AZN 1.964472
BAM 1.956127
BBD 2.327789
BDT 142.803865
BHD 0.435867
BIF 3452.176908
BMD 1.155388
BND 1.478954
BOB 13.753358
BRL 5.87804
BSD 1.155693
BTN 110.085873
BWP 15.570074
BYN 3.435989
BYR 22645.606405
BZD 2.324398
CAD 1.610755
CDF 2614.066317
CHF 0.933808
CLF 0.026824
CLP 1055.723909
CNY 7.7961
CNH 7.793635
COP 3642.60356
CRC 524.689954
CUC 1.155388
CUP 30.617784
CVE 110.283907
CZK 24.250092
DJF 205.808847
DKK 7.47569
DOP 67.38126
DZD 153.592261
EGP 57.747336
ERN 17.330821
ETB 186.880539
FJD 2.553243
FKP 0.857011
GBP 0.85579
GEL 3.016025
GGP 0.857011
GHS 13.568326
GIP 0.857011
GMD 84.917311
GNF 10149.74009
GTQ 8.818397
GYD 242.045687
HKD 9.064453
HNL 30.979177
HRK 7.536369
HTG 151.115254
HUF 363.604111
IDR 20498.202116
ILS 3.466245
IMP 0.857011
INR 110.109235
IQD 1514.05302
IRR 1589294.076063
ISK 142.216689
JEP 0.857011
JMD 183.540672
JOD 0.819128
JPY 183.187355
KES 149.507516
KGS 101.038588
KHR 4685.803343
KMF 492.195074
KRW 1637.520047
KWD 0.3569
KYD 0.963165
KZT 538.813048
LAK 26101.474886
LBP 103496.143572
LKR 387.344731
LRD 208.609375
LSL 18.700163
LTL 3.411561
LVL 0.698883
LYD 7.365231
MAD 10.777548
MDL 20.086965
MGA 4949.848611
MKD 61.530283
MMK 2425.794575
MNT 4152.757665
MOP 9.339844
MRU 46.355747
MUR 54.303359
MVR 17.850882
MWK 2004.078274
MXN 19.818137
MYR 4.726342
MZN 73.835072
NAD 18.700163
NGN 1573.280637
NIO 42.527107
NOK 10.987336
NPR 176.136435
NZD 1.961554
OMR 0.444245
PAB 1.155698
PEN 3.903852
PGK 5.109876
PHP 70.211802
PKR 320.85972
PLN 4.299164
PYG 6879.149604
QAR 4.213104
RON 5.244535
RSD 117.352589
RUB 95.451742
RWF 1697.791072
SAR 4.326647
SBD 9.319009
SCR 17.004638
SDG 693.805905
SEK 10.965222
SGD 1.478256
SLE 28.420632
SOS 660.501804
SRD 43.750504
STD 23914.200576
STN 24.504095
SVC 10.112734
SZL 18.697125
THB 38.145135
TJS 10.673415
TMT 4.055412
TND 3.387866
TRY 55.125778
TTD 7.839344
TWD 37.238734
TZS 3058.893435
UAH 51.843388
UGX 4304.71938
USD 1.155388
UYU 46.557982
UZS 13790.304557
VES 873.198868
VND 30219.175282
VUV 137.91453
WST 3.158504
XAF 656.069478
XAG 0.018024
XAU 0.000266
XCD 3.122494
XCG 2.082948
XDR 0.815502
XOF 656.069478
XPF 119.331742
YER 275.449418
ZAR 18.687033
ZMK 10399.872862
ZMW 21.617706
ZWL 372.034491
Expertos preocupados porque la inteligencia artificial ya engaña a humanos
Expertos preocupados porque la inteligencia artificial ya engaña a humanos / Foto: Kirill KUDRYAVTSEV - AFP/Archivos

Expertos preocupados porque la inteligencia artificial ya engaña a humanos

Los expertos han advertido durante mucho tiempo sobre la amenaza que representa el descontrol de la Inteligencia Artificial (IA), pero un nuevo artículo de investigación sobre esta tecnología en expansión sugiere que ya está sucediendo.

Tamaño del texto:

Los sistemas de IA actuales, diseñados para ser honestos, han desarrollado una preocupante habilidad para el engaño, según un artículo de un equipo de científicos publicado en la revista Patterns el viernes.

Y si bien los ejemplos pueden parecer triviales, los problemas subyacentes que exponen podrían tener graves consecuencias, dijo el primer autor Peter Park, becario postdoctoral en el Instituto de Tecnología de Massachusetts (MIT), especializado en seguridad de la IA.

"Estos peligros tienden a descubrirse solo después de ocurrido el hecho", declaró Park a la AFP, para acotar que "nuestra capacidad de entrenarnos para tendencias de honestidad en lugar de tendencias de engaño es muy baja".

A diferencia del software tradicional, los sistemas de IA de aprendizaje profundo no se "escriben" sino que "crecen" mediante un proceso similar a la reproducción selectiva, indicó Park.

Eso significa que el comportamiento de la IA que parece predecible y controlable en un entorno de entrenamiento puede volverse rápidamente impredecible fuera de este.

- Juego de dominación mundial -

La investigación del equipo fue impulsada por el sistema de IA Cicero, del gigante Meta (Facebook, Instagram), diseñado para el juego de estrategia "Diplomacy", donde construir alianzas es clave.

Cicero se destacó, con puntuaciones que lo habrían colocado entre el 10% superior de jugadores humanos experimentados, según un artículo de 2022 publicado en Science.

Park se mostró escéptico ante la elogiosa descripción de la victoria de Cicero proporcionada por Meta, que afirmaba que el sistema era "en gran medida honesto y útil" y que "nunca apuñalaría por la espalda intencionalmente".

Cuando Park y sus colegas profundizaron en el conjunto de datos completo, descubrieron una historia diferente.

En un ejemplo, jugando como Francia, Cicero engañó a Inglaterra (un jugador humano) al conspirar con Alemania (otro usuario real) para invadirla. Cicero prometió protección a Inglaterra y luego le propuso en secreto a Alemania atacar, aprovechándose de la confianza del perjudicado.

En una declaración a la AFP, Meta no refutó la afirmación sobre los engaños de Cicero, pero dijo que se trataba "meramente de un proyecto de investigación, y los modelos que nuestros investigadores construyeron están entrenados únicamente para participar en el juego Diplomacy".

"No tenemos planes de utilizar esta investigación o sus aprendizajes en nuestros productos", añadió.

- ¿Eres un robot? -

Una amplia revisión realizada por Park y sus colegas encontró que éste era solo uno de los muchos casos en varios sistemas de IA que utilizaban el engaño para lograr objetivos sin instrucciones explícitas para hacerlo.

En un ejemplo sorprendente, el robot conversacional Chat GPT-4 de OpenAI engañó a un trabajador independiente de la plataforma TaskRabbit para que realizara una tarea de verificación de identidad CAPTCHA del tipo "No soy un robot".

Cuando el humano preguntó en broma a GPT-4 si en realidad era un robot, la IA respondió: "No, no soy un robot. Tengo una discapacidad visual que me dificulta ver las imágenes". Luego, el trabajador resolvió el rompecabezas planteado.

A corto plazo, los autores del artículo ven riesgos de que la IA cometa fraude o altere por ejemplo, unas elecciones.

En el peor de los casos, advirtieron sobre una IA superinteligente que podría perseguir conseguir el poder y el control sobre la sociedad, lo que llevaría a la pérdida de decisiones humanas o incluso a la extinción si sus "objetivos misteriosos" se alinearan con estos resultados.

Para mitigar los riesgos, el equipo propone varias medidas: leyes de "bot o no" que exigen a las empresas revelar interacciones humanas o de IA, marcas de agua digitales para el contenido generado por la nueva tecnología y el desarrollo de mecanismos para detectar el engaño potencial examinando sus "procesos de pensamiento" internos "contra acciones externas.

A aquellos que lo llaman pesimista, Park les responde: "La única forma en que podemos pensar razonablemente que esto no es gran cosa es si pensamos que las capacidades engañosas de la IA se mantendrán en los niveles actuales y no se desarrollarán más sustancialmente".

(T.Burkhard--BBZ)