Berliner Boersenzeitung - La diversidad del español, enloquecedora para la inteligencia artificial

EUR -
AED 4.247529
AFN 76.908434
ALL 93.25446
AMD 422.256034
AOA 1060.581278
ARS 1725.019417
AUD 1.637031
AWG 2.083285
AZN 1.970693
BAM 1.956523
BBD 2.322558
BDT 142.742747
BHD 0.434861
BIF 3452.475775
BMD 1.156577
BND 1.477646
BOB 13.705064
BRL 5.879227
BSD 1.153126
BTN 109.730548
BWP 15.564752
BYN 3.433669
BYR 22668.916725
BZD 2.319157
CAD 1.613466
CDF 2616.75369
CHF 0.933803
CLF 0.026839
CLP 1056.320336
CNY 7.804123
CNH 7.798559
COP 3634.943201
CRC 524.193703
CUC 1.156577
CUP 30.649301
CVE 110.305761
CZK 24.260948
DJF 205.34588
DKK 7.475844
DOP 67.314875
DZD 153.025547
EGP 57.297834
ERN 17.348661
ETB 186.120676
FJD 2.554359
FKP 0.857579
GBP 0.856804
GEL 3.018572
GGP 0.857579
GHS 13.532
GIP 0.857579
GMD 85.003173
GNF 10127.742451
GTQ 8.798251
GYD 241.249148
HKD 9.073552
HNL 30.907421
HRK 7.539497
HTG 150.775715
HUF 363.822817
IDR 20588.234011
ILS 3.469559
IMP 0.857579
INR 110.11831
IQD 1510.558189
IRR 1590930.020376
ISK 142.651808
JEP 0.857579
JMD 183.12767
JOD 0.82005
JPY 182.412495
KES 149.215139
KGS 101.142765
KHR 4683.730754
KMF 492.701994
KRW 1628.299593
KWD 0.35699
KYD 0.960955
KZT 540.439706
LAK 26035.620805
LBP 103262.458029
LKR 386.782926
LRD 208.136912
LSL 18.733723
LTL 3.415072
LVL 0.699602
LYD 7.33471
MAD 10.747171
MDL 20.05241
MGA 4920.818364
MKD 61.552745
MMK 2428.291317
MNT 4158.881925
MOP 9.318143
MRU 46.35613
MUR 54.439938
MVR 17.868685
MWK 1999.538879
MXN 19.842803
MYR 4.730516
MZN 73.911064
NAD 18.733723
NGN 1578.566081
NIO 42.435681
NOK 10.982478
NPR 175.568877
NZD 1.96293
OMR 0.442614
PAB 1.153126
PEN 3.905143
PGK 5.095883
PHP 70.210033
PKR 320.136598
PLN 4.298016
PYG 6856.533659
QAR 4.215258
RON 5.246579
RSD 117.383376
RUB 94.346312
RWF 1695.626576
SAR 4.3311
SBD 9.328602
SCR 16.711475
SDG 694.535451
SEK 10.926111
SGD 1.47809
SLE 28.45001
SOS 659.043533
SRD 43.795536
STD 23938.816727
STN 24.509057
SVC 10.089728
SZL 18.729921
THB 38.224743
TJS 10.637631
TMT 4.059587
TND 3.387652
TRY 55.157951
TTD 7.815888
TWD 37.300319
TZS 3052.928132
UAH 51.645684
UGX 4295.587326
USD 1.156577
UYU 46.417152
UZS 13791.096151
VES 874.097703
VND 30307.532057
VUV 137.120508
WST 3.161754
XAF 656.199482
XAG 0.018195
XAU 0.000266
XCD 3.125708
XCG 2.078268
XDR 0.816102
XOF 656.199482
XPF 119.331742
YER 275.730918
ZAR 18.668599
ZMK 10410.580205
ZMW 21.765043
ZWL 372.417446
La diversidad del español, enloquecedora para la inteligencia artificial
La diversidad del español, enloquecedora para la inteligencia artificial / Foto: Josep Lago - AFP/Archivos

La diversidad del español, enloquecedora para la inteligencia artificial

La inteligencia artificial necesitará mucho alimento para que todo hablante del español se pueda dirigir a ella con naturalidad, teniendo en cuenta sus 21 variedades nacionales, acentos, subacentos y jergas como la gaditana o el lunfardo.

Tamaño del texto:

Uno de los temas centrales del IX Congreso Internacional de la Lengua Española (CILE) que se celebra en la ciudad andaluza de Cádiz del lunes al jueves es la inteligencia artificial, y el acto inaugural dejó un momento que da una idea del trecho que tienen que recorrer las máquinas.

Fue cuando el alcalde de la ciudad anfitriona, José María González Santos, más conocido como Kichi, le deseó a los participantes que lo pasen bien, en pura habla gaditana.

"Señoras y señores, estén al 'liquindoi', aprovechen 'la collá' y la 'conviá', disfruten del 'tangai', para que cuando les toque 'guannajarse' puedan decir con orgullo que este congreso ha sido un 'bastinazo'", lanzó Kichi.

Pues bien, esto es lo que transcribió uno de los programas más populares del mundo: "señoras y señores, China lindo y aproveche la ***** y la cumbia y disfruten del tangai para que cuando les toque guardarse puedan decir con orgullo que este congreso ha sido un partidazo".

Esto, explicó a la AFP Virginia Bertolotti, lingüista uruguaya, "es una muestra de que si alimentamos las inteligencias artificiales con algo que es relativamente plano, como es internet, hay cosas que hacen muy bien, pero hay cosas que no pueden hacer".

"Si yo le digo 'hazme un diálogo entre gauchos del siglo XIX', hace cualquier cosa", sostuvo esta catedrática de la Universidad de la República, miembro de la Academia de Letras de Uruguay.

- Correctores incorrectos -

La inteligencia artificial es la "disciplina científica que se ocupa de crear programas informáticos que ejecutan operaciones comparables a las que realiza la mente humana", según la definición de la Real Academia de la Lengua (RAE), que la eligió palabra del año en 2022.

Es un campo con mucho en juego, indicó el ministro español de Asuntos Exteriores, José Manuel Albares, cuando advirtió que hay que "posicionar el español en el núcleo central de la Inteligencia Artificial (IA), en el metaverso".

Muchos de los inventos de esta nueva disciplina son ya de uso común, como los correctores, los traductores, o los redactores o "chatbots".

El problema de estas herramientas, advirtió el director de la Real Academia de la Lengua, Santiago Muñoz Machado, es que estos instrumentos "no usan el canon panhispánico de la lengua, sino el canon de Silicón Valley".

"Hemos advertido en la Academia que lo que nos corrige ese corrector, normalmente no es correcto, y no son juegos de palabras, es exactamente así", ahondó.

El remedio, explicó Bertolotti, sería "sofisticar" la gran cantidad de datos que la inteligencia artificial barre de internet, mediante "muchos materiales que son pequeños corpus de especialidades, que hemos ido trabajando en investigación lingüística".

"El habla de la calle, el habla cotidiana, en el caso del español, que es una lengua de mucho espesor cultural, con una gran distribución geográfica, no necesariamente está capturado por el tipo de datos que se suelen utilizar para entrenar a las inteligencias artificiales", argumentó la lingüista.

- El problema de la lista de la compra -

Asunción Gómez-Pérez, miembro de la RAE y asesora en inteligencia artificial del gobierno de España, cree que podría acabar dándose el caso de que unas variantes del español acaben siendo más dominantes que otras en la inteligencia artificial.

"Los modelos del lenguaje que estamos utilizando ahora se nutren de grandes cantidades de textos que han sido escritos por personas las cuales pertenecen a ciertos países y utilizan cierto vocabulario", explicó a la AFP.

"Cuantos más textos haya de una variante, más posibilidades tiene esa variedad de ser la aceptada", concluyó Gómez-Pérez.

Si acaba siendo el caso, esas avanzadillas domésticas de la inteligencia artificial que son Siri y Alexa sufrirán para entender que cuando se les pide que incluyan en la lista del supermercado ejotes, agujas, chauchas, frijoles verdes, navajitas o judías verdes, se les está pidiendo exactamente lo mismo.

(T.Renner--BBZ)