Dubai Telegraph - La diversidad del español, enloquecedora para la inteligencia artificial

EUR -
AED 4.218957
AFN 74.661225
ALL 91.582971
AMD 417.457719
ANG 2.056463
AOA 1054.440663
ARS 1743.614232
AUD 1.610725
AWG 2.06753
AZN 1.957227
BAM 1.958584
BBD 2.314189
BDT 141.100567
BGN 1.933647
BHD 0.43308
BIF 3445.883141
BMD 1.148628
BND 1.468274
BOB 11.289342
BRL 5.906291
BSD 1.149053
BTN 110.098541
BWP 15.582625
BYN 3.475741
BYR 22513.103189
BZD 2.310945
CAD 1.607792
CDF 2654.479062
CHF 0.944284
CLF 0.027911
CLP 1102.062801
CNY 7.693107
CNH 7.700293
COP 3657.609688
CRC 514.039631
CUC 1.148628
CUP 30.438634
CVE 110.55587
CZK 24.347696
DJF 204.134569
DKK 7.475389
DOP 67.81758
DZD 153.643935
EGP 60.011386
ERN 17.229416
ETB 187.686889
FJD 2.545249
FKP 0.859109
GBP 0.857505
GEL 2.990867
GGP 0.859109
GHS 13.237162
GIP 0.859109
GMD 84.42856
GNF 10101.666796
GTQ 8.768617
GYD 240.39904
HKD 9.011042
HNL 30.845651
HRK 7.534658
HTG 150.176082
HUF 364.287725
IDR 20459.4717
ILS 3.487958
IMP 0.859109
INR 110.252582
IQD 1505.265866
IRR 1578903.655694
ISK 139.202636
JEP 0.859109
JMD 181.437904
JOD 0.814422
JPY 180.197158
KES 148.759217
KGS 100.447935
KHR 4656.761237
KMF 491.613064
KPW 1033.765308
KRW 1592.044397
KWD 0.353962
KYD 0.95759
KZT 513.710212
LAK 25757.976881
LBP 102859.612165
LKR 380.330553
LRD 198.788625
LSL 18.680779
LTL 3.391599
LVL 0.694794
LYD 7.294223
MAD 10.886907
MDL 20.194321
MGA 4981.210628
MKD 61.619198
MMK 2411.949927
MNT 4132.823691
MOP 9.2846
MRU 46.225512
MUR 54.640655
MVR 17.746733
MWK 1992.492937
MXN 19.78965
MYR 4.690656
MZN 73.40923
NAD 18.680942
NGN 1529.662418
NIO 42.280099
NOK 10.809019
NPR 176.162473
NZD 2.008793
OMR 0.442789
PAB 1.149063
PEN 3.877412
PGK 5.114426
PHP 72.2606
PKR 318.484727
PLN 4.363465
PYG 6811.860614
QAR 4.19998
RON 5.263476
RSD 117.119869
RUB 96.935341
RWF 1687.950767
SAR 4.280492
SBD 9.18961
SCR 16.157873
SDG 690.903792
SEK 11.290555
SGD 1.465768
SHP 0.858627
SLE 28.314099
SLL 24086.139517
SOS 656.64482
SRD 43.585257
STD 23774.274604
STN 24.535303
SVC 10.054598
SYP 14934.457826
SZL 18.674871
THB 38.295672
TJS 10.59989
TMT 4.031683
TND 3.380004
TOP 2.76562
TRY 56.015171
TTD 7.800223
TWD 36.503811
TZS 3043.85889
UAH 51.337638
UGX 4532.442628
USD 1.148628
UYU 46.207089
UZS 13604.57507
VES 973.444877
VND 29889.590367
VUV 135.812798
WST 3.158992
XAF 655.957
XAG 0.01734
XAU 0.000262
XCD 3.104224
XCG 2.070844
XDR 0.812139
XOF 655.957
XPF 119.331742
YER 271.708303
ZAR 18.687948
ZMK 10339.031894
ZMW 22.584693
ZWL 369.857655
SSP 6551.981415
MXV 2.243593
La diversidad del español, enloquecedora para la inteligencia artificial
La diversidad del español, enloquecedora para la inteligencia artificial / Foto: Josep Lago - AFP/Archivos

La diversidad del español, enloquecedora para la inteligencia artificial

La inteligencia artificial necesitará mucho alimento para que todo hablante del español se pueda dirigir a ella con naturalidad, teniendo en cuenta sus 21 variedades nacionales, acentos, subacentos y jergas como la gaditana o el lunfardo.

Tamaño del texto:

Uno de los temas centrales del IX Congreso Internacional de la Lengua Española (CILE) que se celebra en la ciudad andaluza de Cádiz del lunes al jueves es la inteligencia artificial, y el acto inaugural dejó un momento que da una idea del trecho que tienen que recorrer las máquinas.

Fue cuando el alcalde de la ciudad anfitriona, José María González Santos, más conocido como Kichi, le deseó a los participantes que lo pasen bien, en pura habla gaditana.

"Señoras y señores, estén al 'liquindoi', aprovechen 'la collá' y la 'conviá', disfruten del 'tangai', para que cuando les toque 'guannajarse' puedan decir con orgullo que este congreso ha sido un 'bastinazo'", lanzó Kichi.

Pues bien, esto es lo que transcribió uno de los programas más populares del mundo: "señoras y señores, China lindo y aproveche la ***** y la cumbia y disfruten del tangai para que cuando les toque guardarse puedan decir con orgullo que este congreso ha sido un partidazo".

Esto, explicó a la AFP Virginia Bertolotti, lingüista uruguaya, "es una muestra de que si alimentamos las inteligencias artificiales con algo que es relativamente plano, como es internet, hay cosas que hacen muy bien, pero hay cosas que no pueden hacer".

"Si yo le digo 'hazme un diálogo entre gauchos del siglo XIX', hace cualquier cosa", sostuvo esta catedrática de la Universidad de la República, miembro de la Academia de Letras de Uruguay.

- Correctores incorrectos -

La inteligencia artificial es la "disciplina científica que se ocupa de crear programas informáticos que ejecutan operaciones comparables a las que realiza la mente humana", según la definición de la Real Academia de la Lengua (RAE), que la eligió palabra del año en 2022.

Es un campo con mucho en juego, indicó el ministro español de Asuntos Exteriores, José Manuel Albares, cuando advirtió que hay que "posicionar el español en el núcleo central de la Inteligencia Artificial (IA), en el metaverso".

Muchos de los inventos de esta nueva disciplina son ya de uso común, como los correctores, los traductores, o los redactores o "chatbots".

El problema de estas herramientas, advirtió el director de la Real Academia de la Lengua, Santiago Muñoz Machado, es que estos instrumentos "no usan el canon panhispánico de la lengua, sino el canon de Silicón Valley".

"Hemos advertido en la Academia que lo que nos corrige ese corrector, normalmente no es correcto, y no son juegos de palabras, es exactamente así", ahondó.

El remedio, explicó Bertolotti, sería "sofisticar" la gran cantidad de datos que la inteligencia artificial barre de internet, mediante "muchos materiales que son pequeños corpus de especialidades, que hemos ido trabajando en investigación lingüística".

"El habla de la calle, el habla cotidiana, en el caso del español, que es una lengua de mucho espesor cultural, con una gran distribución geográfica, no necesariamente está capturado por el tipo de datos que se suelen utilizar para entrenar a las inteligencias artificiales", argumentó la lingüista.

- El problema de la lista de la compra -

Asunción Gómez-Pérez, miembro de la RAE y asesora en inteligencia artificial del gobierno de España, cree que podría acabar dándose el caso de que unas variantes del español acaben siendo más dominantes que otras en la inteligencia artificial.

"Los modelos del lenguaje que estamos utilizando ahora se nutren de grandes cantidades de textos que han sido escritos por personas las cuales pertenecen a ciertos países y utilizan cierto vocabulario", explicó a la AFP.

"Cuantos más textos haya de una variante, más posibilidades tiene esa variedad de ser la aceptada", concluyó Gómez-Pérez.

Si acaba siendo el caso, esas avanzadillas domésticas de la inteligencia artificial que son Siri y Alexa sufrirán para entender que cuando se les pide que incluyan en la lista del supermercado ejotes, agujas, chauchas, frijoles verdes, navajitas o judías verdes, se les está pidiendo exactamente lo mismo.

J.Alaqanone--DT