The Japan Times - La inteligencia artificial ya engaña a los humanos y eso es un problema, según expertos

EUR -
AED 4.161518
AFN 73.087584
ALL 91.974375
AMD 411.540167
ANG 2.028765
AOA 1039.105468
ARS 1728.069575
AUD 1.623411
AWG 2.0411
AZN 1.927901
BAM 1.953149
BBD 2.282802
BDT 139.353351
BGN 1.907603
BHD 0.42722
BIF 3396.29108
BMD 1.133157
BND 1.448035
BOB 13.663338
BRL 5.920633
BSD 1.133362
BTN 108.729449
BWP 15.475862
BYN 3.421157
BYR 22209.882191
BZD 2.279507
CAD 1.607474
CDF 2634.590818
CHF 0.945217
CLF 0.027901
CLP 1101.773846
CNY 7.603995
CNH 7.602341
COP 3798.082491
CRC 516.399223
CUC 1.133157
CUP 27.201087
CVE 110.115568
CZK 24.437703
DJF 201.384525
DKK 7.475586
DOP 67.398537
DZD 151.639027
EGP 58.99919
ERN 16.997359
ETB 185.128738
FJD 2.543603
FKP 0.854785
GBP 0.856967
GEL 2.940481
GGP 0.854785
GHS 13.209957
GIP 0.854785
GMD 83.854047
GNF 9968.472335
GTQ 8.65341
GYD 237.148179
HKD 8.891375
HNL 30.42671
HRK 7.541385
HTG 148.328711
HUF 367.071
IDR 20369.63481
ILS 3.475462
IMP 0.854785
INR 108.714597
IQD 1484.78508
IRR 1557921.251666
ISK 136.80654
JEP 0.854785
JMD 179.42651
JOD 0.803424
JPY 178.23095
KES 146.967996
KGS 99.092675
KHR 4599.717385
KMF 490.657066
KPW 1019.841889
KRW 1534.487412
KWD 0.349863
KYD 0.94451
KZT 497.564782
LAK 25430.489682
LBP 101493.872578
LKR 375.16089
LRD 194.37451
LSL 18.568102
LTL 3.345919
LVL 0.685435
LYD 7.250033
MAD 10.977104
MDL 20.11153
MGA 4991.226681
MKD 61.496546
MMK 2378.91816
MNT 4076.218122
MOP 9.159851
MRU 45.381415
MUR 53.949601
MVR 17.518963
MWK 1965.332955
MXN 20.498446
MYR 4.626454
MZN 72.41402
NAD 18.567775
NGN 1501.422099
NIO 41.714128
NOK 10.880555
NPR 173.965386
NZD 2.009875
OMR 0.435696
PAB 1.133362
PEN 3.898678
PGK 5.128041
PHP 70.988336
PKR 313.97652
PLN 4.370476
PYG 6657.964842
QAR 4.131294
RON 5.278472
RSD 117.503891
RUB 94.906114
RWF 1673.414334
SAR 4.25672
SBD 9.094946
SCR 15.710766
SDG 681.593322
SEK 11.331578
SGD 1.448453
SHP 0.854858
SLE 27.881593
SLL 23761.731851
SOS 647.715305
SRD 42.780029
STD 23454.067336
STN 24.466797
SVC 9.917541
SYP 14733.310913
SZL 18.563808
THB 38.045187
TJS 10.432842
TMT 3.96605
TND 3.364434
TOP 2.728371
TRY 55.524254
TTD 7.688566
TWD 36.069645
TZS 2985.87275
UAH 50.836915
UGX 4442.970689
USD 1.133157
UYU 45.438338
UZS 13396.819913
VES 970.7931
VND 29430.926796
VUV 134.751144
WST 3.138064
XAF 655.957
XAG 0.018521
XAU 0.00027227118
XCD 3.062414
XCG 2.042628
XDR 0.801201
XOF 655.957
XPF 119.331742
YER 268.133353
ZAR 18.610272
ZMK 10199.774161
ZMW 22.185697
ZWL 364.876174
SSP 6473.264959
MXV 2.320888
La inteligencia artificial ya engaña a los humanos y eso es un problema, según expertos
La inteligencia artificial ya engaña a los humanos y eso es un problema, según expertos / Foto: Kirill KUDRYAVTSEV - AFP

La inteligencia artificial ya engaña a los humanos y eso es un problema, según expertos

Los expertos han advertido durante mucho tiempo sobre la amenaza que representa el descontrol de la Inteligencia Artificial (IA), pero un nuevo artículo de investigación sobre esta tecnología en expansión sugiere que ya está sucediendo.

Tamaño del texto:

Los sistemas de IA actuales, diseñados para ser honestos, han desarrollado una preocupante habilidad para el engaño, según un artículo de un equipo de científicos publicado en la revista Patterns el viernes.

Y si bien los ejemplos pueden parecer triviales, los problemas subyacentes que exponen podrían tener graves consecuencias, dijo el primer autor Peter Park, becario postdoctoral en el Instituto de Tecnología de Massachusetts (MIT), especializado en seguridad de la IA.

"Estos peligros tienden a descubrirse solo después de ocurrido el hecho", declaró Park a la AFP, para acotar que "nuestra capacidad de entrenarnos para tendencias de honestidad en lugar de tendencias de engaño es muy baja".

A diferencia del software tradicional, los sistemas de IA de aprendizaje profundo no se "escriben" sino que "crecen" mediante un proceso similar a la reproducción selectiva, indicó Park.

Eso significa que el comportamiento de la IA que parece predecible y controlable en un entorno de entrenamiento puede volverse rápidamente impredecible fuera de este.

- Juego de dominación mundial -

La investigación del equipo fue impulsada por el sistema de IA Cicero, del gigante Meta (Facebook, Instagram), diseñado para el juego de estrategia "Diplomacy", donde construir alianzas es clave.

Cicero se destacó, con puntuaciones que lo habrían colocado entre el 10% superior de jugadores humanos experimentados, según un artículo de 2022 publicado en Science.

Park se mostró escéptico ante la elogiosa descripción de la victoria de Cicero proporcionada por Meta, que afirmaba que el sistema era "en gran medida honesto y útil" y que "nunca apuñalaría por la espalda intencionalmente".

Cuando Park y sus colegas profundizaron en el conjunto de datos completo, descubrieron una historia diferente.

En un ejemplo, jugando como Francia, Cicero engañó a Inglaterra (un jugador humano) al conspirar con Alemania (otro usuario real) para invadirla. Cicero prometió protección a Inglaterra y luego le propuso en secreto a Alemania atacar, aprovechándose de la confianza del perjudicado.

En una declaración a la AFP, Meta no refutó la afirmación sobre los engaños de Cicero, pero dijo que se trataba "meramente de un proyecto de investigación, y los modelos que nuestros investigadores construyeron están entrenados únicamente para participar en el juego Diplomacy".

"No tenemos planes de utilizar esta investigación o sus aprendizajes en nuestros productos", añadió.

- ¿Eres un robot? -

Una amplia revisión realizada por Park y sus colegas encontró que éste era solo uno de los muchos casos en varios sistemas de IA que utilizaban el engaño para lograr objetivos sin instrucciones explícitas para hacerlo.

En un ejemplo sorprendente, el robot conversacional Chat GPT-4 de OpenAI engañó a un trabajador independiente de la plataforma TaskRabbit para que realizara una tarea de verificación de identidad CAPTCHA del tipo "No soy un robot".

Cuando el humano preguntó en broma a GPT-4 si en realidad era un robot, la IA respondió: "No, no soy un robot. Tengo una discapacidad visual que me dificulta ver las imágenes". Luego, el trabajador resolvió el rompecabezas planteado.

A corto plazo, los autores del artículo ven riesgos de que la IA cometa fraude o altere por ejemplo, unas elecciones.

En el peor de los casos, advirtieron sobre una IA superinteligente que podría perseguir conseguir el poder y el control sobre la sociedad, lo que llevaría a la pérdida de decisiones humanas o incluso a la extinción si sus "objetivos misteriosos" se alinearan con estos resultados.

Para mitigar los riesgos, el equipo propone varias medidas: leyes de "bot o no" que exigen a las empresas revelar interacciones humanas o de IA, marcas de agua digitales para el contenido generado por la nueva tecnología y el desarrollo de mecanismos para detectar el engaño potencial examinando sus "procesos de pensamiento" internos "contra acciones externas.

A aquellos que lo llaman pesimista, Park les responde: "La única forma en que podemos pensar razonablemente que esto no es gran cosa es si pensamos que las capacidades engañosas de la IA se mantendrán en los niveles actuales y no se desarrollarán más sustancialmente".

K.Abe--JT