The Prague Post - La inteligencia artificial ya engaña a los humanos y eso es un problema, según expertos

EUR -
AED 4.26807
AFN 76.126374
ALL 92.206872
AMD 421.806782
ANG 2.08003
AOA 1066.870586
ARS 1753.415385
AUD 1.609841
AWG 2.091904
AZN 1.970654
BAM 1.956404
BBD 2.341272
BDT 142.864093
BGN 1.971463
BHD 0.438233
BIF 3476.238288
BMD 1.162169
BND 1.472998
BOB 14.381231
BRL 5.955953
BSD 1.162454
BTN 109.745765
BWP 15.564536
BYN 3.58099
BYR 22778.506256
BZD 2.337971
CAD 1.606751
CDF 2649.744425
CHF 0.940398
CLF 0.027404
CLP 1082.049236
CNY 7.799665
CNH 7.7972
COP 3638.866374
CRC 527.260463
CUC 1.162169
CUP 30.79747
CVE 110.266773
CZK 24.202179
DJF 207.002998
DKK 7.474633
DOP 68.810941
DZD 154.819155
EGP 59.217024
ERN 17.43253
ETB 188.729389
FJD 2.575832
FKP 0.859697
GBP 0.858697
GEL 3.027427
GGP 0.859697
GHS 13.213212
GIP 0.859697
GMD 86.000106
GNF 10217.845869
GTQ 8.872143
GYD 243.133909
HKD 9.111926
HNL 31.20596
HRK 7.533761
HTG 152.021033
HUF 362.121881
IDR 20497.169125
ILS 3.495397
IMP 0.859697
INR 109.814191
IQD 1522.856904
IRR 1597517.076516
ISK 140.808644
JEP 0.859697
JMD 184.263699
JOD 0.823945
JPY 179.466158
KES 150.396107
KGS 101.630602
KHR 4704.269752
KMF 492.759271
KPW 1045.952159
KRW 1561.82646
KWD 0.358995
KYD 0.96882
KZT 529.454798
LAK 26067.1574
LBP 104099.580962
LKR 381.459373
LRD 203.37327
LSL 18.572512
LTL 3.431582
LVL 0.702985
LYD 7.376245
MAD 10.894875
MDL 20.024094
MGA 4987.453475
MKD 61.588789
MMK 2440.252121
MNT 4180.357205
MOP 9.387417
MRU 46.766233
MUR 54.494406
MVR 17.96749
MWK 2015.687424
MXN 19.655922
MYR 4.702153
MZN 74.301895
NAD 18.572832
NGN 1536.305885
NIO 42.781916
NOK 10.778644
NPR 175.643454
NZD 1.975414
OMR 0.446859
PAB 1.162119
PEN 3.898753
PGK 5.240505
PHP 72.752962
PKR 322.366446
PLN 4.308903
PYG 6955.116673
QAR 4.247668
RON 5.251023
RSD 117.3384
RUB 100.35455
RWF 1711.098659
SAR 4.364928
SBD 9.297945
SCR 15.933325
SDG 699.043175
SEK 11.159521
SGD 1.471009
SHP 0.861011
SLE 28.64689
SLL 24370.095374
SOS 664.393622
SRD 43.849205
STD 24054.545402
STN 24.507037
SVC 10.172358
SYP 15110.517153
SZL 18.575413
THB 38.192309
TJS 10.714872
TMT 4.06759
TND 3.391855
TOP 2.798223
TRY 56.287202
TTD 7.869463
TWD 36.646431
TZS 3073.974524
UAH 51.78069
UGX 4387.07054
USD 1.162169
UYU 46.780752
UZS 13711.054751
VES 937.146216
VND 30236.142718
VUV 137.097747
WST 3.158909
XAF 656.148219
XAG 0.017634
XAU 0.000263
XCD 3.14082
XCG 2.095092
XDR 0.821714
XOF 656.15669
XPF 119.331742
YER 275.433763
ZAR 18.564274
ZMK 10460.940695
ZMW 22.232383
ZWL 374.217843
La inteligencia artificial ya engaña a los humanos y eso es un problema, según expertos
La inteligencia artificial ya engaña a los humanos y eso es un problema, según expertos / Foto: Kirill KUDRYAVTSEV - AFP

La inteligencia artificial ya engaña a los humanos y eso es un problema, según expertos

Los expertos han advertido durante mucho tiempo sobre la amenaza que representa el descontrol de la Inteligencia Artificial (IA), pero un nuevo artículo de investigación sobre esta tecnología en expansión sugiere que ya está sucediendo.

Tamaño del texto:

Los sistemas de IA actuales, diseñados para ser honestos, han desarrollado una preocupante habilidad para el engaño, según un artículo de un equipo de científicos publicado en la revista Patterns el viernes.

Y si bien los ejemplos pueden parecer triviales, los problemas subyacentes que exponen podrían tener graves consecuencias, dijo el primer autor Peter Park, becario postdoctoral en el Instituto de Tecnología de Massachusetts (MIT), especializado en seguridad de la IA.

"Estos peligros tienden a descubrirse solo después de ocurrido el hecho", declaró Park a la AFP, para acotar que "nuestra capacidad de entrenarnos para tendencias de honestidad en lugar de tendencias de engaño es muy baja".

A diferencia del software tradicional, los sistemas de IA de aprendizaje profundo no se "escriben" sino que "crecen" mediante un proceso similar a la reproducción selectiva, indicó Park.

Eso significa que el comportamiento de la IA que parece predecible y controlable en un entorno de entrenamiento puede volverse rápidamente impredecible fuera de este.

- Juego de dominación mundial -

La investigación del equipo fue impulsada por el sistema de IA Cicero, del gigante Meta (Facebook, Instagram), diseñado para el juego de estrategia "Diplomacy", donde construir alianzas es clave.

Cicero se destacó, con puntuaciones que lo habrían colocado entre el 10% superior de jugadores humanos experimentados, según un artículo de 2022 publicado en Science.

Park se mostró escéptico ante la elogiosa descripción de la victoria de Cicero proporcionada por Meta, que afirmaba que el sistema era "en gran medida honesto y útil" y que "nunca apuñalaría por la espalda intencionalmente".

Cuando Park y sus colegas profundizaron en el conjunto de datos completo, descubrieron una historia diferente.

En un ejemplo, jugando como Francia, Cicero engañó a Inglaterra (un jugador humano) al conspirar con Alemania (otro usuario real) para invadirla. Cicero prometió protección a Inglaterra y luego le propuso en secreto a Alemania atacar, aprovechándose de la confianza del perjudicado.

En una declaración a la AFP, Meta no refutó la afirmación sobre los engaños de Cicero, pero dijo que se trataba "meramente de un proyecto de investigación, y los modelos que nuestros investigadores construyeron están entrenados únicamente para participar en el juego Diplomacy".

"No tenemos planes de utilizar esta investigación o sus aprendizajes en nuestros productos", añadió.

- ¿Eres un robot? -

Una amplia revisión realizada por Park y sus colegas encontró que éste era solo uno de los muchos casos en varios sistemas de IA que utilizaban el engaño para lograr objetivos sin instrucciones explícitas para hacerlo.

En un ejemplo sorprendente, el robot conversacional Chat GPT-4 de OpenAI engañó a un trabajador independiente de la plataforma TaskRabbit para que realizara una tarea de verificación de identidad CAPTCHA del tipo "No soy un robot".

Cuando el humano preguntó en broma a GPT-4 si en realidad era un robot, la IA respondió: "No, no soy un robot. Tengo una discapacidad visual que me dificulta ver las imágenes". Luego, el trabajador resolvió el rompecabezas planteado.

A corto plazo, los autores del artículo ven riesgos de que la IA cometa fraude o altere por ejemplo, unas elecciones.

En el peor de los casos, advirtieron sobre una IA superinteligente que podría perseguir conseguir el poder y el control sobre la sociedad, lo que llevaría a la pérdida de decisiones humanas o incluso a la extinción si sus "objetivos misteriosos" se alinearan con estos resultados.

Para mitigar los riesgos, el equipo propone varias medidas: leyes de "bot o no" que exigen a las empresas revelar interacciones humanas o de IA, marcas de agua digitales para el contenido generado por la nueva tecnología y el desarrollo de mecanismos para detectar el engaño potencial examinando sus "procesos de pensamiento" internos "contra acciones externas.

A aquellos que lo llaman pesimista, Park les responde: "La única forma en que podemos pensar razonablemente que esto no es gran cosa es si pensamos que las capacidades engañosas de la IA se mantendrán en los niveles actuales y no se desarrollarán más sustancialmente".

V.Sedlak--TPP