The Prague Post - Incidente de OpenAI: ¿La IA se ha vuelto demasiado poderosa para ser controlada?

EUR -
AED 4.248121
AFN 75.768221
ALL 92.763067
AMD 422.722836
ANG 2.070312
AOA 1061.886388
ARS 1723.582978
AUD 1.637745
AWG 2.083576
AZN 1.957325
BAM 1.955443
BBD 2.326975
BDT 141.824111
BGN 1.962252
BHD 0.43572
BIF 3453.969514
BMD 1.156739
BND 1.47783
BOB 13.465542
BRL 6.040957
BSD 1.155389
BTN 110.192885
BWP 15.565159
BYN 3.514159
BYR 22672.08145
BZD 2.323676
CAD 1.605611
CDF 2629.267027
CHF 0.941195
CLF 0.026851
CLP 1056.797093
CNY 7.800122
CNH 7.801648
COP 3603.842156
CRC 519.805115
CUC 1.156739
CUP 30.65358
CVE 110.244876
CZK 24.210888
DJF 205.742444
DKK 7.473222
DOP 67.627655
DZD 152.300199
EGP 58.091696
ERN 17.351083
ETB 186.898684
FJD 2.584385
FKP 0.854872
GBP 0.855165
GEL 3.019414
GGP 0.854872
GHS 12.651691
GIP 0.854872
GMD 85.019022
GNF 10149.14738
GTQ 8.815391
GYD 241.675885
HKD 9.076586
HNL 30.972346
HRK 7.533034
HTG 151.122414
HUF 363.01915
IDR 20622.455882
ILS 3.418275
IMP 0.854872
INR 110.411295
IQD 1513.523722
IRR 1590038.761368
ISK 142.149117
JEP 0.854872
JMD 182.966601
JOD 0.820153
JPY 184.273091
KES 149.332741
KGS 101.156547
KHR 4675.146601
KMF 493.927398
KPW 1041.065304
KRW 1638.647715
KWD 0.357062
KYD 0.962824
KZT 536.112138
LAK 26076.240056
LBP 103462.813951
LKR 384.459821
LRD 209.701721
LSL 18.691288
LTL 3.415549
LVL 0.6997
LYD 7.356657
MAD 10.716044
MDL 20.034343
MGA 4974.092032
MKD 61.513771
MMK 2428.91053
MNT 4159.644874
MOP 9.338495
MRU 46.39953
MUR 54.55675
MVR 17.871782
MWK 2003.434294
MXN 19.676318
MYR 4.726322
MZN 73.927232
NAD 18.691288
NGN 1572.66743
NIO 42.522238
NOK 10.92262
NPR 176.308817
NZD 1.940024
OMR 0.441009
PAB 1.155389
PEN 3.896889
PGK 5.190053
PHP 71.098928
PKR 320.902423
PLN 4.30625
PYG 6934.734137
QAR 4.211831
RON 5.236212
RSD 117.318585
RUB 97.162264
RWF 1698.989867
SAR 4.337808
SBD 9.310109
SCR 15.912095
SDG 694.622044
SEK 11.020251
SGD 1.480283
SHP 0.856988
SLE 28.344406
SLL 24256.23441
SOS 660.279473
SRD 43.926585
STD 23942.158738
STN 24.495529
SVC 10.109155
SYP 15039.918412
SZL 18.688589
THB 38.337771
TJS 10.669752
TMT 4.060153
TND 3.387482
TOP 2.78515
TRY 55.370194
TTD 7.827571
TWD 37.040628
TZS 3061.741111
UAH 51.685265
UGX 4292.216501
USD 1.156739
UYU 46.29155
UZS 13754.489263
VES 890.815114
VND 30246.985806
VUV 136.42623
WST 3.163091
XAF 655.837284
XAG 0.017878
XAU 0.000264
XCD 3.126144
XCG 2.08222
XDR 0.817874
XOF 655.837284
XPF 119.331742
YER 274.374004
ZAR 18.657984
ZMK 10412.034601
ZMW 21.836014
ZWL 372.469438
Incidente de OpenAI: ¿La IA se ha vuelto demasiado poderosa para ser controlada?
Incidente de OpenAI: ¿La IA se ha vuelto demasiado poderosa para ser controlada? / Foto: Sébastien Bozon - AFP/Archivos

Incidente de OpenAI: ¿La IA se ha vuelto demasiado poderosa para ser controlada?

El ciberataque perpetrado de manera autónoma por dos agentes de inteligencia artificial de OpenAI ha planteado dudas sobre cómo se controlarán los modelos de IA más poderosos.

Tamaño del texto:

El test de OpenAI, en un ambiente cerrado, buscaba evaluar las habilidades de su modelo "más avanzado", GPT-5.6 Sol, y su sucesor, aún sin comercializar, una evaluación que la startup estadounidense suele aplicar a sus IA.

Lograron conectarse a internet y lanzaron un ataque a la plataforma Hugging Face, un repositorio de modelos IA.

"Entendían que OpenAI no quería que salieran de su entorno de pruebas y hackearan a otra compañía, pero igual lo hicieron", dijo Jeffrey Ladish, director de Palisade Research, una organización independiente que evalúa los nuevos modelos en términos de ciberseguridad.

"Casi parecía que lo hicieron antes incluso de tener un plan de qué hacer con el acceso a internet", según Ladish.

En marzo, un grupo de desarrolladores afiliados a la empresa china Alibaba descubrió que uno de sus modelos intentaba, por su cuenta, crear una criptomoneda después de conectarse sin autorización a un servidor externo.

Y en abril, Sam Bowman, responsable de seguridad en Anthropic, recibió un correo del modelo Mythos, que estaba siendo probado. Le informó que estaba navegando internet pese a, inicialmente, estar aislado.

Los modelos, advirtió Ladish, "buscan libertad para cumplir con sus objetivos de manera más efectiva. Y eso da mucho miedo".

- "Será más difícil supervisarla" -

El informe de eventos publicado por OpenAI sugiere que la startup no detectó la situación lo bastante pronto como para solucionarla en tiempo real o prevenir a Hugging Face. Consultada al respecto por la AFP, la empresa no respondió.

Desde los hackeos, OpenAI dijo que "implementó protecciones más fuertes" para sus próximas evaluaciones.

Para Gang Wang, profesor de ciencias de la computación en la Universidad de Illinois, todavía es posible prevenir que un modelo se conecte al internet al cortar físicamente el acceso.

El problema, dijo, es que "las personas subestiman a la IA".

Asegurar el ambiente "es algo a lo que debemos prestar más atención (...) como se hace con los accidentes de laboratorio" que liberan virus o bacterias, advirtió Andrew Lohn, del Centro de Seguridad y Tecnologías Emergentes de la Universidad de Georgetown.

Pero para Dan Lahav, director ejecutivo de Irregular -una empresa de ciberseguridad dedicada a la IA de vanguardia-, realizar simulaciones en un entorno completamente aislado "es un desafío de investigación muy difícil".

"Es posible aplicar medidas de mitigación, pero debido a cómo está construida la tecnología, cuanto más se intenta darle libertad y autonomía para realizar tareas más sofisticadas, será más difícil supervisarla", explicó Lahav sobre las salvaguardas en las pruebas.

El incidente de OpenAI sin duda impulsará el actual debate en el gobierno de Estados Unidos sobre si verificar los modelos más avanzados de la IA antes de su lanzamiento.

El gobierno de Donald Trump obligó a Anthropic a suspender dos de sus modelos y a OpenAI a que sus desarrollos sean probados antes de comercializarlos.

El jueves, dos congresistas estadounidenses, uno republicano y uno demócrata, presentaron un proyecto de ley que obligaría a los gigantes de la IA a disponer de un "interruptor de apagado" ("kill switch") que permita desactivar sus sistemas si presentan un riesgo grave.

P.Benes--TPP