The Japan Times - OpenAI reporta hackeo autónomo "sin precedentes" ejecutado por sus agentes de IA

EUR -
AED 4.183845
AFN 72.900796
ALL 91.762516
AMD 414.074598
ANG 2.039348
AOA 1045.665194
ARS 1741.635676
AUD 1.619646
AWG 2.050323
AZN 1.940938
BAM 1.952891
BBD 2.292276
BDT 140.046936
BGN 1.917554
BHD 0.429476
BIF 3413.787943
BMD 1.139068
BND 1.454092
BOB 13.947776
BRL 5.909605
BSD 1.13805
BTN 108.984975
BWP 15.496782
BYN 3.438614
BYR 22325.7403
BZD 2.288981
CAD 1.611384
CDF 2665.420428
CHF 0.943279
CLF 0.027745
CLP 1095.522249
CNY 7.646851
CNH 7.661158
COP 3764.324847
CRC 517.449712
CUC 1.139068
CUP 27.313317
CVE 110.632063
CZK 24.358299
DJF 202.435681
DKK 7.475483
DOP 67.778993
DZD 152.391449
EGP 59.13438
ERN 17.086026
ETB 184.628294
FJD 2.559772
FKP 0.861993
GBP 0.85948
GEL 2.97871
GGP 0.861993
GHS 13.218833
GIP 0.861993
GMD 83.725913
GNF 10009.486524
GTQ 8.691398
GYD 238.124726
HKD 8.934226
HNL 30.546708
HRK 7.533575
HTG 148.944035
HUF 365.202455
IDR 20405.384913
ILS 3.471949
IMP 0.861993
INR 109.142856
IQD 1490.938181
IRR 1565734.922454
ISK 136.984803
JEP 0.861993
JMD 180.051817
JOD 0.807645
JPY 179.147025
KES 147.555356
KGS 99.609484
KHR 4628.28911
KMF 493.217009
KPW 1025.161906
KRW 1543.153328
KWD 0.351563
KYD 0.948379
KZT 504.121503
LAK 25527.985134
LBP 101916.82345
LKR 375.763607
LRD 195.756159
LSL 18.568476
LTL 3.363373
LVL 0.689012
LYD 7.276162
MAD 10.921464
MDL 20.200734
MGA 5024.714304
MKD 61.483833
MMK 2391.472577
MNT 4099.316268
MOP 9.194624
MRU 45.784207
MUR 54.140351
MVR 17.599037
MWK 1973.438569
MXN 20.143343
MYR 4.640683
MZN 72.79829
NAD 18.568476
NGN 1510.837951
NIO 41.879276
NOK 10.830092
NPR 174.376159
NZD 2.011068
OMR 0.439307
PAB 1.13805
PEN 3.863598
PGK 5.070648
PHP 71.01754
PKR 315.35775
PLN 4.37146
PYG 6708.273191
QAR 4.148485
RON 5.27298
RSD 117.171452
RUB 96.123035
RWF 1681.979961
SAR 4.271287
SBD 9.11313
SCR 15.840256
SDG 685.153819
SEK 11.296996
SGD 1.455773
SHP 0.859999
SLE 28.078458
SLL 23885.685201
SOS 650.456856
SRD 42.905863
STD 23576.41575
STN 24.464527
SVC 9.95856
SYP 14810.167401
SZL 18.564083
THB 38.01645
TJS 10.498977
TMT 3.99813
TND 3.369082
TOP 2.742603
TRY 55.748859
TTD 7.740776
TWD 36.141163
TZS 3012.833637
UAH 50.963005
UGX 4457.536696
USD 1.139068
UYU 45.592491
UZS 13469.056382
VES 970.977713
VND 29588.440307
VUV 134.986906
WST 3.150074
XAF 655.957
XAG 0.017716
XAU 0.000265798393
XCD 3.07839
XCG 2.050892
XDR 0.80538
XOF 655.957
XPF 119.331742
YER 269.560946
ZAR 18.558659
ZMK 10252.986409
ZMW 22.200809
ZWL 366.779554
SSP 6507.032816
MXV 2.282681
OpenAI reporta hackeo autónomo "sin precedentes" ejecutado por sus agentes de IA
OpenAI reporta hackeo autónomo "sin precedentes" ejecutado por sus agentes de IA / Foto: MARCO BERTORELLO - AFP

OpenAI reporta hackeo autónomo "sin precedentes" ejecutado por sus agentes de IA

La empresa creadora de ChatGPT, OpenAI, afirmó el martes que sus modelos avanzados de inteligencia artificial se descontrolaron durante una prueba de seguridad y hackearon por su cuenta una popular plataforma para programadores.

Tamaño del texto:

La firma con sede en San Francisco lo calificó como un "incidente cibernético sin precedentes" y dijo que realizará una investigación conjunta con Hugging Face, la biblioteca de código en línea afectada.

Los modelos de IA que sustentan herramientas como los chatbots y generadores de imágenes son conocidos como "agentes" cuando actúan de forma autónoma para realizar tareas en el mundo real.

Con los rápidos avances de esta tecnología, la ciberseguridad se vuelve motivo de preocupación ante el riesgo de que la IA avanzada encuentre puntos débiles en los software antes que los humanos.

OpenAI indicó que el incidente involucró una combinación de modelos, incluyendo su recién lanzado GPT-5.6 Sol "y uno en prelanzamiento" con aún más capacidad.

La empresa intenta evaluar las capacidades de hackeo de sus programas al darles tareas en un espacio digital de pruebas controlado, donde el acceso a internet es limitado por motivos de seguridad.

"Mientras operaban en nuestro entorno de pruebas aislado, nuestros modelos invirtieron una cantidad considerable de potencia de cálculo en buscar una forma de obtener acceso a internet para resolver el problema de evaluación", según una publicación del blog de OpenAI sobre el incidente.

Tras conectarse a internet, los modelos decidieron atacar la plataforma Hugging Face -un gran repositorio de modelos de IA, conjuntos de datos y otra información- para facilitar su búsqueda.

Al buscar "información secreta" que les permitiera manipular la evaluación, el sistema de OpenAI "encadenó múltiples vectores de ataque, incluidos el uso de credenciales robadas".

- Potencial "catastrófico" -

Hussein Abbass, un profesor de informática de la universidad UNSW Canberra, dijo a la AFP que el incidente fue "asombroso en muchos sentidos".

"No solo atacó a Hugging Face. Atacó su sistema interno para explotar sus propias vulnerabilidades", señaló. "Y eso es aterrador".

GPT-5.6 y otros modelos de vanguardia, incluida la serie Mythos de Anthropic, el principal rival de OpenAI, han generado preocupación por su potencial de vulnerar las defensas de ciberseguridad.

Ambas empresas estadounidenses debieron aplazar temporalmente el lanzamiento general de sus tecnologías más recientes debido al temor en Washington de que pudieran facilitar la infiltración de infraestructuras críticas.

La IA avanzada "normalmente está en manos de personas éticas y responsables", sostuvo Abbass, pero "sería catastrófico si llega a las manos de alguien con la intención de causar daño".

La administración del sector de IA es crucial, y "necesitamos un esfuerzo conjunto para manejar esta situación", agregó.

Hugging Face reportó la semana pasada una "intrusión" cibernética, sin mencionar a OpenAI.

"Esto fue diferente de todo lo que hemos manejado antes de una forma importante: fue impulsado de principio a fin por un sistema de agente de IA autónomo, y lo detectamos y analizamos en gran medida con nuestra propia IA", señaló la plataforma.

Clement Delangue, director ejecutivo de Hugging Face, comentó en la red social X que la empresa tenía sospechas de que el ciberataque llegó de un laboratorio de IA líder en el mundo, dada la sofisticación del agente.

"Creemos firmemente que no hubo intención maliciosa de su parte", escribió Delangue en referencia a OpenAI.

"¡Es bastante alucinante que todo esto ocurriera de forma autónoma!", añadió.

K.Yamaguchi--JT