Modelos de IA superan pruebas de seguridad y generan alerta global
Modelos de IA de OpenAI, Anthropic y Meta han escapado de pruebas, accedido a internet y realizado acciones no autorizadas, generando alerta global y presión para regular su desarrollo.
Miguel Ángel Pérez
Editor de Economía

Gobiernos y empresas de todo el mundo están en alerta tras confirmarse que varios modelos avanzados de inteligencia artificial han logrado escapar de entornos de prueba controlados, acceder a internet y realizar acciones no autorizadas, incluyendo intentos de infiltración en sistemas reales.
El primer caso fue revelado por OpenAI el 21 de julio, cuando admitió que dos de sus modelos —GPT-5.6 Sol y un modelo aún más avanzado en fase de prelanzamiento — habían salido de un entorno de pruebas aislado, accedido a internet y tratado de hacer trampa en una prueba de ciberseguridad llamada ExploitGym, al intentar jaquear la plataforma Hugging Face. Aunque la empresa aseguró que las pruebas se realizaron en un entorno altamente restringido, los modelos lograron conectarse a la red.
OpenAI informó posteriormente, el 4 de agosto, de otros dos incidentes similares involucrando modelos evaluados por socios externos que también lograron superar los límites previstos y acceder a internet. Ante estos eventos, la compañía anunció la suspensión del desarrollo de su modelo Astra tras determinar que había alcanzado un nivel «crítico» en ciberseguridad, capaz de identificar y explotar vulnerabilidades de forma autónoma.
Otra empresa líder en IA, Anthropic, reveló a finales de julio que tres de sus modelos de la familia Claude — Opus 4.7, Mythos 5 y un modelo interno de prueba — habían accedido a internet durante pruebas realizadas con socios externos en abril. Aunque se les había indicado que actuaran en un entorno simulado sin acceso a la red, un malentendido técnico permitió que los modelos interactuaran con sistemas reales. Tras revisar más de 146.000 operaciones, Anthropic confirmó tres incidentes de este tipo.
Por su parte, Meta confirmó esta semana que uno de sus modelos de IA había jaqueado los sistemas de otra empresa durante una prueba de ciberseguridad realizada con un socio externo, sumándose a la lista de incidentes reportados.
El Instituto de Seguridad de la IA (AISI) del Reino Unido respaldó estas preocupaciones tras realizar 122 pruebas con siete modelos de IA, detectando 19 acciones que excedieron los parámetros establecidos. Diecisiete de estas estaban vinculadas al modelo Mythos 5 de Anthropic y dos al GPT-5.6 Sol de OpenAI. Entre los comportamientos observados, los modelos intentaron crear perfiles humanos falsos para engañar a personas durante un ciberataque simulado, aunque el AISI señaló que estos intentos no tuvieron éxito.
Ante este escenario, descrito por expertos como un «punto de inflexión» para la IA, la Casa Blanca se reunió esta semana con representantes del sector tecnológico para diseñar un marco regulatorio que permita evaluar los modelos avanzados antes de su lanzamiento comercial. Según Axios, se espera que las empresas tecnológicas deban proporcionar acceso anticipado a ciertos modelos a la administración estadounidense para su revisión.
Estos eventos marcan un antes y un después en la percepción de los riesgos asociados al desarrollo acelerado de la inteligencia artificial, particularmente en lo relacionado con su potencial para evadir controles de seguridad y actuar de forma autónoma en entornos reales.
Compartir artículo
Miguel Ángel Pérez
Editor de Economía
Economista y periodista financiero. Ex analista del Banco Central de la República Dominicana. Especialista en mercados y finanzas internacionales.
Te puede interesar
Más noticias de news

Torneo Internacional de Boliche SBC 2024 rendirá homenaje a Alex Prats
El SBC celebra el XX Torneo Internacional de Boliche del 17 al 23 de este mes, dedicado a Alex Prats, medallista de bronce en JC 2026, quien realizará el saque de honor en la apertura.
Abinader lanza Pronamec para modernizar agricultura dominicana y reducir dependencia de mano de obra extranjera
El presidente Abinader lanza el Pronamec, un programa de RD$200 millones para mecanizar la agricultura dominicana, aumentar productividad y reducir dependencia de mano de obra extranjera.

EE. UU. presenta nueva acusación contra sospechoso de incendio mortal en Los Ángeles
EE. UU. presenta nueva acusación federal contra sospechoso de provocar incendio mortal en Los Ángeles que causó múltiples víctimas y daños materiales.
Alcalde de Lawrence liberado bajo fianza tras arresto por fraude en préstamos pandémicos
El alcalde de Lawrence, Brian DePeña, fue liberado bajo fianza tras su arresto por fraude en préstamos pandémicos, acusado de desviar más de 1.5 millones de dólares para uso personal y de campaña.