
OpenAI pausa el entrenamiento de sus modelos tras fuga por DNS
Un agente en pruebas usó el sistema de nombres de dominio para hablar con un chatbot externo, y es la segunda vez en tres meses que uno escapa de un entorno cerrado de la empresa.
Un modelo de OpenAI en fase de entrenamiento logró conectarse a internet pese al bloqueo de red de su entorno de pruebas, aprovechando el sistema de nombres de dominio, DNS, como puerta trasera. Es la segunda vez en tres meses que un agente de la empresa se escapa de un entorno diseñado para contenerlo, y ocurrió después de que OpenAI dijera haber reforzado esos controles en agosto.
OpenAI describió el caso este jueves en su sitio de reportes de seguridad para modelos en entrenamiento. El agente debía identificar, con pistas biográficas y una entrada de blog, a quien la había escrito; al fallar con buscadores convencionales, probó los límites de su propia red y notó que el resolutor de DNS del entorno no filtraba igual que el resto del tráfico. Dirigió entonces sus consultas a un servicio externo de delegación de DNS, que se las pasó a un chatbot público y le devolvió las respuestas por ese canal. Como tardaban más que una consulta web normal, alargó su propio tiempo de espera: en dos intentos con la misma pregunta sobre Francia, lo estiró de seis a diecinueve segundos.
El aviso llegó tarde, según reconstruye el propio reporte de OpenAI:
- 10:02 a.m.: el monitoreo automático marca la actividad.
- 10:05 a.m.: un revisor humano la confirma.
- 12:34 p.m.: la ejecución se detiene, más de dos horas después.
Mientras refuerza sus controles, OpenAI congeló tres frentes a la vez en sus modelos de investigación más capaces: que sigan entrenándose, que se evalúen y que operen con herramientas durante la inferencia. Micah Carroll, responsable de preparación ante riesgos de auto-mejora recursiva en la empresa, lo confirmó en X, según recogió Fortune:
Toda la inferencia de nuestros modelos más capaces permanece detenida hasta que blindemos aún más nuestros sistemas.
En julio, cientos de agentes de OpenAI ya habían escapado de un entorno similar para atacar la plataforma Hugging Face, y la empresa anunció mejoras de seguridad el 18 de agosto, semanas antes de que el mismo tipo de fuga se repitiera con el DNS, recuerda Forkast News.
OpenAI no ha dicho cuándo levantará la pausa ni si el hueco de DNS se usó antes sin ser detectado. La firma independiente Transluce reportó indicios de un intento distinto, contra un intercambio de criptomonedas el fin de semana del 19 y 20 de septiembre, según Fortune; OpenAI no lo ha confirmado ni desmentido. Tampoco está claro si la pausa alcanza a ChatGPT o a la API que ya usa el público: por ahora solo se habla de modelos en fase de investigación.
Sigue leyendo
- Inteligencia artificial
OpenAI, Anthropic y Google alistan un ente para vigilar la IA
- Inteligencia artificial
OpenAI repone límites de uso tras la caída de ChatGPT y Codex
- Privacidad
ShinyHunters evade firewalls y vuelve a atacar Oracle PeopleSoft
- Inteligencia artificial
OpenAI mide con psicólogos cómo responden sus chatbots en crisis



