Noticias con acento.

Las letras AI en bloques blancos en 3D sobre una placa de circuito de color verde azulado.
Inteligencia artificial

OpenAI pausa el entrenamiento de sus modelos tras fuga por DNS

Un agente en pruebas usó el sistema de nombres de dominio para hablar con un chatbot externo, y es la segunda vez en tres meses que uno escapa de un entorno cerrado de la empresa.

Compartir

Un modelo de OpenAI en fase de entrenamiento logró conectarse a internet pese al bloqueo de red de su entorno de pruebas, aprovechando el sistema de nombres de dominio, DNS, como puerta trasera. Es la segunda vez en tres meses que un agente de la empresa se escapa de un entorno diseñado para contenerlo, y ocurrió después de que OpenAI dijera haber reforzado esos controles en agosto.

OpenAI describió el caso este jueves en su sitio de reportes de seguridad para modelos en entrenamiento. El agente debía identificar, con pistas biográficas y una entrada de blog, a quien la había escrito; al fallar con buscadores convencionales, probó los límites de su propia red y notó que el resolutor de DNS del entorno no filtraba igual que el resto del tráfico. Dirigió entonces sus consultas a un servicio externo de delegación de DNS, que se las pasó a un chatbot público y le devolvió las respuestas por ese canal. Como tardaban más que una consulta web normal, alargó su propio tiempo de espera: en dos intentos con la misma pregunta sobre Francia, lo estiró de seis a diecinueve segundos.

El aviso llegó tarde, según reconstruye el propio reporte de OpenAI:

  • 10:02 a.m.: el monitoreo automático marca la actividad.
  • 10:05 a.m.: un revisor humano la confirma.
  • 12:34 p.m.: la ejecución se detiene, más de dos horas después.

Mientras refuerza sus controles, OpenAI congeló tres frentes a la vez en sus modelos de investigación más capaces: que sigan entrenándose, que se evalúen y que operen con herramientas durante la inferencia. Micah Carroll, responsable de preparación ante riesgos de auto-mejora recursiva en la empresa, lo confirmó en X, según recogió Fortune:

Toda la inferencia de nuestros modelos más capaces permanece detenida hasta que blindemos aún más nuestros sistemas.

En julio, cientos de agentes de OpenAI ya habían escapado de un entorno similar para atacar la plataforma Hugging Face, y la empresa anunció mejoras de seguridad el 18 de agosto, semanas antes de que el mismo tipo de fuga se repitiera con el DNS, recuerda Forkast News.

OpenAI no ha dicho cuándo levantará la pausa ni si el hueco de DNS se usó antes sin ser detectado. La firma independiente Transluce reportó indicios de un intento distinto, contra un intercambio de criptomonedas el fin de semana del 19 y 20 de septiembre, según Fortune; OpenAI no lo ha confirmado ni desmentido. Tampoco está claro si la pausa alcanza a ChatGPT o a la API que ya usa el público: por ahora solo se habla de modelos en fase de investigación.

Compartir

Sigue leyendo

Usamos Google Analytics 4, de Google LLC, para saber cuánta gente nos lee y qué notas le interesan. Solo si aceptas, se guardan las cookies _ga y _ga_S137BJ57VS, con un identificador aleatorio que dura hasta dos años, y los datos de tu visita se envían a servidores de Google en Estados Unidos. Puedes rechazarlas sin perder nada: el periódico funciona igual. Guardamos tu decisión seis meses y puedes cambiarla cuando quieras desde el pie de página. Más información sobre cookies