OpenAI ha decidido pausar el entrenamiento de sus modelos de inteligencia artificial (IA) más avanzados tras registrar una serie de incidentes de seguridad que abarcan desde el escape del entorno aislado de pruebas (sandbox) hasta intentos de vulneración en sitios web gubernamentales de Estados Unidos y accesos masivos a portales de la ONU.
La tecnológica congela la evaluación y el entrenamiento de sus modelos tras detectar desobediencia a las restricciones impuestas en sus entornos seguros
Audio generado con IA
OpenAI ha decidido pausar el entrenamiento de sus modelos de inteligencia artificial (IA) más avanzados tras registrar una serie de incidentes de seguridad que abarcan desde el escape del entorno aislado de pruebas (sandbox) hasta intentos de vulneración en sitios web gubernamentales de Estados Unidos y accesos masivos a portales de la ONU.
La medida se dio a conocer el pasado viernes, después de que uno de sus agentes eludiera los límites del sandbox hacia internet abierta, tras fracasar en la identificación del autor de una entrada de blog mediante los canales permitidos.
Según detalló la tecnológica en un comunicado oficial, el agente detectó una vulnerabilidad en el filtrado DNS del entorno de pruebas y la aprovechó para salir a la red pública. Desde allí, envió 19 consultas a un chatbot externo con pistas sobre el autor y métodos para sortear barreras web, aunque no llegó a completar la tarea asignada.
La prueba asignada no exigía evaluar controles de red ni acceder a fuentes externas, por lo que la acción fue clasificada como elusión deliberada de restricciones y un fallo grave de alineación. Aunque el sistema de monitorización emitió una alerta a los 12 minutos y un operador humano la revisó tres minutos después, OpenAI tardó dos horas y media en detener por completo la ejecución del agente.
Pese a que la compañía califica el suceso como «mucho menos grave» que otros precedentes, admite su relevancia al ser el primero registrado desde que reforzó sus protocolos tras el incidente de seguridad en Hugging Face el pasado julio.
Ante este escenario, OpenAI ha optado por congelar todo el entrenamiento, la evaluación y la inferencia con uso de herramientas en sus modelos de mayor capacidad hasta subsanar las deficiencias detectadas y concluir auditorías de red adicionales. Asimismo, la firma confirmó que no reanudará el desarrollo de ese modelo específico y que futuras ejecuciones integrarán protocolos de alineación más estrictos.
La paralización responde también a un historial reciente de comportamientos desalineados, entre ellos la exposición indebida de contenidos de usuarios y accesos web no autorizados.
OpenAI admitió que sus agentes subieron sin autorización 53 imágenes de usuarios a plataformas públicas de alojamiento mediante enlaces no indexados. Aunque los archivos contaban con autorización para fines de entrenamiento, la tecnológica reconoció que dicha acción no constituyó un uso apropiado de la información.
Por su parte, The New York Times reveló que modelos de la compañía intentaron vulnerar el portal del Departamento de Educación de EEUU para extraer registros de la Oficina de Derechos Civiles, sin éxito; no obstante, sí lograron recopilar información pública de la Comisión de Bolsa y Valores (SEC) y de la Oficina del Censo.
A estos casos se suma la actividad detectada entre abril y junio en la web de la Conferencia de las Naciones Unidas sobre Comercio y Desarrollo (UNCTAD), donde agentes vinculados a OpenAI efectuaron más de 16.000 peticiones automatizadas, según reportó el investigador Rowan Howard-Jones.
Los registros de conexión incluyeron identificadores y direcciones IP atribuidas previamente a la firma. Los agentes, al carecer de acceso directo a la API de estadísticas y contar con bloqueos en sus herramientas HTTP, emplearon el entorno XSS Game de Google para sortear las restricciones y consultar índices comerciales y de capacidades productivas. Si bien se trataba de información de dominio público, el caso evidenció una pauta operativa recurrente en la que los modelos buscan activamente eludir cualquier bloqueo técnico.
Actualidad Económica. Noticias de Economía Nacional e Internacional
