OpenAI, la empresa detrás de ChatGPT, decidió postergar el lanzamiento de su más reciente modelo de inteligencia artificial, el GPT-6.1 Astra. La medida se tomó tras detectarse serios problemas de seguridad y comportamiento durante las fases de prueba interna del sistema.
OpenAI frena el lanzamiento de su nuevo modelo de IA por fallas de seguridad
El modelo GPT-6.1 Astra mostró "niveles de engaño" y ejecutó acciones sin autorización previa en las pruebas internas de la compañía, que ya investiga incidentes previos.
Según se informó, el nuevo modelo de IA exhibió "mayores niveles de engaño" en comparación con versiones anteriores, dificultando la alineación con las instrucciones humanas. Además, se reportó que en ciertas ocasiones avanzaba en tareas sin solicitar la autorización explícita del usuario, recurriendo incluso a herramientas y servicios externos, lo que generaba potenciales riesgos de seguridad.
La cancelación del GPT-6.1 Astra, que estaba previsto para presentarse en los próximos días, se produce en un contexto de creciente preocupación en la industria tecnológica sobre el ritmo de desarrollo de la inteligencia artificial y sus posibles implicaciones. La decisión llega tras una serie de incidentes de ciberseguridad protagonizados por agentes de IA de OpenAI.
Problemas de control y autonomía
Saachi Jain, jefe de sistemas de seguridad de OpenAI, explicó al medio The Wall Street Journal que el GPT-6.1 Astra presentó "retrocesos en dos áreas" clave respecto a su predecesor. Uno de los inconvenientes radicaba en la "alineación" del modelo con las directivas humanas, mostrando "mayores niveles de engaño".
Otra falla significativa se encontró en la "autorización de alcance", lo que implicaba que el modelo podía ejecutar tareas sin pedir permiso y, en ocasiones, utilizaba herramientas o servicios externos de manera insegura. Jain señaló la complejidad de "encontrar el equilibrio adecuado entre mantenerse dentro del alcance, pero también evitar la falta de iniciativa" en el desempeño del modelo ante obstáculos.
Evaluación de incidentes y revisión de protocolos
La decisión de OpenAI también se enmarca en una serie de incidentes recientes donde agentes de IA desarrollados por la compañía accedieron de forma no autorizada a plataformas como Hugging Face y a sitios web gubernamentales. Estos sucesos han intensificado el debate sobre la necesidad de frenar el desarrollo de la IA y establecer salvaguardas más robustas.
La compañía está revisando exhaustivamente los registros generados por sus sistemas para determinar las causas exactas de estos comportamientos inesperados. La pausa temporal en el entrenamiento de sus modelos más avanzados y la investigación en curso subrayan los desafíos para supervisar tecnologías cada vez más potentes y autónomas.
Dejá tu comentario

