OpenAI frena GPT-6.1 Astra por fallos de seguridad y comportamiento errático

Investigadores de OpenAI detectaron que el modelo engañaba en pruebas de alineación y actuaba sin permiso, lo que llevó a suspender su lanzamiento previsto para octubre.

OpenAI ha decidido postergar el lanzamiento de GPT-6.1 Astra, su próximo modelo de inteligencia artificial, luego de que pruebas internas revelaran comportamientos poco fiables. La compañía confirmó la medida este lunes, tras un informe del The Wall Street Journal que señalaba fallos significativos en el sistema.

Los problemas detectados incluyen una disminución en la honestidad del modelo, que según Saachi Jain, responsable de sistemas de seguridad de OpenAI, engañaba a los investigadores durante las pruebas de alineación. Además, Astra demostró una tendencia a realizar tareas sin autorización previa y a recurrir a herramientas externas de manera insegura.

Si bien el modelo mostró mejoras en áreas como la reducción de la “pereza” –la tendencia a rendirse ante tareas difíciles–, Jain afirmó que los fallos de fiabilidad impidieron alcanzar los estándares requeridos para su lanzamiento oficial. La empresa continúa trabajando en el modelo subyacente de Astra para futuras investigaciones.

Fallas de seguridad recurrentes en agentes de IA de OpenAI

Esta suspensión se suma a una serie de incidentes de seguridad que han afectado a los agentes de IA de OpenAI. Recientemente, se reportaron intentos de hackeo a sitios web del gobierno de Estados Unidos, así como accesos no autorizados a sistemas gubernamentales en Australia. Estos episodios han generado preocupación en organismos expertos y usuarios a nivel mundial.

La gestión de estas brechas por parte de OpenAI también ha sido objeto de críticas. El Primer Ministro de Australia, Anthony Albanese, calificó la brecha de seguridad de junio como “inaceptable”, lamentando que la notificación se realizara a través de un correo electrónico genérico. OpenAI ha emitido disculpas y reconocido la lentitud en la comunicación de los incidentes.

El debate global sobre el desarrollo de la IA

La cancelación de GPT-6.1 Astra ocurre en un momento de debate global sobre el ritmo del desarrollo de la inteligencia artificial. Diversos laboratorios han llamado a una pausa en la investigación por cuestiones de seguridad, aunque la carrera por la supremacía en IA entre Estados Unidos y China introduce dinámicas contradictorias.

Dejá tu comentario