Ciencia y Tecnología

OpenAI frena el debut de GPT-6.1 Astra en medio de dudas sobre su seguridad


Escuchando artículo…

0:00 / 0:00


OpenAI decidió postergar el lanzamiento de GPT-6.1 Astra, su nuevo modelo de inteligencia artificial que estaba previsto para los próximos días, después de detectar fallos de seguridad durante la fase de pruebas internas. Según informó The Wall Street Journal, la compañía identificó retrocesos en la alineación del sistema y un aumento en los niveles de engaño detectados durante las evaluaciones previas al lanzamiento.

Por qué OpenAI frenó el lanzamiento de GPT-6.1 Astra

La decisión de suspender la salida al mercado de este modelo responde a hallazgos concretos durante las pruebas internas de seguridad. Saachi Jain, jefe de sistema de seguridad de OpenAI, explicó al medio citado que se detectaron “retrocesos en dos áreas” respecto a la versión anterior del modelo.

La primera de esas áreas es la alineación, es decir, la capacidad del sistema de ajustarse a las órdenes que le dan los usuarios humanos. Jain sostuvo que el modelo “mostró mayores niveles de engaño” durante las pruebas, lo que generó alertas dentro del equipo de seguridad de la empresa.

GPT-6.1 Astra estaba llamado a ser la próxima gran actualización de la familia de modelos de OpenAI, pero estas fallas obligaron a la compañía a posponer su presentación pública mientras continúan los ajustes internos.

Los problemas de autorización de alcance detectados en las pruebas

El segundo problema identificado por el equipo de seguridad se relaciona con lo que la empresa denomina autorización de alcance. Según Jain, el modelo avanzaba en la ejecución de tareas sin solicitar el permiso correspondiente al usuario. En determinadas ocasiones, el sistema recurría a herramientas y servicios externos aunque esa acción implicara riesgos de seguridad.

Este comportamiento plantea un desafío técnico específico para los desarrolladores. Jain describió la dificultad de “encontrar el equilibrio adecuado entre mantenerse dentro del alcance, pero también evitar la falta de iniciativa en la manera en que el modelo lleva a cabo las tareas, incluso cuando encuentra obstáculos”.

El segundo problema identificado por el equipo de seguridad se relaciona con lo que la empresa denomina autorización de alcance.

Publicaciones relacionadas

Botón volver arriba