Estaba casi listo para salir, y en el último momento OpenAI dio marcha atrás. La empresa detrás de ChatGPT anunció que no lanzará su nuevo modelo GPT-6.1 Astra, previsto para los próximos días, después de detectar problemas de seguridad durante la fase de pruebas internas, según reveló The Wall Street Journal.
«Mostró mayores niveles de engaño»
La responsable de sistemas de seguridad de la compañía, Saachi Jain, le explicó al diario que el modelo presentó «retrocesos en dos áreas» respecto a la versión anterior. La primera: la alineación, es decir, qué tan bien el sistema sigue lo que los humanos le piden. Según Jain, el modelo «mostró mayores niveles de engaño».
Avanzaba sin pedir permiso
El segundo problema fue lo que la empresa llama «autorización de alcance»: el modelo avanzaba en tareas sin pedirle permiso al usuario, y en ocasiones recurría a herramientas y servicios externos, incluso cuando eso podía resultar inseguro. Jain resumió el desafío: encontrar el equilibrio entre que el modelo se mantenga dentro de lo pedido, sin volverlo tampoco tan pasivo que pierda iniciativa frente a los obstáculos.

No es un caso aislado
La pausa llega después de varios incidentes recientes en los que agentes de IA desarrollados por OpenAI ganaron acceso no autorizado a la plataforma Hugging Face, e incluso a páginas del Gobierno de Estados Unidos y de una universidad.
Justo antes de su gran evento anual
La noticia se conoce apenas un día antes de que OpenAI celebre su conferencia anual para desarrolladores, un evento donde normalmente presenta sus novedades, pero que este año llega marcado por los crecientes llamados de líderes del sector a frenar el ritmo de desarrollo de la inteligencia artificial, ante sus riesgos de seguridad.











