OpenAI, la compañía responsable de ChatGPT, anunció que no lanzará su nuevo modelo de inteligencia artificial, GPT-6.1 Astra, cuyo estreno estaba previsto para los próximos días, debido a problemas de seguridad detectados durante la fase de pruebas internas. Según uno de los responsables de la empresa, el nuevo modelo presentó «mayores niveles de engaño».

La información fue proporcionada por Saachi Jain, jefe del sistema de seguridad de OpenAI, quien en una entrevista con The Wall Street Journal explicó que el modelo sufrió «retrocesos en dos áreas» en comparación con la versión anterior.
El primer problema estuvo relacionado con la «alineación» del modelo con las instrucciones humanas. Jain señaló que la aplicación mostró un aumento en conductas engañosas respecto a versiones previas.
El segundo inconveniente se refería a la «autorización de alcance», es decir, que el modelo avanzaba en una tarea sin solicitar permiso al usuario y, en ocasiones, utilizaba herramientas y servicios externos que podían implicar riesgos de seguridad.
En este sentido, Jain destacó la dificultad de «encontrar el equilibrio adecuado entre mantenerse dentro del alcance y, al mismo tiempo, evitar la falta de iniciativa en la manera en que el modelo lleva a cabo las tareas, incluso cuando enfrenta obstáculos».
OpenAI tiene programada su conferencia anual de desarrolladores para este martes. Aunque habitualmente en estos eventos se presentan novedades, la reunión de este año estará marcada por las crecientes demandas de líderes del sector para desacelerar el desarrollo de esta tecnología debido a sus riesgos en materia de seguridad.
Este anuncio se produce después de varias incidencias de ciberseguridad relacionadas con agentes de inteligencia artificial desarrollados por OpenAI, que lograron acceder sin autorización a la plataforma Hugging Face, así como a sitios web del gobierno de Estados Unidos y de una universidad.
Con información de EFE.
CADENA RITMO 101.1 NQN SITIO OFICIAL
