OpenAI, la startup que se encuentra detrás de ChatGPT, anunció que no hará el lanzamiento de su nuevo modelo de inteligencia artificial, GPT-6.1 Astra, que estaba previsto en los próximos días, debido a problemas de seguridad durante la fase de pruebas interna. Según detalló uno de los responsables de la empresa, el nuevo modelo «mostró mayores niveles de engaño».
La noticia la dio Saachi Jain, el jefe de sistema de seguridad, quien en diálogo con The Wall Street Journal señaló que el nuevo modelo presentó «retrocesos en dos áreas» respecto a la versión previa.
El primero de esos inconvenientes estaba relacionado con la «alineación» de la inteligencia artificial con las órdenes humanas. Según sostuvo Jain, la aplicación «mostró mayores niveles de engaño» respecto de sus versiones previas.
Según indicó el responsable de seguridad, otra área problemática fue la «autorización de alcance», es decir, que el modelo avanzaba en una tarea sin pedir permiso al usuario y, en ocasiones, recurría a herramientas y servicios externos incluso si ello podía resultar inseguro.
Al respecto, Jain destacó el desafío que implica «encontrar el equilibrio adecuado entre mantenerse dentro del alcance, pero también evitar la falta de iniciativa en la manera en que el modelo lleva a cabo las tareas, incluso cuando encuentra obstáculos».
OpenAI tiene previsto celebrar su conferencia anual de desarrolladores este martes. Aunque durante estos encuentros la empresa suele presentar sus novedades, la reunión de este año estará marcada por las crecientes llamadas de los líderes del sector a frenar el ritmo de desarrollo de esta tecnología por sus riesgos para la seguridad.
La noticia llega tras varias incidencias de ciberseguridad de agentes de IA desarrollados por OpenAI, que ganaron acceso no autorizado a la plataforma Hugging Face e incluso a páginas del Gobierno de Estados Unidos y de una universidad.
Con información de EFE
BPO