OpenAI no lanzará su nuevo modelo de inteligencia artificial: detectaron problemas de seguridad en la fase de prueba

COMPARTIR NOTICIA

OpenAI, la compañía responsable de ChatGPT, anunció que no lanzará su nuevo modelo de inteligencia artificial, GPT-6.1 Astra, cuyo estreno estaba previsto para los próximos días, debido a problemas de seguridad detectados durante la fase de pruebas internas. Según uno de los responsables de la empresa, el nuevo modelo presentó «mayores niveles de engaño».

openai-no-lanzara-su-nuevo-modelo-de-inteligencia-artificial:-detectaron-problemas-de-seguridad-en-la-fase-de-prueba

La información fue proporcionada por Saachi Jain, jefe del sistema de seguridad de OpenAI, quien en una entrevista con The Wall Street Journal explicó que el modelo sufrió «retrocesos en dos áreas» en comparación con la versión anterior.

El primer problema estuvo relacionado con la «alineación» del modelo con las instrucciones humanas. Jain señaló que la aplicación mostró un aumento en conductas engañosas respecto a versiones previas.

El segundo inconveniente se refería a la «autorización de alcance», es decir, que el modelo avanzaba en una tarea sin solicitar permiso al usuario y, en ocasiones, utilizaba herramientas y servicios externos que podían implicar riesgos de seguridad.

En este sentido, Jain destacó la dificultad de «encontrar el equilibrio adecuado entre mantenerse dentro del alcance y, al mismo tiempo, evitar la falta de iniciativa en la manera en que el modelo lleva a cabo las tareas, incluso cuando enfrenta obstáculos».

OpenAI tiene programada su conferencia anual de desarrolladores para este martes. Aunque habitualmente en estos eventos se presentan novedades, la reunión de este año estará marcada por las crecientes demandas de líderes del sector para desacelerar el desarrollo de esta tecnología debido a sus riesgos en materia de seguridad.

Este anuncio se produce después de varias incidencias de ciberseguridad relacionadas con agentes de inteligencia artificial desarrollados por OpenAI, que lograron acceder sin autorización a la plataforma Hugging Face, así como a sitios web del gobierno de Estados Unidos y de una universidad.

Con información de EFE.


COMPARTIR NOTICIA

Compruebe también

Descubrió cómo hackear al asistente de Meta y advierte: “Encontramos fallas en otros agentes de IA”

Descubrió cómo hackear al asistente de Meta y advierte: “Encontramos fallas en otros agentes de IA”

COMPARTIR NOTICIALos nuevos agentes de inteligencia artificial prometen asumir tareas complejas como organizar archivos, completar …

Déjanos tu comentario