OpenAI no lanzará su nuevo modelo de inteligencia artificial: detectaron problemas de seguridad en la fase de prueba

OpenAI, la compañía responsable de ChatGPT, anunció que no lanzará su nuevo modelo de inteligencia artificial, GPT-6.1 Astra, cuyo estreno estaba previsto para los próximos días, debido a problemas de seguridad detectados durante la fase de pruebas internas. Según uno de los responsables de la empresa, el nuevo modelo presentó «mayores niveles de engaño».

OpenAI no lanzará su nuevo modelo de inteligencia artificial: detectaron problemas de seguridad en la fase de prueba

La información fue proporcionada por Saachi Jain, jefe del sistema de seguridad de OpenAI, quien en una entrevista con The Wall Street Journal explicó que el modelo sufrió «retrocesos en dos áreas» en comparación con la versión anterior.

El primer problema estuvo relacionado con la «alineación» del modelo con las instrucciones humanas. Jain señaló que la aplicación mostró un aumento en conductas engañosas respecto a versiones previas.

El segundo inconveniente se refería a la «autorización de alcance», es decir, que el modelo avanzaba en una tarea sin solicitar permiso al usuario y, en ocasiones, utilizaba herramientas y servicios externos que podían implicar riesgos de seguridad.

En este sentido, Jain destacó la dificultad de «encontrar el equilibrio adecuado entre mantenerse dentro del alcance y, al mismo tiempo, evitar la falta de iniciativa en la manera en que el modelo lleva a cabo las tareas, incluso cuando enfrenta obstáculos».

OpenAI tiene programada su conferencia anual de desarrolladores para este martes. Aunque habitualmente en estos eventos se presentan novedades, la reunión de este año estará marcada por las crecientes demandas de líderes del sector para desacelerar el desarrollo de esta tecnología debido a sus riesgos en materia de seguridad.

Este anuncio se produce después de varias incidencias de ciberseguridad relacionadas con agentes de inteligencia artificial desarrollados por OpenAI, que lograron acceder sin autorización a la plataforma Hugging Face, así como a sitios web del gobierno de Estados Unidos y de una universidad.

Con información de EFE.

Acerca de Limite 42 Noticias

Limite 42 Paralelo de Noticias | Diario Digital de El Bolsón – Río Negro – Patagonia Argentina | PERIODISMO INDEPENDIENTE DIRECTOR: Ángel Daniel Morales

Compruebe también

AMD adquiere World Labs, fundada por la «madrina» de la IA Fei-Fei Li

AMD adquiere World Labs, fundada por la «madrina» de la IA Fei-Fei Li

El fabricante de semiconductores Advanced Micro Devices (AMD) anunció el lunes la adquisición de World …

Hackeos autónomos a webs del gobierno de EE.UU. llevan a OpenAI a suspender el entrenamiento de sus agentes de Inteligencia Artificial

Hackeos autónomos a webs del gobierno de EE.UU. llevan a OpenAI a suspender el entrenamiento de sus agentes de Inteligencia Artificial

OpenAI decidió pausar el entrenamiento de sus modelos más recientes de inteligencia artificial ante la …

Dejanos tu comentario