OpenAI ha decidido no lanzar su nuevo modelo de IA, GPT-6.1 Astra, citando preocupaciones de seguridad. La compañía confirmó el martes que el sistema —que navega de forma autónoma por la web y utiliza aplicaciones— "no alcanzó del todo el listón" de sus estándares, según Saachi Jain, jefa de sistemas de seguridad de OpenAI.

La noticia llega junto con una actualización sobre incidentes de junio, hechos públicos solo la semana pasada, en los que modelos de OpenAI accedieron a sitios web y sistemas del gobierno australiano sin autorización. Esas brechas, y otras similares de otras grandes empresas de IA, han intensificado el debate sobre los riesgos de la tecnología. En las últimas semanas, destacados líderes del sector —incluidos Sam Altman, de OpenAI, y el jefe de Anthropic, Dario Amodei— han instado a la industria a frenar el desarrollo debido a preocupaciones de seguridad.

La decisión de OpenAI, reportada por primera vez por The Wall Street Journal, es un caso poco frecuente de un gran desarrollador de IA que retira un nuevo lanzamiento por preocupaciones de seguridad. El último modelo se quedó corto en "mantenerse dentro del alcance y la autorización, y en cómo se comunica con el usuario sobre el tipo de trabajo que ha realizado", dijo Jain. "Queremos asegurarnos de que el desarrollo de nuestros modelos sea seguro, ya sea dentro de la empresa o cuando lo entregamos a los usuarios. Pero cuando lo entregamos a los usuarios, tenemos un listón extremadamente alto en términos de seguridad y alineación", añadió.

El modelo agéntico insignia GPT-6 Astra se lanzó en septiembre y se especializa en razonamiento complejo y ejecución autónoma de tareas. OpenAI dijo que fue el resultado de "años de investigación y grandes apuestas". El anuncio se produjo un día antes de la conferencia anual DevDay de desarrolladores de OpenAI en San Francisco, donde se espera que haga varios anuncios. No está claro si una nueva versión de Astra estará entre ellos.

Los controles de seguridad de la compañía han quedado bajo intenso escrutinio tras varios incidentes de alto perfil. La semana pasada, el primer ministro australiano, Anthony Albanese, anunció que un agente descontrolado de OpenAI había hackeado sitios web y sistemas gubernamentales en junio —lo que los expertos dijeron fue el primer caso conocido de este tipo en el mundo. Albanese criticó a OpenAI por notificar al gobierno australiano a través de una dirección de correo electrónico genérica en lugar de un contacto directo. OpenAI dijo en un comunicado el martes que lamentaba el incidente y que "debería haber gestionado mejor nuestra respuesta".

Services Australia, la Oficina de Estadísticas e Investigación Criminal de Nueva Gales del Sur, el Departamento de Salud de Victoria y el Instituto Australiano de Salud y Bienestar se vieron afectados, aclaró OpenAI. La empresa dijo que lanzó investigaciones tan pronto como tuvo conocimiento a mediados de agosto y notificó a las organizaciones afectadas entre el 10 y el 24 de septiembre. "Nuestro objetivo era dar a las agencias afectadas un relato detallado una vez que nuestra investigación estuviera completa", dijo OpenAI, y añadió que debería haber compartido los hallazgos preliminares con mayor prontitud y haber mantenido informadas a las autoridades australianas.

OpenAI añadió que desarrollará "enfoques prácticos" para que los desarrolladores y los gobiernos identifiquen y divulguen futuros incidentes de IA. La compañía financiará medidas de ciberseguridad, ofrecerá apoyo dedicado a las agencias afectadas y creará un grupo de trabajo para gestionar los riesgos de agentes de IA cada vez más avanzados. También dijo que un alto ejecutivo de OpenAI estará en Australia para asistir a una audiencia del Comité Selecto Conjunto sobre IA el 6 de octubre.

En julio, OpenAI dijo que sus sistemas de IA habían accedido a internet y hackeado el centro de desarrolladores de código abierto Hugging Face, lo que llevó a investigadores y funcionarios a pedir controles más estrictos. El lunes, el gigante de chips de IA Nvidia lanzó un conjunto de herramientas de seguridad de software para plataformas de IA autónomas —llamadas agentes— que, según dijo, podrían haber evitado el hackeo de Hugging Face. Una de las nuevas herramientas utiliza funciones de hardware en los chips de Nvidia para contener a los agentes. El jefe de Nvidia, Jensen Huang, ha desestimado en gran medida los llamados a regulaciones de IA más estrictas, argumentando que los agentes descontrolados son un problema de ingeniería que puede resolverse. Nvidia acordó comprar Hugging Face por 12.900 millones de dólares (9.740 millones de libras) a principios de este mes.

El papa León XIV dijo el lunes durante su vi