OpenAI anunció el 28 de septiembre que no lanzará su modelo de inteligencia artificial más reciente, GPT-6.1 Astra, después de que las pruebas internas indicaran que no cumplía con los estándares de seguridad de la empresa.
Saachi Jain, responsable de sistemas de seguridad de OpenAI, señaló que, si bien GPT-6.1 Astra había mejorado en aspectos como la llamada "pereza del modelo", sus sistemas no alcanzaban el nivel requerido en cuanto a "mantenerse dentro del alcance y la autorización, y en la forma en que comunica al usuario el tipo de trabajo realizado".
"Por supuesto, queremos asegurarnos de que el desarrollo de nuestros modelos sea seguro, tanto dentro de la empresa como cuando los ponemos a disposición de los usuarios. Sin embargo, al lanzarlos a los usuarios, exigimos niveles extremadamente altos de seguridad y alineación", afirmó Jain.
La decisión fue reportada inicialmente por el Wall Street Journal.

No leas más noticias. Entiéndelas.
En Epoch Times Español queremos estar en contacto directo contigo
Seleccionamos para ti lo que de verdad importa, sin ruido ni agendas. Es un canal abierto: si nos escribes, te respondemos.
OpenAI había planeado originalmente lanzar el nuevo modelo en octubre, con la intención de integrarlo en ChatGPT y Codex.
El sitio web de la empresa describía a GPT-6.1 Astra como "el modelo más inteligente y alineado del mundo", diseñado para el uso de computadoras, la navegación web, el trabajo profesional, la ingeniería de software, la ciberseguridad y la ciencia.
The Epoch Times contactó a OpenAI para obtener más detalles, pero no recibió respuesta al momento de la publicación.
Las preocupaciones en torno a la IA aumentan a medida que surgen informes sobre sistemas cada vez más potentes, capaces de resolver problemas que superan la capacidad humana, pero que también podrían volverse incontrolables y plantear nuevos riesgos.
La semana pasada, OpenAI informó que había alertado a instituciones de todo el mundo de que sus agentes de IA podrían haber interferido en sus sitios web. La empresa señaló que algunos de sus modelos eludieron controles de acceso, utilizaron credenciales de inicio de sesión expuestas o interactuaron con sitios web de maneras que afectaron a sistemas externos.
Según la compañía, algunos de los sitios web eran gestionados por gobiernos, universidades, organismos públicos y otras instituciones.
En julio, OpenAI comunicó que sus modelos de IA habían comprometido de forma autónoma una infraestructura operada por la plataforma de IA Hugging Face, tras escapar de un entorno restringido donde se llevaba a cabo una evaluación de ciberseguridad.
OpenAI indicó que detectó la actividad anómala internamente antes de ponerse en contacto con Hugging Face, cuyo equipo de seguridad ya había identificado el comportamiento malicioso del modelo y trabajaba para contenerlo.
"Trabajamos activamente con ellos para continuar investigando el incidente", declaró OpenAI en su momento, expresando su agradecimiento por "la rápida y estrecha colaboración de Hugging Face en la investigación y la solución".
Dario Amodei, director ejecutivo de Anthropic, instó a las empresas de inteligencia artificial a ralentizar el desarrollo de sus modelos más avanzados para ganar tiempo e implementar medidas de seguridad antes de que los sistemas de IA adquieran un poder excesivo. Líderes del sector respaldan el llamado de Amodei, entre ellos Sam Altman, director ejecutivo de OpenAI, y Elon Musk, director ejecutivo de IA en SpaceX.
Bill Pan, Tom Ozimek y Reuters.


















