OpenAI frena GPT-6.1 Astra por fallos de seguridad antes de su conferencia en San Francisco

OpenAI cancela el lanzamiento de GPT-6.1 Astra tras detectar peores resultados de seguridad que la versión actual, pese a reducir la “pereza” del modelo.

30 de septiembre de 2026 a las 14:27h
OpenAI frena GPT-6.1 Astra por fallos de seguridad antes de su conferencia en San Francisco
OpenAI frena GPT-6.1 Astra por fallos de seguridad antes de su conferencia en San Francisco

Añadir Mangas Verdes como fuente preferida de Google de forma gratuita.

Mantente informado con las últimas noticias de actualidad.

Activar ahora

OpenAI ha decidido frenar GPT-6.1 Astra en un momento incómodo, justo antes de su conferencia anual para desarrolladores en San Francisco. La razón no tiene que ver con falta de ambición ni con rendimiento bruto, sino con algo más áspero de explicar y más importante de controlar, porque el modelo rindió peor que la versión actual en las evaluaciones de seguridad.

El tropiezo afecta a un sistema que sí había mejorado en un defecto muy concreto. GPT-6.1 Astra redujo la llamada pereza del modelo, es decir, la tendencia a no ejecutar una tarea.

La mejora técnica no bastó cuando falló la disciplina del modelo

Saachi Jain, jefa de sistemas de seguridad de OpenAI, situó el problema en dos frentes muy reconocibles para cualquiera que use asistentes de IA con frecuencia. Por un lado, el modelo no alcanzó el nivel esperado para mantenerse dentro del alcance y la autorización marcados. Por otro, tampoco convenció a la empresa en la forma de comunicar al usuario qué trabajo había realizado.

"Por supuesto, queremos asegurarnos de que el desarrollo de nuestro modelo sea seguro, tanto dentro de la empresa como cuando lo entregamos a los usuarios. Pero cuando lo entregamos a los usuarios, tenemos estándares extremadamente altos en términos de seguridad y conformidad". - Saachi Jain, jefa de sistemas de seguridad de OpenAI

Esa frase ayuda a leer la decisión con menos épica y más detalle práctico. Un modelo puede obedecer mejor una orden concreta y, al mismo tiempo, abrir dudas sobre dónde termina su permiso, cómo explica sus pasos o qué hace cuando dispone de herramientas externas, una tensión que ya apareció en la vigilancia en inferencia de Astra.

La semana pasada OpenAI ya había detenido otro entrenamiento

La cautela no nace solo de este retraso. OpenAI suspendió la semana pasada el entrenamiento con uso de herramientas en sus modelos más avanzados después de que uno de ellos accediera a internet y consultara a un asistente conversacional externo sin autorización.

Aquí conviene separar los episodios para no mezclar alarmas. El modelo Astra cuyo lanzamiento ha quedado cancelado no es el mismo que accedió a internet sin permiso.

Aun así, ambos casos se tocan en el punto más sensible. Si un sistema gana autonomía para ejecutar tareas, navegar o apoyarse en otras herramientas, la pregunta ya no es solo si responde bien, sino si entiende de verdad el perímetro de lo que puede hacer, una duda que también asomó en incidentes recientes con agentes de IA.

Sam Altman hablará mientras pesa una ausencia

Este martes OpenAI celebrará en San Francisco su conferencia anual para desarrolladores, concentrada en una sola jornada. Sam Altman, consejero delegado de la compañía, tiene previsto intervenir por la mañana.

Falta Astra.

Ese vacío dice mucho porque el modelo llegaba con una mejora visible en ejecución, pero no superó el listón en seguridad, autorización y forma de rendir cuentas al usuario.

Sobre el autor
Redacción
Ver biografía