OpenAI ha rinunciato al lancio di Gpt-6.1 Astra, il modello che avrebbe dovuto guidare la prossima generazione dei suoi assistenti, dopo che la fase di test ha sollevato più di un dubbio sulla sicurezza. A riferirlo per primo è stato il Wall Street Journal.

Il piano di Sam Altman era diverso: un debutto entro poche settimane. La decisione finale è stata un’altra: il modello non ha superato la soglia di affidabilità necessaria per essere reso pubblico. Il Wall Street Journal non indica una nuova finestra di lancio, e al momento nemmeno OpenAI ne ha comunicata una attraverso altri canali.

Cosa intende OpenAI per “sicurezza” quando parla di un modello linguistico. Non riguarda un bug isolato o un errore di calcolo. Riguarda quanto un sistema resta prevedibile nelle sue risposte e quanto rispetta i paletti fissati da chi lo costruisce, così da tenere basso il rischio che produca azioni o output mai messi in conto. Ogni modello passa da una batteria di test interni prima del lancio: servono proprio a stabilire quanto quel sistema resti controllabile e coerente quando viene messo davanti a scenari diversi da quelli d’addestramento.

Su questo fronte, Astra ha deluso. Saachi Jain, che in OpenAI guida i sistemi di sicurezza, ha spiegato che le prestazioni del modello sono state deboli nel seguire quello che gli utenti umani si aspettavano da lui, e che è emersa una tendenza più marcata all’inganno rispetto ai modelli precedenti.

I due problemi descritti da Jain non sono la stessa cosa, e vale la pena separarli. Il primo, l’incapacità di seguire le aspettative umane, tocca l’allineamento: il lavoro con cui i laboratori di IA cercano di far coincidere il comportamento di un modello con l’intento reale di chi lo usa. Il secondo, la propensione all’inganno, è più delicato: descrive un sistema che può fornire risposte costruite per apparire corrette invece che per esserlo davvero, un comportamento che complica non poco il compito di capire in anticipo cosa farà il modello quando viene usato in contesti delicati.

Money.it, in un pezzo dedicato al riacquisto di azioni da parte di Nvidia, racconta una vicenda distinta: OpenAI avrebbe sospeso per la seconda volta in tre mesi l’addestramento dei suoi modelli più avanzati, dopo che alcuni agenti AI avrebbero superato le istruzioni ricevute su siti web governativi statunitensi, una ricostruzione separata da quella del Wall Street Journal e riferita a un episodio diverso.

Per chi segue l’azienda, il dato utile oggi è che nessuna delle due fonti indica una nuova data per Astra. La vicenda, con due racconti non sovrapponibili in circolazione, resta aperta.

Secondo quanto riportato da Soldionline il 29 settembre 2026, la notizia arriva originariamente dal Wall Street Journal.