OpenAI GPT

OpenAI presenta GPT-6 Astra: raggiunta la soglia critica nella cybersicurezza

OpenAI ha annunciato GPT-6 Astra, descritto come il modello linguistico più potente e più ampiamente distribuito realizzato finora dall’azienda. La novità non riguarda solo le prestazioni generali: Astra è il primo modello interno a raggiungere la soglia di capacità di cybersicurezza classificata come “critica” nel framework di preparazione usato da.

Il dato è rilevante perché segna un salto netto nelle capacità operative del modello, ma porta con sé anche nuove cautele. OpenAI ha infatti rafforzato le misure di protezione e di allineamento, riconoscendo allo stesso tempo che la monitorabilità di Astra risulta inferiore rispetto alla generazione precedente in alcuni scenari avversariali.

OpenAI GPT-6 Astra 发布,首次达到“关键”级网络安全能力门槛

GPT-6 Astra alza il livello nelle capacità di sicurezza informatica

OpenAI spiega che, con gli strumenti corretti e i necessari permessi di accesso, Astra è in grado di individuare vulnerabilità sconosciute in sistemi ben protetti anche senza una guida passo passo da parte di un operatore umano.

Proprio per questo l’azienda ha introdotto contromisure più rigide: isolamento più severo, crittografia dei checkpoint, monitoraggio completo delle traiettorie del modello incluse le catene di ragionamento e una procedura di valutazione bloccante prima dell’uso interno.

Più sicurezza operativa, ma resta aperto il nodo della monitorabilità

OpenAI afferma di aver distribuito in modo esteso un sistema di monitoraggio dei comportamenti disallineati durante tutti i processi di ragionamento che prevedono l’uso di strumenti esterni, con un costo computazionale significativo.

Non sono emerse prove di un uso nascosto della catena di ragionamento, dettaglio che suggerisce come il rischio di elusione resti per ora concentrato soprattutto nei compiti che non richiedono esplicitamente quel tipo di tracciamento. Resta comunque un segnale importante: con modelli più capaci, capire con precisione cosa siano in grado di fare diventa più difficile.

Nei contesti pratici, Astra risulta più robusto contro gli attacchi di prompt injection, riduce i comportamenti potenzialmente dannosi in ambienti reali di navigazione e lavoro su computer e gestisce in modo più sicuro anche scenari ad alto rischio. OpenAI sottolinea inoltre una maggiore coerenza nei limiti di sicurezza applicati agli utenti sotto i 18 anni.

Condividi con i tuoi amici

Lascia una risposta

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *

Questo sito utilizza Akismet per ridurre lo spam. Scopri come vengono elaborati i dati derivati dai commenti.

Verified by ExactMetrics

Privacy e contenuti esterni

Puoi autorizzare i servizi esterni. Le nuove autorizzazioni si applicano subito; dopo una revoca la pagina viene ricaricata.

Leggi l'informativa sulla privacy