OpenAI porta GPT-6 Sol e Luna su ChatGPT e aggiunge una Intelligent UI per risposte in formati misti
GPT-6 Sol arriva prima nei piani a pagamento di ChatGPT, mentre GPT-6 Luna segue per gli utenti Free e Go. La scheda di sistema di OpenAI classifica entrambi i modelli al livello di capacità elevata nei domini della cybersicurezza e della biologia e chimica.
Punti chiave
- 1GPT-6 Sol è in fase di distribuzione su ChatGPT Plus, Pro, Business ed Enterprise; GPT-6 Luna segue per gli utenti Free e Go, secondo 9to5Mac.
- 2Intelligent UI consente a ChatGPT di combinare il testo con grafici, moduli, pulsanti che si possono toccare e altri elementi interattivi, a seconda della domanda; ChatGPT può anche creare piccoli strumenti come le calcolatrici.
- 3OpenAI afferma che ChatGPT ora può iniziare a rispondere mentre sta ancora ragionando, arricchendo la risposta man mano.
- 4I modelli di ottobre sostituiscono le versioni GPT-5.6 in ChatGPT; Codex e ChatGPT Work utilizzano ancora le versioni di settembre.
- 5OpenAI classifica entrambi i modelli al livello di capacità elevata nella cybersicurezza e nella biologia e chimica secondo il suo Preparedness Framework; i suoi risultati sulla sicurezza sono autodichiarati.
La notizia completa
OpenAI ha annunciato il 7 ottobre che porta nuovi modelli GPT-6 su ChatGPT, dopo i primi modelli GPT-6 presentati a settembre. Secondo 9to5Mac, gli abbonati ai piani Plus, Pro, Business ed Enterprise ricevono per primi GPT-6 Sol, mentre GPT-6 Luna dovrebbe iniziare a raggiungere gli utenti Free e Go il giorno successivo. OpenAI descrive queste versioni come ottimizzate per la conversazione quotidiana. Nella scheda di sistema del rilascio, l'azienda afferma che GPT-6 arriva sui piani gratuiti e a pagamento in tutto il mondo e che i modelli di ottobre sostituiscono in ChatGPT le versioni GPT-5.6 di Sol e Luna.
Il cambiamento più visibile è quello che OpenAI chiama Intelligent UI. Invece di rispondere solo con il testo, ChatGPT ora può combinare il testo con elementi visivi e interattivi, scegliendo il formato in base alla domanda e al contenuto della risposta. OpenAI elenca elementi grafici, pulsanti che si possono toccare, moduli, grafici ed esperienze interattive utilizzate all'interno della chat. Un confronto può essere presentato fianco a fianco e una spiegazione può arrivare sotto forma di diagramma interattivo, mentre una semplice risposta testuale resta un'opzione quando è quella che serve meglio l'utente. Per i prompt più complessi, ChatGPT può creare widget che consentono di esplorare un concetto o di modificare i dati di input e vedere i risultati aggiornarsi, e può creare piccoli strumenti come calcolatrici, strumenti per dividere il conto e giochi all'interno di una conversazione.
OpenAI afferma inoltre che GPT-6 consente a ChatGPT di iniziare a rispondere prima che il ragionamento sia completato, aggiungendo informazioni alla risposta passo dopo passo anziché trattenere tutto fino alla fine del processo di riflessione. L'aggiornamento non raggiunge ancora tutti i prodotti di OpenAI. Secondo la scheda di sistema, chi usa i modelli in Codex o tramite ChatGPT Work utilizza ancora versioni precedenti. OpenAI contrassegna i modelli in base al mese di rilascio: ottobre per le versioni ora presenti in ChatGPT, settembre per quelle che restano in Codex e Work.
Le affermazioni sulla sicurezza contenute nella scheda di sistema provengono dai test interni di OpenAI. L'azienda afferma che i modelli di ottobre resistono meglio ai jailbreak rispetto ai modelli GPT-5.6, compresi gli attacchi che si adattano nel corso di più turni, e mostrano meno disonestà e inganno. Dice di aver aggiornato il proprio addestramento sulla sicurezza per proteggersi meglio dagli abusi ad alto rischio legati al cyber, alla biologia e alla violenza. OpenAI segnala inoltre regressioni statisticamente significative in alcune categorie di contenuti, come l'autolesionismo e i contenuti gore, e in diverse valutazioni relative agli utenti sotto i 18 anni; afferma che la revisione manuale e il red-teaming hanno rilevato che i fallimenti erano generalmente di bassa gravità e che in produzione operano ulteriori salvaguardie, come i classificatori. Nei suoi test sulla gerarchia delle istruzioni contro la prompt injection, OpenAI indica punteggi di robustezza del 99.99% per GPT-6 Sol e del 99.79% per GPT-6 Luna.
La valutazione del Preparedness Framework di OpenAI colloca entrambi i modelli di ottobre al livello di capacità elevata nel dominio della cybersicurezza e in quello della biologia e chimica. L'azienda afferma che nessuno dei due modelli raggiunge la sua soglia elevata per l'auto-miglioramento dell'IA e che entrambi restano al di sotto del livello critico nella cybersicurezza. Ciò corrisponde alla sua valutazione dei modelli GPT-5.6, e OpenAI afferma di applicare le stesse salvaguardie descritte nella scheda di sistema di GPT-5.6. Nelle proprie valutazioni cyber, riferisce che GPT-6 Sol si è collocato più o meno allo stesso livello del suo predecessore, senza un chiaro miglioramento, mentre GPT-6 Luna ha ottenuto un punteggio inferiore a quello di GPT-6 Sol.
Perché è importante
Il rilascio cambia ciò che vedono gli utenti di ChatGPT: risposte che possono arrivare sotto forma di grafici, moduli o piccoli strumenti invece che solo come testo, e risposte che iniziano prima che il modello abbia finito di ragionare. Inoltre mette a disposizione degli utenti gratuiti di tutto il mondo modelli che la stessa OpenAI classifica al livello di capacità elevata nei domini della cybersicurezza e della biologia e chimica, il che rende più rilevanti le salvaguardie descritte nella sua scheda di sistema. Questi risultati sulla sicurezza provengono dalle valutazioni interne di OpenAI e non da test indipendenti.
Cronologia
· Pubblicato
Argomenti#OpenAI#ChatGPT#GPT-6#Intelligent UI#Sicurezza dell'IA
Fonti
Questa notizia si basa sulle fonti seguenti. Leggile per il contesto completo.
