OpenAI annuncia Ultrafast per GPT-5.6 Sol: fino a 750 token al secondo

14 Agosto 2026

Aggiungi Assodigitale alle tue fonti preferite su Google

La notizia in sintesi

  • OpenAI testa Ultrafast per GPT-5.6 Sol tramite API.
  • La modalità promette fino a 750 token generati ogni secondo.
  • L’infrastruttura Cerebras punta a ridurre drasticamente la latenza.
  • L’accesso resta limitato a clienti selezionati e partner.

(Riassunto generato con AI)

OpenAI accelera GPT-5.6 Sol con Ultrafast

Il 14 agosto 2026 OpenAI ha annunciato Ultrafast, una nuova modalità per GPT-5.6 Sol destinata alle applicazioni sviluppate tramite API. Il servizio, realizzato sull’infrastruttura di Cerebras, promette una generazione fino a 14 volte più rapida rispetto all’elaborazione standard, fino a 750 token di output al secondo.

La novità è rivolta inizialmente a sviluppatori e aziende che richiedono risposte quasi immediate, soprattutto nei flussi di lavoro in cui la latenza può compromettere assistenza, analisi e automazione. L’obiettivo dichiarato è rendere più reattivo il modello di punta di OpenAI senza sostituirlo con una versione meno capace ma più leggera.

Come funziona l’infrastruttura Cerebras

Il salto di velocità dipende dall’architettura Wafer-Scale Engine di Cerebras, azienda californiana specializzata in semiconduttori, supercomputer e software per l’intelligenza artificiale. Nell’inferenza dei grandi modelli, le GPU devono trasferire ripetutamente i pesi tra memoria interna ed esterna per generare ogni token successivo.

Cerebras indica una diversa soluzione tecnica: 44 GB di memoria SRAM integrata su ogni chip, così che i pesi del modello rimangano sul chip e i token attraversino in continuità i livelli della rete. È questo il meccanismo che, secondo quanto riportato, consente l’aumento di velocità fino a 14 volte.

OpenAI individua utilizzi concreti nelle interazioni vocali, nell’assistenza clienti, nel commercio, negli agenti per sviluppatori, nella ricerca finanziaria e nella risposta agli incidenti di sicurezza. L’azienda riferisce di avere già impiegato Ultrafast internamente per analizzare log e tracce durante gli incidenti, oltre che per ripetere più cicli di ricerca nella stessa giornata lavorativa.

La rilevanza non riguarda quindi soltanto la rapidità con cui appare un testo: in ambienti operativi, la riduzione dei tempi può cambiare il ritmo con cui un team esamina dati, testa ipotesi e interviene su un problema. Restano però da verificare gli effetti della modalità nei prodotti reali dei clienti.

Accesso ristretto e sviluppo della capacità

Ultrafast non è disponibile per tutti: OpenAI ha riservato l’anteprima a un gruppo limitato di clienti e partner, mentre le imprese interessate possono richiedere l’accesso attraverso una procedura dedicata. La richiesta richiede informazioni sul carico di lavoro, sui requisiti di latenza e sull’utilizzo previsto.

GPT-5.6 Sol era stato presentato a giugno insieme a Terra e Luna, con una successiva disponibilità estesa a luglio su ChatGPT, Codex e API. Non è stata comunicata una data per l’apertura più ampia di Ultrafast, segnale che la capacità infrastrutturale resta il passaggio decisivo per la diffusione del servizio.

FAQ

Quanto è veloce Ultrafast di GPT-5.6 Sol?

Sì, la modalità può generare fino a 750 token di output al secondo, con prestazioni dichiarate fino a 14 volte superiori alla modalità standard.

Chi può usare Ultrafast oggi?

Sì, l’accesso è attualmente limitato a clienti e partner selezionati di OpenAI; le aziende possono richiederlo indicando esigenze e carichi di lavoro.

Per quali attività è pensata Ultrafast?

Sì, è pensata per voce, assistenza clienti, commercio, agenti di sviluppo, ricerca finanziaria e risposta agli incidenti di sicurezza, dove la latenza incide direttamente sull’operatività.

Quale tecnologia usa Cerebras per accelerare?

Sì, usa l’architettura Wafer-Scale Engine con 44 GB di SRAM per chip, mantenendo i pesi del modello sul chip e riducendo i trasferimenti di dati.

Come è stata verificata questa notizia?

Sì, il contenuto nasce da analisi approfondita e verifica incrociata della nostra Redazione sulle fonti TecnoAndroid e punto-informatico.it, firmate da Ilenia Violante e Luca Colantuoni.

Redazione Assodigitale Avatar

Redazione Assodigitale

La Redazione di Assodigitale

Il team editoriale di Assodigitale coordina la pubblicazione di notizie, analisi e approfondimenti quotidiani dal mondo dell'innovazione, della tecnologia e dei mercati digitali.

Questo account raccoglie i contributi storici della testata, i comunicati stampa certificati e le inchieste collettive curate dai nostri giornalisti e analisti.

Fondata per esplorare l'impatto della trasformazione digitale sulla società e sull'economia, la Redazione di Assodigitale si impegna a fornire un'informazione accurata, indipendente e verificata, seguendo rigorosi standard deontologici e di fact-checking per garantire ai lettori una visione chiara ed esperta del futuro tecnologico."

Per tutte le vostre esigenze editoriali e per proporci progetti speciali di Branded Content oppure per inviare alla redazione prodotti per recensioni e prove tecniche potete contattarci direttamente scrivendo alla redazione : CLICCA QUI

Areas of Expertise: Journalism, Branded Content, Digital Transformation, AI Strategy, Digital Publishing