OpenAI annuncia Ultrafast per GPT-5.6 Sol: fino a 750 token al secondo

14 Agosto 2026

14 Agosto 2026/Home/AI INTELLIGENZA ARTIFICIALE/OpenAI annuncia Ultrafast per GPT-5.6 Sol: fino a 750 token al secondo

La notizia in sintesi

  • OpenAI testa Ultrafast per GPT-5.6 Sol tramite API.
  • La modalità promette fino a 750 token generati ogni secondo.
  • L’infrastruttura Cerebras punta a ridurre drasticamente la latenza.
  • L’accesso resta limitato a clienti selezionati e partner.

DatamoneyRiassunto generato con AI AGENTICA di Datamoney.ch


OpenAI accelera GPT-5.6 Sol con Ultrafast

Il 14 agosto 2026 OpenAI ha annunciato Ultrafast, una nuova modalità per GPT-5.6 Sol destinata alle applicazioni sviluppate tramite API. Il servizio, realizzato sull’infrastruttura di Cerebras, promette una generazione fino a 14 volte più rapida rispetto all’elaborazione standard, fino a 750 token di output al secondo.

La novità è rivolta inizialmente a sviluppatori e aziende che richiedono risposte quasi immediate, soprattutto nei flussi di lavoro in cui la latenza può compromettere assistenza, analisi e automazione. L’obiettivo dichiarato è rendere più reattivo il modello di punta di OpenAI senza sostituirlo con una versione meno capace ma più leggera.

#Assodigitale · su Google
Seguici su Google e non perdere nulla
Aggiungi Assodigitale alle tue fonti preferite su Discover e segui il nostro profilo Google: le notizie di tecnologia, intelligenza artificiale e criptovalute ti arrivano direttamente sul telefono.
Seguici su

Come funziona l’infrastruttura Cerebras

Il salto di velocità dipende dall’architettura Wafer-Scale Engine di Cerebras, azienda californiana specializzata in semiconduttori, supercomputer e software per l’intelligenza artificiale. Nell’inferenza dei grandi modelli, le GPU devono trasferire ripetutamente i pesi tra memoria interna ed esterna per generare ogni token successivo.

Non perdere le notizie che contano

Le innovazioni piu' interessanti di tecnologia e scienza, dritte nella tua inbox.

Offerte imperdibili dai partner di assodigitale

Cerebras indica una diversa soluzione tecnica: 44 GB di memoria SRAM integrata su ogni chip, così che i pesi del modello rimangano sul chip e i token attraversino in continuità i livelli della rete. È questo il meccanismo che, secondo quanto riportato, consente l’aumento di velocità fino a 14 volte.

OpenAI individua utilizzi concreti nelle interazioni vocali, nell’assistenza clienti, nel commercio, negli agenti per sviluppatori, nella ricerca finanziaria e nella risposta agli incidenti di sicurezza. L’azienda riferisce di avere già impiegato Ultrafast internamente per analizzare log e tracce durante gli incidenti, oltre che per ripetere più cicli di ricerca nella stessa giornata lavorativa.

La rilevanza non riguarda quindi soltanto la rapidità con cui appare un testo: in ambienti operativi, la riduzione dei tempi può cambiare il ritmo con cui un team esamina dati, testa ipotesi e interviene su un problema. Restano però da verificare gli effetti della modalità nei prodotti reali dei clienti.

Accesso ristretto e sviluppo della capacità

Ultrafast non è disponibile per tutti: OpenAI ha riservato l’anteprima a un gruppo limitato di clienti e partner, mentre le imprese interessate possono richiedere l’accesso attraverso una procedura dedicata. La richiesta richiede informazioni sul carico di lavoro, sui requisiti di latenza e sull’utilizzo previsto.

GPT-5.6 Sol era stato presentato a giugno insieme a Terra e Luna, con una successiva disponibilità estesa a luglio su ChatGPT, Codex e API. Non è stata comunicata una data per l’apertura più ampia di Ultrafast, segnale che la capacità infrastrutturale resta il passaggio decisivo per la diffusione del servizio.

FAQ

Quanto è veloce Ultrafast di GPT-5.6 Sol?

La modalità può generare fino a 750 token di output al secondo, con prestazioni dichiarate fino a 14 volte superiori alla modalità standard.

Chi può usare Ultrafast oggi?

L’accesso è attualmente limitato a clienti e partner selezionati di OpenAI; le aziende possono richiederlo indicando esigenze e carichi di lavoro.

Per quali attività è pensata Ultrafast?

È pensata per voce, assistenza clienti, commercio, agenti di sviluppo, ricerca finanziaria e risposta agli incidenti di sicurezza, dove la latenza incide direttamente sull’operatività.

Quale tecnologia usa Cerebras per accelerare?

Usa l’architettura Wafer-Scale Engine con 44 GB di SRAM per chip, mantenendo i pesi del modello sul chip e riducendo i trasferimenti di dati.

Come è stata verificata questa notizia?

Il contenuto nasce da analisi approfondita e verifica incrociata della nostra Redazione sulle fonti TecnoAndroid e punto-informatico.it, firmate da Ilenia Violante e Luca Colantuoni.

Non perdere gli errori di prezzo clamorosi su Amazon!

Iscriviti al canale Telegram e ricevili in tempo reale

Guide agli acquisti su Amazon

Vedi tutte le guide agli acquisti su Amazon

Le notizie più lette

#1
AI INTELLIGENZA ARTIFICIALE
Xiaomi svela AI Cube, mini PC per modelli locali fino a 120 miliardi
di Michele Ficara Manganelli ✿∴♛🌿🇨🇭
#2
GAMES
IKEA e Xbox lanciano YXSTABY, arredi gaming per spazi condivisi
di Michele Ficara Manganelli ✿∴♛🌿🇨🇭
#3
FINTECH
Durigon: pensione a 64 anni con il calcolo interamente contributivo
di Redazione Assodigitale
#4
PERSONE
Flavio Siano guida Arkadia Digital nello sviluppo degli investimenti digitali
di Michele Ficara Manganelli ✿∴♛🌿🇨🇭
#5
INTERNET
Truffa del finto CUP: SMS invitano a chiamare numeri a pagamento
di Michele Ficara Manganelli ✿∴♛🌿🇨🇭
Datamoney✨ Classifica generata dalla Agentic AI (REDAZIONE AI) di Datamoney.ch
Redazione Assodigitale Avatar

Redazione Assodigitale

La Redazione di Assodigitale

Il team editoriale di Assodigitale coordina la pubblicazione di notizie, analisi e approfondimenti quotidiani dal mondo dell'innovazione, della tecnologia e dei mercati digitali.

Questo account raccoglie i contributi storici della testata, i comunicati stampa certificati e le inchieste collettive curate dai nostri giornalisti e analisti.

Fondata per esplorare l'impatto della trasformazione digitale sulla società e sull'economia, la Redazione di Assodigitale si impegna a fornire un'informazione accurata, indipendente e verificata, seguendo rigorosi standard deontologici e di fact-checking per garantire ai lettori una visione chiara ed esperta del futuro tecnologico."

Per tutte le vostre esigenze editoriali e per proporci progetti speciali di Branded Content oppure per inviare alla redazione prodotti per recensioni e prove tecniche potete contattarci direttamente scrivendo alla redazione : CLICCA QUI

Areas of Expertise: Journalism, Branded Content, Digital Transformation, AI Strategy, Digital Publishing