AMD acquisisce la startup Taalas per accelerare l’inferenza dei modelli AI

8 Agosto 2026

Aggiungi Assodigitale alle tue fonti preferite su Google

La notizia in sintesi

  • AMD ha firmato l’accordo per acquisire la startup canadese Taalas.
  • I chip Taalas integrano i pesi dei modelli AI direttamente nel silicio.
  • La tecnologia punta a ridurre latenza, consumi e costo dell’inferenza.
  • L’operazione resta soggetta alle autorizzazioni regolamentari.

(Riassunto generato con AI)

AMD punta sull’inferenza AI con Taalas

AMD ha firmato il 6 agosto 2026 un accordo definitivo per acquisire Taalas, startup canadese fondata a Toronto nel 2023, con l’obiettivo di rafforzarsi nell’inferenza dell’intelligenza artificiale. I termini economici non sono stati divulgati e la chiusura resta subordinata alle consuete autorizzazioni regolamentari, attesa entro il quarto trimestre del 2026.

Al centro dell’operazione c’è un approccio hardware radicale: invece di caricare ripetutamente i pesi di un modello dalla memoria alle unità di calcolo, Taalas li incorpora fisicamente nel chip. La scelta risponde a un problema sempre più rilevante nei data center: durante la generazione dei token, il trasferimento dei dati può incidere su velocità, consumo energetico e costi più della sola potenza di calcolo.

Per AMD, la tecnologia non appare come un sostituto delle GPU Instinct, ma come una componente specializzata da integrare nella propria roadmap. Le GPU manterrebbero la flessibilità per addestramento, fine-tuning e modelli aggiornati frequentemente; gli acceleratori Taalas sarebbero destinati a carichi stabili e ad alto volume.

Come funzionano i chip con pesi incisi

L’architettura Hard Coded Inference di Taalas combina una mask-ROM recall fabric, dove i pesi sono definiti nel layout di fabbricazione, con una SRAM recall fabric per i dati modificabili durante l’esecuzione, come le cache di contesto. In questo modo memoria e calcolo non restano separati come nelle architetture convenzionali.

Il chip dimostrativo HC1, prodotto con processo TSMC a 6 nanometri, ha eseguito Llama 3.1 8B fino a quasi 17.000 token al secondo per utente, secondo i test riportati nell’annuncio di AMD. AMD indica il risultato come pari a 48 volte la velocità delle GPU NVIDIA e a 8,5 volte quella degli acceleratori Cerebras, confronti che vanno letti nel perimetro dichiarato dall’azienda.

La startup è stata fondata da Ljubisa Bajic, già fondatore di Tenstorrent e con precedenti esperienze in AMD e NVIDIA, insieme a Drago Ignjatovic e Lejla Bajic. Taalas ha raccolto 219 milioni di dollari, con investitori fra cui Quiet Capital, Fidelity e Pierre Lamond.

Youtube video

Velocità elevata, ma minore flessibilità

Il vantaggio della soluzione è legato al compromesso principale: un chip con i pesi incisi è progettato per uno specifico modello e modifiche sostanziali richiedono una nuova produzione. Taalas sostiene che una revisione possa intervenire su due strati metallici, non sull’intera struttura del chip.

Il prossimo HC2, previsto per l’estate, dovrebbe supportare fino a 20 miliardi di parametri per unità; Taalas stima che 50 acceleratori possano sostenere un modello da un trilione di parametri. L’integrazione potrebbe trovare spazio nei rack Helios, dove AMD immagina GPU Instinct per l’elaborazione dei prompt e hardware specializzato per generare token.

La conseguenza strategica è chiara: la competizione nei semiconduttori AI si sposta dall’addestramento alla messa in produzione dei modelli. Per i fornitori che servono lo stesso modello a milioni di utenti per lunghi periodi, ridurre il movimento dei dati può diventare un vantaggio operativo decisivo.

FAQ

Che cosa ha acquisito AMD?

Sì: AMD ha firmato un accordo definitivo per acquisire Taalas, startup di Toronto specializzata in acceleratori per l’inferenza AI con pesi integrati nel silicio.

Perché i pesi nel silicio sono importanti?

Sì: incorporare i pesi riduce il continuo trasferimento tra memoria e unità matematiche, uno dei fattori che aumentano latenza, consumo energetico e costo per token.

Quale prestazione ha raggiunto il chip HC1?

Sì: HC1 ha eseguito Llama 3.1 8B a quasi 17.000 token al secondo per utente, secondo i test interni riportati nell’annuncio ufficiale di AMD.

Taalas sostituirà le GPU AMD Instinct?

No: AMD prevede un ruolo complementare, con GPU Instinct per compiti flessibili e acceleratori Taalas per inferenza stabile, veloce e ad alto volume.

Come sono state verificate queste informazioni?

Sì: il contenuto nasce da analisi approfondita e verifica incrociata della nostra Redazione su più fonti: Tom’s Hardware e ilsoftware.it.

Redazione Assodigitale Avatar

Redazione Assodigitale

La Redazione di Assodigitale

Il team editoriale di Assodigitale coordina la pubblicazione di notizie, analisi e approfondimenti quotidiani dal mondo dell'innovazione, della tecnologia e dei mercati digitali.

Questo account raccoglie i contributi storici della testata, i comunicati stampa certificati e le inchieste collettive curate dai nostri giornalisti e analisti.

Fondata per esplorare l'impatto della trasformazione digitale sulla società e sull'economia, la Redazione di Assodigitale si impegna a fornire un'informazione accurata, indipendente e verificata, seguendo rigorosi standard deontologici e di fact-checking per garantire ai lettori una visione chiara ed esperta del futuro tecnologico."

Per tutte le vostre esigenze editoriali e per proporci progetti speciali di Branded Content oppure per inviare alla redazione prodotti per recensioni e prove tecniche potete contattarci direttamente scrivendo alla redazione : CLICCA QUI

Areas of Expertise: Journalism, Branded Content, Digital Transformation, AI Strategy, Digital Publishing