Together AI ha raccolto 800 milioni di dollari in un round di Serie C il 1° luglio 2026, portando la “neocloud” a una valutazione di 8,3 miliardi di dollari mentre le aziende spostano in produzione i modelli di IA open source. Il round è stato guidato da Aramco Ventures, con il produttore di chip Nvidia, Vista Equity Partners e General Catalyst tra i partecipanti.

Un cloud costruito per i modelli aperti

La piattaforma di Together AI offre inference serverless, infrastruttura dedicata e batch inference per modelli open source, in esecuzione su GPU Nvidia. Al suo centro c’è un motore proprietario chiamato ATLAS, che utilizza adaptive speculative decoding — un modello leggero abbozza le risposte, che il modello principale poi verifica e corregge — e che, secondo l’azienda, può accelerare alcuni carichi di lavoro di inference fino al 400%.

Il business dietro il round

L’azienda ha comunicato che i bookings annuali hanno superato 1,15 miliardi di dollari nel secondo trimestre del 2026. Sostiene che i clienti risparmiano tra 6x e 20x sui costi di inference rispetto alle API dei modelli chiusi, citando la società di customer service Decagon come esempio di una riduzione di sei volte dopo il passaggio alla sua piattaforma.

Dove andranno i fondi

Together AI prevede di usare il capitale per ampliare i propri prodotti mentre punta a diventare un provider di inference leader, e per aumentare in modo drastico la propria capacità — un’impronta che si aspetta di far crescere di circa 50 volte nei prossimi cinque anni. Accanto all’equity, gli investitori hanno impegnato oltre 500 megawatt di capacità di calcolo, che sarà finanziata separatamente dal round.

Aperto contro chiuso

La raccolta arriva mentre i modelli a pesi aperti di DeepSeek, Qwen di Alibaba, Llama di Meta e Mistral stanno colmando il divario con le API chiuse, rendendo più prezioso per le aziende un cloud specializzato nell’esecuzione di modelli aperti per chi cerca controllo su costi e deployment. La tesi di Together AI è che un’inference più economica e la libertà di eseguire i modelli dove il cliente preferisce continueranno ad attrarre quel lavoro verso la sua piattaforma.