Together AI a levé 800 millions de dollars lors d’un tour de table de série C le 1er juillet 2026, portant le « neocloud » à une valorisation de 8,3 milliards de dollars alors que les entreprises déploient des modèles d’IA open source en production. Le tour a été mené par Aramco Ventures, avec le fabricant de puces Nvidia, Vista Equity Partners et General Catalyst parmi les participants.

Un cloud conçu pour les modèles ouverts

La plateforme de Together AI propose de l’inférence serverless, une infrastructure dédiée et de l’inférence par lots pour des modèles open source, le tout exécuté sur des GPU Nvidia. Au cœur du système se trouve un moteur propriétaire appelé ATLAS, qui utilise un décodage spéculatif adaptatif — un modèle léger rédige des réponses que le modèle principal vérifie et corrige ensuite — et qui, selon l’entreprise, peut accélérer certaines charges d’inférence jusqu’à 400 %.

Les fondamentaux de l’opération

L’entreprise a indiqué que ses bookings annuels ont dépassé 1,15 milliard de dollars au deuxième trimestre 2026. Elle affirme que ses clients économisent entre 6 et 20 fois sur les coûts d’inférence par rapport aux API de modèles fermés, citant la société de service client Decagon, qui aurait divisé ses coûts par six après avoir migré vers sa plateforme.

L’usage des fonds

Together AI prévoit d’utiliser ces capitaux pour étoffer ses produits alors qu’elle cherche à devenir un acteur majeur de l’inférence, et pour augmenter massivement ses capacités — une empreinte qu’elle prévoit de faire croître d’environ 50 fois au cours des cinq prochaines années. En parallèle des fonds propres, les investisseurs se sont engagés sur plus de 500 mégawatts de capacité de calcul, qui seront financés indépendamment du tour.

Open contre fermé

Cette levée intervient alors que les modèles à poids ouverts de DeepSeek, de Qwen d’Alibaba, de Llama de Meta et de Mistral réduisent l’écart avec les API fermées, rendant plus précieux pour les entreprises un cloud spécialisé dans l’exécution de modèles ouverts, afin de garder la main sur les coûts et le déploiement. L’argument de Together AI est qu’une inférence moins chère et la liberté d’exécuter les modèles où le client le souhaite continueront d’orienter ce travail vers sa plateforme.