AMD a déclaré le 6 août avoir conclu un accord définitif pour acquérir Taalas, une société torontoise fondée en 2023 qui grave directement les poids d’un modèle dans un silicium à fonction fixe. AMD n’a communiqué ni prix d’achat, ni répartition entre cash et actions, ni date de clôture. L’opération est « soumise aux conditions de clôture habituelles et aux approbations réglementaires ».
Ce que Taalas a réellement construit
Le démonstrateur technologique HC1 est une puce de 815 mm² gravée en TSMC 6nm et dotée de 53 milliards de transistors. Le changement de modèle pour lequel elle est utilisée ne modifie que deux couches de masque, ce qui rend économiquement envisageable, du moins en théorie, une puce à logique câblée. Taalas a levé environ 219 millions de dollars depuis sa création.
Lire le benchmark avec attention
Taalas affirme atteindre jusqu’à 17 000 tokens par seconde et par utilisateur sur Llama 3.1 8B, devant Nvidia H200 et B200, Groq, SambaNova et Cerebras. Il s’agit des propres mesures de l’entreprise sur un démonstrateur, pas d’un produit commercialisé, et elles concernent un seul modèle à la fois. La généralité est précisément ce que cette architecture renonce à offrir.
Pourquoi AMD le veut
Vamsi Boppana, chez AMD, a présenté cette acquisition comme une plateforme full-stack donnant aux clients « la flexibilité de déployer les bonnes solutions de calcul pour chaque charge de travail IA ». En clair : AMD vend des GPU, et les GPU sont la réponse polyvalente. Racheter une équipe d’inférence à fonction fixe constitue une assurance pour la feuille de route face à l’argument avancé par Groq et Cerebras — à savoir que la plupart des tokens d’inférence n’ont pas besoin d’une machine polyvalente.
Ce qui ne s’est pas encore produit
Pas de prix, pas de clôture, pas de produit, pas de client nommé. Lire « AMD acquiert Taalas » va plus vite que le dépôt, qui décrit un accord en attente d’approbation. Il ne s’agit pas non plus du résultat du T2 d’AMD — tombé le 4 août et distinct de cette opération.