Puces IA
La française ZML lance LLMD, un serveur gratuit qui exécute des LLM sur n’importe quelle puce
La start-up parisienne, soutenue par Yann LeCun, veut briser l’emprise logicielle de Nvidia avec un serveur d’inférence qui exécute des modèles à poids ouverts sur cinq familles de puces à partir d’une seule stack — gratuit, même si son alpha est plus limité que la promesse.
9 juil. 2026
