Puces IA
OpenAI propose un modèle frontière sur le silicium Cerebras à 750 tokens par seconde
Ultrafast accélère GPT-5.6 Sol jusqu’à 14 fois plus vite que l’inférence standard. C’est la première fois qu’OpenAI a publiquement déployé un modèle frontière sur l’accélérateur d’un autre fournisseur.
il y a 4 h
