Cisco a publié le 21 juillet, via son groupe Foundation AI, deux très petits modèles open-weight — Antares-350M et Antares-1B — conçus pour une tâche étroite : déterminer où se trouve une vulnérabilité connue dans une base de code. Une version 3B a été annoncée, mais volontairement non diffusée.

Localisation, pas découverte

La distinction fait toute la différence. Antares ne cherche pas des bogues inconnus ; à partir d’une description de vulnérabilité, il fonctionne de manière agentique — en recherchant des motifs de code, en lisant des fichiers candidats, en recoupant les indices et en revenant en arrière lorsqu’une piste échoue — pour identifier précisément le code affecté. Cisco décrit cela comme « l’un des problèmes les plus difficiles, les plus longs et les plus coûteux en matière de sécurité ».

Les chiffres du benchmark

Sur le VLoc Bench de Cisco, 500 tâches évaluées selon le File F1 : GPT-5.5 arrive en tête avec 0,229 et 0,221, tandis que Antares-3B affiche 0,223 et que Antares-1B obtient 0,209. Viennent ensuite GLM-5.2, un modèle de 753 milliards de paramètres, à 0,186, puis Gemini 3 Pro à 0,152. Qu’un modèle d’un milliard de paramètres batte un modèle de 753 milliards constitue le résultat phare.

Et l’écart de coût

Une évaluation complète de 500 tâches coûte environ 0,82 $ avec Antares, contre environ 141 $ pour GPT-5.5 et 12,50 $ pour GLM-5.2 — soit environ 172 fois moins cher que le modèle de pointe qu’il frôle. L’exécution prend environ 13 minutes sur un seul H100 avec 16 travailleurs parallèles, contre environ cinq heures pour les modèles de pointe. Antares repose sur IBM Granite 4.0 1B, sous licence Apache 2.0, et s’exécute localement, de sorte que le code source ne quitte jamais l’organisation.

Ouvert, mais sous contrôle

L’accès est vérifié. « Nous restreignons totalement le modèle 3B afin de nous assurer de le publier de manière responsable auprès des communautés qui en ont besoin », a déclaré Amin Karbasi, vice-président et chief AI scientist de Cisco. Les chiffres de benchmark et de coût sont ceux de Cisco, sur le benchmark de Cisco, sans réplication indépendante à ce stade.