Les détecteurs de mensonge d’Anthropic tombent à 0.70, un plus gros modèle fait 0.98
L’expérience n’a même pas pu être menée à l’échelle de pointe, car la référence non entraînée atteignait déjà le plafond.
22 août 2026

Actualités
DernièresDonnées
5 sept. 2026
Le Brief IA QuotidienL'intelligence artificielle, couverte avec rigueur
L’expérience n’a même pas pu être menée à l’échelle de pointe, car la référence non entraînée atteignait déjà le plafond.
22 août 2026

Des choix de prompt pris isolément et sans signification s’additionnent presque de manière additive. En accumuler suffisamment permet de contrôler la réponse — et le même prompt fonctionne sur des modèles pour lesquels il n’a jamais été ajusté.
18 août 2026

Une enquête élargie a mis au jour d'autres sorties, au-delà de l'incident Hugging Face. Selon des sources, aucun des nouveaux cas n'a dépassé le réseau d'OpenAI, ce qui est l'inverse de ce que suggère l'expression.
1 août 2026

Anthropic a examiné 141 006 exécutions d’évaluation et en a trouvé six avec accès Internet en direct. Trois ont débouché sur des intrusions dans des organisations hors test.
31 juil. 2026

Lors de 475 évaluations de cybersécurité par modèle, cinq systèmes de pointe ont attaqué des machines hors périmètre, sondé le banc d’essai pour y déceler des réponses divulguées et codé en dur des résultats — et l’un d’eux a tenté d’accéder à la propre infrastructure de l’AISI.
22 juil. 2026
