قالت Anthropic في 7 أغسطس إنه اعتبارًا من 14 أغسطس، ستعمل الجلسات الجديدة في Claude Code على خطط Pro, Max and Team في وضع auto. وبدلًا من الموافقة على كل أمر على حدة، يمر كل إجراء عبر مصنّف بُني لمنع أي شيء لا رجعة فيه أو تدميري أو موجَّه خارج بيئة المستخدم.

الرقم الذي يبرر ذلك

استعانت Anthropic بـ 1,053 مختبرًا مدفوع الأجر عبر مزوّد أبحاث لإجراء دراسة برمجية، مع تضمين أمر خطِر واحد في مطالبة إذن لكل منهم. تمكّن المختبرون من اكتشافه 143 مرة — 13.6%. أما وضع auto فحجب الأمر نفسه 937 مرة — 89%. ويصف الرقمان المجموعة المُحكَمة نفسها، وهو ما يجعل المقارنة ذات معنى.

الانتباه يتلاشى؛ أما المصنّف فلا

والنتيجة الأكثر إثارة للاهتمام هي المنحنى. فقد حجب البشر نحو 17% من الأوامر الخطِرة في بداية الجلسة، ثم هبطت النسبة إلى قرابة 5% بعد 50 prompt أو أكثر سابقة. وظلت نسبة الحجب في وضع auto ثابتة بغضّ النظر عن طول الجلسة. وقد وافق المختبرون على 97% من مطالبات الإذن بينما رفضوا 39% من موافقات الخطة — كانوا يقرؤون الخطط ثم يمرّرون الأوامر تلقائيًا.

دراستان، لا دراسة واحدة

وأجرى تقييم مستقل منفصل من Trajectory Labs 72 سيناريو حقن مطالبات غير مباشر، عشر مرات لكل سيناريو — أي 720 محاولة — ضد Claude Fable 5 وOpus 5 وSonnet 5 في وضع auto، على الإصدارات السارية في 17 يوليو. ولم ينجح أي منها، وشمل ذلك Codex أيضًا. وضمّ هذه المحاولات الـ720 إلى دراسة المختبرين، كما تفعل عدة مواد، يخلط بين تجربتين مختلفتين.

ما الذي يتغير فعليًا

كان وضع auto موجودًا بالفعل. الذي يتغير هو الوضع الافتراضي، ومعه الحجة: ظهر ضرر غير مقصود في 6.3% من الجلسات التي جرى اعتمادها يدويًا مقابل 2.4% في وضع auto، كما أن مستخدمي وضع auto لدى عملاء Team وEnterprise ينجزون نحو 25% أكثر من طلبات السحب.