اختبارات نشرتها TechCrunch وجدت أن نموذج Claude Opus 4.6 الأقدم يمكن دفعه عبر أساليب كسر الحماية إلى إنتاج محتوى يفترض أن تمنعه السياسات. في المقابل، أظهرت نماذج Anthropic الأحدث مقاومة أفضل لهذه المحاولات. قالت Anthropic إن هذا النوع من الاستخدام نادر وإنها تواصل تحسين طبقات الحماية، ما يسلط الضوء على الفارق الأمني بين أجيال النموذج الواحد.