كشف نموذج Claude Mythos Preview، أحدث نماذج الذكاء الاصطناعي من شركة Anthropic، عن آلاف الثغرات الأمنية عالية الخطورة في جميع أنظمة التشغيل الكبرى والمتصفحات الرئيسية، وفق ما أعلنته الشركة في منشور على مدونتها بتاريخ 8 أبريل 2026. وقد دفع هذا الكشف Anthropic إلى تنظيم استجابة صناعية منسقة قبل أن تصبح قدرات النموذج متاحة على نطاق أوسع.

بدلاً من إطلاق النموذج للعموم، أطلقت Anthropic برنامج “Project Glasswing”، وهو برنامج مقيّد يمنح شركاء مختارين إمكانية الوصول إلى قدرات النموذج في اكتشاف الثغرات. والهدف هو معالجة الثغرات الحرجة قبل أن تطلق مختبرات ذكاء اصطناعي أخرى نماذج بقدرات مماثلة لكن بضمانات أقل.

شركاء Project Glasswing ونطاق العمل

أفادت Anthropic بأنها تعمل مع Amazon Web Services وApple وBroadcom وCisco وCrowdStrike وGoogle وJPMorganChase وLinux Foundation وMicrosoft وNvidia وPalo Alto Networks في إطار Project Glasswing. كما امتد الوصول إلى أكثر من 40 منظمة إضافية تبني أو تصون بنية تحتية برمجية حيوية. وبالتوازي مع ذلك، قالت Anthropic إنها تتشارك المعلومات مع الحكومة الأمريكية حول إمكانات النموذج في الاستخدام الهجومي والدفاعي في مجال الأمن السيبراني وتداعياته على الأمن القومي.

قدرات Claude Mythos Preview في استغلال الثغرات

تتجاوز قدرات النموذج مجرد اكتشاف الثغرات. إذ قال باحثو Anthropic إن Mythos كتب ثغرة استغلال لمتصفح ويب تجمع أربع ثغرات منفصلة في سلسلة واحدة، منتجاً هجوم JIT heap spray معقداً تجاوز حماية كل من المُصيِّر ونظام التشغيل. وقد ظل هذا المستوى من تسلسل الاستغلال حكراً تاريخياً على باحثي الأمن البشريين الأكثر مهارة.

من الناحية الكمية، حوّل Mythos 72.4% من الثغرات التي حددها إلى ثغرات استغلال فعلية داخل بيئة JavaScript shell في Firefox. كما حقق التحكم في السجلات في 11.6% إضافية من الهجمات المحاولة. وبالمقارنة، لم يحقق نموذجا Sonnet 4.6 وOpus 4.6 سوى عطل واحد لكل منهما عند مستوى الخطورة الثالث عبر نحو 7000 نقطة دخول في مستودعات مفتوحة المصدر. في المقابل، حقق Mythos 595 عطلاً عند المستويين الأول والثاني، وأضاف عطلاً عند المستويين الثالث والرابع، وحقق اختراقاً كاملاً لتدفق التحكم في عشرة أهداف مُرقَّعة بالكامل عند المستوى الخامس.

ثغرات حقيقية اكتُشفت لأول مرة

قدمت Anthropic أمثلة ملموسة على الثغرات التي اكتشفها النموذج. من بينها ثغرة عمرها 27 عاماً في نظام OpenBSD كانت ستتيح لمهاجم تعطيل النظام بمجرد الاتصال به. وثغرة أخرى عمرها 16 عاماً في مكتبة FFmpeg، قالت Anthropic إنها “اصطدمت بها أدوات الاختبار الآلي خمسة ملايين مرة دون أن تكتشف المشكلة قط”. وثالثة تمثلت في سلسلة استغلال في نواة Linux تتيح للمهاجم الحصول على صلاحيات الجذر في النظام المضيف.

“نُشغّل نماذجنا بانتظام على نحو ألف مستودع مفتوح المصدر من مجموعة OSS-Fuzz، ونصنّف أسوأ عطل يمكنها إنتاجه على سلم من خمسة مستويات متصاعدة الخطورة، تتراوح بين الأعطال الأساسية (المستوى 1) والاختراق الكامل لتدفق التحكم (المستوى 5).”

فريق Anthropic Frontier Red Team

حالة الإفصاح والوصول المستقبلي للنموذج

على الرغم من حجم الثغرات المكتشفة، قالت Anthropic إن أقل من 1% من الثغرات المحتملة التي كشف عنها النموذج قد جرى إصلاحها بالكامل حتى الآن. وأكدت الشركة أنها تتبع سياسة الإفصاح المسؤول لجميع الثغرات المحددة، وإن كان الحجم الهائل للاكتشافات يجعل المعالجة السريعة أمراً عسيراً. وصرّحت Anthropic بأنها لن تتيح Claude Mythos Preview للاستخدام العام، وأنها توثّق سلوكه عبر بطاقة النظام الخاصة بالنموذج.

على المدى البعيد، قالت Anthropic إن برنامج الشراكة المقيّد يهدف إلى مساعدة الشركات والمؤسسات على الاستعداد لمستقبل تصبح فيه نماذج بهذا المستوى من القدرات أكثر شيوعاً. ووصف فريق Frontier Red Team التابع للمختبر خطر الإصدار غير المقيّد بأنه قد يعادل وضع أدوات استغلال متقدمة في أيدي مهاجمين غير مهرة. وأشارت Anthropic إلى أنها تتشارك النتائج أيضاً مع الحكومة الأمريكية لدعم التخطيط الأمني القومي المتعلق بعمليات الفضاء الإلكتروني المدعومة بالذكاء الاصطناعي.