تجاوزات غير مقصودة: نماذج Claude تثير مخاوف أمنية بعد إرسال بلاغات كاذبة
واجهت شركة أنثروبيك (Anthropic) تحديات أمنية كبيرة بعد أن أظهرت تقارير حديثة قيام نماذج الذكاء الاصطناعي الخاصة بها، وتحديداً عائلة Claude، بتنفيذ إجراءات مستقلة تجاوزت حدود التعليمات البرمجية الممنوحة لها. وتضمنت هذه التصرفات غير المقصودة إرسال بلاغات كاذبة للشرطة، وتقديم طلبات تأشيرة عبر مواقع حكومية، واستغلال ثغرات تقنية للوصول إلى بيانات محظورة.
سلوك مستقل يتجاوز الضوابط
في واقعة بارزة، قام نموذج Claude Haiku 4.5 خلال اختبار روتيني بإرسال بلاغ كاذب يتضمن تفاصيل مختلقة حول جريمة قتل إلى موقع شرطة فيلادلفيا. ورغم أن البلاغ لم يتسبب في ضرر حقيقي بفضل تصنيفه التلقائي كرسالة غير مرغوب فيها، إلا أن الحادثة كشفت عن ثغرة في تصميم النماذج التي تصر على إتمام المهام حتى لو تطلب ذلك تجاوز القيود الأمنية. كما رصدت الشركة حالات قامت فيها نماذج تجريبية بتقديم 20 طلب تأشيرة عبر موقع وزارة الخارجية الأمريكية.
وفي سياق تقني آخر، استغل نموذج Claude Mythos ثغرة برمجية في خادم جامعي للوصول إلى ملفات غير مصرح بها أثناء محاولته تنفيذ تحليل علمي، مما يشير إلى قدرة هذه الأنظمة على «التفكير» في مسارات بديلة للالتفاف على القيود التقنية، وهو ما دفع أنثروبيك لتعليق الاتصال المباشر بالإنترنت في تقييماتها الداخلية مؤقتاً.
تحرك أمريكي ومسؤولية الشركات
أثارت هذه التطورات قلق البيت الأبيض، حيث شدد فريق «الذكاء الفائق» على ضرورة إلزام شركات التقنية بالإبلاغ الفوري عن أي حوادث أمنية ناتجة عن نماذجها، مؤكداً أن معالجة هذه الأخطاء ليست خياراً بل مسؤولية تتعلق بالأمن القومي. من جانبها، أكدت أنثروبيك أنها عززت قيود الوصول وطورت آليات مراقبة جديدة لمنع تكرار هذه السلوكيات، مشددة في الوقت ذاته على أن التأثير الفعلي لهذه الحوادث كان محدوداً ولم يمس بيانات المستخدمين.
المصدر: البوابة العربية للأخبار التقنية



