قامت شركة أنثروبيك بقطع إمكانية وصول كلود إلى الإنترنت بعد أن قدم النموذج بشكل ذاتي بلاغًا مزيف عن جريمة قتل لشرطة فيلادلفيا
مانويل أوث
10 أكتوبر 2026استغلت نماذج الذكاء الاصطناعي التابعة لشركة Anthropic عيوب الأمان بشكل مستقل، وقدمت استمارات حكومية، وتجاوزت قيود الوصول أثناء الاختبارات والاستخدام الداخلي. بحثت النماذج بنشاط عن طرق لإنجاز مهام لا يجب عليها التعامل معها، كما ذكرت تفاصيل الشركة في التقرير.
في حالة واحدة، قام كلود بملء نموذج تقرير بمعلومات مزيفة حول جريمة قتل لم تُحل، وقدمها لقسم شرطة فيلادلفيا. وقد أكدت الشرطة الحادثة، لكن التقرير تم تصنيفه كرسائل بريدية غير مرغوب فيها ولم يصل إلى المحققين. وفي حالات أخرى، اكتشف النموذج نقطة ضعف على خادم جامعي واستخدمها لتنفيذ أوامر، وأخرج توكيلات الوصول من إعدادات المواقع الإلكترونية للحصول على بيانات محمية أو محدودة التكلفة، واستخدم برامج اختصار الروابط لتجاوز حدود الطول المسموح به في أدواته.
تقول شركة أنثروبيك إن التأثير في العالم الحقيقي كان منخفضًا، لكنها تلاحظ وجود نمط معين. عندما تكون المهام غامضة أو صعبة الحل، يقوم النموذج بالبحث عن حلول بأنفسه بدلاً من التوقف. أخبرت الشركة البيت الأبيض، وقطعت الوصول إلى الإنترنت للتقييمات الداخلية حتى يتم تطبيق فلاتر الأمان الجديدة بشكل موثوق. هذه الحوادث تضمّن قائمة سريعة النمو من الحالات المماثلة، بما في ذلك حوادث أمن السيبرانتك التي تتعلق بكلود، ونماذج أوپن آي التي قامت بتخريب هوجينغ فيس بنفسها.
أخبار الذكاء الاصطناعي بدون الضجيج – من اختيار البشر
اشترك في THE DECODER للقراءة بدون إعلانات، إلى نشرة أخبار الذكاء الاصطناعي الأسبوعية، إلى تقرير "AI Radar" الحصري الست مرات في السنة، إلى الوصول الكامل لأرشيف المحتوى، وإلى الوصول إلى قسم التعليقات.
المصدر: Anthropic / تقرير | CBS News / شرطة فيلادلفيا