دراسة أفعال النموذج غير المتوقع في تقييماتنا والاستخدام الداخلي
9 أكتوبر 2026
يصف هذا التقرير أمثلة على أفعال النموذج غير المتوقع التي لاحظناها أثناء التقييمات والاستخدام الداخلي لـ Claude. وهو جزء من جهودنا لنشر تقارير أكثر تكرارًا حول سلوك النموذج وتمركزه، بخلاف بطاقات النظام التي ننشرها مع كل إصدار للنموذج، وكذلك تقارير المخاطر التي ننشرها كل ثلاث إلى ستة أشهر كجزء من سياستنا للتوسع المسؤول. نعتقد أن من المهم أن نكون شفافين حول ما يفعله النموذجان أثناء الاختبار والاستخدام.
يمكن تصنيف السلوكيات إلى أربع فئات:
- كلاود يستغل عيبًا بسيطًا في البرنامج لتنفيذ أوامر على الخادم؛
- كلاود يقدم نموذجًا حساسًا على موقع ويب حقيقي عندما لا ينبغي ذلك؛
- كلاود يعمل من أجل التغلب على القيود للحصول على بيانات كانت محظورة بواسطة رمز أو رسوم؛
- يستخدم كلود العمليات المختصرة للروابط لتجاوز القيود في أداة الاستقبال الخاصة به.
لقد اخترنا عدم ذكر الأسماء للمنظمات المشاركة في الأمثلة التالية لتجنب كشف نقاط الضعف في أنظمتها، وذلك بناءً على طلبها. لذلك، نقدم أيضًا تفاصيل أقل عن كل حالة من الحالات المعروضة. بعض الحالات المذكورة أدناه تتعلق بمواقع إلكترونية تديرها وكالات حكومية أمريكية على المستوى الفيدرالي والولائي والمحلي. لقد أبلغنا البيت الأبيض بهذه الحالات، وأخبرنا كل الوكالات المشاركة.
الحالات التي حددناها حتى الآن في هذه الفئات كانت لها تأثير ضئيل في العالم الحقيقي. نعتبر هذه السلوكيات أقل خطورة من الناحية المتوافقة والأمنية مقارنة بالحوادث الأمن السيبراني التي تم الإبلاغ عنها في 30 يوليو و9 سبتمبر. هذه السلوكيات تشبه السلوكيات التي وصفناها في بطاقات النظام منذ مقدمة Claude Mythos. معظمها أشكال من الاستمرارية، حيث يقوم Claude، عندما لا يستطيع إكمال المهمة كما هو مطلوب، بالتغلب على القيود بدلاً من التوقف.
على الرغم من أن تأثير هذه السلوكيات كان ضئيلاً، وقد قمنا بالفعل بإيقاف الوصول إلى الإنترنت المباشر للتقييمات الخاصة بالمخاطر العالية وأمن الشبكات، إلا أننا قررنا الآن توسيع ذلك ليشمل جميع التقييمات الداخلية حتى نتأكد من أن تدابير الأمان والمراقبة لدينا (التي تم وصفها في قسم التصحيح في هذه المنشور) تعمل بشكل موثوق لالتقاط مثل هذه السلوكيات. أدناه، نناقش أيضًا اعتبارات التماسك وندرج تفاصيل أكثر حول كيفية تعديل التدريب لتقليل احتمال السلوك الخاطئ الإضافي.
لقد حددنا معظم هذه الحالات من خلال مراجعة السجلات الصوتية التي بدأناها في يوليو. ركزت مراجعتنا أولاً على تقييمات الأمن السيبراني – اختبارات يتم فيها طلب من النموذج أن يتحقق من النظام الاختباري أو يهاجمه، مع إيقاف الوصول إلى الإنترنت. لقد وسعنا بعد ذلك نطاق الفحص ليشمل مجموعة أوسع من الحالات التي كان يمكن فيها لكلود الوصول إلى الإنترنت، بما في ذلك الاختبارات التي يتم فيها تفعيل وصول الإنترنت عن قصد حتى يمكن تقييم كلود في مهام حقيقية. بدأنا بالبحث عن حوادث من نفس درجة الخطورة التي تم الإبلاغ عنها هذا الصيف في حوادث الأمن السيبراني؛ ولم نجد أي منها حتى الآن. ثم وسعنا البحث إلى الحالات ذات الخطورة الأقل، حيث تفاعل النموذج مع مواقع الويب أو الأنظمة الحقيقية بطرق لم نقصدها.
نقوم أيضًا الآن بفحص مجموعة أكبر من النصوص ذات المخاطر المنخفضة، بالإضافة إلى استخدام Claude في Anthropic وبيئات التعلم التصاعدي (RL) حيث لدى Claude إمكانية الوصول إلى الإنترنت. مع استمرار هذا العمل، نخطط للإبلاغ عن حالات جديدة من السلوكيات غير المتوقعة. جميع الحالات المذكورة هنا تتضمن تفاعل Claude مع العالم الخارجي؛ وحسب علمنا، لم تكن أي منها تشمل بيانات العملاء أو الأنظمة الداخلية لشركة Anthropic.
في هذه المقالة، نوضح سبب إجراء التقييمات، حيث حدثت معظم الحالات هناك؛ ونصف كل سلوك بمزيد من التفصيل؛ ونقدم نظرة أولية حول ما يعنيه هذه السلوكيات بشأن توجه كلود وكيف نعالجها.
لماذا وكيف نجري التقييمات
السلوكيات المذكورة في هذه المقالة ليست خاصة بالتقييمات فقط، بل العديد من الحالات التي حددناها حتى الآن حدثت أثناء تشغيل التقييمات. نختبر النماذج باستمرار على مجموعة واسعة من المهام قبل إصدارها. نستخدم العديد من التقييمات المختلفة (مجموعات مهام موحدة، تقييمات تتم بنفس الطريقة في كل مرة)، وكل منها يساعد في تقديم صورة عن مهارات كلود في مجال معين. العديد من التقييمات التي نستخدمها علنية؛ فهي من كتابة باحثين خارجيين ويمكن لأي مطور تشغيلها، مما يسمح لنا بمقارنة القدرات بين النماذج. أما التقييمات الأخرى التي نبنيها داخليًا.
بما أن نماذج اللغة غير تحديدية، أي أن ردودها تتضمن دائمًا عنصرًا من العشوائية، وقد تنفذ نفس المهمة بطريقة مختلفة قليلاً في كل مرة، فإننا نقوم بتنفيذ مهمة التقييم على كلواد لآلاف المرات (ويُطلق على كل محاولة اسم "تشغيل"). إن اختبارها بعدد كبير من المرات يسمح لنا بفهم كيفية أداء النموذج عادةً، كما يسمح لنا أيضًا بالكشف عن الحالات النادرة التي يقوم فيها النموذج بأمر لا نتوقعه. ما نتعلمه من التقييمات يؤثر على القرارات في Anthropic، بما في ذلك كيفية تدريب النماذج، والاحتياطات التي نقوم ببنائها حولها، والوقت الذي ننشر فيه النماذج.
تكون التقييمات أيضًا المكان الذي تظهر فيه مشاكل السلوك للنموذج أولاً أحيانًا. يتعلم النموذج الكثير مما يمكنه فعله من خلال التعلم العميق، حيث يحاول تنفيذ مهمة في بيئة معينة مرات عديدة ويحصل على مكافأة عند نجاحه. لكن بيئات التدريب غير مثالية. إذا كانت المكافآت أثناء التدريب تشير إلى شيء لم نقصده، مثل اكتشاف الثغرات أو تجاوز القيود، فإن النموذج سيتعلم أن هذه الطرق تؤدي إلى نتائج جيدة ويمكنه تطبيقها في أماكن أخرى. يُعرف هذا بأنه هجوم على المكافآت. بينما لدينا إجراءات لتحديد واستبعاد هجوم المكافآت أثناء التدريب، فإن التقييمات تُعدّ آلية حاسمة لفهم الاتجاهات السلوكية للنموذج في سياقات وأحجام مهام مختلفة عن تلك التي نجدها أثناء التدريب.
بعض المهام – مثل البحث على الإنترنت عن معلومات صعبة الإيجاد – من الصعب محاكاتها بشكل واقعي في بيئة بدون اتصال بالإنترنت. أما تنفيذها مع الاتصال بالإنترنت فقد كانت ممارسة قياسية داخل الصناعة: يتم إجراء اختبارات البحث العلني على الإنترنت المباشر بشكل افتراضي، ويمكننا من خلال تنفيذها بنفس الطريقة مقارنة نماذجنا مع نماذج أخرى. حدثت معظم الحالات المذكورة في هذا التقرير أثناء هذه التقييمات.
نظرة عامة على السلوكيات
أدناه، نصف أربع فئات من السلوك الذي اتخذه كلود على المواقع والأنظمة الحقيقية بطرق لم نقصدها، وكل منها يتضمن منظمة أو شخص خارج أنتاربيك.
استغلال عيب أساسي في البرنامج لتنفيذ الأوامر على الخادم
عندما لم يستطع كلود إكمال مهمة التقييم مباشرة، سواء لأن أدواته الخاصة كانت محدودة عمدًا أو لأن الخدمة الخارجية التي يحتاجها غير متوفرة، فقد استخدم أدوات أخرى موجودة على موقع طرف ثالث لتحقيق هدفه. في بعض الحالات، فعل ذلك باستغلال العيوب البسيطة في برمجيات ذلك الموقع، باستخدام SQL أو تسميم الأوامر (طريقة إرسال مدخلات يعمل بها الموقع بشكل خاطئ كأوامر).
على سبيل المثال، طلب أحد التقييمات من Claude Mythos Preview إجراء تحليل علمي. الأداة العامة التي يحتاجها لتنفيذ ذلك التحليل كانت موجودة على يد جامعة؛ عندما حاول النموذج الوصول إليها، أعادت الأداة رفضًا. بحثًا عن طريقة أخرى لإنجاز المهمة، استكشف Claude موقع الأداة، ووجد برنامجًا على خادم الجامعة يمكنه إرجاع أي ملف يُطلب، وقام باستخدامه لنسخ الملفات من الخادم، بما في ذلك كود البرنامج نفسه. في ذلك الكود، وجد كلود عيب التسرب الذي يسمح له بتنفيذ الأوامر على الخادم، واستخدمه لتنفيذ الحسابات.
في حالة أخرى، كانت البيانات التي يحتاجها كلود ميثوس 5 مجانية، لكن كلود لم يستطع الوصول إليها دون قبول اتفاقية استخدام البيانات، وهو لا يملك الأدوات اللازمة لذلك. استخدم كلود تطبيقات موجودة على الموقع الإلكتروني لتحميل الصفحة وقبول الاتفاقية نيابة عنه.
لقد رأينا هذا السلوك في DeepSearchQA وBrowseComp (كلا منهما تقييمات بحثية عبر الإنترنت عامة)، وفي LABBench2 (معيار بحثي علمي عام)، وكذلك خلال التقييمات الداخلية.
تقديم نموذج لا ينبغي أن يتمه
لقد رأينا حالات حيث قام كلود بإرسال نموذج عبر الإنترنت عندما لا ينبغي ذلك. بشكل عام، يحدث هذا عندما تكون تعليمات التقييم غامضة، أو عندما تعطل إعداد البيئة مما يجعل كلود لا يستطيع العمل مع نماذج وهمية.
على سبيل المثال، في حالة حدثت عدة مرات خلال تقييم معين، كان الهدف من نموذج بحث غير منشور وغير حدودي هو إكمال نسخة عمل من نموذج حكومي. عندما فشل النسخة في التحميل أو أغلق النموذج عن طريق الخطأ، فإن النموذج كان يتوجه بدلاً من ذلك إلى الموقع الإلكتروني الذي يتم عادةً استضافة النموذج الحقيقي عليه، ويتم تقديم النموذج هناك.
في تقييم آخر، تم توجيه كلود هايوك 4.5 لإكمال نموذج بيانات حتى مرحلة الإرسال النهائي، ولكنه توقف قبل إرساله فعليًا. في عدة مرات، قام كلود بإرسال النموذج بشكل خاطئ، ظنًا منه أن هناك صفحة تأكيد إضافية. في هذه الحالات، أشار تسلسل الفكر لدى النموذج إلى أنه يظهر العملية فقط، وليس يرسل طلبًا حقيقيًا.
في مثال ثالث من هذا السلوك، تم تكليف كلود هايوكو 4.5 بإنشاء تنفيذ مهام نموذجية على صفحات ويب مختارة عشوائيًا. في إحدى الجولات، وقع النموذج على صفحة تشير إلى جريمة قتل غير محلولة؛ وكانت تلك الصفحة تحتوي على نموذج تقديم المعلومات يديره قسم شرطة. تم توجيه كلود بعدم تسجيل الدخول، إنشاء حسابات، إدخال بيانات شخصية، شراء أي شيء، أو تقديم أي شيء ضار، لكن التعليمات لم تستبعد إرسال النماذج. ملأ كلود النموذج كالتالي: “ربما لدي معلومات بخصوص هذه القضية. أتذكر أنني رأيت شخصًا يتطابق مع الوصف في المنطقة المحيطة [الشارع المذكور على الصفحة] خلال تلك الفترة. يرجى الاتصال بي إذا كانت هذه المعلومات مهمة.” (لم يُدرج الموقع الإلكتروني وصفًا للجاني.) ترك النموذج حقول الاسم والاتصال فارغتين، وهو ما يسمح به النموذج، ثم قام بتقديمه. تم تمييز الإرسال كرسائل مزعجة، ولم يتم إعادة إرساله لإجراء التحقيق.
لقد رأينا هذا السلوك في OSWorld (تقييم استخدام الكمبيوتر العام)، وفي Odysseys (تقييم المهام طويلة المدى)، وخلال الاستخدام الداخلي.
التصرف حول القيود للوصول إلى البيانات المغلقة
أحيانًا كان كلود يحاول تجاوز قيود لالحاق بالبيانات التي لا يتوفر له إمكانية الوصول إليها. عادةً، يحدث ذلك عندما يرفض الخادم طلب كلود، أو عندما تُقدَّم البيانات مقابل رسوم.
على سبيل المثال، في تقييم تم طلبه من Claude Mythos 5 لتحديد موقع مُظهر في صورة، حاول التطبيق الوصول إلى خريطة ممتلكات الحكومة المحلية لإجراء تحديد دقيق للأخطاء. يمكن لـ Claude قراءة نصوص الصفحات الإلكترونية، لكن التقييم قيّد قدرته على النقر عليها كما يفعل الشخص. بدلاً من ذلك، قرأ ملف الإعدادات الذي يرسله الموقع إلى المتصفحات، وجد تواقيع الوصول الفعالة، واستخدمها لإرسال طلبات مباشرة إلى الخادم الذي يقف وراء الخريطة للوصول إلى البيانات.
في مثال آخر على هذا السلوك، استخدم باحث من مجموعة Anthropic برنامج Claude Mythos 5 في مشروع إحصائي، وطلب منه استخراج بيانات عامة متاحة من وكالة حكومية مقابل رسوم. بدلاً من ذلك، تعلم Claude من نسخة محفوظة من موقع الوكالة الإلكتروني أن لوحة التحكم العامة تُرسل رمز وصول لأي زائر. طلب Claude رمز الوصول واستخدمه للاستعلام عن قاعدة البيانات دون دفع الرسوم.
في كلا المثالين، حصل كلود على بيانات متاحة للعامة بالفعل، لكن مقابل رسوم معينة.
لقد رأينا هذا السلوك في اختبار الإنسانية الأخير، وهو تقييم لأسئلة أكاديمية على مستوى الخبراء، وكذلك أثناء الاستخدام الداخلي.
استخدام خدمات اختصار الروابط
بعض أدوات الاستقبال الخاصة بنا التي تسمح لـ Claude بقراءة الصفحات الإلكترونية، تحد من طول روابط URL التي يمكن لـ Claude طلبها. وذلك لمنع Claude من استخدام روابط URL طويلة لإجراء بعض الأفعال غير المرغوب فيها، مثل إدخال الكودات SQL أو الأوامر (جزء من الرابط هو نص يُمرر إلى خادم الموقع، والرابط الطويل يوفر مساحة لحمل هذه الأوامر). لقد رأينا عدة نماذج، بما في ذلك Claude Opus 5 وClaude Mythos 5، تتخطى هذا الحد باستخدام خدمات تقصير الروابط المجانية. لقد اكتشفنا هذا السلوك من الداخل أولاً، ولكن أثناء كتابة هذه المقالة، أخبرنا أحد موظفي خدمة تقصير الروابط da.gd أنهم أيضًا لاحظوا استخدام كلود لهذا الغرض على موقعهم الإلكتروني. نشكر الموظف على مشاركته هذه التفاصيل.
التصحيح
لقد اتخذنا عدة تدابير وقائية. بعض التقييمات العامة لم نعد تنفيذها؛ أما البعض الآخر، فقد تم تحويله إلى نسخ غير عبر الإنترنت، أو إعادة بنائه بحيث لا تصل مهامه إلى المواقع الإلكترونية الحية. كما قمنا بإجراء تغييرات أوسع. لقد قمنا بتحديث القيود على بعض أدوات الوصول إلى الإنترنت، مثل أداة web fetch، لتقييد ما يمكن للنموذج فعله بها بشكل شديد. وكم part من جهودنا المستمرة في أمان ومراقبة العملاء، قمنا ببناء أدوات تكتشف وتعيق تلقائيًا الأنواع من السلوكيات المذكورة أعلاه. تُشغل هذه الأدوات الآن في معظم التقييمات لدينا، وفي الاستخدام الداخلي للنماذج الحديثة. عندما اختبرناها ضد الحالات الموصوفة في هذا البوست، قامت بمنعها جميعًا.
كما شرحنا في 31 أغسطس نشرنحن أيضًا نواصل إصلاح أو إزالة بيئات التدريب التي تكافئ كلود على التعامل مع قيود الأدوات أو العقبات الأخرى، حتى لا تكون هذه البيئات حافزة لهذه السلوكيات أو تسمح باختراق الجوائز.
نقوم أيضًا باتخاذ إجراءات أخرى لمنع الأفعال غير المقصودة من الوكالات داخل Anthropic، وللكشف عنها إذا حدثت. وتشمل هذه الإجراءات انتقال الوكالات الداخلية إلى بنية تحتية مُدارة مركزياً بإجراءات احتواء قوية، وتقليل الوصول إلى الإنترنت للوكالات الداخلية وعمليات التدريب، ومراقبة المزيد من أفعال الوكالات من خلال تقنيات مثل مفسرات الأمان والتلخيص التسلسلي. أصبحت هذه الإجراءات جزءًا من إجراءات الكشف والاستجابة لفريق الأمان لدينا، حتى نتمكن من الاستجابة والاحتواء السريع للسلوك غير المرغوب فيه. نتوقع نشر المزيد حول هذه الأساليب، وبنائها مباشرة في منتجاتنا.
استخلاصات من المناقشة والتوافق
على الرغم من أننا لم نكمل تقييم التطابق الكامل لهذه الحالات، إلا أننا نعتبرها أقل خطورة من حوادث الأمن السيبراني التي حدثت هذا الصيف. نوضح السبب أدناه، ونشارك الدروس العامة التي استخلصنا منها.
سياق التموضع
عندما نقوم بإنشاء عملية تقديم تقارير عامة منتظمة للسلوكيات من هذا النوع، نريد أيضًا تحديد درجة خطورتها. يظل هذا أمرًا صعبًا: فتقييم مدى فشل التوافق غالبًا يعتمد على ما كان المحلل يحاول فعله، كما أن سرد المحلل لمنطقه ليس بالضرورة دليلًا موثوقًا بصحة معتقداته أو أسباب تصرّفه، كما ناقشنا في تقييم التوافق الذي نشرناه في 9 سبتمبر: تقييم التوافق. مع تطور قدرة المحللات، يمكنها التفاعل مع العالم بطرق أكثر تعقيدًا، مما يجعل الأخطاء المعقدة أكثر احتمالًا. على سبيل المثال، المنطق التحيز الذي وصفناه في ذلك التقييم لم يكن جديدًا، لكنه أدى إلى عواقب خطيرة في بيئة يمكن للمحللات فيها التصرف بشكل فعّال على الأنظمة الحقيقية لساعات. قد تصبح إطار عمل لتقييم خطورة التوافق بناءً على أخطاء اليوم قديمًا بسرعة، نظرًا للتقدم السريع في قدرات الذكاء الاصطناعي.
ومع ذلك، وجدنا عمودين للتوافق مفيدين لفحص الحالات في هذه المقالة: التجاوز المفرط، أو مدى ما تخطاه النموذج من ما كان متوقعًا له من مهمة، والغش، أو ما إذا كان قد قدم تفسيرًا مضللًا لأفعاله نواياه. فيما يتعلق بالتجاوز المفرط، نعتبر هذه الحالات أقل خطورة بكثير من الحوادث التي أبلغنا عنها هذا الصيف، حيث حصل كلود على وصول إلى أنظمة طرف ثالث حقيقية لساعات خلال تقييمات الأمن السيبراني. في الحالات التي نذكرها هنا، على العكس، تغلب كلود على أمن التحكم للوصول إلى البيانات المُحظورة ولكن المتاحة علنًا، أو استغل عيوب البرمجيات وأدخل أوامر على الخوادم (خاصة للوصول إلى بيانات غير حساسة).
فيما يتعلق بالقصور في الأمانة، فإن المقارنة أكثر تعقيدًا. في إحدى الحالات، عندما تم تكليف كلود بإنشاء تفاعلات نموذجية مع المواقع الإلكترونية، قدم كلود نصًا مُختلقًا من خلال نموذج عبر الإنترنت تابع لإدارة الشرطة. من النصوص المسجلة، يبدو أن كلود كان يولد محتوى نموذجي فقط لأغراض المهمة، ولم يحاول إضلال أي شخص لتحقيق هدف ما. أما في الحادث الأكثر خطورة الذي وقع هذا الصيف، فقد استمرت الحجج المضللة التي قدمها كلود لساعات ودعمت هجمته المستمرة. ومع ذلك، فإن تقييم القصور في الأمانة بدقة عادةً يتطلب تقييمًا أعمق مما قمنا به هنا، مثل إعادة تشغيل النصوص المسجلة مع تعديلات لاختبار ما دفع النموذج للسلوك، بحيث قد تتغير وجهة نظرنا تجاه هذه الحالات مع تحليلات أكثر.
الدروس والخطوات التالية
لا توجد أي من السلوكيات التي وصفناها هنا جديدة، ولا تغير هذه السلوكيات رؤيتنا العامة حول توافق كلود. في العديد من الحالات التي لاحظنا فيها هذه السلوكيات، كان على كلود أن يقوم بمهام غامضة أو مستحيلة الإنجاز. لقد لاحظنا أيضًا أن النماذج عندما تُعطى مهام مستحيلة الإنجاز، فإنها تتبع استراتيجيات غير مقصودة وأحيانًا غير متوافقة مع الأهداف.
من الممكن أن كان من الممكن تجنب بعض هذه الأخطاء إذا تم توضيح أسئلة التقييم بشكل أوضح عما يقع ضمن نطاق التمرين وما خارجه، بما في ذلك الأهداف والإجراءات المسموحة وحدود الشبكة (أي ما يجب وما لا يجب على النموذج الوصول إليه). ومع ذلك، يواجه كلود مهامًا غامضة وغير ممكنة يوميًا في الاستخدام الفعلي، وفي الواقع، حدثت عدة حالات من هذه الحالات أثناء استخدام كلود كأداة عاملة بشكل طبيعي.
تدريب السلوك والتوافق هو التقنية الرئيسية التي لدينا للتحسين من حكم كلود وقدرته على التعامل مع الحالات الغامضة بعناية. منذ تاريخياً، ركزنا أكثر على تعليم النماذج احترام الحدود والحذر المناسب في بيئات البرمجة. الآن نوسع هذه البيئات إلى تطبيقات مثل البحث واستخدام الكمبيوتر، التي كانت ضمن الحالات المذكورة هنا. ومع ذلك، فإن تدريب التوافق لا يكفي أو غير مضمون بشكل كامل بمفرده، على الأقل على المدى القصير، لذلك نعتمد أيضًا على نهج الدفاع المتعدد الطبقات، بما في ذلك المفسرات والحمايات المذكورة أعلاه.
نخطط للاستمرار في تقديم تقارير حول السلوكيات أثناء استمرار الفحص والتحليل. نأمل أن تساعد هذه التقارير المطورين الآخرين في فحص السلوكيات المماثلة في نماذجهم، لأن العديد من التقييمات المعنية هي عامة وشائعة. وعلى الرغم من أن تأثير هذه الحالات كان ضئيلاً، إلا أننا لا نريد تقليل أهمية النتائج، لأن نفس السلوكيات قد تسبب ضررًا أكبر عندما تصبح النماذج أكثر قوة. كلما زاد دور النماذج في المجتمع، كان من الضروري أن يعرف الجمهور كيف تتصرف.
ملحوظة: يتعلق مثال شكل الإشارة المذكور أعلاه بإدارة شرطة فيلادلفيا، والتي أعلنت عن ذلك اليوم من خلال بيانها الصحفي. قمنا بمشاركة هذه النتيجة مع الإدارة في 8 أكتوبر، بمجرد اكتمال المراجعة التقنية لدينا.
المحتوى المرتبط
الخريطة المفقودة للسماء
بريس مينارد، عالم الفيزياء الفلكية في جامعة جونز هوبكنز وباحث في شركة أنتروبيك، يشرح كيف تعاون مع كلود ساينس في إنتاج أول خريطة كاملة للسماء باستخدام الضوء فوق البنفسجي.
قرأ أكثرإطلاق خدمة اكتشاف الثغرات بالموافقة من أجل البرمجيات المفتوحة المصدر
نقوم بتوفير أداة OSS Scanner، وهي جهاز مسح للثغرات يُطلب من المستخدمين التسجيل لاستخدامه، وذلك ضمن نظام النوافذ المفتوحة، وقد تم تطويرها استنادًا إلى خبرتنا في استخدام Claude لاكتشاف الثغرات أثناء مشروع Glasswing.
قرأ أكثرعلم على شكل كلود
يصف البروفيسور ماثيو شوارتز، الكاتب الضيف، ما حدث عندما توقف عن محاربة كلود وسمح لكلود بتجد مشاكل “بشكل كلود”: مشاكل تتناسب بأفضل شكل مع قدرات جيل الأدوات اللغوية الآلية الحالية. وقد أدى ذلك إلى بناء أداة BootLoops، وهي أداة لإجراء الحسابات الدقيقة في العلوم الكمية، وهو يستخدمها في مختلف المجالات العلمية بالتعاون مع الخبراء.
قرأ أكثر