تقديم Claude Haiku 5.5: أرخص وأسرع وأكثر النماذج الصغيرة قدرة التي أطلقناها على الإطلاق.
صُمم Claude Haiku 5.5 للمهام عالية الحجم والحساسة للتكلفة. يتعامل بموثوقية مع أعباء العمل السريعة والمتكررة (مثل الملخصات والضغط والاستعلامات عن قواعد البيانات وطلبات التصنيف). يتناغم جيدًا مع Opus 5.5 وSonnet 5.5 كوكيل فرعي في أعمال البرمجة. وبما أنه أيضًا أسرع نموذج لدينا حتى الآن، فهو يعمل بشكل ممتاز للمهام الحساسة للسرعة مثل دعم العملاء المباشر واستخدام المتصفح.¹
يتوفر Haiku 5.5 بسعر أقل بكثير من Haiku 4.5. في المتوسط، أصبحت تكلفة تشغيله الآن أقل بنحو 75%.²
وبالتعاون مع هذا الإطلاق، نجري تحسينات على قيمة مجموعة نماذجنا. نحن نُخفض بنسبة النصف سعر قراءات ذاكرة التخزين المؤقت لـ Claude Sonnet 5.5، مما يعني أن Sonnet 5.5 يعمل الآن بتكلفة أقل بنحو 20% في معظم الأعمال الوكيلة. كما نقدم رصيدًا شهريًا جديدًا لواجهة برمجة التطبيقات (API) لمشتركي Claude Max وTeam، مصممًا لدعم مستخدمينا في بناء وكلاء وتطبيقات جديدة تعمل على منصة Claude.
الأداء
إليك كيف يُظهر Claude Haiku 5.5 أداءه عبر مجموعة من المعايير المرجعية:
| Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5للمرجعية | |
|---|---|---|---|---|
| العمل المعرفيGDPval-AA v2.1 | 1620 | 735 | 1437 | 1840 |
| العمل المعرفيAA-Briefcase v1.1 | 1578 | 614 | 1336 | 1824 |
| استخدام الحاسوبOSWorld 2.1 | 72.4%المجموعة غير المتصلة | 15.7%المجموعة غير المتصلة | 48.9%المجموعة غير المتصلة | 83.9%المجموعة غير المتصلة |
| الاستدلال متعدد التخصصاتHumanity’s Last Exam | 45.9%بدون أدوات | 10.2%بدون أدوات | — | 56.9%بدون أدوات |
| 57.4%بالأدوات | 18.7%بالأدوات | — | 64.5%بالأدوات | |
| البرمجة الوكيلةTerminal-Bench 4.0 | 39.2% | 0.0% | 16.4% | 70.6% |
| البرمجة الوكيلةFrontierCode 1.1 (Main) | 46.4% | — | 42.4% | 52.1%Xhigh |
| الاستدلال البصريChartography | 46.4%بدون أدوات | 6.4%بدون أدوات | 29.1%بدون أدوات | 61.6%بدون أدوات |
للاطلاع على تفاصيل كيفية إجراء تقييماتنا، انظر بطاقة نظام Haiku 5.5.
يُعد Haiku 5.5 أول نموذج من فئة Haiku يأتي مع إعداد جهد قابل للتعديل. وهذا يعني أنه، كما هو الحال مع نماذجنا الأخرى، يمكن للمستخدمين أن يقرروا ما إذا كانوا يريدون تحسين التكلفة أو الذكاء. تُظهر المخططات أدناه أداء Haiku 5.5 على ثلاثة معايير قياس عند كل إعداد جهد:
يقيس OSWorld 2.1 مدى قدرة الوكلاء على تشغيل كمبيوتر حقيقي لإكمال مهام طويلة متعددة الخطوات.
يقيّم معيار GDPval-AA v2.1 من Artificial Analysis الوكلاء في أعمال مهنية واقعية عبر 44 مهنة.
امتحان البشرية الأخير (HLE) هو اختبار للمعرفة والاستدلال الأكاديميين على مستوى الخبراء.
في الاختبارات المبكرة، أفاد عملاؤنا بنتائج تتسق مع تحسينات الأداء والتكلفة الموضحة أعلاه. إليك ما أخبرونا به عن النموذج الجديد:
اقتباسالشركةAsanaالمؤلفAaron Vinh، مهندس برمجيات دائم“لقد أُبهرنا كثيرًا بـ Claude Haiku 5.5، ولا سيما سرعته. جربناه من خلال مجموعة تقييماتنا لمنتج AI Teammates، وهو منتج الوكلاء الذكي لدينا، والذي يغطي حالات استخدام مثل فرز الأخطاء وإعداد المشاريع والبحث في محافظ كبيرة لكشف العمل عالي المخاطر أو المتأخر. مقارنةً بالنموذج الذي نستخدمه اليوم، لاحظنا انخفاضًا يزيد عن 30% في زمن الاستجابة لإكمال المهام، وسرعة استدلال أعلى تصل إلى 2.5x لكل دورة وكيل. إنها تجربة أسرع بشكل ملحوظ.”
الأسعار
يوضح الجدول أدناه كيف تقارن أسعار Claude Haiku 5.5 بنماذجنا الأخرى. يقدم Haiku 5.5 قيمة استثنائية عند استخدامه للمهام ذات المطالبات التي تصل إلى 100,000 رمز، والتي تمثل حوالي 90% من الطلبات الموجهة إلى نموذج Haiku السابق لدينا.
| السعر لكل 1 مليون رمز | Haiku 5.5 مطالبات تصل إلى / تتجاوز 100k | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| قراءات ذاكرة التخزين المؤقت | $0.01 / $0.05 | $0.10 | $0.10 |
| كتابات ذاكرة التخزين المؤقت | $0.125 / $0.625 | $1.25 | $2.50 |
| رموز الإدخال | $0.10 / $0.50 | $1.00 | $2.00 |
| رموز الإخراج | $0.50 / $2.50 | $5.00 | $10.00 |
السلامة
المواءمة. يُظهر Claude Haiku 5.5 تحسينات كبيرة في تقريبًا جميع تقييمات المواءمة لدينا مقارنةً بـ Haiku 4.5. وعلى وجه الخصوص، وجدنا حالات أقل بكثير من السلوك غير المتوافق، وانخفاضًا في الاستعداد للتعاون مع سوء الاستخدام. تصف بطاقة النظام الخاصة بالنموذج عملية التقييم والنتائج بمزيد من التفصيل.
إجراءات الحماية. بما يتوافق مع قدراته، تُعدّ إجراءات الحماية السيبرانية في Haiku 5.5 أكثر تقييدًا من إجراءات الحماية في Haiku 4.5، ولكنها أقل تقييدًا إلى حد ما من تلك التي طبقناها على النماذج الحديثة الأخرى. في مجال الأمن السيبراني، تسمح هذه الإجراءات بمجموعة أوسع من المهام الدفاعية مقارنة بإجراءات الحماية الخاصة بنا لـ Sonnet 5.5، لكنها لا تزال تحظر اختبار الاختراق وغيره من التقنيات التي يُرجَّح أن يستخدمها المهاجمون.
إجراءات الحماية البيولوجية في Haiku 5.5 هي نفسها المطبقة في Sonnet 5 وSonnet 5.5 وOpus 5. فهي تسمح بأسئلة الأبحاث البيولوجية لكنها تقيد الطلبات التي نحكم بأنها من المرجح أن تسبب ضررًا. يمكن للمنظمات العاملة على أنشطة بيولوجية وسيبرانية أوسع نطاقًا التقدم إلى برنامج برنامج التحقق لعلوم الحياة و برنامج التحقق السيبراني.
التوافر
Claude Haiku 5.5 متاح الآن على جميع المنصات، بما في ذلك Amazon Web Services وGoogle Cloud وMicrosoft Azure. على منصة Claude، يمكن للمطورين البدء باستخدام claude-haiku-5-5.
اطلع على دليل الترحيل للتفاصيل.
تحديثات إضافية
إلى جانب أسعارنا الجديدة لـ Claude Haiku 5.5، نُجري تحسينات إضافية على القيمة التي تقدمها نماذجنا ومنتجاتنا.
أولاً، اعتبارًا من اليوم، نقوم بتخفيض سعر قراءات ذاكرة التخزين المؤقت على Claude Sonnet 5.5. تكلّف قراءات الكاش الآن أقل بنسبة 50%: 0.10 دولار لكل مليون رمز بدلاً من 0.20 دولار. ولأن قراءات الكاش تشكل حصة كبيرة من استهلاك النماذج للرموز، فهذا يقلل تكلفة Sonnet 5.5 في معظم المهام الوكيلة بنحو 20%.
على سبيل المثال، إليك ما يعنيه خفض السعر لأداء Sonnet 5.5 بالنسبة إلى التكلفة على Terminal-Bench 4.0:
يقيس Terminal-Bench 4.0 مدى قدرة النموذج على إتمام مهام مهنية معقدة ومتعددة الخطوات ضمن واجهة سطر الأوامر.
يوضح هذا المخطط فرقًا مهمًا بين Haiku 5.5 ونماذجنا الأكبر. يظل Sonnet 5.5 وOpus 5.5 خيارين أفضل لمهام البرمجة الوكيلة المعقدة مثل تلك التي يقيسها Terminal-Bench 4.0. في المقابل، يُعد Haiku 5.5 الأنسب للمهام الأكثر محدودية في النطاق والتي كانت قد تكون مكلفة للغاية مع الإصدارات السابقة من Claude—مثل الضغط أو التلخيص أو عمل الوكيل الفرعي.
ثانيًا، خلال هذا الأسبوع، سنطلق رصيدًا شهريًا جديدًا لواجهة برمجة التطبيقات لجميع مشتركي Max وTeam لاستخدامه على منصة Claude. سيحصل مستخدمو Max 5x على رصيد بقيمة 100 دولار شهريًا، ومستخدمو Max 20x على 200 دولار، وسيتلقى مشتركو Team ما يصل إلى 500 دولار مجمّعة عبر مستخدميهم. صُممت هذه الأرصدة للسماح لمستخدمينا بتجربة بناء أدوات وتطبيقات ووكلاء تستدعي واجهة برمجة التطبيقات لدينا. ويمكن استخدامها على أي من نماذجنا. لمزيد من المعلومات، اطلع على مقالنا في مركز المساعدة.
وبالنسبة للمطورين، نقوم أيضًا بتحديث حزمتينا Claude Python وType SDK لإضافة دعم استخدام الحاسوب واستخدام المتصفح في نسخة تجريبية. يتناسب Haiku 5.5 بشكل خاص مع هذه المهام، نظرًا لمزاجه من السرعة والقدرة والسعر. يمكنك قراءة المزيد حول هذا في وثائق منصة Claude لدينا.
الحواشي
1 Claude Haiku 5.5 هو أسرع نماذجنا حتى الآن بالسرعة القياسية لكل نموذج، على الرغم من أنه يعمل بسرعة أقل من نماذج Opus لدينا في الوضع السريع (Fast Mode).
2 يُسعَّر Claude Haiku 5.5 أقل بنسبة 90% من Claude Haiku 4.5 للطلبات التي تصل إلى 100,000 رمز، وأقل بنسبة 50% للطلبات التي تتجاوز 100,000 رمز. على Haiku 4.5، وقع 90% من الطلبات في الفئة الأولى. يراعي هذا الحساب أيضًا التغييرات بين Haiku 4.5 وHaiku 5.5 في عدد الرموز المستخدمة لإتمام عمل معين: يمتلك Haiku 5.5 مُرمِّزًا (tokenizer) محدثًا (مشابهًا لـ Sonnet 5.5 وOpus 5.5)، مما يعني أنه يستخدم رموزًا أكثر قليلًا لكل مهمة.
