أطلقت Anthropic وOpenAI وGoogle DeepMind 4 نماذج من الفئة الرائدة خلال 30 يوماً. Claude Fable 5.1 وصل في 1 سبتمبر. GPT-6 Astra تبعه في 3 سبتمبر. GPT-6.1 Sol و Gemini 4 Argon حطّا في الأيام الأخيرة من سبتمبر.
غطّينا كل إطلاق على حدة. هذا المقال يضعها جنباً إلى جنب. درجات المعايير المرجعية تتداخل أكثر مما تشير إليه منشورات الإطلاق، أما الأسعار وقواعد الوصول والتكلفة لكل مهمة فلا تفعل.
يؤطّر تغيير واحد التشكيلة. ألغت OpenAI GPT-6.1 Astra في 28 سبتمبر بعد أن رسب في اختبارات النطاق والتفويض الداخلية. يبقى GPT-6 Astra نموذج OpenAI الأعلى في الوقت الحالي.
المواصفات والتسعير والوصول
تشترك Astra وFable 5.1 في السعر القياسي نفسه: 10 دولارات للمدخلات و50 دولاراً للمخرجات. أما Sol وArgon فمسعّران بخُمس ذلك. سعر Argon تمهيدي وسيتضاعف لاحقاً.
| الميزة | GPT-6 Astra | GPT-6.1 Sol | Gemini 4 Argon | Claude Fable 5.1 |
|---|---|---|---|---|
| المطوّر | OpenAI | OpenAI | Google DeepMind | Anthropic |
| تاريخ الإصدار | 3 سبتمبر 2026 | 29 سبتمبر 2026 | أُعلن عنه في 30 سبتمبر 2026 | 1 سبتمبر 2026 |
| الوصول | OpenAI API وChatGPT وCodex | OpenAI API وChatGPT Work وCodex | برنامج Fairwind فقط | Claude API وBedrock وGoogle Cloud وMicrosoft Foundry |
| الإدخال / الإخراج (لكل 1M) | $10 / $50 | $2 / $10 | $2 / $10 تمهيديًا، ثم $4 / $20 | $10 / $50 |
| الإدخال المخزّن مؤقتًا (لكل 1M) | $1.00 | $0.10 | $0.10 تمهيدي | $0.25 |
| تسعير الأوامر الطويلة | فوق 272K: $20 / $75 | فوق 272K: 2x للإدخال، 1.5x للإخراج | غير معلن | ثابت حتى 1M |
| نافذة السياق | 1.05M | 1.05M | غير معلن | 1M |
| الحد الأقصى للإخراج لكل استجابة | 128K | 128K | 1M | 128K |
| التحكم في الاستدلال | 5 مستويات جهد، من منخفض إلى أقصى | 5 مستويات جهد، من منخفض إلى أقصى | غير معلن | مستويات جهد تشمل منخفض ومتوسط وعالي |
| أوزان مفتوحة | لا | لا | لا | لا |
المصادر: تغطية OpenAI GPT-6.1 Sol, تغطية Gemini 4 Argon, تسعير GPT-6 Astra للسياق الطويل, مواصفات Claude Fable 5.1. أسعار القوائم الرسمية من الطرف الأول، فئة السياق القصير.
صف الإدخال المخزّن مؤقتًا هو الأهم للوكلاء. يعيد الوكلاء إرسال مطالبات النظام ومخططات الأدوات والسجل في كل خطوة. سعر القراءة من ذاكرة التخزين المؤقت لدى Astra البالغ 1.00 دولار يعادل 4 أضعاف Fable 5.1 و10 أضعاف Sol.
سقف مخرجات Argon البالغ 1M هو الحالة الشاذة الهيكلية الوحيدة. أما النماذج الـ 3 الأخرى فتتوقف عند 128K رمز لكل استجابة.
المعايير القياسية: أين يتفوق كل نموذج
لا يوجد نموذج يجتاح جميع المجالات. يتصدر Argon صفوف العمل المعرفي والبرمجة طويلة المدى. وتتصدر Astra هندسة البرمجيات الرائدة واستخدام الحاسوب. أما Opus 5.5، غير المدرج في هذه التشكيلة، فيتصدر Terminal-Bench 4.0.
| المعيار القياسي | ما يختبره | Gemini 4 Argon | GPT-6 Astra | Claude Fable 5.1 |
|---|---|---|---|---|
| DeepSWE v1.1 | هندسة البرمجيات طويلة المدى | 77.9% | 74.1% | 67.4% |
| Vals Index | أعمال المالية والبرمجة والقانون والضرائب | 68.9% | 63.1% | 65.8% |
| FrontierSWE v2 | هندسة البرمجيات الرائدة | 55.0% | 65.5% | 56.3% |
| Terminal-Bench 4.0 | العمل الوكيلي في الطرفية | 57.4% | 58.2% | 57.9% |
| CWE-bench v1 | معالجة الثغرات الأمنية | 68% (تعادل) | 68% (تعادل) | 58% |
| OSWorld-2.0 | استخدام الحاسوب | 69.2% | 72.6% | غير موجود في جدول Google |
المصدر: المقارنة المنشورة من Google DeepMind، كما ورد في تناولنا لـ تغطية Gemini 4 Argon. أرقام أبلغ عنها المورّد.
GPT-6.1 Sol ليس موجوداً في جدول Google. أرقام OpenAI الخاصة تضعه قريباً من Astra:
- DeepSWE v1.1: Sol يضاهي Astra بنحو خُمس التكلفة.
- OSWorld 2.0 المجموعة دون الاتصال: Sol يقع ضمن 2.1 نقطة من Astra بنحو سُدس التكلفة لكل مهمة.
- AutomationBench 1.0.6: Sol يسجل 2.2 نقطة فوق Claude Opus 5.5 بمستوى جهد متوسط.
- Terminal-Bench Science 0.1: لا تزال Astra في الصدارة بنسبة 68.1%. توصي OpenAI باستخدام Astra لأصعب الأبحاث.
الإشارات المستقلة تشير إلى عكس ذلك فيما يخص الذكاء الخام. على Artificial Analysis مؤشر الذكاء، تحصل Astra على 61. بينما تحصل Fable 5.1 على 5 نقاط أعلى. وعلى مؤشر وكلاء البرمجة الخاص بها، تسجل Fable 5.1 في Claude Code درجة 70 مقابل 67 لـ Astra. كما تُبلغ Artificial Analysis أيضاً أن Argon يوازي Astra على مؤشر الذكاء.
على ARC-AGI-2، تسجل Astra نسبة 95% بينما تسجل Fable 5.1 نسبة 90%.
التكلفة لكل مهمة: نفس سعر القائمة، فاتورة مختلفة
تقدّر Artificial Analysis تكلفة Claude Fable 5.1 بـ $9.18 لكل مهمة، مقابل $4.72 لـ GPT-6 Astra. أي نحو 1.9x، بأسعار قائمة متطابقة.
تأتي الفجوة من حجم الرموز (tokens) وليس من الأسعار. تُحتسب التكلفة لكل مهمة بضرب السعر في عدد الرموز المستهلكة. وبتساوي الأسعار، فإن الفجوة تعني أن Fable 5.1 استهلكت رموزاً أكثر لكل مهمة في تلك الجولة. كما تشير Anthropic إلى أن أداة الترميز (tokenizer) الأحدث لديها تنتج نحو 30% رموزاً إضافية لنفس النص.
النموذجان الأرخص يغيّران الصورة أكثر:
- Gemini 4 Argon: تُبلغ Artificial Analysis أن Argon يوازي مؤشر الذكاء الخاص بـ Astra مقابل 60% من تكلفة Astra لكل مهمة، باستخدام الأسعار التمهيدية.
- GPT-6.1 Sol: على Terminal-Bench Science، تُبلغ OpenAI عن $5.47 لكل مهمة لـ Sol مقابل $23.80 لـ Astra.
يمكن أن يعكس التخزين المؤقت (Caching) ترتيب الوكلاء. الأرقام الخاصة بكل مهمة أعلاه لا تأخذ في الحسبان إعادة الاستخدام الكثيف للذاكرة المؤقتة. الوكيل طويل الأمد يعيد قراءة نفس السياق في كل خطوة. إليك الحساب لسياق مخزّن مؤقتًا بحجم 200K من الرموز (tokens)، قبل رموز المخرجات:
| النموذج | السعر المخزّن مؤقتًا (لكل 1M) | لكل خطوة | لكل 100 خطوة |
|---|---|---|---|
| GPT-6 Astra | $1.00 | $0.20 | $20.00 |
| Claude Fable 5.1 | $0.25 | $0.05 | $5.00 |
| GPT-6.1 Sol | $0.10 | $0.02 | $2.00 |
| Gemini 4 Argon (التأسيسي) | $0.10 | $0.02 | $2.00 |
حساب توضيحي مستند إلى أسعار قائمة الذاكرة المؤقتة. سياق Astra البالغ 200K من الرموز يبقى تحت حد المطالبات الطويلة الخاص به البالغ 272K.
في الحلقات كثيفة استخدام الذاكرة المؤقتة، يقرأ Fable 5.1 السياق بربع سعر Astra. قِس كليهما على بياناتك التتبعية الخاصة قبل أن تحسم اختيارك بناءً على العناوين الرئيسية لكل مهمة.
أي نموذج لأي مهمة
اختر حسب نوع العمل، لا حسب الترتيب في لوحة المتصدرين. GPT-6.1 Sol هو الخيار الافتراضي لمعظم الفرق. النماذج الـ 3 الأخرى تستحق سعرها في مهام أضيق نطاقًا.
| المهمة | الاختيار | السبب | البديل الثاني |
|---|---|---|---|
| وكلاء البرمجة عالية الحجم، روبوتات CI، مراجعة طلبات السحب (PR) | GPT-6.1 Sol | يوازي Astra على DeepSWE v1.1 بسعر $2 / $10 وبسعر مخزّن مؤقتًا قدره $0.10 | Gemini 4 Argon، بمجرد إتاحته للعموم |
| أصعب المهام الهندسية المفتوحة | GPT-6 Astra | يتصدر FrontierSWE v2 بنسبة 65.5% | Claude Fable 5.1 |
| استخدام الحاسوب ووكلاء المتصفح | GPT-6 Astra | يتصدر OSWorld-2.0 بنسبة 72.6% | GPT-6.1 Sol، بفارق 2.1 نقطة |
| جلسات البرمجة الطويلة داخل إطار عمل (harness) | Claude Fable 5.1 | أعلى نتيجة (70) في تقييم وكيل البرمجة من Artificial Analysis في Claude Code؛ و0.25 دولار لقراءات الكاش | GPT-6 Astra (67) |
| العلوم والبحث الصارمين | GPT-6 Astra | يتصدر Terminal-Bench Science بنسبة 68.1% | GPT-6.1 Sol بسعر 5.47 لكل مهمة |
| أتمتة القانون والمالية والأعمال | Gemini 4 Argon | يتصدر Vals Index (بنسبة 68.9%) وAutomationBench (بنسبة 51.3%) وHarvey Legal (بنسبة 19.6%) | GPT-6.1 Sol؛ وClaude Fable 5.1 |
| المخرجات الفردية الطويلة جداً: إعادة الهيكلة الكبيرة والتقارير الكاملة | Gemini 4 Argon | النموذج الوحيد الذي يقدم 1M من رموز الإخراج لكل استجابة | أي من النماذج الـ 3 الأخرى، مع التقسيم على عدة محادثات |
| اكتشاف الثغرات وإصلاحها | Gemini 4 Argon أو GPT-6 Astra | متكافئان بنسبة 68% على CWE-bench v1 | Claude Fable 5.1 (بنسبة 58%) |
| أضيق ميزانية عند جودة الحد الأقصى | GPT-6.1 Sol | أقل سعر عام؛ وArgon يضاهيه فقط داخل Fairwind | Gemini 4 Argon |
الوصول يحسم 2 من هذه الصفوف. Argon متاح اليوم فقط لمدافعي الأمن السيبراني في Fairwind. وتقع القدرة الكاملة لـAstra في الأمن الهجومي خلف برنامج Daybreak من OpenAI؛ أما الإصدار العام فيرفض مهام الاختراق السيبراني الهجومي المتقدمة. وتقصر Anthropic نموذجها التوأم غير المقيَّد، Claude Mythos 5.1، خلف برامج الوصول الموثوق.
ما يجب التحقق منه قبل التبديل
معظم الأرقام هنا من تقارير المورّدين، والمورّدين يختلفون في الهوامش. تذكر OpenAI أن Astra حقق 57.9% على Terminal-Bench 4.0، بينما يدرج جدول المقارنة من Google نسبة 58.2%.
- إجراءات الحماية تؤثر في نتائج Fable 5.1: شغّلت Anthropic معاييرها القياسية مع تشغيل إجراءات الحماية الإنتاجية. وتُحوَّل مهام الأمن السيبراني والأحياء المُعلَّمة إلى نماذج Claude الأخرى، ما يُرجَّح أنه خفّض نتائج OSWorld وAutomationBench.
- تسعير Argon مؤقت: السعر 2 / 10 تمهيدي. سينتقل لاحقاً إلى 4 / 20، دون الإعلان عن تاريخ محدد.
- نافذة سياق Argon غير معلنة: نشرت Google حد الإخراج البالغ 1M لكنها لم تنشر حد الإدخال.
- التكاليف لكل مهمة هي لمحة لحظية: أرقام 9.18 دولار و4.72 دولار مصدرها تشغيل Astra في أوائل سبتمبر من Artificial Analysis. إعدادات الجهد تغيّرها كثيرًا.
- لدى Anthropic خيار أرخص: تغطيتنا لـ Argon تستشهد بتقارير تفيد بأن Claude Opus 5.5 يتفوق على Fable 5.1 في معايير الوكلاء الرئيسية بسعر API أقل. كما يتصدّر Terminal-Bench 4.0 بنسبة 66.4%.
الخلاصات الرئيسية
- GPT-6.1 Sol يضاهي Astra على DeepSWE v1.1 بخُمس السعر.
- GPT-6 Astra يتصدّر FrontierSWE v2 (65.5%) وOSWorld-2.0 (72.6%).
- يتصدر Gemini 4 Argon كلًا من DeepSWE وVals Index وAutomationBench، ولكن فقط داخل Fairwind.
- تكلّف Fable 5.1 مبلغ 9.18 دولار لكل مهمة مقابل 4.72 دولار لـ Astra، وبأسعار القائمة نفسها.
- بالنسبة للوكلاء المعتمدين بكثافة على التخزين المؤقت، يتجاوز سعر القراءة من الذاكرة المؤقتة في Fable 5.1 البالغ 0.25 دولار نظيره في Astra البالغ 1.00 دولار بتوازٍ يبلغ 4 مرات.
الأسئلة الشائعة
- أيها الأرخص؟ GPT-6.1 Sol، بسعر $2 للإدخال، و$10 للإخراج، و$0.10 للذاكرة المؤقتة لكل 1M رمز. أما Argon فيضاهي ذلك فقط بسعر التعريف، داخل Fairwind.
- أيهما الأفضل للبرمجة؟ Sol لكميات العمل الكبيرة. وAstra للمهام الأصعب. وتتصدر Fable 5.1 مؤشر وكلاء البرمجة لدى Artificial Analysis في Claude Code.
- هل يمكنني استخدام Gemini 4 Argon اليوم؟ فقط من خلال برنامج Fairwind التابع لشركة Google المخصص للمدافعين السيبرانيين.
المقال GPT-6 Astra مقابل GPT-6.1 Sol مقابل Gemini 4 Argon مقابل Claude Fable 5.1: أي نموذج حدودي يناسب أي وظيفة ظهر المقال لأول مرة على MarkTechPost.