MarkTechPostآخر تحديث

GPT-6 Astra مقابل GPT-6.1 Sol مقابل Gemini 4 Argon مقابل Claude Fable 5.1: أي نموذج رائد يناسب أي مهمة

تتصدر Astra استخدام الحاسوب، ويقود Argon أعمال القانون والتمويل، بينما يتفوق Sol في السعر لوكلاء البرمجة. ظهر المقال GPT-6 Astra مقابل GPT-6.1 Sol مقابل Gemini 4 Argon مقابل Claude Fable 5.1: أي نموذج رائد يناسب أي مهمة…

أطلقت Anthropic وOpenAI وGoogle DeepMind 4 نماذج من الفئة الرائدة خلال 30 يوماً. Claude Fable 5.1 وصل في 1 سبتمبر. GPT-6 Astra تبعه في 3 سبتمبر. GPT-6.1 Sol و Gemini 4 Argon حطّا في الأيام الأخيرة من سبتمبر.

غطّينا كل إطلاق على حدة. هذا المقال يضعها جنباً إلى جنب. درجات المعايير المرجعية تتداخل أكثر مما تشير إليه منشورات الإطلاق، أما الأسعار وقواعد الوصول والتكلفة لكل مهمة فلا تفعل.

يؤطّر تغيير واحد التشكيلة. ألغت OpenAI GPT-6.1 Astra في 28 سبتمبر بعد أن رسب في اختبارات النطاق والتفويض الداخلية. يبقى GPT-6 Astra نموذج OpenAI الأعلى في الوقت الحالي.

المواصفات والتسعير والوصول

تشترك Astra وFable 5.1 في السعر القياسي نفسه: 10 دولارات للمدخلات و50 دولاراً للمخرجات. أما Sol وArgon فمسعّران بخُمس ذلك. سعر Argon تمهيدي وسيتضاعف لاحقاً.

الميزةGPT-6 AstraGPT-6.1 SolGemini 4 ArgonClaude Fable 5.1
المطوّرOpenAIOpenAIGoogle DeepMindAnthropic
تاريخ الإصدار3 سبتمبر 202629 سبتمبر 2026أُعلن عنه في 30 سبتمبر 20261 سبتمبر 2026
الوصول‏OpenAI API وChatGPT وCodex‏OpenAI API وChatGPT Work وCodexبرنامج Fairwind فقط‏Claude API وBedrock وGoogle Cloud وMicrosoft Foundry
الإدخال / الإخراج (لكل 1M)$10 / $50$2 / $10‏$2 / $10 تمهيديًا، ثم $4 / $20$10 / $50
الإدخال المخزّن مؤقتًا (لكل 1M)$1.00$0.10‏$0.10 تمهيدي$0.25
تسعير الأوامر الطويلةفوق 272K: $20 / $75فوق 272K: 2x للإدخال، 1.5x للإخراجغير معلنثابت حتى 1M
نافذة السياق1.05M1.05Mغير معلن1M
الحد الأقصى للإخراج لكل استجابة128K128K1M128K
التحكم في الاستدلال5 مستويات جهد، من منخفض إلى أقصى5 مستويات جهد، من منخفض إلى أقصىغير معلنمستويات جهد تشمل منخفض ومتوسط وعالي
أوزان مفتوحةلالالالا

المصادر: تغطية OpenAI GPT-6.1 Sol, تغطية Gemini 4 Argon, تسعير GPT-6 Astra للسياق الطويل, مواصفات Claude Fable 5.1. أسعار القوائم الرسمية من الطرف الأول، فئة السياق القصير.

صف الإدخال المخزّن مؤقتًا هو الأهم للوكلاء. يعيد الوكلاء إرسال مطالبات النظام ومخططات الأدوات والسجل في كل خطوة. سعر القراءة من ذاكرة التخزين المؤقت لدى Astra البالغ 1.00 دولار يعادل 4 أضعاف Fable 5.1 و10 أضعاف Sol.

سقف مخرجات Argon البالغ 1M هو الحالة الشاذة الهيكلية الوحيدة. أما النماذج الـ 3 الأخرى فتتوقف عند 128K رمز لكل استجابة.

المعايير القياسية: أين يتفوق كل نموذج

لا يوجد نموذج يجتاح جميع المجالات. يتصدر Argon صفوف العمل المعرفي والبرمجة طويلة المدى. وتتصدر Astra هندسة البرمجيات الرائدة واستخدام الحاسوب. أما Opus 5.5، غير المدرج في هذه التشكيلة، فيتصدر Terminal-Bench 4.0.

المعيار القياسيما يختبرهGemini 4 ArgonGPT-6 AstraClaude Fable 5.1
DeepSWE v1.1هندسة البرمجيات طويلة المدى77.9%74.1%67.4%
Vals Indexأعمال المالية والبرمجة والقانون والضرائب68.9%63.1%65.8%
FrontierSWE v2هندسة البرمجيات الرائدة55.0%65.5%56.3%
Terminal-Bench 4.0العمل الوكيلي في الطرفية57.4%58.2%57.9%
CWE-bench v1معالجة الثغرات الأمنية68% (تعادل)68% (تعادل)58%
OSWorld-2.0استخدام الحاسوب69.2%72.6%غير موجود في جدول Google

المصدر: المقارنة المنشورة من Google DeepMind، كما ورد في تناولنا لـ تغطية Gemini 4 Argon. أرقام أبلغ عنها المورّد.

GPT-6.1 Sol ليس موجوداً في جدول Google. أرقام OpenAI الخاصة تضعه قريباً من Astra:

  • DeepSWE v1.1: Sol يضاهي Astra بنحو خُمس التكلفة.
  • OSWorld 2.0 المجموعة دون الاتصال: Sol يقع ضمن 2.1 نقطة من Astra بنحو سُدس التكلفة لكل مهمة.
  • AutomationBench 1.0.6: Sol يسجل 2.2 نقطة فوق Claude Opus 5.5 بمستوى جهد متوسط.
  • Terminal-Bench Science 0.1: لا تزال Astra في الصدارة بنسبة 68.1%. توصي OpenAI باستخدام Astra لأصعب الأبحاث.

الإشارات المستقلة تشير إلى عكس ذلك فيما يخص الذكاء الخام. على Artificial Analysis مؤشر الذكاء، تحصل Astra على 61. بينما تحصل Fable 5.1 على 5 نقاط أعلى. وعلى مؤشر وكلاء البرمجة الخاص بها، تسجل Fable 5.1 في Claude Code درجة 70 مقابل 67 لـ Astra. كما تُبلغ Artificial Analysis أيضاً أن Argon يوازي Astra على مؤشر الذكاء.

على ARC-AGI-2، تسجل Astra نسبة 95% بينما تسجل Fable 5.1 نسبة 90%.

التكلفة لكل مهمة: نفس سعر القائمة، فاتورة مختلفة

تقدّر Artificial Analysis تكلفة Claude Fable 5.1 بـ $9.18 لكل مهمة، مقابل $4.72 لـ GPT-6 Astra. أي نحو 1.9x، بأسعار قائمة متطابقة.

تأتي الفجوة من حجم الرموز (tokens) وليس من الأسعار. تُحتسب التكلفة لكل مهمة بضرب السعر في عدد الرموز المستهلكة. وبتساوي الأسعار، فإن الفجوة تعني أن Fable 5.1 استهلكت رموزاً أكثر لكل مهمة في تلك الجولة. كما تشير Anthropic إلى أن أداة الترميز (tokenizer) الأحدث لديها تنتج نحو 30% رموزاً إضافية لنفس النص.

النموذجان الأرخص يغيّران الصورة أكثر:

  • Gemini 4 Argon: تُبلغ Artificial Analysis أن Argon يوازي مؤشر الذكاء الخاص بـ Astra مقابل 60% من تكلفة Astra لكل مهمة، باستخدام الأسعار التمهيدية.
  • GPT-6.1 Sol: على Terminal-Bench Science، تُبلغ OpenAI عن $5.47 لكل مهمة لـ Sol مقابل $23.80 لـ Astra.

يمكن أن يعكس التخزين المؤقت (Caching) ترتيب الوكلاء. الأرقام الخاصة بكل مهمة أعلاه لا تأخذ في الحسبان إعادة الاستخدام الكثيف للذاكرة المؤقتة. الوكيل طويل الأمد يعيد قراءة نفس السياق في كل خطوة. إليك الحساب لسياق مخزّن مؤقتًا بحجم 200K من الرموز (tokens)، قبل رموز المخرجات:

النموذجالسعر المخزّن مؤقتًا (لكل 1M)لكل خطوةلكل 100 خطوة
GPT-6 Astra$1.00$0.20$20.00
Claude Fable 5.1$0.25$0.05$5.00
GPT-6.1 Sol$0.10$0.02$2.00
Gemini 4 Argon (التأسيسي)$0.10$0.02$2.00

حساب توضيحي مستند إلى أسعار قائمة الذاكرة المؤقتة. سياق Astra البالغ 200K من الرموز يبقى تحت حد المطالبات الطويلة الخاص به البالغ 272K.

في الحلقات كثيفة استخدام الذاكرة المؤقتة، يقرأ Fable 5.1 السياق بربع سعر Astra. قِس كليهما على بياناتك التتبعية الخاصة قبل أن تحسم اختيارك بناءً على العناوين الرئيسية لكل مهمة.

أي نموذج لأي مهمة

اختر حسب نوع العمل، لا حسب الترتيب في لوحة المتصدرين. GPT-6.1 Sol هو الخيار الافتراضي لمعظم الفرق. النماذج الـ 3 الأخرى تستحق سعرها في مهام أضيق نطاقًا.

المهمةالاختيارالسببالبديل الثاني
وكلاء البرمجة عالية الحجم، روبوتات CI، مراجعة طلبات السحب (PR)GPT-6.1 Solيوازي Astra على DeepSWE v1.1 بسعر $2 / $10 وبسعر مخزّن مؤقتًا قدره $0.10Gemini 4 Argon، بمجرد إتاحته للعموم
أصعب المهام الهندسية المفتوحةGPT-6 Astraيتصدر FrontierSWE v2 بنسبة 65.5%Claude Fable 5.1
استخدام الحاسوب ووكلاء المتصفحGPT-6 Astraيتصدر OSWorld-2.0 بنسبة 72.6%GPT-6.1 Sol، بفارق 2.1 نقطة
جلسات البرمجة الطويلة داخل إطار عمل (harness)Claude Fable 5.1أعلى نتيجة (70) في تقييم وكيل البرمجة من Artificial Analysis في Claude Code؛ و0.25 دولار لقراءات الكاشGPT-6 Astra (67)
العلوم والبحث الصارمينGPT-6 Astraيتصدر Terminal-Bench Science بنسبة 68.1%GPT-6.1 Sol بسعر 5.47 لكل مهمة
أتمتة القانون والمالية والأعمالGemini 4 Argonيتصدر Vals Index (بنسبة 68.9%) وAutomationBench (بنسبة 51.3%) وHarvey Legal (بنسبة 19.6%)GPT-6.1 Sol؛ وClaude Fable 5.1
المخرجات الفردية الطويلة جداً: إعادة الهيكلة الكبيرة والتقارير الكاملةGemini 4 Argonالنموذج الوحيد الذي يقدم 1M من رموز الإخراج لكل استجابةأي من النماذج الـ 3 الأخرى، مع التقسيم على عدة محادثات
اكتشاف الثغرات وإصلاحهاGemini 4 Argon أو GPT-6 Astraمتكافئان بنسبة 68% على CWE-bench v1Claude Fable 5.1 (بنسبة 58%)
أضيق ميزانية عند جودة الحد الأقصىGPT-6.1 Solأقل سعر عام؛ وArgon يضاهيه فقط داخل FairwindGemini 4 Argon

الوصول يحسم 2 من هذه الصفوف. Argon متاح اليوم فقط لمدافعي الأمن السيبراني في Fairwind. وتقع القدرة الكاملة لـAstra في الأمن الهجومي خلف برنامج Daybreak من OpenAI؛ أما الإصدار العام فيرفض مهام الاختراق السيبراني الهجومي المتقدمة. وتقصر Anthropic نموذجها التوأم غير المقيَّد، Claude Mythos 5.1، خلف برامج الوصول الموثوق.

ما يجب التحقق منه قبل التبديل

معظم الأرقام هنا من تقارير المورّدين، والمورّدين يختلفون في الهوامش. تذكر OpenAI أن Astra حقق 57.9% على Terminal-Bench 4.0، بينما يدرج جدول المقارنة من Google نسبة 58.2%.

  • إجراءات الحماية تؤثر في نتائج Fable 5.1: شغّلت Anthropic معاييرها القياسية مع تشغيل إجراءات الحماية الإنتاجية. وتُحوَّل مهام الأمن السيبراني والأحياء المُعلَّمة إلى نماذج Claude الأخرى، ما يُرجَّح أنه خفّض نتائج OSWorld وAutomationBench.
  • تسعير Argon مؤقت: السعر 2 / 10 تمهيدي. سينتقل لاحقاً إلى 4 / 20، دون الإعلان عن تاريخ محدد.
  • نافذة سياق Argon غير معلنة: نشرت Google حد الإخراج البالغ 1M لكنها لم تنشر حد الإدخال.
  • التكاليف لكل مهمة هي لمحة لحظية: أرقام 9.18 دولار و4.72 دولار مصدرها تشغيل Astra في أوائل سبتمبر من Artificial Analysis. إعدادات الجهد تغيّرها كثيرًا.
  • لدى Anthropic خيار أرخص: تغطيتنا لـ Argon تستشهد بتقارير تفيد بأن Claude Opus 5.5 يتفوق على Fable 5.1 في معايير الوكلاء الرئيسية بسعر API أقل. كما يتصدّر Terminal-Bench 4.0 بنسبة 66.4%.

الخلاصات الرئيسية

  • GPT-6.1 Sol يضاهي Astra على DeepSWE v1.1 بخُمس السعر.
  • GPT-6 Astra يتصدّر FrontierSWE v2 (65.5%) وOSWorld-2.0 (72.6%).
  • يتصدر Gemini 4 Argon كلًا من DeepSWE وVals Index وAutomationBench، ولكن فقط داخل Fairwind.
  • تكلّف Fable 5.1 مبلغ 9.18 دولار لكل مهمة مقابل 4.72 دولار لـ Astra، وبأسعار القائمة نفسها.
  • بالنسبة للوكلاء المعتمدين بكثافة على التخزين المؤقت، يتجاوز سعر القراءة من الذاكرة المؤقتة في Fable 5.1 البالغ 0.25 دولار نظيره في Astra البالغ 1.00 دولار بتوازٍ يبلغ 4 مرات.

الأسئلة الشائعة

  • أيها الأرخص؟ GPT-6.1 Sol، بسعر $2 للإدخال، و$10 للإخراج، و$0.10 للذاكرة المؤقتة لكل 1M رمز. أما Argon فيضاهي ذلك فقط بسعر التعريف، داخل Fairwind.
  • أيهما الأفضل للبرمجة؟ Sol لكميات العمل الكبيرة. وAstra للمهام الأصعب. وتتصدر Fable 5.1 مؤشر وكلاء البرمجة لدى Artificial Analysis في Claude Code.
  • هل يمكنني استخدام Gemini 4 Argon اليوم؟ فقط من خلال برنامج Fairwind التابع لشركة Google المخصص للمدافعين السيبرانيين.

المقال GPT-6 Astra مقابل GPT-6.1 Sol مقابل Gemini 4 Argon مقابل Claude Fable 5.1: أي نموذج حدودي يناسب أي وظيفة ظهر المقال لأول مرة على MarkTechPost.

المصدر الأصلي

MarkTechPost

ملاحظات المحتوى

النشر الأصلي والحقوق تعود إلى المصدر.

ترجمة آلية · يُرجى الرجوع إلى الأصل