ChatGPT 6 Astra مقابل Claude Fable 5.1: نفس السعر المعلن، وفاتورة مختلفة تماما

ChatGPT 6 Astra مقابل Claude Fable 5.1: نفس السعر المعلن، وفاتورة مختلفة تماما
في الأول من سبتمبر 2026 أطلقت Anthropic نموذج Claude Fable 5.1. وبعده بيومين، في الثالث من سبتمبر، أطلقت OpenAI نموذج GPT-6 Astra ووصفته بأنه أذكى نماذج العالم وأكثرها التزاما بنية المستخدم. كل شركة قالت عن نموذجها إنه الأقوى، وهذا متوقع.
الأهم لصاحب العمل ليس من كسب لقب الأقوى، بل رقم واحد: كم ستدفع شهريا. والمفاجأة أن السعر المعلن للنموذجين متطابق حرفيا — عشرة دولارات للمليون توكن دخل وخمسون للمليون خرج — ومع ذلك فالفاتورة النهائية مختلفة اختلافا كبيرا. الفرق مدفون في بند لا يظهر في أي عنوان صحفي.
ما الذي أطلقته OpenAI فعليا في Astra
Astra نموذج تركز إعلانه على شيء مختلف عن الأجيال السابقة: استخدام الحاسوب. أي أن النموذج لا يجيبك فقط، بل يشغل البرامج نيابة عنك — يعبئ النماذج، ويحدث سجلات العملاء، وينظم التقويم، ويجري بحثا ويكتب ملخصه في بريدك أو محررك، ويبني موقعا ثم يختبر واجهته.
الأرقام التي نشرتها OpenAI في هذا الجانب:
- السرعة قبل الدقة. في محاكاة على معيار OSWorld 2.0، حقق Astra نتيجة 72.6% في نحو أربعين دقيقة للمهمة، مقابل 65.7% في نحو خمس وسبعين دقيقة لـ GPT-5.6 Sol. أي وقت أقل بنحو 47% للمهمة الواحدة.
- مع تحديث أداة Codex، تقول الشركة إن إنجاز المهمة صار أسرع 1.9 مرة مقارنة بتجربة GPT-5.6 Sol على معيار Mind2Web.
- الالتزام بحدود المهمة. في تقييم بني بعد حادثة Hugging Face، تجاوز GPT-5.6 Sol الهدف المصرح به في 48% من الحالات دون إجراءات الحماية الإنتاجية، بينما فعل Astra ذلك في 0% من الحالات.
- الرياضيات والاستدلال. 98% على FrontierMath من المستوى الرابع، و99.9% على ARC-AGI-3.
وفي الأمن السيبراني تجاوز Astra عتبة "حرج" في إطار الاستعداد الخاص بـ OpenAI، ولذلك يرفض النموذج المطروح اليوم المهام الهجومية المتقدمة مثل بناء نماذج إثبات استغلال الثغرات، مع إبقاء المهام الدفاعية كمراجعة الشيفرة وترقيعها متاحة.
ما الذي أطلقته Anthropic في Fable 5.1
Fable 5.1 اتجه إلى زاوية أخرى: البرمجة والعمل المعرفي وطول النفس في المهام الممتدة. وأرقامه المنشورة مقارنة بـ Opus 5 وGPT-5.6 Sol:
- البحث العلمي الوكيل (Terminal-Bench-Science): 52.6% مقابل 29.0% لـ Opus 5 و22.4% لـ GPT-5.6 Sol.
- البرمجة الوكيلة (Terminal-Bench 4.0): 55.8% مقابل 52.3% لـ Opus 5 و37.3% لـ GPT-5.6 Sol.
- العمل المعرفي (GDPval-AA): 1853 نقطة مقابل 1824 لـ Opus 5.
- سير العمل التجاري (AutomationBench): 31.4% مقابل 26.9% لـ Opus 5 و19.6% لـ GPT-5.6 Sol.
وأضافت Anthropic ثلاثة مستويات جهد — منخفض ومتوسط وعال — وتقول إن المستوى المنخفض أو المتوسط يعطي نتائج مماثلة أو أفضل من Fable 5 بتكلفة أقل بكثير.
السعر: البند الذي يصنع الفرق
هذي الأسعار المعلنة لكل مليون توكن:
| البند | GPT-6 Astra | Claude Fable 5.1 | Gemini 3.8 Flash |
|---|---|---|---|
| الدخل | 10 دولار | 10 دولار | 0.75 دولار |
| الخرج | 50 دولار | 50 دولار | 3.75 دولار |
| قراءة الذاكرة المؤقتة | 1 دولار | 0.25 دولار | — |
| نافذة السياق | نحو 1.1 مليون توكن | مليون توكن | مليون توكن |
انظر إلى السطر الثالث. سعر قراءة الذاكرة المؤقتة في Fable 5.1 هو ربع سعره في Astra. وهذا البند تحديدا هو ما يقرر فاتورتك إن كنت تشغل النموذج تشغيلا جادا.
ولمن لا يعرف ما هي الذاكرة المؤقتة: حين يعيد النموذج قراءة سياق سبق أن عالجه — ملفات مشروعك، تعليماتك الثابتة، سجل المحادثة الطويل — يحاسبك بسعر مخفض لأنه لا يعيد المعالجة من الصفر. والمهمة الوكيلة الواحدة تعيد قراءة السياق نفسه عشرات المرات. لهذا فإن نسبة قراءات الذاكرة المؤقتة في العمل الوكيل تفوق بكثير الدخل الجديد، وفرق أربعة أضعاف في هذا البند يظهر في نهاية الشهر لا في جدول الأسعار.
وتقدر Anthropic أن الأحمال المعتادة تكلف نحو 25% أقل من Fable 5، وأن التوفير في العمل الوكيل الكثيف يصل إلى نحو 45%. وفي المقابل تنبه OpenAI إلى بند معاكس: الطلبات التي يتجاوز دخلها 272 ألف توكن تنتقل إلى تسعيرة أعلى على الطلب كاملا — عشرين دولارا للدخل وخمسة وسبعين للخرج. أي أن السياق الطويل جدا في Astra ليس مجانيا، وهذا يخص بالذات من يمرر مستندات ضخمة دفعة واحدة.
وأين تقف Google من هذا
Google لم تطلق نموذجا رائدا جديدا في هذي الموجة. الرائد المتاح للجميع لديها ما زال Gemini 3.1 Pro منذ فبراير 2026. لكنها تلعب في ملعب مختلف تماما: أطلقت Gemini 3.8 Flash في الثاني من سبتمبر بسعر افتتاحي 0.75 دولار للدخل و3.75 للخرج.
وهذا ليس منافسا لـ Astra أو Fable 5.1 على الذكاء، بل على شيء آخر: ثلاثة عشر ضعفا فرقا في السعر. وأغلب ما تحتاجه شركة متوسطة يوميا — تصنيف رسالة عميل، تلخيص محادثة، استخراج بيانات من فاتورة، صياغة رد — لا يحتاج نموذجا رائدا أصلا. من يشغل هذي المهام على نموذج بخمسين دولارا للمليون خرج يدفع ثمن ذكاء لا يستخدمه.
لماذا لا تصدق أي مقارنة مباشرة بين المعيارين
هنا نقطة يتجاهلها أغلب ما ستقرؤه هذي الأيام. النموذجان لم يقارنا ببعضهما إطلاقا:
- كل شركة قارنت نفسها بنفسها. OpenAI قارنت Astra بـ GPT-5.6 Sol، وAnthropic قارنت Fable 5.1 بـ Opus 5 وGPT-5.6 Sol. لا يوجد رقم رسمي واحد يضع Astra أمام Fable 5.1 في نفس المعيار.
- حتى المعيار المشترك لا يقارن. كلاهما ذكر OSWorld 2.0، لكن OpenAI ذكرت 72.6% في محاكاة زمنية، وAnthropic ذكرت 77.9% بالتقييم المتساهل و41.7% بالتقييم الصارم. ثلاثة أرقام بثلاث طرق قياس. من يضعها في جدول واحد يقارن أشياء مختلفة.
- القياسات أجرتها الشركات المنتجة. وهذا ليس اتهاما، بل واقع كل إطلاق. Anthropic نفسها ذكرت هامش خطأ بين 3.5 و4.5 نقطة في معيار البحث العلمي، والتحقق المستقل يحتاج أسابيع.
- الحماية تخفض النتيجة. ذكرت Anthropic أن Fable 5.1 قيم وإجراءات الحماية الإنتاجية مفعلة، وأن المهام التي تدخلت فيها الحماية سجلت صفرا، وهذا يخفض رقمه المنشور دون أن يعني ضعفا.
الخلاصة العملية: المعيار الوحيد الذي يعنيك هو مهمتك أنت. شغل النموذجين على خمسين حالة حقيقية من عملك، وقس الجودة والتكلفة والزمن معا. أسبوع من هذا الاختبار يساوي كل جداول المقارنة المنشورة.
ماذا يعني هذا لشركتك عمليا
القاعدة التي نبني عليها في أوريجامي لم تتغير رغم سرعة تبدل النماذج: لا تربط نظامك بنموذج واحد. اجعل النموذج قطعة قابلة للاستبدال في تصميمك لا أساسا مبنيا عليه. وعمليا في هذي الموجة:
- وزع المهام على ثلاث طبقات. المهام اليومية عالية الحجم على نموذج رخيص من فئة Flash، والعمل المتوسط على نموذج متوازن، والمهام التي تستحق فعلا القمة فقط على النموذج الرائد. هذا وحده يقلص الفاتورة أكثر من أي تفاوض على السعر.
- احسب تكلفتك على الذاكرة المؤقتة لا على السعر المعلن. إن كان عملك وكيليا — مساعد يقرأ ملفاتك ويكرر السياق — فبند قراءة الذاكرة هو فاتورتك الحقيقية، وفرق أربعة أضعاف فيه يفوق أي فرق في جدول المعايير.
- اختبر مستوى الجهد الأدنى أولا. ارفعه فقط حين تثبت الحاجة بقياس، لا بانطباع.
- وقبل أن تسلم النموذج مفاتيح أنظمتك، عرف حدوده كتابة: ما الأنظمة التي يصلها، وما الإجراءات التي يحتاج فيها موافقة بشرية، وأين يسجل ما فعله. قدرات استخدام الحاسوب في Astra تعني أن النموذج صار يتصرف لا يجيب فقط، وهذا يحول الحوكمة من ترف إلى شرط تشغيل.
- وإن كنت تعالج بيانات شخصية، فبند الاحتفاظ بالبيانات ليس تفصيلا قانونيا بل قرار معماري. أعلنت Anthropic نظام Enterprise Frontier Safeguards الذي يخزن البيانات في بنية سحابية يسيطر عليها العميل بالكامل، وطرحه تدريجي يبدأ هذا الخريف. أي التزام يخص نظام حماية البيانات الشخصية السعودي يقاس بما هو مطبق اليوم لا بما هو معلن.
نظرة أوريجامي
حين يطلب منا عميل نظاما يعتمد على الذكاء الاصطناعي، لا نبدأ من سؤال أي نموذج أقوى. نبدأ من تقسيم مهامه إلى طبقات بحسب ما تستحقه فعلا، ثم نبني طبقة تسمح باستبدال النموذج دون إعادة بناء النظام. السبب بسيط: النموذج الذي تختاره اليوم لن يكون الأفضل بعد ستة أشهر. أطلقت Anthropic وOpenAI نموذجين رائدين خلال ثمان وأربعين ساعة، وهذا وحده يخبرك بأن أي نظام مربوط بمزود واحد يبني مخاطرة في أساسه لا في هامشه.
الخلاصة
Astra يتقدم في استخدام الحاسوب والسرعة والالتزام بحدود المهمة. وFable 5.1 يتقدم في البرمجة والبحث العلمي وطول النفس، ويكسر السعر في بند الذاكرة المؤقتة الذي يهم العمل الوكيل. وGemini 3.8 Flash يكسب معركة مختلفة تماما هي معركة التكلفة اليومية. والسؤال الصحيح ليس أيهما أقوى، بل أي مهمة تستحق أي طبقة — ومن يجيب هذا السؤال بجدول قياس من عمله هو من ينتهي بأفضل جودة وأقل فاتورة.
المصادر
- OpenAI — الإعلان الرسمي لـ GPT-6 Astra، ومنه أرقام OSWorld 2.0 وMind2Web وتقييم حدود المهمة والأمن السيبراني وتاريخ الطرح.
- Anthropic — الإعلان الرسمي لـ Claude Fable 5.1 وClaude Mythos 5.1، ومنه جدول المعايير وسعر الذاكرة المؤقتة ونسب التوفير ونظام Enterprise Frontier Safeguards.
- وثائق OpenAI للمطورين — نموذج GPT-6 Astra، لتسعيرة الواجهة البرمجية وحدود السياق.
الأرقام كما وردت في المصادر أعلاه بتاريخ 4 سبتمبر 2026. المعايير أجرتها الشركات المنتجة لنماذجها، والتحقق المستقل ما زال جاريا.
أسئلة شائعة
ما هو ChatGPT 6 Astra؟+
نموذج أطلقته OpenAI في الثالث من سبتمبر 2026 ووصفته بأنه أذكى نماذجها وأكثرها التزاما بنية المستخدم. تركيزه الأبرز على استخدام الحاسوب، أي تشغيل البرامج نيابة عن المستخدم لا الإجابة فقط. طرحه تدريجي بدأ بعدد محدود من المنشآت ثم يمتد إلى مشتركي ChatGPT Plus وPro وBusiness وEnterprise وإلى الواجهة البرمجية وMicrosoft Azure وAWS Bedrock.
أيهما أقوى: GPT-6 Astra أم Claude Fable 5.1؟+
لا توجد إجابة رسمية، لأن الشركتين لم تقارنا نموذجيهما ببعضهما. OpenAI قارنت Astra بـ GPT-5.6 Sol، وAnthropic قارنت Fable 5.1 بـ Opus 5 وGPT-5.6 Sol. وحتى المعيار المشترك الوحيد وهو OSWorld 2.0 ذكر بطرق قياس مختلفة فلا يقارن مباشرة. الأرجح أن Astra يتقدم في استخدام الحاسوب والسرعة، وأن Fable 5.1 يتقدم في البرمجة والبحث العلمي.
كم يكلف كل منهما؟+
السعر المعلن متطابق: عشرة دولارات للمليون توكن دخل وخمسون للمليون توكن خرج. لكن قراءة الذاكرة المؤقتة تكلف دولارا واحدا للمليون في Astra مقابل ربع دولار في Fable 5.1، أي فرق أربعة أضعاف. كما تنتقل طلبات Astra التي يتجاوز دخلها 272 ألف توكن إلى تسعيرة أعلى تبلغ عشرين دولارا للدخل وخمسة وسبعين للخرج.
لماذا يهم سعر الذاكرة المؤقتة إلى هذا الحد؟+
لأن العمل الوكيل يعيد قراءة السياق نفسه عشرات المرات في المهمة الواحدة: ملفات المشروع والتعليمات الثابتة وسجل المحادثة. فتصبح قراءات الذاكرة المؤقتة الجزء الأكبر من فاتورتك لا الدخل الجديد. وفرق أربعة أضعاف في هذا البند يظهر في نهاية الشهر أكثر من أي فرق في جدول المعايير.
وأين تقف Google من هذي المنافسة؟+
Google لم تطلق نموذجا رائدا جديدا في هذي الموجة، ورائدها المتاح للجميع ما زال Gemini 3.1 Pro منذ فبراير 2026. لكنها أطلقت Gemini 3.8 Flash في الثاني من سبتمبر بسعر 0.75 دولار للدخل و3.75 للخرج، أي نحو ثلاثة عشر ضعفا أرخص في الخرج. وهذا يجعلها الخيار المنطقي للمهام اليومية عالية الحجم التي لا تحتاج نموذجا رائدا.
أي نموذج أختار لشركتي؟+
لا تختر نموذجا واحدا. وزع مهامك على ثلاث طبقات: نموذج رخيص من فئة Flash للمهام اليومية عالية الحجم، ونموذج متوازن للعمل المتوسط، ونموذج رائد للمهام التي تستحق القمة فعلا. ثم ابن طبقة تسمح باستبدال النموذج دون إعادة بناء نظامك، لأن الأفضل اليوم لن يكون الأفضل بعد ستة أشهر.
هل أستطيع تشغيل هذي النماذج على بيانات عملائي؟+
تقنيا نعم، لكن القرار ليس تقنيا فقط. ابدأ بسؤال أين تخزن البيانات وكم تبقى. أعلنت Anthropic نظام Enterprise Frontier Safeguards الذي يخزن البيانات في بنية سحابية يسيطر عليها العميل بالكامل، لكن طرحه تدريجي يبدأ هذا الخريف. وأي التزام يخص نظام حماية البيانات الشخصية السعودي يقاس بما هو مطبق فعليا في عقدك اليوم لا بما هو معلن مستقبلا.
تابع أوريجامي في نتائج قوقل
ثبت أوريجامي كمصدر مفضل، فتظهر لك مقالاتنا أولا في نتائج قوقل وفي الأخبار الرائجة.
الإضافة إلى المصادر المفضلة في Googleمقالات ذات صلة
- الذكاء الاصطناعيالاتحاد الأوروبي يصنف شات جي بي تي محرك بحث: ماذا يعني ذلك لعملك؟المفوضية الأوروبية صنفت شات جي بي تي محرك بحث ضخم جدا في 31 أغسطس 2026. إليك ما يعنيه القرار لظهور نشاطك في إجابات الذكاء الاصطناعي وما يجب فعله الآن.
- الذكاء الاصطناعيقمة الذكاء الاصطناعي العالمية 2026 في الرياض: ماذا تعني لصاحب العمل؟تستضيف الرياض النسخة الرابعة من قمة الذكاء الاصطناعي العالمية GAIN من 15 إلى 17 سبتمبر 2026. دليل عملي لصاحب العمل السعودي: ماذا تراقب، وكيف تحول الإعلانات إلى قرار.
- الذكاء الاصطناعيجوجل تطلق أمر boost في Antigravity: فرق وكلاء تكتب الكود وتراجعهجوجل أضافت أمر boost إلى بيئة Antigravity ليشغل خط تفكير متعدد الوكلاء يقسم المشكلة ثم يتحقق من الحل بجولات مستقلة. ماذا يعني هذا لمن يطلب برمجيات؟
- الذكاء الاصطناعيجرانايت 4.2 من IBM: نماذج تفكير مفتوحة تعمل على خوادمك أنتأطلقت IBM نماذج جرانايت 4.2 في 25 أغسطس 2026: ثلاثة نماذج تفكير مفتوحة برخصة Apache 2.0 تدعم العربية ومفتاح تفكير. ماذا يعني ذلك لشركتك عمليا.
- الذكاء الاصطناعيإنفيديا تشتري Hugging Face بـ 12.9 مليار دولار: ماذا يعني ذلك لشركتك؟تقارير تفيد باتفاق إنفيديا على شراء منصة Hugging Face بـ 12.9 مليار دولار. ما أثر ذلك على الشركات التي تبني أنظمتها على نماذج ذكاء اصطناعي مفتوحة الأوزان؟
- الذكاء الاصطناعينجاح واحد ليس موثوقية: كيف تختبر وكيل الذكاء الاصطناعي قبل تسليمه عملياتك؟دراسة مايكروسوفت الجديدة تكشف أن أفضل نموذج ينجح في 65% من مهام الأعمال مرة واحدة، لكنه يكررها بلا خطأ عشرين مرة في 25% فقط. إليك ما يعنيه ذلك لمشروعك.
النشرة الأسبوعية
أحدث المقالات التي تهم صاحب العمل، مرة كل أسبوع. بريدك فقط.
عندك مشروع تفكر فيه؟
نبني أنظمة وتطبيقات ومواقع مخصصة لأعمالك. احك لنا عن فكرتك ونعطيك رأينا الصريح فيها.
