العودة للمدونة
الذكاء الاصطناعي

Sonnet 5.5 بسعر Sonnet 5 نفسه، والمهمة أرخص حتى 30%

فريق أوريجاميفريق التحرير
6 دقائق
Sonnet 5.5 بسعر Sonnet 5 نفسه، والمهمة أرخص حتى 30%
يعجبك ما ننشره؟ ثبت أوريجامي كمصدر مفضل في قوقل.الإضافة إلى المصادر المفضلة في Google

Sonnet 5.5 بسعر Sonnet 5 نفسه، والمهمة أرخص حتى 30%

يوم 28 سبتمبر 2026 أطلقت أنثروبيك نموذج Claude Sonnet 5.5، ثاني نماذج جيل 5.5 بعد Opus 5.5 الذي صدر في 22 سبتمبر. السعر لم يتغير عن Sonnet 5: دولاران لكل مليون رمز إدخال، و 10 دولارات لكل مليون رمز إخراج، و 0.20 دولار لكل مليون رمز يقرأ من التخزين المؤقت. والرمز، أو التوكن، هو وحدة النص التي تحاسب بها نماذج الذكاء الاصطناعي.

ومع ذلك تقول أنثروبيك إن النموذج الجديد يكلف في اختباراتها حتى 30% أقل لكل مهمة، ويكتب مخرجاته أسرع بأكثر من 30%. السبب ليس خصما في الأسعار، بل أن النموذج يحتاج رموزا أقل لينجز العمل نفسه. وهذه هي الفكرة التي تستحق انتباه أي منشأة تدفع فاتورة ذكاء اصطناعي: سعر الرمز لا يخبرك كم تكلفك المهمة.

لماذا تنخفض الفاتورة وسعر الرمز ثابت

فاتورة النموذج تساوي عدد الرموز مضروبا في سعرها. وعدد الرموز لا يحدده طول سؤالك وحده، بل ما يفعله النموذج حتى يصل إلى الجواب: كم خطوة يمشي، وكم مرة يستدعي أداة أو يبحث، وكم يفكر قبل أن يكتب. وتنص وثائق أنثروبيك على أن رموز التفكير تحاسب بسعر رموز الإخراج، وهي الأغلى.

ونشرت أنثروبيك مع الإعلان نتائج شركات جربت النموذج قبل إطلاقه:

  • Balyasny لإدارة الأصول: على 2,441 مهمة مالية بين أسئلة واستخراج بيانات وتحليل وتوقعات، استهلك Sonnet 5.5 نحو 121 ألف رمز للإجابة الواحدة، مقابل 497 ألفا استهلكها Sonnet 5، وجاءت نتيجته أعلى.
  • Slack: تفوق على Sonnet 5 في كل اختباراتها الداخلية لمساعدها Slackbot تقريبا، بخطوات أقل ورموز إخراج أقل بنحو 14%، دون أي تعديل على التعليمات.
  • Lovable: احتاج في اختبارات البرمجة استدعاءات أدوات أقل بالثلث، ونحو نصف أوامر التشغيل لينهي المهمة.
  • Box: كان أدق من النموذج السابق، وأسرع منه 2.4 مرة، واستهلك إجمالي رموز أقل بنسبة 12%.

لاحظ المدى بين الأرقام: من 12% رموزا أقل إلى نحو ثلاثة أرباع أقل، بحسب نوع العمل. وهذه نتائج اختبارات الشركات نفسها كما نشرتها أنثروبيك، لا قياسات مستقلة. المعنى العملي أن الوفر الحقيقي في منشأتك لا يعرف إلا بتجربة على مهامك أنت.

Sonnet 5.5 أم Opus 5.5: الفرق في السعر والقدرة

Opus 5.5 ضعف السعر في الإدخال والإخراج، وقراءة التخزين المؤقت بالسعر نفسه، والفارق في معظم الاختبارات المنشورة صغير. لكن أنثروبيك نفسها تحدد لكل منهما دورا مختلفا.

البندSonnet 5.5Opus 5.5
المعرف في الواجهة البرمجيةclaude-sonnet-5-5claude-opus-5-5
السعر (إدخال / إخراج لكل مليون رمز)2 / 10 دولارات4 / 20 دولارا
كتابة في التخزين المؤقت (5 دقائق)2.50 دولار5 دولارات
قراءة من التخزين المؤقت0.20 دولار0.20 دولار
واجهة الدفعات (إدخال / إخراج)1 / 5 دولارات2 / 10 دولارات
نافذة السياق / أقصى إخراجمليون رمز / 128 ألف رمزمليون رمز / 128 ألف رمز
مستوى الجهد الافتراضي في الواجهة البرمجيةhighmedium
Terminal-Bench 4.0 — البرمجة في الطرفية70.6%66.4%
CursorBench 4.0 — مهام برمجة من جلسات حقيقية55.5%57.8%
OSWorld 2.1 — استخدام الحاسوب80.1%81.8%
GDPval-AA — أعمال مهنية في 44 مهنة (نقاط تقييم)18441846
Humanity's Last Exam — مع أدوات64.5%67.7%

الأرقام من إعلان أنثروبيك ووثائق الأسعار والنماذج. ونتيجة Opus 5.5 في Terminal-Bench هي أعلى نتائجه، عند مستوى الجهد Xhigh. وللمقارنة، سجل Sonnet 5 في GDPval-AA نحو 1449 نقطة.

الأرقام متقاربة، لكن أنثروبيك تكتب في الإعلان نفسه أن الاختبارات تقيس جانبا واحدا من القدرة، وأن Opus 5.5 يبقى في اختباراتها واختبارات المختبرين الخارجيين أقوى بوضوح في العمل المعقد المفتوح الذي يحتاج حكما متواصلا. أما Sonnet 5.5 فأقوى ما يكون في المهام اليومية محددة النطاق، وإصلاح الأخطاء البرمجية، وإعداد المستندات والعروض والجداول.

وفي قراءتنا لذلك بلغة التشغيل: الرد على استفسار عميل بقواعد واضحة، واستخراج بيانات فاتورة، وتلخيص اجتماع، ومسودة عرض من قالب ثابت، مهام تناسب Sonnet. أما تصميم نظام جديد، أو تحليل مفتوح يوازن بين خيارات، أو قرار يعتمد على سياق طويل متشعب، فمهام قد يستحق فيها Opus فرق السعر. وقارنا Opus 5.5 بالنموذج الأعلى Fable 5.1 بالتفصيل في مقال سابق.

مستوى الجهد: الإعداد الذي يحرك الفاتورة أكثر من اسم النموذج

يعمل Sonnet 5.5 بخمسة مستويات جهد: low و medium و high و xhigh و max. كلما ارتفع المستوى عمل النموذج أطول وراجع نفسه أكثر، فترتفع تكلفة المهمة وترتفع النتيجة عادة. والافتراضي هو medium داخل تطبيقات Claude و Claude Code، و high عند استخدامه عبر الواجهة البرمجية.

وتذكر أنثروبيك أن Sonnet 5.5 على مستوى low أو medium تجاوز في عدة اختبارات أفضل نتيجة سجلها Sonnet 5، بنحو عشر تكلفة المهمة. وفي اختبار FrontierCode، الذي يقيس هل يقبل تعديل الكود للدمج دون تحرير بشري، سجل على مستوى high نتيجة أعلى من Sonnet 5 على المستوى نفسه بعشر نقاط، وبنحو جزء من خمسة عشر من تكلفة المهمة.

وفي الإعلان ملاحظة تستحق التوقف: على FrontierCode سجل Sonnet 5.5 على مستوى max نتيجة أقل من مستوى xhigh، لأنه أكثر من تشغيل أداة مراجعة الكود في Claude Code التي توزع المراجعة على وكلاء فرعيين، وفي حالتين فحصتهما شركة Cognition انتهى الوقت أو أضاف تعديلات خارج المطلوب. أعلى جهد ليس أفضل نتيجة دائما، لكنه عادة الأغلى.

ودليل الانتقال في وثائق أنثروبيك ينبه إلى أن المستويات أعيدت معايرتها، فالمستوى نفسه لا ينتج مقدار التفكير نفسه الذي كان في Sonnet 5. وتوصي الوثائق بالبدء من high للعمل العام، ومن medium لمهام البرمجة والأدوات المتعددة إذا كانت محددة جيدا، ومن medium أو low للمحادثة وكل ما يحتاج ردا سريعا. أي أن نظاما يستدعي النموذج عبر الواجهة البرمجية دون تحديد المستوى سيعمل على high، وقد يدفع أكثر مما تحتاجه مهامه الروتينية.

قبل أن يغير المطور اسم النموذج في نظامك

تبديل النموذج يبدو تغيير سطر واحد، لكن دليل الانتقال يذكر تغييرات قد توقف تكاملا يعمل اليوم أو تغير فاتورته:

  • إيقاف التفكير تغير: الأنظمة التي توقف التفكير في Sonnet 5 بالإعداد thinking: {"type": "disabled"} ستتلقى خطأ 400 من Sonnet 5.5. البديل هو الإعداد الجديد between_tools، ولا يقبل إلا على مستويات الجهد low و medium و high.
  • التفكير يعمل افتراضيا: الطلب الذي لا يحدد إعداد التفكير يعمل على Sonnet 5.5 بالتفكير التكيفي. ومن ينتقل من Sonnet 4.6 أو أقدم أو من Haiku 4.5، حيث كان التفكير مغلقا افتراضيا، سيدفع رموز تفكير على الطلبات التي لم تحدد إعداد التفكير.
  • النص نفسه برموز أكثر لمن يأتي من الجيل 4: يستخدم Sonnet 5.5 طريقة تقطيع النص نفسها التي في Sonnet 5، وتقول الوثائق إن النص نفسه ينتج نحو 30% رموزا أكثر مقارنة بـ Sonnet 4.6 و Sonnet 4.5 و Haiku 4.5، بحسب المحتوى. أي أن وفر المهمة الذي تعلنه أنثروبيك محسوب مقابل Sonnet 5، لا مقابل الجيل 4.
  • شكل الرد: قد يبدأ الرد بكتلة تفكير قبل النص، فالشيفرة التي تقرأ أول عنصر في الرد على أنه النص ستنكسر.
  • إعدادات ترفض: ميزانيات التفكير الثابتة، والقيم غير الافتراضية لمعاملات مثل temperature و top_p، والتعبئة المسبقة لرد النموذج، وفرض استخدام الأدوات، سواء أداة بعينها أو أي أداة، كلها تعيد خطأ 400.
  • مهام الأمن السيبراني: لأن قدرات النموذج السيبرانية تقارب Opus 5، أطلقته أنثروبيك بضوابط تحول المهام الأمنية عالية الخطورة بشكل ظاهر إلى Sonnet 5. وفي الواجهة البرمجية يعود الطلب المرفوض برد رفض، ما لم يفعل المطور خيار التحويل التلقائي التجريبي المتاح في واجهة Claude فقط. أما إصلاح الأخطاء في الكود ضمن التطوير المعتاد فلا يتأثر.

والنموذج متاح عبر منصة Claude و AWS و Google Cloud و Microsoft Azure، وتنص الوثائق على أنه لن يتقاعد قبل 28 سبتمبر 2027، فمن يبني عليه اليوم لديه نحو سنة قبل أن يضطر إلى الانتقال.

كيف تقيس تكلفة المهمة في منشأتك

السؤال الذي يستحق أن تطرحه على من يدير تكامل الذكاء الاصطناعي عندك ليس كم سعر النموذج، بل كم تكلفنا المهمة المقبولة الواحدة. والقياس بسيط:

  • اختر عينة حقيقية: من 20 إلى 50 مهمة من عملكم الفعلي، مثل ردود على عملاء أو فواتير تستخرج منها البيانات، لا أمثلة مصطنعة.
  • شغلها على النموذجين: النموذج الحالي و Sonnet 5.5، وعلى مستويين من الجهد على الأقل. الواجهة البرمجية تعيد مع كل رد عدد رموز الإدخال والإخراج، فسجلها مع زمن التنفيذ.
  • احكم على الجودة بموظف: يقرر من يعرف العمل أي المخرجات مقبولة كما هي.
  • احسب التكلفة لكل مهمة مقبولة: إجمالي التكلفة مقسوما على عدد المخرجات المقبولة. النموذج الأرخص الذي يحتاج إعادة ثلث مهامه ليس أرخص.
  • استفد من خيارات التسعير: المهام غير العاجلة، مثل معالجة أرشيف فواتير، تعمل عبر واجهة الدفعات بنصف السعر: دولار للإدخال و 5 دولارات للإخراج لكل مليون رمز. والسياق الذي يتكرر في كل طلب، مثل سياسات الشركة أو كتالوج المنتجات، يقرأ من التخزين المؤقت بـ 0.20 دولار بدل دولارين، وصار الحد الأدنى لما يمكن تخزينه 512 رمزا بدل 1,024.

نظرة أوريجامي

جداول الأسعار تغري بالمقارنة بسعر المليون رمز، لكن هذا الإصدار مثال واضح على أن الرقم المهم هو تكلفة المهمة. النموذج نفسه بالسعر نفسه قد يصبح أرخص لأنه يعمل بخطوات أقل، وقد يصبح أغلى إن فتح التفكير افتراضيا أو رفع أحد مستوى الجهد دون قياس. ومن يدفع فاتورة ذكاء اصطناعي شهرية دون أن يعرف تكلفة المهمة الواحدة يدير بندا لا يراه.

لذلك نرى أن أي نظام يستخدم نموذج لغة داخل المنشأة يجب أن يجعل اسم النموذج ومستوى الجهد إعدادا يغير دون إعادة برمجة، وأن يسجل الرموز لكل مهمة ويعرضها في تقرير شهري. عندها يصبح الانتقال إلى إصدار جديد، مثل Sonnet 5.5 اليوم و Haiku 5.5 الذي تقول أنثروبيك إنه سيصدر خلال الأسابيع القادمة، قرارا يقاس في أيام لا مشروعا جديدا.

الخلاصة

Sonnet 5.5 لم يخفض السعر المعلن، لكنه قد يخفض فاتورتك إن كان النموذج السابق يستهلك في عملك خطوات ورموزا كثيرة. قبل التبديل:

  • اطلب من المطور مراجعة إعدادات التفكير والشيفرة التي تقرأ الرد، ثم اختبار التكامل في بيئة تجريبية قبل النظام الحي.
  • قس تكلفة المهمة المقبولة على عينة حقيقية، على مستويين من الجهد على الأقل.
  • إن كنت على Sonnet 4.6 أو أقدم، فاحسب أثر الرموز الإضافية للنص نفسه قبل أن تفترض أي وفر.
  • أبق Opus 5.5 للمهام المفتوحة التي تحتاج حكما، وانقل إلى Sonnet 5.5 المهام المحددة المتكررة، ثم راقب الأرقام شهرا كاملا.

مصادر

#Claude Sonnet 5.5#أنثروبيك#تكلفة الذكاء الاصطناعي#نماذج اللغة#أتمتة الأعمال

أسئلة شائعة

هل Claude Sonnet 5.5 أرخص من Sonnet 5؟+

سعره لكل مليون رمز هو نفسه: دولاران للإدخال و 10 دولارات للإخراج. لكن أنثروبيك تقول إنه يكلف في اختباراتها حتى 30% أقل لكل مهمة، لأنه ينجز العمل برموز وخطوات أقل. الوفر يختلف بحسب نوع العمل، ولا يعرف في منشأتك إلا بتجربة على عينة من مهامك الحقيقية.

متى أختار Opus 5.5 بدل Sonnet 5.5؟+

Opus 5.5 ضعف السعر: 4 دولارات للإدخال و 20 للإخراج لكل مليون رمز. وتقول أنثروبيك إنه يبقى أقوى بوضوح في العمل المعقد المفتوح الذي يحتاج حكما متواصلا، بينما Sonnet 5.5 أقوى في المهام اليومية محددة النطاق وإصلاح الأخطاء وإعداد المستندات والعروض. المهام المتكررة ذات القواعد الواضحة تذهب عادة إلى Sonnet.

هل يكفي أن نغير اسم النموذج في نظامنا لننتقل إليه؟+

ليس دائما. الأنظمة التي توقف التفكير بالإعداد disabled ستتلقى خطأ 400 ويجب أن تستخدم between_tools، والقيم غير الافتراضية لمعاملات مثل temperature ترفض، وكذلك فرض استخدام الأدوات، وقد يبدأ الرد بكتلة تفكير قبل النص. اطلب من المطور مراجعة دليل الانتقال واختبار التكامل في بيئة تجريبية أولا.

ما مستوى الجهد المناسب لمهام الأعمال اليومية؟+

الافتراضي عبر الواجهة البرمجية هو high. وتوصي وثائق أنثروبيك بالبدء من medium أو low للمحادثة والمهام التي تحتاج ردا سريعا، ومن medium لمهام البرمجة والأدوات المحددة جيدا. جرب مستويين على عينة من مهامك وقارن تكلفة المهمة المقبولة، ولا تفترض أن أعلى مستوى يعطي أفضل نتيجة.

تابع أوريجامي في نتائج قوقل

ثبت أوريجامي كمصدر مفضل، فتظهر لك مقالاتنا أولا في نتائج قوقل وفي الأخبار الرائجة.

الإضافة إلى المصادر المفضلة في Google

مقالات ذات صلة

عندك مشروع تفكر فيه؟

نبني أنظمة وتطبيقات ومواقع مخصصة لأعمالك. احك لنا عن فكرتك ونعطيك رأينا الصريح فيها.

جلسة واحدة. عشرون دقيقة. بلا التزامات.