Sonnet 5.5 بسعر Sonnet 5 نفسه، والمهمة أرخص حتى 30%

Sonnet 5.5 بسعر Sonnet 5 نفسه، والمهمة أرخص حتى 30%
يوم 28 سبتمبر 2026 أطلقت أنثروبيك نموذج Claude Sonnet 5.5، ثاني نماذج جيل 5.5 بعد Opus 5.5 الذي صدر في 22 سبتمبر. السعر لم يتغير عن Sonnet 5: دولاران لكل مليون رمز إدخال، و 10 دولارات لكل مليون رمز إخراج، و 0.20 دولار لكل مليون رمز يقرأ من التخزين المؤقت. والرمز، أو التوكن، هو وحدة النص التي تحاسب بها نماذج الذكاء الاصطناعي.
ومع ذلك تقول أنثروبيك إن النموذج الجديد يكلف في اختباراتها حتى 30% أقل لكل مهمة، ويكتب مخرجاته أسرع بأكثر من 30%. السبب ليس خصما في الأسعار، بل أن النموذج يحتاج رموزا أقل لينجز العمل نفسه. وهذه هي الفكرة التي تستحق انتباه أي منشأة تدفع فاتورة ذكاء اصطناعي: سعر الرمز لا يخبرك كم تكلفك المهمة.
لماذا تنخفض الفاتورة وسعر الرمز ثابت
فاتورة النموذج تساوي عدد الرموز مضروبا في سعرها. وعدد الرموز لا يحدده طول سؤالك وحده، بل ما يفعله النموذج حتى يصل إلى الجواب: كم خطوة يمشي، وكم مرة يستدعي أداة أو يبحث، وكم يفكر قبل أن يكتب. وتنص وثائق أنثروبيك على أن رموز التفكير تحاسب بسعر رموز الإخراج، وهي الأغلى.
ونشرت أنثروبيك مع الإعلان نتائج شركات جربت النموذج قبل إطلاقه:
- Balyasny لإدارة الأصول: على 2,441 مهمة مالية بين أسئلة واستخراج بيانات وتحليل وتوقعات، استهلك Sonnet 5.5 نحو 121 ألف رمز للإجابة الواحدة، مقابل 497 ألفا استهلكها Sonnet 5، وجاءت نتيجته أعلى.
- Slack: تفوق على Sonnet 5 في كل اختباراتها الداخلية لمساعدها Slackbot تقريبا، بخطوات أقل ورموز إخراج أقل بنحو 14%، دون أي تعديل على التعليمات.
- Lovable: احتاج في اختبارات البرمجة استدعاءات أدوات أقل بالثلث، ونحو نصف أوامر التشغيل لينهي المهمة.
- Box: كان أدق من النموذج السابق، وأسرع منه 2.4 مرة، واستهلك إجمالي رموز أقل بنسبة 12%.
لاحظ المدى بين الأرقام: من 12% رموزا أقل إلى نحو ثلاثة أرباع أقل، بحسب نوع العمل. وهذه نتائج اختبارات الشركات نفسها كما نشرتها أنثروبيك، لا قياسات مستقلة. المعنى العملي أن الوفر الحقيقي في منشأتك لا يعرف إلا بتجربة على مهامك أنت.
Sonnet 5.5 أم Opus 5.5: الفرق في السعر والقدرة
Opus 5.5 ضعف السعر في الإدخال والإخراج، وقراءة التخزين المؤقت بالسعر نفسه، والفارق في معظم الاختبارات المنشورة صغير. لكن أنثروبيك نفسها تحدد لكل منهما دورا مختلفا.
| البند | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| المعرف في الواجهة البرمجية | claude-sonnet-5-5 | claude-opus-5-5 |
| السعر (إدخال / إخراج لكل مليون رمز) | 2 / 10 دولارات | 4 / 20 دولارا |
| كتابة في التخزين المؤقت (5 دقائق) | 2.50 دولار | 5 دولارات |
| قراءة من التخزين المؤقت | 0.20 دولار | 0.20 دولار |
| واجهة الدفعات (إدخال / إخراج) | 1 / 5 دولارات | 2 / 10 دولارات |
| نافذة السياق / أقصى إخراج | مليون رمز / 128 ألف رمز | مليون رمز / 128 ألف رمز |
| مستوى الجهد الافتراضي في الواجهة البرمجية | high | medium |
| Terminal-Bench 4.0 — البرمجة في الطرفية | 70.6% | 66.4% |
| CursorBench 4.0 — مهام برمجة من جلسات حقيقية | 55.5% | 57.8% |
| OSWorld 2.1 — استخدام الحاسوب | 80.1% | 81.8% |
| GDPval-AA — أعمال مهنية في 44 مهنة (نقاط تقييم) | 1844 | 1846 |
| Humanity's Last Exam — مع أدوات | 64.5% | 67.7% |
الأرقام من إعلان أنثروبيك ووثائق الأسعار والنماذج. ونتيجة Opus 5.5 في Terminal-Bench هي أعلى نتائجه، عند مستوى الجهد Xhigh. وللمقارنة، سجل Sonnet 5 في GDPval-AA نحو 1449 نقطة.
الأرقام متقاربة، لكن أنثروبيك تكتب في الإعلان نفسه أن الاختبارات تقيس جانبا واحدا من القدرة، وأن Opus 5.5 يبقى في اختباراتها واختبارات المختبرين الخارجيين أقوى بوضوح في العمل المعقد المفتوح الذي يحتاج حكما متواصلا. أما Sonnet 5.5 فأقوى ما يكون في المهام اليومية محددة النطاق، وإصلاح الأخطاء البرمجية، وإعداد المستندات والعروض والجداول.
وفي قراءتنا لذلك بلغة التشغيل: الرد على استفسار عميل بقواعد واضحة، واستخراج بيانات فاتورة، وتلخيص اجتماع، ومسودة عرض من قالب ثابت، مهام تناسب Sonnet. أما تصميم نظام جديد، أو تحليل مفتوح يوازن بين خيارات، أو قرار يعتمد على سياق طويل متشعب، فمهام قد يستحق فيها Opus فرق السعر. وقارنا Opus 5.5 بالنموذج الأعلى Fable 5.1 بالتفصيل في مقال سابق.
مستوى الجهد: الإعداد الذي يحرك الفاتورة أكثر من اسم النموذج
يعمل Sonnet 5.5 بخمسة مستويات جهد: low و medium و high و xhigh و max. كلما ارتفع المستوى عمل النموذج أطول وراجع نفسه أكثر، فترتفع تكلفة المهمة وترتفع النتيجة عادة. والافتراضي هو medium داخل تطبيقات Claude و Claude Code، و high عند استخدامه عبر الواجهة البرمجية.
وتذكر أنثروبيك أن Sonnet 5.5 على مستوى low أو medium تجاوز في عدة اختبارات أفضل نتيجة سجلها Sonnet 5، بنحو عشر تكلفة المهمة. وفي اختبار FrontierCode، الذي يقيس هل يقبل تعديل الكود للدمج دون تحرير بشري، سجل على مستوى high نتيجة أعلى من Sonnet 5 على المستوى نفسه بعشر نقاط، وبنحو جزء من خمسة عشر من تكلفة المهمة.
وفي الإعلان ملاحظة تستحق التوقف: على FrontierCode سجل Sonnet 5.5 على مستوى max نتيجة أقل من مستوى xhigh، لأنه أكثر من تشغيل أداة مراجعة الكود في Claude Code التي توزع المراجعة على وكلاء فرعيين، وفي حالتين فحصتهما شركة Cognition انتهى الوقت أو أضاف تعديلات خارج المطلوب. أعلى جهد ليس أفضل نتيجة دائما، لكنه عادة الأغلى.
ودليل الانتقال في وثائق أنثروبيك ينبه إلى أن المستويات أعيدت معايرتها، فالمستوى نفسه لا ينتج مقدار التفكير نفسه الذي كان في Sonnet 5. وتوصي الوثائق بالبدء من high للعمل العام، ومن medium لمهام البرمجة والأدوات المتعددة إذا كانت محددة جيدا، ومن medium أو low للمحادثة وكل ما يحتاج ردا سريعا. أي أن نظاما يستدعي النموذج عبر الواجهة البرمجية دون تحديد المستوى سيعمل على high، وقد يدفع أكثر مما تحتاجه مهامه الروتينية.
قبل أن يغير المطور اسم النموذج في نظامك
تبديل النموذج يبدو تغيير سطر واحد، لكن دليل الانتقال يذكر تغييرات قد توقف تكاملا يعمل اليوم أو تغير فاتورته:
- إيقاف التفكير تغير: الأنظمة التي توقف التفكير في Sonnet 5 بالإعداد
thinking: {"type": "disabled"}ستتلقى خطأ 400 من Sonnet 5.5. البديل هو الإعداد الجديدbetween_tools، ولا يقبل إلا على مستويات الجهد low و medium و high. - التفكير يعمل افتراضيا: الطلب الذي لا يحدد إعداد التفكير يعمل على Sonnet 5.5 بالتفكير التكيفي. ومن ينتقل من Sonnet 4.6 أو أقدم أو من Haiku 4.5، حيث كان التفكير مغلقا افتراضيا، سيدفع رموز تفكير على الطلبات التي لم تحدد إعداد التفكير.
- النص نفسه برموز أكثر لمن يأتي من الجيل 4: يستخدم Sonnet 5.5 طريقة تقطيع النص نفسها التي في Sonnet 5، وتقول الوثائق إن النص نفسه ينتج نحو 30% رموزا أكثر مقارنة بـ Sonnet 4.6 و Sonnet 4.5 و Haiku 4.5، بحسب المحتوى. أي أن وفر المهمة الذي تعلنه أنثروبيك محسوب مقابل Sonnet 5، لا مقابل الجيل 4.
- شكل الرد: قد يبدأ الرد بكتلة تفكير قبل النص، فالشيفرة التي تقرأ أول عنصر في الرد على أنه النص ستنكسر.
- إعدادات ترفض: ميزانيات التفكير الثابتة، والقيم غير الافتراضية لمعاملات مثل temperature و top_p، والتعبئة المسبقة لرد النموذج، وفرض استخدام الأدوات، سواء أداة بعينها أو أي أداة، كلها تعيد خطأ 400.
- مهام الأمن السيبراني: لأن قدرات النموذج السيبرانية تقارب Opus 5، أطلقته أنثروبيك بضوابط تحول المهام الأمنية عالية الخطورة بشكل ظاهر إلى Sonnet 5. وفي الواجهة البرمجية يعود الطلب المرفوض برد رفض، ما لم يفعل المطور خيار التحويل التلقائي التجريبي المتاح في واجهة Claude فقط. أما إصلاح الأخطاء في الكود ضمن التطوير المعتاد فلا يتأثر.
والنموذج متاح عبر منصة Claude و AWS و Google Cloud و Microsoft Azure، وتنص الوثائق على أنه لن يتقاعد قبل 28 سبتمبر 2027، فمن يبني عليه اليوم لديه نحو سنة قبل أن يضطر إلى الانتقال.
كيف تقيس تكلفة المهمة في منشأتك
السؤال الذي يستحق أن تطرحه على من يدير تكامل الذكاء الاصطناعي عندك ليس كم سعر النموذج، بل كم تكلفنا المهمة المقبولة الواحدة. والقياس بسيط:
- اختر عينة حقيقية: من 20 إلى 50 مهمة من عملكم الفعلي، مثل ردود على عملاء أو فواتير تستخرج منها البيانات، لا أمثلة مصطنعة.
- شغلها على النموذجين: النموذج الحالي و Sonnet 5.5، وعلى مستويين من الجهد على الأقل. الواجهة البرمجية تعيد مع كل رد عدد رموز الإدخال والإخراج، فسجلها مع زمن التنفيذ.
- احكم على الجودة بموظف: يقرر من يعرف العمل أي المخرجات مقبولة كما هي.
- احسب التكلفة لكل مهمة مقبولة: إجمالي التكلفة مقسوما على عدد المخرجات المقبولة. النموذج الأرخص الذي يحتاج إعادة ثلث مهامه ليس أرخص.
- استفد من خيارات التسعير: المهام غير العاجلة، مثل معالجة أرشيف فواتير، تعمل عبر واجهة الدفعات بنصف السعر: دولار للإدخال و 5 دولارات للإخراج لكل مليون رمز. والسياق الذي يتكرر في كل طلب، مثل سياسات الشركة أو كتالوج المنتجات، يقرأ من التخزين المؤقت بـ 0.20 دولار بدل دولارين، وصار الحد الأدنى لما يمكن تخزينه 512 رمزا بدل 1,024.
نظرة أوريجامي
جداول الأسعار تغري بالمقارنة بسعر المليون رمز، لكن هذا الإصدار مثال واضح على أن الرقم المهم هو تكلفة المهمة. النموذج نفسه بالسعر نفسه قد يصبح أرخص لأنه يعمل بخطوات أقل، وقد يصبح أغلى إن فتح التفكير افتراضيا أو رفع أحد مستوى الجهد دون قياس. ومن يدفع فاتورة ذكاء اصطناعي شهرية دون أن يعرف تكلفة المهمة الواحدة يدير بندا لا يراه.
لذلك نرى أن أي نظام يستخدم نموذج لغة داخل المنشأة يجب أن يجعل اسم النموذج ومستوى الجهد إعدادا يغير دون إعادة برمجة، وأن يسجل الرموز لكل مهمة ويعرضها في تقرير شهري. عندها يصبح الانتقال إلى إصدار جديد، مثل Sonnet 5.5 اليوم و Haiku 5.5 الذي تقول أنثروبيك إنه سيصدر خلال الأسابيع القادمة، قرارا يقاس في أيام لا مشروعا جديدا.
الخلاصة
Sonnet 5.5 لم يخفض السعر المعلن، لكنه قد يخفض فاتورتك إن كان النموذج السابق يستهلك في عملك خطوات ورموزا كثيرة. قبل التبديل:
- اطلب من المطور مراجعة إعدادات التفكير والشيفرة التي تقرأ الرد، ثم اختبار التكامل في بيئة تجريبية قبل النظام الحي.
- قس تكلفة المهمة المقبولة على عينة حقيقية، على مستويين من الجهد على الأقل.
- إن كنت على Sonnet 4.6 أو أقدم، فاحسب أثر الرموز الإضافية للنص نفسه قبل أن تفترض أي وفر.
- أبق Opus 5.5 للمهام المفتوحة التي تحتاج حكما، وانقل إلى Sonnet 5.5 المهام المحددة المتكررة، ثم راقب الأرقام شهرا كاملا.
مصادر
- أنثروبيك — إعلان Claude Sonnet 5.5 (28 سبتمبر 2026)
- وثائق Claude — الأسعار، ومنها واجهة الدفعات والتخزين المؤقت
- وثائق Claude — نظرة عامة على النماذج: نافذة السياق وأقصى إخراج ومستوى الجهد الافتراضي وموعد التقاعد
- وثائق Claude — دليل الانتقال إلى Sonnet 5.5
- TechCrunch — أنثروبيك تطلق Sonnet 5.5 (28 سبتمبر 2026)
أسئلة شائعة
هل Claude Sonnet 5.5 أرخص من Sonnet 5؟+
سعره لكل مليون رمز هو نفسه: دولاران للإدخال و 10 دولارات للإخراج. لكن أنثروبيك تقول إنه يكلف في اختباراتها حتى 30% أقل لكل مهمة، لأنه ينجز العمل برموز وخطوات أقل. الوفر يختلف بحسب نوع العمل، ولا يعرف في منشأتك إلا بتجربة على عينة من مهامك الحقيقية.
متى أختار Opus 5.5 بدل Sonnet 5.5؟+
Opus 5.5 ضعف السعر: 4 دولارات للإدخال و 20 للإخراج لكل مليون رمز. وتقول أنثروبيك إنه يبقى أقوى بوضوح في العمل المعقد المفتوح الذي يحتاج حكما متواصلا، بينما Sonnet 5.5 أقوى في المهام اليومية محددة النطاق وإصلاح الأخطاء وإعداد المستندات والعروض. المهام المتكررة ذات القواعد الواضحة تذهب عادة إلى Sonnet.
هل يكفي أن نغير اسم النموذج في نظامنا لننتقل إليه؟+
ليس دائما. الأنظمة التي توقف التفكير بالإعداد disabled ستتلقى خطأ 400 ويجب أن تستخدم between_tools، والقيم غير الافتراضية لمعاملات مثل temperature ترفض، وكذلك فرض استخدام الأدوات، وقد يبدأ الرد بكتلة تفكير قبل النص. اطلب من المطور مراجعة دليل الانتقال واختبار التكامل في بيئة تجريبية أولا.
ما مستوى الجهد المناسب لمهام الأعمال اليومية؟+
الافتراضي عبر الواجهة البرمجية هو high. وتوصي وثائق أنثروبيك بالبدء من medium أو low للمحادثة والمهام التي تحتاج ردا سريعا، ومن medium لمهام البرمجة والأدوات المحددة جيدا. جرب مستويين على عينة من مهامك وقارن تكلفة المهمة المقبولة، ولا تفترض أن أعلى مستوى يعطي أفضل نتيجة.
تابع أوريجامي في نتائج قوقل
ثبت أوريجامي كمصدر مفضل، فتظهر لك مقالاتنا أولا في نتائج قوقل وفي الأخبار الرائجة.
الإضافة إلى المصادر المفضلة في Googleمقالات ذات صلة
- الذكاء الاصطناعيEleven v4 يرد بالعربية خلال 100 ملي ثانية، والصعب هو ما سيقوله لعميلكأطلقت إليفن لابز Eleven v4 ونسخة Turbo بزمن توليد نحو 100 ملي ثانية ودعم أكثر من 90 لغة منها العربية. الأسعار والحدود وما تجهزه قبل أن يرد صوت آلي على عملائك.
- الذكاء الاصطناعيشاومي تفتح MiMo-V2.6 برخصة MIT، ونسخته الخفيفة تقرأ مليون رمز بـ14 سنتاأطلقت شاومي نماذج MiMo-V2.6 مفتوحة المصدر برخصة MIT: نموذج واحد يفهم النص والصوت والصورة والفيديو بسياق مليون رمز وأسعار تبدأ من 0.14 دولار للمليون.
- الذكاء الاصطناعيوكيل مفتوح المصدر يعمل لأيام لا لدقائق: Atria Dawn وفاتورة تشغيله الحقيقيةمختبر شنغهاي نشر Atria Dawn بترخيص MIT: 744 مليار معامل لوكيل مصمم للمهام الطويلة. ما الذي يصلح له فعلا، وكم يكلّف تشغيله داخل منشأتك.
- الذكاء الاصطناعيسباق النماذج يفرمل: مقيّمون خارجيون بشارة ومكتب داخل أنثروبيك، وأوبن إيه آي توافق خلال ساعاتفي 12 سبتمبر 2026 دعا رئيس أنثروبيك إلى إبطاء تطوير نماذج الذكاء الاصطناعي والتزم بفتح الشركة لمقيّمين مستقلين. ما الذي يتغير فعليا في خطتك التقنية للعام القادم.
- الذكاء الاصطناعيSWE-2 يطابق نماذج الصف الأول في البرمجة بثلث التكلفة، ثم يسقط في اختبار واحدCognition أطلقت SWE-2 في 10 سبتمبر 2026: 50.0% على FrontierCode مقابل 50.9% لـ Fable 5.1 وبتكلفة أقل 64%، لكنه يتأخر 28 نقطة في اختبار Terminal-Bench 4.
- الذكاء الاصطناعيمن أشهر إلى ساعات: معيار MHS يربط أجهزة مصنعك ومختبرك بوكيل ذكاء اصطناعي واحدأنثروبيك تفتح معاينة بحثية لمعيار MHS الذي يمكن وكيل ذكاء اصطناعي من تشغيل أجهزة المختبر والمصنع معا، ويختصر ربطها من أسابيع إلى ساعات. ما هو، ولمن يصلح اليوم.
عندك مشروع تفكر فيه؟
نبني أنظمة وتطبيقات ومواقع مخصصة لأعمالك. احك لنا عن فكرتك ونعطيك رأينا الصريح فيها.
