العودة للمدونة
الذكاء الاصطناعي

شاومي تفتح MiMo-V2.6 برخصة MIT، ونسخته الخفيفة تقرأ مليون رمز بـ14 سنتا

فريق أوريجاميالفريق التحريري
7 دقائق
شاومي تفتح MiMo-V2.6 برخصة MIT، ونسخته الخفيفة تقرأ مليون رمز بـ14 سنتا
يعجبك ما ننشره؟ ثبت أوريجامي كمصدر مفضل في قوقل.الإضافة إلى المصادر المفضلة في Google

شاومي تفتح MiMo-V2.6 برخصة MIT، ونسخته الخفيفة تقرأ مليون رمز بـ14 سنتا

الخلاصة المباشرة: في 22 سبتمبر 2026 أطلقت شاومي عائلة نماذج MiMo-V2.6 ونشرت أوزانها برخصة MIT التي تسمح بالاستخدام التجاري والتعديل دون قيود تذكر. العائلة تضم نموذجين: Pro بحجم 1.02 تريليون معامل، وFlash بحجم 309 مليارات معامل. كلاهما يقبل النص والصورة والفيديو والصوت في نموذج واحد، وبسياق يصل إلى مليون رمز. وعلى منصة OpenRouter يبدأ سعر Flash من 0.14 دولار لكل مليون رمز مدخل. هذا يعني لشركتك أمرين: خيار تشغيل ذاتي على خوادمك بترخيص مريح، وخيار API رخيص جدا للمهام التي تجمع الصوت والصورة والنص.

ما الذي أطلقته شاومي بالضبط

النموذجان مبنيان بمعمارية «خليط الخبراء» (MoE)، أي أن جزءا صغيرا فقط من المعاملات يعمل عند كل رمز، وهذا ما يخفض كلفة التشغيل مقارنة بالحجم الكلي:

  • MiMo-V2.6-Pro: إجمالي 1.02 تريليون معامل، منها 42 مليارا نشطة عند كل خطوة، وسياق مليون رمز.
  • MiMo-V2.6-Flash: إجمالي 309 مليارات معامل، منها 15 مليارا نشطة، وبالسياق نفسه.
  • Pro-UltraSpeed: نسخة من Pro تقول شاومي إنها أسرع في الاستدلال بما يصل إلى 20 مرة، وتقدم عبر API بسعر أعلى بعشرة أضعاف.

ولم تكتف الشركة بالأوزان. نشرت معها أكثر من 7 آلاف بيئة تدريب بالتعلم المعزز تغطي هندسة البرمجيات وإعادة إنتاج الثغرات والعمل المعرفي وتصميم المواقع، إلى جانب إطار التدريب نفسه والتقرير التقني، ونموذجا صغيرا مقطرا بحجم 9 مليارات معامل مبنيا على Qwen. الأوزان منشورة بدقة FP8 على Hugging Face ومتاحة للتنزيل دون طلب إذن.

أين يقف أداؤه فعلا

منحت Artificial Analysis نموذج Pro درجة 46.32 على مؤشرها للذكاء. وتقول شاومي إنه بهذه الدرجة يتقدم على Kimi K3 وQwen3.8 Max ليصبح أقوى نموذج مفتوح المصدر عند إطلاقه، مع إقرارها بأنه ما زال خلف Claude Fable 5.1 وGPT-6 Astra.

أما جدول المقارنات في بطاقة النموذج فيقارنه بجيل سابق من النماذج المغلقة، لا بالجيل الحالي. وهذه أرقامه أمام Claude Opus 5:

  • AutomationBench (أتمتة المهام): 53.1 مقابل 50.3.
  • Terminal Bench 2.1 (العمل في سطر الأوامر): 89.9 مقابل 89.1.
  • DeepSWE (إصلاح أخطاء برمجية حقيقية): 71.9 مقابل 74.0.
  • OSWorld-Verified (استخدام الحاسوب): 82.0 مقابل 83.4.
  • Terminal Bench 4.0 الأصعب: 34.9 مقابل 49.0.

الخلاصة الصادقة: نموذج قريب من نماذج الصف الأول في الجيل السابق في مهام الوكلاء والبرمجة، ويتأخر بوضوح في المهام الأصعب. فلا تقرأ الإعلان على أنه بديل مكافئ لأحدث النماذج المغلقة.

السعر: الرقم الذي يغير حسابات التشغيل

على OpenRouter، يكلف كل مليون رمز مدخل وكل مليون رمز مخرج ما يلي:

  • Flash: 0.14 دولار للمدخل و0.28 دولار للمخرج.
  • Pro: 0.435 دولار للمدخل و0.87 دولار للمخرج.
  • Pro-UltraSpeed: 4.35 دولارات للمدخل و8.70 دولارات للمخرج.

مثال توضيحي بافتراضات نضعها نحن: مساعد خدمة عملاء يعالج 1,000 محادثة يوميا، في كل محادثة نحو 3,000 رمز مدخل و500 رمز مخرج. يستهلك ذلك 3 ملايين رمز مدخل ونصف مليون مخرج في اليوم. بنموذج Flash تبلغ الكلفة نحو 0.56 دولار يوميا، أي قرابة 63 ريالا شهريا. وبنموذج Pro نحو 1.74 دولار يوميا، أي قرابة 196 ريالا شهريا. الأرقام الفعلية تتغير بطول محادثاتك وبالتخزين المؤقت للسياق، لكن الفارق في الحجم هو المهم: التكلفة هنا لم تعد عائقا أمام التجربة. وتقول شاومي إن كلفة Pro تعادل ما بين جزء من 20 وجزء من 60 من كلفة النماذج الأجنبية عند مستوى الذكاء نفسه، وهذا ادعاء الشركة وليس قياسا مستقلا.

نموذج واحد يسمع ويرى ويقرأ

الجديد الذي يستحق الانتباه هو أن المدخلات الأربعة يفهمها نموذج واحد. اليوم، إذا أردت نظاما يحلل تسجيلات مكالمات العملاء، تحتاج غالبا إلى خدمة تحويل الكلام إلى نص، ثم نموذج لغوي يحلل النص. ومثلها صورة فاتورة يصورها مندوب بجواله: خدمة لاستخراج النص من الصورة، ثم نموذج لفهمه. كل حلقة في هذه السلسلة كلفة إضافية ونقطة تعطل محتملة.

النموذج متعدد الوسائط يختصر السلسلة: تسجيل المكالمة يدخل كما هو، وصورة الإيصال كما هي، ومقطع الفيديو من كاميرا المستودع كما هو. هذا يبسط بناء أنظمة مثل مراجعة جودة المكالمات، أو إدخال المستندات آليا في نظام المحاسبة، أو فحص صور البضائع عند الاستلام. لكن تذكر أن المصادر لا تذكر أداء النموذج في اللغة العربية أو اللهجات السعودية تحديدا، وهذا ما يجب أن تختبره على بياناتك قبل أي قرار.

التشغيل على خوادمك: ممكن، لكن بحساب

رخصة MIT تعني أنك تستطيع تشغيل النموذج داخل بنيتك وتعديله ودمجه في منتج تجاري. وهذا مهم لمن يعالج بيانات شخصية، لأن نظام حماية البيانات الشخصية يضع ضوابط على نقل البيانات إلى خارج المملكة، والتشغيل الذاتي يبقيها داخل بيئتك.

لكن الحجم حقيقي. بطاقة Pro تعرض إعداد تشغيل بتوزيع النموذج على 8 وحدات معالجة رسومية عبر vLLM، أو على عقدتين عبر SGLang. أما Flash فيكفيه توزيع على 4 وحدات. البطاقة لا تحدد نوع الوحدات، لكن نموذجا بهذا الحجم يحتاج عمليا إلى خوادم ذكاء اصطناعي من الفئة العليا. لذلك فإن Flash، بمعاملاته النشطة الخمسة عشر مليارا، هو المرشح الواقعي للتشغيل الذاتي عند أغلب المنشآت. شرحنا حسابات العتاد بالتفصيل في مقال كيف تشغل نموذجا كبيرا على جهازك.

ما يجب أن تنتبه له قبل أن تعتمده

  • الأمان: يتأخر Pro كثيرا في اختبارات استغلال الثغرات، فدرجته في ExploitBench بلغت 47.9 مقابل 70.0 لنموذج Opus 5. إذا كانت مهمتك مراجعة أمنية للكود، فهذا ليس خيارك الأول.
  • مسار البيانات: استخدامه عبر API يعني أن بيانات عملائك تمر بخوادم مزود خارجي. للبيانات الحساسة، التشغيل الذاتي أو إخفاء الهوية قبل الإرسال شرط لا خيار.
  • الأرقام من المصنع: معظم نتائج الاختبارات منشورة من شاومي نفسها. اختبر على مهمة من عملك بأسئلة من بياناتك.

كيف نتعامل معه في أوريجامي

لا نربط الأنظمة التي نبنيها بنموذج واحد. نضع طبقة وسيطة تسمح بتبديل النموذج دون إعادة بناء التطبيق، ثم نقيس كل مرشح على مهمة حقيقية من عمل العميل: الدقة، والكلفة لكل عملية، وزمن الاستجابة. MiMo-V2.6 يدخل هذه القائمة الآن، خصوصا في المهام التي تجمع الصوت والصورة والنص، وحيث تكون الكلفة الشهرية هي ما يمنع مشروع الذكاء الاصطناعي من الانطلاق. إذا كانت لديك مهمة من هذا النوع وتريد أن تعرف كلفتها الحقيقية قبل أن تلتزم، تواصل معنا.

المصادر

#MiMo-V2.6#نماذج مفتوحة المصدر#الذكاء الاصطناعي متعدد الوسائط#تكلفة الذكاء الاصطناعي

أسئلة شائعة

ما هو MiMo-V2.6 من شاومي؟+

عائلة نماذج ذكاء اصطناعي أطلقتها شاومي في 22 سبتمبر 2026 ونشرت أوزانها برخصة MIT. تضم Pro بحجم 1.02 تريليون معامل (42 مليارا نشطة) وFlash بحجم 309 مليارات (15 مليارا نشطة). كلاهما يفهم النص والصورة والفيديو والصوت بسياق مليون رمز.

كم تكلفة استخدام MiMo-V2.6 عبر API؟+

على OpenRouter يكلف Flash 0.14 دولار لكل مليون رمز مدخل و0.28 دولار للمخرج، ويكلف Pro 0.435 دولار للمدخل و0.87 دولار للمخرج. مساعد يعالج ألف محادثة متوسطة يوميا قد يكلف أقل من 70 ريالا شهريا على Flash، بحسب طول المحادثات.

هل أستطيع تشغيله على خوادم شركتي؟+

نعم، رخصة MIT تسمح بالتشغيل والتعديل والاستخدام التجاري. لكن إعدادات التشغيل المرجعية في بطاقة Pro توزعه على 8 وحدات معالجة رسومية، بينما يكفي Flash توزيع على 4 وحدات، لذلك هو الخيار الواقعي للتشغيل الذاتي عند أغلب المنشآت.

هل هو أفضل من ChatGPT وClaude؟+

لا. يقترب من نماذج الجيل السابق مثل Claude Opus 5 في مهام البرمجة والأتمتة ويتأخر في المهام الأصعب، وشاومي نفسها تقر بأنه خلف Claude Fable 5.1 وGPT-6 Astra. ميزته الحقيقية هي السعر والرخصة المفتوحة وفهم الصوت والصورة في نموذج واحد.

تابع أوريجامي في نتائج قوقل

ثبت أوريجامي كمصدر مفضل، فتظهر لك مقالاتنا أولا في نتائج قوقل وفي الأخبار الرائجة.

الإضافة إلى المصادر المفضلة في Google

مقالات ذات صلة

عندك مشروع تفكر فيه؟

نبني أنظمة وتطبيقات ومواقع مخصصة لأعمالك. احك لنا عن فكرتك ونعطيك رأينا الصريح فيها.

جلسة واحدة. عشرون دقيقة. بلا التزامات.