كيف تشغل ذكاء اصطناعي بحجم كلود و شات جي بي تي على جهازك أنت؟

كيف تشغل ذكاء اصطناعي بحجم كلود و شات جي بي تي على جهازك أنت؟
السؤال يتكرر علينا من أصحاب الأعمال: بياناتنا حساسة، وفاتورة الاستخدام تكبر كل شهر، فهل نشغل النموذج عندنا بدل الاعتماد على خدمة خارجية؟
والجواب الصادق يبدأ بتصحيح بسيط: أوزان كلود و GPT غير منشورة أصلا، فلا أحد يشغلها في بيته مهما كان جهازه. لكن الذي تستطيع تشغيله فعلا هو نماذج مفتوحة الأوزان تصل اليوم إلى مئتي مليار بارامتر وأكثر، وتقترب في كثير من المهام العملية مما تعطيك إياه الخدمات المدفوعة: تلخيص المستندات، والإجابة على أسئلة بياناتك، وكتابة الكود، والترجمة. والفجوة تضيق كل بضعة أشهر.
فالسؤال الحقيقي ليس هل يمكن، بل كم بارامتر يسع جهازك. وهذا يقودنا إلى القاعدة الوحيدة التي تحسم كل شيء.
القاعدة التي تحسم القرار: الذاكرة قبل السرعة
النموذج يجب أن يدخل في الذاكرة كاملا ليعمل. والحساب أبسط مما يبدو:
- بالدقة الكاملة: بايتان لكل بارامتر.
- بضغط ٨-بت: بايت واحد لكل بارامتر.
- بضغط ٤-بت: نصف بايت لكل بارامتر، وهو الخيار العملي لأغلب الاستخدامات.
ثم أضف نحو ٢٠ إلى ٣٠٪ لذاكرة السياق والتشغيل. والنتيجة هذا الجدول التقديري الذي تقيس به أي جهاز:
| حجم النموذج | بدقة كاملة | بضغط ٨-بت | بضغط ٤-بت | أين يعمل |
|---|---|---|---|---|
| ٨ مليار | ~١٩ جيجا | ~١٠ جيجا | ~٥ جيجا | أي حاسب بذاكرة ١٦ جيجا، حتى لابتوب |
| ٣٢ مليار | ~٧٧ جيجا | ~٣٩ جيجا | ~٢٢ جيجا | Mac Mini أو Mac Studio الأساسي، أو حاسب بـ٣٢ جيجا |
| ٧٠ مليار | ~١٦٨ جيجا | ~٨٤ جيجا | ~٤٥ جيجا | Mac Studio بـ M5 Max، أو AMD Ryzen AI Max+ 395، أو DGX Spark |
| ١٢٠ مليار | ~٢٨٨ جيجا | ~١٤٤ جيجا | ~٧٥ جيجا | الثلاثة نفسها بسعة ١٢٨ جيجا، بأريحية |
| ٢٠٠ مليار | ~٤٨٠ جيجا | ~٢٤٠ جيجا | ~١٢٠ جيجا | ١٢٨ جيجا بالكاد؛ الأريح Mac Studio بـ M5 Ultra |
| ٤٠٠ مليار | ~٩٦٠ جيجا | ~٤٨٠ جيجا | ~٢٤٠ جيجا | Mac Studio بـ M5 Ultra و ٥١٢ جيجا |
| ٦٧٠ مليار | ~١٦٠٠ جيجا | ~٨٠٠ جيجا | ~٤٠٠ جيجا | Mac Studio بـ ٥١٢ جيجا، أو عدة أجهزة مربوطة عبر Thunderbolt 5 |
الأرقام تشمل هامش التشغيل، وهي تقديرية تختلف قليلا باختلاف طريقة الضغط وطول السياق.
هذا الجدول وحده يختصر عليك أغلب المقارنات: انظر لسعة ذاكرة الجهاز أولا، فهي التي تحدد ماذا تشغل. أما عرض النطاق ونوع المعالج فيحددان كم بسرعة.
الخيارات المتاحة اليوم
آبل — Mac Studio الجديد
أعلنت آبل في 25 أغسطس 2026 جيلا جديدا من Mac Studio يشحن من 22 سبتمبر، أما نسخة ٥١٢ جيجا فتصل في أواخر أكتوبر. وهو اليوم أوسع خيار متاح من ناحية السعة:
- M5 Max: معالج بثمانية عشر نواة، ومعالج رسومي حتى أربعين نواة بمسرعات عصبية داخل كل نواة، وحتى ١٢٨ جيجابايت ذاكرة موحدة بعرض نطاق يصل إلى ٦١٤ جيجابايت في الثانية.
- M5 Ultra: حتى ست وثلاثين نواة معالجة، وثمانين نواة رسومية، وحتى ٥١٢ جيجابايت ذاكرة موحدة — أي أنه يشغل نماذج ضخمة كاملة على الجهاز.
- ومنفذ Thunderbolt 5 يتيح ربط أكثر من جهاز معا، بأداء يصل إلى ثلاثة أضعاف في الاستدلال الموزع مقارنة بجهاز واحد.
وميزته الحقيقية أن الذاكرة موحدة بين المعالج والرسوميات، فلا تحتاج بطاقة بذاكرة منفصلة. ومعه إطاران للمطورين: Core AI الجديد و MLX مفتوح المصدر.
AMD — معالج Ryzen AI Max+ 395
يأتي في أجهزة مكتبية صغيرة بـ١٢٨ جيجابايت ذاكرة موحدة، ويعمل بويندوز أو لينكس، وسعره أقل من منافسه المباشر من إنفيديا. وهو الخيار العملي لمن يريد ١٢٨ جيجا بأقل تكلفة، ولمن يفضل بيئة لينكس المألوفة لفريقه.
إنفيديا — DGX Spark
جهاز بحجم لتر واحد تقريبا يحمل شريحة Grace Blackwell و١٢٨ جيجابايت، وهو الذي أسس هذي الفئة أصلا. ميزته الأهم ليست الأرقام بل منظومة CUDA: أغلب أدوات الذكاء الاصطناعي وأطر التدريب كتبت لها أولا. فإن كان فريقك سيدرب أو يعدل نماذج لا يكتفي بتشغيلها، فهذا اعتبار جوهري.
المسار التقليدي — سيرفر ببطاقات رسومية منفصلة
يبقى الأنسب حين تخدم عدة مستخدمين في وقت واحد. بطاقات الخوادم تعطي عرض نطاق أعلى بكثير من أجهزة الذاكرة الموحدة، وهذا يظهر في عدد الطلبات المتزامنة لا في حجم النموذج. عيبه: تكلفة أعلى، وكهرباء وحرارة وضجيج يحتاج غرفة مناسبة.
مقارنة الأجهزة في جدول
| الجهاز | المعالج | الذاكرة | النظام | يناسب |
|---|---|---|---|---|
| Mac Studio بـ M5 Max | ١٨ نواة معالجة، ٤٠ نواة رسومية | حتى ١٢٨ جيجا موحدة | macOS | نماذج حتى ٢٠٠ مليار، مستخدم أو اثنان |
| Mac Studio بـ M5 Ultra | ٣٦ نواة معالجة، ٨٠ نواة رسومية | حتى ٥١٢ جيجا موحدة | macOS | أكبر النماذج المفتوحة، وربط عدة أجهزة |
| AMD Ryzen AI Max+ 395 | معالج AMD بذاكرة موحدة | ١٢٨ جيجا موحدة | ويندوز أو لينكس | أقل تكلفة لسعة ١٢٨ جيجا |
| NVIDIA DGX Spark | شريحة Grace Blackwell | ١٢٨ جيجا | لينكس، منظومة CUDA | من سيدرب أو يعدل النماذج |
| سيرفر ببطاقات منفصلة | بطاقات رسومية منفصلة | حسب البطاقات | لينكس | خدمة عدة مستخدمين في وقت واحد |
الأسعار الدقيقة وأين تشتري
أخذنا أسعار آبل من متجرها مباشرة، الأمريكي والسعودي، بتاريخ نشر هذا المقال:
| التهيئة | السعر في أمريكا | السعر في السعودية |
|---|---|---|
| M5 Max — ١٨ نواة معالجة و ٣٢ رسومية | ٢٤٩٩ دولارا | ١١٬٩٩٩ ريالا |
| M5 Max — ١٨ نواة معالجة و ٤٠ رسومية | ٣٠٩٩ دولارا | ١٤٬٩٩٩ ريالا |
| M5 Ultra — ٣٠ نواة معالجة و ٦٤ رسومية | ٥٤٩٩ دولارا | ٢٥٬٩٩٩ ريالا |
| M5 Ultra — ٣٦ نواة معالجة و ٨٠ رسومية | ٦٧٩٩ دولارا | ٣٢٬٤٩٩ ريالا |
الشراء: متجر آبل السعودية أو متجر آبل الأمريكي. وهذي أسعار البداية لكل تهيئة؛ رفع الذاكرة إلى أقصاها يرفعها كثيرا، ونسخة ٥١٢ جيجا تصل في أواخر أكتوبر لا مع الإطلاق. لاحظ أن السعر السعودي يشمل ضريبة القيمة المضافة بينما السعر الأمريكي قبل الضريبة.
أما AMD و إنفيديا فلا يبيعان هذي الأجهزة مباشرة بسعر واحد: معالج AMD يأتي داخل أجهزة من مصنعين مختلفين بأسعار تتراوح بين ١٥٠٠ و ٤٠٠٠ دولار حسب المصنع والتهيئة، و DGX Spark أُطلق قرب ٤٠٠٠ دولار وارتفع سعره في السوق. ولم نجد لهما إدراجا رسميا في متاجر التجزئة السعودية حتى تاريخ النشر، فالشراء يتم عبر موزعين أو استيراد — واحسب حينها الضريبة والجمارك والشحن. صفحتاهما الرسميتان: NVIDIA DGX Spark و AMD Ryzen AI Max+ 395.
كيف تختار عمليا
- مستخدم واحد أو اثنان؟ جهاز بذاكرة موحدة يكفي ويوفر كثيرا.
- فريق يستخدم النظام في وقت واحد؟ ستحتاج بطاقات منفصلة، لأن المشكلة صارت عدد الطلبات المتزامنة لا حجم النموذج.
- ستدرب أو تعدل نماذج؟ رجح CUDA.
- تريد أكبر نموذج ممكن بأقل تعقيد؟ السعة الكبرى اليوم عند آبل.
- ميزانية محدودة؟ ١٢٨ جيجا تكفي لنماذج تصل إلى مئتي مليار بضغط ٤-بت، وهذا يغطي أغلب احتياجات الشركات فعلا.
والمقايضة التي يجب أن تفهمها قبل الشراء: أجهزة الذاكرة الموحدة تعطيك سعة كبيرة بعرض نطاق أقل من بطاقات الخوادم. أي أنها تحمل النموذج الكبير بلا مشكلة، لكن سرعة توليد الكلمات تكون أبطأ. لو استخدامك محادثة وتلخيص فلن تلاحظ كثيرا، ولو كان معالجة دفعات ضخمة فستلاحظ.
متى يكون السيرفر الخاص قرارا خاطئا؟
نقولها بصراحة لأننا نراها كثيرا: الجهاز ليس نهاية المشروع بل بدايته. أنت تشتري معه مسؤولية التحديث والنسخ الاحتياطي والمراقبة ومن يصلحه حين يتوقف يوم الخميس. وإن كان استخدامك متقطعا وصغيرا، فالفاتورة الشهرية لخدمة خارجية أرخص من ثمن الجهاز وكهربائه ووقت من يديره.
السيرفر الخاص يستحق حين تجتمع ثلاثة: بيانات لا يصح خروجها، واستخدام كثيف ثابت، وشخص أو جهة تتولى تشغيله. وإن نقص واحد منها، أعد الحساب.
نظرة أوريجامي
نرى أن أهم سؤال ليس أي جهاز تشتري، بل ماذا ستشغل عليه. أغلب من يسألنا عن سيرفر خاص يحتاج فعليا نموذجا متوسطا يجيب على مستندات شركته، وهذا يعمل على ١٢٨ جيجا بأريحية، وأحيانا على أقل. شراء ٥١٢ جيجا لتشغيل نموذج بسبعين مليار بارامتر إنفاق بلا عائد.
ونصيحتنا العملية: ابدأ بتحديد المهمة، ثم اختر النموذج الذي ينجزها، ثم اشتر الجهاز الذي يسع ذلك النموذج مع هامش. ونحن نساعد في هذا الترتيب: تحديد المهمة، واختيار النموذج المناسب، وبناء الطبقة التي تربطه ببياناتك وأنظمتك — لأن النموذج وحده بلا ربط ببياناتك يبقى أداة عامة لا نظام يخدم شركتك. تجدنا في صفحة التواصل.
الخلاصة
لا تشغل كلود في بيتك، لكنك تشغل نماذج مفتوحة قوية تكفي أغلب أعمال الشركات. احسب حاجتك بالبارامترات أولا: نصف بايت لكل بارامتر بضغط ٤-بت زائد هامش. ثم اختر بين ذاكرة موحدة تعطيك سعة بتكلفة معقولة، وبطاقات منفصلة تعطيك سرعة وتزامنا. والقرار الأهم يبقى قبل الجهاز: ما الذي ستشغله ولماذا.
مصادر
- بيان آبل الصحفي، 25 أغسطس 2026 — مواصفات Mac Studio بـ M5 Max و M5 Ultra، وسعات الذاكرة الموحدة وعرض النطاق، وربط الأجهزة عبر Thunderbolt 5، وإطارا Core AI و MLX.
- مراجعات مستقلة من StorageReview و HotHardware لأجهزة AMD Ryzen AI Max+ 395 و NVIDIA DGX Spark، ومقارنات السعة والسعر بينهما.
- حساب الذاكرة حسب دقة التمثيل مبني على القاعدة القياسية المعروفة في تشغيل النماذج: بايتان لكل بارامتر بالدقة الكاملة، وتقل بالتناسب مع الضغط.
أسئلة شائعة
هل أستطيع تشغيل كلود أو شات جي بي تي على جهازي؟+
لا. أوزان هذي النماذج غير منشورة، فلا يمكن تشغيلها محليا مهما كان جهازك. المتاح هو نماذج مفتوحة الأوزان تصل إلى مئتي مليار بارامتر وأكثر، وتؤدي أغلب المهام العملية بكفاءة قريبة.
كيف أحسب الذاكرة التي يحتاجها نموذج معين؟+
اضرب عدد البارامترات في حجم الوحدة: بايتان بالدقة الكاملة، أو بايت واحد بضغط ٨-بت، أو نصف بايت بضغط ٤-بت. ثم أضف ٢٠ إلى ٣٠ بالمئة لذاكرة السياق. فنموذج بسبعين مليار بضغط ٤-بت يحتاج نحو أربعين إلى خمسين جيجابايت.
ما أكبر سعة متاحة في جهاز مكتبي اليوم؟+
Mac Studio بمعالج M5 Ultra يصل إلى ٥١٢ جيجابايت ذاكرة موحدة، ويشحن من 22 سبتمبر 2026. أما أجهزة AMD و إنفيديا في هذي الفئة فتصل إلى ١٢٨ جيجابايت.
ما الفرق بين الذاكرة الموحدة والبطاقات المنفصلة؟+
الذاكرة الموحدة تعطي سعة كبيرة بتكلفة أقل لكن بعرض نطاق أقل، فتناسب مستخدما أو اثنين. والبطاقات المنفصلة تعطي عرض نطاق أعلى بكثير فتناسب خدمة عدة مستخدمين في وقت واحد.
متى لا يستحق السيرفر الخاص؟+
حين يكون استخدامك متقطعا وصغيرا، أو لا يوجد من يتولى تشغيله وصيانته. يستحق حين تجتمع بيانات حساسة لا يصح خروجها، واستخدام كثيف ثابت، وجهة تتولى التشغيل.
هل أحتاج CUDA؟+
إن كنت ستشغل نماذج جاهزة فلا، وأجهزة آبل و AMD تكفي. أما إن كان فريقك سيدرب أو يعدل النماذج فمنظومة CUDA من إنفيديا تبقى الأوسع دعما في الأدوات والأطر.
تابع أوريجامي في نتائج قوقل
ثبت أوريجامي كمصدر مفضل، فتظهر لك مقالاتنا أولا في نتائج قوقل وفي الأخبار الرائجة.
الإضافة إلى المصادر المفضلة في Googleمقالات ذات صلة
- الذكاء الاصطناعيبيانات عميلك لا تغادر جهازك: بربلكستي تشغل نصف المهمة محليابربلكستي أطلقت Hybrid Compute على الماك: بوابة على الجهاز تفحص كل مهمة وتستبدل الأسماء والعناوين قبل إرسالها للسحابة. المعمار أهم من المنتج لمنشأتك.
- الذكاء الاصطناعيتينسنت تفتح أوزان Hy4: 770 مليار معامل تشغلها على خوادمك أنتتينسنت تطلق Hy4 بأوزان مفتوحة تحت رخصة Apache 2.0: 770 مليار معامل ونافذة مليون رمز، وأوزان تنزلها وتشغلها داخل بنيتك بلا إرسال بياناتك لأحد. متى تستحق الاستضافة الذاتية فعلا، ومتى تكون تكلفة بلا عائد؟
- الذكاء الاصطناعيالاتحاد الأوروبي يصنف شات جي بي تي محرك بحث: ماذا يعني ذلك لعملك؟المفوضية الأوروبية صنفت شات جي بي تي محرك بحث ضخم جدا في 31 أغسطس 2026. إليك ما يعنيه القرار لظهور نشاطك في إجابات الذكاء الاصطناعي وما يجب فعله الآن.
- الذكاء الاصطناعيقمة الذكاء الاصطناعي العالمية 2026 في الرياض: ماذا تعني لصاحب العمل؟تستضيف الرياض النسخة الرابعة من قمة الذكاء الاصطناعي العالمية GAIN من 15 إلى 17 سبتمبر 2026. دليل عملي لصاحب العمل السعودي: ماذا تراقب، وكيف تحول الإعلانات إلى قرار.
- الذكاء الاصطناعيجوجل تطلق أمر boost في Antigravity: فرق وكلاء تكتب الكود وتراجعهجوجل أضافت أمر boost إلى بيئة Antigravity ليشغل خط تفكير متعدد الوكلاء يقسم المشكلة ثم يتحقق من الحل بجولات مستقلة. ماذا يعني هذا لمن يطلب برمجيات؟
- الذكاء الاصطناعيجرانايت 4.2 من IBM: نماذج تفكير مفتوحة تعمل على خوادمك أنتأطلقت IBM نماذج جرانايت 4.2 في 25 أغسطس 2026: ثلاثة نماذج تفكير مفتوحة برخصة Apache 2.0 تدعم العربية ومفتاح تفكير. ماذا يعني ذلك لشركتك عمليا.
النشرة الأسبوعية
أحدث المقالات التي تهم صاحب العمل، مرة كل أسبوع. بريدك فقط.
عندك مشروع تفكر فيه؟
نبني أنظمة وتطبيقات ومواقع مخصصة لأعمالك. احك لنا عن فكرتك ونعطيك رأينا الصريح فيها.
