كلود يقود 26% من أبحاث أنثروبيك: المقياس الذي يكشف نصيب الذكاء الاصطناعي من عملك

كلود يقود 26% من أبحاث أنثروبيك: المقياس الذي يكشف نصيب الذكاء الاصطناعي من عملك
الإجابة المباشرة: في 17 سبتمبر 2026 نشرت أنثروبيك «مؤشر أتمتة البحث والتطوير»، وهو أول قياس تفصيلي معلن لنصيب الذكاء الاصطناعي من العمل داخل مختبر نماذج رائد. النتيجة المعلنة أن كلود «يقود» 26% من أعمال بحث وتطوير النماذج داخل الشركة في أغسطس 2026، صعودا من أقل من 1% في فبراير من العام نفسه، وأن أكثر من 90% من هذا العمل يجري عند مستوى «التعاون» أو أعلى، مع عدم وصول أي فئة مقاسة إلى الاستقلال الكامل. والأهم لمنشأتك ليس الرقم، بل الطريقة التي وصلوا بها إليه، لأنها قابلة للنسخ على عملك بأدوات تملكها اليوم.
ما الذي نشرته أنثروبيك بالضبط
معظم الحديث عن «كم يؤتمت الذكاء الاصطناعي من العمل» يقوم على انطباعات: مدير يقول إن نصف عمل فريقه صار آليا، ومطور في الفريق نفسه يقول إن الأداة لا تكتب إلا القوالب. ما فعلته أنثروبيك أنها حولت هذا السؤال إلى قياس متكرر بمنهجية ثابتة بدلا من الانطباع.
الفكرة بسيطة في جوهرها: احصر كل أنواع العمل التي تجري فعلا داخل أقسام بحث وتطوير النماذج، ثم قيّم كل نوع منها على سلم يقيس درجة مشاركة النموذج، ثم اجمع التقييمات بوزن يعكس أهمية كل نوع. الشركة تصف المؤشر بأنه نموذج أولي وليس قياسا نهائيا، وتضعه ضمن جهد أوسع لتقليل الفجوة بين ما تعرفه المختبرات وما يعرفه الناس عن سرعة تطور هذه التقنية.
سلم من ست درجات: من AL0 إلى AL5
المقياس المستخدم مأخوذ من مركز Epoch AI ويسمى «مستوى الأتمتة»، ويمتد من صفر إلى خمسة:
- AL0: لا مشاركة للذكاء الاصطناعي إطلاقا.
- AL1 و AL2: مشاركة محدودة ثم مساعدة، أي أن الإنسان ينفذ والنموذج يقترح أو يسرّع خطوات صغيرة.
- AL3 «يتعاون»: النموذج ينجز أجزاء كبيرة من المهمة تحت توجيه بشري قريب ومستمر.
- AL4 «يقود»: النموذج ينهي معظم المهمة من طرفها إلى طرفها انطلاقا من توجيه عام، مع إشراف بشري.
- AL5: استقلال كامل بلا إنسان في الحلقة، وهذه الدرجة لم تتحقق في أي فئة مقاسة.
حين تقول أنثروبيك «26%» فهي تعني الفئات التي وصلت إلى AL4 تحديدا. الفرق بين AL3 و AL4 هو الفرق الذي يهم إدارتك عمليا: في الأول يبقى الإنسان داخل كل خطوة، وفي الثاني ينتقل دوره إلى تحديد الهدف ومراجعة المخرج.
الرقم الأهم في التقرير ليس 26%
في تفاصيل المنهجية رقم يستحق وقفة أطول من العنوان نفسه: حين قارنوا تقييم النموذج لدرجة الأتمتة بتقييم الموظف الذي يؤدي العمل، تطابق التقييمان تماما في 59% من الحالات، وبقيا ضمن درجة واحدة من بعضهما في 97%. أما حين قارنوا تقييم موظف بتقييم زميله لنفس العمل، فلم يتطابقا إلا في 35% من الحالات.
بعبارة أوضح: اختلاف البشر فيما بينهم حول «كم يؤتمت من عملنا» أكبر من اختلافهم مع النموذج. وهذا يفسر النقاشات التي تدور في اجتماعاتكم بلا نتيجة. إن كان زميلان في الفريق نفسه لا يتفقان على وصف عملهما، فأي قرار استثمار في الذكاء الاصطناعي يبنى على انطباع جماعي هو قرار على أرض رخوة. الحل ليس مزيدا من النقاش، بل مقياس مكتوب وثابت يعاد تطبيقه على الشيء نفسه كل فترة.
كيف تبني نسختك من المؤشر خلال أسبوع
المنهجية التي وصفتها أنثروبيك قابلة للتصغير إلى حجم منشأة متوسطة. الخطوات باختصار:
- احصر العمل الحقيقي لا الوصف الوظيفي: أنثروبيك اختارت عينة عشوائية من 20% من موظفي الأقسام المعنية خلال شهر يوليو 2026، وراجعت عملهم الفعلي من المحادثات والوثائق الداخلية، فنتج نحو 15 ألف مهمة دقيقة. عندك تكفي عينة أصغر بكثير من أسبوع عمل حقيقي لفريق أو فريقين.
- رتب المهام في شجرة: تلك الـ15 ألف مهمة جُمعت في شجرة من 542 عقدة، منها 378 فئة نهائية. المنشأة المتوسطة تصل إلى صورة مفيدة بثلاثين إلى خمسين فئة نهائية.
- رجّح بالوقت لا بالإحساس: استخدموا وقت الأشخاص المخصص لكل مهمة مؤشرا على أهميتها. هذا يمنع تضخيم المهام اللامعة قليلة الأثر.
- قيّم كل فئة على سلم AL0–AL5: واكتب سبب التقييم في سطر واحد حتى يمكن مراجعته لاحقا.
- جمّد السلة وأعد القياس: النقطة الجوهرية أن قائمة الفئات تُجمّد بعد بنائها، فيعاد القياس على الشيء نفسه لا على قائمة جديدة كل مرة. بغير التجميد تقيس تغير قائمتك لا تقدم الأتمتة.
ناتج هذا التمرين ليس رقما للتباهي، بل خريطة تخبرك أين يقف الذكاء الاصطناعي فعلا في تشغيلك: أي فئات وصلت إلى «يتعاون» وتستحق أتمتة أعمق، وأيها ما زالت عند الصفر رغم أنها تستهلك ساعات كثيرة، وهذه تحديدا فرصك القريبة.
ماذا يعني مستوى «يقود» عمليا في تشغيلك
حين تصل فئة عمل عندك إلى مستوى AL4، يتغير شكل الإدارة لا حجم الفريق فقط. التوجيه يصبح عاما والمراجعة تصبح على المخرج النهائي، وهذا يعني أن جودة المخرج تعتمد على أمرين: وضوح التعليمات المكتوبة، ووجود نقطة مراجعة قبل أي أثر لا يمكن التراجع عنه — إرسال إلى عميل، تعديل على بيانات حقيقية، أو التزام مالي.
في المشاريع التي نبنيها للعملاء، هذه النقطة هي الفارق بين أتمتة تعتمد عليها وأخرى تخيفك. النموذج يستطيع أن يقود مهمة كاملة، لكن النظام حولها هو ما يحدد ماذا يحدث حين يخطئ: هل يظهر الخطأ في سجل قابل للمراجعة ويتوقف عند بوابة موافقة، أم يمر إلى العميل مباشرة؟ الانتقال من AL3 إلى AL4 قرار تصميم في النظام قبل أن يكون قرار ثقة في النموذج.
تحفظات ذكرتها أنثروبيك نفسها
الأمانة تقتضي ذكر حدود هذا القياس كما أوردتها الشركة: لم تتحقق منه جهة خارجية مستقلة، وقد أُنتج إلى حد كبير باستخدام كلود نفسه، أي أن النموذج الذي يُقاس شارك في القياس — وهو ما قد ينقل أخطاءه إلى الحكم. الشركة تقول إنها تعتزم إشراك مقيّمين مستقلين لاحقا. كذلك فإن تجميد سلة المهام عند خط أساس يوليو 2026 يعني أن أنواع العمل التي ظهرت بعده لا تدخل في الحساب.
ولذلك اقرأ الرقم على ما هو عليه: إشارة اتجاه قوية من داخل مختبر رائد، لا حقيقة مطلقة عن سوق العمل. القفزة من أقل من 1% إلى 26% خلال ستة أشهر تستحق الانتباه بصرف النظر عن دقة العشرات.
من أين تبدأ
ابدأ بفريق واحد وأسبوع واحد. سجل ما فعله الفريق فعلا، صنفه في ثلاثين فئة، قيّم كل فئة على السلم، جمّد القائمة، وأعد القياس بعد ثلاثة أشهر. ستحصل على شيء لا تملكه أغلب المنشآت اليوم: خط أساس مكتوب تقارن به بدل أن تجادل فيه. وإن أردت تحويل الفئات التي ظهرت عند الصفر إلى أنظمة تعمل، فهذا بالضبط ما نبنيه في أوريجامي.
المصادر
- أنثروبيك — قياس سرعة تطور الذكاء الاصطناعي داخل المختبرات الرائدة: anthropic.com
- Epoch AI — سلم مستويات الأتمتة المستخدم في المؤشر: epoch.ai
أسئلة شائعة
ماذا يعني أن كلود «يقود» 26% من العمل؟ هل استغنوا عن الباحثين؟+
لا. «يقود» في المؤشر تعني الدرجة الرابعة من سلم من ست درجات: النموذج ينهي معظم المهمة من طرفها إلى طرفها انطلاقا من توجيه عام، لكن تحت إشراف بشري. أنثروبيك تصرح بأن أي فئة عمل مقاسة لم تصل إلى الاستقلال الكامل بلا إنسان في الحلقة.
منشأتي متوسطة الحجم، هل يمكنني بناء مؤشر مشابه؟+
نعم، ولا يحتاج أدوات خاصة. اختر فريقا واحدا، سجل عمله الفعلي خلال أسبوع، رتبه في ثلاثين إلى خمسين فئة، رجّح كل فئة بالوقت المصروف عليها، ثم قيّمها على سلم من صفر إلى خمسة. الشرط الوحيد المهم هو تجميد قائمة الفئات وإعادة القياس عليها نفسها كل ثلاثة أشهر.
ما الفائدة العملية من قياس نصيب الذكاء الاصطناعي من عملنا؟+
تكشف الخريطة فئتين مهمتين: فئات وصلت إلى مستوى تعاون جيد وتستحق أتمتة أعمق، وفئات ما زالت بلا أي مشاركة رغم استهلاكها ساعات كثيرة — وهذه غالبا أسرع عائد متاح لك. بدون قياس مكتوب تستثمر حسب الانطباع، وبيانات التقرير نفسه تظهر أن الانطباعات البشرية متضاربة إلى حد كبير.
هل الرقم موثوق؟+
اقرأه كإشارة اتجاه لا كحقيقة نهائية. أنثروبيك تذكر صراحة أن المؤشر لم تتحقق منه جهة خارجية مستقلة وأنه أُنتج إلى حد كبير باستخدام كلود نفسه، وأنها تعتزم إشراك مقيّمين مستقلين لاحقا. مع ذلك فالانتقال من أقل من 1% في فبراير 2026 إلى 26% في أغسطس اتجاه واضح يستحق الانتباه.
تابع أوريجامي في نتائج قوقل
ثبت أوريجامي كمصدر مفضل، فتظهر لك مقالاتنا أولا في نتائج قوقل وفي الأخبار الرائجة.
الإضافة إلى المصادر المفضلة في Googleمقالات ذات صلة
- الذكاء الاصطناعي للأعمالClaude Cowork صار جاهزا للمؤسسات: ماذا يعني ذلك لعملك؟Claude Cowork من Anthropic صار متاحا عبر الخطط المدفوعة مع ضوابط للمؤسسات. تعرف على ما يفعله وكيل العمل الذكي وكيف تتبناه في شركتك بأمان.
- الذكاء الاصطناعيسباق النماذج يفرمل: مقيّمون خارجيون بشارة ومكتب داخل أنثروبيك، وأوبن إيه آي توافق خلال ساعاتفي 12 سبتمبر 2026 دعا رئيس أنثروبيك إلى إبطاء تطوير نماذج الذكاء الاصطناعي والتزم بفتح الشركة لمقيّمين مستقلين. ما الذي يتغير فعليا في خطتك التقنية للعام القادم.
- الذكاء الاصطناعيمن أشهر إلى ساعات: معيار MHS يربط أجهزة مصنعك ومختبرك بوكيل ذكاء اصطناعي واحدأنثروبيك تفتح معاينة بحثية لمعيار MHS الذي يمكن وكيل ذكاء اصطناعي من تشغيل أجهزة المختبر والمصنع معا، ويختصر ربطها من أسابيع إلى ساعات. ما هو، ولمن يصلح اليوم.
- الذكاء الاصطناعيبيانات عميلك لا تغادر جهازك: بربلكستي تشغل نصف المهمة محليابربلكستي أطلقت Hybrid Compute على الماك: بوابة على الجهاز تفحص كل مهمة وتستبدل الأسماء والعناوين قبل إرسالها للسحابة. المعمار أهم من المنتج لمنشأتك.
- الذكاء الاصطناعينجاح واحد ليس موثوقية: كيف تختبر وكيل الذكاء الاصطناعي قبل تسليمه عملياتك؟دراسة مايكروسوفت الجديدة تكشف أن أفضل نموذج ينجح في 65% من مهام الأعمال مرة واحدة، لكنه يكررها بلا خطأ عشرين مرة في 25% فقط. إليك ما يعنيه ذلك لمشروعك.
- الذكاء الاصطناعيتقرير البنك الدولي 2026 للذكاء الاصطناعي: ماذا يعني لشركتك السعودية؟تقرير التنمية في العالم 2026 من البنك الدولي وضع السعودية ضمن أكبر عشر دول في الاستثمار بالذكاء الاصطناعي. إليك ما يعنيه إطار التبني والتكييف والتقدم لشركتك عمليا.
عندك مشروع تفكر فيه؟
نبني أنظمة وتطبيقات ومواقع مخصصة لأعمالك. احك لنا عن فكرتك ونعطيك رأينا الصريح فيها.
