Scovai Scovai
AI & Operations 2026-09-14 1 min read

أنت تُحسّن الربع الأرخص من فاتورة وكلائك: McKinsey تُقدّر الإشراف البشري بنسبة 70–75% من التكلفة المتغيرة لوكيل الذكاء الاصطناعي

DSL

Dr. Sarah Liu

أنت تُحسّن الربع الأرخص من فاتورة وكلائك: McKinsey تُقدّر الإشراف البشري بنسبة 70–75% من التكلفة المتغيرة لوكيل الذكاء الاصطناعي

احسب تكلفة وكيل لخدمة العملاء في القطاع المصرفي، فتبلغ فاتورة التوكنات 20 إلى 25 بالمئة من تكلفته المتغيرة للتشغيل. أما الإشراف البشري — خبراء الوظائف والمخاطر الذين يراجعون عمل الوكيل — فيبلغ 70 إلى 75 بالمئة (McKinsey QuantumBlack، 2026).

سير العمل نفسه. الفاتورة نفسها. ومع ذلك، فإن كل دراسة جدوى للوكلاء قرأتها هذا العام تقريبًا تُحسّن الرقم الأصغر.

اختيار النموذج، وتخزين المطالبات مؤقتًا، ومستوى استدلال أرخص للاستدعاءات منخفضة المخاطر: هناك يذهب اهتمام الهندسة، لأن التكلفة هناك قابلة للقراءة. تصل شهريًا، مُفصّلة، وقابلة للنسب. أما الإشراف فيصل على هيئة ساعات مدفوعة الراتب داخل مركز تكلفة شخص آخر، فلا يُحتسب أبدًا ضمن تكلفة وكيل الذكاء الاصطناعي. بل يُحتسب باعتباره السبب في أن المشروع التجريبي فشل بهدوء في التوسّع.

ما الذي سعّرته McKinsey فعليًا

يفعل دليل QuantumBlack الصادر في 24 أغسطس 2026 حول اقتصاديات سير العمل الوكيلي شيئًا تتجاوزه معظم تحليلات الوكلاء: فهو يُسعّر العمل المُنجز، لا البرمجيات. الوكلاء، والأنظمة الحتمية، والبشر الذين يراجعون المُخرجات، كل ذلك في رقم واحد محمّل بالكامل.

الحالة المرجعية هي فتح حساب مصرفي. يستخدم سير العمل من خمسة إلى سبعة وكلاء إلى جانب أنظمة حتمية متعددة، مع فريقين إلى أربعة فرق من البشر يوفّرون الإشراف. تنخفض التكلفة المحمّلة بالكامل لكل عملية تسجيل مكتملة من نحو 50-150 دولارًا إلى نحو 10-30 دولارًا (McKinsey QuantumBlack، 2026).

هذا تحسّن بمقدار ثلاثة إلى خمسة أضعاف. إذن، هذه ليست حجة على أن الوكلاء لا يحققون عائدًا. إنها حجة على أنك تتابع البند الخاطئ لتعرف ما إذا كان وكلاؤك يحققون عائدًا.

ولإعطاء مقياس: تُقدّر McKinsey سير العمل بوكيل واحد الموجّه للعملاء في بعض البنوك بما بين 20,000 و30,000 دولار سنويًا للتشغيل، وفريق متعدد الوكلاء بما بين 100,000 و200,000 دولار. هذه الأرقام مستمدة من تحليل McKinsey لأبحاث عامة وأسعار معلنة، لا من دفاتر عملاء مدققة — فتمسّك بالنِّسَب بإحكام وبالأرقام المطلقة برفق.

ما الذي يحرّك فعليًا تكلفة وكيل الذكاء الاصطناعي: معدل الاستثناء، لا النموذج

في تسجيل العملاء المصرفيين، تتوقع McKinsey أن تُراجَع نسبة 10 إلى 20 بالمئة من عمليات التشغيل الوكيلية من قِبل خبراء المخاطر والخبراء الوظيفيين.

معدل المراجعة هذا هو اللعبة كلها، ويستحق أن نمرّ على الحساب بتأنٍّ — المثال التالي من عندي، لا من McKinsey، لكن المدخلات مدخلاتهم.

خذ سير عمل بمعدل مراجعة 15% و20 دقيقة من وقت الخبير لكل مراجعة. عبر 1,000 عملية تشغيل، يعني ذلك 50 ساعة من وقت وظيفي رفيع. اخفض معدل المراجعة إلى 5% فتكلّف الألف عملية نفسها نحو 17 ساعة. لقد أزلت ثلثي البند المكلف دون أن تمسّ نموذجًا أو مطالبة أو عقد مورّد.

ولاحظ مَن يقوم بتلك المراجعة. تحدد McKinsey خبراء الوظائف والمخاطر — أي الأشخاص الذين وُجد سير العمل أصلًا لحماية حكمهم، لا طبقة ضمان جودة مبتدئة يمكن توظيفها بثمن زهيد. تكلفة الإشراف مرتفعة تحديدًا لأن الإشراف الرخيص ليس إشرافًا؛ فالمراجِع يجب أن يكون رفيع المستوى بما يكفي ليَنقض قرار الوكيل. وأي خطة تفترض إمكانية تفويض طبقة المراجعة إلى الأسفل هي في الحقيقة خطة للتوقف عن المراجعة.

قارن ذلك الآن بالرافعة التي يسحبها الجميع فعليًا. تحدد McKinsey ثلاثة محركات فقط لتكلفة التوكنات: جودة النموذج، ومتطلب زمن الاستجابة، وتكرار المهمة. بلغت أسعار الطراز المتقدم في أوائل يوليو 2026 نحو 5 دولارات لكل مليون توكن إدخال و30 دولارًا لكل مليون توكن إخراج لنموذج من الفئة العليا، مقابل 0.20 و1.25 دولار لنموذج خفيف أقدم. فارق بمقدار خمسة وعشرين ضعفًا — مُطبَّق على ربع الفاتورة.

وهنا يكمن الفخ داخل التحسين البديهي. اخفض مستوى النموذج لتقليل التوكنات فترفع معدل الخطأ. ومعدل الخطأ الأعلى يرفع معدل الاستثناء. ومعدل الاستثناء الأعلى يرفع ساعات المراجعة، أي الأرباع الثلاثة. إن توفير التوكنات يموّل روتينيًا زيادة في الإشراف لا يقيسها أحد، فيصبح سير العمل أغلى بينما تُظهره لوحة المعلومات أرخص.

لماذا لا تختفي ساعات المراجعة

ثمة أدلة مستقلة على أن بند الإشراف بنيوي، لا مشكلة نضج تتجاوزها مع النمو.

استطلعت MIT Technology Review Insights وMicrosoft آراء 300 من المسؤولين التنفيذيين والممارسين في مجال التقنية، وصنّفت 101 مهمة وكيلية على مقياس ثقة من 0 إلى 100. تتبعت الثقة قابلية التحقق من المهمة واكتمال سياق الأعمال، لا قدرة النموذج: سجّل التوليد الآلي للتقارير 83.5 وسجّلت الشيفرة النمطية 82.5، ولكلٍّ منهما مقياس تقييم موضوعي وحيد، بينما سجّل تكوين شبكة الخدمات 37.5 وسجّلت اختبارات التعافي من الكوارث 43 — النماذج الأساسية نفسها، ناقص طريقة نظيفة لمعرفة ما إذا كانت المخرجات صحيحة. أقلقت المساءلة 48% من المشاركين والهلوسة 47%، و59% يخططون بالفعل لإشراف بشري دائم (MIT Technology Review Insights، 2026).

وتشير بيانات الإنتاج إلى الاتجاه نفسه. وجدت دراسة لمنتج الوكيل من Perplexity مقارنةً بمنتج البحث لديها أن إنجاز المهام المتطابقة انخفض من 269 دقيقة إلى 36 — بخفض 87% في الوقت و94% في التكلفة — بينما انتقل عمل المتابعة الذي يقوم به المستخدمون إلى الأعلى، نحو التحقق والتوسيع (arXiv 2606.07489، 2026).

العمل البشري يُعاد توطينه في خطوة المراجعة. وMcKinsey ببساطة أول من يضع سعرًا للمكان الذي يحطّ فيه.

الحجم وإعادة الاستخدام يقرران ما إذا كانت الحسابات تستقيم

النصف الآخر من اقتصاديات McKinsey هو التكلفة الثابتة، وهو النصف الذي يحدد ما إذا كانت برامج الوكلاء في السوق المتوسطة تتخطى العتبة أصلًا.

وكيل محادثة يتولى تسجيل 2,500 عميل جديد سنويًا يكلّف 10,000-15,000 دولار. ضاعِف الحجم فترتفع التكلفة إلى 15,000-20,000 دولار فقط — لأن البنية التحتية للذكاء الاصطناعي وتنسيق الوكلاء ثابتان إلى حد بعيد، والتكاليف الثابتة تُستهلك بالتوزيع. ولاحظ ما يقع داخل بند التنسيق ذاك: طاقة دائمة في علم البيانات للحفاظ على الوكيل في بيئة الإنتاج، وهو ما تلاحظ McKinsey أنه "كثيرًا ما يحتاج إلى تعديل كل بضعة أيام".

لذلك تخسر عمليات سير العمل منخفضة الحجم مرتين. فهي لا تحصل على استهلاك للتكلفة الثابتة، وتبقى نسبة الإشراف فيها مرتفعة لأنها لا تراكم أبدًا ما يكفي من عمليات التشغيل ليكتشف أحدهم أنماط الاستثناء ويصممها بعيدًا.

مخرج السوق المتوسطة هو إعادة الاستخدام لا التوسّع. فإذا لم يحمل أي سير عمل منفرد حجمًا كافيًا لاستهلاك بند البنية التحتية والتنسيق، يصبح السؤال: كم عدد عمليات سير العمل التي يمكن تشغيلها على بناء وكيل واحد؟ إطار McKinsey هو: ابنِ مرة واحدة، وانشر عبر عدة عمليات سير عمل. ثلاث عمليات متجاورة تتشارك وكيلًا وطبقة سياق وبروتوكول مراجعة تتخطى عتبة التكلفة الثابتة التي لا تتخطاها أي منها منفردة. هذا قرار معماري يُتخذ قبل أول مشروع تجريبي، ويصعب جدًا تداركه لاحقًا بعد أن يكون كل فريق من ثلاثة فرق قد اشترى حلًّا نقطيًا خاصًا به.

يظهر هذا التفاوت في بيانات التبني. وجد تقرير State of AI 2026 من McKinsey أن المؤسسات التي تتجاوز إيراداتها مليار دولار والتي توسّع استخدام الوكلاء ارتفعت من 27% إلى 40%، بينما ظلت المؤسسات دون المليار ثابتة عند 22%. وأفاد نحو 20% بأن تكاليف تشغيل الذكاء الاصطناعي قيّدت استخدامهم، وبقيت نسبة من ينسبون إلى الذكاء الاصطناعي أثرًا ما على الأرباح قبل الفوائد والضرائب عند 37%، دون تغيير عن العام السابق (McKinsey، 2026).

التبني يتراكم. الأثر المالي المُعلن لا يتراكم. تلك هي بصمة بند تكلفة لا يديره أحد.

الاعتراض الأمين: هذا قطاع مصرفي، وهو تقدير

تحفّظان يُستحسن أن تسمعهما مني لا من مديرك المالي.

أولًا، رقم 70-75% مستمد من خدمات مالية منظَّمة وموجّهة للعملاء. وشدة الإشراف دالة على التعرّض التنظيمي وعلى تبعات الخطأ. أما الفرز الداخلي للتذاكر في شركة لوجستيات من 200 موظف فيقع على منحنى مختلف، وقد يكون التقسيم هناك أقرب إلى التعادل.

ثانيًا، هذه تكاليف مُنمذجة مبنية على أسعار معلنة وأبحاث عامة، لا دفاتر مقيسة من ارتباط مع عميل. تعامل معها بوصفها تقديرًا محدّدًا جيدًا، لا قياسًا.

لكن لاحظ اتجاه الخطأ. أسعار التوكنات انخفضت باطراد وستواصل الانخفاض. رواتب المراجعين لم تنخفض ولن تنخفض. كل شهر يمر يدفع النسبة أبعد ضد التوكنات، لا عائدًا نحوها. وإذا كانت 70-75% خاطئة لسياقك اليوم، فالتصحيح الأمين هو أن تسأل إلى ماذا ستتحول بعد ثمانية عشر شهرًا — لا أن تفترض أنها ستعود إلى شيء تستطيع لوحة التوكنات رؤيته.

سعّر ساعات المراجعة قبل أن تعتمد المشروع التجريبي

خمسة أمور غيّرها في طريقة تقييمك لمقترح الوكلاء القادم.

  1. ضع معدل الاستثناء في دراسة الجدوى كرقم مُسمّى. نسبة عمليات التشغيل التي تتطلب مراجعة بشرية، والدقائق المتوقعة لكل مراجعة، والتكلفة المحمّلة للساعة للمراجِع. إن لم يلتزم أحد بهذه الأرقام الثلاثة، فليس لديك دراسة جدوى: لديك عرض توضيحي مُرفق به ميزانية.
  2. اهندس قابلية التحقق قبل أن توسّع النطاق. يُظهر تصنيف MIT–Microsoft أن الثقة تتبع المهام ذات مقياس نجاح وحيد وقابل للقراءة. وهذه الخاصية قابلة للبناء: جهّز المقياس، ورمّز سياق الأعمال، وضيّق النطاق. رتّب عمليات النشر حسب قابلية التحقق، لا حسب أي مهمة تبدو أبسط.
  3. رتّب عمليات سير العمل المرشحة أولًا حسب عدد عمليات التشغيل السنوية. إعادة الاستخدام والحجم هما ما يستهلك التكلفة الثابتة. حالة استخدام ذكية منخفضة الحجم استثمار أسوأ من حالة مملة عالية الحجم، في كل مرة.
  4. خصّص ميزانية صريحة لبند الصيانة. الوكلاء الذين يُعدَّلون كل بضعة أيام يتطلبون طاقة هندسية دائمة. هذه تكلفة ثابتة مستمرة، لا مصروف مشروع.
  5. أبلِغ عن عائد الاستثمار للعمل المُنجز. التكلفة المحمّلة بالكامل لإنهاء العمل — البشر والوكلاء والأنظمة الحتمية معًا — مقيسةً مقابل قيمة العمل. لا التكلفة لكل توكن، ولا الساعات الموفَّرة نظريًا.

وصفة McKinsey نفسها معاكسة للحدس: بدلًا من تحسين اختيار النموذج، أعِد تصميم سير العمل لخفض معدلات الاستثناء وتبسيط عمليات المراجعة التي تستدعي تدخلًا بشريًا مكلفًا. هذا تكليف بهندسة العمليات يقبع داخل ما ظل الجميع يعاملونه بوصفه قرار مشتريات.

ما الذي يجب أن تقرره هذا الربع

ابحث عن المشروع التجريبي للوكلاء الذي ينتظر توقيعك، واطلب رقمًا واحدًا غير موجود في العرض: ساعات المراجعة المتوقعة لكل مئة عملية تشغيل.

إن كان الجواب هزّة كتفين، فأنت لا تُطالَب باعتماد برنامج. أنت تُطالَب بتوظيف فريق مراجعة لم يضع له أحد ميزانية — وأن تفعل ذلك عند تلك الأرباع الثلاثة من تكلفة وكيل الذكاء الاصطناعي التي لم تُبنَ لوحة معلوماتك يومًا لتُظهرها لك.

Ready to go beyond the CV?

Scovai's AI-powered Talent Passport reveals what resumes can't: personality, potential, and true job fit.