8 دقائق قراءة
تكلفة وكيل الذكاء الاصطناعي: كم يكلّف بناؤه وتشغيله؟
تنقسم تكلفة وكيل الذكاء الاصطناعي إلى تكلفة بناء لمرة واحدة وفاتورة تشغيل متكررة. إليك ما يحرّك كلاً منهما، ونطاقات توضيحية مع افتراضاتها المعلنة، وطريقة إبقاء تكلفة المهمة الواحدة مرئية.
تتكوّن تكلفة وكيل الذكاء الاصطناعي من جزأين: تكلفة بناء لمرة واحدة تحددها عمليات التكامل وإجراءات الكتابة في الأنظمة وأعمال التقييم، وتكلفة تشغيل متكررة يحددها عدد استدعاءات النموذج لكل مهمة ووقت المراجعة البشرية والصيانة. الوكيل الذي يخدم مسار عمل واحداً ضيقاً مشروع متواضع، أما الوكيل الذي يكتب في عدة أنظمة أعمال فهو قرار منصّة.
يشرح هذا الدليل العوامل التي تقف خلف كل رقم، ويقدّم نطاقات توضيحية مع افتراضاتها المعلنة، ويبيّن كيف تقيس تكلفة المهمة الواحدة قبل أن تلتزم. هذه النطاقات أدوات للتخطيط وليست عروض أسعار. طبيعة مسار العمل وبياناتك ومدى تقبّلك للأخطاء تؤثر فيها أكثر من أي قائمة أسعار لدى أي مزوّد.
لماذا يصعب تقدير تكلفة وكيل الذكاء الاصطناعي؟
الشات بوت يجيب مرة واحدة. أما الوكيل فيخطط، ويستدعي أداة، ويقرأ النتيجة، ثم يقرر هل يواصل أم يتوقف. عدد استدعاءات النموذج لكل مهمة ليس ثابتاً، بل يتغير بحسب المدخلات. تذكرتا دعم متشابهتان في الظاهر قد تنتج إحداهما تشغيلاً من ثلاث خطوات والأخرى تشغيلاً من اثنتي عشرة خطوة، فتكلّف معالجة الثانية أضعاف الأولى.
ويصعب تحديد تكلفة البناء لسبب مختلف. النموذج التجريبي هو الجزء الرخيص. يمكن تجميع نموذج أولي يستدعي نموذجاً لغوياً وواجهة برمجية واحدة خلال أيام. العمل المكلف يقع على الأطراف: أنظمة بلا بيئة اختبار، وسجلات تتعارض فيما بينها، وشاشات موافقة، وتحديد نطاق الصلاحيات، والتقييم، والمراقبة، ومسار الاستعادة عندما تنجح عملية كتابة جزئياً فقط. لا يظهر شيء من ذلك في العرض التجريبي، لكنه كله يحدد هل يمكن أن يبقى الوكيل قيد التشغيل.
أين تخطئ الفرق عادة؟
الخطأ الأكثر شيوعاً هو تسعير النموذج بدلاً من تسعير مسار العمل. الرموز (tokens) هي البند الأوضح في الفاتورة، لذلك تُبنى الميزانيات حولها. لكنها في كثير من مسارات العمل ليست البند الأكبر. فالوقت الذي يقضيه موظف في مراجعة المسودات، وساعات الهندسة المصروفة على عمليات التكامل، والصيانة الشهرية عند إيقاف إصدار نموذج ما، كلها عادة أهم.
أخطاء متكررة أخرى:
- اعتبار النموذج الأولي معظم عمل البناء، ثم اكتشاف أن عمل الإنتاج هو الحصة الأكبر.
- إغفال وقت المراجعة، مع أن كل خطوة موافقة تحوّل مخرجات النموذج إلى دقائق عمل بشري مدفوعة.
- نسيان الصيانة. النماذج تُوقف، وواجهات المزوّدين تغيّر إصداراتها، وكل تعديل على التعليمات يحتاج إلى اختبار انحدار.
- التشغيل بلا سقف. الوكيل الذي لا يملك حداً للخطوات أو ميزانية لكل تشغيل قد يدور في حلقة حول أداة فاشلة ويستمر في الإنفاق حتى يلاحظ أحدهم.
- مقارنة العروض على أساس السعر اليومي فقط، بينما الفرق الحقيقي هو هل يشمل العرض التقييم والمراقبة والتسليم.
طريقة عملية لتقدير تكلفة البناء
قدّر تكلفة البناء انطلاقاً من مسار العمل نفسه. اكتب الأنظمة التي يقرأ منها الوكيل، والأنظمة التي يكتب فيها، والقرارات التي يتخذها، وأسوأ خطأ واقعي قد يرتكبه. هذه القائمة، لا اختيار النموذج، هي ما يستطيع المطوّر تسعيره.
محركات تكلفة البناء
- الأنظمة المعنية: كل تكامل يحتاج إلى مصادقة ومعالجة للأخطاء واختبارات. النظام الذي لا يملك واجهة برمجية أو بيئة تجريبية يضيف عملاً أو يفرض خطوة بشرية صريحة.
- القراءة مقابل الكتابة: جعل مساعد للقراءة فقط آمناً أرخص بكثير من وكيل يغيّر السجلات أو يرسل الرسائل أو يحرّك الأموال.
- تجربة الموافقة: يحتاج المراجِع إلى رؤية التغيير المقترح والدليل الذي يستند إليه، وإلى طريقة للتعديل قبل الموافقة.
- تجهيز البيانات: الاسترجاع من مستندات غير منظمة ينتج إجابات خاطئة بثقة عالية. وغالباً ما يلزم تنظيف الجزء من البيانات الذي يعتمد عليه مسار العمل.
- مجموعة التقييم: حالات تاريخية حقيقية بنتائج صحيحة معروفة، إضافة إلى مدخلات عدائية، حتى تُقاس الجودة قبل الإطلاق وبعد كل تغيير.
- المراقبة والحدود: سجلات لكل تشغيل، وتتبّع للتكلفة، وتنبيهات، وسقوف.
- نموذج التنفيذ: الوكيل القصير الذي يعمل بطلب واستجابة يمكن أن يعمل داخل طلب ويب، أما التشغيلات الطويلة فتحتاج إلى طابور وعامل تنفيذ ونقاط حفظ.
نطاقات توضيحية لتكلفة البناء
تفترض النطاقات التالية فريقاً صغيراً من ذوي الخبرة، وأنظمة قائمة بواجهات برمجية قابلة للاستخدام، وبيئة إنتاج واحدة، وعميلاً قادراً على تقديم أمثلة تاريخية حقيقية للتقييم. وهي لا تشمل تراخيص البرمجيات، ولا تنظيف البيانات الواسع خارج الجزء الخاص بمسار العمل، ولا أعمال الامتثال التي تتطلب مراجعة قانونية. إنها مراتب تقريبية لنقاش الميزانية، وليست أسعاراً.
- مساعد للقراءة فقط على مستنداتك أو على نظام واحد، مع استشهاد بالمصادر ومجموعة تقييم: من نحو 8,000 إلى 25,000 دولار.
- وكيل لمسار عمل واحد يجهّز مسودات إجراءات في نظام واحد، مع خطوة موافقة وسجل تدقيق ومراقبة: من نحو 20,000 إلى 60,000 دولار.
- وكيل متعدد الأنظمة مع عدة تكاملات كتابة، وتنفيذ متين، وصلاحيات لكل أداة، وطبقة أدوات مشتركة: غالباً من 60,000 إلى 150,000 دولار أو أكثر، ويُسلَّم عادة على مراحل.
للتوضيح فقط، يعادل نطاق 20,000 إلى 60,000 دولار تقريباً 73,000 إلى 220,000 درهم إماراتي أو 75,000 إلى 225,000 ريال سعودي بأسعار الصرف المرتبطة بالدولار. هذه تحويلات تقريبية لتسهيل القراءة، وليست عرض سعر.
العرض بسعر ثابت يحتاج إلى مسار عمل محدد النطاق، وبيانات نموذجية، وتعريف مكتوب للنتيجة الصحيحة. من دون ذلك، أي رقم هو تخمين يرتدي ثوب السعر.
كيف تقدّر تكلفة التشغيل لكل مهمة؟
أسهل طريقة للتفكير في تكلفة التشغيل هي حسابها لكل مهمة ثم ضربها في حجم العمل. استخدم نموذجاً بسيطاً: تكلفة المهمة تساوي تكلفة النموذج، مضافاً إليها رسوم الأدوات والواجهات البرمجية، والبنية التحتية، ووقت المراجعة البشرية، وحصة من الصيانة الشهرية.
إليك مثالاً محسوباً بأسعار افتراضية؛ راجع قائمة الأسعار الحالية لدى مزوّدك قبل استخدام أرقام حقيقية. لنفترض أن النموذج يكلّف دولاراً واحداً لكل مليون رمز مدخل وخمسة دولارات لكل مليون رمز مخرج. تُجري المهمة النموذجية ثمانية استدعاءات للنموذج، يرسل كل منها نحو 6,000 رمز مدخل ويستقبل نحو 500 رمز مخرج. هذا يعني 48,000 رمز مدخل، أي نحو 0.048 دولار، و4,000 رمز مخرج، أي 0.02 دولار، فيصبح المجموع نحو 0.07 دولار للمهمة. وعند 20,000 مهمة شهرياً، يبلغ إنفاق النموذج نحو 1,360 دولاراً.
أضف الآن المراجعة. إذا قضى موظف دقيقتين في الموافقة على كل مسودة، فإن 20,000 مهمة تعني نحو 667 ساعة مراجعة شهرياً. في هذا المثال يكون وقت المراجِع بنداً أكبر بكثير من الرموز. ولهذا فإن تصميم الموافقات، الذي نتناوله في وكلاء الذكاء الاصطناعي مع الإشراف البشري، قرار تكلفة بقدر ما هو قرار أمان.
تكاليف الصيانة والتغيير
خصّص ميزانية للعمل المتكرر حتى عندما لا يكون هناك عطل. إصدارات النماذج تُوقف، والبدائل تتصرف بشكل مختلف. والأنظمة المتصلة تغيّر واجهاتها البرمجية. وتظهر حالات حدّية جديدة في الاستخدام الحقيقي فتتحول إلى حالات تقييم جديدة. وكل تعديل على التعليمات أو النموذج يحتاج إلى اختبار انحدار قبل الإصدار. تغطي الفرق ذلك عادة باتفاقية دعم شهرية أو بحصة محددة من وقت مهندس داخلي.
اعتبارات تنفيذية تغيّر الفاتورة
عدة اختيارات هندسية تؤثر مباشرة في تكلفة التشغيل:
- حدود الخطوات: ضع سقفاً لعدد خطوات التفكير في كل تشغيل حتى يتوقف الوكيل المرتبك بدلاً من الدوران في حلقة.
- ميزانية لكل تشغيل: أوقف المهمة أو صعّدها عندما يتجاوز استهلاك الرموز لها حداً معيناً.
- تشذيب المخرجات: اقتطع نتائج الأدوات الكبيرة أو لخّصها قبل أن تعود إلى سياق النموذج.
- توجيه النماذج: استخدم نموذجاً أصغر لخطوات التصنيف والاستخراج، واحتفظ بالنموذج الأكبر للتخطيط أو الصياغة.
- إعادة محاولة محدودة: أعد المحاولة فقط عند الأخطاء التي يمكن أن تنجح بإعادة المحاولة، مع تأخير متزايد. كل إعادة محاولة استدعاء مدفوع آخر.
- تسجيل الاستخدام: سجّل استهلاك الرموز لكل خطوة حتى تأتي تكلفة المهمة من البيانات لا من التقديرات.
- التخزين المؤقت: أعد استخدام السياق المسترجع والتعليمات الثابتة للنظام حيث يدعم المزوّد ذلك.
الموازنات والمفاضلات
النموذج الأرخص قد يرفع التكلفة الإجمالية إذا احتاج إلى خطوات أكثر أو إعادة محاولات أكثر أو تصحيح بشري أكثر. قِس المهمة كاملة، لا سعر الرمز الواحد.
خطوات الموافقة تكلّف وقت المراجِع، لكنها تخفض التكلفة المتوقعة لأي حادثة. أبقِها حيث يكون الخطأ مكلفاً، وأزلها حيث تُثبت الأدلة أن الوكيل موثوق.
بناء التنفيذ المتين وسجل استدعاءات الأدوات والتقييم منذ البداية يرفع تكلفة البناء الأولية. لكن إضافتها بعد دخول الوكيل مرحلة الإنتاج تكلّف عادة أكثر، لأن الاختصارات التي أخذها النموذج الأولي تكون قد انتشرت في الكود. والنهج المرحلي الموصوف في ترحيل الأنظمة القائمة إلى الوكلاء يبقي المرحلة الأولى صغيرة مع الحفاظ على هذه البنية.
دروس من أعمال ImadDhin
الملاحظات التالية مستمدة من كود مساحة عمل Agent في هذه البوابة. إنها ملاحظات تنفيذية على مستوى الكود، وليست نتائج عملاء ولا أرقام تكلفة إنتاج.
- التعرّض للتكلفة قرار منتج. المحادثة المجانية محدودة لكل زائر على الخادم، وأدوات البحث التي تستدعي واجهة خارجية مدفوعة تعيد استجابة تطلب الدفع ما لم يكن الزائر مشتركاً في الباقة المميزة. القدرات المكلفة تُقيَّد قبل استدعائها، لا بعد وصول الفاتورة.
- العدّادات تحتاج إلى الاتساق المناسب. قوة حد الاستخدام من قوة طريقة تحديث عدّاده. العدّاد الذي يقرأ ثم يكتب يسمح للطلبات المتزامنة بتجاوز الحد، وهي ملاحظة شائعة عند مراجعة المنتجات المبنية بالذكاء الاصطناعي. قد يكون ذلك مقبولاً لحصة مجانية صغيرة، أما أي شيء مرتبط بالفوترة أو الأرصدة فيجب أن يستخدم زيادة ذرّية أو معاملة.
- التشغيلات محدودة في أكثر من موضع. بيئة تشغيل مسار العمل تحصر التشغيل في عدد ثابت من خطوات المخطط، وترفض نقاط الحفظ المخزنة التي تتجاوز حجماً معيناً، وتقتطع مخرجات الأدوات قبل إعادتها إلى النموذج. كل حد يوقف نوعاً مختلفاً من الانفلات.
- الاستخدام يُسجَّل لكل خطوة. كل خطوة تفكير تكتب بيانات استخدام النموذج في سجل أحداث التشغيل، ما يجعل تكلفة المهمة شيئاً يمكن حسابه من السجلات.
- إعادة المحاولة إنفاق. غلاف أدوات البحث يجري ثلاث محاولات كحد أقصى، ويحترم ترويسة إعادة المحاولة التي يرسلها المزوّد عند تجاوز حد الطلبات، ويتراجع تدريجياً عند انتهاء المهلة وأخطاء الخادم، ولا يعيد المحاولة أبداً عند أخطاء الطلب غير الصالح أو المصادقة.
أخطاء شائعة يجب اختبارها
قبل الإطلاق، اختبر سلوك التكلفة بالعناية نفسها التي تختبر بها الإجابات:
- أرسل مدخلاً طويلاً بشكل غير معتاد أو عدائياً، وتأكد أن استهلاك الرموز لكل تشغيل يبقى تحت السقف.
- اجعل أداة تفشل مراراً، وتأكد أن الوكيل يتوقف أو يصعّد بدلاً من الدوران في حلقة.
- أرسل طلبات متزامنة نحو أي حد استخدام، وتأكد أنه يصمد حيث يجب أن يصمد.
- حاكِ انقطاع المزوّد، وتحقق من تكلفة المسار البديل وسلوكه.
- ألغِ تشغيلاً في منتصفه، وتأكد أن الإنفاق يتوقف.
- تأكد أنك تستطيع إصدار تقرير بتكلفة المهمة لكل مسار عمل، لا مجرد إجمالي الفاتورة الشهرية.
متى يكون الحل الأبسط أفضل؟
إذا كانت المهمة تتبع الخطوات نفسها دائماً، فإن مسار عمل محدداً مسبقاً مع استدعاء واحد للنموذج للتصنيف أو الصياغة أرخص في البناء، وأرخص في التشغيل، وأسهل في الاختبار من الوكيل. وإذا كان حجم العمل منخفضاً، فقد يكون موظف يملك قالباً جيداً هو الخيار الأرخص على الإطلاق.
يستحق الوكيل تكلفته عندما تتنوع المدخلات إلى درجة تفرض تحديد المسار حالة بحالة، وعندما يكون الحجم كبيراً بما يكفي لاسترداد تكلفة البناء. وإذا لم تكن متأكداً في أي جانب من هذا الخط يقع مسار عملك، فإن فحص الجاهزية للذكاء الاصطناعي طريقة منخفضة التكلفة لمعرفة ذلك قبل الالتزام بالبناء.
احصل على نموذج تكلفة لمسار عملك
يبدأ التقدير المفيد من مسار العمل والأنظمة التي يلمسها وأسوأ خطأ واقعي، ثم يفصل تكلفة البناء عن تكلفة المهمة الواحدة. إذا أردت بناء هذا النموذج حول عمليتك الفعلية، فاطّلع على تطوير وكلاء الذكاء الاصطناعي أو أحضر مسار العمل وأحجامه الحالية إلى مكالمة مدتها 30 دقيقة.
الأسئلة الشائعة
ما أكبر عامل في تكلفة وكيل الذكاء الاصطناعي؟
في البناء، هو عدد الأنظمة التي يكتب فيها الوكيل ومدى الأمان المطلوب في تنفيذ هذه الكتابات. وفي التشغيل، غالباً ما يفوق وقت المراجعة البشرية والصيانة تكلفة رموز النموذج، خاصة عندما يحتاج كل إجراء إلى موافقة.
هل يمكنني الحصول على سعر ثابت لوكيل ذكاء اصطناعي؟
نعم، بعد تحديد نطاق مسار العمل وتوفر بيانات نموذجية وكتابة تعريف للنتيجة الصحيحة. قبل ذلك، إما أن يحمل السعر الثابت هامش احتياط كبيراً، أو أن يستبعد التقييم والمراقبة والتسليم.
كيف أقدّر تكاليف التشغيل الشهرية؟
قدّر تكلفة المهمة الواحدة: عدد استدعاءات النموذج مضروباً في الرموز لكل استدعاء بأسعار مزوّدك، مضافاً إليه رسوم الأدوات والبنية التحتية ودقائق المراجعة وحصة من الصيانة. اضرب الناتج في الحجم الشهري المتوقع، ثم تحقق منه مقابل الاستخدام المسجل خلال فترة تشغيل تجريبي موازٍ.
هل يخفض النموذج الأرخص التكلفة دائماً؟
لا. النموذج الأرخص الذي يحتاج إلى خطوات أو إعادة محاولات أو تصحيحات بشرية أكثر قد يكلّف أكثر لكل مهمة مكتملة. قارن النماذج على المهمة كاملة باستخدام مجموعة التقييم الخاصة بك.
ما الضوابط التي تجعل إنفاق الوكيل قابلاً للتوقع؟
حدود للخطوات في كل تشغيل، وميزانية رموز لكل مهمة، واقتطاع مخرجات الأدوات، وإعادة محاولة محدودة للأخطاء القابلة لذلك فقط، وتسجيل الاستخدام لكل خطوة، وتنبيهات عندما تنحرف تكلفة المهمة.
ابنِ نموذج تكلفة حول مسار عملك الحقيقي
أحضر مسار عمل واحداً وحجمه الحالي، واخرج بأهم محركات تكلفة البناء والتشغيل.
احجز مكالمة مدتها 30 دقيقةمشاريع محددة النطاق تشمل التقييم والموافقات وسجلات التدقيق وسقوف التكلفة.
تعرّف على تطوير وكلاء الذكاء الاصطناعيتحقق هل يحتاج مسار العمل إلى وكيل أم إلى أتمتة أبسط.
ابدأ فحص الجاهزية للذكاء الاصطناعيمقالات ذات صلة
كيف تختار شركة تطوير وكلاء الذكاء الاصطناعي: قائمة تحقق للمشتري
قيّم أي شركة تطوير وكلاء الذكاء الاصطناعي بطريقة تحديدها للأدوات والصلاحيات، واختبارها للسلوك، وتعاملها مع الأعطال، وإبقائها القرار بيد البشر، ونقلها الملكية إليك، لا ببراعة العرض التوضيحي.
Human-in-the-loop AI agents: approval steps that don't kill the return on investment
Approval steps protect trust in an agent, but applied to everything they erase the time it was meant to save. Here is how to gate only the actions that need a person, and how to design the approval itself.
AI agent evaluation before production: a practical evaluation harness
An agent that looked good in five demo conversations can still fail on the sixth real one. A small, repeatable evaluation harness turns quality from an impression into a report you can rerun on every change.
Fixed price vs time and materials for AI projects
AI projects mix known engineering with open questions about model behavior. Price each part by how much of it is actually known, instead of forcing one contract model onto the whole project.