الرؤى
التقييم والموثوقية

ما الذي يجب قياسه قبل نشر نظام ذكاء اصطناعي؟

إذا لم تُقَس العملية الحالية فلن تعرف هل حسّن AI النتيجة أم نقل التكلفة والخطأ إلى مكان آخر.

عبدالله ناصر2026-08-14٧ دقائق

يجب أن يبدأ القياس قبل النموذج. الخط الأساس يجعل قرار البناء قابلاً للدفاع عنه، ويمنع الفريق من الاحتفال بمؤشر تقني لا يغير العمل.

01

قس العملية كما هي اليوم

سجل حجم الحالات، زمن الإنجاز، وقت العمل اليدوي، نسبة الإعادة، ونقاط الانتظار. لا تحتاج نظام تحليلات مثالياً؛ تحتاج عينة صادقة تكشف أين تذهب التكلفة.

افصل المتوسط عن التوزيع. قد يبدو الزمن جيداً بينما تتعطل نسبة صغيرة من الحالات المهمة أياماً. هذه الحالات الطرفية غالباً ما تحدد قيمة النظام ومخاطره.

02

عرّف الجودة بلغة القرار

الدقة العامة لا تكفي. حدد أنواع الخطأ: معلومة خاطئة، مصدر غير مناسب، إجراء ناقص، أو تصعيد غير ضروري. ليست كل الأخطاء متساوية في أثرها.

ابنِ مجموعة تقييم من حالات حقيقية مع إجابة أو سلوك مقبول. إذا اختلف الخبراء على النتيجة، فهذه إشارة إلى أن تعريف العملية يحتاج وضوحاً قبل تقييم AI.

03

اجمع التكلفة والزمن والتدخل البشري

قِس تكلفة الاستدعاءات والبنية والمراجعة البشرية والتشغيل، لا سعر النموذج وحده. نظام أرخص في الاستدعاء قد يكون أغلى إذا زاد التصحيح اليدوي.

راقب زمن الاستجابة من منظور العملية. ثانية إضافية قد لا تهم في مسودة تقرير، لكنها قد تمنع استخدام قدرة داخل مكالمة مباشرة أو مسار خدمة سريع.

04

حوّل المؤشرات إلى قرار

حدد عتبة إطلاق وعتبة توقف وهدف توسع. مثال: لا ينفذ النظام تلقائياً حتى يحقق جودة محددة في فئة منخفضة المخاطر، وتبقى الفئات الحساسة تحت الموافقة.

المؤشر الذي لا يغير قراراً يتحول إلى ضوضاء. اربط كل مقياس بسؤال: هل نطلق؟ هل نزيد الصلاحية؟ هل نغير المصدر؟ هل نوقف حالة استخدام؟

THE DECISION

قس خط الأساس، جودة السلوك، اقتصاديات التشغيل، وحدود التدخل البشري؛ ثم حدد مسبقاً كيف ستغير النتائج قرار الإطلاق.

ناقش هذه المسألة في سياق مؤسستك.

ابدأ جلسة تشخيص