نبني أنظمة ذكاء اصطناعي تقوم على بياناتك أنت وتؤدي مهمة محددة: الإجابة عن أسئلة من مكتبة سياسات، أو استخراج الحقول من الفواتير وإشعارات التسليم، أو صياغة رد أولي يعتمده إنسان بعد ذلك، أو توجيه حالة إلى المكتب الصحيح. تبدأ كل مشاركة باختيار عملية واحدة والاتفاق على قيمة الساعة الموفَّرة، لأن مشروع ذكاء اصطناعي بلا خط أساس لا يمكن إثبات نجاحه أبداً.
الاسترجاع قبل التوليد
النموذج الذي يجيب من ذاكرته سيختلق. أما النموذج الذي يجيب من مستنداتك ويستشهد بالفقرة التي استخدمها، فيمكن التحقق منه. نبني الاسترجاع أولاً — التقطيع والتضمينات وفهرساً هجيناً يجمع الكلمات المفتاحية والمتجهات، ومرشحات صلاحيات تُطبَّق وقت الاستعلام — بحيث تبقى كل إجابة قابلة للتتبع إلى مصدر يُسمح للقارئ برؤيته.
- الإجابات تستشهد بالمستند والقسم الذي جاءت منه
- الصلاحيات مفروضة عند الاسترجاع، فلا يرى أحد ملفاً ما كان ليفتحه بنفسه
- العربية والإنجليزية مفهرستان معاً، فالسؤال بإحداهما يجد الدليل في الأخرى
- رفض الإجابة حين لا يحتوي المصدر عليها، بدل تخمين واثق
التقييم هو المُخرَج
قبل إطلاق أي شيء نبني مجموعة اختبار من حالاتك الحقيقية — عادةً من ١٠٠ إلى ٣٠٠ سؤال بإجابات متوقعة يكتبها من يؤدي العمل اليوم. تصبح تلك المجموعة هي البوابة: كل تعديل على التعليمات وكل ترقية للنموذج وكل إعادة بناء للفهرس تُقيَّم مقابلها، فتكتشف أن تغييراً ما أساء إلى الجودة في مرحلة الدمج لا في شكوى عميل.
١٠٠–٣٠٠
حالة مُقيَّمة في مجموعة الاختبار قبل الإطلاق
يبقى الإنسان في الحلقة حيث يهم
الأتمتة تكسب الثقة على مراحل. نبدأ بالنظام يصوغ والإنسان يعتمد، ونقيس معدل التعديل، ولا نوسّع الاستقلالية إلا حيث يقول معدل التعديل إن ذلك آمن. أما الخطوات عالية الأثر — كل ما يمس المدفوعات أو العقود أو البيانات الشخصية — فتحتفظ بمعتمِد مُسمّى بشكل دائم.
حوكمة تصمد أمام التدقيق
تسجيل للتعليمات والردود بمدة احتفاظ تتحكم بها، وإخفاء للبيانات الشخصية قبل خروج أي شيء من نطاقك، وتوجيه للنماذج بحيث تعمل الأعباء الحساسة داخل المنطقة أو على خوادمك، وسجل مكتوب لما دُرِّب أو أُسنِد بأي بيانات. هذا ما سيطلبه قانون حماية البيانات الشخصية الإماراتي ومراجعتك الأمنية، وإضافته لاحقاً أغلى بكثير من بنائه من البداية.