خدمة
خدمات دمج الذكاء الاصطناعي
يُوظَّف حيث يزيل عملاً، لا حيث يبدو جميلاً في العرض.
لفرق تريد الذكاء الاصطناعي داخل الأنظمة التي تشغّلها بالفعل، لمهام محددة: قراءة المستندات، وتصنيف ما يرد، والإجابة عن أسئلة على بياناتها الخاصة، وصياغة ما يعتمده شخص بعد ذلك. مبني مع تقييم وضبط للتكلفة، لأن ميزة لا يستطيع أحد قياسها ميزة لا يستطيع أحد الوثوق بها.
القرار
متى يكون هذا هو القرار الصحيح.
معظم ميزات الذكاء الاصطناعي تفشل بالطريقتين نفسيهما. تُضاف حيث تكون ظاهرة لا حيث توفّر الوقت، وتُطلَق دون أي وسيلة لمعرفة ما إذا كان مخرجها صحيحاً. وملخِّص يخطئ مرة من كل عشرين أسوأ من غياب الملخّص أصلاً، لأن الحالة العشرين هي التي تصل إلى العميل.
الإخفاق الثاني هو اكتشاف التكلفة وزمن الاستجابة في بيئة الإنتاج. فموجّه يبدو جيداً في الاختبار يصبح باهظاً عند عشرة آلاف طلب يومياً، وميزة تستغرق تسع ثوانٍ لن تُستخدم مهما كانت جيدة. وكلاهما قيد تصميمي، وكلاهما رخيص المعالجة مبكراً وعسير التدارك لاحقاً.
نبدأ من المهمة لا من التقنية: ما الذي يُنجَز يدوياً، وكم مرة، وكم يكلف حين يكون خاطئاً. ثم نبني مجموعة تقييم قبل الميزة، حتى يصبح لسؤال ما إذا كانت تعمل إجابة. وكثيراً ما يتبيّن أن الجواب الصحيح لا يحتاج نموذجاً أصلاً، ونقول ذلك.
ما الذي تحصل عليه
ما الذي يشمله العمل.
استخراج البيانات من المستندات
تُقرأ الفواتير وأوامر الشراء وكشوف الحساب والنماذج إلى حقول منظمة، مع إظهار درجة الثقة حتى تذهب الحالات منخفضة الثقة إلى شخص بدل أن تمر بصمت.
التصنيف والتوجيه
تُوجَّه الاستفسارات والتذاكر والمستندات الواردة إلى الطابور الصحيح، مع قواعد قابلة للمراجعة لا غامضة.
بحث داخل بياناتك أنت
بحث عبر مستنداتك وسجلاتك يذكر مصادره، حتى يمكن التحقق من الإجابة بدل تصديقها.
صياغة تمر ببوابة بشرية
تُجهَّز الردود والملخصات والأوصاف كي يعتمدها شخص. البوابة قرار تصميمي لا إخلاء مسؤولية.
تقييم قبل الإطلاق
مجموعة موسومة ونسبة نجاح مقيسة، حتى يصبح تغيير الموجّه أو النموذج مقارنةً لا تخميناً.
ضبط التكلفة وزمن الاستجابة
تخزين مؤقت وتوجيه النماذج حسب الصعوبة وتنبيهات للميزانية، لأن التسعير بالطلب يتحول إلى فاتورة شهرية لم يحسبها أحد.
التقنيات
بماذا نبنيه.
تُختار لكل مشروع. لا شيء هنا يُفرَض افتراضياً، والفريق الذي سيصونها يزن بقدر المشكلة نفسها.
النماذج
Claude أو GPT أو نموذج مفتوح الأوزان، يُختار لكل مهمة بناءً على جودة وتكلفة مقيستين لا على العلامة التجارية.
الاسترجاع
PostgreSQL مع pgvector حيث يكفي ذلك، ومخزن متجهات مخصص حيث يبرر الحجم ذلك.
التنسيق
الأفضلية لشيفرة بسيطة يمكن قراءتها. ولا تُستخدم أطر الوكلاء الثقيلة إلا حين تبرر كلفة تصحيحها.
التقييم
مجموعات اختبار مرقّمة الإصدار تُشغَّل داخل خط الإنتاج، حتى يُلتقط أي تراجع في التكامل المستمر لا عند عميل.
الخصوصية
أين تقيم البيانات ومدة الاحتفاظ بها وما يُحجب منها، تُحسم قبل أول طلب، بما في ذلك ما إذا كان يُسمح لطلب بمغادرة بنيتك التحتية أصلاً.
مقارنة
ذكاء اصطناعي مُضاف من الخارج مقابل ذكاء اصطناعي يستحق مكانه.
معظم ميزات الذكاء الاصطناعي تفشل بالطريقتين نفسيهما: تُضاف حيث تكون ظاهرة لا حيث توفّر الوقت، وتُطلَق دون أي وسيلة لمعرفة ما إذا كان مخرجها صحيحاً.
| الجانب | إضافة ذكاء اصطناعي سطحية | كيف نبنيه |
|---|---|---|
| إلى أين يتجه | حيث يبدو جميلاً في العرض — صندوق محادثة على لوحة المعلومات | حيث يقع العمل اليدوي فعلاً، وهو عادةً غير لافت |
| معرفة أنه يعمل فعلاً | جرّبه أحدهم بضع مرات وبدا جيداً | مجموعة موسومة من حالاتك الحقيقية، مع نسبة نجاح مقيسة قبل الإطلاق |
| عندما لا يكون متأكداً | يجيب على أي حال، وبالثقة نفسها التي يجيب بها حين يكون مصيباً | ما دون الحد الذي تحدده يذهب إلى شخص، والحد أنت من يضعه |
| التكلفة | تُكتشف مع فاتورة الشهر الأول | يُقدَّر أثناء الاستكشاف، مع تخزين مؤقت وتوجيه للنماذج وتنبيه للميزانية |
| زمن الاستجابة | تُكتشف في بيئة الإنتاج، وبعدها يتوقف استخدام الميزة بهدوء | قيد تصميمي مرتبط برقم، لأن ميزة تستغرق تسع ثوانٍ لن تُستخدم |
| تغيير الموجّه أو النموذج | تغيير لا يستطيع أحد تقييمه، فلا يجرؤ أحد على إجرائه | مقارنة مقيسة على مجموعة الاختبار نفسها، تُشغَّل في التكامل المستمر |
كيف يسير الأمر
من أول حديث حتى الإطلاق.
إرشادي لعمل بهذا الشكل. التجربة الأولية ليست اختيارية — ولا يُنقل شيء قبل أن يقول مستخدموه إنه يصمد.
- أسبوع واحد
حدّد أين يقع العمل
ما الذي يُنجَز يدوياً، وكم مرة، وكم يكلف حين يكون خاطئاً. أحياناً يكون الجواب قاعدة أو نموذجاً أفضل، ونقول ذلك.
- أسبوع واحد
ابنِ مجموعة التقييم
حالات حقيقية موسومة، قبل وجود الميزة. وبدونها لا سبيل للتمييز بين تحسّن وتراجع.
- 3-5 أسابيع
ابنِ وقِس
الدمج والبوابة البشرية والتخزين المؤقت وضوابط التكلفة، مقيسة على المجموعة نفسها عند كل تغيير.
- 2-3 أسابيع
تجربة وضبط
تشغيل مباشر على شريحة من الحجم الحقيقي مع ضبط متحفّظ للبوابة، ولا تُخفَّف إلا بقدر ما تبرره الأرقام المقيسة.
بعد الإطلاق
ما الذي يتغير.
- الخطوة اليدوية التي بُنيت الميزة لإزالتها تُزال فعلاً، لا تُدعَم فحسب.
- الحالات منخفضة الثقة تصل إلى شخص بدل أن تمر بصمت، وهذا ما يجعل تشغيل الميزة دون إشراف آمناً.
- يصبح تغيير الموجّه أو النموذج مقارنةً لا مقامرة.
- فاتورة الشهر رقم توقّعه أحدهم مسبقاً، لا مفاجأة.
وُصفت نوعياً عن قصد. نحن لا ننشر نسب تحسّن لا نستطيع نسبتها إلى عميل بعينه وبموافقته.
أسئلة
أسئلة شائعة.
هل ستُستخدم بياناتنا لتدريب نموذج يخص جهة أخرى؟
ليس في الإعدادات التي ننشر بها. شروط واجهات البرمجة للمؤسسات تستثني التدريب على البيانات المرسلة، وحيث لا يكون ذلك مقبولاً نشغّل نموذجاً مفتوح الأوزان على بنيتك التحتية. ويُحسم هذا قبل بناء أي تكامل.
كيف تعرفون أن الذكاء الاصطناعي على صواب؟
نبني مجموعة تقييم موسومة من حالاتك الحقيقية قبل إطلاق الميزة، ونقيس عليها. وكل ما هو دون الحد المتفق عليه يذهب إلى شخص بدل أن يمضي، والحد أنت من يضعه.
كم تبلغ تكلفة تشغيله؟
يعتمد على الحجم وعلى النموذج المختار، ونقدّره أثناء الاستكشاف لا بعد الإطلاق. والتخزين المؤقت وتوجيه الحالات البسيطة إلى نماذج أرخص وتنبيه شهري للميزانية كلها جزء من البناء.
هل نحتاج إلى الذكاء الاصطناعي أصلاً؟
في الغالب لا. قاعدة موضوعة في مكانها الصحيح أو نموذج أفضل أو تقرير ثابت يحل نسبة مفاجئة مما يُصنَّف كمشكلة ذكاء اصطناعي، بجزء يسير من التكلفة ودون أي من عدم اليقين. وحين يكون الأمر كذلك، سنخبرك.
هل يمكنكم تشغيل نموذج على بنيتنا التحتية؟
نعم، بنموذج مفتوح الأوزان حيث تتطلب إقامة البيانات أو الشروط التعاقدية ذلك. والمقايضة بين الجودة وعبء التشغيل من جهة والتحكم من جهة أخرى، ويجدر حسمها بنتائج مقيسة على مهمتك الفعلية لا على مبدأ.
ماذا لو أخطأ الذكاء الاصطناعي أمام عميل؟
هذا ما توجد البوابة البشرية وحد الثقة لمنعه، وكلاهما قرار تصميمي يُتخذ قبل إطلاق الميزة لا إخلاء مسؤولية يُضاف بعدها. وحيث تكون كلفة الخطأ عالية، يكون الضبط الصحيح هو الصياغة للاعتماد وعدم التصرف دون إشراف أبداً.