مهندس ذكاء اصطناعي تطبيقي
أبني وأختبر طبقة المعرفة
التي يقوم عليها الذكاء الاصطناعي
سنوات من تصعيدات الدعم على المستوى الثالث علّمتني أفرّق بين الإجابة المقنعة والإجابة الصحيحة. أعمل على الشيء نفسه الآن مع أنظمة الذكاء الاصطناعي: ربط كل إجابة بمصدرها، وبناء اختبارات تقييم (evals)، وتنسيق المحتوى الذي يجيب منه المساعد.
الآن
ما أعمل عليه حاليًا
أعمل على مستشار ذكي مبني على Claude لأصحاب مواقع العضويات. مسؤوليتي هي جودة الإجابة من أولها لآخرها: المحتوى المنسّق الذي يستند إليه المستشار، والاسترجاع الذي يربطه ببيانات العميل الحقيقية، والإصلاحات التي أُطلقها حين تخرج إجابة واثقة وخاطئة. يمتد هذا من كتابة المحتوى ومراجعته إلى كود المنتج نفسه: كيف يُعرض المصدر، وما الذي يُسمح للمستشار بقوله حين تكون البيانات ناقصة.
وخارج العمل، أُشغّل إعدادي الخاص للذكاء الاصطناعي كنظام متكامل لا كنافذة محادثة: Claude و Cursor يوميًا، وطبقة ذاكرة قائمة على ملفات تصمد بين الجلسات، ووكلاء يعملون تلقائيًا وفق جدول ويحسّنون أنفسهم. أغلب ما أكتبه يخرج من أشياء تعطّلت داخل هذا الإعداد.
آخر تحديث: أغسطس 2026
كيف أعمل
أن يقول المساعد ما تدعمه البيانات فقط
سنوات من التصعيدات على المستوى الثالث درّبت حاسة واحدة: التفريق بين الإجابة المقنعة والإجابة الصحيحة. وبتطبيقها على منتج ذكاء اصطناعي تتحول إلى مهمتين.
كل إجابة مرتبطة ببيانات العميل
كل إجابة من المستشار لازم تستند إلى بيانات العميل نفسه وتذكر مصدرها. دوري أن يبقى مسار المصادر سليمًا، وأن أمنع النموذج من تأكيد أي شيء لا تدعمه البيانات.
نكتشف الخطأ قبل المستخدم
اختبارات تقييم (evals) تفشل إذا سمح تعديل في الـ prompt أو في الاسترجاع بمرور إجابة خاطئة، حتى لا يكسر إصلاح إجابة واحدة ستًّا غيرها بصمت.
ما أعمله
مجالات تركيزي
العمل يقع عند نقطة التقاء نظام الذكاء الاصطناعي بالمعرفة التي يعتمد عليها، وحيث يجب على أحدهم إثبات أن الإجابات صحيحة.
التقييم والاختبار
معرفة ما إذا كانت الإجابة صحيحة فعلًا
- تصميم اختبارات التقييم (evals) وتغطية تمنع رجوع الأخطاء في الـ prompts والاسترجاع
- القياس عبر تشغيلات متعددة حتى لا يُقرأ التباين بين تشغيلة وأخرى على أنه نتيجة حقيقية
- قراءة النتائج بصدق، بما فيها التي تقول إن التعديل لم ينجح
الاسترجاع وتنسيق المعرفة
تحديد ما يُسمح للمساعد بمعرفته
- تنسيق ومراجعة المحتوى الذي يجيب منه المساعد
- ربط كل إجابة بمصدر، باستشهادات تصمد عند المراجعة
- عمليات مراجعة تمنع دخول المحتوى الضعيف أو المتناقض
الوكلاء وهندسة السياق
ضبط الجلسات والذاكرة والأدوات
- تصميم السياق والذاكرة ليحتفظ الوكيل بحالته بين الجلسات
- أدوات MCP وسير عمل الوكلاء
- حدود صلاحيات تعمل كقيود فعلية لا كطلبات مهذبة
تعمل على شيء مشابه؟ راسلني .
الأدوات
ما أعمل به
أستخدم Claude و Cursor يوميًا، ومعهما وكلاء يعملون تلقائيًا وفق جدول بدل انتظار أمر مني.
الأعمال
ما بنيتُه
هذه الأعمال تعمل داخل منتج حي في مستودع خاص، فلا يوجد رابط لها؛ الشرح يوضّح ما كانت المشكلة وما الذي تغيّر. وكل ما تحتها منشور ومفتوح المصدر.
اكتشاف أن «مُستشهَد به» لم يكن يقيس الاستشهاد
المشكلة
كان المنتج يقيس أداء عناصر قاعدة المعرفة بعدّ مرات الاستشهاد بها. وأثناء تتبّع مسار الاسترجاع لبناء تحليلات الاستخدام، اكتشفت أن لا شيء يقرأ نص الإجابة أصلًا بحثًا عن علامات المصادر. فكانت كلمة «مُستشهَد به» تعني في الحقيقة «وصل إلى النموذج ضمن النتائج»، لا «استخدمه النموذج فعلًا». وكل قرار عن المحتوى الأفضل كان مبنيًا على هذا المقياس الخاطئ.
الحل
بنيت سجلًا يوثّق كل عنصر مرّ عليه الاسترجاع في كل إجابة، لا العناصر المُعادة فقط، ليظهر الفرق بين ما بحث عنه النظام وما أعاده وما استخدمه النموذج بالفعل. ثم بنيت فوقه تجميعًا ليليًا لكل عنصر: عدد مرات الاستشهاد، وآخر مرة استُخدم فيها، والاستشهادات التي جاء معها تقييم من المستخدم، ومعدل الإفادة على كامل المدة وعلى آخر ثلاثين يومًا.
النتيجة
مراجعة المحتوى صارت تعتمد على رقم يعني ما يقوله. ولولا ذلك لظل المقياس يعطينا صورة خاطئة عن المحتوى الذي يستحق البقاء.
سلامة الاستشهادات في إجابات المستشار
المشكلة
كان المستشار يكتب رموزًا بين أقواس داخل إجاباته، دائمًا بعد جملة تخص بيانات العميل الحية. تبدو كمصادر لكنها لا تشير إلى شيء، فتظهر كنص خام في الإجابات المبنية على بيانات حقيقية تحديدًا، وهي سبب وجود المنتج أصلًا.
الحل
الـ prompt كان يطلب من النموذج ذكر المصادر بين أقواس بما يطابق السياق المُعطى له. والطلب واسع أكثر من اللازم، فصار النموذج يخترع أقواسًا من عناوين أقسام السياق نفسها، بينما طبقة العرض لا تحذف إلا الأقواس المرقّمة. ضيّقت الـ prompt، واستبدلت طبقة العرض بطبقة تنقية مخصصة، وأضفت اختبار تقييم (eval) يفشل إذا وصل أي رمز من هذا النوع إلى الإجابة.
النتيجة
المصادر الحقيقية تظهر، والمخترعة لا تصل للمستخدم، واختبار التقييم يمنع رجوع المشكلة بصمت.
رفض تأكيد صفر غير حقيقي
المشكلة
بعض موصّلات الفوترة تُبلّغ عن الأعضاء دون المعاملات، لأن الإضافة المصدر لا تحتفظ بسجل مالي أصلًا. و«لا توجد بيانات إيراد» و«الإيراد صفر» كانتا تظهران معًا كـ $0.00، فيؤكد المستشار صفرًا لا سند له. وهذا أخطر أنواع أخطاء الذكاء الاصطناعي: واثق ومحدد وخاطئ في الاتجاه الذي سيتصرف المشغّل بناءً عليه.
الحل
حدّدت أي المنصات عندها سجل مالي فعلي، وأضفت طبقة تعرف ما إذا كانت بيانات الإيراد متوفرة أصلًا، وجعلت طبقة الرد تصرّح بأن البيانات غير متاحة، مع تعليمات واضحة للنموذج بعدم عرض أو استنتاج أو تقدير الإيراد لهذه المواقع. الحل يغطي كل المنصات من هذا النوع، لا منصة واحدة.
النتيجة
المستشار يذكر أن البيانات غير متاحة بدل طباعة رقم يبدو كإجابة.
ذاكرة ملفّات للوكلاء
المشكلة
جلسات النماذج اللغوية تبدأ من الصفر كل مرة، فأقضي أول كل صباح في إعادة شرح السياق نفسه قبل أي عمل.
الحل
طبقة ذاكرة قائمة على الملفات ببنية محددة للحقائق والمشاريع والتفضيلات، مع قواعد لما يُكتب وما يُستبعد.
النتيجة
الوكيل يكمل من حيث انتهت الجلسة السابقة بدل إعادة الإحاطة. يُشغّل عملي اليومي منذ شهور، وهو الآن منشور كقالب مفتوح المصدر.
حدود الصلاحيات للوكلاء
المشكلة
قواعد الأمان المكتوبة داخل الـ prompt تبدو كقيود، لكنها تتصرف كاقتراحات. والفرق لا يظهر إلا في اللحظة التي يتجاهل فيها النموذج إحداها.
الحل
راجعت كل قاعدة أمان في إعدادي الخاص، وفصلت القواعد النصية عن المُنفَّذة فعليًا، ورسمت ما يلزم لتحويل الطلب إلى حد حقيقي.
النتيجة
تصور عملي لأين ينتهي مجرد التوجيه وأين يبدأ القيد الحقيقي، منشور مع سلّم الصلاحيات الناتج عنه.
Administrator Rescue Link — إضافة Members
المشكلة
إزالة صلاحية حرجة واحدة من دور المسؤول تُغلق عليك لوحة تحكم ووردبريس بالكامل، وكان الإنقاذ الوحيد عبر قاعدة البيانات مباشرة، وهو ما يصعب على أغلب أصحاب المواقع.
الحل
ساهمت بميزة Administrator Rescue Link في إضافة Members (أكثر من 300 ألف تثبيت نشط). ترسل رابطًا آمنًا صالحًا لوقت محدود إلى بريد المسؤول المسجّل، والضغط عليه يعيد صلاحيات الدور عبر رابط مخصص في الواجهة الأمامية. تتضمن تحققًا بالرمز، وحدًا لعدد المحاولات، ودعمًا لشبكات المواقع المتعددة، وإعادة هيكلة لمسار الاستعادة.
النتيجة
متاحة في الإصدار الحالي من Members. المسؤول المحبوس خارج موقعه يستعيد صلاحياته في أقل من دقيقتين، دون قاعدة بيانات ودون فتح تذكرة دعم.
مزيد من أعمال ووردبريس — فواتير PDF المجمعة، وحماية بريد بيئة الاختبار، وقواعد المحتوى لكل عضو، والوصول الأمامي فقط — متاحة في مستودعات عامة على GitHub.
تصفح المستودعات على GitHubالإثبات
موثّق لا مُدّعى
تقييم 5 نجوم على Trustpilot
تقييمات عامة تذكرني بالاسم بين MemberPress و Leap13، وكلها قابلة للبحث على Trustpilot.
عرض الملف الشخصيإضافتان على WordPress.org
منشورتان على حسابي الخاص، إلى جانب مساهمات برمجية في إضافة Members.
عرض الملف الشخصيعن بُعد عبر أربع مناطق
عمل عبر المناطق الزمنية مع فرق في أمريكا والإمارات ومصر وأوروبا.
التقييمات
ماذا كتب العملاء
تقييمات عامة على Trustpilot تذكرني بالاسم، منقولة حرفيًا كما نُشرت بالإنجليزية. ابحث عن “Omar” في صفحة MemberPress لقراءتها كاملة.
“Working with customer support in MemberPress, and Omar in particular, has been shockingly great. No quick, confusing answers that leave you with more questions — long, detailed explanations that completely clarify the situation. And when I had an unusual situation, they developed a plug-in for me to cover it! Absolutely outstanding!”
“My latest experience when I needed guidance on how to do something I was quite willing to upgrade to Pro but Omar explained how to carry out what I needed to do without upgrading. Now that's unheard of as most companies would gladly just point you towards the upgrade option! 10 out of 10 Guys, keep up the great work.”
“The support replies quickly and gives specific, detailed and practical solutions. As a software developer I'm using different tools and having a good support is a key point for me to use a software long term over multiple years.”
“I've designed and managed several WordPress membership site projects with MemberPress and have always found their support to be top quality. With a recent issue I was facing, Omar went the extra mile to find a solution and resolve the problem.”
“I spoke with Omar who gave fast and correct support to solve my client's issue immediately. Really impressive. Thank you Omar!”
18 تقييمًا عامًا على Trustpilot تذكرني بالاسم بين MemberPress و Leap13.
المسيرة
أين عملت
هندسة دعم، ثم استشارات، والآن طبقة المعرفة في منتج ذكاء اصطناعي.
تحميل السيرة الذاتيةمهندس معرفة للذكاء الاصطناعي
Caseproof (MemberPress)
أتولّى جودة المعرفة في منتج مستشار ذكي: ما يُسمح للمساعد بمعرفته، وكيف يُكتب ويُراجع المحتوى المنسّق الذي يجيب منه، وكيف نتحقق من صحة إجاباته.
- • كتابة ومراجعة المحتوى المنسّق خلف المساعد
- • إدارة عملية المراجعة التي تمنع دخول المحتوى الضعيف
- • العمل مع فريق هندسة الذكاء الاصطناعي على ربط الإجابات بمصادرها وعلى جودتها
مهندس دعم — المستوى الثالث
Caseproof (MemberPress)
التعامل مع التصعيدات التي تجاوزت المستويين الأول والثاني: منطق الاشتراكات، وتكاملات بوابات الدفع، والأخطاء الحرجة في منتج SaaS عالمي.
- • تصعيدات المستوى الثالث في التذاكر التي عجز عنها الآخرون
- • تتبّع أعطال الاشتراكات و webhooks في Stripe و PayPal
- • 18 تقييم 5 نجوم عام على Trustpilot يذكرني بالاسم
مهندس دعم ووردبريس
Caseproof (MemberPress)
دعم تطبيقات SaaS القائمة على ووردبريس على نطاق واسع، والعمل المباشر مع العملاء على مشكلات العضويات والمدفوعات.
- • استكشاف الأعطال في تنصيبات ووردبريس و MemberPress الكبيرة
- • حل مشكلات العضويات والاشتراكات والمدفوعات المعقدة
- • هذا الدور هو ما تطوّر لاحقًا إلى المستوى الثالث
مستشار تقني ومطوّر رئيسي لووردبريس
SwiftX (عمل حر)
مستشار تقني ومطوّر رئيسي لمنصات وحلول العملاء القائمة على ووردبريس، بالتوازي مع العمل الأساسي.
- • تحويل متطلبات العمل إلى مواصفات تقنية
- • تصميم وتسليم منصات العملاء
- • قيادة التنفيذ عبر مشاريع العملاء
مطوّر ووردبريس
Leap13 / LeapWorx
دور هجين يجمع تطوير ووردبريس والدعم التقني والمحتوى التقني لمنصات تواجه العملاء، مع ثلاثة تقييمات 5 نجوم موثقة على Trustpilot.
- • تطوير إضافات وقوالب مخصصة بـ PHP و JavaScript
- • منصات عملاء بووردبريس و WooCommerce
- • من هنا بدأ جانب الدعم في مسيرتي
تواصل
منفتح على العمل في
الذكاء الاصطناعي التطبيقي
اختبارات التقييم (evals)، والاسترجاع، وأدوات الوكلاء، وأنظمة المعرفة. عن بُعد من القاهرة. ويسعدني النقاش في أي موضوع من المقالات.