اسأل وكيل الذكاء الاصطناعي في مؤسستك السؤال نفسه في يومين متتاليين، وسيجيبك في المرة الثانية من الصفر. لن يتذكر الحساب الذي أشرت إليه، ولا الاستثناء الذي وافقت عليه، ولا التفضيل الذي ذكرته أمس. تُصفَّر نافذة السياق، فيعود الوكيل غريباً عنك من جديد. هذا هو وضع الفشل الحقيقي خلف معظم شكاوى «وكيل الذكاء الاصطناعي لدينا بدا غبياً»، وهو مشكلة ذاكرة لا مشكلة نموذج.

نافذة السياق لم تكن الحل يوماً

عالجت عمليات النشر المبكرة للوكلاء المسألة بتوسيع نافذة السياق: احشُ فيها مزيداً من سجل المحادثة، وسيتذكر الوكيل. هذا لا يصمد في الإنتاج. نوافذ السياق الفعلية في 2026 تتراوح بين 128K و2M من الرموز (tokens)، ويعلن بعض المزوّدين عن 10M، لكن اتساع النافذة لا يحل مشكلة الاستدعاء. السجل غير ذي الصلة الذي يملأ النافذة يضر بزمن الاستجابة وجودة المخرجات معاً، ولا شيء داخل نافذة خام يبقى بعد انتهاء الجلسة التي أنشأته. النافذة مسودة مؤقتة، لا ذاكرة.

والبحث الذي يقوم عليه معيار LoCoMo، وهو المرجع القياسي لاختبار الاستدعاء عبر جلسات متعددة على 1,540 سؤالاً، يتعامل مع هذا بوصفه مشكلة معمارية محلولة لا سؤالاً مفتوحاً: الذاكرة يجب أن تعيش خارج النافذة، في مخزن يستعلم منه الوكيل عند الحاجة.

كيف تبدو منظومة ذاكرة تعمل فعلاً

النمط الذي استقر في 2026 يقسّم الذاكرة إلى طبقات بدل سلة واحدة:

  • الذاكرة داخل السياق: مخزن المحادثة الحي. فوري، لكنه يختفي بانتهاء الجلسة.
  • الذاكرة الدلالية: حقائق ومعارف محفوظة في مخزن متجهات، تُستدعى بالتشابه عند الحاجة بدل تفريغها كاملة. هذه هي الطبقة التي ينفّذ عليها RAG الوكيل.
  • الذاكرة العَرَضية: سجل دائم لما جرى في التفاعلات السابقة، محدد النطاق بمستخدم أو وكيل أو جلسة، حتى يستطيع الوكيل استرجاع «ما اتفقنا عليه يوم الثلاثاء».
  • الذاكرة الإجرائية: الكيفية لا المحتوى، أي مسارات العمل وعادات استخدام الأدوات وأعراف العمليات التي يُفترض أن يطبّقها الوكيل باتساق. هذه الطبقة ما زالت في بدايتها في معظم الأدوات.

وضع تقرير Mem0 المرجعي لعام 2026، المبني على ورقة ECAI 2025 المحكَّمة التي قارنت عشرة أساليب للذاكرة على LoCoMo، خوارزميةَ الاستدعاء الانتقائي عند 92.5 على LoCoMo و94.4 على LongMemEval، بمتوسط أقل من 7,000 رمز لكل استعلام. أما أساس 2025 القائم على حشو سجل المحادثة الكامل داخل السياق فكان يقترب من 26,000 رمز لكل استعلام لدقة مماثلة، أي نحو 3.7 أضعاف كلفة الرموز مع استدعاء أسوأ في الأسئلة الزمنية ومتعددة الخطوات. الاستدعاء الانتقائي ليس ميزة كمالية، بل هو الفارق بين وكيل يمكن تحمّل كلفة تشغيله على نطاق واسع وآخر لا يمكن.

رسم بياني شريطي يقارن متوسط الرموز لكل استعلام بين أساس الذاكرة بالسياق الكامل في 2025 والاستدعاء الانتقائي للذاكرة في 2026

الأسلوبمتوسط الرموز لكل استعلام
الأساس بالسياق الكامل (2025)~26,000
الاستدعاء الانتقائي (2026، LoCoMo)~6,956

المصدر: تقرير Mem0 المرجعي لعام 2026، استناداً إلى ورقة ECAI 2025 التي قارنت عشرة أساليب للذاكرة على معيار LoCoMo.

الاستدعاء هو الجزء الصعب، لا التخزين

تخزين الذكريات في قاعدة بيانات متجهات هو النصف السهل. أما تحديد ما يُستدعى لاستعلام بعينه ودمجه بشكل صحيح، فهناك ذهب معظم الجهد الهندسي في 2026. الأسلوب الحالي يشغّل ثلاث تمريرات تقييم بالتوازي، هي التشابه الدلالي ومطابقة الكلمات المفتاحية ومطابقة الكيانات، ثم يدمج النتائج، لأن أي إشارة منفردة غير موثوقة وحدها: البحث الدلالي الصرف يفوّت الأسماء والتواريخ الدقيقة، والبحث بالكلمات المفتاحية الصرف يفوّت الأسئلة المُعاد صياغتها.

عشرون خلفية لمخازن المتجهات مدمجة اليوم عبر أطر الذاكرة مفتوحة المصدر الكبرى، من Qdrant وWeaviate إلى خيارات مُدارة مثل Azure AI Search وAmazon S3 Vectors، وهذا يخبرك أن الأمر صار بنية تحتية أساسية لا نموذجاً بحثياً أولياً. ما لم يستقر بعد هو تتبّع المصدر: في الأنظمة متعددة الوكلاء، تبقى حقيقة مخزّنة مثل «العميل يحتاج استرداداً» ملتبسة ما لم تسجّل طبقة الذاكرة من قالها، أهو المستخدم أم وكيل مراقبة أم استنتاج من وكيل تخطيط. أخطئ هنا، ويبدأ الوكيل في الوثوق بتخميناته الخاصة بوصفها حقائق أكّدها المستخدم.

أين تشعر المؤسسات بهذا فعلاً

تظهر الكلفة التجارية لغياب الذاكرة في ثلاثة مواضع نراها متكررة في عمليات النشر لدى العملاء:

  1. إعادة شرح السياق في كل جلسة. وكلاء الدعم والعمليات الذين لا يستطيعون استرجاع سجل العميل يعيدون عبء الاستمرارية إلى الإنسان، وهذا يلغي الغرض من أتمتة التفاعل أصلاً.
  2. لا تخصيص على نطاق واسع. الوكيل الذي لا يحتفظ بتفضيل ذكره المستخدم، أو بأعراف كتابة الكود في فريق، أو باستثناءات حساب عميل، لا يمكنه أن يتحسّن مع الوقت، بل يبدأ من أساس عام في كل تشغيل.
  3. مخاطر الامتثال. الذاكرة التي تبقى إلى أجل غير مسمى دون تحديد نطاق أو مسار حذف تخلق التزاماً في الاحتفاظ بالبيانات. وتنطبق هنا الحوكمة نفسها التي نطبّقها على هندسة السياق: الذاكرة تحتاج مالكاً ونطاقاً ومساراً لحق النسيان، وإلا صارت أول ما تشير إليه المراجعة.

لا شيء من هذا غريب. إنه الانضباط نفسه الذي كان يحدد نجاح مشاريع تخطيط موارد المؤسسات أو فشلها قبل ظهور الوكلاء بزمن طويل: حدّد ما الذي يبقى من بيانات، ومن يملكه، وكيف يُستدعى، قبل أن توسّع النظام.

ما الذي تبنيه قبل توسيع أي وكيل

إذا تجاوزت مرحلة التجربة، فثلاثة أسئلة تحدد ما إذا كانت الذاكرة ستفيد أم تتحول إلى عبء:

  • ما الذي يستحق التذكّر فعلاً؟ ليست كل رسالة ذاكرة. الحقائق والقرارات المؤكدة تستحق، والحديث الجانبي لا. تعامل مع الكتابة في الذاكرة كعملية منتقاة، لا تلقائية.
  • ما هو النطاق؟ احسم منذ البداية ما إذا كانت الذاكرة تخص مستخدماً أو وكيلاً أو جلسة أو المؤسسة كلها. خلط النطاقات هو الطريق الذي يسرّب بيانات عميل إلى عميل آخر.
  • ما هو مسار الحذف؟ إذا كان مخزن الذاكرة عاجزاً عن تنفيذ طلب حذف بالطريقة نفسها التي تنفّذها بها أنظمتك الأخرى، فهو ثغرة حوكمة تنتظر من يكتشفها في مراجعة، لا ميزة.

نبني هذا داخل عمليات نشر الذكاء الاصطناعي الوكيل التي ننفذها للعملاء، فنربط الذاكرة الدائمة بالمنصات نفسها التي تدير البنية السحابية والبيانات، بدل تركيب مزوّد ذاكرة منفصل فوق منظومة وكلاء لم تُصمَّم لاستخدامه. إذا كانت وكلاؤك تعمل تقنياً لكنها تطلب من العملاء تكرار كلامهم، فتلك فجوة في معمارية الذاكرة لا قيد في النموذج، وتستحق مراجعة قبل إضافة مزيد من الأتمتة فوقها. نهجنا يبدأ من هنا. تواصل معنا لنناقش ما الذي يجب أن يتذكره وكلاؤك فعلاً.