هناك نمط فشل في أنظمة الاسترجاع المعزَّز لا يضعه أحد في العرض التوضيحي. تطرح سؤالًا، فيُضمِّن النظام السؤال، ويسحب أفضل عشرة مقاطع، ويحشرها في مُوجّه، ثم يكتب النموذج إجابة سلسة مبنية على أي عشرة مقاطع صادف أنها حصلت على أعلى درجة.
إن كانت الإجابة تحتاج إلى مقطع حادي عشر، فلن تعرف ذلك. ستحصل على الفقرة الواثقة نفسها في كلتا الحالتين.
الحل ليس مُضمِّنًا أفضل. الحل هو السماح لشيء ما بأن ينظر مجددًا — وهذا بالضبط ما يفعله الـ RLM.
مكوّنان، منفصلان بوضوح
السَيدكار وكيل أسطول. يعمل حيث توجد قدرة الحوسبة، ويبلّغ عمّا لديه، ويخدم طلبات الاستدلال. ويسجّل خادم Fantom MCP نفسه كأحد الأسياد الذين يبلّغهم السَيدكار.
الـ RLM نموذج لغوي للاسترجاع — نموذج مخصَّص ليست مهمته كتابة النثر بل الجمع. يستدعي أدوات البحث في الكود بشكل تكراري حتى يحصل على الكود الدقيق اللازم للإجابة، ثم يعيد الأدلة التي جمعها مع مسودة موجزة. وتتولى خطوة تركيب منفصلة تحويل ذلك إلى الإجابة النهائية الموثّقة بالمصادر.
الفصل مهم. نموذج الجمع مُحسَّن لاستخدام الأدوات ويمكن أن يكون صغيرًا وسريعًا. ونموذج التركيب مُحسَّن للكتابة. أما مطالبة نموذج واحد بالقيام بالأمرين فهي الطريق إلى إجابة إمّا رديئة البحث أو رديئة الصياغة.
كيف يبلّغ الأسطول
السَيدكار هو من يبدأ الاتصال، لا الخادم — وهذا هو الاتجاه الصحيح حين تكون قدرة الحوسبة موجودة على محطات عمل تظهر وتختفي.