منهجية وصفية · الإصدار 3.7 (30 سبتمبر 2026، بعد إدخال موسوعات الدرر السنية ومعجم الجمهرة وكتاب «بيّنات» وإتاحة أبوابها في البحث والفلاتر؛ مسودة قيد المراجعة المستقلة) · إصدار البحث search-2026-09-30.1

منهجية مَرجِع لاسترجاع النصوص الشرعية الموثقة

تصف هذه الوثيقة النظام القائم، ومجموعة نصوصه، وخطوات الاسترجاع والتلخيص وحدوده. وهي أساس لإعداد دراسة وصفية لاحقة، وليست بذاتها دراسة تجريبية محكّمة أو تقويماً شرعياً لمخرجات النظام.

1. تصميم الدراسة وهدف النظام

يتبع التوثيق منهجاً وصفياً تحليلياً لنظام قائم، ويفرّق بين أربعة مستويات من الأدلة: (أ) حقائق التنفيذ المقروءة من الشفرة وقاعدة البيانات؛ (ب) اختبارات وظيفية آلية للسلوك البرمجي؛ (ج) فحوص آلية مساعدة لشكل الملخص وأمانته الظاهرة؛ (د) تقييم مستقل بأحكام مختصين — لم يُنجز. اختبارات الوحدة ليست قياساً لدقة شرعية ولا تحكيماً علمياً. يصف مصادر البيانات، ووحدة التحليل، والمعالجة، وآلية الاسترجاع، وطريقة العرض. يهدف النظام إلى تقليل الإجابات غير المسندة عبر استرجاع نصوص محفوظة وإظهار بيانات توثيقها. مَرجِع أداة بحث، لا جهة إفتاء ولا بديلاً عن سؤال أهل العلم في الوقائع الشخصية والنوازل.

2. مجتمع النصوص ونطاق التغطية

لقطة تاريخية: بلغ عدد السجلات 116,705 سجلاً قبل بدء إدخال الكتب الحديثية الجديدة (59,957 فتوى، و18,708 تفسيراً، و14,954 حديثاً، و13,305 مقالات، و6,236 آية، و3,545 شرح حديث). وفي 2026-09-28T16:01:05Z بلغ 117,145 سجلاً بعد إضافة 440 من «الجامع الصحيح»، وفي 2026-09-28T16:22Z قرأنا 120,625 سجلاً كلها بالحالة التقنية verified. هذه أعداد لقطات مؤرخة لا أعداد آنية؛ العدد الظاهر في أعلى الموقع عدّاد تشغيل حي يتغير مع الإدخال الجاري. وحدة العد «سجل» في قاعدة البيانات (حديث أو آية أو مقطع تفسير أو فتوى أو مقطع منها أو مادة)، ولم تُجر إزالة تكرار بين المصادر، فلا تعني الأعداد نصوصاً فريدة. لقطة الإعدادات الوصفية القابلة للتعيين محفوظة في docs/snapshots/.

لقطة الإغلاق: في 2026-09-28T17:58:02Z (20:58:02 بتوقيت الرياض)، ومن قراءة واحدة متسقة (معاملة REPEATABLE READ) أثناء إدخال جارٍ: 140,726 سجلاً (70,515 فتوى، 28,417 حديثاً، 18,708 تفسيراً، 13,305 مقالات، 6,236 آية، 3,545 شرح حديث)، كلها بالحالة التقنية verified؛ يدخل البحث منها 136,293 سجلاً، ويُستبعد 4,433 سجلاً من «بيان الإسلام» (توصيف كتب لا متونها)، ولا سجل بلا تمثيل دلالي. التمثيل اللفظي المطبّع موجود في 140,726 سجلاً (صفر فارغ). جدول الأعداد أدناه بحسب المصدر من اللقطة نفسها، والمعلَّم «جارٍ» يزداد بعدها. الاستعلام ونتيجته في docs/snapshots/counts-2026-09-28-closeout.sql و.json. هذه لقطة لا نسخة corpus قابلة لإعادة الإنتاج.

لقطة التسليم (بعد توقف السحب): في 2026-09-29T05:20Z (08:20 بتوقيت الرياض): 164,675 سجلاً (83,653 فتوى، 39,228 حديثاً، 18,708 تفسير، 13,305 مقالات، 6,236 آية، 3,545 شرح حديث)، كلها بحالة verified (أهلية استرجاع ونسبة إلى المصدر لا مراجعة بشرية)؛ القابل للاسترجاع 160,242، والمستبعد من البحث 4,433 (توصيف كتب «بيان الإسلام»)؛ التضمين الدلالي والتمثيل اللفظي المطبّع موجودان في 164,675/164,675 (صفر ناقص)؛ أدلة المراجعة البشرية 0. توقف السحب نهائياً بعد اكتمال «نور على الدرب» لابن باز و«إرواء الغليل» و«صحيح سنن أبي داود». هذه سجلات لا نصوص فريدة، واللقطات السابقة تبقى بتاريخها.

لقطة التسليم النهائية: في 2026-09-29 (قراءة مباشرة بعد حذف مقدمة «إرواء الغليل»): 164,644 سجلاً (83,653 فتوى، 39,197 حديثاً، 18,708 تفسير، 13,305 مقالات، 6,236 آية، 3,545 شرح حديث)، كلها بحالة verified؛ التضمين الدلالي والتمثيل اللفظي المطبّع موجودان في 164,644/164,644 (صفر ناقص)؛ أدلة المراجعة البشرية 0. المستبعد من البحث 7,050 سجلاً: 4,433 من «بيان الإسلام» (توصيف كتب لا متونها) و2,617 من «إرواء الغليل» (مخفي بقرار إداري، محفوظ وقابل للإرجاع)، فيكون القابل للاسترجاع 157,594 سجلاً.

لقطة التوسّع (30 سبتمبر 2026): بعد إدخال خمسة مصادر جديدة مكتملة وبدء سحب سادس بلغ العدد 235,490 سجلاً موزعة كالآتي: 83,653 فتوى، و39,197 حديثاً، و35,294 شرح حديث، و25,137 مصطلحاً، و18,708 تفسيراً، و13,305 مقالات، و6,236 آية، و6,222 موضعاً في السيرة والتاريخ، و5,411 مسألة فقهية، و1,491 مسألة عقدية، و836 مسألة في الشبهات والردود. التضمين الدلالي والتمثيل اللفظي المطبّع مكتملان في جميع الأنواع عدا شروح الموسوعة الحديثية التي ما زال سحبها وتضميناها جاريين (12,149 سجلاً بلا تمثيل دلالي وقت اللقطة، يدخل البحث اللفظي ولا يدخل الدلالي حتى يكتمل). المستبعد من البحث: 4,433 من «بيان الإسلام»، و2,617 من «إرواء الغليل» (مخفي بقرار إداري)، و31 سجلاً من «بيّنات» موسومة «للمراجعة». هذه سجلات لا نصوص فريدة، ولم تُجر إزالة تكرار بين المصادر الجديدة والقديمة (قد يتكرر الحديث بين كتب الحديث وشروح الموسوعة الحديثية).

المصدرالعددالنوعجهة الجلب
القرآن الكريم6,236آيةمنصة خدمة المحتوى الإسلامي
تفاسير السعدي وابن كثير والبغوي18,708تفسيرمشروع آيات — جامعة الملك سعود
صحيح البخاري7,580حديثمجموعة بيانات مفتوحة بترقيم فتح الباري
صحيح مسلم7,360حديثترقيم محمد فؤاد عبد الباقي
موسوعة الأحاديث النبوية3,545شرح حديثHadeethEnc
اللجنة الدائمة — المجموعتان12,907فتوىالمكتبة الشاملة
فتاوى ومقالات الشيخ ابن باز24,599فتوىالموقع الرسمي
فتاوى الشيخ ابن عثيمين13,460فتوىالموقع الرسمي
نور على الدرب — ابن عثيمين5,685 (مكتمل)فتوىالمكتبة الشاملة
نور على الدرب — ابن باز (بعناية الشويعر)18,011 (مكتمل)فتوىالمكتبة الشاملة
لقاء الباب المفتوح — ابن عثيمين6,192فتوىالمكتبة الشاملة
فتاوى الشيخ ابن جبرين1,668فتوىالمكتبة الشاملة
المنتقى من فتاوى الشيخ الفوزان539فتوىالمكتبة الشاملة
نور على الدرب — ابن باز (العقيدة)431فتوىالمكتبة الشاملة
فتاوى الشيخ محمد الأمين الشنقيطي74فتوىالمكتبة الشاملة
الجامع الصحيح مما ليس في الصحيحين — الوادعي7,586 (مكتمل)حديثالمكتبة الشاملة (كتاب 148097)
سلسلة الأحاديث الصحيحة — الألباني10,560 (مكتمل)حديثالمكتبة الشاملة (كتاب 9442)
إرواء الغليل — الألباني2,617 (مكتمل، دون المقدمة؛ مخفي حالياً من البحث والمصادر)حديث وتخريجالمكتبة الشاملة (كتاب 22592)
صحيح سنن أبي داود — الألباني3,480 (مكتمل، دون المقدمة)حديثالمكتبة الشاملة (كتاب 25881)
إسلام هاوس8,944مقال وفتوىواجهة بيانات IslamHouse
بيان الإسلام4,433مقال (مستبعد من البحث)منصة خدمة المحتوى الإسلامي
رسالة الحرمين29مقال وحديثمنصة خدمة المحتوى الإسلامي
الموسوعة العقدية — الدرر السنية1,491 (مكتمل، 3,500 صفحة)عقيدةموقع الدرر السنية
الموسوعة الفقهية — الدرر السنية5,411 (مكتمل، 18,000 صفحة)فقهموقع الدرر السنية
الموسوعة التاريخية — الدرر السنية6,222 (مكتمل، 7,200 صفحة)سيرة وتاريخموقع الدرر السنية
الموسوعة الحديثية — الدرر السنية31,749 (السحب جارٍ؛ الصحيح والحسن فقط)شرح حديثموقع الدرر السنية
معجم المصطلحات الإسلامية — الجمهرة25,137 (مكتمل، 14,000 صفحة)مصطلحمعجم الجمهرة
بيّنات: أسئلة وأجوبة عن الإسلام836 (مكتمل؛ 31 موسوماً «للمراجعة» ومحجوباً)شبهةالمستودع الدعوي (نسخة نصية)

لا تتضمن المجموعة أرشيفي «الإسلام سؤال وجواب» أو «إسلام ويب». اكتملت جميع الكتب المجدولة للسحب عدا «الموسوعة الحديثية» للدرر السنية، ويجري سحبها وتضمينها آلياً على الخادم بدفعات منتظمة، فالعدّاد الظاهر في الموقع يزداد.

المصادر الجديدة (30 سبتمبر 2026): أُضيفت خمسة مصادر مكتملة وسادس جارٍ، وأُتيحت أبوابها في مرشحات «اسأل المصادر» وصفحة «المصادر» وفي ترتيب الأنواع. موسوعات الدرر السنية (العقدية والفقهية والتاريخية والحديثية) تُستخرج مسألةً مسألة من صفحات الموقع مع عنوان المسألة وبابها ورابط صفحتها الأصلية؛ ووحدة التحليل فيها المسألة المحرَّرة بأدلتها كما وردت. وفي الموسوعة الحديثية يُقرأ من كل صفحة الراوي والمحدِّث وخلاصة حكمه، ثم تُستبعد الأحاديث الضعيفة والموضوعة وغير محددة الحكم قبل الإدخال أصلاً فلا تدخل القاعدة ولا صفحة المصادر (بلغ المستبعد آلياً 26,739 نصاً وقت اللقطة)؛ وقد صُحح نمط الاستخراج بعد فحص صفحات حقيقية لأنه كان يقرأ «خلاصة حكم المحدث» مكان اسم المحدِّث. معجم الجمهرة وحدة تحليله المصطلح المحرَّر بتعريفه وأقسامه. كتاب «بيّنات» استُورد نصياً من مشروع سابق، ومرّ على تنظيف حتمي من أربع طبقات: استبدال الآيات المشوّهة برسمها المعتمد من جدول القرآن في القاعدة نفسها عبر إحالة السورة ورقم الآية المذكورة بعد كل آية، وتصحيح انعكاس علامات الترقيم والأقواس، وحذف ترويسات الصفحات المتسللة من قائمة محصورة، ثم فحص ذاتي مغلق يوسم كل سجل بقي فيه رمز غير محلول أو قوس آية غير متوازن بـ«للمراجعة» ويحجبه عن البحث والملخص (805 نقية و31 محجوباً). التنظيف قواعد نمطية حتمية لا توليد آلي، ولم تُراجع نتائجه بشرياً بعد.

أُدخلت في 28–29 سبتمبر 2026 أربعة كتب حديثية محكوم عليها من المكتبة الشاملة: «الجامع الصحيح» للوادعي (3,526 صفحة)، و«السلسلة الصحيحة» (6,550 صفحة) و«إرواء الغليل» (2,927 صفحة) و«صحيح سنن أبي داود» (3,494 صفحة، بدءاً من الصفحة 15 دون المقدمة) للألباني. وحدة التحليل فيها هي الحديث المرقّم في الصفحة مع تخريجه وكلام المصنف عليه، ويُحفظ الجزء والصفحة أو رقم الحديث المطبوع ورابط الصفحة، ويُسجَّل في حقل الحكم توصيف الكتاب العام. هذا توصيف مجموعة وليس حكماً مستخرجاً على كل حديث بعينه، ويبقى كلام المصنف وتخريجه داخل النص كما هو؛ أما «إرواء الغليل» فيُترك حقل الحكم فيه فارغاً لأن الحكم يختلف من حديث لآخر. وفي الملخص والشرح لا يُنسب الحديث إلى الألباني بل يُقال «جاء في الحديث» مع بقاء الإحالة إلى الكتاب. وفي 29 سبتمبر 2026 حُذفت صفحات مقدمة «إرواء الغليل» (الصفحات 1–23: مقدمات الناشر والمؤلف وتراجم الأعلام)، فصار الكتاب يبدأ من أول حديث مخرَّج (الصفحة 24) بـ2,617 سجلاً.

درجة كل حديث (29 سبتمبر 2026): صار لكل سجل حديث درجة محفوظة في جدول مستقل (39,228 سجلاً) دون تعديل أي نص: صحيح البخاري ومسلم والجامع الصحيح «صحيح» (27,380 مع غيرها)؛ «إرواء الغليل» يُقرأ فيه حكم الألباني المكتوب بعد كل حديث (مثل «* صحيح.» و«* ضعيف.») ويرثه ما بعده من صفحات التخريج حتى الحكم التالي: صحيح 1,821، حسن 162، ضعيف 462، موضوع 34، غير محدد 169؛ «صحيح سنن أبي داود» يُقرأ فيه «(قلت: حديث صحيح/حسن…)» وإلا فتوصيف الكتاب «صحيح أو حسن»؛ «السلسلة الصحيحة» توصيف الكتاب «صحيح أو حسن» (10,560). الاستخراج آلي بقواعد نصية ولم يُراجَع بشرياً بعد. في «اسأل المصادر» والملخص والشرح المبسّط لا تدخل إلا الأحاديث الصحيحة والحسنة؛ الضعيف والموضوع وغير محدد الحكم تُستبعد ويُكمل البحث بغيرها. أما صفحة «المصادر» فتعرض كل الأحاديث بدرجتها ملوّنة: صحيح بالأخضر، حسن بالأزرق، ضعيف أو موضوع بالأحمر. إخفاء المصادر: تتيح صفحة الرفع للمشرف إخفاء أي مصدر من البحث وصفحة المصادر مع بقائه محفوظاً وقابلاً للإرجاع؛ و«إرواء الغليل» مخفي حالياً بهذه الآلية (لاحتمال كثرة الإشكالات في استخراج درجاته آلياً)، فلا تدخل سجلاته البحث ولا الملخص ولا صفحة المصادر، وتبقى درجاته المستخرجة موثقة هنا بوصفها عملاً منجزاً.

3. الجمع والإعداد والتحقق

  1. جُلبت المواد من المواقع الرسمية أو مجموعات وواجهات بيانات معلنة، ثم حُفظت مع اسم المصدر والمؤلف وموضع النص.
  2. قُسّمت المواد إلى وحدات قابلة للاسترجاع، مثل الآية، والحديث، والفتوى بسؤالها وجوابها.
  3. وُحّدت أسماء السور والمصادر المتكررة، وأُزيلت التشكيلات عند الحاجة إلى مطابقة العبارات القرآنية القصيرة، دون تغيير النص المعروض.
  4. لا يدخل البحث العام إلا السجل ذو الحالة التقنية verified. هذه الحالة هي الافتراضية عند الاستيراد، وتعني أهلية الاسترجاع: سجل منسوب إلى مصدر محدد ومجلوب آلياً مع بيانات موضعه. لا توجد في المشروع أدلة محفوظة على مطابقة عينات من الدفعات السابقة بمصدرها، فلا يُدّعى ذلك؛ جميع السجلات الحالية «مجلوبة آلياً ومنسوبة إلى مصدرها، دون مراجعة بشرية مسجلة».
  5. حقل verified_by يحمل في الغالب اسم الموقع أو الطبعة أو نظام الترقيم (مثل «ترقيم محمد فؤاد عبد الباقي»)، لا هوية مراجع؛ وتعرضه البطاقة بعنوان «الطبعة / جهة المصدر». أربعة سجلات من صحيح مسلم (MSL-0093، MSL-0534، MSL-6541، MSL-6853) بلا قيمة فيه مع وجود رابطها في sunnah.com؛ تُركت فارغة لعدم ثبوت الطبعة، وتظهر «غير مسجلة».
  6. أُنشئ جدول «أدلة المراجعة» (review_evidence) لتسجيل مراجعة لاحقة على عينة أو مراجعة فردية، بالمراجع والتاريخ والطريقة والنتيجة. عدد صفوفه وقت لقطة الإغلاق صفر؛ لا توجد أي مراجعة بشرية مسجلة، ولا نسب دقة أو أسماء مراجعين.
  7. تُحفظ النصوص للقراءة العامة، بينما تتم الإضافة والتحديث من جهة الخادم فقط.

4. النماذج والخدمات المستخدمة

الوظيفةالشركةاسم النموذجالمعرّف التقنيالاستخدام
التضمين الدلاليGoogleGemini Embedding 2google/gemini-embedding-2تمثيل السؤال والنصوص بمتجهات من 3,072 بُعداً
تلخيص النتائجGoogleGemini 3.1 Flash-Litegoogle/gemini-3.1-flash-liteتلخيص مقيد بالنصوص المسترجعة مع إحالات رقمية
الشرح المبسّطGoogleGemini 3.1 Flash-Litegoogle/gemini-3.1-flash-liteجواب سردي عن السؤال من النتائج الخمس الأولى، يُنشأ عند طلبه ويُفحص قبل عرضه
القراءة الصوتية الطبيعيةGoogleGemini 3.1 Flash TTS Previewgoogle/gemini-3.1-flash-tts-previewتحويل النص إلى صوت؛ الصوت المختار Charon

النماذج خدمات خارجية قد تتغير إصداراتها أو سلوكها. ينبغي توثيق تاريخ الاختبار ومعرّف النموذج ولقطة البيانات عند أي دراسة قابلة لإعادة الاختبار.

5. خط أنابيب الاسترجاع الهجين الصارم

  1. يُحوّل السؤال إلى متجه دلالي من 3,072 بُعداً.
  2. الفهرس الدلالي من نوع IVFFlat على تمثيل halfvec(3072) بمسافة جيب التمام: فهرس عام (lists=300) وفهارس جزئية لكل نوع كبير (فتوى 250، حديث 150، تفسير 100، مقال 100)، وتضبط دالة البحث ivfflat.probes=8، وتُخطَّط كل مرة بقيم الطلب الفعلية (plan_cache_mode=force_custom_plan) حتى يُستعمل فهرس النوع المطلوب. تطبق حالة الأهلية ومرشحا النوع والمصدر قبل ترتيب أقرب 200 مرشح، ثم يُحتفظ بعدد مرشحين يساوي الأكبر من ثلاثة أمثال العدد المطلوب أو 30. البحث تقريبي، ولا يضمن استرجاع كل نص مناسب.
  3. صيغة السؤال والمفاهيم المترابطة (إصدار search-2026-09-29.1): يُستدل من صيغة السؤال على النوع المرجَّح: «ما حكم / هل يجوز / ماذا أفعل» ← فتوى؛ «فسّر / ما معنى قوله تعالى» ← آية وتفسير؛ «أكمل الحديث / ماذا قال الرسول» ← حديث وشرحه. هذا تقديم لا حصر: يضيف علاوة ترتيب صغيرة ويقدّم أفضل نتيجة من النوع المرجَّح، دون استبعاد غيره ودون تغيير عتبة 0.70 أو المرشحات. وتوسّع قائمة مراجعة يدوياً البحثَ اللفظي بألفاظ مترابطة (مثل: خمر ← مسكر، نبيذ، كحول) دون أثر في التشابه الدلالي. ويُحفظ تمثيل السؤال المتكرر مؤقتاً لتجنب إعادة توليده.
  4. الأسئلة الكلية (إصدار search-2026-09-30.1): لوحظ أن السؤال عن باب كامل («الحكم الشرعي للطهارة») كان يُجاب بفتاوى جزئية عنوانها قريب لفظاً («حكم الطهارة إذا خلع الجورب»، «حكم الطهارة للطواف»)، فتغيب نصوص التأصيل. فصار النظام يميّز صيغتين: تأصيل («ما معنى / تعريف / أقسام / أركان / اشرح» + الموضوع) فتُقدَّم نصوص المصطلحات والفقه والعقيدة؛ وحكم كلي («حكم / الحكم الشرعي / أحكام» مع اسم باب من قائمة أبواب مراجعة يدوياً: الطهارة، الصلاة، الزكاة، الصيام، الحج، النكاح، الربا، التوحيد…) فتُقدَّم نصوص الفقه والعقيدة والمصطلحات مع بقاء الفتاوى في القائمة، لأن كثيراً من الأحكام لا يُنص عليه إلا فيها. ويُشترط لكلتا الصيغتين قِصَر السؤال (سبع كلمات فأكثر قليلاً تُخرجه) وخلوّه من قرائن الواقعة الشخصية («هل، إذا، لو، عندي، نسيت، زوجي…»)، فيبقى «ما حكم التدخين» و«ما حكم أكل النمل» في مسار الفتاوى. ويُضاف إلى البحث اللفظي في هذه الصيغ ألفاظ موضع التأصيل (تعريف، معنى، أقسام، شروط، أركان، فرض، واجب، إجماع). وهذا كله تقديم لا حصر: عتبة 0.70 ومرشحات المستخدم تبقى حاكمة.
  5. بالتوازي، ينتج البحث اللفظي ما يصل إلى 60 مرشحاً مع رتبة ts_rank. يعمل على تمثيل بحث مطبّع مستقل (search_norm_tsv) يُبنى بالدالة ar_search_norm من المصدر والباب والسورة والنص، ويُطبق التطبيع نفسه على السؤال؛ ويبقى النص الأصلي والرسم القرآني دون تغيير. اكتملت تعبئته لجميع السجلات في 28 سبتمبر 2026 (قبل ذلك اليوم كان جزئياً)، والسجلات الجديدة والمعدلة تُطبّع تلقائياً بمشغّل قاعدة البيانات؛ وبقي في الدالة مسار احتياطي للتمثيل القديم لأي سجل بلا تمثيل مطبّع.
  6. تُدمج القائمتان بطريقة Reciprocal Rank Fusion بالصيغة 1/(50+r_sem) + 1/(50+r_kw)؛ ومساهمة المسار الذي لم يُرجع السجل صفر. عند عدم اختيار مرشح يبحث التطبيق في كل نوع على حدة ثم يرتب الأنواع: آية ← تفسير ← حديث ← شرح حديث ← فتوى ← عقيدة ← فقه ← سيرة ← شبهة ← مصطلح ← مقال، حتى لا تطغى الفتاوى لكثرتها ولا تُحجب الموسوعات الجديدة خلف المقالات. وعند اختيار نوع أو مصدر يلتزم به وحده.
  7. يعيد التطبيق ترتيب المرشحين باستخدام درجة داخلية موثقة في القسم التالي.
  8. تُستبعد النتائج ذات التشابه الأقل من 0.70، وتُقبل النتائج الواقعة ضمن 0.10 من درجة أفضل مرشح بعد إعادة الترتيب.
  9. يعرض النظام أول خمس نتائج. يطبق المسار الأول حداً أقصى قدره نتيجتان من المصدر نفسه؛ ولا يطبق هذا الحد على مطابقات العبارات القرآنية التي تسبقها في القائمة النهائية. بعد الدمج يُعاد التحقق من الأهلية والنوع والمصدر لكل بطاقة، فلا تظهر آية عند تقييد البحث بصحيح البخاري مثلاً.
  10. يمكن طلب خمس نتائج إضافية في كل مرة. يحافظ هذا المسار على عتبة 0.70 والمرشحات، ويستبعد المعرفات المعروضة، لكنه يزيل نافذة القرب وحد المصدر لزيادة التغطية. لا تُخزن النتائج الإضافية ولا تدخل في الملخص أو الشرح.
  11. للعبارات القرآنية القصيرة من كلمة إلى خمس كلمات، وبطول أربعة محارف مطبّعة فأكثر، مسار مطابقة نصية إضافي يعمل بالتوازي، ويتسامح مع التشكيل واختلاف بعض صور الألف والياء والهاء والتاء المربوطة. يلتزم هذا المسار بمرشحي النوع والمصدر: لا يعمل إلا إذا كان النوع «آية» أو غير محدد، ويقيّد بالمصدر المختار.

6. تعريف نسبة المطابقة وطريقة حسابها

المسمى الأدق للرقم الظاهر هو «درجة التشابه الدلالي». يُنشئ نموذج التضمين متجه سؤال q ومتجه نص d، ثم تحسب قاعدة البيانات تشابه جيب التمام:

similarity(q,d) = (q · d) / (||q|| × ||d||) = 1 − cosine_distance(q,d)

تُحسب المسافة بعد تحويل المتجهين ذوي 3,072 بُعداً إلى تمثيل نصف الدقة halfvec؛ ولذلك فالنتيجة تقريب عددي وليست حساباً بكامل دقة المتجه الأصلي. تحول الواجهة القيمة إلى عدد صحيح مئوي بالصيغة round(similarity × 100). لذلك يعني ظهور 78% أن قيمة التشابه قبل التقريب تقع تقريباً حول 0.78.

لا تعني النسبة أن النص يطابق السؤال حرفياً بنسبة 78%، ولا أنها احتمال صحة الفتوى، ولا درجة ثقة شرعية، ولا حكماً على ملاءمة النص لظروف السائل.

قد يتأثر التشابه بطول النص وصياغة السؤال وتمثيل المفردات. وتُعرض أوصاف تشغيلية بجانب الرقم: «تشابه مرتفع» من 80% فأعلى، و«تشابه جيد» من 75% إلى أقل من 80%، و«تشابه مقبول» لما دون 75% من النتائج المقبولة. هذه الحدود وصف بصري غير معاير علمياً.

المطابقة النصية مستقلة عن التشابه. كان الإصدار السابق يعطي مطابقة العبارة القرآنية القيمة 1 ويعرضها 100% تحت «درجة التشابه الدلالي»، وكانت هذه قيمة مصطنعة. في الإصدار الحالي يحمل كل سجل نوع مطابقة (match_kind): semantic، أو phrase، أو phrase+semantic. تُعرض للمطابقة النصية عبارة «عُثر على العبارة في النص بعد تطبيع التشكيل والرسم» دون نسبة، وتُعرض النسبة فقط إذا حُسب تشابه جيب التمام فعلاً للسجل نفسه. وفي الإصدار الحالي تظهر للمستخدم أربعة أوصاف بحسب نوع المطابقة: «عبارة متصلة» إذا وُجدت عبارة السؤال بلفظها متصلة، و«تفسير الآية المطابقة» للتفسير المجلوب برقم السورة والآية بعد مطابقة الآية، و«تطابق كلمات» إذا تطابقت كلمات السؤال متفرقة، و«تشابه دلالي» بنسبته المئوية لما حُسب له تشابه فعلاً. وتُعامل الإجابات المحفوظة بالإصدار القديم على أنها منتهية، فلا تعود القيمة المصطنعة عبر التخزين المؤقت.

الأوصاف البصرية («مرتفع/جيد/مقبول») والعتبة 0.70 والأوزان معاملات تشغيلية غير معايرة، ولم تُغيَّر في هذا الإصدار؛ ولا تُعد أي منها احتمال صحة ولا اعتماداً شرعياً.

7. درجة الترتيب الداخلية واختيار النتائج

لا يساوي ترتيب البطاقات ترتيب نسب التشابه الظاهرة دائماً. فبعد تطبيق حد التشابه 0.70، يحسب النظام لكل مرشح الدرجة الداخلية الآتية:

ranking_score = similarity + 0.03 × min(keyword_rank, 1) + source_type_bonus + question_intent_bonus

المكوّنالقيمةشرط التطبيق
وزن الرتبة اللفظيةحتى 0.03بحسب keyword_rank وبحد أعلى 1
مكافأة التفسير+0.03لكل نص من نوع تفسير
مكافأة الحديث+0.02لكل نص من نوع حديث
مكافأة شرح الحديث+0.01لكل نص من نوع شرح حديث
قصد سؤال التفسير+0.05عند ورود: تفسير، معنى الآية، معنى قوله، معنى سورة
قصد سؤال الحديث+0.04عند ورود: حديث، قال رسول، قال النبي، صلى الله عليه
قصد سؤال الفتوى+0.02عند ورود: فتوى، حكم، يجوز، هل يصح
  1. تُحذف السجلات غير الموثقة، وما دون 0.70، ومقالات «بيان الإسلام» من مسار الإجابة لأنها تعريفات بالكتب وليست نصوص الكتب.
  2. يرتب الباقي تنازلياً بحسب الدرجة الداخلية.
  3. تُحفظ النتائج التي لا تقل درجتها عن أفضل نتيجة بأكثر من 0.10.
  4. يؤخذ من نتائج هذا المسار بحد أقصى نصان من المصدر الواحد وخمس نتائج.
  5. تُقدّم مطابقات العبارات القرآنية القصيرة أولاً، ثم نتائج المسار الدلالي غير المكررة، ويُقص الناتج النهائي إلى خمس بطاقات. قد تتجاوز القائمة النهائية نتيجتين من القرآن لأن حد المصدر لا يعاد تطبيقه بعد دمج المسارين.

تفسر هذه الخطوات إمكان ظهور بطاقة ذات تشابه 76% قبل بطاقة ذات 78%: الأولى قد تحصل على وزن لفظي أو نوعي أو قصدي أعلى. الرقم الظاهر يظل التشابه الدلالي وحده. الدرجة الداخلية تُعاد في MCP بالحقل ranking_score منفصلة عن semantic_similarity، ولا تُعرض في البطاقة.

8. آلية عرض بطاقات النتائج

تحافظ البطاقات على ترتيب القائمة النهائية وتُرقم من [1] إلى [5]. ويتكون العرض من:

  1. رأس البطاقة: رقم النتيجة، ونوع النص، وشارة «نص منسوب إلى مصدره».
  2. النص: يعرض كما هو محفوظ بين علامتي اقتباس. إذا تجاوز 1,200 محرف يختصر بصرياً فقط، مع زر لعرضه كاملاً؛ ولا يُحذف شيء من السجل الأصلي.
  3. بطاقة التوثيق: تعرض الكتاب والمؤلف والمجلد والصفحة أو رقم الفتوى، وتضيف الباب والراوي والحكم عند توافرها للحديث؛ ويُميَّز «الحكم كما ورد في بيانات المصدر» عن «توصيف الكتاب». وللتفسير تعرض اسم التفسير والمؤلف والسورة ورقم الآية و«الطبعة / جهة المصدر».
  4. رابط الأصل: يظهر «عرض النص في مصدره» عندما يحتوي السجل رابطاً أصلياً صالحاً، بينما تحمل بطاقة التفسير عبارة «المصدر المباشر في مشروع آيات — جامعة الملك سعود».
  5. أدوات الاستخدام: الاستماع الطبيعي، ونسخ النص مع توثيقه، والعودة إلى الملخص.
  6. مؤشر التشابه: يعرض «التشابه الدلالي المحسوب» وشريطه فقط إذا حُسب، ووسم المطابقة النصية إذا وُجدت، وتنبيهاً قصيراً بأن المؤشر ليس احتمال صحة ولا حكماً شرعياً، مع مستوى المراجعة.

أرقام المصادر داخل الملخص أزرار تنقل إلى البطاقة المناظرة. ولا يُفعّل رابط مشاركة الإجابة حتى ينتهي التلخيص (نجاحاً أو رفضاً). لا يُبث الملخص جزءاً جزءاً؛ يُعرض كاملاً بعد اجتيازه الفحص، فالعرض والقراءة الصوتية والحفظ والاستعادة تستعمل النسخة المفحوصة نفسها.

9. التلخيص المقيد وعلاقة الملخص بالمصادر

بعد الاسترجاع، يرسل الموقع السؤال والنتائج الخمس الأولى إلى نموذج التلخيص. تلزمه التعليمات بعدم إضافة حكم أو دليل، وبإحالة كل نقطة إلى رقم بطاقة موجود، وبنسبة كل قول إلى قائله أو جهته، وبنقل الشروط والقيود والأعداد كما وردت، وبتضمين كل نقطة اقتباساً حرفياً قصيراً بين «»، وبعنوان «اختلاف:» يليه قول كل نص بإحالته عند اختلاف نصين مختلفين أو أكثر، دون ترجيح. سياسة عرض الأقوال: كل نقطة لنص واحد منسوبة إليه؛ وإذا ذكر الملخص مقداراً بوحدة مدعومة أو عبارة «أفضل» فعليه نقل المقابل من كل نص مرفق يذكر مثله. وعند ورود حديث من كتب الألباني لا يُنسب الحديث إليه في صياغة الملخص، بل يقال «جاء في الحديث» مع جواز ذكر درجته كما في البطاقة، مع بقاء إحالة بطاقة المصدر؛ ويُسمح باسمه داخل اقتباس حرفي من النص فقط.

ما يصل إلى النموذج: حتى 9,000 محرف من كل نص وبميزانية إجمالية 24,000 محرف موزعة على النصوص (بحد أدنى 1,500 لكل نص). النص الذي يتجاوز حصته يُوسم للنموذج بعبارة «اقتُطع النص: عُرض س من ص محرفاً»، ويُطلب منه ألا يجزم بما قد يكون في الجزء غير المعروض. البطاقة تعرض النص كاملاً دائماً. كان الحد السابق 4,000 محرف دون وسم.

الفحص الآلي قبل الاعتماد (مساعد، لا ضمان): يُقبل الملخص فقط إذا اجتاز كل ما يلي، وإلا أُعيد توليده مرة واحدة مع أسباب الرفض. في المحاولة الأخيرة يمكن تصحيح رقم إحالة اقتباس إذا وُجد بلفظه في نص مرفق واحد آخر، أو حذف السطر المعيب وحده؛ ثم يُعاد الفحص الكامل، مع قاعدتين مضافتين: حذف سطر لا يُسقط شرط عرض طرفي الاختلاف (فإذا كان السطر المحذوف طرفاً وحيداً في قسم «اختلاف:» حُجب الملخص)، والسطر الذي فيه اسم عالم وتغيّرت إحالته يُحذف بدل تصحيحه؛ فإن لم ينجح الباقي لا يُعرض الملخص ولا يُحفظ ولا يُقرأ صوتياً: (1) صحة الإحالات؛ (2) إحالة كل ادعاء؛ (3) اقتباس حرفي في كل نقطة؛ (4) مطابقة الأعداد ووحداتها وقيود المقارنة؛ (5) إحالة قسم الاختلاف إلى نصين مختلفين على الأقل؛ (6) تغطية المقادير والأفضلية المتقابلة؛ (7) منع نسبة الحديث إلى الألباني في الصياغة خارج الاقتباس. يتحقق الفحص من هذه العلامات الظاهرة، لكنه لا يثبت أن المصدر يدعم كل معنى رابط في إعادة الصياغة، ولا يكشف كل نفي أو شرط غير عددي أو كل اختلاف موضوعي؛ لذلك تبقى النصوص الأصلية هي المرجع.

شرح مبسّط عند الطلب (تحديث 30 سبتمبر 2026): يتيح اللسان الثاني شرحاً سردياً من فقرة إلى أربع فقرات، ويُولّد فقط عند فتحه باستخدام نموذج Flash-Lite نفسه ومن النتائج الخمس الأولى نفسها. وقد صار مبنياً على السؤال لا على البطاقات: الفقرة الأولى جواب مباشر عن عين ما سُئل عنه بما دلّت عليه النصوص المرفقة، والفقرات التالية تفصّل شروطه وأقسامه وما ورد فيه من خلاف، ويُمنع سرد النصوص واحداً واحداً («ذكر النص الأول… ذكر الثاني…»). ولا يُغيّر هذا شيئاً من الضوابط: كل فقرة تحتاج إحالة واقتباساً حرفياً، وتطبق عليها فحوص الإسناد والأعداد والقيود والأقوال المتقابلة وسياسة نسبة الحديث نفسها، وإن لم تُجب النصوص عن السؤال بعينه صُرّح بذلك ولم يُجب عن سؤال مجاور. الشرح محلي للجلسة ولا يغيّر الملخص الموثّق المحفوظ.

كان الإصدار السابق يعيد ترقيم المتاح إذا سُحب سجل فتنزاح الإحالات؛ صار التلخيص يرفض الطلب إذا نقص أي سجل، ويُخفى الملخص المحفوظ عند تغيّر أي مصدر (القسم 10).

10. التخزين المؤقت والمشاركة والتسجيل

  • يُطبّع السؤال بإزالة التشكيل وتوحيد صور الألف والياء والتاء المربوطة وإزالة علامات الترقيم، ثم يضم إلى مرشحي النوع والمصدر لتكوين مفتاح التخزين المؤقت.
  • يُحفظ مع كل إجابة: إصدار البحث، ومعرفات النتائج وترتيبها، ونوع المطابقة، والتشابه الدلالي الحقيقي أو null، وبصمة لكل نص تشمل كل حقوله المؤثرة (المعرف، النوع، المصدر، المؤلف، المجلد، الموضع، الباب، الراوي، الحكم، النص، الحالة، الملاحظة، السورة ورقمها ورقم الآية، جهة المصدر، الرابط، تنبيه الوقف) بتسلسل JSON ثابت الترتيب، وبصمة للملخص تربطه بالسؤال وبقائمة النتائج بترتيبها وببصمات نصوصها وبإصدار الملخص.
  • عند الاستعادة يُعاد فحص وجود كل سجل وأهليته ومطابقته للمرشحات وبصمته. إذا تغيّر أي شيء أو كان إصدار البحث قديماً تُجرى عملية بحث جديدة وتُستبدل الإجابة المحفوظة. ولا يُعاد الملخص إلا إذا طابقت بصمته السؤال والقائمة والبصمات الحالية وإصدار الملخص، واجتاز الفحص الآلي نفسه من جديد. ولا يُحفظ ملخص إذا تغيّرت بصمة أي نص بين بدء التلخيص وانتهائه. لا يُفترض تشابه 0.8 أو 1 عند نقص الدرجة.
  • الإجابة الخالية («لم أجد») تبقى صالحة فقط إذا حُفظت بإصدار البحث الحالي نفسه، ولم يُضف أو يُعدَّل أي سجل بعد حفظها (أحدث updated_at في القاعدة، ويُحدَّث عند الإدخال وعند كل تعديل بما فيه تغيير الحالة؛ الحذف لا يمكن أن يحوّل «لم أجد» إلى جواب). تُطبق القاعدة نفسها على رابط مشاركة الإجابة الخالية. أثناء الإدخال الجاري تُعاد غالباً. أما الإجابة غير الخالية فتبقى صالحة ما لم تتغير نصوصها أو الإصدار، ولا يُعاد تقييمها عند إضافة نصوص جديدة (قيد معروف).
  • رابط المشاركة: إذا تغيّرت المصادر يُعرض تنبيه «تغيّرت بعض المصادر»، ويُخفى الملخص القديم، وتظهر النصوص الصالحة فقط بأرقامها الأصلية، مع دعوة لإعادة السؤال.
  • يسجل النظام السؤال، ومرشحي النوع والمصدر، والحالة، وعدد النتائج، والمدة، وإصدار البحث، وهل جاءت من التخزين المؤقت، وأعلى تشابه دلالي حقيقي، وتشابه أول بطاقة، ودرجة ترتيبها، ونوع مطابقتها، وأول مصدر، والقناة، وبيانات الجهاز التقريبية والبلد والمدينة. في السجلات السابقة لهذا الإصدار (بلا إصدار بحث) يمثل «أعلى تشابه» قيمة أول بطاقة، وقد يكون 100% مصطنعة لمطابقة نصية؛ لا يُعاد تفسيرها آلياً وتُعلَّم بنجمة في صفحة السجل.

11. حالات الاستجابة والضوابط التشغيلية

  • يقبل السؤال من حرفين إلى 500 حرف، ويمكن تقييده بنوع النص أو مصدر بعينه.
  • إذا لم ينجح أي مرشح في شروط القبول، يعرض النظام: «لم أجد جواباً لهذا السؤال في المصادر المرفوعة»، وتظهر الإحالة إلى الرئاسة العامة للبحوث العلمية والإفتاء للمسائل الشرعية فقط؛ أما الأسئلة غير الشرعية (كالطقس أو البرمجة) فتوضح الواجهة أنها خارج نطاق المنصة دون إحالتها لجهة الإفتاء. لا يوجد مصنف موضوعي مختبر؛ هذه صياغة واجهة لا قياس.
  • يحاول طلب التضمين مرة ثانية عند فشل الشبكة أو انتهاء المهلة، لكنه لا يعيد المحاولة عند انشغال الخدمة أو نفاد الرصيد.
  • يستخدم الموقع وخادم MCP نواة الاسترجاع الصارم نفسها، بينما يضيف الموقع الملخص والبطاقات المرئية وأدوات المشاركة.
  • القراءة الصوتية تحول النص المعروض إلى صوت عند طلب المستخدم، ولا تدخل في الاسترجاع أو الترتيب أو الحكم على النتائج.
  • تظهر النتائج فور اكتمال الاسترجاع، ثم يظهر الملخص الموثّق في بطاقته بعد توليده وفحصه؛ فلا يؤخر التلخيص عرض النصوص.
  • البحث الجزئي: إذا تعذر الاسترجاع في نوع من الأنواع (كالحديث مثلاً) تُعرض نتائج الأنواع السليمة مع تنبيه «البحث جزئي» يذكر النوع المتعطل، ويُسجَّل ذلك في سجل البحث، ولا تُحفظ النتيجة الجزئية في التخزين المؤقت ولا تُلخَّص، حتى لا تُقدَّم لاحقاً بوصفها نتيجة كاملة.

إشكالات تشغيلية ومعالجتها (28–29 سبتمبر 2026)

  • بطء البحث الجديد (9–22 ثانية): كانت دالة البحث تعيد استعمال خطة عامة لا تعرف النوع المطلوب، فلا تستعمل فهرس النوع. القياس المباشر: 100–250 مللي ثانية لبحث النوع بفهرسه مقابل 25 ثانية وأكثر بدونه. المعالجة: تخطيط كل طلب بقيمه الفعلية. بعد ذلك قيس ثلاثة أسئلة جديدة في المتصفح: 1.9–3.0 ثوانٍ حتى ظهور النتائج.
  • انتظار الملخص: كانت النتائج تُحجب حتى يكتمل الملخص (5–6 ثوانٍ). صارت تُعرض أولاً والملخص بعدها.
  • طغيان الفتاوى في البحث العام: لأنها أكثر من نصف القاعدة. المعالجة: بحث مستقل لكل نوع ثم الترتيب المعتمد. جُرّب دمج الأنواع في استعلام واحد فأعاد 23 فتوى و7 مقالات من 30 مرشحاً، فلم يُعتمد.
  • بطء العبارات القرآنية: «اهدنا السراط المستقيم» استغرق 18 ثانية؛ أضيفت مطابقة الآية الحرفية أولاً وتطبيع «السراط/الصراط» وحدّ كلمة يدعم العربية، فانخفض إلى أقل من ثانية.
  • حجب الملخص عند اقتباس غير مطابق: بدل حجب الملخص كله يُصحَّح رقم الإحالة إذا وُجد الاقتباس بلفظه في نص آخر، أو يُحذف السطر المعيب وحده، ثم يُعاد الفحص الكامل.
  • خطأ نقل قيد عددي (FWZ-288): «تزيد عن أربعة» نُقلت «أربعة فأكثر»؛ حُفظت الحالة اختباراً دائماً وأضيف فحص قيود المقارنة.
  • نسبة الحديث إلى الألباني: صارت الصياغة «في الحديث الصحيح» للصحيح و«في الحديث الحسن» للحسن (30 سبتمبر 2026)، وتُرفض آلياً نسبة الحديث إلى الألباني.
  • أحاديث ضعيفة في «إرواء الغليل»: استُخرج حكم كل حديث وتُستبعد الأحاديث الضعيفة والموضوعة وغير محددة الحكم من الإجابات والملخصات، وتبقى معروضة بدرجتها في صفحة «المصادر».
  • ضياع التفاسير في أسئلة الآيات: صار البحث بعد مطابقة الآية يجلب تفسيرها برقم السورة والآية ثم يُكمل البحث المعتاد في بقية الأنواع، مقابل زمن أطول قليلاً.
  • مقدمة «إرواء الغليل» وإخفاؤه: حُذفت صفحات المقدمة (1–23) فصار الكتاب يبدأ من أول حديث مخرَّج، ثم أُخفي الكتاب كله من البحث وصفحة المصادر بقرار إداري احتياطي (يبقى محفوظاً وقابلاً للإرجاع من صفحة الرفع).
  • وصف المطابقة المضلل: كانت العبارة «وُجدت العبارة» تظهر حتى عند تطابق كلمات متفرقة؛ صارت الأوصاف أربعة: «عبارة متصلة»، «تفسير الآية المطابقة»، «تطابق كلمات»، و«تشابه دلالي» بنسبته.
  • توقف السحب عند إعادة تهيئة بيئة العمل: كان السحب يستأنف من آخر صفحة محفوظة بمعرّفات ثابتة للصفحات (SHM-كتاب-صفحة) فلا يتكرر السجل. انتهى السحب في 29 سبتمبر 2026، ونُظّف الجدول بعده (صفر سجلات ميتة).

12. التقييم الحالي وحدود الاستدلال

تقرير تطوير سابق غير قابل للتحقق حالياً: ورد في ملاحظات التطوير (PLATFORM.md) وصف جولة تشخيصية من 45 سؤالاً (34 شرعياً و11 خارج النطاق) بنتيجة 44/45. لا توجد في المشروع ملفات الأسئلة أو المخرجات الخام أو معيار الحكم أو إصدار القاعدة والنماذج وقت التشغيل، فلا يُعد هذا الرقم مؤشر أداء متحققاً، ولا تُنسب إليه نسبة دقة. وإن ثبت فالـ44 تشمل الرفض الصحيح للأسئلة الإحدى عشرة، أي لا تعني 44 إجابة نصية زائدة على 11 رفضاً. وقد استُخدمت الأسئلة نفسها للضبط.

أُعد هيكل تقييم مستقل قابل للتشغيل في eval/: ملفات أسئلة منفصلة للضبط (dev) والاختبار (test)، وسكربت يحفظ النتائج الخام مع الإصدارات، ومعايير حكم مكتوبة تشمل Precision@5 القياسي (الملائم بين أول خمس ÷ 5 دائماً) ومقياساً منفصلاً لدقة المعروض (الملائم ÷ المعروض فعلاً، غير معرّف عند الصفر) وجودة الرفض وصحة الإحالات وتغطية الشروط واختلاف الأقوال. لم يُنفذ التقييم بعد، ولا توجد أحكام مختصين. الاختبارات الآلية المضافة في هذا الإصدار اختبارات سلوك برمجي، لا قياس دقة.

تشغيلات فحص أمانة الملخص (جولة الإغلاق، 28 سبتمبر 2026، بيئة النواة): أُعيد تشغيل الملخص المحفوظ لسؤال المسافر (9509e07b) على الفاحص الجديد فرُفض (تغيّر قيد العدد، وقسم «اختلاف» بنص واحد). ثم شُغّل التلخيص على أربع حالات (المسافر من نصوص مثبتة، و«إنما الأعمال بالنيات» و«زكاة الفطر» و«المسح على الخفين» من بحث حي) في ثلاث جولات بإعدادات متتالية، كلها محفوظة: الجولة الأولى (4 تشغيلات لكل حالة) رُفض فيها المسافر 4/4 وزكاة الفطر 4/4؛ وبعد إضافة تنبيه المقادير رُفضت زكاة الفطر 4/4 واعتُمد المسافر 4/4؛ وبعد تحسين رسالة إعادة التوليد اعتُمدت الحالات الأربع 3/3. في الملخصات المعتمدة للمسافر لم يُنسب «أربعة فأكثر»، وظهر مثال «خمسة أيام أو ستة» منسوباً إلى [1]، لكن لم يُذكر شق «تزيد عن أربعة» في كل مرة. هذه نتائج فحص آلي على عدد صغير من الحالات، لا حكم مختص؛ الملفات في eval/results/summary-fidelity-*.json.

جولة التصحيح الأخيرة (summary-2026-09-28.3، 28 سبتمبر 2026 نحو 18:55Z، بيئة النواة): صُحح أربعة تجاوزات أبلغ عنها المراجع (إسقاط القيد مع عدد مجرد، سطر ادعاء ينتهي بنقطتين، جملة امتناع مع ادعاء زائد، تبديل الوحدة) باختبارات مباشرة. وحُفظت حالتا المسافر المنشورتان (9509e07b: تغطية جزئية للأقوال، 18:33Z؛ و4e3c9e3a: حالة نجاح، 18:35Z) بمدخلاتهما ومخرجاتهما وبصماتهما قبل الإبطال؛ الملخص المحفوظ لـ9509e07b يُرفض الآن بقاعدة التغطية. شُغّل التوليد 3 مرات لكل من السؤالين وحالتين إضافيتين: اعتُمدت حالتا المسافر 3/3 بعد إعادة توليد واحدة في كل تشغيل، وظهر فيهما «تزيد عن أربعة» منسوباً إلى الفوزان ومثال «خمسة أيام أو ستة أيام» منسوباً إلى ابن عثيمين، وفي الحالة الأولى «الأفضل أن تصوم إذا لم يشق عليك» مقابل أفضلية الفطر؛ لكن بعض الصياغات الرابطة بين الاقتباسات بقيت عامة («له أحكام مختلفة»)، وهذا لا يكشفه الفاحص. اعتُمدت زكاة الفطر 3/3، ورُفض «المسح على الخفين للمسافر» 3/3 فحُجب ملخصه وبقيت النصوص. التشغيلات بدرجة حرارة 0 أعطت مخرجات متطابقة تقريباً، فهي ليست عينات مستقلة إحصائياً. هذه اختبارات تشخيصية/ضبط لا نسبة دقة. الملف: eval/results/summary-fidelity-2026-09-28T18-55-43-334Z.json (وتشغيل سابق بقاعدة أضعف محفوظ في …T18-54-06-701Z.json، اعتُمد فيه المسافر مع إسقاط «تزيد عن أربعة» ومثال 5/6، وهو سبب تشديد القاعدة).

13. القيود والاعتبارات الأخلاقية

  • تفاوت حجم المصادر قد يؤثر في احتمال ظهور بعضها أكثر من غيرها.
  • المعاملات الحالية ضُبطت تطويرياً وليست حدوداً معيارية ثابتة.
  • النص الطويل: لا يدخل التضمين الدلالي النص كاملاً إذا طال؛ يُضمَّن كل سجل من أول 6,000 محرف من «المصدر + الباب + النص» (مساري الإدخال والفتاوى الأسبوعية). ما بعد ذلك محفوظ ومعروض ويدخل البحث اللفظي، لكنه لا يؤثر في التشابه الدلالي. في عينة تشخيصية من 500 سجل (غير ممثلة) تجاوز 7 سجلات حد 6,000، وبلغ أطول نص 21,239 محرفاً. تقسيم النصوص الطويلة إلى مقاطع وإعادة تضمينها غير منفذ (تحسين لاحق موثق). ولا يُدّعى أن كل الدفعات التاريخية أُدخلت بالطريقة الحالية نفسها.
  • حدود التطبيع اللفظي: يزيل التشكيل وعلامات المصحف والتطويل، ويوحد أ/إ/آ/ٱ إلى ا، وى إلى ي، وة إلى ه، وؤ إلى و، وئ إلى ي، ويستبدل الترقيم بمسافة. لا يعالج اختلاف الرسم العثماني في الحروف نفسها (مثل «الصلوٰة» التي تصير «الصلوه» لا «الصلاه»)، ولا الجذور أو الصيغ الصرفية، وقد يدمج كلمات مختلفة المعنى بعد إزالة الهمزة أو التشكيل. تاريخ المعالجة: توقفت تعبئة التمثيل المطبّع أولاً بعد نحو 26–27 ألف سجل بسبب امتلاء القرص، ثم استُكملت على دفعات صغيرة في 28 سبتمبر 2026؛ قراءة 17:39:09Z أظهرت 135,757 سجلاً كلها مطبّعة، ولقطة الإغلاق 17:58:02Z أظهرت 140,726 كلها مطبّعة. السجلات الجديدة والمعدلة تُطبّع تلقائياً عند الإدخال.
  • التشابه الدلالي قد يسترجع نصاً قريب الموضوع لكنه لا يجيب عن الحالة الخاصة.
  • قد يؤدي شرط الرفض إلى فقد بعض النتائج الصحيحة مقابل تقليل النتائج بعيدة الصلة.
  • النظام لا يرجّح بين الأقوال الفقهية ولا يصدر فتوى؛ يعرض المواد الأقرب وفق خوارزمية البحث.
  • تسجيل البحث لأغراض القياس يشمل الحقول المفصلة في القسم 10. لا يُطلب اسم الباحث، لكن اجتماع السؤال وبيانات الجهاز والموقع التقريبي قد يزيد قابلية التمييز؛ لذا ينبغي التعامل مع السجل بوصفه بيانات استخدام مقيدة الوصول.

14. قابلية إعادة الاختبار والعمل المستقبلي

لقطة الإعدادات الوصفية محفوظة في docs/snapshots/config-2026-09-28.json (الإصدار السابق) وdocs/snapshots/config-2026-09-28-closeout.json (هذا الإصدار)، وسجل ما تغيّر في docs/METHODOLOGY_REMEDIATION_2026-09-28.md وdocs/METHODOLOGY_CLOSEOUT_2026-09-28.md، وما يصلح للاستشهاد وما يحتاج عملاً بحثياً في docs/STUDY_READINESS.md. لقطة العد ليست نسخة corpus؛ تعريف بيانات الاختبارات (معرفات وبصمات) في eval/fixtures/. لإعادة اختبار النتائج يجب تثبيت: تاريخ لقطة البيانات وعدد سجلاتها، ومعرّفات النماذج، وقائمة الأسئلة، ومعايير الحكم، وعتبة 0.70، ونافذة 0.10، وقيمة RRF، وعدد المرشحين، وإعداد البحث التقريبي، وأوزان إعادة الترتيب، وقواعد عرض البطاقات، وإصدار البرنامج. الأولوية التالية هي بناء مجموعة تقييم مستقلة ومراجعة بشرية متعددة المقيمين، ثم تحليل الحساسية للعتبات والأوزان.

15. الربط الخارجي والمصادر الأصلية

يتيح خادم MCP لـChatGPT وClaude وغيرهما البحث في المصادر عبر أداتي search_sources (بمرشحي النوع والمصدر) وget_text. يعيد search_sources لكل نتيجة match_kind وsemantic_similarity (أو null) وranking_score وgrade_kind وreview_level. ويتلقى العميل تعليمات بعرض النص وتوثيقه وعدم الإضافة إليه. الروابط المرجعية: