# المقارنات الرقمية — للعرض ## 1) النموذج القديم مقابل نموذجنا (نفس المخطوطة المغربية) | النموذج | النتيجة | |---|---| | `reg(96.5)` (القديم — للفريق) | **نص بلا معنى** (نموذج غير مناسب للخط المغربي) | | **`exp6_best` (نموذجنا)** | **نص عربي صحيح ومقروء** | السبب: نموذجنا مُدرَّب خصّيصاً على الخط المغربي (RASAM + TariMa). ## 2) دقّة النموذج المغربي `exp6_best` (مقياس CER عبر ketos test) | الحالة | دقّة الحروف | CER | |---|---|---| | صفحات مُدرَّب عليها | **96.71%** | **3.29%** | | 51 صفحة اختبار مجمّدة (لم يرها) | **92.50%** | **7.50%** | **CER ≈ 7.5% على بيانات لم يرها النموذج** — رقم تنافسي للمخطوطات المغربية. ## 3) أثر النموذج اللغوي (LM) — قبل/بعد | المجموعة | بدون LM | مع LM | التحسّن | |---|---|---|---| | RASAM (مغربي) | 7.48% | **6.79%** | −0.69 | | TariMa | 10.27% | **8.81%** | −1.46 | (LM متاح ويُفعَّل عبر `USE_LM=true`؛ مطفأ افتراضياً في نسخة العرض للاستقرار.) ## 4) تصحيح القراءة المبني على الصورة (مثال حيّ) سطر «الملائكة المقرب**ير**» → النظام يرجّح **«المقرب**ين**» (55.8%)** = تصحيح صحيح. (التفاصيل في `تحليل/بدائل_القراءة.md`.) ## 5) فصل المتن عن الحاشية — قبل/بعد (صفحة 1960) | | قبل | بعد («المتن فقط») | |---|---|---| | الأسطر المعروضة | 30 (متن + 4 شظايا هامشية متداخلة) | 26 متناً نظيفاً | الحواشي لا تُحذف — تُعرض في تبويب منفصل وتُصدَّر موسومة. ## مسار التحسّن التراكمي للمشروع muharaf 37.91% → exp4A 7.64% → exp6 7.48% → exp6+LM **6.79%**