النماذج اللغوية العربية وما تصلح له فعلاً
يدور معظم الحديث عن الذكاء الاصطناعي العربي حول خمس عائلات تسندها دول، وحولها مجموعة اشتقاقات، وثلاث حقائق تحسم الاختيار بينها: عدد المعاملات، وما يبيحه الترخيص فعلاً، وهل تُنزَّل الأوزان أصلاً. هذه هي القائمة مقروءةً في بطاقات النماذج ونصوص الرخص، ثم السؤال الأصعب بعدها: ماذا تقيس درجةٌ عربية حين تصدر؟
معظم الميدان خمس عائلات تسندها دول، وحولها اشتقاقات
خرج «جيس» من إنسبشن التابعة لمجموعة G42، مع جامعة محمد بن زايد للذكاء الاصطناعي وCerebras، وأُعلن «جيس-13» في 30 آب 2023. وفي أيلول 2024 صدرت العائلة: عشرون نسخة بثمانية أحجام، من 590 مليوناً إلى 70 ملياراً، على ما تقول بطاقتها، وإن كان الحساب يضمّ كذلك نسخاً بـ256 مليوناً لا تعدّها البطاقة؛ وتفصّل البطاقة نسبين: jais-family مدرَّبة من الصفر، وjais-adapted بأحجام 7 و13 و70 ملياراً مأخوذة عن Llama-2 بعد إضافة 32,000 رمز عربي إلى المُرمِّز؛ وملفّ إعدادات المقتبس الأكبر ما زال يذكر LlamaForCausalLM.
وأُعلن «جيس 2» في 9 كانون الأول 2025 بحجمين، 8 و70 ملياراً، كلاهما من الصفر: البنية Jais2ForCausalLM والمعجم 150,272 رمزاً، فلا Llama تحته ولا Gemma. وورقته التقنية arXiv:2608.13580 مؤرَّخة على أركايف في 7 تموز 2026 مع أنّ معرّفها من كتلة آب، ويذكر ملخّصها ميزانية تدريب نسبية لا عدد رموز؛ ورقم 2.6 تريليون المتداول مصدره مدوّنة Cerebras.
و«علّام» من المركز الوطني للذكاء الاصطناعي في الهيئة السعودية للبيانات والذكاء الاصطناعي، وورقته arXiv:2407.15390 تحصر ما تغطّيه: ثلاثةٌ بأوزان Llama-2 (7 و13 و70 ملياراً) ورابعٌ من الصفر بسبعة مليارات؛ ونسخة الـ34 ملياراً التي ظهرت بعدها ليست فيها. و«فَنار» لمعهد قطر لبحوث الحوسبة في جامعة حمد بن خليفة (arXiv:2501.13944): فَنار ستار بسبعة مليارات مدرَّب من الصفر على قرابة تريليون رمز من العربية والإنجليزية والشيفرة، وفَنار برايم بتسعة مليارات مدرَّب تدريباً متّصلاً على أساس Gemma-2 9B على المجموعة نفسها؛ وانتقل فَنار 2 في آذار 2026 إلى gemma-3-27b-pt.
وأعلن معهد الابتكار التكنولوجي «فالكون العربي» في 21 أيار 2025 على أساس Falcon 3-7B، ثم «فالكون-H1 العربي» في 5 كانون الثاني 2026 بأحجام 3 و7 و34 ملياراً. ونشر مركز الابتكار التطبيقي المصري نموذجَي «كرنك»، 6 و40 ملياراً، موسَّعَين في العمق من نموذجَي Qwen3. وحولها اشتقاقات: AceGPT، وSILMA-9B على أساس Gemma-2، وAtlas-Chat للدارجة المغربية.
- الورقة التقنية لجيس 2 (arXiv:2608.13580)
- ورقة علّام: نماذج لغوية كبيرة للعربية والإنجليزية (arXiv:2407.15390)
- ورقة فَنار: منصّة توليدية متعدّدة الوسائط محورها العربية (arXiv:2501.13944)
- إعلان معهد الابتكار التكنولوجي عن فالكون العربي، 21 أيار 2025
- بيانات مستودع Karnak-40B-v1.0 من واجهة Hugging Face البرمجية
«أُعلِن» و«صدر» و«يمكن تنزيله» ثلاث حالات لا حالة واحدة
لا أوزان عامة لفالكون العربي ولا لفالكون-H1 العربي في حساب معهد الابتكار التكنولوجي على Hugging Face حتى الآن. فمستودعاته البالغ عددها 137 ليس فيها ما يطابق كلمة arab، والأسماء المرجَّحة تردّ الرمز 401، في حين يردّ tiiuae/Falcon3-7B-Instruct الرمز 200. والرمز 401 لا يميّز الخاصّ من المحذوف من المقيَّد يدوياً من غير المُنشأ أصلاً، فهو استجابة Hugging Face لكلّ اسم ترفض تأكيده؛ فليست هذه دعوى سحب، بل إنّ القارئ لا يجد ما ينزّله. وإعلانه في 5 كانون الثاني 2026 يحيل القارئ إلى واجهة محادثة لا إلى مستودع أوزان.
ولا يظهر فَنار ستار بين مستودعات معهد قطر العامة؛ والذي يُنزَّل ستّ نسخ من فَنار، كلّها بلا حجب وكلّها موسومة apache-2.0: أساس Fanar-1-9B ونسخته الموجَّهة Fanar-1-9B-Instruct — بـ8.78 مليار معامل، أي أقلّ من 9.24 مليار في الأساس الذي ضُبطت عليه، مع أنّ الاسمين يحملان «9B» — وFanar-2-27B-Instruct، ونموذجا فَنار 2 «ديوان» و«أوريكس». ومن نماذج علّام الأربعة التي تصفها الورقة نسخةٌ واحدة تُنزَّل: ALLaM-7B-Instruct-preview؛ أما علّام 34 ملياراً، وهو خارج الورقة، فخلف محادثة «هيوماين»، ويصفه تقييمٌ مستقلّ له بأنه خدمة محادثة مغلقة على الويب.
والانغلاق يحدّ ما يُقاس. فذلك التقييم (arXiv:2508.17378) أُجري عبر تلك الواجهة: 23 موجَّهاً، خمس جولات لكلّ منها، 115 مخرجاً حكمت عليها ثلاثة نماذج متقدّمة، وأدنى محاوره وفاءُ اللهجة، 4.21 من 5، مقابل 4.74 للفصحى المعاصرة. والنموذج وغلاف الخدمة لا ينفصلان من الخارج.
و«المفتوح» هنا ثلاثة معانٍ: متاحٌ بلا قيد ويُنزَّل مباشرة، كعلّام 7 مليارات ونسخ فَنار ونموذجَي كرنك؛ وخلف نقرة موافقة تلقائية، كجيس 2 ونسخ jais-adapted بدقّتها الكاملة؛ ومُعلَنٌ لا يُنال، كفالكون العربي وفَنار ستار وعلّام 34 ملياراً. ثم الاستعمال التجاري، محورٌ رابع يقطع الثلاثة.
| النموذج (الأحجام) | الجهة الصانعة | وسم الرخصة على البطاقة | هل تُنزَّل الأوزان |
|---|---|---|---|
| جيس 2 (8 و70 ملياراً) | إنسبشن، وجامعة محمد بن زايد، وCerebras | apache-2.0 | نعم، خلف حجب تلقائي |
| jais-family وjais-adapted (590 مليوناً إلى 70 ملياراً) | إنسبشن | apache-2.0 | متفاوت: معظمها محجوب تلقائياً، وقليل منها بلا قيد |
| علّام (7 و13 و70 ملياراً في الورقة، و34 ملياراً في الخدمة) | المركز الوطني للذكاء الاصطناعي، سدايا | apache-2.0 في الترويسة، والمتن يحيل إلى ملفّ LICENSE لا وجود له في المستودع | السبعة مليارات وحدها |
| فَنار 1 (9.24 مليار للأساس و8.78 مليار للنسخة الموجَّهة) وفَنار 2 (27 ملياراً) | معهد قطر لبحوث الحوسبة، جامعة حمد بن خليفة | apache-2.0 | نعم؛ وفَنار ستار (7 مليارات) غير منشور |
| فالكون العربي (7 مليارات)، وفالكون-H1 العربي (3 و7 و34 ملياراً) | معهد الابتكار التكنولوجي | رخصة TII Falcon، كانون الأول 2024 | لم يُعثر على مستودع عام |
| كرنك (6 و40 ملياراً) | مركز الابتكار التطبيقي، مصر | apache-2.0 | نعم |
| Aya Expanse (32 ملياراً) وCommand R7B Arabic (8.03 مليار) | مختبرات Cohere | cc-by-nc-4.0 | نعم، للاستعمال غير التجاري |
الوسم على المشتقّ ليس رخصة الأوزان التي انطلق منها
ومثال ذلك Fanar-1-9B-Instruct: تدريبٌ متّصل على أساس google/gemma-2-9b، وبطاقته تقول license: apache-2.0. وFanar-2-27B-Instruct المبنيّ على gemma-3-27b-pt يقول apache-2.0، وAceGPT-v2-8B-Chat المشتقّ من Llama-3 يقول apache-2.0، وكذلك نسخ jais-adapted. أما SILMA-9B وAtlas-Chat وNile-Chat-12B فتنطلق من أُسس Gemma نفسها وتضع الوسم license: gemma.
والوثيقتان لا تقولان الشيء ذاته. فرخصة Apache 2.0 لا تفرض قيداً على الاستعمال ولا جملةَ نسبةٍ في كلّ بيان عامّ ولا قاعدة تسمية ولا سقفاً للمستخدمين، وإنما تشترط استبقاء الإشعارات عند إعادة التوزيع. وشروط استعمال Gemma تُلزم الموزّعَ بأن يسلّم كلّ متلقٍّ لاحق نسخةً من الاتفاقية، وتحتفظ لغوغل بحقّ تقييد الاستعمال متى رأت خرقاً. ورخصة Llama 3 من ميتا تشترط إظهار عبارة Built with Meta Llama 3 في موضع بارز، وأن يبدأ اسم المشتقّ بـLlama 3، وأن تُطلب رخصة منفصلة من ميتا إذا كان عدد المستخدمين النشطين شهرياً قد تجاوز 700 مليون في تاريخ إصدار النسخة.
وجواز الاستبدال في حالة بعينها مما لا يفصل فيه هذا المقال، فالاتفاقات الخاصة موجودة ولا تُنشر؛ والمتحقَّق منه أنّ الوثيقتين مختلفتان، وأنّ الوسم لا سلطان له على أوزان لم يصنعها، وأنّ فرقاً أخرى على الأساس نفسه اختارت الوسم الآخر.
ويشيع وصف فالكون بأنه Apache 2.0 وليس كذلك. فFalcon 3 وFalcon-H1 يحيلان إلى رخصة TII Falcon الصادرة في كانون الأول 2024: بلا إتاوة، وتبيح إعادة التوزيع، غير أنها تشترط جملة ثابتة في كلّ بيان عامّ عن المشتقّ، مؤدّاها أنه مبنيٌّ باستعمال تقنية ذكاء اصطناعي من معهد الابتكار التكنولوجي. وكرنك هو الحالة النظيفة: أساساه من Qwen3 هما فعلاً Apache 2.0. لكنّ الاسم ليس نظيفاً كلّه: نسخ GGUF مكمَّمة تعلن Applied-Innovation-Center/Karnak-70B-LLAMA-v1.0 أساساً لها وتحمل الوسم license: llama3، وذلك المستودع ليس بين نماذج الجهة الثلاثة المعروضة علناً.
التخصّص في العربية لا يعني التقدّم
جدول معهد قطر عن Fanar-2-27B-Instruct يسجّل 69.40 على OALL v2 مقابل 70.95 لـgoogle/gemma-3-27b-it. وليست تلك النسخةَ التي انطلق منها: الترويسة تسمّي google/gemma-3-27b-pt، ويقول المتن إنّ الفريق درّبه تدريباً متّصلاً على قرابة 166 مليار رمز. والنسخة -it شقيقةٌ مضبوطة على التعليمات لنموذج مضبوط على التعليمات، فهي المقارنة النِّدّية لا المقارنة المخفَّفة، وفي الجدول صفّان آخران لـAceGPT-v2-32B-Chat وQwen3-32B. وفي الجدول ذاته يتقدّم فَنار على ArabicMMLU، 74.67 مقابل 72.21، وعلى Almieyar، 79.46 مقابل 70.48، ويتأخّر على GSM8K، 93.70 مقابل 95.80: تشغيلاتُ مختبرٍ واحد، تشير إلى جهات شتّى في آن.
وبطاقة جيس 2 من إنسبشن تُظهر المقايضة في الاتجاه المعاكس. وجيس 2 مدرَّب من الصفر، فلا نموذج أساس هنا، وLlama-3.3-70B-Instruct نظيرٌ لا سلف: فعلى IFEval يسجّل Jais-2-70B دقّةً على مستوى التعليمة بالعربية مقدارها 74.53 مقابل 63.13 لـLlama-3.3-70B-Instruct، وعلى الشقّ الإنجليزي من الاختبار نفسه 78.93 مقابل 92.10. وكلّ رقم هنا نشره صانعه، ولم يُعَد تشغيل شيء منه.
وأنفع نتيجة مفردة على بطاقة فَنار 1، لأنها تثبّت المهمّة وتغيّر المستوى اللغوي وحده. فعلى AraDiCE PIQA يسجّل Fanar-1-9B-Instruct 67.68 بالفصحى المعاصرة، و63.66 بالمصرية، و59.03 بالشامية. وALLaM-7B-Instruct-preview: 67.52 ثم 63.44 ثم 60.88. وAceGPT-v2-8B-Chat: 64.58 ثم 61.32 ثم 56.91. وLlama-3.1-8B-Instruct، وهو غير متخصّص في العربية أصلاً: 58.11 ثم 55.39 ثم 54.24.
المقاييس مختلفة فيما بينها في أيّ عربيةٍ تقيس
ArabicMMLU (arXiv:2402.12840، جامعة محمد بن زايد، Findings of ACL 2024) 14,575 سؤال اختيار من متعدّد على أربعين مهمّة، مصدرها امتحانات مدرسية من ثماني دول، لا بحصص متقاربة: ففي حقل البلد داخل المجموعة، يعطي شقُّ الاختبار (14,455 مفردة) الأردنَ 5,990 سؤالاً، ومصرَ 2,487، وفلسطينَ 2,032، مقابل 101 للسعودية، ونحو 3,000 مفردة بلا وسم بلد أصلاً. وكلّها بالفصحى المعاصرة، فهذا تنوّع مناهج لا تنوّع لهجات.
وAraDiCE (arXiv:2409.11404، معهد قطر، COLING 2025) يصف طريقته صراحةً: ترجمة آلية يعقبها تحرير بشريّ، قرابة 45,000 عيّنة محرَّرة تغطّي الخليج ومصر والشام. وDialectalArabicMMLU (arXiv:2510.27543) يحوّل 3,000 مفردة من MMLU-Redux إلى خمس لهجات قُطرية. وأسقطت OALL v2 من نسختها الأولى المهامَّ المشبعة والمترجمة آلياً، بحجّة انخفاض جودتها وما قد تحمله من تحيّز ثقافي؛ وبقيت الترجمة في مواضع تغطية اللهجة.
والمجموعة التي يختارها الصانع تقرّر معنى رقمه. فمجلّد التقييمات في مستودع علّام يسمّي مهامّه العربية: acva وaraMath_v3 وaraPro وarabicmmlu وetec_v2 وgat وmoe_ien_mcq وmoe_ien_tf وسواها. وETEC هيئة تقويم التعليم والتدريب السعودية، وGAT اختبار القدرات العامة، وmoe_ien منصّة «عين» التابعة لوزارة التعليم السعودية. وأقوى رقم يعلنه علّام، 91.77 على IEN-MCQ، درجةٌ على بنك أسئلة وطنيّ سعودي.
ويعدّ مسحُ معهد الابتكار التكنولوجي للميدان (arXiv:2510.13430) ضعفَ تغطية اللهجات قليلة الموارد، السودانية والموريتانية، من الثغرات الحرجة فيما يزيد على 40 مقياساً أحصاها. ثم إنّ تقسيم الخليج والشام ومصر متنازَعٌ عليه بدوره: فقد وسّع كيليغ وغولدووتر ومجدي (Keleg, Goldwater, Magdy؛ arXiv:2505.21816، ACL 2025) مجموعةً متعدّدة الوسوم يحكم فيها ناطقون بإحدى عشرة لهجة قُطرية على كلّ جملة، كلٌّ في لهجته هو، وخلصوا إلى أنّ أربعة افتراضات شائعة، أوّلها أنّ اللهجات تُجمَع في أقاليم يمكن تمييزها، تُبسِّط الواقع تبسيطاً مخلّاً، وأنّ بعضها ليس دقيقاً على الدوام.
الأدوات صغيرة، ومعطوبة في مواضع، ويصنعها أصحاب مصلحة
نشر معهد الابتكار التكنولوجي QIMMA في نيسان 2026 (arXiv:2604.03395): لوحةُ صدارة وتدقيقُ مقاييس معاً، تجمع 109 مجموعات فرعية وأكثر من 52,000 عيّنة، وتفحص كلّ عيّنة بسُلَّم من عشر نقاط قبل أن يُقاس عليها نموذج. ونسب الاستبعاد تمتدّ من 0.01٪ على GAT إلى 3.08٪ على ArabicMMLU، وتتفاوت داخله بحسب المادة حتى تبلغ 83.8٪ في المحاسبة الجامعية.
ونتيجتان تتجاوزان الجرد. ففي النسخ العربية من مقياسَي البرمجة احتاج 88٪ من مسائل HumanEval+ و81٪ من مسائل MBPP+ إلى تعديل، ويردّ الباحثون ذلك إلى حال الترجمات العربية الأصلية لا إلى صعوبة المهمّة. وفي المقاييس الثقافية يبلّغون عن مفردات تضع تعميمات جوهرانية عن جماعات بعينها في موضع الإجابة الصحيحة موضوعياً، وأظهرُ ما يكون ذلك في ArabCulture.
وQIMMA عملُ معهد الابتكار التكنولوجي، والمعهد يصنع فالكون، وإن لم يظهر أيّ نموذج فالكون في جداولها. والحالة الأوضح AraGen، وعلى بروتوكولها 3C3H تعلن عدّة نماذج نتائجها: تديرها إنسبشن وجامعة محمد بن زايد وHugging Face، واثنتان من الثلاث تصنعان جيس. ودورتها AraGen-12-24 كانت 279 سؤالاً حكم عليها Claude 3.5 Sonnet وحده، و3C3H متوسّطُ ستّة أحكام موزونة. وليس في هذا سوء سلوك؛ إنما هو ميدان صغير صار فيه المدقِّق والمدقَّق عليه مؤسسةً واحدة.
ولوحات الصدارة متأخّرة كذلك. فمجموعة نتائج OALL v2 آخر تعديل عليها في 3 آذار 2026، وكان طابور طلباتها لا يزال يستقبل الطلبات في 6 حزيران، فاستشهادٌ بـ«اللوحة» في منتصف 2026 قد يكون استشهاداً بلقطة من آذار. وأرقام فالكون على OALL تشغيلاتُ المعهد نفسه منشورةً باسمه على Hugging Face؛ وبين 919 مجموعة في حساب OALL لا أثر لنتيجةٍ من طرف ثالث تخصّ فالكون العربي.
الخلاصة
أربعة أمور تحسم الاختيار هنا، وليس فيها الدرجة المعلنة على رأس البطاقة: هل تُنزَّل الأوزان فعلاً أم هي إعلان، وماذا تقول رخصة الأساس لا وسم المشتقّ، وهل قاس المقياسُ الفصحى المعاصرة أم اللهجة التي يكتب بها مستخدموك، وكم مفردةً كان يحوي حين قاس.
مقالات قريبة