هل Awal LM نموذج لغوي بميزات الذكاء الإصطناعي فعلا أم مجرد دعاية؟


| تحديث:

Rachid Nichan Awal LM ذكاء اصطناعي

 بعد نهاية كأس العالم 2026 قررت أن استريح قليلا من الفيسبوك لأركز على جوانب أخرى في حياتي، ولكن قبل أيام عدت لأطلع على ما يدور في الفضاء الأزرق ولو لبضع دقائق، فثار انتباهي  منشور لشاب يدعى رشيد نيشان Rachid Nichan يقول فيه  " اليوم، وبعد خدمة وسهر وبحث تقني عميق، كنعلن رسمياً على إطلاق النسخة الثانية من: 🌟 Awal-LM V2.0 (ⴰⵡⴰⵍ) ⵣ أول محرك ذكاء اصطناعي أمازيغي مستقل ومفتوح المصدر" نشره يوم 2 أكتوبر 2026:

Rachid Nichan Awal LM

صراحة سررت لذلك الخبر وقلت مع نفسي "جميل .. رائع" لكن دون أن أتصفح التطبيق أو كوده المصدري، وبعد دقائق غادرت الفيسبوك الى يوتوب.. وبعد ان عدت بعد ايام قليلة للفيسبوك وجدت ان الشاب شارك خبرا نشره عنه موقع "العمق المغربي" بعنوان "شاب مغربي يبني نموذجا لـ إي أي بالأمازيغية من الصفر.. ويدربه على تيفيناغ بحاسوب محمول" ثم خبر آخر من موقع القناة القناة الثانية حول هذا الإنجاز ودفعني الفضول لأقرأ أكثر عن الموضوع خاصة أنني على علم بالتحديات والصعوبة والمشقة التي يتطلبها بناء نموذج ذكاء اصطناعي خاصة "من الصفر" كما يزعم سي رشيد نيشان.

وحسب "العمق المغربي" فرشيد نشأ في الدار البيضاء ولا يجيد الأمازيغية نطقا ولا كتابة وهذا المعطى مهم كما سنرى.

Awal LM

لماذا Awal LM ليس نموذج ذكاء اصطناعي ولا نموذج لغوي Language Model (LM) ؟

كل ما يقوم به الكود الذي نشره السيد رشيد نيشان هو أخذ كلمات السؤال أو الأمر وعزل الكلمات وترقيمها وحساب احتمالات واختيار الاحتمال الأقرب لجواب معد مسبقا! معنى ذلك أن "النموذج" أو الكود بالأحرى لا يستطيع توليد جمل جديدة، ولا فهم سياق المحادثة، وإذا كانت المعطيات التي "يدرب" عليها تتكون من 900 جملة فهذا يعني ان الكود يجيب فقط بجملة من تلك ال 900 جملة، في حين أن نموذج الذكاء الإصطناعي اللغوي الحقيقي يستطيع تركيب وتوليد جمل جديدة وفهم السياق، وتختلف الجمل التي يجيب بها عند طرح نفس السؤال عدة مرات، في حين أن الكود الذي نشره السيد رشيد ينتح نفس الجواب دائما والذي هو معد مسبقا. فلماذا سماه نموذج لغوي Language Model ؟ ووصفه بصفات الذكاء الإصطناعي إذا لم يستطع هذا الكود انتاج جمل جديدة وفهم سياق المحادثة؟ فكل العبارات التي يجيب بها يتم حملها من ملف واحد. فهو أشبه ببرنامج يجيب عن الأسئلة الشائعة FAQ بأجوبة معدة مسبقا بنفس الكلمات ونفس الترتيب ونفس الجمل.

صور تظهر أن الذي يسميه سي رشيد "نموذج لغوي" و "ذكاء إصطناعي" لا يفهم المحادثة ولا السياق ويجيب بجمل وعبارات ثابتة خارج الموضوع:

Awal LM Rachid Nichan
 وفي هذه المحادثة طرحت نفس السؤال وأعاد نفس الإجابة بنفس الكلمات ونفس الترتيب علما ان الإجابة لا علاقة لها بالموضوع مما يثبت ان هذا الكود ليس نموذج لغوي LM ولا ذكاء اصطناعي (ولا هم يحزنون). ويمكنك اختبار اجابة نموذج ذكاء اصكناعي حقيقي ك Google Gemini وسترى انه يجيب اجابات مختلفة رغم ظعف فهمها للأمازيغية مقارنة بفهمها للغات الأخرى:
awal lm

وبعد نشر الخبر في القناة الثانية 2M والعمق المغرب سارع رشيد نيشان الى نشر مقالة قصيرة على ويكيبيديا حول نموذجه والذي حعل الكثير من المستعملين الغير متخصصين يعتقدون انه نموذج ذكاء اصطناعي حقيقي على  غرار النماذج اللغوية المعروفة ك ChatGpt و Google Gemini... لكن سرعان ما قام أحد المشرفين في ويكيبيديا بحذف المقالة بعد ساعات من نشرها بسبب ما قال انه "دعاية صريحة" وبالفعل فإن سي رشيد وضع رابط ربحي في صفحة المشروع على huggingface واستعمل كلمات مبالغ فيها لوصف عمل الكود الذي نشره.

Awal LM Wikipedia

هل هو تظليل متعمد من طرف السيد رشيد نيشان؟

لا أعلم إن كان هناك تعمد ام لا، لكن من المؤكد أن هناك تظليل سواء من حيت الإسم Awal LM وعبارات "نموذج ذكاء إصطناعي" و "مفتوح المصدر"، فإن كان رشيد مبرمجا حقيقيا وليس مجرد هاوي يعتمد على الذكاء الاصطناعي ليحرر له كود كل شيء ضمن ما يسمى Vibe coding فإنه لن يخفى عنه ان النموذج اللغوي الحقيقي لابد أن يكون قادرا على فهم السياق وتوليد جمل جديدة ويتطلب عشرات الآف من السطور وبيانات ضخمة. كما ان المشروع ليس مفتوح المصدر كاملا لأن السيد رشيد نيشان تعمد بيع العينة التي يجري عليها الكود رغم قلتها (حوالي 900 مدخل) مقابل 10 دولارات (حوالي 100 درهم مغربية) لكل شخص يرغب في مراجعة تلك العينة أو تجريبها



كما ان هناك خصائص في الكود المصدري الذي نشره في huggingface تشير الى احتمال ان يكون محرر بال AI مثل استعمال الإيموجي في التعليقات وترقيم المراحل بتعليقات مبهرة ولا يميل المبرمجين عادة الى استعمال التعليقات بهذه الطريقة كما ان الكود مختصر بشدة مما يحيل إلى تأليف جزء كبير منه بواسط نماذج الذكاء الإصطناعي.

هل هو استرزاق واستغلال للأمازيغية ولرغبة الأمازيغ في الدفع بلغتهم إلى الأمام؟

ألقيت نظرة على حساب السيد رشيد نشيان في الفيسبوك ووجدته يشارك تطبيقات أخرى طورها وروابط إلى موقعه الربحي rachidnichan.com الذي بناه على منصة GUMROAD، لكن هناك تطبيق مجاني رغم انه يعرض الإعلانات بشكل مبالغ فيه نشره على بلاي ستور اسمه Izem حول تعلم الأمازيغية وهي مبادرة جيدة أفضل مما سماه "نموذج الذكاء الإصطناعي" الذي تحدثنا عنه سلفا، إلا انه يؤخذ عنه عدم التنسيق وطلب المساعدة من الباحثين والمتخصصين في اللغة الأمازيغية، لأنه يخطئ في نطق عدد من الكلمات مثلا كما يظهر أنه لا يجيد القراءة بتفيناغ ويقرأ الامازيغية بالحروف الفرنسية ويقرأ مثلا ⵜⴰⵖⴰⴹⵜ "تكاتت" “tagatet”و ⵓⵛⵛⵏ يقرأها أوتشين…لذلك أنصح السيد رشيد نيشان بأن يستعمل مصطلحات أدق في وصف الأعمال والتطبيقات التي ينشرها ويتجنب الدعاية لنفسه ويترك أعماله تتحدث عنه، وإذا كان من حقه تحقيق الربح عبر تطبيقاته فإنني أدعوه للتواصل مع الناطقين بالأمازيغية خاصة أساتذتها من أجل المصطلحات والنطق وتركيب الجمل باللغة الأمازيغية المعيارية وان لا يكون دافعه ربحي فقط.


فالمشكلة ليست أبدا في الربح المادي من المشاريع المتعلقة بالأمازيغية، لأن الذين يشتغلون على مشروع معين يأخذ منهم الكثير من الجهد والوقت والموراد الأخرى، وليس عيبا أن يعرضوا منتجاتهم ويشهروها على المنصات، بل إنه من وجهة نظر شخصية أرى أن الأهداف الربحية المالية قد تخدم أهداف أخرى تربوية وثقافية واجتماعية، كالنهوض بالأمازيغية على المستوى الرقمي. لكن المشكلة تقع عندما يسعى الآخرون لبيع منتجات مغشوشة أو رديئة على أساس انها ذات جودة عالية ووصفها بصفات وميزات لا تتوفر فيها، خاصة عندما يتعلق الأمر باللغة الأمازيغية التي هي بحاجة الى الدارسة الجدية وفهم قواعدها والقدرة على القراءة والنطق بها أو على الأقل الاستعانة بالمختصين والأشخاص الملمون بهذه اللغة لتطوير تطبيقات خاصة بها كالمعاجم وتطبيقات التعلم. إذ لا ينبغي التركيز على الربح على حساب جودة المحتوى، كأن تملئ الشاشة بالإشهارات مقابل محتوى فقير ومحدود ومليء بالأخطاء.