في زمنٍ كثرت فيه نماذج الذكاء الاصطناعي وتعددت إصداراتها، يقف المرء حائراً أمام هذه الخيارات المتلاطمة: ماذا يختار؟ وأي النماذج يخدم حاجته دون أن يرهق جيبه أو يقيّد حريته؟
بدأت بفكرة مبنية على عدة عوامل، أولاً اشتراك شهري لا يتجاوز 20 أو 30 دولاراً، يتجدد استخدامه بشكل يومي أو عبر نوافذ زمنية متجددة (مثل نافذة 5 ساعات)، لا بنظام النقاط الذي ينتهي في غمضة عين. وأردت أن يدعم النموذج تطبيق سطح مكتب لكتابة الكود وإنجاز المهام. وكان قراري منذ البداية أن أتجه شرقاً — إلى النماذج الصينية — لا غرباً، هذا مع مقارنتي لكلا النماذج.
الشروط الخمسة التي وضعتها
إذا كنتُ سأعتمد نموذجاً واحداً أجعله رفيقي اليومي في العمل والبرمجة، فقد وضعتُ لنفسي قائمة شروطٍ واضحة لا تنازل عنها:
- برنامج مكتبي لنظام ويندوز (Desktop App): ينبغي أن يمتلك النموذج أو واجهته تطبيقاً مخصصاً لنظام ويندوز؛ ليضمن لي التكامل السلس مع بيئة العمل والبرمجيات دون الاعتماد الكامل على متصفحات الويب.
- استخدام يومي سخي بعيداً عن تقييد النقاط: لا أريد حصر نفسي في نظام “النقاط” (Credits) التي تنتهي في غمضة عين؛ بل أريد “نافذة استخدام يومية” متجددة تمنحني حريتي، أو في المقابل، رصيد توكنز ضخم جداً يُعادل استهلاكاً يومياً مفتوحاً.
- تكلفة واحدة موحدة للـ API والتطبيقات: إمكانية استخدام الـ API بنفس السعر التنافسي، سواء استخدمتُ النموذج من موقعه الرسمي، أو من تطبيقه المكتبي، أو ربطته مع محرر الأكواد (IDE)، دون أي تكاليف خفية أو مضاعفة (وهذا يسد عن الشرط رقم 1).
- إمكانية التصدير والربط ببيئة العمل: يدعم الربط بسهولة مع أدوات العمل لإنشاء قواعد معرفة محلية (Knowledge Base) على جهازي، مع إمكانية تصدير المحادثات والبيانات لنقلها لأي نموذج آخر متى أردت.
- ليس شرطاً أن يكون أمريكياً: بل أفضّل أن يكون صينياً قوي الأداء، ممتازاً في التعامل مع اللغة العربية، وضليعاً في تحليل الأكواد والبرمجة مع دعم المبادئ المفتوحة المصدر، حتى من الممكن تشغيل النموذج كله محليا.
الجولة الأولى: مسح شامل للخدمات الصينية
بدأتُ رحلتي بمسح شامل للخدمات الصينية، فقمتُ بفحص:
- MiniMax — بنظام النوافذ المتجددة (5 ساعات + أسبوعي)
- Qwen (Alibaba) — بنظام Credits مع نوافذ 7 أيام
- Kimi (Moonshot) — بنظام بركة Credits مع حد 5 ساعات للكود
- DeepSeek — مجاني تماماً مع تطبيق سطح مكتب
- Xiaomi MiMo — بنظام Token Plan بدون حدود زمنية
- Zhipu GLM — بنظام 5 ساعات + نوافذ أسبوعية
- BytePlus ModelArk (ByteDance) — يدعم نماذج متعددة
- Baidu Qianfan — الأرخص سعراً
- SenseTime — مجاني خلال النسخة التجريبية
كانت المفاجأة أن MiMo تقدم نظاماً فريداً: “Unlimited Usage — No weekly cap · No 5-hour cap” أي لا يوجد حد أسبوعي ولا حد 5 ساعات. وهذا يتوافق تماماً مع شرطي الثاني. لكن تطبيق سطح المكتب كان لا يزال في مرحلة الاختبار التجريبي.
في المقابل، MiniMax بنظام M Plan الجديد (باقة Go بـ 22 دولاراً) وGLM Pro مع ZCode (~21 دولاراً) قدما توازناً جيداً بين السعر والنوافذ المتجددة وتطبيق سطح المكتب.
الجولة الأولى ونصف: لماذا لم أتجه غرباً؟
قد يتساءل القارئ: لماذا كل هذا الجهد في البحث شرقاً، بينما العمالقة الأمريكيون — Claude وChatGPT وGemini — يقدمون خدمات ناضجة ومعروفة؟
الحقيقة أنني لم أستبعدهم من البداية، بل قارنتُ فعلاً. والنتيجة كانت مفاجئة بدرجة ما: النسخ الصينية الحديثة أصبحت جيدة جداً، ومزاياها مقاربة للنسخ الأمريكية في كثير من المهام، مع فارق كبير في السعر ومرونة الاستخدام.
Claude وChatGPT: بلا شك هما معياران ذهبيان في جودة الاستدلال والكتابة والبرمجة. لكن مشكلتهما كانت في نظام النوافذ والقيود: Claude يقدم نافذة 5 ساعات لكن بدون رقم واضح للرسائل (يعتمد على الاستهلاك الفعلي)، وChatGPT Plus يعطي 160 رسالة كل 3 ساعات مع تحويل تلقائي لنموذج مصغر عند التجاوز. وهذا يعني أنك قد تدفع 20 دولاراً وتجد نفسك مقيداً في منتصف مهمة. أما النسخ الصينية — مثل MiniMax وQwen وGLM — فقد قدمت نوافذ مماثلة أو أفضل، بأسعار أقل، وتطبيقات سطح مكتب مخصصة للبرمجة.
Gemini: هنا المفاجأة الحقيقية. Gemini يعطي نقاطاً كثيرة جداً مقارنة بالخدمات الأخرى، وهو نموذج جيد بلا شك. لكن حتى في إصداره الأخير (3.8)، وجدتُ أنه أضعف قليلاً من بعض النماذج الصينية المتقدمة في مهام معينة — خاصة في البرمجة المعقدة والاستدلال العربي. ليس فارقاً كبيراً، لكنه كافٍ لجعلك تفكر مرتين عندما تكون الأولوية للكود واللغة العربية.
DeepSeek: هذا حالة خاصة ومثيرة للاهتمام. DeepSeek يمتلك برنامج سطح مكتب (Harness)، ونقاطه رخيصة جداً، بل إنه يقدم رصيداً مجانياً عند التسجيل. صحيح أنه أضعف قليلاً من MiniMax وQwen في بعض المهام — خاصة RAG العربي كما رأينا سابقاً — لكنه يبقى خياراً مناسباً جداً لسببين: أولاً، أنت تشحن النقاط وتنساها؛ فهي لا تنتهي شهرياً ولا تفرض عليك اشتراكاً متكرراً. ثانياً، كونه مجانياً في الاستخدام العادي، يمكن أن يكون طبقة احتياطية ممتازة أو أداة يومية خفيفة دون أي قلق من الفواتير.
الخلاصة من هذه الجولة: العمالقة الأمريكيون ما زالوا في القمة من حيث الجودة الخام، لكن الفجوة تتقلص بسرعة. وإذا كانت أولويتك — مثلي — هي الاستخدام اليومي السخي، بدون قيود نقاط، مع دعم ممتاز للعربية والبرمجة، وتطبيق سطح مكتب، فإن النماذج الصينية لم تعد “بديلاً رخيصاً”، بل أصبحت خياراً أولاً بجدارة.
الجولة الثانية: مقارنة MiniMax وKimi في الأداء والبرمجة
بعد المسح الأولي، ضيّقتُ الخيارات وبدأتُ مقارنة معمّقة بين MiniMax وKimi من حيث:
نتائج الاختبارات المعيارية:
- في اختبار SWE-bench Pro للبرمجة: MiniMax M3 سجل 59.0% مقابل Kimi K2.6 بنسبة 58.6% — فارق ضئيل جداً (0.4 نقطة).
- في LiveCodeBench للمهام الخوارزمية: Kimi تفوق بنسبة 89.6% مقابل ~88% لـ MiniMax.
- في اختبارات الوكلاء المستقلين: Kimi يمتلك Agent Swarm (300 وكيل فرعي)، بينما MiniMax يتصدر في YC-Bench للقرارات الاستثمارية.
إدارة الشركات:
- MiniMax يتفوق في القرارات المالية والاستثمارية (المركز الأول في YC-Bench بـ 2.1 مليون دولار) وفي مهام المكتب (تحسن 59.3%).
- Kimi يتفوق في المحاكاة التشغيلية (Vending-Bench) لكنه فشل في CoffeeBench بأرباح صفرية — مما كشف ضعفاً في الانضباط التجاري والتفاوض.
التكلفة:
- MiniMax أرخص بـ 2.7× من Kimi وأسرع بـ 311% في التوليد.
الخلاصة: MiniMax هو المنفذ العملي — أرخص، أسرع، أفضل في القرارات المالية والمهام المكتبية. Kimi هو عبقري الاستدلال لكنه أغلى وأقل انضباطاً تجارياً.
الجولة الثالثة: اختبار اللغة العربية — معركة حاسمة
بما أن اللغة العربية أولوية قصوى، خضتُ مقارنة معمّقة بين MiniMax وDeepSeek وKimi في الأداء العربي.
MiniMax (عبر HUMAIN M3):
- اختارته السعودية (HUMAIN/PIF) كأساس لنموذجها العربي الوطني.
- دُرِّب على أكثر من تريليون توكن عربي.
- حقق 89.37% متوسط في 7 اختبارات عربية — أعلى من GPT-5.6 وOpus 5.
- في اختبار AraTrust للموثوقية: 97.53%.
- في ArabicMMLU: 90.70%.
DeepSeek:
- ممتاز في الترجمة الأدبية (تفوق على ChatGPT 4.5 في ترجمة الروايات).
- لكنه ضعيف جداً في RAG العربي — سجل 0.09 فقط في الدرجات الدلالية العربية.
- مشكلة موثقة: أحياناً يتحول للردود بالصينية عند السؤال بالعربية.
Kimi:
- الأعلى في اللهجة النجدية السعودية.
- لكنه يعاني من هلوسة موثقة بالعربية.
الخلاصة: MiniMax هو الخيار الأفضل للعربية بفارق واضح، مدعوم بأدلة موضوعية قوية.
الجولة الرابعة: RAG العربي — MiniMax أم Qwen 3.8؟
ثم جاء السؤال الأصعب: ماذا عن RAG (الاسترجاع المعزز بالتوليد) باللغة العربية؟ وهنا قارنتُ بين MiniMax وQwen 3.8 (الجيل الأحدث، وليس Qwen3-8B القديم).
ما وجدته:
- HUMAIN M3 (المبني على MiniMax) حقق 94.63% في اختبار ALRAGE لـ RAG العربي — متفوقاً على GPT-5.6 SOL (94.91%) وOpus 5 (94.85%) بفارق طفيف.
- Qwen 3.8 لم يُدرج بعد في اختبارات ALRAGE أو ArabicMMLU. لكن Qwen3.8-27B سجل 90% في استعلامات خليجية (مهمة routing).
- Qwen 3.8-Max أغلى بـ 7 مرات من MiniMax M3 ($2.00/$6.00 مقابل $0.28/$1.10 لكل مليون رمز).
الخلاصة: MiniMax هو الخيار الوحيد المُثبت بأرقام في RAG العربي. Qwen 3.8 مرشح قوي لكنه يفتقر إلى تقييم عربي شامل ومستقل حتى الآن.
الجولة الخامسة: السؤال الغريب — هل يمكن بناء RAG محلي؟
ثم طرحت سؤالاً جوهرياً: هل يمكنني بناء قاعدة معرفة محلية على جهازي، وأربطها بأي نموذج ذكاء اصطناعي، وأتنقل بين الشركات (صينية وأمريكية) بحرية؟
الإجابة: نعم، وهذا ممكن تماماً.
الطريقة:
- استخدم API بدلاً من الاشتراكات المغلقة.
- كل من MiMo وMiniMax يوفران نقاط API متوافقة مع OpenAI.
- يمكن استخدامها في أدوات مثل Roo Code (كمثال) أو أي أداة أخرى.
- لكن انتبه: استخدام API يستهلك من نفس الحصة المشتركة للاشتراك، لكنه يستهلك Tokens أكثر بكثير لأن الأدوات الوكيلية (Agentic) ترسل سياقاً ضخماً مع كل طلب.
الخلاصة: الحصة مشتركة، لكن استهلاكك عبر API سيستنزفها أسرع. والأهم: تأكد من استخدام Subscription Key وليس Pay-as-you-go Key.
الجولة السادسة: البحث عن البرنامج المثالي لـ RAG المحلي
بعد التأكد من إمكانية بناء RAG محلي، بدأت البحث عن تطبيق سطح مكتب لنظام ويندوز يسمح بحفظ المحادثات وبناء RAG قابل للنقل بين الأجهزة والنماذج.
جربتُ وفحصتُ:
| التطبيق | الميزة | العيب |
|---|---|---|
| Cherry Studio | قاعدة بيانات محلية (libSQL)، نقل بسيط بنسخ المجلد | — |
| AnythingLLM | قوي ومستقر، يدعم API و MCP | النقل يحتاج ضغط مجلد documents يدوياً |
| GPT4All | سهولة مطلقة، خصوصية كاملة | ليس مصمماً لكتابة الكود |
| KnowNote | بديل محلي لـ NotebookLM | لا يذكر كتابة الكود إطلاقاً |
| Synorive | بحث دلالي في كل شيء (صور، فيديو، كود) | أداة بحث وليست بيئة تطوير |
السؤال الحاسم: من منهم يصلح لكتابة الكود أيضاً؟
الإجابة:
- Cherry Studio — الأنسب. يدير أدوات البرمجة بنفسه (Claude Code، Codex، Gemini CLI، OpenCode، Qwen Code، Kimi Code، Qoder CLI، GitHub Copilot CLI). يولد الكود، يفهم المشروع، ويكتب الاختبارات.
- AnythingLLM — قوي كطبقة معرفة. يدعم فهرسة Git repos، ويتكامل مع أدوات البرمجة عبر API و MCP.
- Synorive — ممتاز كطبقة بحث دلالي. يوفر 24 أداة MCP لـ Claude Code.
- GPT4All و KnowNote — غير مصممين لكتابة الكود.
الحسم: لماذا Cherry Studio؟
بعد هذه الرحلة الطويلة، كان الوصول إلى Cherry Studio هو الحل الحاسم. فهو لم يحل مشكلة الواجهة فحسب، بل مثّل المفتاح الذهبي الذي يربط كل خياراتي ببعضها بسلاسة تامة.
ما يقدمه Cherry Studio:
- قاعدة معرفة محلية مبنية على قاعدة بيانات libSQL — كل شيء (المحادثات، المستندات، المتجهات) في ملف واحد قابل للنقل.
- الموقع:
%APPDATA%\CherryStudioعلى ويندوز. لنقل قاعدة معرفتك، انسخ هذا المجلد إلى نفس المسار على جهاز آخر. - إدارة أدوات البرمجة مباشرة من داخل التطبيق.
- تكامل مع أي نموذج — محلي (Ollama، LM Studio) أو سحابي (MiniMax، Qwen، DeepSeek API).
- مرونة كاملة: قاعدة المعرفة محلية وثابتة، والنماذج مجرد “عقول” قابلة للتبديل.
الخلاصة النهائية: التزاوج الذهبي
بعد رحلة بحث وتجربة مطولة، وجدتُ أن الخيار الأمثل يكمن في الاعتماد على عمالقة الذكاء الاصطناعي الصيني — وفي مقدمتهم MiniMax وQwen وDeepSeek — مدارةً عبر واجهة Cherry Studio.
الأسباب:
- سياق ضخم جداً (1M Context Window): استيعاب هائل للأكواد والمستندات الطويلة دفعة واحدة.
- مرونة الاستخدام والتكلفة عبر API: أدفع فقط مقابل الاستهلاك الفعلي للتوكنز دون اشتراكات شهرية باهظة أو نفاد تعسفي للنقاط.
- دعم لغوي وبرمجي: النماذج الصينية الحديثة أثبتت كفاءة عالية في تفكيك الكود وفهم المنطق والتعامل مع العربية بدقة.
- الاستقلالية وحرية البيانات: بناء قاعدة معرفة محلية، تصدير المحادثات، والتحرر من قيود المنصات المغلقة.
Cherry Studio (الواجهة) + MiniMax M3 (المحرك الأساسي للعربية والبرمجة) + DeepSeek (احتياطي للترجمة) + Qwen 3.8 (للمهام الخليجية والـ routing) = منظومة ذكاء اصطناعي محلية، مرنة، وقابلة للنقل، دون قيود النقاط أو الاشتراكات الباهظة.
الوصفة النهائية:
وهكذا، بعد رحلة طويلة من البحث والتجربة، وجدتُ أخيراً ما كنت أبحث عنه: ذكاء اصطناعي يحترم جيبي، يحترم لغتي، ويحترم حريتي في اختيار النموذج الذي أريد — متى أردت.
اترك تعليقاً