GLM من Z.ai: نماذج مفتوحة الأوزان بسعر يُنافس — وقياس تأخير حي من السعودية
الذي يوقف المطوّر العربي الفردي ليس نقص الأفكار، بل فاتورة الواجهة البرمجية. نموذج من الطبقة الأولى قد يلتهم ميزانية شهر في أسبوع من التجريب. وهنا يدخل GLM من شركة Z.ai الصينية: عائلة نماذج مفتوحة الأوزان بسعر مليون توكن أقل بمراتب، وخطة ترميز ثابتة تشتغل داخل أدوات تعرفها. لكن الرخص وحده لا يكفي — وفي آخر المقال رقم قِسناه بأنفسنا من السعودية يضيف بُعداً لا تجده في صفحات التسعير.
⚡ الخلاصة بسرعة
- السعر: النموذج الأعلى GLM-5.3 بـ$1.4 للمليون إدخال و$4.4 إخراج — أرخص من Claude Opus 5 بنحو ثلاث مرات ونصف إدخالاً وخمس مرات ونصف إخراجاً.
- مفتوح الأوزان فعلاً: أوزان GLM-5.3 منشورة على Hugging Face — لكن برخصة خاصة لا MIT. اقرأ الرخصة قبل أي استخدام تجاري.
- خطة الترميز: تبدأ من $18 شهرياً وتعمل داخل Claude Code وCline وOpenCode.
- الثمن الخفي: قياسنا الحي من السعودية أعطى 702ms لـapi.z.ai مقابل 311ms لأنثروبيك و194ms لأوبن إيه آي. الرخص يشتريه تأخير.
ما هو GLM بالضبط؟
GLM عائلة نماذج لغوية تطوّرها Z.ai — الشركة المعروفة سابقاً باسم Zhipu AI. وما يميّزها عن معظم منافسيها في الطبقة العليا أنها تنشر أوزان نماذجها للعموم، فتستطيع مبدئياً تشغيل النموذج على عتادك أنت بدل أن تكون رهينة واجهة برمجية واحدة.
النموذج الأحدث وقت كتابة هذا المقال هو GLM-5.3، وهو نموذج خبراء مُوزَّعين بإجمالي 753B معامل، بنافذة سياق تصل إلى 1M توكن وحد إخراج 128K توكن حسب وثائق Z.ai. وهو يعمل بالتفكير المُفعَّل دائماً، بثلاثة مستويات جهد: low وhigh وmax.
وهنا تفصيل يستحق الانتباه ويُساء فهمه كثيراً: نُشرت أوزان GLM-5.3 على Hugging Face في 28 أغسطس 2026، لكن برخصة خاصة باسم النموذج نفسه لا برخصة MIT. أما النسخة الأصغر GLM-5.3-Flash فنُشرت قبلها بيومين تحت MIT. «مفتوح الأوزان» ليس مرادفاً لـ«مفتوح المصدر بلا قيود» — وإن كنت تبني منتجاً تجارياً فوق الأوزان، الرخصة أول ما تقرأه.
كم يكلّف فعلاً؟
هذه الأسعار من صفحة التسعير في وثائق Z.ai الرسمية بتاريخ 19 سبتمبر 2026، لكل مليون توكن:
| النموذج | إدخال | إخراج |
|---|---|---|
| GLM-5.3 | $1.40 | $4.40 |
| GLM-5.3-FlashX | $0.37 | $1.25 |
| GLM-5.3-Flash | $0.15 | $0.50 |
| GLM-4.7 | $0.60 | $2.20 |
| GLM-4.5-Air | $0.20 | $1.10 |
| GLM-4.7-Flash | $0 | $0 |
لاحظ أن الموزّعين الوسطاء (مثل منصات التجميع) يعرضون أحياناً أسعاراً مختلفة صعوداً أو نزولاً — الجدول أعلاه هو السعر المباشر من Z.ai. راجع صفحة التسعير الرسمية قبل أي التزام.
المقارنة العادلة مع Claude وOpenAI
الرقم وحده بلا سياق تسويق. تحقّقنا من أسعار المنافسين من صفحاتهم الرسمية في اليوم نفسه، لكل مليون توكن:
| النموذج | إدخال | إخراج |
|---|---|---|
| GLM-5.3 | $1.40 | $4.40 |
| Claude Sonnet 5 | $2.00 | $10.00 |
| Claude Opus 5 | $5.00 | $25.00 |
| GPT-5.6 Terra | $2.00 | $12.00 |
| GPT-5.6 Sol | $4.00 | $20.00 |
القراءة الصادقة: GLM-5.3 ليس أرخص بعشر مرات كما توحي بعض العناوين. هو أرخص من Claude Sonnet 5 بنحو الثلث إدخالاً وأكثر من النصف إخراجاً، وأرخص من Claude Opus 5 بفارق كبير. والفارق يتضخّم في الإخراج — وهذا مهم عملياً لأن الأعباء الوكيلية (وكيل يقرأ ويكتب كوداً بتكرار) تولّد إخراجاً كثيراً، فهناك يظهر الفرق في الفاتورة لا في جدول الأسعار.
وفي الطرف الآخر، إن كانت مهمتك بسيطة فالمقارنة تنقلب: GLM-5.3-Flash بـ$0.15 إدخالاً يواجه GPT-5.6 Luna بـ$0.20 وClaude Haiku 4.5 بـ$1. الفجوة هنا أضيق مما تتخيّل.
خطة الترميز
إلى جانب الدفع بالاستهلاك، تبيع Z.ai اشتراكاً ثابتاً باسم GLM Coding Plan. جاذبيته أنه يعمل داخل أدوات الترميز التي يستعملها الناس فعلاً — توثّق Z.ai دعم Claude Code وCline وOpenCode وغيرها، فتستبدل المزوّد خلف الأداة نفسها.
الحصص من وثائق Z.ai الرسمية: خطة Lite تعطي 2,000 كريدت كل خمس ساعات و10,000 أسبوعياً، وPro تعطي 12,000 و60,000، وMax تعطي 28,000 و140,000. وكل الخطط تصل إلى GLM-5.3 وGLM-5.3-Flash.
أما السعر فهنا نتوقف بأمانة. وثائق Z.ai تقول صراحةً إن الخطط تبدأ من $18 شهرياً، وهذا الرقم متحقَّق منه. لكن سعري Pro وMax يختلفان بين المصادر المستقلة: بعضها يذكر $80 و$168، وبعضها الأقدم يذكر $72 و$160. لم نتحقق من سعري Pro وMax من صفحة رسمية، فلا نثبّتهما هنا — افتحهما بنفسك من صفحة الاشتراك. ونفس التحفّظ ينطبق على خصومات الدفع الربعي والسنوي التي تتردد في المصادر ولم نؤكّدها رسمياً.
وأين هو من Claude وGPT في القدرة؟
هنا يجب أن نكون حذرين: معظم الأرقام المنشورة عن GLM-5.3 مصدرها Z.ai نفسها لا جهة مستقلة. وهذا لا يعني أنها كاذبة، بل يعني أنها أفضل حالاتها لا متوسط حالاتها. بهذا القيد، الصورة المنشورة:
- في Terminal-Bench 3.0 سجّل 28.3 — أعلى من Claude Opus 4.8 عند 21.1، لكن أدنى من Claude Fable 5 عند 33.7 وGPT-5.6 Sol عند 34.6.
- في DeepSWE v1.1 سجّل 66.9 مقابل 69.7 لـFable 5 و72.7 لـGPT-5.6 Sol.
- في اكتشاف الثغرات CyberGym سجّل 84.5 — متقدّماً بفارق ضئيل على المنافسين المذكورين.
- لكنه يتراجع بوضوح في ExploitBench عند 54.4 مقابل 78.0 و76.5 للمنافسين.
الخلاصة المعقولة من هذه الأرقام: GLM-5.3 يقترب من الصف الأول ولا يتصدّره. وهذا بالضبط ما يجعله بديلاً جاداً لا بديلاً كاملاً — يكفي لأغلب النداءات بجزء من السعر، ويتعثّر حيث تحتاج الحافّة القصوى.
البُعد الذي لا تراه في التسعير: التأخير من الخليج
صفحات التسعير تُسعّر التوكن ولا تُسعّر المسافة. ولأن معظم الكلام العربي عن هذه النماذج منقول عن مصادر غربية، قِسنا بأنفسنا: من اتصال فالح في القريات بالسعودية، يوم 18 سبتمبر 2026، كان زمن الاستجابة لنقاط النهاية الثلاث كالتالي:
| نقطة النهاية | زمن الاستجابة | الفارق |
|---|---|---|
| api.openai.com | 194 ms | الأسرع |
| api.anthropic.com | 311 ms | أبطأ بنحو 1.6 ضعف |
| api.z.ai | 702 ms | أبطأ بنحو 3.6 ضعف |
هذا قياس واحد من اتصال واحد في وقت واحد، لا معدّلاً علمياً ولا متوسط عدة أيام. عاملْه كإشارة لا كحُكم: قِس من اتصالك أنت قبل أن تبني عليه قراراً.
ماذا يعني هذا عملياً؟ إن كنت تبني وكيلاً يُجري عشرات النداءات المتتابعة في المهمة الواحدة، فنصف ثانية إضافية لكل نداء تتراكم إلى دقائق من الانتظار. ولو كانت واجهتك محادثة مباشرة أمام مستخدم، فالفرق محسوس في أول حرف يظهر. الرخص ليس مجانياً — ثمنه يُدفع انتظاراً. وهذا يقلب الحساب: المهام الخلفية والدفعات الليلية تحتمل التأخير بامتياز، والمهام التفاعلية لا تحتمله.
وأين تذهب بياناتك؟
سؤال جاد يستحق جواباً هادئاً بلا نبرة سياسية. الشركة المشغّلة لخدمة Z.ai الدولية مسجّلة في سنغافورة، وسياسة الخصوصية المنشورة تقول إن بيانات العملاء تُعالَج عموماً في سنغافورة. وتنص اتفاقية معالجة البيانات المرفقة على أن محتوى عملاء الواجهة البرمجية يُعالَج فورياً ولا يُحفَظ على خوادمهم. كما أن إقامة البيانات داخل الاتحاد الأوروبي غير متاحة.
ما الذي يجب أن يفكّر فيه القارئ قبل إرسال بيانات عميل لأي مزوّد — صينياً كان أو أمريكياً؟ ثلاثة أسئلة عملية:
📍 أين تُعالَج ومن يحكمها؟
الولاية القضائية التي تُعالَج فيها بياناتك تحدّد من يستطيع طلبها قانوناً. اعرف الجواب قبل العقد لا بعده — ولكل مزوّد ولاية، ولا يوجد خيار «محايد».
📄 هل الوعد في عقد أم في صفحة تسويقية؟
«لا نخزّن المحتوى» جملة قوية إن كانت في اتفاقية معالجة بيانات موقّعة، وضعيفة إن كانت في صفحة عامة. اطلب الاتفاقية، واقرأ استثناءاتها إن وُجدت.
🧾 ما التزامك أنت تجاه عميلك؟
إن كنت تعالج بيانات شخصية لعميل سعودي، فأنت مسؤول أمامه بغضّ النظر عن مزوّدك. صنّف بياناتك أولاً: ما يُمنع خروجه من عندك لا يُرسَل لأي واجهة برمجية خارجية، مهما كان اسمها.
والخلاصة التي نؤمن بها: قاعدة «لا ترسل ما لا تحتمل تسريبه» تنطبق على كل المزوّدين بلا استثناء. وميزة الأوزان المفتوحة هنا حقيقية — من يملك عتاداً يستطيع تشغيل النموذج محلياً وإسقاط السؤال كلّه.
الحكم: بديل جاد للنداءات الكثيرة، لا للحظة الحرجة
نرى GLM أفضل ما يكون في مكان محدد: الأحمال الكثيرة غير الحسّاسة للزمن. تصنيف آلاف المدخلات، تلخيص أرشيف، توليد مسودّات بالجملة، مهام خلفية تعمل بينما تنام. هنا الفارق في سعر الإخراج يتحوّل إلى مال حقيقي في جيبك، وثلث الثانية الإضافية لا تعني شيئاً.
وأسوأ ما يكون في مكان محدد أيضاً: الواجهات التفاعلية أمام مستخدم عربي، والمهام التي تحتاج آخر خمس نقاط من القدرة. قياسنا الحي يقول إن نقطة النهاية أبعد عنّا بنحو 3.6 ضعف من أوبن إيه آي، والبنشماركات المنشورة — على علّة أنها من المزوّد — تضعه قريباً من القمة لا عليها.
النصيحة العملية: لا تستبدل مزوّدك كله. قسّم أعباءك: أرسل الكمّ الرخيص إلى GLM، واحتفظ بالحرج عند مزوّدك الحالي. هذا التقسيم يقتصّ من فاتورتك بلا مقامرة بجودة ما يراه عميلك.
GLM-4.7-Flash مجاني تماماً على واجهة Z.ai — نقطة بداية بلا بطاقة ائتمان لقياس جودة مهمتك أنت. وإن كان لديك عتاد كافٍ فأوزان GLM-5.3-Flash منشورة برخصة MIT وتشغيلها محلياً يحلّ سؤال الخصوصية والتأخير معاً. ومتى لا تحتاجه أصلاً؟ إن كانت فاتورتك الشهرية الحالية أقل من عشرين دولاراً، فالوقت الذي ستقضيه في نقل خط أنابيبك واختباره أغلى مما ستوفّره. الترحيل يستحق حين يصير التوفير بالمئات لا بالدولارات.
تبي تقيسه بنفسك؟
ابدأ بالنموذج المجاني، شغّل مهمتك الحقيقية، وقِس شيئين: جودة المخرَج وزمن الاستجابة من اتصالك أنت — قبل أي اشتراك.
افتح Z.ai ←المصادر
- z.ai — الموقع الرسمي وصفحات التسعير والاشتراك (رابط إحالة)
- docs.z.ai/guides/overview/pricing — أسعار كل نموذج لكل مليون توكن
- docs.z.ai — مواصفات GLM-5.3 ونافذة السياق ومستويات التفكير
- docs.z.ai/devpack — حصص خطة الترميز والأدوات المدعومة
- docs.z.ai — سياسة الخصوصية ومعالجة البيانات في سنغافورة
- Hugging Face — أوزان GLM-5.3 ورخصتها
- Anthropic — أسعار Claude الرسمية
- OpenAI — أسعار GPT الرسمية
- Emergent — قراءة نقدية لبنشماركات GLM-5.3 وكونها من المزوّد
- قياس زمن الاستجابة: قياس طرف أول أجراه فالح الرويلي من اتصاله في القريات، السعودية، يوم 18 سبتمبر 2026 — عيّنة واحدة لا معدّل.
— ذُكاء، تشرق بكرة إن شاء الله 🌅