مراجعة GLM-5.2 (2026): هل ما زال خياراً جيداً بعد GLM-5.3 Flash؟
مراجعة GLM-5.2 بعد وصول GLM-5.3 Flash: مقارنة عملية للأسعار والأداء والبرمجة والاستضافة الذاتية، مع توصية واضحة بشأن النموذج الأنسب في 2026.

تبيّن مراجعة GLM-5.2 أن هذا النموذج البرمجي مفتوح الأوزان، والمرخّص بموجب MIT، لا يزال يضم 753 مليار معلمة، لكنه لم يعد يتصدر عائلته من حيث القيمة. فقد أصبح سعر GLM-5.3 Flash المعلن $0.15 لكل مليون رمز إدخال و$0.50 لكل مليون رمز إخراج، مقابل $1.40 و$4.40 عند استخدام نقطة نهاية GLM-5.2 لدى Cloudflare. وفوق ذلك، يضيف Flash دعماً أصلياً للرؤية ونافذة سياق على Cloudflare بسعة 1,048,576 رمزاً.
خلاصة مراجعة GLM-5.2
لا يُنصح ببدء عبء عمل مستضاف جديد على GLM-5.2، إلا إذا كان المطلوب الحفاظ على التوافق مع نشر قائم أو إعادة إنتاج تقييم أقدم بدقة. يمثل GLM-5.3 Flash الخيار الافتراضي الأفضل للوكلاء الذين تتصدر التكلفة أولوياتهم وللمهام متعددة الوسائط. أما عندما يتقدم أقصى أداء برمجي على تكلفة الرموز، فالاختيار الأقوى هو GLM-5.3 الكامل. وتبقى الجدوى الأوضح لـ GLM-5.2 اليوم في كونه خط أساس مستقراً قابلاً للاستضافة الذاتية.
هذه توصية أكثر حسماً مما انتهت إليه المراجعة عند نشرها أول مرة. فما زال GLM-5.2 يجمع بين الأوزان المرنة والسياق الطويل والأداء البرمجي الموثوق، لكن Z.ai أطلقت منذ ذلك الحين خليفتين له. لم تعد المفاضلة بين GLM-5.2 ونموذج مغلق مرتفع السعر؛ بل أصبحت غالباً بين Flash وGLM-5.3 الكامل، مع الإبقاء على GLM-5.2 فقط عندما تفوق مخاطر الانتقال قيمة التوفير.

منذ 30 أغسطس 2026، باتت خدمة Cloudflare AI Search تدعم GLM-5.3 Flash بوصفه نموذج التوليد الأصلي عبر Workers AI، باستخدام الاسم المستعار @cf/zai-org/glm-5.3-flash ونافذة سياق سعتها 1,048,576 رمزاً. وبذلك يتاح Flash داخل منظومة مُدارة للاسترجاع والتوليد، لا عبر Z.ai أو خطة برمجة فحسب. ويتناول شرح Cloudflare AI Search مع GLM-5.3 Flash ما يترتب على ذلك من حيث الإعداد والتكلفة.
إذا كان هناك نشر ذاتي قائم ومستقر لـ GLM-5.2، فلا داعي إلى الانتقال لمجرد صدور إصدار جديد. لكن في أي نشر مستضاف جديد، يصعب تجاهل فارق السعر: فسعر الإخراج المعلن لـ Flash أقل بنسبة 88.6%، كما أنه يتعامل أصلياً مع الصور والفيديو والملفات، وهي مدخلات لا يقبلها GLM-5.2 بصورة أصلية.
ما نموذج GLM-5.2 تحديداً؟
أطلقت Z.ai نموذج GLM-5.2 في 16 يونيو 2026 بوصفه نموذجاً هندسياً للمهام طويلة الأفق. وتذكر بطاقة النموذج الرسمية أنه يضم 753 مليار معلمة، ويستقبل النص ويخرجه، ويوفر أوزاناً مفتوحة، ويدعم النشر المحلي عبر SGLang وvLLM وKTransformers وxLLM وTransformers. يدعم النموذج مباشرةً من Z.ai سياقاً بسعة 1 مليون رمز، وحداً أقصى للإخراج يبلغ 128K رمزاً. أما نقطة نهاية GLM-5.2 المستضافة لدى Cloudflare فتعمل ضمن حدود مختلفة، إذ تقف سعة السياق عند 262,144 رمزاً.
كانت IndexShare أبرز خصائص البنية عند الإطلاق الأصلي. فبحسب صفحة إطلاق GLM-5.2 لدى Z.ai، يُعاد استخدام مفهرس خفيف واحد عبر كل أربع طبقات من الانتباه المتناثر، ما يخفض حسابات كل رمز بمقدار 2.9 مرة عند سياق يبلغ 1 مليون رمز. وبعبارة أبسط، يتجنب النموذج تكرار جزء من عملية البحث المكلفة داخل موجه ضخم في كل طبقة. وهذا يقلل تكلفة تشغيل الجلسات الطويلة على مستودعات الشيفرة.
GLM-5.3 هو الخليفة البرمجي المباشر. وتوضح Z.ai أنه يستخدم النموذج الأساسي نفسه الذي يستخدمه GLM-5.2، وأن مكاسبه جاءت من تدريب لاحق إضافي. أما GLM-5.3 Flash فهو فرع مختلف مبني على أساس جديد: 320 مليار معلمة إجمالاً، منها 18 مليار معلمة نشطة، مع مزيج من الانتباه المتناثر والخطي، ومجموعة تدريب متعددة الوسائط تضم 30 تريليون رمز. وتورد وثائقه الحالية دعماً لمدخلات الفيديو والصور والنصوص والملفات، ومخرجات نصية، وسياقاً بسعة 1 مليون رمز، وحداً أقصى للإخراج يبلغ 128K رمزاً.
الانخفاض في حجم الجزء النشط هو التغيير الأهم تجارياً. تفيد Z.ai بأن حسابات الانتباه أقل بمقدار 3.0 مرات، وأن ذاكرة التخزين المؤقت للمفاتيح والقيم أصغر بمقدار 4.4 مرات مقارنةً بـ GLM-5.3 الكامل. وانخفاض الحوسبة والذاكرة المطلوبة لكل طلب هو ما يتيح تسعيراً أدنى بكثير لكل رمز. لذا فإن Flash ليس مجرد GLM-5.2 باسم جديد؛ بل يغير اقتصاديات التشغيل ويضيف التغذية الراجعة البصرية الأصلية إلى دورة البرمجة.
يظل كل من GLM-5.2 وGLM-5.3 Flash متاحاً بترخيص MIT. وهذا يسمح بالاستخدام التجاري والتعديل والاستضافة الذاتية، ويبقيهما ضمن النقاش حول النماذج مفتوحة الأوزان، حتى وإن ظل الوصول المستضاف والعتاد اللازم لتشغيل نماذج بهذا الحجم مكلفين.
قراءة واقعية لاختبارات الأداء
أصبحت نتائج GLM-5.2 الأصلية في اختبارات الأداء خط أساس قديماً، لا ترتيباً راهناً. ففي مواد الإطلاق الصادرة في يونيو، ذكرت Z.ai أن GLM-5.2 تأخر بنحو نقطة واحدة عن Claude Opus 4.8 في FrontierSWE، وجاء خلف Opus 4.8 في PostTrainBench، وتأخر عنه 13 نقطة في SWE-Marathon. كانت تلك نتائج قوية لنموذج مفتوح الأوزان، لكنها تصف تشكيلة نماذج يونيو والمهام التي اختارت Z.ai عرضها.

المقارنة الأحدث تغيّر التوصية. ففي تقييم GLM-5.3 Flash الذي نشرته Z.ai، سجل Flash نتيجة 84.3 مقابل 81.0 لـ GLM-5.2 في Terminal Bench 2.1، و63.4 مقابل 46.2 في DeepSWE v1.1، و48.8 مقابل 26.2 في AutomationBench v1.0.6. وفي Z.ai Code Bench v1.0، عند أقصى مستوى للجهد وباستخدام Claude Code 2.1.207، سجل Flash نتيجة 29.0 مقابل 29.5 لـ Opus 4.8.
هذه الأرقام مفيدة، لكنها تظل منشورة من الشركة الموردة. تشير الاختبارات العامة في الاتجاه نفسه عبر مهام البرمجة والوكلاء، بينما يخضع Code Bench الخاص لسيطرة Z.ai. والخلاصة التي يمكن الدفاع عنها هي أن Flash يتفوق على GLM-5.2 في أعباء العمل التي تعرضها Z.ai، ويقترب من Opus 4.8 في تقييمها البرمجي الخاص. لكنها ليست دليلاً على أن Flash يضاهي Opus في الكتابة أو التحليل أو اتباع التعليمات أو العمل على كل مستودع برمجي في بيئة الإنتاج.
التكلفة الفعلية
تجعل صفحات الأسعار الحالية تبرير GLM-5.2 صعباً لأي عبء عمل مستضاف جديد. جرى التحقق من الأسعار التالية عبر صفحة الأسعار الحالية لدى Z.ai وأسعار Workers AI الحالية من Cloudflare في 30 أغسطس 2026.
يخص عرض Flash الترويجي واجهة API التابعة لـ Z.ai، وينتهي الساعة 24:00 في 9 سبتمبر 2026 بتوقيت سنغافورة UTC+8. أما Cloudflare فتعلن الأسعار القياسية: $0.15 للإدخال و$0.03 للإدخال المخزّن مؤقتاً و$0.50 للإخراج. لذلك لا ينبغي بناء ميزانية نشر على Cloudflare بالاستناد إلى خصم Z.ai المؤقت.
في عبء عمل بسيط يستهلك 1 مليون رمز إدخال و1 مليون رمز إخراج، تبلغ تكلفة GLM-5.2 أو GLM-5.3 الكامل $5.80. أما Flash فيكلف $0.65 بالسعر المعلن، أي أقل بنسبة 88.8%. وخلال عرض Z.ai الترويجي تبلغ تكلفته $0.325، أي أقل بنسبة 94.4%. قد تختلف نسبة رموز الإدخال إلى الإخراج في الاستخدام الفعلي، لكن النتيجة لا تتغير: يقع GLM-5.2 وGLM-5.3 ضمن الفئة السعرية نفسها، بينما يأتي Flash بسعر أدنى بكثير.

تغيرت أيضاً GLM Coding Plan. فلا تزال Lite بسعر $18 شهرياً، أو $12.60 شهرياً عند الفوترة السنوية، وتعلن الآن عن 10,000 رصيد أسبوعياً. وتبلغ كلفة Pro $80 شهرياً، أو $56 شهرياً عند الفوترة السنوية، مع استخدام يعادل 6 مرات Lite. أما Max فسعرها $168 شهرياً، أو $117.60 شهرياً عند الفوترة السنوية، مع استخدام يعادل 14 مرة Lite. وتعرض الصفحة أكثر من 20 أداة للوكلاء، من بينها Claude Code وZCode، كما لا تزال توفر أمر الإعداد npx @z_ai/coding-helper.
يتاح GLM-5.3 Flash لجميع مستخدمي Coding Plan، ويحصل على حصة قابلة للاستخدام تعادل 3 مرات حصة GLM-5.3 الكامل. وهذا يجعل اختيار الخطة أوضح: البداية مع Lite مناسبة إذا كان العمل الأسبوعي لا يتجاوز 10,000 رصيد، ثم يمكن الانتقال إلى مستوى أعلى عند الحاجة إلى سعة أكبر. ويقدم دليل أسعار Claude Code المقارنة المفيدة عند الموازنة بين هذه الخطة واشتراك في نموذج رائد. ولا يُختار GLM-5.3 الكامل داخل الخطة إلا عندما يبرر أداؤه البرمجي الأقوى استهلاك الحصة الأعلى.
هل GLM-5.2 مجاني؟
يمكن تنزيل الأوزان واستخدامها مجاناً بموجب ترخيص MIT. تستضيف Hugging Face أوزان GLM-5.2، كما تسرد Z.ai أطر الاستدلال المحلي المدعومة. وينطبق الأمر نفسه على GLM-5.3 Flash.
أما القدرة الحاسوبية فليست مجانية. يضم GLM-5.2 عدد 753 مليار معلمة، بينما يضم Flash إجمالاً 320 مليار معلمة؛ ولذلك فإن الاستضافة الذاتية لأي منهما مشروع بنية تحتية، وليست حلاً مختصراً للعمل على حاسوب محمول. تبلغ كلفة GLM-5.2 المستضاف $1.40 لكل مليون رمز إدخال و$4.40 لكل مليون رمز إخراج. ويكلف Flash $0.15 و$0.50 بالسعر المعلن، مع خصم Z.ai المؤقت الموضح أعلاه.
تضيف Cloudflare AI Search فارقاً آخر. إذ تتاح AI Search مجاناً خلال مرحلتها التجريبية المفتوحة وضمن الحدود المنشورة، بما يشمل 20,000 استعلام شهرياً و500 صفحة تزحف إليها الخدمة يومياً ضمن Workers Free، لكن توليد Workers AI واستخدام AI Gateway يُحاسبان بصورة منفصلة. فمجانية طبقة البحث لا تعني مجانية رموز التوليد.
مقارنة GLM-5.2 مع GPT وClaude في البرمجة
لم يعد السؤال المفيد هو ما إذا كان GLM-5.2 يستطيع الاقتراب أحياناً من GPT أو Claude. بل يتعلق بما إذا كانت قيمة النموذج المفتوح واقتصاديات الرموز القابلة للتوقع والمدخلات الأصلية متعددة الوسائط تبرر قبول منظومة أحدث عهداً. ويعزز GLM-5.3 Flash عناصر هذه المعادلة الثلاثة.
أوضح ما تتفوق به عائلة GLM على GPT وClaude هو التحكم والتكلفة. إذ يمكن استضافة الأوزان ذاتياً، كما يجعل Flash الإخراج المستمر أقل كلفة بكثير. وفي المقابل، تظل النماذج الرائدة المغلقة الخيار الأبسط لمن يريد مساعداً واحداً مصقولاً للكتابة والتحليل والبرمجة معاً، بدلاً من اختيار نموذج مخصص لعبء عمل بعينه.
في البرمجة البحتة، لا يصح تحويل نتيجة FrontierSWE في يونيو إلى ادعاء شامل. فتأخر GLM-5.2 بنحو نقطة واحدة عن Opus 4.8 في اختبار تاريخي واحد لم يكن يعني قط تساوي قدراتهما في كل مكان. يحسن Flash معادلة التكلفة والقدرات، بينما يستهدف GLM-5.3 الكامل أصعب أعمال البرمجة بسعر API نفسه لـ GLM-5.2. ولإجراء مقارنة أوسع قبل تغيير سير عمل إنتاجي، يظل دليل نماذج البرمجة الرائدة نقطة البداية الأنسب. كما تتناول مراجعة Kimi K3 بديلاً آخر مفتوح الأوزان، يقوم على موازنة مختلفة بين الكلفة والأداء.
من يناسبه هذا النموذج ومن الأفضل أن يتجاوزه؟
يظل GLM-5.2 مناسباً عندما تكون منظومة الاستضافة الذاتية الحالية مستقرة، أو عندما يجب أن يبقى التقييم قابلاً لإعادة الإنتاج، أو تكون إحدى التبعيات مثبتة على سلوكه. فالنشر الذي يعمل جيداً لا يصبح خاطئاً يوم صدور نموذج جديد.
أما GLM-5.3 Flash فهو الأنسب للوكلاء الجدد ذوي الحجم الكبير، والبرمجة البصرية، والعمل على المستندات، أو التوليد عبر Cloudflare AI Search. فأسعاره المعلنة للرموز تقارب تُسع أسعار GLM-5.2، وهو يقبل المدخلات البصرية والملفات، كما يوفر نافذة سياق أكبر على Cloudflare. ويُختار GLM-5.3 الكامل عندما يكون أداء البرمجة المعقدة أهم من معدل الإنجاز؛ فسعر API لم يتغير عن GLM-5.2، ولذلك لا يوجد مبرر قوي لبدء عبء عمل برمجي جديد ومدفوع على GLM-5.2 بالسعر نفسه.
ولا داعي إلى الانتقال إذا كان عبء العمل محدوداً إلى حد يجعل تكلفة النموذج ضئيلة، أو إذا كان تغيير النموذج يستلزم أعمال تحقق تتجاوز قيمتها الوفر الشهري. كما أن اختبارات الشركات الموردة لا تغني عن تجربة مهمة ممثلة من المستودع الفعلي.
خطوة يوم الاثنين واضحة: شغّل مهمة حقيقية واحدة من المستودع عبر GLM-5.3 Flash، وسجّل رموز الإخراج والوقت المنقضي والتعديلات التي تحتاج إلى تصحيح، ثم كررها باستخدام GLM-5.3 الكامل. إذا اجتاز Flash معيار الجودة المطلوب، فاجعله الخيار الافتراضي للعمل المعتاد، واحتفظ بالنموذج الكامل للحالات التصعيدية. وعند استخدام Cloudflare AI Search، اختر @cf/zai-org/glm-5.3-flash نموذجاً للتوليد، واترك الاسترجاع بلا تغيير في المقارنة الأولى.
هل GLM-5.2 صيني؟
نعم. يذكر تاريخ شركة Z.ai أن ZhipuAI تأسست في 2019 انطلاقاً من تقنية طورتها Tsinghua University. ويحمل كل من GLM-5.2 وGLM-5.3 Flash أوزاناً مرخصة بموجب MIT، ولذلك تستطيع الفرق ذات المتطلبات الصارمة لموقع البيانات تقييم الاستضافة الذاتية بدلاً من إرسال الموجهات إلى نقطة نهاية مستضافة.
هل GLM-5.2 مجاني؟
يمكن تنزيل الأوزان المرخصة بموجب MIT واستخدامها مجاناً. أما الاستدلال المستضاف فمدفوع؛ إذ تسرد الأسعار الحالية كلفة GLM-5.2 عند $1.40 للإدخال و$4.40 للإخراج لكل مليون رمز. كما يجعل العتاد والتشغيل الاستضافة الذاتية تكلفة فعلية.
هل GLM-5.2 أفضل من GPT في البرمجة؟
ليس بوصفه حكماً عاماً. فقد أظهرت بيانات إطلاق Z.ai في يونيو أن GLM-5.2 قريب من أبرز النماذج المغلقة في اختبارات مختارة للبرمجة طويلة الأفق، لكن GLM-5.3 وGLM-5.3 Flash تجاوزاه منذ ذلك الحين في تقييمات البرمجة التي نشرتها Z.ai. وتتمثل أقوى مبررات استخدام GLM-5.2 اليوم في أوزانه المفتوحة وتوافقه، لا في كونه أحدث نموذج متصدر للأداء.
هل يمكن استخدام GLM-5.2 مع Claude Code؟
نعم. تدعم GLM Coding Plan أداة Claude Code وأكثر من 20 أداة للوكلاء. وبات GLM-5.3 Flash متاحاً الآن لجميع مستخدمي الخطة، مع حصة قابلة للاستخدام تعادل 3 مرات حصة GLM-5.3 الكامل، ولذلك فهو النموذج الأول الأنسب للتجربة في العمل المعتاد.
يتوقف تحديد مكان GLM-5.2 في بيئة العمل عادةً على طريقة ربط وكيل البرمجة. لذلك أعددت قائمة تحقق مجانية لإعداد Claude Code وCodex، توضح خطوات توجيه الوكيل إلى نموذج أقل كلفة من دون الإخلال بسير العمل. اشترك في النشرة البريدية للحصول عليها، إلى جانب قراءة أسبوعية تحدد النماذج التي تستحق الانتقال إليها.
3 سبتمبر 2026







