مراجعة Grok 4.5: نموذج $2/$6 يتفوق في التكلفة لا في البرمجة
مراجعة عملية لنموذج Grok 4.5 وأسعاره وأدائه في البرمجة والوكلاء، مع مقارنة مباشرة بالمنافسين وشرح حد 200K الذي يضاعف تكلفة الطلب بالكامل قبل التبني.

تخلص مراجعة Grok 4.5 إلى أن سعره البالغ $2 لكل مليون رمز إدخال و$6 لكل مليون رمز إخراج لا يجعله المتصدر الجديد في البرمجة. إنه النموذج الأنسب عندما تكون تكلفة الوكيل وكفاءة الرموز أهم من الفوز في كل اختبار معياري، بشرط أن تظل مطالباتك دون عتبة التسعير البالغة 200K.
خلاصة مراجعة Grok 4.5 في جدول واحد
يمثل Grok 4.5 الخيار الأفضل من حيث القيمة بين أرخص نموذج برمجي ومتصدّر الاختبارات المعيارية. فهو أعلى تكلفة من Composer 2.5 لدى Cursor، ويسجل نتيجة أدنى من Claude Fable 5 في معظم بنود مخطط SpaceXAI الهندسي، لكنه يظل مقنعاً للوكلاء الذين يعملون لفترات طويلة لأن سعر الإخراج يبلغ $6 بدلاً من $50 لـ Fable داخل Cursor.

تقدم واجهة الفوترة الحالية في Cursor أوضح مقارنة، لأنها تضع نماذجها الخاصة وبدائل الصدارة على مقياس واحد. جميع الأسعار أدناه محسوبة لكل مليون رمز.
عند عبء شهري يبلغ 10 ملايين من رموز الإدخال الجديدة و2 مليون من رموز الإخراج، تنتج هذه الأسعار فاتورة مباشرة: $32 لـ Grok 4.5، و$10 لـ Composer 2.5، و$200 لـ Claude Fable 5، و$110 لـ GPT-5.6 Sol. كما تضيف Cursor رسماً قدره $0.25 لكل مليون رمز إلى نماذج الجهات الخارجية ضمن خطتي Teams وEnterprise، بينما تُعفى منه نماذج Grok وComposer التابعة لها.
لهذا تكشف Cursor موقع Grok 4.5 بوضوح: ليس الأرخص ولا صاحب أعلى نتيجة، بل نقطة التوازن بين الخيارين.

هذه هي الخلاصة. أما بقية القرار فتتوقف على إثبات أن عبء عملك يقع في الجانب المناسب منها.
ما Grok 4.5 وأين يعمل؟
Grok 4.5 نموذج استدلال صُمم للبرمجة والمهام الوكيلة وأعمال المعرفة، وليس مجرد إعداد مسبق جديد للدردشة. تصفه Cursor وSpaceXAI بأنه نموذج «مزيج خبراء» دُرّب بالشراكة؛ أي إن كل رمز يفعّل مجموعة مختارة من مكونات النموذج المتخصصة بدلاً من استخدام الشبكة كاملة في كل خطوة.
جرى الإطلاق على مرحلتين. أطلقت Cursor نموذج Grok 4.5 في 8 يوليو، ثم نشرت SpaceXAI إعلان الإطلاق الكامل في 16 يوليو. وتقول Cursor إن مزيج التدريب شمل تريليونات الرموز من بيانات تفاعل وكلاء المطورين، إلى جانب مهام STEM والأوراق البحثية وأعمال المعرفة الأوسع.
معرّف النموذج الحالي هو grok-4.5. وهو يقبل النصوص والصور، ويعيد نصاً، ويوفر نافذة سياق بسعة 500,000 رمز، ويدعم جهداً استدلالياً منخفضاً أو متوسطاً أو مرتفعاً، مع اعتماد المرتفع افتراضياً. وتشمل أدواته الأصلية استدعاء الدوال، والبحث على الويب، والبحث في X، وتنفيذ الشفرة عبر Responses API أو Chat Completions.
يتسم توزيعه باتساع غير معتاد لنموذج جديد. فهو متاح عبر SpaceXAI API، وهو النموذج الافتراضي في Grok Build، ويعمل في Cursor ضمن جميع الخطط، ويشغّل إضافات Word وPowerPoint وExcel، كما أنه مدرج عبر OpenRouter وVercel وCloudflare وSnowflake وDatabricks Mosaic. وداخل Cursor، يتوفر على سطح المكتب والويب وiOS وCLI وSDK.
هذا الانتشار يقلل عوائق التبني، لكنه لا يلغي ضرورة الفصل بين النموذج والمنتج المحيط به. فتسعير الذاكرة المؤقتة لـ Grok 4.5 عبر API المباشر يختلف عن تسعير Grok 4.5 داخل Cursor، فيما تضيف Grok Build حلقة تشغيل لوكيل فوق النموذج. وكانت اقتصاديات Grok Build السابقة محكومة إلى حد كبير ببوابة اشتراك ثابتة. أما Grok 4.5 فيغير النقاش لأن كلاً من النموذج والوكيل بات يملك مساراً أوضح للفوترة بحسب الاستخدام.
الاختبارات تثبت القيمة لا الصدارة المطلقة
يفوز Grok 4.5 بواحد من خمسة اختبارات هندسية تعرضها SpaceXAI، ويكاد يعادل المتصدرين في اختبار آخر، ويتأخر عن Claude Fable 5 في الاختبارات الثلاثة الباقية. ووصفه ببطل البرمجة الجديد لا يستقيم إلا بتجاهل أرقام الجهة المقدمة نفسها.
يوضح مخطط إطلاق SpaceXAI أن أرقام المنافسين مأخوذة من بطاقات الأنظمة الصادرة عن مقدميها أو من لوحات صدارة الاختبارات. لذلك يصلح الجدول لتحديد الاتجاه، لا بديلاً عن تقييم مصمم لعبء عملك. فإعدادات التنفيذ والاستدلال وإعادة المحاولة وميزانيات الرموز قد تغيّر نتيجة البرمجة بما يكفي لتبديل قرار الشراء.
الفوارق محددة: يتأخر Grok عن Fable 5 بمقدار 4.1 نقاط في DeepSWE 1.0، و17 نقطة في DeepSWE 1.1، و1 نقطة في Terminal Bench 2.1، و15.7 نقطة في SWE Bench Pro. وفوزه الواضح هو SWE Marathon، حيث تتقدم نتيجته البالغة 29.0% على Opus 4.8 عند 26.0% وFable 5 عند 24.0%.
أما حجة الكفاءة فأكثر إقناعاً. تفيد SpaceXAI بأن Grok يستخدم في المتوسط 15,954 رمز إخراج لكل مهمة في SWE Bench Pro، مقابل 67,020 لـ Opus 4.8 max، أي أقل بنحو 4.2 مرات. هذه بيانات نشرتها الجهة المقدمة، لكنها تشير إلى الوحدة الاقتصادية الصحيحة: المهمة المنجزة، لا السعر المعلن للرمز الواحد.
وتضع القياسات المستقلة الحكم في سياقه الواقعي. تمنح Artificial Analysis نموذج Grok 4.5 نتيجة مرتفعة تبلغ 54، في مقابل 55 لـ GPT-5.5 xhigh. ويبلغ سعره المدمج بنسبة 7:2:1 للذاكرة المؤقتة/الإدخال/الإخراج $1.35 لكل مليون رمز لـ Grok، مقابل $4.35 لـ GPT-5.5. كما قاست المقارنة المباشرة نفسها نحو 70 رمز إخراج في الثانية لـ Grok ونحو 76 لـ GPT-5.5.
تعلن SpaceXAI عن 80 رمز إخراج في الثانية، بينما تظهر النتيجة المستقلة نحو 70. هذا الفارق ليس إخفاقاً، لكنه يذكّر بأن سرعة الخدمة تتغير وأن إنتاجية يوم الإطلاق ليست ضماناً لمستوى الخدمة.
الحكم المباشر للاختبارات هو أن Grok 4.5 قريب بما يكفي من أداء الصدارة ليكون جذاباً اقتصادياً، لكنه ليس قوياً بما يسمح باستبدال بوابة الجودة بجدول أسعار.
تكلفة Grok 4.5 الحقيقية
لا يكون السعر المعلن لـ Grok 4.5، والبالغ $2/$6، دقيقاً إلا دون 200,000 رمز سياق. فعند بلوغ هذه العتبة، تضاعف SpaceXAI أسعار الإدخال الجديد والإدخال المخزّن مؤقتاً والإخراج للطلب بأكمله.
هذا الفارق مهم لأن نافذة سياق بسعة 500,000 رمز تصف السعة، لا سعة منخفضة التكلفة. فالطلب الذي يحمل 250K من رموز الإدخال وينتج 50K من رموز الإخراج يكلف $1.60 وفق أسعار السياق الطويل. ولو طُبقت أسعار السياق القصير على أعداد الرموز نفسها، لبلغت التكلفة $0.80. تضاعف العتبة فاتورة الرموز قبل احتساب البحث على الويب أو تنفيذ الشفرة أو إعادة المحاولات.

في المقابل، يمكن للذاكرة المؤقتة أن تخفض التكلفة. فعبء عمل يضم 10 ملايين من رموز الإدخال الجديدة و2 مليون من رموز الإخراج يكلف $32. وإذا قُدم نصف ذلك الإدخال من الذاكرة المؤقتة عبر API المباشر، تنخفض الفاتورة إلى $23.50، أي توفير قدره $8.50 أو نحو 26.6%.
لا يتحقق هذا التوفير تلقائياً. توصي SpaceXAI بضبط prompt_cache_key في Responses API، أو x-grok-conv-id مع Chat Completions، كي تُوجَّه المحادثة إلى الخادم نفسه. ومن دون ذلك، قد يحول خادم لم تُهيأ ذاكرته المؤقتة طلباتٍ كان يفترض أن تستفيد منها إلى إدخال كامل السعر.
يضيف استخدام الأدوات عداداً ثانياً. تبلغ تكلفة كل من البحث على الويب والبحث في X وتنفيذ الشفرة $5 لكل 1,000 استدعاء. ويضيف تشغيل يستخدم 25 استدعاءً من هذا النوع $0.125 قبل احتساب رموز النموذج اللازمة لهذه الاستدعاءات. وتبلغ تكلفة البحث في المرفقات $10 لكل 1,000 استدعاء، مقابل $2.50 لكل 1,000 للبحث في المجموعات.
ما الذي يتعطل في بيئة الإنتاج؟
أول إخفاق في الإنتاج هو إعادة التسعير الصامتة، لا ذكاء النموذج. تتمدد مطالبة بحجم مستودع الشفرة فتتجاوز 200K، وتنتقل جميع رموز الطلب إلى سعر السياق الطويل، فينهار فوراً نموذج تكلفة بُني على السعر الرئيسي $2/$6.
الثاني هو التفاؤل حيال الذاكرة المؤقتة. تبدو جولات الوكيل المتكررة مناسبة لها، لكنها لا تستفيد من سعر الإدخال المباشر المخزّن مؤقتاً، والبالغ $0.30، إلا إذا سمح التوجيه بإعادة استخدام البادئة السابقة. وينبغي إدراج توصية SpaceXAI الصريحة بشأن مفتاح الذاكرة المؤقتة في تصميم الفوترة منذ الطلب الأول.
الثالث هو تراكم السياق. يقرأ الوكلاء طويلو التشغيل مراراً الخطط ومخرجات الأدوات والفروق والاختبارات والشروح السابقة. تؤجل نافذة 500,000 رمز لحظة الفشل، لكنها لا تجعل حمل كل جولة قديمة خياراً منطقياً. توصي SpaceXAI بضغط السياق للحلقات الطويلة، أي استبدال التفاصيل المتقادمة بحالة عمل أصغر قبل أن يبلغ الوكيل عتبة التسعير أو يفقد تركيزه داخل تاريخه.
الرابع هو التعامل مع اختبارات الجهة المقدمة كبوابة للإصدار. تمتد نتائج Grok 4.5 المعروضة من المركز الأول في SWE Marathon إلى التأخر 17 نقطة عن Fable 5 في DeepSWE 1.1. وستعتمد جودة الإنتاج على مستودعك ومشغّل التنفيذ وتغطية الاختبارات وصلاحيات الأدوات وتعريفك للنجاح.
الخامس هو توافر منصة التشغيل. تفيد صفحة Grok 4.5 الحالية في Cursor بأن النموذج غير متاح بعد في الاتحاد الأوروبي عبر Cursor. هذا قيد في Cursor، وليس دليلاً على حظر كل مسارات الوصول عبر SpaceXAI، لكنه يكفي لمنع فريق أوروبي من التخطيط اليوم للانتقال إلى Cursor اعتماداً عليه.
من يناسبه Grok 4.5 ومن الأفضل أن يتجاوزه؟
استخدم Grok 4.5 لحلقات الوكلاء الحساسة للتكلفة التي تظل دون 200K وتستطيع التحقق من عملها. وتجاوزه عندما يستحق أعلى معدل نجاح برمجي معروض تكلفته الإضافية، أو عندما يكون Composer 2.5 جيداً بما يكفي بالفعل، أو إذا كان مستخدمو Cursor لديك في الاتحاد الأوروبي.

- يجعل سعر الإدخال البالغ $2 والإخراج البالغ $6 مهام الوكلاء بمستوى قريب من الصدارة أرخص بوضوح من Fable 5 أو GPT-5.6 Sol داخل Cursor.
- تتيح نافذة السياق بسعة 500,000 رمز مساحة لمستودعات كبيرة وسجل مهام طويل.
- يقلل استدعاء الدوال والبحث على الويب والبحث في X وتنفيذ الشفرة والمخرجات المنظمة وواجهتا API القياسيتان من جهد التكامل.
- تظهر بيانات الجهة المقدمة فوزاً حقيقياً في SWE Marathon واستهلاكاً أقل بكثير لرموز الإخراج من Opus 4.8 max في SWE Bench Pro.
- لا يتصدر Grok 4.5 أربعة من الاختبارات الهندسية الخمسة في مخطط SpaceXAI نفسه.
- تتضاعف أسعار API المباشر لكل رمز بمجرد بلوغ الطلب سياقاً قدره 200K.
- يتطلب التوفير الموثوق من الذاكرة المؤقتة انضباطاً صريحاً في التوجيه.
- تقل السرعة المستقلة عن ادعاء الجهة المقدمة البالغ 80 رمزاً في الثانية، وقد كشفت Cursor عن تلوث أحد الاختبارات المستبعدة.
خطة تقييم آمنة
يقارن اختبار التبني الصحيح العمل المنجز عند معيار جودة مضبوط، لا المطالبات المنفردة. حافظ على مجموعة المهام ومشغّل الوكيل وصلاحيات الأدوات وفحوص القبول نفسها بين النماذج.
ثبّت مجموعة مهام ممثلة
اختر مهام حقيقية من العمل الذي تنوي تفويضه: إصلاح خطأ مع اختبارات، وتغيير على مستوى المستودع، ومهمة بحث تستخدم الأدوات، ومستند أو ملف جداول إن كانا مهمين. عرّف النجاح والفشل قبل أن يراها أي نموذج.
اضبط الاستدلال والسياق
استخدم إعداد الاستدلال نفسه في كل تشغيل لـ Grok، وسجل الحجم الدقيق للمطالبة، وافصل المهام دون 200K عن مهام السياق الطويل. لا تسمح لنموذج برؤية ملفات إضافية أو ميزانية أدوات مختلفة.
اجعل الذاكرة المؤقتة قابلة للقياس
اضبط
prompt_cache_keyأوx-grok-conv-idللمحادثات المتكررة. وسجل الإدخال الجديد والمخزّن مؤقتاً كلّاً على حدة كي تعكس مقارنة التكلفة فاتورة يمكنك إعادة إنتاجها.اجعل اقتصاديات المهمة المكتملة بوابة القرار
سجل معدل النجاح، والتصحيحات البشرية، وإعادة المحاولات، وإجمالي الرموز، واستدعاءات الأدوات، والوقت المنقضي. لا تعتمد Grok إلا عندما يتفوق في تكلفة النتيجة المقبولة على نموذجك الحالي من دون خفض معيار الإصدار.
بالنسبة إلى مؤسس حصل على تمويل، قد تكون البوابة هي وقت مراجعة المطور. وبالنسبة إلى مدير تقنية في شركة متوسطة، قد تكون العيوب المتسربة إلى الإنتاج وقابلية التدقيق. أما المشغّل الخبير فقد يقيس ما إذا كان ملف Excel أو مخرج البحث يصمد أمام مراجعة الحقائق. وبالنسبة إلى مطور تقني يعمل منفرداً، فالسؤال غالباً هو: هل يشتري السعر الأقل عملاً منجزاً أكثر من دون أن يخلق وظيفة ثانية لمراجعة الوكيل؟
الأسئلة الشائعة
هل Grok 4.5 جيد؟
نعم، عندما تحتاج إلى قدرات قوية لتشغيل الوكلاء بتكلفة رموز أقل. لكنه ليس الخيار الافتراضي الأكثر أماناً لأقصى دقة برمجية، لأن Fable 5 يتصدر أربعة من الاختبارات الهندسية الخمسة التي تعرضها SpaceXAI، بينما يتمثل أوضح تفوق لـ Grok في إنجاز المهام الممتدة بكفاءة من حيث التكلفة.
كم تبلغ تكلفة Grok 4.5؟
يكلف SpaceXAI API المباشر $2 لكل مليون رمز إدخال جديد، و$0.30 لكل مليون رمز إدخال مخزّن مؤقتاً، و$6 لكل مليون رمز إخراج دون سياق 200K. وعند 200K أو أكثر، تصبح الأسعار $4 و$0.60 و$12 للطلب بأكمله. وتدرج Cursor سعراً قدره $2 للإدخال، و$0.50 لقراءة الذاكرة المؤقتة، و$6 للإخراج ضمن مجموعتها الخاصة.
أين يمكن استخدام Grok 4.5؟
توثق SpaceXAI الوصول إليه عبر API الخاص بها، وGrok Build، وCursor، وWord، وPowerPoint، وExcel، وOpenRouter، وVercel، وCloudflare، وSnowflake، وDatabricks Mosaic. وتدعمه Cursor على سطح المكتب والويب وiOS وCLI وSDK، لكنها تدرجه حالياً بوصفه غير متاح في الاتحاد الأوروبي.
هل تريد قائمة إعداد Claude Code وCodex؟ احصل عليها عبر النشرة البريدية.
3 سبتمبر 2026







