أفضل ذكاء اصطناعي للبرمجة: نماذج اقتصادية لوكلاء البرمجة في 2026
مقارنة عملية لأفضل نماذج الذكاء الاصطناعي الاقتصادية لوكلاء البرمجة في 2026، مع أسعار المحاولات وحدود السياق وقاعدة اختيار أقل تكلفة للرقعة المقبولة.

GPT-5.6 Luna هو أفضل ذكاء اصطناعي للبرمجة منخفض التكلفة يمكن اعتماده افتراضياً في وكلاء البرمجة عام 2026: شهر يضم 10,000 مهمة، تستهلك كل منها 100,000 رمز إدخال و30,000 رمز إخراج، يكلف $560 وفق السعر المعلن، بينما تتراوح تكلفة DeepSeek V4 Flash بين $418 خارج أوقات الذروة و$836 وقت الذروة. قاعدة الشراء ليست اختيار أقل سعر للرمز، بل أقل ميزانية للرقعة المقبولة بعد احتساب إعادة المحاولة والاختبارات والمراجعة البشرية.
أفضل ذكاء اصطناعي للبرمجة: الخلاصة السريعة
استخدم GPT-5.6 Luna عاملاً للمهام المعتادة، وDeepSeek V4 Flash للمهام المجدولة خارج أوقات الذروة، وGemini 3.7 Flash عندما تبرر المهام الأصعب أو متعددة الوسائط تكلفة أعلى للمحاولة، وClaude Haiku 4.5 إذا كان باقي النظام يعمل بالفعل على Claude. هذه أقصر إجابة مفيدة.
النموذج ووكيل البرمجة ليسا المنتج نفسه. النموذج هو محرك الاستدلال، أما الوكيل فهو بيئة التشغيل التي تقرأ الملفات وتشغّل الأوامر وتعدّل الكود وتحافظ على السياق وتطلب الموافقة. أدوات مثل Cursor وClaude Code وCodex هي بيئات تشغيل. يعزل هذا الترتيب طبقة النموذج لأنها موضع حسم اقتصاديات الرموز وسلوك إعادة المحاولة. وإذا لم تُحسم بيئة التشغيل بعد، فارجع إلى مقارنة وكلاء البرمجة بالذكاء الاصطناعي المنفصلة.
جرى التحقق من كل سعر أدناه في وثائق المورّد المنشورة يوم 22 أغسطس 2026. أسعار الإدخال والإخراج محسوبة لكل 1 مليون رمز. جرى تسعير هذه النماذج وتحليلها، ولم تُعرض كما لو أنها اختُبرت في بيئة إنتاج خلال إعداد هذا المقال.
لا يدّعي هذا الترتيب أن الصف الأول يفوز في كل مهمة داخل كل مستودع. بل يعني أنه يمنح المطوّر أقوى وضع افتراضي من حيث الميزانية قبل توافر بيانات تقييم خاصة. قد تكون تكلفة DeepSeek أقل من Luna أو أعلى منه بحسب الساعة. وقد يصبح Gemini أقل تكلفة لكل رقعة مقبولة إذا تفادى عدداً كافياً من الدورات الفاشلة. أما Haiku فقد يكون التنفيذ الأقل مخاطرة ضمن منظومة موحّدة على Anthropic حتى لو كان سعر الرموز أعلى.
ميزانية الرقعة المقبولة تغيّر ترتيب النماذج
لا يوفر نموذج برمجة رخيص المال إلا إذا اجتازت رقعه الاختبارات وصمدت أمام المراجعة. الرموز هي عدّاد التكلفة وليست النتيجة. وقد يخسر نموذج يحتاج إلى 3 محاولات أو يكرر استدعاءات الأدوات أو يفتح دورة تصحيح طويلة أمام نموذج أغلى ينجز المهمة من المحاولة الأولى.
يمكن تسمية المقياس المفيد هنا ميزانية الرقعة المقبولة:
ميزانية الرقعة المقبولة = إجمالي الإنفاق على النموذج مقسوماً على الرقع التي تجتاز الاختبارات المطلوبة والمراجعة.
هذا ليس معياراً اختبارياً من أحد المورّدين، بل رقم تشغيلي يستطيع مالك وكيل البرمجة حسابه من استهلاك API وعملية الدمج.
لإظهار فارق السعر عملياً، افترض أن شركة تشغّل 10,000 مهمة لوكيل برمجة خلال شهر. تستهلك كل مهمة 100,000 رمز إدخال غير مخزّن مؤقتاً بين سياق المستودع والتعليمات ونتائج الأدوات، ثم 30,000 رمز إخراج بين الاستدلال والرقع والاختبارات وجولات المتابعة. يصبح عبء العمل الشهري 1 مليار رمز إدخال و300 مليون رمز إخراج. ولا يشمل الحساب التخزين المؤقت أو خصومات الدفعات أو الأدوات المدفوعة أو زمن تشغيل البيئة المعزولة أو المراجعة البشرية، حتى تبقى خطوط تكلفة الرموز الأربعة قابلة للمقارنة.

يمثل DeepSeek أوضح تحذير من ترتيب النماذج بسعر رئيسي واحد. إذا نُفّذت المهام كلها خارج الذروة، تكون التكلفة $418 للشهر المفترض، أي أقل من Luna بمقدار $142. وإذا نُفّذت كلها وقت الذروة، ترتفع إلى $836، أي أكثر من Luna بمقدار $276. فاتورة Luna أقل بنسبة 33.01% من فاتورة DeepSeek وقت الذروة. لذلك قد يدفع فريق يشغّل وكلاء تفاعليين خلال تلك النوافذ سعراً أعلى مع DeepSeek قبل أن تدخل الجودة في المقارنة.
سرعان ما تضيق أفضلية خارج الذروة عند احتساب إعادة المحاولة. تبلغ محاولة Luna الواحدة $0.056 في هذا النموذج الحسابي، مقابل $0.0418 لمحاولة DeepSeek خارج الذروة. إذا تجاوز متوسط DeepSeek 1.34 محاولة مقابل كل محاولة Luna واحدة تنتج رقعة مقبولة، تختفي الوفورات الظاهرة. وهذه عتبة منخفضة بما يكفي لأن تحسمها بضع دورات إضافية للأدوات خلال الشهر.
حالة Gemini معاكسة. تكلف محاولته بالسعر القياسي التمهيدي $0.1875، أي ما يعادل 3.35 محاولات Luna. لا يصبح Gemini النتيجة الأرخص إلا إذا حلّت محاولة واحدة منه محل أكثر من 3.35 محاولات Luna مع شكل الرموز نفسه، أو إذا أنجز مهمة لا يستطيع Luna حلها. وقد يظل مسار التصعيد الصحيح، لكن ارتفاع قدرته الخام لا يبرر جعله الخيار الافتراضي لكل الأسطول.
تبلغ تكلفة محاولة Haiku المفترضة $0.25، أي ما يعادل 4.46 محاولات Luna. لذلك لا يفوز كسعر عام. ومع ذلك، قد يكون الأفضل داخل بنية مبنية أصلاً على Claude إذا كان تغيير المورّد سيضيف من أعمال التنفيذ والتقييم والحوكمة ما يتجاوز وفورات فرق الرموز.
يغيّر التخزين المؤقت جانب الإدخال، لكن الإخراج يبقى حاسماً في دورات البرمجة. إذا أصبحت 80% من مدخلات Luna المفترضة إصابات في الذاكرة المؤقتة، تهبط فاتورة 10,000 مهمة من $560 إلى $416 قبل رسوم الكتابة الأولية إلى الذاكرة المؤقتة. أما بند الإخراج البالغ $360 فلا يتغير. ولهذا قد يتفوّق نموذج يكتب رقعة صحيحة أقصر على نموذج ذي سعر إدخال أقل.
1. GPT-5.6 Luna: أفضل خيار منخفض التكلفة لوكلاء البرمجة
GPT-5.6 Luna هو أفضل نموذج منخفض التكلفة إجمالاً لأعمال وكلاء البرمجة المعتادة، لأن سعري الإدخال $0.20 والإخراج $1.20 يأتيان الآن ضمن منظومة متكاملة لنموذج يستخدم الأدوات. يمنحه OpenAI نافذة سياق من 1,050,000 رمز، وما يصل إلى 128,000 رمز إخراج، واستدعاء الدوال، والمخرجات المنظمة، وhosted shell، وapply patch، وSkills، وMCP، والبحث عن الأدوات. فهو ليس مجرد نقطة نهاية رخيصة للنصوص، بل يستطيع أداء دور العامل في وكيل يقرأ المستودع ويعدّل الملفات ويشغّل التحقق.

وصل الأثر التجاري قبل أن تلحق به معظم تقارير مقارنة النماذج. خفّض OpenAI سعر Luna بنسبة 80% في 30 يوليو. وفي 19 أغسطس، أعلن OpenAI وReplit أن Luna يشغّل Replit Free Mode لملايين المستخدمين. يوجّه Replit العمل الذي يحتاج إلى استدلال أكثر تقدماً إلى GPT-5.6 Sol، ثم يعود إلى Luna مع الحفاظ على سياق المشروع. هذه هي البنية المفيدة: النموذج الرخيص يمتلك المسار الشائع، والنموذج الأغلى يتعامل مع عدم اليقين بدلاً من استهلاك كل رمز.
أدلة النشر هذه صادرة عن المورّدين، ولذلك ينبغي التعامل معها كأدلة منسوبة لا كاختبار مستقل. لكنها تظل وثيقة الصلة على نحو غير معتاد. تقول Ramp إن Luna أصبح خيارها الافتراضي لأتمتة الوكلاء في الخلفية. وتفيد Blitzy بأن Luna رفع إعادة استخدام التخزين المؤقت للـprompt من 24% إلى 90%، وتعامل مع سياق أكبر بمقدار 2.2x مستخدماً رموز إخراج أقل بمقدار 8.5x، وخفّض التكلفة 87% مقارنة بـGPT-5.4 mini عبر آلاف استدعاءات الإنتاج. كما تفيد Dust بأداء أسرع 40% وأقل تكلفة 40% من خيارها الافتراضي السابق على مهام الوكلاء نفسها. تدعم هذه الأمثلة نتيجة التوجيه: انضباط الإخراج وسلوك الذاكرة المؤقتة قد يكونان أهم من سعر الإدخال الظاهر.
الأنسب لـ: التنفيذ المعتاد، وكتابة الاختبارات، وإعادة الهيكلة المحدودة، والعاملين في الخلفية، والوكلاء الفرعيين ذوي الحجم الكبير
أبرز ميزة: نموذج حديث يراعي التكلفة، مع hosted shell، وapply patch، وSkills، وMCP، ومخرجات منظمة، ونافذة سياق من 1,050,000 رمز
التسعير: إدخال $0.20، وإدخال مخزّن مؤقتاً $0.02، وإخراج $1.20 لكل 1 مليون رمز
التجربة المجانية: الفئة المجانية من API غير مدعومة؛ ويقدّم Replit وضع Free Mode منفصلاً يعمل عبر Luna
- أقل خيار افتراضي سائد مخاطرة في هذه المقارنة، بتكلفة $560 لعبء العمل الشهري الموحّد
- منظومة أدوات كاملة لتنفيذ إجراءات المستودع، لا مجرد إكمالات محادثة
- 6 إعدادات لجهد الاستدلال تبدأ من none وتنتهي عند max
- حد إخراج أقصى يبلغ 128,000 رمز، مناسب للرقع الطويلة ودورات الأدوات
- حالات نشر علنية تعرض نمط العامل مع مسار التصعيد على نطاق واسع
- تكلفة الإخراج تساوي 6 أضعاف الإدخال غير المخزّن مؤقتاً
- كل طلب يتجاوز 272,000 رمز إدخال ينتقل بكامله إلى سعر إدخال 2x وسعر إخراج 1.5x
- لا توجد فئة مجانية لـAPI
- قد تشجع نافذة السياق الطويلة على إغراق النموذج بالمستودع بدلاً من الاسترجاع الدقيق
لماذا يفوز Luna بمسار المهام المعتادة
لا تعني «المعتادة» أنها تافهة، بل أن شروط القبول واضحة قبل بدء التشغيل. يمكن لتذكرة تنفيذ محددة جيداً، أو اختبار فاشل معروف الحدود، أو ترقية إحدى الاعتماديات، أو إصلاح lint، أو نقطة نهاية نمطية أن تكون جميعها مهام معتادة حتى داخل قاعدة كود كبيرة. يستطيع الوكيل استرجاع الملفات ذات الصلة، وإجراء التعديل، وتشغيل عمليات التحقق المحددة، ثم إعادة فرق التغييرات للمراجعة.
تتيح ضوابط الاستدلال في Luna لبيئة التشغيل توزيع الإنفاق بطرق مختلفة داخل النموذج نفسه. استخدم جهداً أقل للتعديلات الحتمية وارفعه عندما يحتاج الوكيل إلى التوفيق بين قيود متعددة. بهذا لا تدفع سعر نموذج طليعي لمجرد أن مهمة واحدة في الطابور غير يقينية. لكن هذا الضبط يظل بحاجة إلى تقييم، إذ قد يستهلك إعداد الاستدلال الأعلى مخرجات أكثر، والإخراج هو الجانب المكلف في تسعير Luna.
الحاجز الأساسي هو عتبة السياق الطويل. أي تلقين يتجاوز 272,000 رمز إدخال يُحاسب بضعف سعر الإدخال و1.5 ضعف سعر الإخراج للطلب كله. يقبل النموذج 1,050,000 رمز، لكن السعة لا تعني السماح بلصق مستودع كامل في كل جولة. ويمكن لطبقة استرجاع تنتقي الملفات المناسبة أن تمنع مجموعة ملفات إضافية واحدة من إعادة تسعير الطلب بكامله.
تجربة Luna لمدة أسبوع
حدّد مسار المهام المعتادة
اختر فئة مهام واحدة لها أمر اختبار واضح ومعيار مراجعة محدد. من الخيارات المناسبة إصلاحات الأخطاء المحدودة، وتوليد الاختبارات، وتحديث الاعتماديات، وإعادة الهيكلة الضيقة. لا تبدأ بإعادة تصميم البنية.
أبقِ النموذج الحالي مساراً للتصعيد
أرسل المحاولة الأولى إلى GPT-5.6 Luna. لا تصعّد إلا بعد فشل التحقق أو نقص السياق أو ظهور حالة عدم يقين محددة. حافظ على حالة المهمة حتى لا يعيد النموذج الأقوى أعمال الاستكشاف كلها.
اضبط حدود السياق والأدوات
استرجع ملفات المستودع ذات الصلة فقط. اسمح بأدوات shell وpatch التي تتطلبها المهمة، وأبقِ الإجراءات المدمرة خلف طلب الموافقة، وضع علامة على أي طلب يتجاوز عتبة السعر عند 272,000 رمز.
سجّل ميزانية الرقعة المقبولة
سجّل لكل مهمة الإدخال، والإدخال المخزّن مؤقتاً، والإخراج، وعدد المحاولات، والاختبارات، ودقائق المراجعة، وما إذا دُمجت الرقعة. الإنفاق على النموذج من دون بيانات القبول لا يثبت أن المسار رخيص.
انقل الفئة الناجحة فقط
بعد التجربة، وجّه إلى Luna فئة المهام التي حققت معيار الجودة والمراجعة. وأبقِ العمل الفاشل والملتبس وعالي العواقب على مسار التصعيد.
اختر Luna عندما تريد الشركة API واسع الدعم وأدوات وكلاء حديثة ومساراً شائعاً رخيصاً. ولا تستخدمه نموذجاً وحيداً إذا كانت المهام تتطلب باستمرار حكماً معمارياً أو تغييرات أمنية حرجة أو سياق مستودع يتجاوز عتبة تسعيره. الإجابة الصحيحة هناك هي مسار توجيه، لا فاتورة افتراضية أكبر.
2. DeepSeek V4 Flash: الأفضل لأعمال الوكلاء المجدولة خارج الذروة
DeepSeek V4 Flash هو أرخص مسار قادر ضمن هذه القائمة، ولكن فقط عندما يصل العمل خارج أوقات الذروة. سعره المنشور هو $0.22 للإدخال و$0.66 للإخراج خارج الذروة، ثم $0.44 و$1.32 وقت الذروة. يجعله جدول الأسعار مناسباً لتوليد الاختبارات ليلاً، وعمليات الترحيل الموضوعة في طابور، وفهرسة المستودعات، ومهام الصيانة القابلة لإعادة المحاولة. لكنه أضعف كخيار افتراضي لفريق عالمي تفاعلي يتبع طلبه ساعات العمل.

يعرّف DeepSeek الذروة بأنها من 01:00 إلى 04:00 UTC ومن 06:00 إلى 10:00 UTC، وكل الساعات الأخرى خارج الذروة. وتذكر صفحة الأسعار أيضاً أن احتساب خارج الذروة طوال عطلة نهاية الأسبوع يبدأ عند 00:00 بتوقيت بكين في 23 أغسطس 2026. بذلك تتحول الجدولة إلى أداة هندسية: فالطابور القادر على الانتظار يحصل على سعر نموذج مختلف عن المطوّر الذي ينتظر داخل محرر.
V4 Flash ليس مصنّفاً صغيراً. يسرد DeepSeek سياقاً من 1,000,000 رمز، وحد إخراج أقصى يبلغ 384,000 رمز، ومخرجات JSON، واستدعاءات الأدوات، وResponses API، وواجهة API متوافقة مع Anthropic، وإكمال FIM في وضع non-thinking. ويقول المورّد إن استدلاله يقترب من V4 Pro وإنه يطابق V4 Pro في مهام الوكلاء البسيطة. كما يسمّي DeepSeek تكاملات Claude Code وOpenClaw وOpenCode. تظل هذه ادعاءات للمورّد، لكنها تصف السطح الصحيح لتقييم وكيل برمجة.
الأنسب لـ: صيانة الكود المجدولة، وتوليد الاختبارات خارج الذروة، وتحويلات المستودعات، والفرق التي تريد API على هيئة OpenAI أو Anthropic
أبرز ميزة: نموذج وكلاء بسياق من 1,000,000 رمز، وتسعير خارج الذروة $0.22/$0.66، وحد تزامن يبلغ 2,500
التسعير: خارج الذروة: إصابة ذاكرة مؤقتة $0.007، وإخفاق ذاكرة مؤقتة $0.22، وإخراج $0.66؛ وقت الذروة: إصابة ذاكرة مؤقتة $0.014، وإخفاق ذاكرة مؤقتة $0.44، وإخراج $1.32
التجربة المجانية: لا تعرض صفحة الأسعار الحالية فئة مجانية دائمة
- أقل تكلفة شهرية مفترضة هنا عندما تُشغّل كل المهام خارج الذروة
- دعم JSON واستدعاءات الأدوات وResponses API وAnthropic API وFIM
- سياق من 1,000,000 رمز وحد إخراج أقصى يبلغ 384,000 رمز
- يمكن للتسعير المعتمد على الوقت أن يكافئ الطابور غير المتزامن فعلاً
- حد معلن يبلغ 2,500 طلب متزامن، مناسب للتقييم واسع النطاق
- يرفع سعر الذروة تكلفة الشهر الموحّد 49.29% فوق Luna
- يعتمد الوصول إلى أقل سعر على الجدولة، لا على اختيار النموذج وحده
- يحتفظ DeepSeek بحق تغيير الأسعار
- لا يلغي توافق المورّد مراجعة المشتريات والخصوصية ومخاطر الخدمة
الساعة جزء من البنية
يستطيع فريق المنصة جدولة مهام تحديث الكود التي تعمل بعد الدمج. أما المطوّر الذي يطلب من وكيل إصلاح بناء فاشل أثناء ساعات العمل فلا يستطيع الانتظار. لذلك لا ينبغي أن تشترك الحالتان في افتراض سعري واحد.
تكلف المحاولة الموحّدة خارج الذروة $0.0418، مقابل $0.056 لـLuna. وهذا لا يمنح DeepSeek سوى هامش جودة يبلغ 1.34 محاولة. فإذا احتاج في المتوسط إلى دورة استكشاف أو تصحيح إضافية بما يرفع المتوسط فوق هذه العتبة، يصبح Luna أقل تكلفة لكل رقعة مقبولة حتى قبل انتقال الساعة إلى الذروة. وفي الذروة، يتجاوز DeepSeek بالفعل تكلفة Luna مع توزيع الرموز المفترض.
لا يجعل ذلك DeepSeek مجرد خيار هامشي، بل يوضح موضع فوزه. ضع العمل القابل لإعادة المحاولة وغير العاجل خلف طابور، وسجّل نافذة الفوترة في القياسات، واحتفظ بـLuna أو بالمورّد الحالي للمسار التفاعلي. هكذا تحصل المؤسسة على اقتصاديات خارج الذروة من دون ربط زمن استجابة المطوّر بتقويم الأسعار.
الحاجز الثاني هو استقرار السعر. يحتفظ DeepSeek صراحة بحق تغيير الأسعار ويطلب من العملاء مراجعة الصفحة الحالية. هذا التنبيه مهم لأن بنية وكيل البرمجة تستطيع نقل حصة كبيرة من الرموز سريعاً إلى مورّد واحد. ضع معرّف النموذج والمورّد ونافذة الفوترة ونتيجة الرقعة المقبولة في السجل نفسه، حتى يؤدي تغير السعر إلى قرار توجيه بدلاً من فاتورة مفاجئة.
اختر DeepSeek عندما يجعل الطابور غير المتزامن وأدوات التحقق القوية الخصم الزمني حقيقياً. ولا تجعله المسار الوحيد إذا كانت الاستجابة التفاعلية أو قابلية توقع تكلفة الوحدة السنوية أو علاقة شراء ثابتة أهم من وفر خارج الذروة.
3. Gemini 3.7 Flash: أفضل تصعيد اقتصادي للعمل الصعب ومتعدد الوسائط
Gemini 3.7 Flash هو النموذج الذي تضيفه عندما يواصل العامل الرخيص الإخفاق في الكود المعقد أو مهام تحويل التصميم إلى كود أو أدلة المستودع متعددة الوسائط. تصفه Google بأنه متاح بشكل عام وتضعه للبرمجة المعقدة وسير عمل الوكلاء والتنفيذ الموثوق متعدد الخطوات. يقبل النصوص والصور والفيديو والصوت وملفات PDF، ويدعم بعد ذلك تنفيذ الكود واستدعاء الدوال والمخرجات المنظمة والبحث في الملفات ومستويات التفكير low أو medium أو high.

التسعير منافس جداً، لكنه مؤقت. تبلغ تكلفة الفئة القياسية المدفوعة $0.75 للإدخال و$3.75 للإخراج حتى 31 ديسمبر 2026. وفي 1 يناير 2027، تصبح الأسعار $1.50 و$7.50. لذلك ترتفع الفاتورة الشهرية الموحّدة من $1,875 إلى $3,750 من دون أي تغيير في حركة الاستخدام. وبناء ميزانية سنوية على السعر التمهيدي وحده خطأ من الأساس.
تقول Google إن النموذج يحسّن أعمال هندسة البرمجيات والوكلاء في الواقع، بما في ذلك حل المشكلات ودورات الوكلاء الفاشلة. مستوى التفكير medium هو الإعداد الافتراضي وتوصية Google للكود المعقد واستخدامات الوكلاء. وقد يحسن high الاستدلال الصعب، لكنه يزيد استهلاك الرموز والتكلفة. لذلك يصلح Gemini نموذجاً للتصعيد: لا يبدأ هذا المسار إلا بعدما تثبت محاولة أرخص أن المهمة تستحق مزيداً من الاستدلال.
الأنسب لـ: التحقيق في الأخطاء المعقدة، وأعمال الواجهات متعددة الوسائط، وتدقيق مطابقة التصميم، ودورات الأدوات الصعبة، ومسار اقتصادي مؤقت بقدرة أعلى
أبرز ميزة: نموذج متعدد الوسائط متاح عموماً بسياق من 1,048,576 رمز، مصمم للبرمجة والوكلاء، ويضم تنفيذ الكود ومستويات تفكير قابلة للضبط
التسعير: فئة مجانية؛ والفئة القياسية المدفوعة $0.75 للإدخال و$3.75 للإخراج حتى 31 ديسمبر 2026، ثم $1.50 و$7.50
التجربة المجانية: نعم، لكن محتوى الفئة المجانية يُستخدم لتحسين منتجات Google، بخلاف محتوى الفئة المدفوعة
- مصمم صراحة للبرمجة وسير عمل الوكلاء والتنفيذ متعدد الخطوات
- يدعم إدخال النصوص والصور والفيديو والصوت وملفات PDF
- تنفيذ الكود واستدعاء الدوال والمخرجات المنظمة والبحث في الملفات
- حد إدخال يبلغ 1,048,576 رمزاً وحد إخراج يبلغ 65,536 رمزاً
- تجعل الفئة المجانية تقييم المدخلات المنقحة منخفض التكلفة
- يتضاعف السعر المدفوع التمهيدي في 1 يناير 2027
- يُستخدم محتوى الفئة المجانية لتحسين منتجات Google
- يزيد مستوى التفكير high استهلاك الرموز والتكلفة
- يتطلب الانتقال إزالة عدة إعدادات قديمة للتوليد والرسائل المسبقة للنموذج
استخدم Gemini لتقليص تكلفة الدورات الفاشلة
تبلغ تكلفة محاولة Gemini المفترضة $0.1875 حتى 31 ديسمبر، أي ما يعادل 3.35 محاولات Luna. يستحق النموذج مكانه عندما تحل محاولة واحدة محل أكثر من 3.35 محاولات رخيصة، أو عندما يعالج نوع إدخال لا يستطيع المسار المعتاد التعامل معه، أو عندما تكون للمهمة الصعبة عواقب تجارية تبرر المحاولة الأولى الأعلى تكلفة.
يُعد إصلاح مطابقة التصميم مثالاً عملياً. يستطيع الوكيل فحص لقطة شاشة أو ملف PDF وقراءة التنفيذ وتشغيل الكود وإرجاع نتيجة منظمة. يقبل Luna إدخال الصور أيضاً، لذلك لا يحسم تعدد الوسائط القرار وحده. ينقلب القرار عندما يثبت التقييم أن Gemini ينتج إصلاحات مقبولة أكثر أو يقلل دورات المراجعة بوضوح في فئة المهام نفسها.
الفئة المجانية مخصصة للتقييم بمدخلات منقحة، وليست الخيار الافتراضي لبيانات المستودعات الخاصة. تنص صفحة Google الحالية على استخدام محتوى الفئة المجانية لتحسين منتجاتها، وعلى عدم استخدام محتوى الفئة المدفوعة لذلك. فسعر الرموز الصفري لا يعلو على متطلبات حماية الكود.
هناك أيضاً حاجز الترحيل. تطلب Google من الفرق المنتقلة إلى Gemini 3.7 Flash إزالة temperature وtop_p وtop_k وcandidate_count والرسائل المسبقة للنموذج، ثم استبدال thinking_budget بـthinking_level. قد يكون النموذج أرخص من مسار طليعي، لكن تغييرات التكامل تظل جزءاً من تكلفة التحويل.
اختر Gemini عندما تنجح فئة محددة من المهام الصعبة أو متعددة الوسائط في تجاوز عتبة الرقعة المقبولة. ولا تجعله الخيار الافتراضي المعتاد إذا كان Luna أو DeepSeek خارج الذروة ينجح بالفعل، ولا تستخدم فئته المجانية للكود المملوك.
4. Claude Haiku 4.5: أفضل وكيل فرعي اقتصادي لمنظومة Claude
Claude Haiku 4.5 هو النموذج منخفض التكلفة المناسب عندما تكون منظومة الوكلاء المحيطة مبنية بالفعل على Claude، وتكون المهمة سريعة ومباشرة وكبيرة الحجم. توصي Anthropic نفسها بالبدء مع Haiku كخيار يعطي الأولوية للكفاءة في التنفيذ الحساس للتكلفة وأعمال الوكلاء الفرعيين. تبلغ تكلفة النموذج $1 للإدخال و$5 للإخراج، وتصل نافذة سياقه إلى 200,000 رمز، ويدعم extended thinking، وهو الأسرع استجابةً في مصفوفة نماذج Anthropic الحالية.

لا يفوز Haiku بسباق السعر العام. يكلف الشهر الموحّد $2,500، أو $0.25 لكل محاولة، وهو ما يعادل 4.46 محاولات Luna. لا ينبغي لفريق يبدأ من الصفر أن يدفع هذا المضاعف لمجرد استخدام علامة مألوفة. لكن فريقاً موحّداً على Anthropic قد يصل إلى نتيجة مختلفة، لأن التلقينات ومخططات الأدوات والتقييمات والرصد وعقود السحابة والنماذج الاحتياطية ربما تكون قائمة بالفعل.
أقوى أدواره هو أن يعمل تحت Claude Sonnet 5 أو Opus 5. يتولى Haiku تصنيف المستودع، وإعداد هياكل الاختبارات، وملخصات التغييرات، وجولات المراجعة البسيطة، وغيرها من المهام الفرعية المقيدة. ويتولى Sonnet أو Opus حالات عدم اليقين المعمارية والعمل المستقل الطويل. تكشف أسعار Anthropic الحالية هذا السلم بوضوح: Sonnet 5 بسعر $2/$10، وOpus 5 بسعر $5/$25، وFable 5 بسعر $10/$50.
الأنسب لـ: الوكلاء الفرعيين ضمن Claude، والمراجعة السريعة، وتصنيف المستودعات، وبناء هياكل الاختبارات، والمهام المباشرة كبيرة الحجم
أبرز ميزة: أسرع نموذج حالي لدى Anthropic، مع extended thinking ومسار تصعيد مباشر إلى Sonnet 5 أو Opus 5
التسعير: إدخال $1، وإصابات ذاكرة مؤقتة $0.10، وإخراج $5 لكل 1 مليون رمز
التجربة المجانية: يحصل مستخدمو API الجدد على قدر صغير من الرصيد المجاني
- ينسجم مباشرة مع مخططات أدوات Claude وحزم التقييم القائمة
- توصي به Anthropic للأعمال التي تعطي الأولوية للكفاءة وتعمل بحجم كبير، ولأعمال الوكلاء الفرعيين
- تكلف إصابات الذاكرة المؤقتة عُشر سعر الإدخال القياسي
- يتوافر extended thinking عندما تحتاج مهمة محدودة إلى عمل أعمق
- حد إخراج أقصى يبلغ 64,000 رمز، ويدعم رقعاً ومراجعات كبيرة
- التكلفة الشهرية الموحّدة البالغة $2,500 هي أعلى سعر حالي في هذا الترتيب
- سياق 200,000 رمز أصغر بكثير من البدائل التي تقارب 1,000,000 رمز
- يحتاج إلى محاولات أقل بمقدار 4.46x من Luna حتى يفوز بفاتورة الرموز الموحّدة وحدها
- يرجع الحد الزمني لمعرفته الموثوقة إلى فبراير 2025، وهو أقدم من نماذج Claude الطليعية الحالية
حاجز السياق هو ما يحدد الدور
تكفي نافذة 200,000 رمز للملفات المختارة وطلب التغيير ومخرجات الأدوات ودورة المراجعة. لكنها أقل ملاءمة لوكيل طويل العمر يحتفظ بمستودع كبير كامل وسجل ممتد في تلقين واحد. يعزز هذا الحد دور الوكيل الفرعي: أعطِ Haiku الملفات المحددة وقاعدة القبول، بدلاً من مطالبته بامتلاك الاستكشاف والبنية والتنفيذ والمراجعة في سياق واحد.
قد يجعل التخزين المؤقت للـprompt تعليمات المستودع المتكررة أقل تكلفة. تبلغ إصابات ذاكرة Haiku المؤقتة $0.10 لكل مليون رمز، بينما تكلف كتابة ذاكرة لمدة 5 دقائق $1.25، وكتابة ساعة واحدة $2. قد يسترد السياق المستقر والمتكرر كلفته، بخلاف السياق المستخدم مرة واحدة. وينبغي للتطبيق تسجيل إنشاء الذاكرة المؤقتة وقراءاتها كلٌ على حدة، بدلاً من افتراض انطباق أقل سعر على كل الإدخال.
اختر Haiku لمهام العامل المقيدة داخل منظومة Claude. وتجنبه للاستقلالية على مستوى المستودع كله، أو عند بناء API منخفض التكلفة من الصفر، أو لأي عبء عمل تُجبر فيه نافذة 200,000 رمز النظام على إعادة بناء السياق مراراً.
أي نموذج يناسب كل حالة؟
الاختيار قاعدة توجيه، لا فائز دائم. امنح كل نموذج أصغر مهمة يستطيع فيها إنتاج رقعة مقبولة بصورة موثوقة.

على مؤسس ممول يبني منتج وكلاء أن يبدأ بـLuna. فهو يبقي المسار الشائع عند $0.056 لكل محاولة مفترضة ويحافظ على منظومة أدوات كاملة. ولا تضف Gemini إلا لفئة مهام يكون فيها انخفاض الدورات الفاشلة كافياً لتبرير تكلفة المحاولة البالغة 3.35x.
على مدير تقني في شركة متوسطة لديه طابور ليلي أن يقيّم DeepSeek. ضع عمليات الترحيل وتوليد الاختبارات والصيانة القابلة لإعادة المحاولة في نوافذ خارج الذروة. ضع ميزانية الاستخدام التفاعلي للمطورين على أساس سعر الذروة، ثم قرر إن كان مورّد واحد أو اثنان ينتج نظام تشغيل أبسط.
على المشغّل الخبير الذي يستخدم لقطات الشاشة وملفات PDF والكود معاً أن يضيف Gemini. تجعله المدخلات متعددة الوسائط وتنفيذ الكود مرشحاً أقوى عندما تضم المهمة أدلة من الواجهة أو عدة أنواع من الأدلة. وأبقِ قفزة سعر يناير ضمن دراسة الجدوى.
على مجموعة هندسية موحّدة على Claude إبقاء Haiku في طبقة العامل. قد تفوق إعادة استخدام التعاقد الحالي مع Claude فرق الرموز في العمل المقيد. لكن لا تسمح لألفة المورّد بتوسيع Haiku إلى مهام طويلة السياق أو شديدة الاستقلالية لم يُختر من أجلها.
على المطوّر التقني الفردي تجنب بنية من 4 مورّدين منذ اليوم الأول. ابدأ بـLuna والنموذج الطليعي الاحتياطي الحالي. لا تضف DeepSeek إلا عند وجود طابور قابل للجدولة، ولا Gemini إلا عند فشل فئة صعبة محددة، ولا Haiku إلا عندما تتطلب الأداة Claude بالفعل.
قاعدة التحويل الصريحة بسيطة: أبقِ العامل الأرخص ما دام يحقق معيار الرقعة المقبولة والمراجعة. وصعّد عندما تجعل المحاولات الفاشلة أو عبء المراجعة أو حدود السياق أو نوع الوسائط أو المخاطر النموذج التالي أقل تكلفة على مستوى النتيجة.
كيف اختيرت أفضل نماذج الذكاء الاصطناعي للبرمجة؟
يكافئ هذا الترتيب ميزانية قابلة للدفاع لوكيل البرمجة، لا أقل سعر منفرد للرمز. دخلت 4 نماذج القائمة لأن كلاً منها يمتلك قراراً مختلفاً، ولأن التفاصيل المباشرة المنشورة تكفي لتحديد سعره وسياقه ومنظومة أدواته وحدوده.
يعتمد التقييم على 5 معايير:
- اقتصاديات الرقعة المقبولة: يُوحّد إنفاق الرموز على عبء العمل نفسه المؤلف من 10,000 مهمة، ثم يُقارن مع نقطة تعادل إعادة المحاولة.
- منظومة الوكيل: تفوق أهمية استدعاءات الأدوات والمخرجات المنظمة وإجراءات المستودع وواجهات API المتوافقة جودة المحادثة وحدها.
- تسعير السياق: يُعامل الحد الأقصى للنافذة وحد السعر المترتب على استخدامها كعاملين منفصلين.
- الملاءمة التشغيلية: يمكن للجدولة وأعمال الترحيل وألفة المورّد وشروط الخصوصية ومسارات التصعيد أن تعكس قراراً مبنياً على الرموز وحدها.
- استدامة السعر: تدخل أسعار أوقات اليوم والزيادات المجدولة في الترتيب الآن، لا كملاحظات مؤجلة.
جرى التحقق من الصفحات يوم 22 أغسطس 2026. لم يُوصف أي نموذج بأنه خضع للاختبار خلال إعداد المقال. وتظل نتائج الإنتاج التي نشرها المورّدون منسوبة إلى الشركات التي أصدرتها. أما الإضافة الأصلية فهي عبء العمل الموحّد وميزانية الرقعة المقبولة ونقطة تعادل الإعادة المحسوبة من الأسعار المنشورة.
تقتصر القائمة عمداً على 4 نماذج. يحتاج مشتري طبقة النموذج إلى أسعار كاملة وحدود للفشل وقواعد للتوجيه، لا إلى كتالوج يخلط محركات النماذج ببيئات تشغيل الوكلاء. لذلك تفيد 4 قرارات شراء مكتملة أكثر من صف أطول من الأسماء.
وتستبعد القائمة أيضاً الأوزان المحلية. فتشغيل نموذج محلي يستبدل إنفاق الرموز بتكلفة الأجهزة والطاقة والصيانة والتزامن. يغطي دليل نماذج البرمجة المحلية جانب الأجهزة، بينما يغطي تحليل أرخص API للذكاء الاصطناعي أعباء العمل غير البرمجية وخيارات البوابات.
نماذج وخيارات ينبغي تجنبها
تجنب DeepSeek من دون خطة لنوافذ الفوترة
لا يملك DeepSeek سعراً رخيصاً ثابتاً. ضع في الميزانية $0.22/$0.66 خارج الذروة و$0.44/$1.32 وقت الذروة. وإذا تعذر على التطبيق تغيير توقيت العمل، فقيّمه أولاً بسعر الذروة. جدول بيانات يطبق سعر خارج الذروة على حركة تفاعلية ليس ميزانية.
تجنب التعامل مع سعر Gemini التمهيدي كأنه دائم
ينتقل Gemini 3.7 Flash من $0.75/$3.75 إلى $1.50/$7.50 في 1 يناير 2027. وتتضاعف الفاتورة الشهرية الموحّدة من $1,875 إلى $3,750. لا تعتمد المسار إلا إذا ظل مجدياً بالسعر اللاحق أو امتلك بديلاً موثقاً.
تجنب الفئة المجانية للكود المصدري الخاص
تقول Google إن محتوى فئة Gemini المجانية يُستخدم لتحسين منتجاتها، بخلاف محتوى الفئة المدفوعة. استخدم مدخلات مولّدة أو عامة أو منقحة في التقييم المجاني. وانقل الكود المملوك إلى مسار مدفوع بشروط معتمدة قبل الإنتاج.
تجنب اعتماد نموذج طليعي عاملاً افتراضياً
يأتي Claude Sonnet 5 بسعر $2/$10، وOpus 5 بسعر $5/$25، وFable 5 بسعر $10/$50. وقد تكون هذه النماذج مسار التصعيد الصحيح للعمل الصعب. لكن دفع تلك الأسعار مقابل كل اختبار مباشر أو ملخص أو تعديل محدود يهدر فرصة التوجيه التي صنعتها النماذج الرخيصة القادرة.
تجنب ملء كل نافذة سياق
يقبل Luna مقدار 1,050,000 رمز، لكن أي طلب يتجاوز 272,000 رمز إدخال يُعاد تسعيره بالكامل. كما يوفّر Gemini وDeepSeek نوافذ تقارب 1,000,000 رمز. جودة الاسترجاع وحجم السياق شيئان مختلفان. أضف مواد المستودع لأن رقعة فاشلة أثبتت غيابها، لا لمجرد أن النموذج يقبلها.
تجنب قياس النجاح أو الفشل وحدهما
قد تجتاز الرقعة الاختبارات ومع ذلك تستلزم مراجعة طويلة أو تخفي خياراً تصميمياً محفوفاً بالمخاطر. سجّل دقائق المراجعة وعدد الإعادات والتراجع والتصعيد إلى جانب الاختبارات. النموذج الأرخص هو ما يخفض ميزانية الرقعة المقبولة كاملة من دون خفض المعيار الهندسي.
خطوة يوم الاثنين
في الأسبوع المقبل، مرّر 100 مهمة ممثلة عبر سلّم نماذج صغير وقابل للتراجع. الهدف ليس معياراً اختبارياً عاماً، بل قرار تشغيلي واحد عن مستودع واحد وفئة مهام واحدة.
اختر فئة مهام واحدة قابلة للتكرار
استخدم فئة محدودة مثل توليد الاختبارات أو تحديث الاعتماديات أو إصلاح الأخطاء الصغيرة أو تلخيص المستودعات. حدّد الاختبارات المطلوبة ومعيار المراجعة والإجراءات المحظورة قبل الاستدعاء الأول.
شغّل Luna كعامل مرجعي
أرسل كل مهمة إلى GPT-5.6 Luna مع أصغر سياق ذي صلة والأدوات المطلوبة. وأبقِ النموذج الأقوى الحالي مسار تصعيد يحافظ على الحالة بعد فشل التحقق أو ظهور حالة عدم يقين محددة.
أضف منافساً واحداً لسبب واضح
استخدم DeepSeek لطابور قابل للجدولة خارج الذروة، أو Gemini للمهام الصعبة أو متعددة الوسائط، أو Haiku لوكيل فرعي ضمن Claude. لا تضف كل نموذج لمجرد أن API متاح.
قِس ميزانية الرقعة المقبولة
سجّل الإدخال والإدخال المخزّن مؤقتاً والإخراج وعدد المحاولات وزمن التنفيذ الفعلي والاختبارات ودقائق المراجعة والتصعيد والدمج والتراجع. ولا تقسم إجمالي إنفاق النموذج على الرقع المقبولة إلا بعد اكتمال المراجعة.
وجّه الفائز واحتفظ بمسار للرجوع
انقل فئة المهام الناجحة وحدها. واحتفظ بالمسار الاحتياطي وسجلات السياق ومعرّف النموذج حتى يمكن تقييم تغيير سعر أو تراجع أداء أو إصدار جديد من دون إعادة بناء سير العمل.
هذه هي نتيجة انخفاض أسعار نماذج الوكلاء: لم تعد الشركة مضطرة إلى منح نموذج غالٍ واحد كل العمل. خطوة الاثنين هي تحويل مجموعة النماذج إلى سلّم تشغيل مقاس بالبيانات، يضم عاملاً رخيصاً وقاعدة تصعيد دقيقة وميزانية للرقعة المقبولة يستطيع فريق المالية تدقيقها.
الأسئلة الشائعة
ما أرخص نموذج ذكاء اصطناعي للبرمجة؟
DeepSeek V4 Flash هو الأرخص خارج الذروة ضمن هذه المجموعة المؤلفة من 4 نماذج، بسعر $0.22 للإدخال و$0.66 للإخراج لكل مليون رمز. ويكون GPT-5.6 Luna أرخص خلال ساعات ذروة DeepSeek على عبء عمل وكيل البرمجة الموحّد، لذلك تحسم الساعة ونسبة إعادة المحاولة الإجابة.
ما أفضل وكيل برمجة بالذكاء الاصطناعي لميزانية محدودة؟
افصل بين بيئة تشغيل الوكيل والنموذج. استخدم بيئة تشغيل قادرة مع GPT-5.6 Luna عاملاً للمهام المعتادة، واحتفظ بنموذج أقوى للتصعيد، وقِس تكلفة الرقعة المقبولة بدلاً من اختيار الوكيل بحسب سعر مقعده الشهري وحده.
ما الذكاء الاصطناعي المجاني بالكامل للبرمجة؟
يملك Gemini 3.7 Flash فئة مجانية، ويقدّم Replit وضع Free Mode منفصلاً يعمل عبر Luna. لكن المجاني يظل خاضعاً للحصص وحدود المنتج وشروط البيانات؛ ويُستخدم محتوى فئة Google المجانية لتحسين منتجاتها، لذلك ينبغي وضع الكود المملوك على مسار مدفوع ومعتمد.
ما أفضل نموذج ذكاء اصطناعي محلي للبرمجة في 2026؟
يغطي هذا الترتيب واجهات API مستضافة ومنخفضة التكلفة. وللإعداد المحلي، تتناول مقارنة نماذج البرمجة المحلية المخصصة مقايضات الأجهزة والقدرات؛ تبدأ الأوزان المحلية من دون فاتورة رموز، لكنها تظل بحاجة إلى الذاكرة والطاقة والصيانة وبيئة تشغيل آمنة.
نزّل قائمة تدقيق سير عمل الأعمال بالذكاء الاصطناعي، وحوّل سلّم النماذج هذا إلى تقييم توجيه مدته أسبوع واحد.
2 سبتمبر 2026






