Groq pricing في 2026: معدل المعالجة، لا تكلفة الرموز، يفرض الترقية

دليل Groq pricing لعام 2026: قارن خطة Free وDeveloper وأسعار النماذج وحدود الاستخدام وخصومات Batch، واعرف متى تصبح الترقية الخيار العملي لعملك.

Thursday, September 3, 2026Omid Saffari
Groq pricing في 2026: معدل المعالجة، لا تكلفة الرموز، يفرض الترقية

تبدأ تكلفة Groq، أو Groq pricing، من $0 إلى أن تعطل الحدود الخاصة بكل نموذج في خطة Free سير عملك؛ بعد ذلك، لا تفرض Developer اشتراكًا، بل تحاسب على الاستخدام فقط. وفي حمل محسوب على GPT-OSS 120B، لا يعادل الحد اليومي المجاني للرموز سوى $1.44 شهريًا من الاستخدام المدفوع، لذلك فإن معدل المعالجة، لا الإنفاق على الرموز، هو ما يفرض الترقية.

Groq pricing: الأسعار والخطط باختصار

لا يوجد في Groq سعر شهري ثابت لكل مستخدم تحتاج إلى حفظه. الاختيار هو بين خطة Free محدودة المعدل، وخطة Developer بالدفع حسب الاستخدام، وسعة Enterprise المخصصة.

تم التحقق من هذه الأسعار والحدود بالرجوع إلى صفحة أسعار Groq المباشرة، والنماذج المدعومة، والأسئلة الشائعة حول الفوترة، ووثائق حدود المعدل في 15 أغسطس 2026.

صفحة أسعار Groq المباشرة وبها أسعار النماذج والأدوات المدمجة
أسعار Groq بعد التحقق منها في أغسطس 2026
الخطةالسعرالسعةالأنسب لها
Free$0حدود للمؤسسة تختلف حسب النموذجالتقييم والاستخدام الداخلي الخفيف
Developerبلا اشتراك أساسي؛ الفوترة حسب الاستخدامحدود أساسية للنماذج النصية تصل إلى 300K TPM و1K RPMبيئات الإنتاج ذاتية الخدمة
Enterpriseسعة مخصصة يجري توفيرها حسب الاتفاقحزم متعاقد عليها للإدخال والإخراجالمسارات الحرجة التي تحتاج إلى SLA

الرمز هو الوحدة التي يحاسب النموذج عليها. تشمل رموز الإدخال التعليمات وسجل المحادثة والمستندات وتعريفات الأدوات المرسلة إلى النموذج، أما رموز الإخراج فهي ما يولده النموذج. تسعّر Groq كلا النوعين لكل مليون رمز، ومن ثم تكون التكلفة الشهرية مجموع الإدخال والإخراج والصوت وأي استخدام للأدوات المدمجة.

لا ترتبط Developer بالتزام اشتراك شهري أو سنوي. تطلب Groq وسيلة دفع، وتقيس الاستخدام، وتصدر الفواتير عادة بعد الاستهلاك. ولا يوجد سعر منفصل لتجاوز الحصة: تمنع Free الحركة الزائدة عند بلوغ الحد المطبق، بينما تواصل Developer احتساب الاستخدام بأسعار النموذج نفسها إلى أن يوقفه حد الحساب أو Spend Limit. أما Enterprise Performance فتعمل بطريقة مختلفة؛ إذ يشتري العميل سعة مخصصة للإدخال والإخراج بدلًا من دفع سعر الرموز العام عند الطلب.

خطة Free مفيدة إلى أن يتحول أحد حدودها المشتركة إلى اعتماد إنتاجي

يمكن لخطة Groq Free تشغيل نموذج أولي، أو مساعد داخلي، أو قدر مفيد على نحو لافت من الأتمتة منخفضة الحجم. لكنها تتوقف عن كونها بنية تحتية مجانية في اللحظة التي يصبح فيها خطأ حد المعدل حدثًا يراه العميل.

تُطبق الحدود على المؤسسة، لا على كل مفتاح API. لذلك، لا يؤدي إنشاء مفاتيح إضافية إلى مضاعفة السعة. وتفرض Groq عدة أبعاد في الوقت نفسه: الطلبات في الدقيقة، والطلبات في اليوم، والرموز في الدقيقة، والرموز في اليوم. وأول سقف يتم بلوغه يمنع الطلب التالي ويرجع HTTP 429.

تشمل حدود Free المنشورة للنماذج النصية الإنتاجية الحالية ما يلي:

  • GPT-OSS 120B وGPT-OSS 20B: 30 RPM و1,000 RPD و8,000 TPM و200,000 TPD.
  • Llama 3.3 70B Versatile: 30 RPM و1,000 RPD و12,000 TPM و100,000 TPD.
  • Llama 3.1 8B Instant: 30 RPM و14,400 RPD و6,000 TPM و500,000 TPD.
  • Compound وCompound Mini: 30 RPM و250 RPD و70,000 TPM.
  • Whisper Large V3 وTurbo: 20 RPM و2,000 RPD و7,200 ثانية صوتية في الساعة و28,800 ثانية صوتية في اليوم.

تصف Groq هذا الجدول العام بأنه ملخص عالي المستوى. وتظل صفحة Limits داخل Console هي المرجع المعتمد للحصة الحالية الخاصة بكل مؤسسة.

غالبًا ما يُستنفد سقف الرموز اليومي قبل عدد الطلبات. لنأخذ طلبًا على GPT-OSS 120B يضم 2,000 رمز إدخال و500 رمز إخراج. بإجمالي 2,500 رمز، يسمح حد 200,000 TPD بتنفيذ 80 طلبًا مماثلًا يوميًا. أما سقف 8,000 TPM فيسمح بثلاثة طلبات خلال دقيقة واحدة؛ وسيتجاوز طلب رابع بالحجم نفسه تقريبًا حد الرموز رغم أن الخطة تعلن 30 RPM.

هنا تقع نقطة الانتقال من المجاني إلى المدفوع. يكلف الطلب نفسه $0.0006 على Developer، أي إن تنفيذ 80 طلبًا يوميًا طوال شهر من 30 يومًا يكلف نحو $1.44. لا يوجد سبب مالي وجيه لتطويع سير عمل إنتاجي حول سقف Free؛ فالترقية تشتري السعة بينما تظل فاتورة النموذج أقل من معظم إضافات SaaS.

مسار قرار يبدأ من Groq Free ثم Developer وينتهي عند Enterprise لحمل محسوب على GPT-OSS 120B
في الطلب المحسوب بحجم 2,500 رمز، تبلغ Free حد 80 طلبًا يوميًا، بينما تكلف الحركة الشهرية نفسها نحو $1.44 على Developer

من يمكنه الاستمرار بلا دفع

قد لا تحتاج إلى Developer مطلقًا إذا اقتصر استخدام Groq على التطوير المحلي، أو التقييم العرضي، أو برنامج نصي داخلي شخصي، أو عرض تجريبي تبقى حركته دون حدود الرموز والطلبات المطبقة. وتناسب Free أيضًا الحالات التي يمكن فيها انتظار إعادة المحاولة بعد خطأ 429 من دون وعد أحد بخدمة مستمرة.

ادفع عندما يصبح لسير العمل مستخدم أو موعد نهائي أو قائمة انتظار لا تحتمل الحد المشترك. كما تضيف Developer ميزات Batch وFlex ودعم المحادثة وSpend Limits. هذه الضوابط التشغيلية، لا كتالوج نماذج مختلف، هي الحد الفاصل عمليًا.

جميع أسعار نماذج Groq الحالية

كتالوج Groq الإنتاجي الحالي مختصر: أربعة نماذج نصية، ونموذجان لتحويل الكلام إلى نص، ونظاما Compound. ويوجد كتالوج Preview منفصل لنماذج قد تختفي خلال مهلة قصيرة.

النماذج النصية الإنتاجية

  • يكلف Llama 3.1 8B Instant مبلغ $0.05 للإدخال و$0.08 للإخراج لكل مليون رمز. وهو أرخص مسار نصي إنتاجي. تبلغ حصته الأساسية على Developer 250,000 TPM و1,000 RPM، مع نافذة سياق من 131,072 رمزًا.
  • يكلف GPT-OSS 20B مبلغ $0.075 للإدخال و$0.30 للإخراج لكل مليون رمز. ويبلغ سعر الإدخال المخزن مؤقتًا $0.0375 لكل مليون. حصته الأساسية على Developer هي 250,000 TPM و1,000 RPM، مع نافذة سياق من 131,072 رمزًا.
  • يكلف GPT-OSS 120B مبلغ $0.15 للإدخال و$0.60 للإخراج لكل مليون رمز. ويبلغ سعر الإدخال المخزن مؤقتًا $0.075 لكل مليون. حصته الأساسية على Developer هي 250,000 TPM و1,000 RPM، مع نافذة سياق من 131,072 رمزًا.
  • يكلف Llama 3.3 70B Versatile مبلغ $0.59 للإدخال و$0.79 للإخراج لكل مليون رمز. وتبلغ حصته الأساسية على Developer 300,000 TPM و1,000 RPM، مع نافذة سياق من 131,072 رمزًا.

ابدأ تقييمًا إنتاجيًا باستخدام GPT-OSS 120B عندما تحتاج إلى نموذج أكبر مفتوح الأوزان مع أهمية وجود مزود بديل للنموذج نفسه. انتقل إلى GPT-OSS 20B أو Llama 3.1 8B فقط عندما يثبت اختبار القبول أن النموذج الأصغر يحافظ على جودة النتيجة. ولا تنتقل إلى Llama 3.3 70B إلا إذا كانت مخرجاته تبرر سعرًا يعادل 3.93 أضعاف GPT-OSS 120B في الإدخال و1.32 ضعفًا في الإخراج.

لا تثبت هذه المضاعفات أن نموذجًا أفضل من آخر، بل تحدد ما ينبغي للنتيجة أن تسترده عبر عدد أقل من المحاولات، أو إجابات أقصر، أو جهد مراجعة أقل، أو قدرة لا يوفرها المسار الأرخص.

نماذج تحويل الكلام إلى نص

  • يكلف Whisper Large V3 مبلغ $0.111 لكل ساعة صوتية. تبلغ سعته الأساسية على Developer 200,000 ثانية صوتية في الساعة و300 RPM، مع حد أقصى للملف قدره 100 MB.
  • يكلف Whisper Large V3 Turbo مبلغ $0.04 لكل ساعة صوتية. تبلغ سعته الأساسية على Developer 400,000 ثانية صوتية في الساعة و400 RPM.

عند 1,000 ساعة صوتية، تصبح بنود التكلفة $111 لـWhisper Large V3 و$40 لـTurbo، بفارق $71. السعر الأقل هو نقطة البداية، لكن على فريق الصوت الاحتفاظ بالنموذج الذي يجتاز معيار قبول التفريغ النصي. فالتفريغ الأرخص الذي يحتاج إلى تصحيح ليس نتيجة أرخص.

أنظمة Compound ونماذج Preview

تجمع Groq Compound وCompound Mini بين نماذج الإنتاج وأدوات تعمل على الخادم. ولا تملك سعرًا ثابتًا واحدًا للرموز؛ إذ تمرر Groq تكلفة النموذج الأساسي ورسوم الأدوات، ولذلك تحتاج فاتورة Compound إلى تجميع مستقل للتكاليف بدل تقدير واحد لكل رمز.

يسرد كتالوج Preview المباشر حاليًا:

  • Qwen3.6 27B: $0.60 للإدخال و$3.00 للإخراج لكل مليون رمز.
  • Safety GPT-OSS 20B: $0.075 للإدخال و$0.30 للإخراج لكل مليون رمز.
  • Llama Prompt Guard 2 22M: $0.03 للإدخال والإخراج لكل مليون رمز.
  • Llama Prompt Guard 2 86M: $0.04 للإدخال والإخراج لكل مليون رمز.
  • Canopy Labs Orpheus V1 English: $22 لكل مليون حرف.
  • Canopy Labs Orpheus Arabic Saudi: $40 لكل مليون حرف.
  • MiniMax M2.7: تسعير Enterprise عبر التواصل مع المبيعات.

تعني Preview التقييم، لا وعدًا بالإنتاج. تقول Groq إن هذه النماذج قد تتوقف خلال مهلة قصيرة؛ لذا تحتاج أي ميزانية تعتمد على Qwen3.6 27B أيضًا إلى مسار مختبر نحو مزود أو نموذج آخر قبل وصوله إلى العملاء.

لا تتضمن صفحة Supported Models الحالية لدى Groq نموذجًا من DeepSeek أو Kimi. المنشورات والحاسبات القديمة التي ما زالت تسعّر هذه الأسماء باعتبارها مسارات Groq نشطة أصبحت قديمة. إذا كان DeepSeek هو المتطلب، فاحسب تكلفته عبر مزود حالي بدل افتراض بقائه في كتالوج Groq؛ ويغطي تحليل أسعار DeepSeek ذلك القرار المنفصل.

تكلفة النتيجة هي ما يحسم اختيار النموذج

أسعار الرموز لدى Groq منخفضة إلى درجة تجعل شكل الحركة أهم من اختيار النموذج إلى أن يصبح الاستخدام كبيرًا. ولإجراء مقارنة سليمة، ثبّت طلبًا واحدًا واحسب سعر كل مسار بناءً عليه.

استخدم طلبًا معياريًا يضم 2,000 رمز إدخال و500 رمز إخراج. عند 100,000 طلب شهريًا، وقبل التخزين المؤقت أو Batch أو الأدوات أو إعادة المحاولة، تكون التكلفة:

  • Llama 3.1 8B Instant: إجمالي $14، أو $0.00014 لكل طلب.
  • GPT-OSS 20B: إجمالي $30، أو $0.0003 لكل طلب.
  • GPT-OSS 120B: إجمالي $60، أو $0.0006 لكل طلب.
  • Llama 3.3 70B Versatile: إجمالي $157.50، أو $0.001575 لكل طلب.
  • Qwen3.6 27B preview: إجمالي $270، أو $0.0027 لكل طلب.

المقام المفيد ليس عدد الطلبات، بل عدد النتائج المقبولة. فإذا أعاد نموذج أصغر المحاولة، أو أنتج مخرجات أطول، أو أرسل مزيدًا من العمل إلى مراجع بشري، فقد يتحول الطلب الرخيص إلى سير العمل الأغلى. تتبع النتائج المقبولة إلى جانب الرموز كي يثبت النموذج استحقاقه لمكانه بدل الفوز بسعره المعلن فقط.

لا توجد نقطة تعادل عند حجم مدفوع تجعل نموذج Groq ما أرخص تلقائيًا من آخر. كل سعر عام عند الطلب خطي ولا توجد رسوم أساسية. يظل GPT-OSS 20B بنصف التكلفة المحسوبة لـGPT-OSS 120B سواء عند طلب واحد أو مليون طلب. ولا يتغير القرار إلا عندما تغير جودة النتيجة أو السلوك التشغيلي مقدار العمل اللازم.

بالنسبة إلى مؤسس حصل على تمويل، قد يعني ذلك استخدام GPT-OSS 20B للتصنيف وGPT-OSS 120B للحالات الملتبسة. وبالنسبة إلى مدير تقنية في شركة متوسطة، يعني الاحتفاظ بحقول النموذج والرموز في سجل كل طلب حتى تتمكن المشتريات من رؤية تكلفة كل سير عمل مقبول. أما المشغل الخبير فعليه قياس التصحيحات وإعادة المحاولة، لا اعتبار نجاح عرض تجريبي واحد دليلًا على صلاحية مسار الإنتاج.

يتفوق Batch على التخزين المؤقت في العمل غير المتزامن، ولا تتراكم الخصومات

يقدم Batch من Groq أدنى سعر منشور عندما يمكن للنتيجة أن تنتظر. فهو يكلف أقل بنسبة 50% من سعر API المتزامن، ويعمل خارج الحدود القياسية لكل نموذج، ويتيح نافذة معالجة تبدأ من 24 ساعة وتصل إلى 7 أيام.

في حمل من 100,000 طلب على GPT-OSS 120B، تكون الخيارات:

  • متزامن من دون تخزين مؤقت: $60.
  • متزامن مع تقديم 50% من رموز الإدخال من الذاكرة المؤقتة: $52.50.
  • متزامن مع تقديم 80% من رموز الإدخال من الذاكرة المؤقتة: $48.
  • Batch: $30.

القاعدة الحالية التي تغير الميزانية صريحة: خصما Batch والتخزين المؤقت للموجهات لا يتراكمان. تُحاسب كل رموز Batch بسعر Batch المخفض 50% بصرف النظر عن حالة التخزين المؤقت. لذلك، فإن جدول البيانات الذي يخفض إجمالي Batch البالغ $30 مرة أخرى إلى $15 مخطئ.

يظل التخزين المؤقت للموجهات مفيدًا لحركة GPT-OSS المتزامنة. فهو تلقائي، ولا يفرض رسوم ميزة، ويخفض سعر الإدخال المخزن مؤقتًا بنسبة 50%. ويدعم حاليًا GPT-OSS 20B وGPT-OSS 120B وGPT-OSS Safeguard 20B. تتطلب إصابة الذاكرة المؤقتة تطابقًا دقيقًا في البادئة، ويتراوح الحد الأدنى للبادئة القابلة للتخزين بين 128 و1,024 رمزًا حسب النموذج، وتنتهي صلاحية البيانات غير المستخدمة بعد ساعتين. ولا تُضمن الإصابة؛ فهي تعمل وفق مبدأ أفضل جهد.

ضع تعليمات النظام وتعريفات الأدوات الثابتة في بداية الموجه، ثم ضع بيانات المستخدم المتغيرة بعدها. وبعد ذلك اقرأ استخدام الرموز المخزنة مؤقتًا من الاستجابات. لا تتحول نسبة التخزين المتوقعة إلى حقيقة في الميزانية قبل أن يثبتها استخدام الإنتاج.

لـBatch حدود تشغيلية مختلفة. يمكن أن يحتوي ملف JSONL على ما يصل إلى 50,000 سطر وألا يتجاوز حجمه 200 MB. تنتهي صلاحية المهام التي لا تُنجز ضمن نافذة المعالجة المختارة، لكن Groq لا تحاسب إلا على الطلبات المكتملة بنجاح. ويمكن أن تبقى ملفات Batch ونتائجها في أنظمة Groq مدة تصل إلى 30 يومًا، لذلك تحتاج أحمال العمل الحساسة إلى مراجعة احتفاظ البيانات قبل أن يحسم توفير التكلفة اختيار المسار.

قد تتحول رموز بقيمة $60 إلى فاتورة Compound قدرها $560

التكلفة الخفية في Compound ليست النموذج، بل حلقة الأدوات.

تسعّر Groq خدمة Basic Search بسعر $5 لكل 1,000 طلب، وAdvanced Search بسعر $8 لكل 1,000، وVisit Website بسعر $1 لكل 1,000، وCode Execution بسعر $0.18 في الساعة. وتضاف هذه الرسوم إلى تكلفة رموز النموذج الأساسي.

لنأخذ 100,000 طلب معياري على GPT-OSS 120B. تكلف رموز النموذج $60. وإذا نفذ كل طلب استدعاء Basic Search واحدًا، تضيف عمليات البحث $500 وتصبح الفاتورة الإجمالية $560. أما استدعاء Advanced Search مرة واحدة لكل طلب فينتج إجماليًا قدره $860، واستدعاء Visit Website مرة واحدة لكل طلب ينتج $160.

أعمدة تكلفة تقارن رموز GPT-OSS بقيمة 60 دولارًا ورسوم Basic Search بقيمة 500 دولار
عند 100,000 طلب محسوب، تضيف عملية Basic Search واحدة لكل طلب مبلغ $500 إلى فاتورة رموز قيمتها $60

هذا هو بند الميزانية الأكثر احتمالًا لمفاجأة فريق يبني الوكلاء. لن ينقذ تحسين الرموز سير عمل يبحث فيه الوكيل عند كل خطوة. الضابط الأول هو سياسة للأدوات: حدد متى يصبح البحث ضروريًا، وضع سقفًا لحلقات الأدوات، وخزّن النتائج طويلة الصلاحية خارج النموذج، وسجل استدعاءات الأدوات لكل نتيجة مقبولة.

الفاتورة المدفوعة بلا التزام سنوي، لكن لها تفاصيل تشغيلية

تعتمد Developer الفوترة حسب الاستخدام، وليست عقد SaaS سنويًا متنكرًا. وتتعلق الشروط الأقل وضوحًا بموعد سحب الأموال من الحساب، وكيف تتصرف الحدود، وما يحدث للأرصدة.

تستخدم حسابات Developer الجديدة الفوترة المتدرجة. قد تصدر Groq فاتورة عندما يتجاوز الاستخدام التراكمي طوال عمر الحساب $1 ثم $10 ثم $100 ثم $500 ثم $1,000. وبعد عتبة $1,000 تبدأ الفوترة الشهرية المعتادة. أما الحسابات التي تحمل عنوان فوترة هنديًا فتستخدم عتبتي $1 و$10، تليهما زيادات متكررة قدرها $100. ولا تطلب Groq الدفع إلى أن يبلغ الاستخدام $0.50 على الأقل.

قد يؤدي هذا الجدول إلى عدة خصومات صغيرة من البطاقة في بداية الاستخدام. ليست هذه رسومًا إضافية، لكن على قسم المالية فهم النمط قبل اعتبار الخصومات مكررة.

تمنع Spend Limits الحركة مع تأخر قصير في التقارير

تستطيع الخطط المدفوعة تعيين Spend Limit شهري واحد على مستوى المؤسسة. يشمل كل مفاتيح API ونقاط النهاية، ويُعاد ضبطه في اليوم الأول من الشهر، ويمنع الطلبات الجديدة فور اكتشاف بلوغ الحد. وتدعم Groq نقاط تنبيه مثل 50% و75% و90% من السقف.

تتأخر تحديثات تتبع الإنفاق من 10 إلى 15 دقيقة. لذلك قد تدفع طفرة استخدام الفاتورة النهائية قليلًا فوق المبلغ المحدد قبل أن يبدأ المنع. تقترح Groq البدء بحد يزيد من 20% إلى 30% على الاستخدام الشهري المتوقع. وفي المسار الحرج، تقلل هذه المساحة أيضًا احتمال أن يحول ارتفاع طبيعي في الحركة ضابط الميزانية إلى انقطاع.

تنتهي صلاحية الأرصدة، ومبيعات الدفع المسبق نهائية

تنتهي صلاحية Service Credits من Groq بعد عام واحد من الشراء أو الإصدار، ما لم يُحدد أجل مختلف. وهي غير قابلة للتحويل، ولا يمكن استردادها نقدًا، وغير قابلة للاسترجاع. ويؤدي إغلاق الحساب إلى انتهاء الرصيد فورًا.

تتعامل Billing FAQ لدى Groq مع طلبات الاسترداد العامة كل حالة على حدة عبر الدعم. ولا يلغي ذلك شروط Service Credit المحددة؛ فالأرصدة المشتراة والترويجية تظل مبيعات نهائية. اشترِ رصيدًا مرتبطًا بتوقع فعلي، لا بانتقال مستقبلي غامض.

تمنح Flex سقفًا أعلى مقابل التخلي عن السعة المضمونة

تتوفر Flex للعملاء المدفوعين بسعر الرموز نفسه لخدمة On Demand، وتوفر 10 أضعاف حد المعدل عند الطلب. والمقابل هو سعة تعمل بأفضل جهد؛ فإذا كانت Flex ممتلئة، فقد تفشل سريعًا مع HTTP 498 والخطأ capacity_exceeded.

استخدم Flex لقوائم الانتظار القابلة لإعادة المحاولة، والتقييمات، والأعمال المجمعة التي تستطيع استيعاب فشل سريع. ولا تجعلها المسار الوحيد لإجراء يخص عميلًا ولا يمكن تكراره. توفر On Demand سرعة متوقعة، لكنها قد تضيف زمن انتظار في أوقات الذروة. أما Enterprise Performance فهي الخيار المتعاقد عليه عندما لا يكون هذا التفاوت مقبولًا، مع SLA للتوافر بنسبة 99.9% وضمان لزمن الاستجابة بنسبة 99% بموجب اتفاق Enterprise.

تتعادل Groq وTogether AI وFireworks في رموز GPT-OSS 120B غير المخزنة مؤقتًا

لا تتفوق Groq في السعر العام لرموز GPT-OSS 120B وحده. تعرض Groq وTogether AI وFireworks AI جميعًا سعر $0.15 للإدخال و$0.60 للإخراج لكل مليون رمز للنموذج نفسه.

استخدم حملًا موحدًا واحدًا: 100 مليون رمز إدخال و20 مليون رمز إخراج. من دون خصم التخزين المؤقت، يكلف كل مزود $27. هذا التعادل نتيجة مفيدة لأنه ينقل قرار اختيار المزود إلى اقتصاديات التخزين المؤقت، وحدود المعدل، وخيارات النشر، والموثوقية، وزمن الاستجابة المقاس.

Together AI

Together AI مزود استدلال متعدد النماذج، ويكلف مساره serverless لنموذج GPT-OSS 120B مبلغ $0.15 للإدخال و$0.60 للإخراج لكل مليون رمز. ولا يفرض منتج serverless حدًا أدنى أو رسوم توفير للسعة.

صفحة أسعار Together AI المباشرة لخدمة serverless تعرض أسعار GPT-OSS 120B
أسعار GPT-OSS 120B لدى Together AI

لا ينشر صف GPT-OSS 120B الحالي لدى Together سعرًا للإدخال المخزن مؤقتًا. وتقول وثائقها إن النموذج الذي لا يحمل سعرًا للتخزين المؤقت يحاسب كل الإدخال بالسعر القياسي. لذلك يظل الإجمالي $27 على الحمل الموحد حتى إذا تكرر الموجه. وتقدم Together سعر Batch أقل بما يصل إلى 50% للنماذج serverless المدعومة، ولذلك تظل خيارًا صالحًا للعمل غير المتزامن عندما يكون هذا النموذج بعينه مؤهلًا.

اختر Together عندما يصبح كتالوج النماذج الأوسع أو مسار الانتقال من serverless إلى بنية تحتية محجوزة أهم من الملف التشغيلي الخاص بـGroq. ولا تنتقل بينهما بدافع السعر قبل أن يكشف حمل فعلي فرقًا، لأن بند GPT-OSS غير المخزن مؤقتًا متطابق.

Fireworks AI

تعرض Fireworks AI نموذج GPT-OSS 120B بسعر $0.15 للإدخال، و$0.014 للإدخال المخزن مؤقتًا، و$0.60 للإخراج لكل مليون رمز، مع رصيد تسجيل serverless بقيمة $1.

صفحة نموذج GPT-OSS 120B لدى Fireworks AI وبها أسعار الرموز القياسية والمخزنة مؤقتًا
أسعار GPT-OSS 120B لدى Fireworks AI

عند تخزين 50% من الإدخال مؤقتًا، يصبح الإجمالي الموحد $20.20 لدى Fireworks، و$23.25 لدى Groq، و$27 لدى Together. وهذا يجعل Fireworks الفائز بالسعر العام لإدخال GPT-OSS 120B كثير التكرار، بشرط انطباق سعر التخزين المعلن على الحمل المقاس. وتظل Groq Batch أقل تكلفة للعمل غير المتزامن عند $13.50 للحركة الموحدة نفسها.

طورت OpenAI نموذج GPT-OSS، لكنها لا تقدمه عبر OpenAI API أو تطبيقها للمستهلكين. لذلك، تغير المقارنة المباشرة مع OpenAI API المزود والنموذج معًا، ما يفسد توحيد السعر. قارن النموذج نفسه بين مزودي الاستضافة أولًا، ثم قيّم النماذج الاحتكارية المختلفة بحسب النتيجة المقبولة. وتغطي قائمة أرخص AI API المختصرة المجال الأوسع للنماذج والمزودين.

قرار اختيار المزود واضح:

  • اختر Groq عندما يتفوق معدل المعالجة المتزامنة وضوابط التشغيل في المسار المقاس، أو عندما يجعل سعر Batch المخفض 50% العمل المؤجل هو الأرخص.
  • اختر Fireworks عندما يحقق سياق GPT-OSS المتكرر باستمرار سعر الإدخال المخزن مؤقتًا والمعلن عند $0.014.
  • اختر Together عندما يكون مسارها الأوسع من serverless إلى dedicated مهمًا، ولا يستفيد الحمل من سعر مخزن مؤقتًا لـGPT-OSS.

من ينبغي له اختيار Groq، ومن الأفضل له تجاوزها؟

تعد Groq خيارًا قويًا عندما يجتاز نموذج مفتوح معيار الجودة وتؤثر سرعة الاستجابة في المنتج. وتصبح أضعف عندما يقع النموذج المطلوب، أو ضمان السعة، أو التحكم في النشر خارج كتالوج الخدمة الذاتية الحالي لديها.

نقاط القوة
ما يجيده
12 points

  • خطة Free مفيدة بما يكفي لتقييم نماذج الإنتاج قبل إضافة وسيلة دفع.
  • لا تفرض Developer اشتراكًا أساسيًا أو التزامًا سنويًا.
  • تظل الأسعار العامة عند الطلب أقل من $1 لكل مليون رمز لجميع النماذج النصية الإنتاجية.
  • يخفض Batch تكلفة العمل غير المتزامن المؤهل بنسبة 50% من دون استهلاك حدود النموذج القياسية.
  • يعمل التخزين المؤقت لموجهات GPT-OSS تلقائيًا ويخفض أسعار الإدخال المخزن مؤقتًا إلى النصف.
  • تستطيع Spend Limits منع الاستخدام على مستوى المؤسسة قبل أن تنفلت الميزانية الشهرية.
  • حدود Free مشتركة على مستوى المؤسسة، وقد تُستنفد بالرموز قبل الطلبات بوقت طويل.
  • لا يتراكم خصما Batch والتخزين المؤقت.
  • قد تتجاوز رسوم أدوات Compound الإنفاق على رموز النموذج بفارق كبير.
  • لا يدعم التخزين المؤقت للموجهات إلا عائلة GPT-OSS المدرجة، ويعتمد على إعادة استخدام البادئة نفسها تمامًا.
  • قد ترجع Flex الخطأ HTTP 498 عندما لا تتوفر سعة best-effort.
  • قد تُزال نماذج Preview خلال مهلة قصيرة، فلا يمكنها حمل اعتماد إنتاجي غير قابل للنقل.

ينبغي لمؤسس حصل على تمويل اختيار Groq عندما يحافظ نموذج مفتوح سريع على استجابة المنتج، ويستطيع الفريق إبقاء مزود بديل للنموذج نفسه جاهزًا. وعلى مدير التقنية في شركة متوسطة ألا يستخدم Developer إلا بعد توحيد إدارة المفاتيح، وتسجيل استخدام النماذج والأدوات، ووضع سقف للمؤسسة. أما المشغل الخبير فعليه الاهتمام بتكلفة كل نتيجة مقبولة، لا بالعنوان المثير حول عدد الرموز مقابل الدولار.

لا تعتمد على Groq بوصفها المزود الوحيد إذا كان التطبيق يحتاج إلى نموذج احتكاري غير موجود في كتالوجها، أو مسار best-effort مضمون، أو نموذج Preview بلا بديل مستقر. تستطيع Enterprise Performance توفير سعة متعاقد عليها للنماذج التي تدعمها، لكنها تسعير مخصص للسعة الموفرة وليست خطة عامة أرخص.

قاعدة القرار الصريحة هي: اختر Groq فقط عندما يجتاز نموذج إنتاجي حالي اختبار القبول، ويتفوق إما السلوك التشغيلي المتزامن أو تكلفة Batch على البديل الذي يقدم النموذج نفسه. إذا لم يتحقق أي منهما، فليس انخفاض سعر الرموز سببًا للانتقال.

تاريخ أسعار Groq يكافئ التحقق المباشر

تتغير أسعار Groq على مستوى الميزات والنماذج، حتى عندما تظل بنية الفوترة قائمة على الدفع حسب الاستخدام. فقد أعلن إطلاق Developer في فبراير 2025 عن Batch بخصم 25% من السعر المتزامن، بينما تحدد وثائق Batch الحالية الخصم عند 50%.

كذلك خفضت Groq أسعار GPT-OSS وبدأت إضافة التخزين المؤقت للموجهات إلى العائلة في أكتوبر 2025. والنتيجة الحالية هي $0.15/$0.60 لنموذج GPT-OSS 120B و$0.075/$0.30 لنموذج GPT-OSS 20B، مع إدخال مخزن مؤقتًا بنصف سعر الإدخال القياسي.

تقلب الكتالوج مهم بقدر تاريخ السعر. فالنماذج التي ظهرت في تغطيات التسعير القديمة، ومنها مسارات Kimi وDeepSeek، غائبة عن صفحة Supported Models الحالية. وينبغي للميزانية أن تسجل تاريخ التحقق ومعرف النموذج والبديل، بدل اعتبار سعر منسوخ ثابتًا إلى الأبد.

خطوة يوم الاثنين: سعّر سير عمل مقبولًا واحدًا وضع له سقفًا

ابدأ يوم الاثنين بسير عمل واحد محدد، وابنِ ميزانية يستطيع كل من الهندسة والمالية فحصها. لا تبدأ بانتقال شامل على مستوى المزود.

  1. التقط شكل الحركة

    صدّر أسبوعًا ممثلًا يتضمن عدد الطلبات، ورموز الإدخال، ورموز الإخراج، والرموز المصابة في الذاكرة المؤقتة، ومعرفات النماذج، واستدعاءات الأدوات، وإعادة المحاولة، والنتائج المقبولة. وافصل الحركة المتزامنة عن المهام التي يمكنها الانتظار.

  2. سعّر ثلاثة مسارات

    احسب On Demand بأسعار النماذج المباشرة، وBatch بنسبة 50% للعمل المؤجل المؤهل، والأدوات كبنود مستقلة. لا تطبق وفر التخزين المؤقت على Batch، ولا تفترض نسبة تخزين لم تثبتها حقول الاستخدام.

  3. حدد الحد المدفوع

    إذا عطلت حدود Free المسار، فانقله إلى Developer. اضبط Spend Limit شهريًا يزيد من 20% إلى 30% على التوقعات، ثم ضع تنبيهات عند 50% و75% و90%. واترك مساحة لتأخر التقارير من 10 إلى 15 دقيقة.

  4. أبقِ بديلًا واحدًا جاهزًا

    شغّل النموذج نفسه عبر مزود بديل واحد على مجموعة تقييم صغيرة. وسجل نقطة النهاية، ومعدل القبول المرصود، ومحفز إعادة التوجيه، حتى لا يحول تغير الكتالوج أو خطأ السعة الموقف إلى انتقال طارئ.

النتيجة هي بند ميزانية واحد لكل سير عمل مقبول، يضم رموز النموذج والأدوات وإعادة المحاولة والمراجعة البشرية. أعد تشغيل الحساب عندما يتغير كتالوج النماذج المباشر، أو حدود المعدل، أو صفحة الأسعار.

الأسئلة الشائعة

كم تبلغ تكلفة Groq AI؟

تكلف Groq Free مبلغ $0. ولا تفرض Developer اشتراكًا أساسيًا، بل تحاسب على الاستخدام حسب النموذج. تبدأ أسعار النماذج النصية الإنتاجية الحالية من $0.05 للإدخال و$0.08 للإخراج لكل مليون رمز في Llama 3.1 8B Instant، وتصل إلى $0.59 للإدخال و$0.79 للإخراج في Llama 3.3 70B Versatile.

هل Groq مجاني؟

نعم، ضمن حدود المؤسسة الخاصة بكل نموذج. تعرض Free حاليًا لـGPT-OSS 120B و20B حدود 30 RPM و1,000 RPD و8,000 TPM و200,000 TPD. ويؤدي تجاوز حد مطبق إلى إرجاع HTTP 429.

ما نماذج Groq AI المتاحة مجانًا؟

تتيح خطة Free الكتالوج المدعوم ضمن حدود خاصة بكل نموذج. استخدم نماذج الإنتاج لإجراء تقييم قابل للاستمرار. وتقول Groq إن نماذج Preview مخصصة للتقييم وقد تتوقف خلال مهلة قصيرة.

كم تكلف Groq شهريًا؟

لا يوجد اشتراك شهري أو سنوي عام للخدمة الذاتية. اجمع شهريًا استخدام الإدخال والإخراج والصوت والأدوات ومستوى الخدمة بالأسعار الحالية. ويكلف الحمل المحسوب عند 100,000 طلب على GPT-OSS 120B مبلغ $60 بالتنفيذ المتزامن قبل التخزين المؤقت أو رسوم الأدوات.

هل تقدم Groq خصمًا للطلاب؟

لا تعرض Groq خصمًا مخصصًا للطلاب في صفحات التسعير أو الفوترة التي جرى التحقق منها في أغسطس 2026. ويمكن للطلاب وغيرهم من المستخدمين ذوي الاستخدام الخفيف الاستفادة من خطة Free العامة بسعر $0 ضمن حدود المعدل.

ما سياسة الاسترداد لدى Groq؟

تتعامل Groq مع طلبات استرداد الفوترة العامة كل حالة على حدة عبر الدعم. أما Service Credits فأكثر صرامة؛ إذ إن الأرصدة المشتراة والترويجية غير قابلة للاسترداد أو التحويل، وتنتهي بعد عام واحد ما لم يُذكر أجل مختلف.

هل تغيرت أسعار Groq؟

نعم. بدأ Batch بخصم 25% من السعر المتزامن في فبراير 2025، وأصبح الخصم اليوم 50%. وخفضت Groq أسعار GPT-OSS وأضافت التخزين المؤقت إلى العائلة في أكتوبر 2025. تحقق من الصفحة المباشرة لأن الكتالوج والأسعار على مستوى النماذج يتغيران.

كيف تقارن أسعار Groq بأسعار OpenAI؟

لا تقدم OpenAI نموذج GPT-OSS عبر API الخاص بها، لذلك تغير المقارنة المباشرة النموذج. وفي حمل موحد لـGPT-OSS 120B، تتعادل Groq وTogether AI وFireworks AI عند $27 مقابل 100 مليون رمز إدخال و20 مليون رمز إخراج قبل خصومات التخزين المؤقت.

احصل على AI Tools Map for Business Owners

يحول AI Tools Map for Business Owners أسعار النماذج إلى مسار تبنٍّ واضح، يحدد معيار الجودة والدور التشغيلي ومحفز التكلفة الذي يجب أن تستحقه كل أداة. اشترك لتحصل على الإصدار التالي مجانًا.

آخر تحديث

3 سبتمبر 2026

التصنيفAI

فضّل هذا الموقع في Google

إضافة omidsaffari.com كمصدر مفضّل في بحث Google

اجعل omidsaffari.com مصدرًا مفضّلًا، وسيرفعه Google لك في Top Stories وAI Overviews وAI Mode.

المزيد من AI

عرض كل مقالات AI
النشرة البريدية

رسالة واحدة، كل يوم أحد. أنظمة تعمل، لا آراء ساخنة.

سجلات بناء، وأنظمة قيد التشغيل، وملاحظات ميدانية من إدارة محفظة مشاريع ذكاء اصطناعي.

أسبوعية. بلا إزعاج. يمكنك إلغاء الاشتراك متى شئت.