Claude API: ما الذي يغيّره Claude Fable 5.1؟

دليل عملي لفهم Claude Fable 5.1 في Claude API: تكلفة الذاكرة المخبأة، ونافذة السياق، وقيود استدعاء الأدوات، وخطوات ترحيل الوكلاء بأمان إلى الإنتاج.

Wednesday, September 2, 2026Omid Saffari
Claude API: ما الذي يغيّره Claude Fable 5.1؟

يستحق Claude Fable 5.1 الاختبار عند تشغيل الوكلاء لفترات طويلة، لكنه ليس ترقية جاهزة تحل محل النموذج السابق في كل تكامل مع Claude. أطلقته Anthropic في 1 سبتمبر 2026، مع قراءة للذاكرة المخبأة بسعر $0.25 لكل مليون رمز، إلى جانب قواعد جديدة في Claude API قد تُعطّل الاستدعاء الإجباري للأدوات وسجلّات المحادثات المعدّلة.

ما هو Claude Fable 5.1 داخل Claude API؟

Fable 5.1 هو نموذج Anthropic للمهام التي لا تنتهي في جولة واحدة: وكيل برمجي يتتبع عطلًا عبر خدمات متعددة، أو وكيل بحث يلاحق الأدلة بين عدة مصادر، أو وكيل مستندات يحوّل مجموعة ضخمة من الملفات إلى مخرج نهائي متكامل. معرّف النموذج في الواجهة هو claude-fable-5-1، وهو متاح لجميع عملاء Claude API، وكذلك عبر Amazon Bedrock وClaude Platform on AWS وGoogle Cloud وMicrosoft Foundry.

الكلمة الأهم هنا هي نموذج. لسنا أمام تطبيق جديد أو بديل كامل لمنتج Claude. لا تزال Anthropic تنصح غالبية مطوري الواجهة بالبدء مع Claude Opus 5، ثم الانتقال إلى Fable 5.1 عندما تعجز اختبارات Opus الخاصة بهم عن اجتياز مهام الاستدلال الصعبة أو الأعمال الممتدة زمنيًا. ويستخدم Claude Mythos 5.1 النموذج الأساسي نفسه مع ضمانات مختلفة، لكنه يقتصر على عملاء Project Glasswing المعتمدين. يوضح دليل النماذج الحالي من Anthropic هذا الفصل صراحةً.

تحصل افتراضيًا على نافذة سياق بسعة 1M رمز، مع مخرجات تصل إلى 128k رمز. نافذة السياق هي ذاكرة العمل التي يستخدمها النموذج للطلب الحالي؛ وتشمل التعليمات والرسائل والملفات والأدوات ونتائجها والتفكير والإجابة التي ينتجها. تستوعب مليون رمز قدرًا هائلًا من المحتوى، لكن ذلك لا يجعل كل رمز مفيدًا. فدليل Anthropic عن السياق يحذّر من تآكل السياق: قد تتراجع القدرة على الاسترجاع والدقة كلما تراكمت مواد غير ذات صلة.

يعمل التفكير التكيفي دائمًا. ويمكن ضبط مقدار الجهد الذي يبذله النموذج عبر خمسة مستويات: low وmedium وhigh وxhigh وmax. نقطة البداية المناسبة هي high، وهو الإعداد الافتراضي في الواجهة. لا تخفّضه إلا إذا أثبتت اختباراتك بقاء جودة النتيجة، لأن رموز التفكير تُحتسب ضمن المخرجات حتى عندما يكون نص الاستدلال مخفيًا.

هذا شرح موجّه إلى مطوري الواجهات. أما من يستخدم Claude في المحادثة فقط، فقد يلاحظ تحسنًا في مهمة يرسلها إليه، لكنه لا يحتاج إلى تنفيذ أي عملية ترحيل.

أسعار Claude Fable 5.1: خفض محدود بأثر كبير

لم يصبح Fable 5.1 أرخص في كل بند. بقي سعرا الإدخال والإخراج الأساسيان كما كانا في Fable 5، وكلاهما يساوي ضعف سعر Opus 5. التحول الكبير الوحيد يخص السياق المتكرر.

النموذجالإدخال لكل 1M رمزقراءة الذاكرة المخبأة لكل 1M رمزالإخراج لكل 1M رمزالسياق
Claude Fable 5.1$10$0.25$501M
Claude Fable 5$10$1$501M
Claude Opus 5$5$0.50$251M

تحتفظ ذاكرة المطالبات المخبأة ببادئة سبق أن عولجت، مثل تعليمات النظام أو تعريفات الأدوات أو خريطة المستودع أو مجموعة المستندات. عندما يبدأ الطلب التالي بالبادئة نفسها تمامًا، يستطيع Claude قراءة العمل المخبأ بدل معالجته مجددًا بسعر الإدخال الكامل.

لنفترض أن بادئة بحجم 1M رمز قُرئت 10 مرات. يكلّف ذلك $10 في Fable 5، مقابل $2.50 في Fable 5.1. أي إن السياق المتكرر نفسه يوفر $7.50، أو 75%، قبل احتساب أي إدخال أو إخراج جديد. وتقدّر Anthropic إجمالي الوفر بنحو 25% لأحمال العمل المعتادة التي تُحاسب بالرموز، وقد يصل إلى نحو 45% للأحمال التي تعتمد بكثافة على الوكلاء، استنادًا إلى أربعة أسابيع من استخدامها خلال أغسطس 2026. هذه تقديرات من المورّد، لكن سعر الوحدة الذي تستند إليه واضح. تعرض بطاقة الأسعار الحالية تكلفة كل عملية تخص الذاكرة المخبأة.

مقارنة تكلفة بأسلوب بوابة مائية طينية، توضح أن 10 قراءات لبادئة مخبأة بحجم مليون رمز تكلف $10 على Fable 5 و$2.50 على Fable 5.1
يخفض Fable 5.1 فاتورة البادئة المتكررة بنسبة 75%، لكنه لا يخفض سعر الإدخال الجديد أو الإخراج.

لكن ثمة قيدًا مهمًا. تبلغ تكلفة كتابة ذاكرة مخبأة لمدة خمس دقائق $12.50 لكل مليون رمز، وتبلغ كتابة الساعة الواحدة $20. أما المدة الافتراضية للذاكرة المخبأة فهي خمس دقائق. ويجب ألا يقل طول البادئة عن 512 رمزًا، وأن تتطابق تمامًا، كما ينبغي أن تبدأ الاستجابة الأولى قبل أن تتمكن الطلبات اللاحقة المتوازية من الاستفادة منها. تقول Anthropic إن خيار الدقائق الخمس يسترد تكلفته بعد قراءة واحدة، وخيار الساعة بعد قراءتين. لذلك افحص cache_creation_input_tokens وcache_read_input_tokens وinput_tokens بدل افتراض أن التخزين المؤقت قد عمل.

يكاد هذا التغيير لا يؤثر في المطالبات القصيرة ذات الجولة الواحدة، أو البادئات التي تتغير باستمرار، أو الوكلاء الذين تتركز تكلفتهم في المخرجات. ومع سعر يبلغ $50 لكل مليون رمز إخراج، قد يظل التفكير غير الضروري والإجابات المطولة صاحبي الحصة الأكبر من الفاتورة.

تبعث مؤشرات الإطلاق على التفاؤل، لكنها لا تكفي لاتخاذ قرار شراء. تفيد Anthropic بأن Fable 5.1 حقق 55.8% مقابل 42.0% لـFable 5 في Terminal-Bench 4.0، و31.4% مقابل 17.1% في AutomationBench. أُجريت تلك الاختبارات باستخدام ضمانات Anthropic الإنتاجية، وجاءت النتائج من المورّد نفسه. تعامل معها كسبب لإجراء تقييم على مهامك الفعلية، لا كدليل على تحسن كل حمل عمل. ينشر تقرير الإطلاق ملاحظات الاختبار والمقارنات.

من ينبغي له استخدام النموذج، وكيف؟

مؤسس منفرد أمام مهمة صعبة في مستودع واحد

لا تنقل كل مهمة برمجية إلى Fable 5.1. أبقِ التعديلات الروتينية على النموذج الذي يفي بمعاييرك بالفعل، ثم وجّه الأعمال العنيدة إلى Fable: ترحيل يمتد عبر خدمات متعددة، أو تحقيق في السبب الجذري، أو مراجعة تتطلب ربط القرارات عبر قاعدة شيفرة كبيرة. خزّن تعليمات المستودع المستقرة وتعريفات الأدوات مؤقتًا. هكذا ترفع احتمال نجاح المهمة المكلفة من دون دفع أسعار Fable مقابل كل تعديل صغير.

مهندس منصة وكلاء يطلق حلقة أدوات

تغيير النموذج ليس إلا نصف المهمة. راجع ما إذا كان مشغّل الوكيل يفرض أداة بعينها، أو يعيد كتابة مطالبة النظام العليا، أو يغيّر مصفوفة الأدوات، أو يحذف رسائل قديمة، أو يستبدلها بملخص ينشئه العميل مع الإبقاء على كتل التفكير اللاحقة. كل نمط من هذه الأنماط قد يحول جلسة عادية إلى خطأ 400. المكسب الحقيقي ليس عرضًا توضيحيًا أجمل، بل إطلاقًا يظل مستقرًا في الجولات التالية.

قائد بحث يعمل على مجموعة ملفات كبيرة

استخدم Fable 5.1 عندما تتطلب المهمة فعلًا وصل المعلومات عبر سجل طويل، لا لمجرد إتاحة رقم 1M. ابدأ بجهد high، وقارن الإجابة بالنتائج المعروفة، ثم اختبر النزول إلى medium. تقول Anthropic إن medium يضاهي Fable 5 تقريبًا بتكلفة أقل، لكن اختبارات الاسترجاع والاستشهاد لديك هي التي تحسم ما إذا كانت هذه المقايضة صالحة.

مسؤول أمن أو بيانات في مؤسسة

افحص السياسة قبل القدرات. يُصنَّف Fable 5.1 ضمن Covered Model مع شرط للاحتفاظ بالبيانات لمدة 30 يومًا، ولا يتاح مع الاحتفاظ الصفري بالبيانات إلا إذا منحت Anthropic تصريحًا صريحًا. كذلك لا يدعم Priority Tier. إذا كان أي من الشرطين غير قابل للتفاوض، فأوقف التقييم عند هذه النقطة وأبقِ نموذجًا مؤهلًا ضمن مسار التوجيه.

طريقة آمنة للترحيل إلى Claude Fable 5.1

الاستدعاء الأدنى بسيط، لكن الترحيل إلى بيئة الإنتاج يحتاج إلى أربعة فحوص.

  1. ضع خطًا أساسًا باستخدام مهمة حقيقية واحدة

    شغّل المهمة التمثيلية نفسها على نموذجك الحالي، وسجّل نجاح المهمة والزمن المنقضي والإدخال وإنشاء الذاكرة المخبأة وقراءاتها والإخراج وأي رفض. اختر المهمة التي تبرر سعر Fable الأعلى، لا مطالبة تجريبية مصطنعة.

  2. استدعِ النموذج المثبّت بجهد مرتفع

    اضبط مفتاح الواجهة، وثبّت الإصدار الحالي من حزمة Python، ثم احفظ مقطع Python باسم test_fable.py.

    Bash
    python3 -m venv .venv
    source .venv/bin/activate
    pip install anthropic
    export ANTHROPIC_API_KEY="your-api-key-here"
    Python
    import anthropic
    
    client = anthropic.Anthropic()
    
    message = client.messages.create(
        model="claude-fable-5-1",
        max_tokens=4096,
        output_config={"effort": "high"},
        messages=[
            {
                "role": "user",
                "content": "Map the risks in moving this service from SQLite to PostgreSQL.",
            }
        ],
    )
    
    for block in message.content:
        if block.type == "text":
            print(block.text)
    
    print(message.usage.model_dump_json())

    شغّله باستخدام python test_fable.py. يتبع هذا المثال الصياغة الحالية لحزمة Anthropic ولمعامل الجهد. أما مطالبة الإنتاج، فينبغي أن تكون مهمة التقييم الخاصة بك.

  3. أزل النمطين اللذين يتسببان في الأعطال

    ابحث في طلباتك عن tool_choice عندما تكون قيمته any أو أداة tool مسمّاة. كلاهما يعيد الآن خطأ HTTP 400. اتركه على auto، واضبط strict: true في مخطط الأداة عندما تحتاج إلى معاملات صالحة، ووجّه النموذج نصيًا إلى الأداة المطلوبة في تلك الجولة.

    بعد ذلك اجعل السجل قابلًا للإلحاق فقط. أعد إرسال جولات المساعد تمامًا كما وصلت، بما فيها كتل التفكير. أضف التعليمات الجديدة كرسائل نظام في منتصف المحادثة. واستخدم الضغط من جهة الخادم أو تحرير السياق بدل إعادة كتابة الجولات السابقة.

  4. فعّل التشخيص قبل استقبال الزيارات

    شغّل جلسة طبيعية متعددة الجولات مع ترويسة الإصدار التجريبي thinking-binding-controls-2026-08-01 والإعداد prefix_mismatch_behavior: "drop_block". وسجّل input_transformations. ظهور prefix_binding_mismatch يعني أن تكاملك غيّر السجل، بينما يُتوقع ظهور model_binding_mismatch بعد التوجيه إلى نموذج أقدم.

    بعد استقرار السجل، أضف cache_control: {"type": "ephemeral"} في المستوى الأعلى إلى طلب ذي بادئة قابلة لإعادة الاستخدام لا تقل عن 512 رمزًا. ثم تأكد من أن طلبًا لاحقًا يعرض قيمة في cache_read_input_tokens أكبر من الصفر.

الحقيقة بلا تجميل: سياق أرخص مقابل حالة أشد صرامة

يربط Fable 5.1 كل كتلة تفكير بمطالبة النظام والأدوات والرسائل التي سبقتها. وفي الحسابات المنشأة في 31 أغسطس 2026 أو بعده، يؤدي تغيير تلك البادئة ثم إعادة تشغيل الكتلة إلى ظهور الخطأ The block is bound to a different conversation. تستطيع الحسابات الأقدم تفعيل الفحص نفسه الآن، وتقول Anthropic إن النماذج المستقبلية ستفرضه على نطاق أوسع.

مسار محادثة طيني يوضح وصول الجولات القابلة للإلحاق فقط إلى مخرج صالح، بينما تنتهي إعادة كتابة جولة سابقة بخطأ 400 ومسار تجاوز تجريبي يعتمد drop-block
يكافئ Fable 5.1 سجل الوكيل القابل للإلحاق فقط؛ فقد تؤدي إعادة كتابة الماضي إلى إبطال كل كتلة تفكير لاحقة.

يتصرف النموذج أيضًا بصورة مختلفة من دون إصدار خطأ. ففي حلقات الوكلاء الضمنية، قد ينفذ استدعاء أداة واحدًا حيث كان Fable 5 يجمع عدة استدعاءات. وهو يكتب تحديثات تقدم أقل، ويبحث بوتيرة أضعف عند جهد low، وقد ينتج نثرًا أكثر كثافة أو يعيد كتابة ملف كامل من أجل تعديل صغير. يمكن أن تضيف هذه الاختلافات جولات وزمن استجابة ومخرجات، حتى مع انخفاض سعر الذاكرة المخبأة. تنشر Anthropic تعديلات للمطالبات تعالج كل سلوك، لكنك تظل بحاجة إلى تقييم يقيس السلوك الذي يهمك.

وثمة سقف آخر يختبئ خلف ادعاء إخراج 128k. تفرض حزم SDK استخدام البث عندما تتجاوز قيمة max_tokens مقدار 21,333. ويشارك التفكير في ميزانية الإخراج هذه، لذلك قد يستهلك طلب بجهد مرتفع جزءًا كبيرًا منها قبل بدء الإجابة المرئية. ضع حدًا رحبًا للأعمال الصعبة فعلًا، لكن لا تتعامل مع السقف الكبير باعتباره هدفًا.

يحتاج مستخدمو Claude Code إلى عمل تكاملي أقل. فقد جعل الإصدار 2.1.257 من Fable 5.1 نموذج Fable الافتراضي في 1 سبتمبر 2026. ومع ذلك، يظل من الضروري مراقبة الاستخدام ومراجعة الفروق وحصر النموذج في الأعمال التي تبرر نتائجها سعره. يوثق سجل تغييرات Claude Code تبديل النموذج.

ما الخطوة المناسبة الآن؟

تحرك هذا الأسبوع إذا كنت تشغّل بالفعل وكلاء Fable 5 لفترات طويلة، وترسل سياقًا ثابتًا مرارًا، ويمكنك قبول شروط الاحتفاظ بالبيانات. ضع Fable 5.1 خلف شريحة صغيرة من الزيارات، وشغّل تشخيص السجل، واستبدل فرض الأدوات، ثم قارن تكلفة المهمة الناجحة عند جهدي medium وhigh.

انتظر إذا كان Opus 5 أو نموذجك الحالي يجتاز حمل العمل بالفعل، أو كانت معظم الاستدعاءات من جولة واحدة، أو لم يكن لديك تقييم تمثيلي. لا يزال الإدخال والإخراج الأساسيان في Fable يكلّفان ضعف Opus 5. انخفاض بند الذاكرة المخبأة لا يصلح قرار توجيه ضعيفًا.

لا يتغير عليك شيء إذا كنت تستخدم محادثة Claude فقط ولا تتحكم في تكامل الواجهة. دع المنتج يختار النموذج، ثم قيّم النتيجة. وعلى فرق المؤسسات التي تشترط الاحتفاظ الصفري المعتاد بالبيانات أو Priority Tier أن تبقى أيضًا على مسار مؤهل، ما لم تمنح Anthropic تصريحًا مكتوبًا.

إذا أردت تحويل الإصدار المقبل إلى قرار بناء عملي، فانضم إلى النشرة البريدية.

آخر تحديث

2 سبتمبر 2026

التصنيفExplained

فضّل هذا الموقع في Google

إضافة omidsaffari.com كمصدر مفضّل في بحث Google

اجعل omidsaffari.com مصدرًا مفضّلًا، وسيرفعه Google لك في Top Stories وAI Overviews وAI Mode.

المزيد من Explained

عرض كل مقالات Explained
النشرة البريدية

رسالة واحدة، كل يوم أحد. أنظمة تعمل، لا آراء ساخنة.

سجلات بناء، وأنظمة قيد التشغيل، وملاحظات ميدانية من إدارة محفظة مشاريع ذكاء اصطناعي.

أسبوعية. بلا إزعاج. يمكنك إلغاء الاشتراك متى شئت.