شرح Cloudflare AI Search مع GLM-5.3 Flash وكيف يعمل ويسعر

أضافت Cloudflare نموذج GLM-5.3 Flash إلى AI Search لتوليد الإجابات. إليك طريقة عمل خط المعالجة، والتكاليف، ومتى ينبغي التبديل.

Thursday, September 3, 2026Omid Saffari
شرح Cloudflare AI Search مع GLM-5.3 Flash وكيف يعمل ويسعر

في August 30, 2026، أضافت Cloudflare نموذج GLM-5.3 Flash إلى AI Search كخيار لتوليد النصوص. التغيير المفيد هنا ليس مجرد إضافة نموذج آخر إلى القائمة؛ بل يمكنك الاحتفاظ بخط استرجاع البيانات المُدار بالكامل من Cloudflare واستبدال النموذج الذي يكتب الإجابة النهائية فقط، مع نافذة سياق تبلغ 1,048,576 رمزاً (tokens) وأسعار Workers AI بواقع $0.15 لكل مليون رمز إدخال و $0.50 لكل مليون رمز إخراج.

ما الذي غيرته Cloudflare فعلياً؟

تُعد Cloudflare AI Search خدمة بحث مُدارة للمحتوى الخاص بك. يمكنك تزويدها بموقع إلكتروني، أو حاوية R2 (وهي خدمة التخزين السحابي للكائنات من Cloudflare)، أو ملفات مرفوعة. تقوم الخدمة بتحليل هذا المحتوى، وتقسيمه إلى أجزاء مفيدة، وفهرسة تلك الأجزاء، واسترجاع المقاطع ذات الصلة عندما يطرح شخص ما سؤالاً. وتعمل خدمة Workers AI كمنصة استضافة للنماذج لتشغيل GLM-5.3 Flash ضمن هذا الإعداد.

يُطلق على هذا النمط اسم التوليد المعزز بالاسترجاع، أو RAG. بعبارة يومية بسيطة: يعثر النظام على المقاطع المصدرية أولاً، ثم يطلب من النموذج صياغة إجابة بالاعتماد على تلك المقاطع ثانياً.

يأتي دور GLM-5.3 Flash في هذه المرحلة الثانية حصراً. فهو لا يزحف إلى الموقع، ولا ينشئ التضمينات (embeddings) التي تمثل النصوص رقمياً للعثور على المحتوى المشابه، ولا ينفذ البحث بالكلمات المفتاحية أو يعيد ترتيب النتائج (rerank) لتقييم مدى ملاءمتها. مهمته فقط أخذ السياق المسترجع وصياغة الإجابة. ويجمع البحث الهجين بين المطابقة الدلالية المتجهية والمطابقة الدقيقة للكلمات المفتاحية.

مرحلة AI Searchوظيفتهاهل تغيرت في August 30؟
Indexing (الفهرسة)تحليل المحتوى، وتقسيمه، وتضمينه، وتخزينهلا
Retrieval (الاسترجاع)العثور على الأجزاء ذات الصلة بالمتجهات، أو الكلمات المفتاحية، أو البحث الهجينلا
Generation (التوليد)كتابة إجابة مستندة إلى الأجزاء المسترجعةنعم، بات GLM-5.3 Flash خياراً متاحاً

هذا الفصل هو جوهر المنظومة بأكملها؛ إذ يمكنك تغيير نموذج التوليد دون الحاجة إلى إعادة بناء الفهرس أو تغيير نموذج التضمين. كما تتيح لك Cloudflare ضبط النموذج مرة واحدة في إعدادات (Settings) النسخة المثيلة (instance) أو تجاوزه في طلب واحد محدد.

مقطع يوضح فهرسة المستندات واسترجاعها قبل أن يكتب GLM-5.3 Flash الإجابة النهائية
يستقر GLM-5.3 Flash في مرحلة التوليد النهائية فقط، بينما تبقى مراحل الفهرسة والاسترجاع الحالية ثابتة في مكانها.

لماذا تعد نافذة الـ 1,048,576 رمزاً مهمة، ولماذا قد تضللك؟

تبلغ نافذة السياق المعلنة للنموذج الجديد ثمانية أضعاف نافذة الـ 131,072 رمزاً المحددة لنموذج GLM-4.7 Flash في قائمة النماذج المدعومة في AI Search. والسياق هو مجمل البيانات التي يمكن للنموذج معالجتها في طلب واحد، بما في ذلك التعليمات، والمقاطع المسترجعة، وسجل المحادثة، والإجابة التي ينتجها.

يمنح هذا السقف الأكبر خدمة AI Search مساحة إضافية لاستيعاب مقاطع مسترجعة أطول ومحادثات ممتدة، وهو أمر ذو أهمية للأدلة التقنية، ومستودعات السياسات واللوائح، ومحادثات الدعم الفني التي تعتمد إجاباتها على تفاصيل متفرقة عبر مصادر متعددة.

لكن هذا لا يعني أن AI Search باتت تدفع بقاعدتك المعرفية بالكامل داخل كل مطالبة (prompt)؛ فعملية الاسترجاع لا تزال تنتقي مجموعة محددة من الأجزاء النصية. يعيد ربط Workers الافتراضي 10 نتائج ويسمح بنطاق يتراوح بين 1 و 50 نتيجة. بالتالي، لن تعوض نافذة السياق ذات المليون رمز ضعف الفهرسة، أو عوامل التصفية الخاطئة، أو عتبة الاسترجاع التي تسقط المقاطع المفيدة.

هناك فارق عملي آخر جدير بالانتباه؛ إذ يدعم نموذج Workers AI المباشر التفكير المنطقي (reasoning)، واستدعاء الدوال (function calling)، والرؤية الحاسوبية (vision). أما داخل AI Search، فقد أضيف في هذا التحديث خصيصاً كنموذج لتوليد النصوص. فالصور الموجودة في مستنداتك المصدرية تُحول إلى Markdown أثناء مرحلة الفهرسة وقبل الوصول إلى مرحلة التوليد، لذا لا يحول هذا التحديث محادثة AI Search إلى نقطة نهاية لمعالجة وتحليل الصور الخام.

من يمكنه الاستفادة من هذا الإعداد فوراً؟

مؤسس SaaS الفردي الذي يواجه تكدساً في تذاكر الدعم

قم بفهرسة توثيقك العام المتاح للجمهور، وحدد GLM-5.3 Flash للتوليد، وضع واجهة المحادثة الناتجة خلف زر المساعدة في تطبيقك. القيمة هنا ليست الحصول على روبوت محادثة عام، بل امتلاك مسار مُدار ومباشر ينقل سؤال العميل إلى المقطع المصدري المسترجع ثم إلى الإجابة مباشرة.

يمكنك اختبار هذا المسار داخل لوحة التحكم قبل كتابة أي كود برمجي للتطبيق.

  1. إنشاء النسخة المثيلة (Instance)

    افتح AI Search في لوحة تحكم Cloudflare، واختر Create Instance، وسمّها، ثم اربطها بموقع منتجك الإلكتروني أو بحاوية R2. يمكنك أيضاً إنشاء النسخة أولاً ورفع الملفات إليها لاحقاً.

  2. انتظار انتهاء الفهرسة

    انتقل إلى تبويب Items في النسخة وتأكد من اكتمال فهرسة المحتوى. علماً بأن رفع أي ملف يبدأ عملية الفهرسة تلقائياً.

  3. اختيار نموذج التوليد

    افتح Settings، وحوّل الخيار من Smart Default إلى تحديد النموذج يدوياً، ثم اختر @cf/zai-org/glm-5.3-flash. سيبقى نموذج التضمين كما هو دون تغيير.

  4. اختبار وضعي التشغيل

    استخدم تبويب Search في الـ Playground لمعاينة الأجزاء المسترجعة، ثم استخدم تبويب Chat لمعاينة الإجابة المولدة. إذا أخفق البحث في جلب المصدر المناسب، فلن يؤدي تغيير نموذج التوليد إلى حل المشكلة.

وكالة تقنية صغيرة تدير قواعد معرفية لعملائها

احتفظ بمحتوى كل عميل في نسخة AI Search مستقلة، ثم وحّد طبقة التوليد على GLM-5.3 Flash للحالات التي يجتاز فيها تقييمات واختبارات العميل. الفائدة التشغيلية هنا واضحة: يحتفظ فريقك بنظام فهرسة واسترجاع موحد، بينما يحصل كل عميل على محتواه ومطالباته وقرار إطلاقه الخاص.

لا تدمج بيانات العملاء لمجرد تبسيط إدارة النماذج؛ إذ يمكن تعيين النموذج على مستوى كل نسخة مثيلة، كما تدعم Cloudflare مساحات الأسماء (namespaces) عندما تحتاج لإدارة عدة نسخ عبر ربط برمجي واحد.

فريق العمليات التقنية الذي يبحث في أدلة التشغيل (Runbooks)

اربط أدلة التشغيل المخزنة في R2، واستخدم الاسترجاع الهجين لالتقاط أكواد الأخطاء الدقيقة والإجراءات المتشابهة دلالياً في آن واحد، ودع GLM-5.3 Flash يحول الخطوات المسترجعة إلى إجابة واضحة وسلسة. الميزة هي الوصول الأسرع للإجراء الصحيح، مع بقاء الأجزاء المسترجعة متاحة دائماً للتحقق من المصدر.

في سيناريوهات معالجة الحوادث البرمجية، اعرض تلك الأجزاء المصدرية إلى جانب الإجابة. فالفقرة المولدة هي مجرد وسيلة مساعدة سريعة، وليست المرجع المطلق لتنفيذ التغييرات على أنظمة الإنتاج الحية.

مهندس المنصات الذي يختبر النموذج دون تغيير البنية التحتية

استخدم حقل model المتاح لكل طلب لتوجيه نسبة محددة وقابلة للقياس من الترافيك إلى GLM-5.3 Flash. سجّل استهلاك رموز الإدخال والإخراج، والأجزاء المسترجعة، ومعدل قبول الإجابات، وزمن الاستجابة (latency). وأبقِ على النموذج الحالي للنسخة لبقية الترافيك.

يمنحك ذلك مقارنة معيارية دقيقة ونظيفة؛ لأن الفهرس، وإعدادات الاسترجاع، ومجموعة البيانات المصدرية تظل كما هي تماماً، والوحيد الذي يتغير هو نموذج صياغة الإجابة.

إذا كان وكيلك الذكي يحتاج إلى استرجاع مباشر من الويب العام بدلاً من البحث في محتوى مفهرس مسبقاً، فهذه مهمة مختلفة تماماً. يستعرض دليل واجهات برمجة تطبيقات البحث بالذكاء الاصطناعي المزودين المتخصصين في هذا المسار.

كود Worker قابل للتشغيل باستخدام GLM-5.3 Flash

يبدأ دليل Workers الحالي من Cloudflare بإنشاء مشروع TypeScript مخصص لـ Worker:

Bash
npm create cloudflare@latest -- ai-search-tutorial
cd ai-search-tutorial

أضف ربط مساحة الأسماء إلى ملف wrangler.jsonc. والربط (binding) هو اتصال مسمى يتيح لـ Worker استدعاء موارد Cloudflare الأخرى. خيار remote: true ضروري هنا لأن AI Search لا تعمل داخل بيئتك المحلية؛ حيث يتولى Wrangler تمرير الطلب بالوكالة (proxy) إلى الخدمة السحابية المنشورة أثناء التطوير المحلي.

Jsonc
{
  "$schema": "./node_modules/wrangler/config-schema.json",
  "ai_search_namespaces": [
    {
      "binding": "AI_SEARCH",
      "namespace": "default",
      "remote": true
    }
  ]
}

بعد ذلك، استبدل محتوى src/index.ts بهذا المثال الكامل. قم بزيارة المسار /setup مرة واحدة لإنشاء النسخة وفهرسة مستند تجريبي. وستتولى كافة الطلبات الأخرى بعد ذلك استرجاع المحتوى المطابق ومطالبة GLM-5.3 Flash بكتابة الإجابة.

TypeScript
export interface Env {
	AI_SEARCH: AiSearchNamespace;
}

export default {
	async fetch(request, env): Promise<Response> {
		const url = new URL(request.url);

		if (url.pathname === "/setup") {
			const instance = await env.AI_SEARCH.create({ id: "my-instance" });
			const item = await instance.items.uploadAndPoll(
				"getting-started.md",
				"AI Search indexes uploaded content for retrieval.",
			);
			return Response.json({ created: "my-instance", status: item.status });
		}

		const query = url.searchParams.get("q") ?? "What does AI Search do?";

		const response = await env.AI_SEARCH.get("my-instance").chatCompletions({
			messages: [
				{
					role: "system",
					content: "Answer only from the indexed content. If the answer is missing, say so.",
				},
				{ role: "user", content: query },
			],
			model: "@cf/zai-org/glm-5.3-flash",
			ai_search_options: {
				retrieval: { max_num_results: 5 },
			},
		});

		return Response.json(response);
	},
} satisfies ExportedHandler<Env>;

شغّله محلياً باستخدام npx wrangler dev. وبعد التحقق من عمله محلياً، نفّذ npx wrangler login ثم npx wrangler deploy.

يعني وجود الربط أن كود Worker الخاص بك لا يحتاج لحمل رمز API token لـ AI Search. أما إذا كنت تستدعي REST API مباشرة، فيجب أن يحمل الرمز صلاحيتي AI Search:Edit و AI Search:Run.

الخطأ الشائع هنا هو محاولة تصحيح أخطاء النموذج بينما المشكلة تكمن في أن المقطع المصدري لم يُسترجع من الأساس. تحقق دائماً من response.chunks قبل تعديل المطالبة، أو زيادة السياق، أو لوم نموذج GLM؛ فلا يمكن صياغة إجابة دقيقة استناداً إلى مقطع لم يصل إلى النموذج أصلاً.

حسابات التكلفة والحدود الفعلية

خدمة AI Search نفسها مجانية حالياً خلال مرحلة البيتا المفتوحة ضمن حدود خطة Workers الخاصة بك. وتتم فوترة استهلاك Workers AI بشكل منفصل، كما قد تضيف بوابة AI Gateway تكاليفها الخاصة إذا قمت بربطها. وتوضح Cloudflare أنها ستخطر المستخدمين قبل 30 يوماً على الأقل من بدء تطبيق الرسوم على AI Search.

تبلغ تكلفة GLM-5.3 Flash نحو $0.15 لكل مليون رمز إدخال و $0.50 لكل مليون رمز إخراج. بالتالي، فإن طلباً يتضمن 5,000 رمز إدخال غير مخزن مؤقتاً (uncached) و 500 رمز إخراج سيكلف $0.001 تقريباً:

0.005 × $0.15 + 0.0005 × $0.50 = $0.001

وعند إجراء 20,000 طلب بهذا الحجم تماماً، ستكلف عمليات التوليد عبر Workers AI نحو $20. هذا الحساب لغرض التوضيح وليس تقديراً ثابتاً؛ إذ يشمل الإدخال كلاً من مطالبة النظام، والمحادثة، والأجزاء المسترجعة، مما يعني أن الاسترجاع المطول سيزيد الفاتورة بسرعة تفوق ما يوحي به السعر المبدئي المنخفض.

تتيح خطة Workers Free إجراء 20,000 استعلام شهرياً في AI Search، و 100 نسخة مثيلة، و 100,000 ملف لكل نسخة، والزحف إلى 500 صفحة موقع يومياً، بحد أقصى لحجم الملف يبلغ 4 MB. بينما ترفع خطة Workers Paid الحد الأقصى للنسخ إلى 5,000 نسخة، وتلغي القيود الشهرية على الاستعلامات والزحف اليومي، وتسمح بمليون ملف لكل نسخة، أو 500,000 ملف عند تفعيل البحث الهجين، مع بقاء الحد الأقصى لحجم الملف عند 4 MB.

لا تنشر صفحات Cloudflare أرقاماً رسمية خاصة بزمن الاستجابة أو جودة الإجابات لهذا النموذج داخل AI Search تحديداً؛ إذ تصف صفحة النموذج بنيته المعمارية وإمكانياته العامة، ولكن ذلك لا يمثل بالضرورة نتائجه الفعلية على مستنداتك الخاصة. لذلك، اختبر أسئلة ذات إجابات معروفة ومحددة مسبقاً قبل توجيه الترافيك الفعلي إليه، وبخاصة للمحتوى القانوني، أو المالي، أو الطبي، أو المتعلق بإدارة الحوادث التقنية.

ما الخطوات العملية التالية؟

ابدأ بالتجربة هذا الأسبوع إذا كنت تستخدم بالفعل ميزة Chat Completions في AI Search، وتبحث عن نموذج توليد مستضاف بالكامل لدى Cloudflare، ولديك مجموعة اختبار من الأسئلة المعروفة الإجابة. ثبت GLM-5.3 Flash على نسخة تجريبية أو تجاوزه لكل طلب على حدة، ثم قارن الأجزاء المسترجعة، وجودة الإجابات المقبولة، واستهلاك الرموز، وزمن الاستجابة مقابل نموذجك الحالي.

تمهل إذا كان خيار Smart Default يلبي أهدافك الحالية من حيث الجودة والتكلفة؛ فالخيار الجديد لا يفرض عليك الترحيل فوراً. وتمهل أيضاً إذا كان محتواك يعاني من مشاكل في الفهرسة؛ لأن تغيير نموذج التوليد لن يعالج المقاطع المصدرية المفقودة أو المقسمة بشكل سيئ.

لن تتأثر بهذا التحديث إطلاقاً إذا كنت تستدعي نقطة نهاية Search فقط وتقوم بتوليد الإجابات في طبقة النماذج الخاصة بك، وكذلك لن تتأثر إذا كنت لا تستخدم AI Search أساساً. فنموذج GLM-5.3 Flash متاح بشكل مباشر عبر Workers AI، إلا أن هذا الإصدار بالذات يركز على دمجه داخل مرحلة التوليد في AI Search.

إذا كنت ترغب في تحليلات تشغيلية متعمقة تواكب تطور هذه الأدوات، اشترك في النشرة البريدية.

آخر تحديث

3 سبتمبر 2026

التصنيفExplained

فضّل هذا الموقع في Google

إضافة omidsaffari.com كمصدر مفضّل في بحث Google

اجعل omidsaffari.com مصدرًا مفضّلًا، وسيرفعه Google لك في Top Stories وAI Overviews وAI Mode.

المزيد من Explained

عرض كل مقالات Explained
النشرة البريدية

رسالة واحدة، كل يوم أحد. أنظمة تعمل، لا آراء ساخنة.

سجلات بناء، وأنظمة قيد التشغيل، وملاحظات ميدانية من إدارة محفظة مشاريع ذكاء اصطناعي.

أسبوعية. بلا إزعاج. يمكنك إلغاء الاشتراك متى شئت.