ai-ml

بيئات تشغيل الوكلاء المدارة: AWS وGoogle وAlibaba في 2026

٢١ يوليو ٢٠٢٦

Managed Agent Runtimes: AWS, Google, Alibaba in 2026

ملخص: حلقة الوكيل (agent loop) — استدعاء النموذج، اختيار الأداة، تغذية النتيجة مرة أخرى، والتكرار — يتم إعادة تعبئتها الآن كبنية تحتية سحابية مدفوعة. جعلت AWS "ضابط الوكيل" (agent harness) الخاص بها ككائن تكوين خلف استدعاءين لـ API. ودمجت Google كل Vertex AI في منصة Gemini Enterprise Agent. وكشفت Alibaba عن مجموعة "Agent-Native Cloud" في مؤتمر WAIC في 18 يوليو. ثلاثة موردين، ثلاثة أسماء، ورهان واحد: وهو أنه يجب عليك التوقف عن كتابة كود التنسيق (orchestration code).

العرض مقنع والأساسيات قد تقاربت بالفعل. ولكن في حالة واحدة على الأقل، يختلف الإعلان والوثائق الخاصة بالمورد حول ما تم إطلاقه فعلياً — وهي وثائق AWS، وسجل التغييرات، وجدول المناطق من جهة، والبيان الصحفي لـ AWS من جهة أخرى.

في سطر واحد: بيئة تشغيل الوكيل المدارة (managed agent runtime) هي بنية تحتية سحابية تقوم بتشغيل حلقة تنسيق وكيل الذكاء الاصطناعي نيابة عنك — استدعاءات النماذج، تنفيذ الأدوات، بيئة التشغيل المعزولة (sandboxing)، الذاكرة، الهوية والتتبع — بحيث يتم تكوينها بدلاً من برمجتها. أعلنت كل من AWS وGoogle وAlibaba عن واحدة منها بين أبريل ويوليو 2026.

ما ستتعلمه

  • ما هي بيئة تشغيل الوكيل المدارة، وكيف تختلف عن إطار عمل الوكيل مثل LangGraph أو CrewAI
  • ما الذي يوفره لك ضابط AgentCore من AWS فعلياً، وصولاً إلى أنواع الأدوات وافتراضات الذاكرة
  • لماذا يقول إعلان AWS "متاح بشكل عام" بينما لا يزال جدول المناطق والوثائق وسجل التغييرات يشيرون إلى "نسخة تجريبية" (preview)
  • ما الذي أطلقته Google في أبريل، وقرار Vertex AI المدفون في الإعلان
  • ما الذي كشفت عنه Alibaba في WAIC 2026، وأي من أرقامها تم الإبلاغ عنها من قبل الشركة
  • الأساسيات التي تتقارب حولها هذه المنصات، وأين تضعف الأدلة العامة على هذا التقارب
  • التكلفة الفعلية لهذا على AWS، المورد الوحيد من بين الثلاثة الذي نشر أسعار الوحدة
  • متى يكون التكوين كافياً حقاً، ومتى يجب أن تظل تكتب الحلقة بنفسك

ما هي بيئة تشغيل الوكيل المدارة فعلياً

لنبدأ بالتعريف الذي ثبت. في سبتمبر 2025، استقر Simon Willison على صيغة كان الآخرون قد تقاربوا حولها بالفعل — "وكيل LLM يشغل أدوات في حلقة لتحقيق هدف ما" — مشيراً إلى أن صياغة "الأدوات في حلقة" "كانت شائعة لفترة من الوقت" وأن Anthropic على وجه الخصوص قد اعتمدتها. وكان قد جمع بشكل منفصل 211 تعريفاً متنافساً ولم يجد إجماعاً بينها، وهو ما كان الهدف الأساسي.1 وتقتبس AWS نفس السطر باستحسان في مواد الإطلاق الخاصة بها.2

لم تكن الحلقة أبداً هي الجزء الصعب. فأربعون سطراً من Python كفيلة بتشغيلها. ما يكلف الفرق أسابيع هو كل ما يحيط بهذه الحلقة: الحوسبة المعزولة لتنفيذ الكود الذي يولده النموذج، اتصالات الأدوات الآمنة، مكان لتخزين الحالة، الهوية لكي يعمل الوكيل كشخص ما، التتبع لتعرف ما الذي فعله، والعزل حتى لا تتمكن جلسة مستخدم واحد من رؤية جلسة مستخدم آخر.

تضع AWS هذا التمييز بوضوح في وثائقها: "كل وكيل لديه طبقة تنسيق... تشغيل هذه الحلقة يتطلب بنية تحتية تحتها: حوسبة لاستضافة الوكيل، بيئة معزولة لتنفيذ الكود بأمان، اتصالات آمنة بالأدوات، تخزين دائم، ذاكرة، هوية، وقابلية الملاحظة. تشكل هذه البنية التحتية معاً ضابط الوكيل (agent harness)."3

هذه هي الفئة. إطار العمل — LangGraph، CrewAI، أو Claude Agent SDK — يمنحك طريقة للتعبير عن الحلقة. أما بيئة تشغيل الوكيل المدارة فتمنحك مكاناً لتعيش فيه الحلقة، وتتولى أعمال السباكة التقنية الموجودة تحتها. الاثنان يكملان بعضهما البعض وليسا متنافسين، ولهذا السبب فإن ضابط AWS مبني نفسه على إطار عمل مفتوح المصدر ويمكنه العودة إلى واحد منها.

AWS: حلقة الوكيل خلف استدعاءين لـ API

أعلنت AWS عن التوافر العام لـ AgentCore harness في 17 يونيو 2026، وتبع ذلك التقرير الهندسي بعد يوم واحد.42 وكان الـ harness في مرحلة المعاينة منذ أبريل.2

الواجهة صغيرة عمدًا: CreateHarness لتعريف العميل (agent)، و InvokeHarness لتشغيله.2 أنت تحدد النموذج، ومجموعة من الأدوات، وبعض المهارات والتعليمات؛ وتقوم AWS بتجميع وتشغيل الحلقة. وبذلك يصبح تجربة نموذج مختلف أو إضافة أداة مجرد تغيير في الإعدادات بدلاً من تغيير في الكود.

في الخلفية، تكون كل جلسة stateful افتراضيًا وتعمل في microVM معزولة خاصة بها مع نظام ملفات وshell، بحيث يمكن للعميل كتابة الكود، وتنفيذه، والاحتفاظ بالملفات والذكريات عبر الجلسات.3 يتم تشغيل الـ harness بواسطة Strands Agents، وهو إطار عمل العملاء مفتوح المصدر من AWS.3

هناك أربع تفاصيل تستحق الذكر، لأنها هي التي تميز هذا النظام عن مجرد غلاف استضافة (hosting wrapper):

قابلية نقل النموذج صريحة. أربعة حقول للمزودين — bedrock، و openAi، و gemini و liteLlm — ويمكنك تبديل المزودين في منتصف الجلسة دون فقدان السياق. مثال AWS هو التخطيط باستخدام Claude Opus، وكتابة الكود باستخدام GPT-5.5، والتلخيص باستخدام Gemini، كل ذلك في محادثة واحدة مستمرة.2 توضع مفاتيح API الخاصة بالمزود في خزنة رموز AgentCore Identity؛ لذا لا يرى العميل أبدًا بيانات الاعتماد الخام.2

الأدوات عبارة عن تصريحات. خمسة أنواع: agentcore_gateway (مرجع ARN يكشف عن كل هدف OpenAPI أو Smithy أو Lambda أو MCP خلفه)، و remote_mcp (أي خادم MCP عبر URL)، و agentcore_browser، و agentcore_code_interpreter، و inline_function للموافقات البشرية (human-in-the-loop).2 إذا كنت تعاني من تدهور أداء عدد الأدوات في واجهات أدوات العملاء الكبيرة، لاحظ أن مرجع الـ gateway يتوسع ليشمل كل هدف يمثله — لذا تظل مسؤولية ضبط العدد على عاتقك.

أصبحت الذاكرة افتراضية بدلاً من كونها خطوة إضافية. عند التوافر العام (GA)، يؤدي حذف إعدادات الذاكرة إلى توفير مورد ذاكرة مدار تلقائيًا باستراتيجيات SEMANTIC و SUMMARIZATION، وصلاحية أحداث لمدة 30 يومًا، وتشفير مملوك لـ AWS وعزل متعدد المستأجرين يعتمد على actorId.2 إنه مورد حقيقي يمكن عنونته والاستعلام عنه أو فصله — وليس صندوقًا أسود.

هناك مخرج موثق. يقوم أمر واحد في واجهة سطر الأوامر (CLI) بتصدير الـ harness إلى كود يعتمد على Strands يحافظ على النموذج، والمطالبة (prompt)، والأدوات، وتوصيلات الذاكرة والمهارات. تصف AWS ذلك بأنه "ترجمة من الإعدادات إلى الكود، وليس تغييرًا في البنية التحتية"، وتقول إن Strands هو أول هدف للتصدير، مع "قرب وصول" Claude Agent SDK.2

هذه النقطة الأخيرة أهم من قائمة الميزات. بيئة التشغيل المدارة التي لا يمكنك مغادرتها هي فخ. أما بيئة التشغيل المدارة التي توفر مسار تصدير ميكانيكي فهي نقطة بداية.

تسمية التوافر العام التي تناقضها وثائق AWS نفسها

هنا تختلف الرواية بين الإعلان الرسمي وجزء التوثيق.

يقول إعلان 17 يونيو أن الـ harness "متاح بشكل عام اليوم في جميع مناطق AWS التجارية التي يتوفر فيها AgentCore".4 وتكرر مدونة 18 يونيو ذلك: "متاح اليوم في جميع مناطق AWS التي يتوفر فيها AgentCore بشكل عام"، مع رابط لجدول المناطق.2

اتبع ذلك الرابط. اعتباراً من 21 يوليو 2026، يدرج جدول المناطق المدعومة في AWS هذه الميزة كـ "AgentCore harness (preview)"، مع علامات اختيار في أربع مناطق فقط: شرق الولايات المتحدة (شمال فرجينيا)، غرب الولايات المتحدة (أوريغون)، أوروبا (فرانكفورت)، وآسيا والمحيط الهادئ (سيدني).5 في نفس الجدول، تظهر كل من AgentCore Runtime و Gateway و Identity و Built-in Tools و Observability في ست عشرة منطقة — خمس عشرة منطقة تجارية، بالإضافة إلى GovCloud (US-West). وتؤكد ملاحظات الإصدار الخاصة بـ AWS هذا الانقسام بدقة: حيث يصف إدخال في مايو 2026 ميزة Runtime بأنها "متاحة في جميع مناطق AWS الـ 15 التي يدعمها AgentCore Runtime"، ويعلن إدخال منفصل في مايو عن التوفر العام (GA) لـ AgentCore في AWS GovCloud (US-West).56

تتفق صفحة نظرة عامة على الـ harness مع الجدول وليس مع الإعلان: "AgentCore harness في مرحلة المعاينة العامة (public preview) في غرب الولايات المتحدة (أوريغون)، شرق الولايات المتحدة (شمال فرجينيا)، آسيا والمحيط الهادئ (سيدني)، وأوروبا (فرانكفورت)."3 كما تحمل تلك الصفحة ملاحظة في شريط علوي — "عمليات النشر عبر المناطق مستمرة: متاحة حالياً في SYD و FRA و IAD" — والتي تدرج ثلاث مناطق بينما تدرج الفقرة التي تليها أربع مناطق.3

تعد ملاحظات الإصدار الخاصة بـ AWS نفسها السطح الثالث، والأكثر لفتاً للنظر. يحمل سجل تغييرات AgentCore إدخالاً واحداً لحالة الـ harness — "AgentCore harness الآن في المعاينة العامة"، ومسجل تحت أبريل 2026، مما يؤكد بشكل مستقل تاريخ معاينة أبريل.6 ولا يوجد إدخال مقابل لوصول الـ harness إلى مرحلة التوفر العام. اعتباراً من 21 يوليو 2026، فإن أحدث قسم في سجل التغييرات هو مايو 2026؛ ولا يوجد قسم لشهر يونيو 2026 على الإطلاق.6

هناك إشارة رابعة أصغر ولكنها تشير إلى نفس الاتجاه. أمر التثبيت "للمسار الأسرع" في مدونة التوفر العام هو npm install -g @aws/agentcore@preview، باستخدام وسم توزيع npm الخاص بالمعاينة (preview).2

لإنصاف الأمر، يمكن استخدام سجل التغييرات كدليل في الاتجاهين. فصفحة ملاحظات الإصدار التي تفتقر إلى قسمي يونيو ويوليو هي في حد ذاتها صفحة لم يتم تحديثها منذ شهرين، مما يجعل "التقادم" هو التفسير الأكثر منطقية لكل هذا — فقد تكون الوثائق ببساطة متأخرة عن عملية طرح حدثت بالفعل. هذه القراءة متسقة تماماً مع الحقائق، وهي التي يراهن عليها هذا المقال.

لكن هذا لا يحل المشكلة العملية. فخدمات المعاينة في AWS غالباً ما تكون صالحة للاستخدام في بيئات الإنتاج ومجموعة القدرات هنا حقيقية؛ ولا يعني أي من هذا أن الـ harness لا يعمل. ما يعنيه هو أن المطور الذي يتحقق اليوم لا يمكنه تأكيد التوفر العام (GA) من أي مصدر في AWS باستثناء الإعلان نفسه. توجد تفسيرات حميدة أخرى أيضاً — مثل طرح إقليمي تدريجي، أو تمييز بين الـ harness الذي يتم الوصول إليه عبر CLI ومورد الـ harness المدار. لم تنشر AWS أيًا منها، وهذا المقال لا يجزم بأي المصادر هو الصحيح.

الخلاف في حد ذاته هو الجزء القابل للتحقق، وهو ما يجب أن تبني عليه تصرفك. إذا كانت عملية المشتريات لديك تتعامل مع "GA" كالتزام تعاقدي، فإن الإعلان أو صفحة التوثيق التي قد تكون قديمة ليست كافية بمفردها — تحقق من جدول المناطق لمنطقتك المحددة، وإذا كانت لا تزال تشير إلى "preview"، فاحصل على تأكيد كتابي من فريق حسابك قبل التخطيط لعملية نقل بناءً على ذلك.

الدرس العام هنا أضيق من مجرد "ثق في التوثيق". الإعلان يخبرك بتاريخ الإطلاق ونية المورد؛ أما التوثيق فيخبرك بالواقع التشغيلي ولكنه قد يتأخر عن ذلك لأسابيع. عندما يتعارض الاثنان، فإن الاستنتاج الصادق هو أنك لا تعرف بعد — وبالنسبة لأي شيء أساسي في البنية التحتية، فهذه هي اللحظة المناسبة للسؤال بدلاً من الافتراض.

جوجل: Vertex AI أصبح الآن منصة للوكلاء (Agent Platform)

جاءت خطوة جوجل في وقت مبكر وكانت أكبر من الناحية الهيكلية. في 22 أبريل 2026، أطلقت Google Cloud منصة Gemini Enterprise Agent Platform، واصفة إياها بأنها "تطور Vertex AI".7

هناك جملة مدفونة في الإعلان لها تأثير أكبر من أي ميزة أخرى: "من الآن فصاعداً، سيتم تقديم جميع خدمات Vertex AI وتطورات خارطة الطريق حصرياً من خلال Agent Platform، بدلاً من كونها خدمة مستقلة".7 لم يتم توسيع Vertex AI بميزات الوكلاء فحسب، بل تمت إعادة تنظيمه ليصبح منصة وكلاء.

قسمت جوجل النتيجة إلى أربعة ركائز — البناء، التوسع، الحوكمة، والتحسين — وتظهر قائمة المكونات كخريطة مباشرة لنفس المشكلة التي تحلها AWS:

  • Agent Runtime، والتي تقول جوجل إنها توفر عمليات تشغيل باردة (cold starts) في أقل من ثانية وتدعم "الوكلاء الذين يعملون لفترات طويلة بشكل مستقل لعدة أيام في المرة الواحدة"7
  • Agent Sandbox، وهي بيئة محصنة لتنفيذ الكود الذي يولده النموذج ومهام استخدام الكمبيوتر القائمة على المتصفح7
  • Agent Memory Bank، التي تولد وتنسق ذكريات طويلة المدى من المحادثات، مع ملفات تعريف ذاكرة (Memory Profiles) جديدة لاسترجاع سريع الاستجابة7
  • Agent Identity، والتي تمنح كل وكيل "معرفاً تشفيرياً فريداً" وسجلاً قابلاً للتدقيق7
  • Agent Gateway، الموصوفة بأنها "برج مراقبة حركة المرور لنظام الوكلاء الخاص بك"، حيث تفرض حمايات Model Armor ضد حقن الأوامر (prompt injection) وتسريب البيانات7
  • Agent Simulation, Evaluation, Observability and Optimizer، بالإضافة إلى اكتشاف الشذوذ باستخدام "نماذج إحصائية وإطار عمل LLM-as-a-judge"7

كشفت جوجل أيضاً عن رقم استخدام مفيد كمؤشر للنطاق: يتم معالجة أكثر من ستة تريليونات توكن شهرياً على نماذج Gemini من خلال Agent Development Kit.7 كما يوفر Model Garden وصولاً ممتازاً إلى أكثر من 200 نموذج، بما في ذلك نماذج من جهات خارجية مثل Claude Opus و Sonnet و Haiku من Anthropic.7

يجب قراءة النتائج التي ذكرها العملاء في الإعلان على أنها مختارة من قبل المورد: حيث تشير Payhawk إلى تقليل وقت تقديم المصروفات "بنسبة تزيد عن 50%"، وتصف Gurunavi تحسناً متوقعاً في الرضا بنسبة "30% أو أكثر" — وصيغ الأخير كتوقع مستقبلي وليس كنتيجة مقاسة.7 لا يوضح منشور Google أي المكونات متاحة بشكل عام (GA) مقابل تلك التي لا تزال في مرحلة المعاينة (preview)، وهذا المقال لا يدعي حالة التوفر العام لأي منها.

Alibaba: "Agent-Native Cloud"، وروايتان متناقضتان

أُعلن عن أحدث هذه المنصات الثلاث قبل ثلاثة أيام، في المؤتمر العالمي للذكاء الاصطناعي في شنغهاي في 18 يوليو 2026. وهي أيضاً المنصة التي لا تتفق فيها الروايات المتاحة مع بعضها البعض، لذا يستحق الأمر الفصل بينها.

ما تقوله Alibaba Cloud نفسها. يصف إعلانها الخاص مجموعة "Agent-Native Cloud" المصممة لـ "إدارة وتحسين وتنسيق سير عمل الوكلاء المتعددين مع تحسين كفاءة استنتاج النماذج الكبيرة"، وتسمي ثلاثة منتجات بدلاً من منصة واحدة: AgentRun، وهي طبقة دورة الحياة الحالية التي تغطي التطوير والنشر والعمليات؛ وإضافتان جديدتان، AgentLoop للتتبع والتقييم والتحسين الفوري لأداء الوكلاء، وAgentTeams للتنسيق والحوكمة عبر وكلاء متعددين.8 كما قدمت Alibaba أداة TokenWorks داخل منصتها للذكاء الاصطناعي، والمتاحة من خلال PAI-EAS، والتي تدمج توجيه الطلبات، وتنفيذ الاستنتاج، وإعادة استخدام الحوسبة والجدولة في نظام واحد.8

بمقارنة ذلك مع المنصتين الأخريين، نجد تطابقاً واضحاً: AgentRun هو بيئة التشغيل (runtime)، وAgentLoop هي طبقة المراقبة والتقييم، وAgentTeams هو تنسيق الوكلاء المتعددين.

أين تختلف التغطية الثانوية. تصف التقارير الناطقة بالإنجليزية عن نفس الإعلان — والتي تعود إلى تقرير من Shanghai Observer — البنية بشكل مختلف. فهي تنسب الإطلاق إلى Qi Zhou، رئيس منصة التطبيقات السحابية الأصلية في Alibaba Cloud، وتذكر AgentTeams إلى جانب مكون يسمى Agentic Computer للتنفيذ الآمن القائم على السحابة، وتستشهد ببيئات sandbox أصلية، وعزل أعباء العمل، والتوسع المرن، وتكامل الهوية المؤسسية. كما تذكر نتائج داخلية: 15 وكيلاً منسقاً للذكاء الاصطناعي يتعاملون مع 85% من طلبات دعم المطورين، وانخفاض بنسبة 90% في وقت الدعم التشغيلي، وضغط دورات الإصدار إلى يوم واحد.9

تتفق الروايتان في اسم منتج واحد فقط: AgentTeams. كل شيء آخر في تلك الفقرة غير مؤكد في إعلان Alibaba Cloud الإنجليزي، الذي لا يذكر "Agentic Computer"، ولا يستشهد بمقاييس النشر، ولا يقتبس من Zhou.8 التفسير الأرجح هو تفسير بسيط — منشور Alibaba الإنجليزي هو ملخص عام لمؤتمر WAIC يغطي سماعات الأذن والرقائق إلى جانب الوكلاء، بينما غطى Shanghai Observer جلسة واحدة بعمق، وتغيرت المصطلحات أثناء الترجمة. لكن النتيجة العملية تظل قائمة: لا يمكن تأكيد اسم المكون والنسب المئوية الرئيسية التي انتشرت في التغطية الإنجليزية بناءً على إعلان Alibaba نفسه. تعامل معها على أنها من مصدر واحد، وتعامل مع المقاييس الداخلية على أنها أرقام أبلغت عنها الشركة في جلسة مؤتمر خاصة بها، وهذا هو واقعها بغض النظر عن أي شيء.

استخدمت Huawei Cloud نفس الحدث لتوسيع منصتها AgentArts ونظام openJiuwen مفتوح المصدر ليشمل الخدمات المالية، حيث أطلقت "Industry AI Workshop – Smart Finance Zone" التي تهدف إلى تقليل الجداول الزمنية لتطوير الذكاء الاصطناعي من شهور إلى أسابيع، وخفض تكاليف التطوير بنسبة تزيد عن 60%.9 وهذا هو نفس مجتمع openJiuwen الذي يقف وراء مجموعة JiuwenMemory agent-memory، والتي تم إصدارها بشكل منفصل في 1 يوليو — أي أن طبقة الذاكرة ودفع تبني الصناعة جاءا من نظام بيئي واحد خلال ثلاثة أسابيع، رغم أن الأخير فقط هو ما تم الإعلان عنه في WAIC.

لم يتم الكشف عن التوافر والأسعار والتغطية الإقليمية لمنتجات Agent-Native Cloud في أي من الروايتين. لذا، فإن المقارنة التالية تبدأ بأسماء منتجات Alibaba نفسها وتحدد أي شيء تم إثباته فقط في التغطيات الثانوية.

أين تلتقي الشركات الثلاث

إذا قمنا بإزالة العلامات التجارية، سيظهر نفس شكل المكونات. تتفق AWS وGoogle في جميع العناصر الأساسية السبعة أدناه. ويؤكد إعلان Alibaba ثلاثة منها — وهي runtime، وmulti-agent orchestration، وobservability؛ أما العناصر الأربعة المتبقية فإما لم تسمها Alibaba أو تم إثباتها فقط في التغطيات الثانوية، لذا يحددها الجدول على هذا النحو بدلاً من افتراض التكافؤ.

العنصر الأساسيAWS AgentCoreGoogle Agent PlatformAlibaba Agent-Native Cloud
وقت التشغيل / دورة الحياةيعمل على AgentCore Runtime3Agent Runtime، تشغيل بارد في أقل من ثانية7AgentRun — التطوير، النشر، والعمليات8
التنفيذ المعزولmicroVM لكل جلسة مع نظام ملفات وshell3Agent Sandbox للأكواد التي تولدها النماذج واستخدام الكمبيوتر7تم ذكر الـ Sandboxing في تغطيات ثانوية؛ لم يتم تسميته في إعلان Alibaba الرسمي98
الذاكرة المستمرةذاكرة مدارة، يتم توفيرها تلقائياً بشكل افتراضي2Agent Memory Bank مع ملفات تعريف الذاكرة (Memory Profiles)7لم يتم ذكرها في المصادر التي تمت مراجعتها
هوية العميل (Agent identity)AgentCore Identity، خزنة رموز (token vault) لمفاتيح المزودين2Agent Identity، معرف تشفيري فريد لكل عميل7تم الإبلاغ عن تكامل الهوية في التغطيات الثانوية فقط9
الاتصال بالأدواتبوابة (Gateway) + MCP مباشر + متصفح/مفسر مدمج2Agent Gateway مع فرض سياسة Model Armor7لم يتم ذكرها في المصادر التي تمت مراجعتها
تنسيق العملاء المتعددينتصدير إلى كود للتنسيق المخصص2تنسيق من عميل إلى عميل آخر7AgentTeams — التنسيق والحوكمة8
القابلية للملاحظة والتقييمCloudWatch GenAI Observability؛ AgentCore Evaluations2Agent Observability, Simulation, Evaluation, Optimizer7AgentLoop — التتبع، التقييم، والتحسين8

هناك قراءتان لهذا الجدول تستحق التفكير فيهما في آن واحد.

الرؤية المتفائلة: عندما يتفق الموردون على نفس قائمة المكونات، يكون ذلك عادةً دليلاً على أن المشكلة حقيقية وأن شكلها مفهوم. تتطابق AWS وGoogle تقريباً بنداً ببند، وما وصفته Alibaba علناً يتسق مع ذلك قدر ما يتوفر من معلومات. لا توجد مواصفات مشتركة هنا ليتم نسخها — لا توجد هيئة معايير حددت "صندوق رمل لكل جلسة (per-session sandbox) بالإضافة إلى ذاكرة دائمة وهوية للعميل وبوابة أدوات تفرض السياسات". التفسير الأكثر ترجيحاً هو أن الثلاثة راقبوا فشل العملاء في إدخال العملاء (agents) إلى مرحلة الإنتاج لنفس الأسباب المتكررة. لاحظ أيضاً أن الإعلانات كانت متتالية وعلنية — Google في أبريل، AWS في يونيو، Alibaba في يوليو — لذا كان لدى كل مشترك لاحق المشتركون السابقون ليتعلم منهم. هذا تقارب (convergence)، وليس دليلاً على اختراع مستقل.

الرؤية الحذرة: التقارب في العناصر الأساسية (primitives) ليس تقارباً في الواجهات. CreateHarness ليس هو Agent Runtime وليس هو AgentTeams. العناصر الأساسية تتشابه؛ لكن واجهات برمجة التطبيقات (APIs) لا تتشابه. إمكانية النقل بين هذه المنصات اليوم تتم من خلال طبقة التجريد الخاصة بك أو من خلال البروتوكولات المفتوحة مثل MCP وA2A — وليس من خلال أي شيء اتفق عليه الموردون. وهذا بالضبط هو السبب في أن عمل مواصفات MCP عديمة الحالة (stateless) وبروتوكولات العميل-إلى-العميل تكتسب أهمية أكبر، وليس أقل، مع انتشار بيئات التشغيل المدارة.

أما Agent 365 من Microsoft، والذي أصبح متاحاً بشكل عام (GA) في وقت سابق من هذا العام كلوحة تحكم لهوية العميل وحوكمته، فيستهدف نفس المنطقة من جانب الإدارة بدلاً من جانب التنفيذ. أربعة عمالقة للحوسبة السحابية، أربع مفردات، ومشكلة واحدة.

التكلفة الفعلية

من بين الثلاثة، قامت AWS فقط بنشر تسعير الوحدة في المواد التي تمت مراجعتها هنا.

لا توجد رسوم منفصلة لـ harness — أنت تدفع مقابل العناصر الأساسية التي يستهلكها العميل.2 يتم فوترة حوسبة وقت التشغيل (Runtime compute) بناءً على الاستهلاك النشط لكل ثانية بسعر 0.0895 دولار لكل ساعة vCPU و0.00945 دولار لكل ساعة جيجابايت، وتقدم AWS حجة محددة حول سبب ملاءمة هذا الهيكل للعملاء: "تستهلك أعباء عمل العملاء وقتاً طويلاً في انتظار إدخال/إخراج النموذج والأداة. يتم فوترة وقت التشغيل فقط عندما يتم استهلاك وحدة المعالجة المركزية (CPU) فعلياً."2 يستخدم المتصفح ومفسر الكود (Code Interpreter) نفس النموذج. يتم فوترة البوابة (Gateway) لكل 1,000 استدعاء ولكل 1,000 استعلام بحث. يتم فوترة الذاكرة لكل 1,000 حدث قصير المدى، ولكل 1,000 سجل طويل المدى شهرياً، ولكل 1,000 عملية استرجاع. أما إمكانية المراقبة (Observability) فتتبع تسعير CloudWatch القياسي، ويتم تحصيل رسوم استنتاج النموذج بشكل منفصل بواسطة Bedrock أو المزود الخارجي.2

النتيجة العملية: تكلفة العميل الآن موزعة على خمسة مقاييس على الأقل بالإضافة إلى الاستنتاج، وهذه المقاييس ليست متناسبة مع بعضها البعض. العميل "الثرثار" الذي يقوم بعدد قليل من استدعاءات الأدوات، والعميل "المعتمد على الأدوات" الذي يقوم بدورات تفكير قصيرة، سيكون لديهما فواتير مختلفة تماماً لنفس المدة الزمنية. قم بنمذجة عبء العمل الخاص بك؛ ولا تعتمد في تقديرك على رقم الساعة وحده. الأسعار والفئات تتغير — تحقق من صفحة تسعير AgentCore الحالية قبل تخصيص الميزانية.

لم يتم نشر تسعير Google وAlibaba لمنصات العملاء الخاصة بهم في الإعلانات التي تمت مراجعتها لهذا المقال.

ماذا يعني هذا إذا كنت تبني عملاء (Agents)

التكوين (Configuration) كافٍ حقاً في أغلب الأحيان أكثر مما يتوقعه المهندسون. إذا كان عميلك هو "استدعِ هذه الأدوات، تذكر هذا المستخدم، قم بتشغيل هذا الكود في صندوق رمل، تتبع كل شيء"، فأنت تصف مشكلة تم حلها وسيقوم ثلاثة موردين الآن بتشغيلها نيابة عنك. الأسابيع التي كانت تُقضى سابقاً في عزل الجلسات ووساطة الاعتمادات لم تكن أبداً عملاً يميز منتجاً عن آخر.

تحقق من ملصق الحالة بنفسك، في منطقتك. حالة AWS في هذا المقال ليست نمطاً شاذاً؛ بل هي الفجوة المعتادة بين منشور الإطلاق وصفحة التوثيق. قبل أن تخطط بناءً على ميزة معينة، افتح جدول المناطق أو التوفر الخاص بالمورد في اليوم الذي تخطط فيه.

تعامل مع مسار التصدير كمتطلب أساسي. إن ميزة تصدير "الإعدادات إلى كود" (config-to-code) من AWS هي الشيء الأكثر طمأنينة في إعلان التوفر العام (GA)، تحديداً لأنها تجعل المنصة قابلة للمغادرة. عندما تقيم أي بيئة تشغيل مدارة للوكلاء (managed agent runtime)، اسأل عما يحدث عندما لا تعود الإعدادات كافية — وكن متشككاً في أي إجابة مفادها "أعد كتابتها".

مقاييس النشر التي يبلغ عنها الموردون هي مجرد تسويق حتى يتم إعادة إنتاجها بشكل مستقل — وتحقق مما إذا كانت صادرة عن المورد أصلاً. الرقم الذي تكرر على نطاق واسع بأن 15 وكيلاً يتعاملون مع 85% من طلبات دعم المطورين في Alibaba يعود إلى تقرير واحد عن جلسة مؤتمر، وليس إلى إعلان Alibaba Cloud نفسها. نسب العملاء لدى Google موجودة على الأقل في منشور Google الخاص، لكنها مختارة ذاتياً. استخدم أرقاماً كهذه لتحديد حجم الفرصة، وليس لتبرير قرار أبداً.

استمر في كتابة الحلقة (loop) الخاصة بك عندما تكون الحلقة هي المنتج. إذا كان تميزك يكمن في التنسيق المخصص — استراتيجيات تخطيط غير تقليدية، تدفق تحكم خاص بالمجال، توبولوجيا مبتكرة للوكلاء المتعددين — فإن الهيكل المدار (managed harness) يقوم بتجريد الطبقة ذاتها التي تحاول الابتكار فيها. استخدم البدائيات المدارة في الأسفل واحتفظ بالحلقة.

الخلاصة

بين أبريل ويوليو 2026، قرر ثلاثة من عمالقة الحوسبة السحابية أن حلقة الوكيل (agent loop) هي بنية تحتية وليست مجرد كود تطبيق، وبدأوا في بيعها على هذا الأساس. إن التقارب حول نفس شكل المكونات — بيئة تشغيل مدارة، تنفيذ معزول (sandboxed)، ذاكرة مستدامة، هوية للوكيل، بوابة أدوات تفرض السياسات، تنسيق وتتبع الوكلاء المتعددين — هو دليل جيد على أن الصناعة تتفق الآن على ما تحتاجه الوكلاء في بيئة الإنتاج، مع التحفظ بأن Alibaba فصلت علنًا جزءًا أقل من مجموعتها التقنية مقارنة بالاثنين الآخرين.

لكن هذا لا يعني بعد إمكانية النقل. الأساسيات تتشابه؛ لكن واجهات برمجة التطبيقات (APIs) لا تتشابه، ولا يوجد شيء في هذه الإعلانات يجعل الوكيل قابلًا للنقل بين السحابات. تظل البروتوكولات المفتوحة هي التحوط الحقيقي الوحيد.

وهناك نقطة صغيرة تستحق الذكر: عند مراجعتها معًا في 21 يوليو، تبين أن البيان الصحفي لـ AWS في يونيو، وتوثيقها الحالي، وجدول المناطق، وسجل التغييرات الخاص بها، كانت متضاربة حول ما إذا كانت ميزة أساسية متاحة بشكل عام أو في مرحلة المعاينة. عندما يتعارض تسويق المزود مع وثائقه، فإن الوثائق هي التي تحتوي على قائمة المناطق الصحيحة.

الحواشي

  1. Simon Willison, "I think 'agent' may finally have a widely enough agreed upon definition to be useful jargon now," September 18, 2025. https://simonwillison.net/2025/Sep/18/agents/

  2. كوستي فاسيلكاكيس، ألكسندر ريتشي، إيفاندرو فرانكو وفيفيك دالال، "Amazon Bedrock AgentCore harness متاح الآن بشكل عام: انتقل من الفكرة إلى عميل بمستوى إنتاجي في دقائق"، مدونة AWS Artificial Intelligence، 18 يونيو 2026. https://aws.amazon.com/blogs/machine-learning/amazon-bedrock-agentcore-harness-is-now-generally-available-go-from-idea-to-production-grade-agent-in-minutes/ 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23

  3. AWS, "نظرة عامة على AgentCore harness"، دليل مطور Amazon Bedrock AgentCore. تم الدخول في 21 يوليو 2026. https://docs.aws.amazon.com/bedrock-agentcore/latest/devguide/harness.html 2 3 4 5 6 7 8 9

  4. AWS, "AgentCore harness متاح الآن بشكل عام" [كما وردت]، AWS What's New. نُشر في 17 يونيو 2026. https://aws.amazon.com/about-aws/whats-new/2026/06/amazon-bedrock-agentcore-harness-generally-available/ 2 3

  5. AWS, "مناطق AWS المدعومة"، دليل مطور Amazon Bedrock AgentCore. تم الدخول في 21 يوليو 2026. https://docs.aws.amazon.com/bedrock-agentcore/latest/devguide/agentcore-regions.html 2 3

  6. AWS, "ملاحظات الإصدار لـ Amazon Bedrock AgentCore"، دليل مطور Amazon Bedrock AgentCore. تم الدخول في 21 يوليو 2026. https://docs.aws.amazon.com/bedrock-agentcore/latest/devguide/release-notes.html 2 3 4

  7. مايكل جيرستنهابر ومايكل باكمان، "تقديم Gemini Enterprise Agent Platform، الذي يدعم الموجة التالية من الوكلاء"، مدونة Google Cloud، 22 أبريل 2026. https://cloud.google.com/blog/products/ai-machine-learning/introducing-gemini-enterprise-agent-platform 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19

  8. كريستال ليو، وشاو شياويي، وكارين تشانغ، وجابي فو، "Alibaba Cloud تكشف عن ابتكارات Agent-Native في WAIC 2026"، مجتمع Alibaba Cloud، 20 يوليو 2026 (نُشرت في الأصل على Alizila). https://www.alibabacloud.com/blog/alibaba-cloud-unveils-agent-native-innovations-at-waic-2026_603377 2 3 4 5 6 7 8 9

  9. فيفيان نجوين، "Alibaba Cloud تطلق Agent Native Cloud لتوسيع نطاق وكلاء الذكاء الاصطناعي للمؤسسات"، Crypto Briefing، 18 يوليو 2026. https://cryptobriefing.com/alibaba-cloud-launches-agent-native-cloud-to-scale-enterprise-ai-agents/ 2 3 4 5

الأسئلة الشائعة

بنية تحتية سحابية تقوم بتنفيذ حلقة تنسيق الوكيل الذكي نيابة عنك — استدعاء النموذج، تنفيذ الأدوات، تنفيذ الكود في بيئة معزولة (sandboxed)، استمرارية الذاكرة، الهوية والتتبع — يتم تعريفها من خلال الإعدادات بدلاً من كود التطبيق.