TrueForge: الجزء الصعب في وكلاء الذكاء الاصطناعي ليس النموذج
TrueForge من TrueFoundry حاضنة وكلاء مفتوحة المصدر تدعي خفض التكلفة بما يصل إلى 75% مقارنة بـ Claude Managed Agents. ما الذي تفعله الحاضنة فعلياً، وما الذي يظهره الاختبار حقاً، ولماذا هذه أخبار جيدة للنماذج المفتوحة.
في هذه الصفحة
- ماذا حدث؟
- لماذا الحاضنة هي الطبقة التي تستحق المنافسة؟
- الاختبار، بقراءة حذرة
- نموذج العمل ليس الترخيص
- ماذا يعني ذلك للنماذج المفتوحة؟
- ماذا ينبغي أن تفعل الآن؟
- الأسئلة الشائعة
- ما هي حاضنة الوكلاء؟
- هل TrueForge مجاني؟
- كيف يقارن TrueForge مع Claude Managed Agents؟
- هل يستطيع TrueForge استخدام نماذج صينية مفتوحة مثل GLM أو Qwen؟
- الخلاصة
- المصادر
اسأل غرفة من المهندسين ما الذي يجعل بناء وكيل ذكاء اصطناعي صعباً، وسيقول معظمهم: النموذج. اسأل غرفة من المهندسين الذين أطلقوا واحداً فعلاً إلى الإنتاج، وستحصل على قائمة مختلفة: جلسات تنجو من إعادة التشغيل، وبيانات اعتماد الأدوات لا تتسرب إلى صندوق العزل، وخطوة موافقة بشرية تعمل عند الثانية صباحاً، ونافذة سياق لا تكلفك بهدوء عشرة أضعاف ما وضعت له ميزانية. النموذج هو الجزء الذي تستطيع استبداله في ظهيرة. الآلات المحيطة به هي الجزء الذي يلتهم الربع كله.
هذه الآلات هي ما فتحته TrueFoundry كمصدر في 19 أغسطس. TrueForge حاضنة وكلاء، أي طبقة بيئة التشغيل التي تدير الحلقة حول النموذج: خطط، استدع أداة، أعد النتيجة إلى النموذج، كرر، مع إدارة الجلسات وصناديق العزل والموافقات والسياق في الطريق. عرض الإطلاق هو بديل محايد تجاه المورد لـ Claude Managed Agents من Anthropic بتكلفة تشغيل تقارب النصف، والاختبار الذي يقف خلف هذا العرض يعتمد على نموذج صيني مفتوح للقيام بالعمل الثقيل. وهذا هو الجزء الذي أجده الأكثر إثارة للاهتمام. قرأت المستودع ومنشور الإعلان والتغطية. إليك ما يصمد أمام التدقيق.
أهم الخلاصات - TrueForge حاضنة وكلاء بترخيص MIT من TrueFoundry: خادم أساسي يشغّل حلقة الوكيل، وواجهة HTTP API مع SDK لـ TypeScript، وواجهة دردشة قابلة للتضمين. أي مزود نموذج، وأي خادم MCP، وعلى بنيتك التحتية أنت. - الاختبار الرئيسي: في تقييم مؤسسي من 14 مهمة، طابق TrueForge نسبة إكمال المهام في Claude Managed Agents بتكلفة أقل بنحو 30% على النموذج نفسه، وأقل بنحو 75% عند إقرانه بـ GLM-5.2 بدلاً من Opus 4.8. هذا اختبار TrueFoundry نفسها، ولم يتحقق منه طرف مستقل. - بيئة التشغيل مجانية؛ النشاط التجاري هو البوابة الموجودة تحتها. تبيع TrueFoundry طبقة الحوكمة، من الميزانيات وحدود المعدل والتدقيق والرصد، التي تمر عبرها كل استدعاءات النماذج والأدوات. - بالنسبة للنماذج المفتوحة، هذه هي القصة الأهم: الحاضنة المحايدة تعني أن أرخص نموذج ينجز المهمة يفوز بالحمل، وهذه المنافسة تضم بصورة متزايدة مختبرات صينية. - الوضع المحلي عملية واحدة مع SQLite ومن دون تسجيل دخول. عامله كطريقة لتجربة النظام، لا أكثر.
ماذا حدث؟
في 19 أغسطس، أطلقت TrueFoundry، وهي شركة ناشئة للبنية التحتية للذكاء الاصطناعي في سان فرانسيسكو أسسها مهندسون سابقون في Meta عام 2021، مشروع TrueForge بترخيص MIT. ظهرت تغطية الإطلاق في VentureBeat وInfoWorld في الأسبوع نفسه، وتجاوز المستودع 1,800 نجمة خلال أيام. أهم الحقائق:
تشغّل الحاضنة حلقة تنفيذ الوكيل كاملة: استدعاءات النماذج، وأدوات MCP، والمهارات، وتنفيذ الشفرة داخل صندوق عزل، والموافقات البشرية، وإدارة السياق، وحالة الجلسة، مع بث من طرف إلى طرف.
تُعرض بثلاث طرق: واجهة دردشة مرفقة، وHTTP API مع SDK لـ TypeScript باسم
@truefoundry/trueforge-sdk، وSDK للواجهة قابلة للتضمين باسم@truefoundry/trueforge-uiلوضع الواجهة داخل منتجك.تأتي النماذج من كتالوجات YAML: OpenAI وAnthropic وGemini ونحو عشرين مزوداً آخر، إضافة إلى أي نقطة نهاية متوافقة مع OpenAI. والمهارات حزم
SKILL.mdمدعومة بـ Git، وهي الصيغة نفسها التي اشتهر بها Claude Code.يعمل في شكلين: وضع محلي، عملية واحدة مع SQLite تبدأ بالأمر
npx @truefoundry/trueforge، أو وضع مستضاف، Postgres مع Redis عبر Docker Compose أو Helm، للفرق.يتوفر إصدار مستضاف بالدفع حسب الاستخدام من TrueFoundry للفرق التي لا تريد تشغيله بنفسها. وتُذكر NetApp وAutomatiq كمستخدمين مبكرين، إلى جانب مساعد TrueFoundry الداخلي.
TrueForge حاضنة وكلاء مفتوحة المصدر بترخيص MIT أطلقتها TrueFoundry في 19 أغسطس 2026. تشغّل حلقة الوكيل، بما فيها استدعاءات النماذج وأدوات MCP والتنفيذ المعزول والموافقات وإدارة السياق وحالة الجلسة، وتعرضها من خلال واجهة دردشة وHTTP API مع SDK لـ TypeScript وواجهة قابلة للتضمين، وفق إعلان TrueFoundry.
لماذا الحاضنة هي الطبقة التي تستحق المنافسة؟
بناء عرض لوكيل سهل. تشغيل خمسين منها في الإنتاج ليس كذلك، والفجوة بين الاثنين كلها عمل في الحاضنة. النموذج يستدل، لكنه لا يستطيع التصرف وحده: لن يفتح ملفاً، أو يستدعي API، أو يتذكر ما قاله قبل ثلاث رسائل، أو يوقف نفسه قبل حذف الجدول الخطأ. لا بد أن تنفذ شفرة أحد كل ذلك، مراراً وبأمان وبتكلفة يمكن توقعها.
حتى وقت قريب كان لديك خياران. تبني الحاضنة بنفسك، ما يعني شهوراً من أعمال الربط ثم تجد نفسك تحافظ على بيئة تشغيل بدلاً من منتج، أو تستأجر واحدة من مزود النموذج. وهذا ما تفعله Claude Managed Agents: تشغّل Anthropic الحلقة نيابة عنك، وتُحاسب بتوكنات Claude إضافة إلى 0.08 دولار لكل ساعة جلسة تشغيل، محسوبة حتى جزء الألف من الثانية. الخيار الثاني مريح لكنه محرج بنيوياً. عندما تكون بيئة التشغيل والأدوات والفوترة كلها لدى مورد واحد، تصبح خريطة طريقك لديه أيضاً.
ولهذا أيضاً تهم ميزات هندسة السياق أكثر من قائمة النماذج. يقدم TrueForge وكلاء فرعيين، وتحميلاً مؤجلاً للأدوات، حيث تُحمّل تعريفات الأدوات عند الحاجة بدلاً من حشرها في كل أمر، ونقل النتائج الكبيرة خارج السياق، وضغط السياق. كلها حيل تمنع تشغيل وكيل طويل من الغرق في تاريخه. هذه ليست كماليات. في اختبار TrueFoundry، استهلك إعدادها 3.8 مليون توكن لكل تشغيل مقابل 10 ملايين في Claude Managed Agents على المهام نفسها والنموذج نفسه. حتى لو أخذت الرقم بتحفظ، فالاتجاه صحيح: معظم تكلفة الوكلاء هدر في السياق، والتعامل مع السياق عمل الحاضنة. ولهذا أقول للعملاء إن السؤال المثير في المعمارية الوكيلية نادراً ما يكون أي نموذج، بل ما الذي يحيط به.
تتولى حاضنة الوكلاء مشكلات الإنتاج التي لا تتولاها النماذج: الجلسات، وبيانات اعتماد الأدوات، وصناديق العزل، والموافقات، ونمو السياق. في اختبار TrueFoundry، استخدمت حاضنتها 3.8 مليون توكن لكل تشغيل مقابل 10 ملايين لـ Claude Managed Agents على مهام متطابقة، وتعزو ذلك إلى ضغط السياق والتحميل المؤجل للأدوات.
الاختبار، بقراءة حذرة
الرقم الذي يتصدر كل مكان هو 75%، فلنفككه، لأنه في الحقيقة رقمان يرتديان معطفاً واحداً.
اختبرت TrueFoundry على Enterprise-Bench من DevRev، وهو تقييم من 14 مهمة يغطي أنظمة محاكاة لـ CRM وتتبع المشكلات والوثائق. المهام نفسها، والأدوات نفسها، والنموذج نفسه:
أكمل TrueForge مع Opus 4.8 من Anthropic نحو 11 من 14 مهمة بمتوسط 8.50 دولارات لكل تشغيل.
أكمل Claude Managed Agents مع Opus 4.8 نفسه العدد نفسه تقريباً بمتوسط 11.80 دولاراً لكل تشغيل.
أكمل TrueForge مع GLM-5.2، النموذج مفتوح الأوزان من Zhipu، العدد نفسه تقريباً أيضاً بمتوسط 2.90 دولار لكل تشغيل.
إذن التفكيك الصادق: حاضنة مقابل حاضنة على النموذج نفسه توفر نحو 30%، معظمها هامش خدمة مُدارة مع خفض التوكنات المذكور أعلاه. القفزة إلى 75% تأتي من تبديل النموذج أيضاً، من Opus 4.8 إلى GLM-5.2. هذه المقارنة تغير متغيرين في وقت واحد، كما لاحظ تحليل حاد، وتخبرك أكثر عن مدى تقدم النماذج المفتوحة مما تخبرك عن TrueForge نفسه. وهي، بطريقة ما، حجة TrueFoundry الفعلية: إذا كانت الحاضنة محايدة، فأنت حر في أخذ هذا التوفير.
هناك تحفظان إضافيان. أجرت TrueFoundry الاختبار بنفسها، ولم يُتحقق منه بصورة مستقلة على أحمال إنتاجية أكبر. كما أن 14 مهمة عينة صغيرة: ثلاث مهام من الضوضاء هي الفرق بين أسبوع جيد وآخر سيئ. تعامل مع الأرقام بوصفها معلنة لا مدققة.
التقييم نفسه، وثلاث تهيئات. توفير 30% هو حاضنة مقابل حاضنة؛ أما توفير 75% فيأتي في معظمه من تبديل النموذج. أرقام معلنة من المورد، ويمكن إعادة إنتاجها من مجلد الاختبار في المستودع.
في اختبار TrueFoundry الذاتي على Enterprise-Bench من DevRev، طابق TrueForge أداء Claude Managed Agents عند نحو 11 من 14 مهمة: 8.50 دولارات مقابل 11.80 دولاراً لكل تشغيل على نموذج Opus 4.8 نفسه، أي أقل بنحو 30%، و2.90 دولار لكل تشغيل عند إقرانه بـ GLM-5.2، أي أقل بنحو 75%، وفق الإعلان. لم تُتحقق النتائج بصورة مستقلة، ورقم 75% يغير الحاضنة والنموذج معاً.
نموذج العمل ليس الترخيص
أعطِ بيئة التشغيل مجاناً، وبع الطبقة الموجودة تحتها. الحاضنة مفتوحة المصدر كاملة ومجانية فعلاً، لكن TrueForge مصمم لتوجيه كل استدعاء نموذج وتفاعل MCP عبر AI Gateway من TrueFoundry، وهناك تعيش الميزانيات وحدود المعدل والحواجز وسياسات الوصول والرصد. هذا هو المنتج التجاري، إلى جانب الفئة المستضافة بالدفع حسب الاستخدام للفرق التي تفضل ألا تشغّل Postgres بنفسها.
لا أقول ذلك كنقد؛ إنها الصفقة نفسها في كثير من البنى مفتوحة المصدر الجيدة، وتظهر خلفية Meta. حجة المؤسسين هي أن التحكم والراحة ليسا متضادين إذا كانت المنصة صحيحة، وأن إعطاء الحاضنة مجاناً هو الطريقة لوضع طبقة التحكم الخاصة بك تحت وكلاء الجميع. يصف Robert Rubin، المدير الأول لهندسة المنصة في NetApp، TrueFoundry بأنها «المنصة المركزية في تقنية المعلومات التي تمر عبرها التطبيقات الوكيلية والوكلاء»، وهو بالضبط الموقع الذي تريد الشركة امتلاكه. كمشترٍ، من المفيد أن تعرف أي طبقة تلتزم بها. الحاضنة تستطيع عمل fork لها. البوابة اشتراك.
وتزدحم المنافسة، ما يخبرك أن الفئة حقيقية: بيئة Anthropic المُدارة عند الطرف المغلق، وDeep Agents من LangChain في عالم الأطر، وحاضنة DeepSeek نفسها بترخيص MIT ولا تزال في معاينة للمطورين، والآن TrueForge يستهدف الاستخدام الإنتاجي العام. عندما تطلق ثلاث قارات الطبقة نفسها من البرمجيات خلال عام، فالطبقة تحمل وزناً حقيقياً.
TrueForge مجاني بترخيص MIT، لكنه مصمم لتوجيه حركة النماذج وMCP عبر AI Gateway التجاري من TrueFoundry، حيث تباع ميزات فرض الميزانية وحدود المعدل والرصد. ومن المستخدمين المبكرين المذكورين عند الإطلاق NetApp وAutomatiq، وفق تغطية الإطلاق.
ماذا يعني ذلك للنماذج المفتوحة؟
هذه هي الزاوية التي أظن أن معظم التغطية الغربية قللت من شأنها. بيئة تشغيل مُدارة مرتبطة بعائلة نموذج واحدة هي خندق دفاعي لتلك العائلة. أما بيئة تشغيل محايدة فهي أداة مساواة: كل حمل يمر عبر TrueForge يصبح حملاً يمكن فيه لـ GLM-5.2 أو Qwen أو DeepSeek أو Kimi أن يفوز على أساس تكلفة المهمة المكتملة، لا العلامة التجارية. رقم 75% موجود لأن نموذجاً صينياً مفتوح الأوزان أكمل مهام مؤسسية بربع سعر Opus. قبل عام، لم يكن بإمكانك كتابة جملة «النموذج الرخيص أكمل عدداً مماثلاً من المهام» بوجه جاد.
هذا هو النمط الذي أراقبه من Hangzhou منذ فترة: مختبرات الأوزان المفتوحة لا تحتاج إلى هزيمة النماذج المتقدمة في كل شيء، بل أن تقترب بما يكفي حتى تتوقف الطبقة فوقها عن الاهتمام بالنموذج الموجود تحتها. الحاضنة المحايدة هي هذه الطبقة بالضبط، وهي الآن مفتوحة المصدر ومعها قصة حوكمة. إذا كنت تزن مدى جاهزية النماذج الصينية المفتوحة لأحمال حقيقية، فهذه الحسبة مغطاة بصورة أعمق في إطار المخاطر الذي أستخدمه مع العملاء. النسخة القصيرة: عبارة «الحاضنة تتعامل معه كنقطة نهاية أخرى فحسب» تزيل واحداً من أفضل الأعذار لعدم الاختبار.
ماذا ينبغي أن تفعل الآن؟
إذا كنت تبني أو تشغّل وكلاء، فهذه ثلاث خطوات بالترتيب.
اليوم: شغّل
npx @truefoundry/trueforgeعلى جهازك واربط نموذجاً واحداً وخادم MCP واحداً. الوضع المحلي عملية واحدة على SQLite، ما يجعله أرخص طريقة أعرفها لبناء حدس عن وظيفة الحاضنة فعلياً. أبقه على localhost: لا يوجد تسجيل دخول افتراضياً، والوثائق واضحة في أن الوضع المحلي ليس إعداداً مكشوفاً للإنترنت.هذا الأسبوع: خذ حمل وكيل تشغله بالفعل، وسجل استهلاكه من التوكنات ونسبة الإكمال، ثم أعد إنتاج شكل الاختبار على مهامك. مجلد
benchmark/في المستودع مصمم لهذا تحديداً. رقمك أنت هو الوحيد الذي يهم؛ اختبارات الموردين، ومنها هذا، تسويق حتى تعيد تشغيلها.هذا الشهر: إذا كنت تدفع أسعار بيئات التشغيل المُدارة، فاحسب توفير الحاضنة وحده، 30%، مقابل فاتورتك الفعلية، واختبر بصورة منفصلة ما إذا كان نموذج مفتوح يجتاز معيار الجودة لديك على المهام نفسها. قراران مستقلان، وجدولا بيانات مستقلان. وإذا كنت في مرحلة أبكر وما زلت تختار أول منظومة، فابدأ بـ البناء مقابل الشراء ومفاضلات الاستضافة الذاتية قبل الالتزام بأي بيئة تشغيل.
الأسئلة الشائعة
ما هي حاضنة الوكلاء؟
طبقة بيئة التشغيل التي تحول نموذجاً لغوياً إلى وكيل عامل. تشغّل الحلقة حول النموذج، خطط واستدع الأدوات وأعد النتائج وكرر، وتتولى كل ما لا يستطيع النموذج توليه: استمرارية الجلسة، وبيانات اعتماد الأدوات، والتنفيذ المعزول، والموافقات البشرية، وإبقاء نافذة السياق تحت السيطرة في المهام الطويلة. TrueForge وClaude Managed Agents وDeep Agents من LangChain كلها حاضنات؛ والنماذج تحتها قابلة للتبديل بدرجات مختلفة.
هل TrueForge مجاني؟
الحاضنة نفسها بترخيص MIT ومجانية، بما في ذلك الاستخدام التجاري. ما تزال تدفع مقابل النماذج ومزود صندوق العزل، Daytona حالياً، وبنيتك التحتية. تبيع TrueFoundry طبقة حوكمة اختيارية، AI Gateway مع الميزانيات وحدود المعدل والتدقيق والرصد، وإصداراً مستضافاً بالدفع حسب الاستخدام للفرق التي لا تريد الاستضافة الذاتية.
كيف يقارن TrueForge مع Claude Managed Agents؟
Claude Managed Agents مُدار بالكامل بواسطة Anthropic، ويُحاسب بتوكنات Claude إضافة إلى 0.08 دولار لكل ساعة جلسة تشغيل، ويعمل مع Claude فقط. TrueForge ذاتي الاستضافة، أو مستضاف لدى TrueFoundry، ومحايد تجاه النماذج ومجاني التشغيل. في اختبار TrueFoundry نفسها، طابقه في إكمال المهام بتكلفة أقل بنحو 30% على النموذج نفسه. المفاضلة: تدير أنت أشياء أكثر، والاختبار صادر عن المورد لا عن جهة مستقلة.
هل يستطيع TrueForge استخدام نماذج صينية مفتوحة مثل GLM أو Qwen؟
نعم. يدعم أي نقطة نهاية متوافقة مع OpenAI، والرقم الرئيسي في اختبار الإطلاق جاء من إقرانه بـ GLM-5.2. هذا الاقتران هو مصدر خفض التكلفة بنسبة 75%، وهو يقول عن تسعير النماذج المفتوحة بقدر ما يقول عن الحاضنة.
الخلاصة
TrueForge عمره شهر، واختباره اختباره هو، ولا ينبغي لأحد أن يمرر الرواتب عبره بعد. لكن شكل الفكرة صحيح: الحاضنة تصبح طبقة مستقلة في المنظومة، وكان من المحتم أن تحصل هذه الطبقة على خيار محايد مفتوح المصدر، وكون حسابات الإطلاق تعتمد على نموذج صيني مفتوح لصناعة الرقم الرئيسي هو الإشارة الهادئة إلى اتجاه اقتصاديات الوكلاء. راقب ظهور إعادة إنتاج مستقلة لادعاءات التكلفة خلال الربع المقبل. هذا هو الفرق بين إطلاق وتحول.
إذا كنت تحاول تحديد مكان الحاضنة داخل منظومة وكلائك، فهذا نقاش أجريه مع العملاء بانتظام. تواصل معي.
المصادر
TrueFoundry، «TrueForge: بديل مفتوح المصدر لـ Claude Managed Agents»: https://www.truefoundry.com/blog/engineering/trueforge-open-source-agent-harness/ (نُشر في 2026-08-18، واستُرجع في 2026-08-29)
TrueFoundry، مستودع TrueForge: https://github.com/truefoundry/trueforge (استُرجع في 2026-08-29)
وثائق TrueFoundry، «ما الذي تضيفه TrueFoundry فوق TrueForge»: https://www.truefoundry.com/docs/agent-platform/agent-harness/what-truefoundry-adds (استُرجع في 2026-08-29)
VentureBeat، «حاضنة وكلاء الذكاء الاصطناعي مفتوحة المصدر TrueForge من TrueFoundry تدعي إنجاز المهام بتكلفة أقل 30% إلى 75%»: https://venturebeat.com/orchestration/truefoundrys-open-source-ai-agent-harness-trueforge-boasts-30-75-cheaper-task-completion-than-claude-managed-agents (نُشر في 2026-08-19، واستُرجع في 2026-08-29)
InfoWorld، «TrueFoundry تطلق حاضنة وكلاء ذكاء اصطناعي مفتوحة المصدر وتدعي خفض التكلفة حتى 75%»: https://www.infoworld.com/article/4211969/truefoundry-debuts-open-source-ai-agent-harness-claiming-up-to-75-lower-costs.html (نُشر في 2026-08-20، واستُرجع في 2026-08-29)
Superpower Daily، «TrueFoundry تعطي بيئة تشغيل وكلائها مجاناً لتبيع الطبقة الموجودة تحتها»: https://www.superpowerdaily.com/posts/truefoundry-gives-away-its-agent-runtime-to-sell-the-layer-beneath-it (نُشر في 2026-08-20، واستُرجع في 2026-08-29)
Business Wire، «TrueFoundry تطلق TrueForge»، بيان صحفي: https://finance.yahoo.com/technology/ai/articles/truefoundry-launches-trueforge-open-source-120000790.html (نُشر في 2026-08-19، واستُرجع في 2026-08-29)
تابع القراءة
Agent Field Notes
احصل على العدد التالي.
أنظمة Harness للوكلاء، وبيئات التشغيل، والأمان، والحوكمة، موضحة لمن يتعين عليهم تشغيل هذه الأنظمة.
هل تواجه قراراً من هذا النوع؟
نجري مراجعات للبنية وتقييمات للحوكمة ومقارنات للأطر بإصدارات مثبتة للفرق التي تتخذ قرارات مصيرية بشأن أنظمة الوكلاء.