TestMu AI تطلق Agent Assurance للتحقق من وكلاء الذكاء الاصطناعي قبل إطلاقهم
يتحقق المنتج الجديد من وكلاء الذكاء الاصطناعي الذين يتحدثون إلى العملاء، ومن الوكلاء الذين ينفذون إجراءات على الأنظمة؛ فينشئ سيناريوهات اختبار مباشرةً من الشفرة البرمجية، ويقيّم كل إجراء استنادًا إلى أدلة فعلية، ويعرض فجوة التحقق لكل ما يتعذر عليه التحقق منه.
سان فرانسيسكو ونويدا، الهند، 19 أغسطس 2026 /PRNewswire/ -- TestMu AI، المعروفة سابقًا باسم LambdaTest، أول منصة في العالم لهندسة الجودة القائمة أصلاً على الذكاء الاصطناعي الوكيلي، تعلن عن Agent Assurance، وهو منتج صُمم للإجابة عن سؤال يواجهه الآن كل فريق هندسي يطرح وكلاء ذكاء اصطناعي: هل هذا الوكيل آمن للإطلاق؟ يشمل Agent Assurance في منتج واحد نوعَي الوكلاء: فئة الوكيل التحاوري التي تقيّم الوكلاء المتعاملين مع البشر عبر الدردشة والصوت والهاتف والفيديو والصور، وفئة الوكيل المستقل الجديدة التي تتحقق من الوكلاء الذين ينفذون إجراءات على الأنظمة، بما في ذلك استدعاء الأدوات وكتابة الملفات واستدعاء واجهات API وفتح طلبات السحب.
تختبر معظم الفرق اليوم الوكلاء المستقلين بالاطلاع على وصف الوكيل نفسه لما فعله: سجل للمحادثة أو درجة يمنحها مقيّم لرسالته النهائية. أما Agent Assurance فيقيّم الأثر بدلًا من ذلك. عند توجيهه إلى قاعدة شفرة برمجية، يستنتج ما يفعله الوكيل، وينشئ حزمة متكاملة لاختبار الوكيل تشمل اختبار وظائفه وفحوصه غير الوظيفية والسيناريوهات العدائية، ثم يستدعي الوكيل فعليًا ويقيّم كل معيار مقابل الأدلة المرصودة: الملفات التي تغيّرت على القرص، والمخرجات التي أُنشئت، واستدعاءات الأدوات التي يجري التحقق منها في ضوء واجهة الأدوات التي يعلنها الوكيل نفسه.
إلى جانب نتيجتي النجاح والإخفاق، يعرض Agent Assurance حكمًا ثالثًا هو يتعذر التحقق، لا يُحتسب ضمن معدل النجاح ويُعرض في صورة رقم: فجوة التحقق. كل نتيجة واردة في التقرير رُصدت بالفعل، ولأن الفجوة تعكس مدى توثيق الوكيل لإجراءاته الخاصة، تستطيع الفرق تقليصها بجعل وكلائها أكثر قابلية للرصد.
قال Vipul Verma، نائب الرئيس الأول لهندسة المجموعة في :TestMu AI «تتراكم لدى الفرق الهندسية ديون التحقق تحديدًا في الطبقة التي تكون فيها المخاطر في أعلى مستوياتها. إن وصف الوكيل نفسه لما فعله هو أضعف الأدلة المتاحة على ما فعله، فهو الطرف الوحيد الذي قد تكون لديه مصلحة في أن يخطئ. كل أداة في هذا المجال تعرض معدل نجاح. يعرض Agent Assurance معدل النجاح وحجم نقطة العمى الخاصة به، فهذه هي الطريقة الوحيدة التي يصبح بها الرقم رقمًا يمكن الوثوق به لاتخاذ خطوات بناءً عليه».
باستخدام Agent Assurance، تستطيع الفرق:
- اختبر من دون كتابة اختبارات: اختبار تلقائي للوكلاء تُشتق فيه حزمة الاختبارات من قاعدة الشفرة البرمجية؛ والمدخل الوحيد هو طريقة استدعاء الوكيل، سواء عبر أمر أو نقطة نهاية HTTP أو خادم MCP أو سير عمل مبني على منصات مثل n8n.
- غطِّ الجوانب العدائية افتراضيًا: تُنشأ سيناريوهات حقن التعليمات وإساءة استخدام الأدوات وتجاوز التعليمات كفئة أساسية، لا كإضافة.
- اضبط بوابات الإصدار ضمن CI: اختبارات متواصلة للوكلاء في كل مسار، من اختبارات الدخان للوكيل عند كل إيداع للتغييرات وصولًا إلى عمليات تشغيل كاملة قبل الإصدار، مع أوامر بلا واجهة رسومية ورموز خروج تميّز بين «ارتكب الوكيل خطأً» و«لم تتمكن بيئة الاختبار من اختباره».
- تتبَّع التغيير بثقة: اختبار انحدار الوكلاء مع فروق بين عمليات التشغيل تفصل بين النتائج التي أخفقت حديثًا وتلك التي أُصلحت حديثًا والنتائج المتذبذبة؛ إذ إن التذبذب والانحدار يتطلبان استجابتين متعاكستين.
تتوسع فئة الوكيل التحاوري أيضًا لتشمل أحدث مجال تلتقي فيه البرمجيات بالناس: الوكلاء الذين يظهرون أمام الكاميرا. ومع قدرة المنصة الجديدة ) Video Agent Testingالرابط(، ينضم إنسان محاكى بوجه وصوت واقعيين إلى جلسة وكيل فيديو مباشر، ويجري معه محادثة حقيقية، ثم يقيّم الوكيل وفق معايير نجاح تحددها الفرق، مع إسناد كل حكم إلى اللحظة الدقيقة في التسجيل التي استند إليها. يُحتسب عمدًا كل ما يتعذر التحقق منه من التسجيل على أنه غير مستوفى، وهو معيار صارم لفئة يكون التسجيل فيها هو الدليل؛ إذ لا يُمنح وكيل الفيديو أي رصيد عن لحظة لم يتمكن المقيّم من رصدها.
تتوفر فئة الوكيل التحاوري الآن بصورة عامة على منصة TestMu AI. تتوفر فئة الوكيل المستقل بنظام وصول مبكر، وتعمل من سطر الأوامر باسم rook، فيما تُشغَّل النماذج داخل وحدة التحكم الخاصة بـ TestMu AI، لذلك لا حاجة محليًا إلى مفاتيح API خاصة بمزودي الخدمات. للبدء، تفضل بزيارة الرابط.
نبذة عن TestMu AI
TestMu AI هي أول منصة في العالم لهندسة الجودة القائمة أصلاً على الذكاء الاصطناعي الوكيلي، وقد صُممت لتمكين المؤسسات من أتمتة الاختبارات وتوسيع نطاقها، مع جعل الذكاء في صميمها. ومن خلال الجمع بين القدرات المستقلة والتكامل السلس عبر مسارات التطوير الحديثة، تمكّن TestMu AI الفرق من تقديم برمجيات أسرع وأكثر موثوقية وأمانًا في عالم تكون فيه الأولوية للذكاء الاصطناعي.
لمزيد من المعلومات، يُرجى زيارة TestMu AI.
للتواصل:
Nikhil Saxena،
مدير الاتصالات المؤسسية في TestMu AI،
،[email protected]
+919870981968
شارك هذا المقال