الملخص
عندما تقوم بإنشاء وكيل ذكاء اصطناعي في Astra، فإن النظام لا يكتفي بإنشائه ويتركك لتتعامل مع الباقي بنفسك، بل يقوم بإنشاء حالات اختبار تلقائية لمساعدتك في تقييم وكيلك وتحسينه منذ البداية.
يشرح هذا المقال كيف يعمل الاختبار الآلي، وتحسين المطالبات (Prompts)، ولوحة معلومات التقييم معاً لمساعدتك في إطلاق وكيل موثوق وعالي الأداء بجهد يدوي أقل.
التعليمات
كيف يعمل التقييم الآلي للوكيل
بمجرد إنشاء وكيلك، يقوم Astra بإنشاء حالات اختبار تلقائياً. وهذا يلغي الحاجة إلى إعداد الاختبار يدوياً ويقلل الوقت المستغرق في التجربة والخطأ.
عند فتح صفحة التقييم (Evaluation)، سترى مجموعة من حالات الاختبار التي تم إنشاؤها تلقائياً بناءً على تعليمات وكيلك الحالية.
تضع حالات الاختبار هذه خط أساس للأداء، وتساعدك على فهم كيفية استجابة وكيلك عبر أنواع المحادثات المختلفة، والحالات الاستثنائية، وسيناريوهات المخاطر. تتراوح هذه السيناريوهات من الاستعلامات القياسية إلى المشكلات المعقدة.
كيفية إجراء التقييم وعرض النتائج
هل تفضل شرحاً مرئياً؟ شاهد دليل الفيديو الخاص بنا حول كيفية تقييم وكلاء الذكاء الاصطناعي في Astra:
يمكنك تحديد حالات اختبار معينة من القائمة لإجراء التقييم، أو النقر على تشغيل الكل (Run all) لتقييم جميع حالات الاختبار المتاحة دفعة واحدة.
بمجرد اكتمال التقييم، سيعرض لك النظام أداء الوكيل في الوقت الفعلي. يساعدك هذا في التعرف بسرعة على التعليمات غير الواضحة أو غير الكاملة أو المتضاربة.
سترى نتائج التقييم الإجمالية، بما في ذلك:
درجة الكفاءة (Efficiency score) – مدى جودة تعامل وكيل الذكاء الاصطناعي مع الأسئلة.
الدقة (Accuracy) – مدى صحة استجابات وكيل الذكاء الاصطناعي.
زمن الاستجابة (Latency) – مدى سرعة استجابة وكيل الذكاء الاصطناعي.
يمكنك أيضاً عرض التفاصيل التالية في ملخص التقييم (evaluation summary):
السؤال (Question) – سؤال الاختبار المستخدم لتقييم وكيل الذكاء الاصطناعي.
الفئة (Category) – نوع السؤال، مثل استعلام قياسي، أو مشكلة ضمنية، أو سؤال خارج الموضوع.
الإجابة المتوقعة (Expected answer) – الاستجابة التي من المتوقع أن يقدمها وكيل الذكاء الاصطناعي.
استجابة الذكاء الاصطناعي (AI response) – الاستجابة الفعلية التي أنشأها الوكيل.
المقاييس (Metrics) – تعرض درجة الكفاءة للاستجابة.
الحالة (Status) – تشير إلى ما إذا كان وكيل الذكاء الاصطناعي قد اجتاز أو فشل في التقييم.
ملاحظات (Notes) – تعرض معلومات إضافية حول حالة الاختبار، مثل ما إذا كان السؤال تم إنشاؤه تلقائياً، أو تم تحميله عبر CSV، أو تمت إضافته يدوياً.
يمكنك النقر على أي حالة اختبار فردية لعرض نتائج مفصلة، بما في ذلك:
ملخص التقييم – تحليل لكيفية استجابة الوكيل وسبب اجتيازه أو فشله.
السلوك المتوقع – الاستجابة الصحيحة أو المثالية التي كان يجب أن يقدمها الوكيل.
تتضمن كل نتيجة شرحاً مفصلاً لكيفية تفسير الوكيل لمدخلات المستخدم وما إذا كان قد استجاب بشكل صحيح. وهذا يسهل تحديد الفجوات وتحسين تعليماتك بدقة.
ما تحتاج إلى القيام به:
مراجعة النتائج لكل حالة اختبار.
مقارنة استجابة الوكيل بملخص التقييم.
التحقق مما إذا كانت الاستجابة تتطابق مع السلوك المتوقع.
كيفية عرض تحليل الذكاء الاصطناعي والتوصيات
انقر على تحليل النتائج (Analyse results) لمراجعة نتيجة التقييم. قد يستغرق النظام بضع لحظات لمعالجة التحليل.
بعد اكتمال التحليل، انقر على عرض التوصية (View recommendation) لرؤية اقتراحات التحسين المدعومة بالذكاء الاصطناعي.
يلخص النظام المشكلات الرئيسية ويقدم توصيات عملية لتحسين دقة الوكيل وموثوقيته.
راجع الاقتراحات ذات الأولوية العالية بعناية. قد تشمل هذه إضافة قواعد واضحة لطلبات معينة أو تحديد تعليمات خطوة بخطوة للمهام المعقدة مثل تتبع الطلبات.
كيفية تحديث تعليمات الوكيل
بعد مراجعة الاقتراحات، انقر على تحديث التعليمات (Update instructions) لتطبيق التحسينات تلقائياً. تساعد هذه الميزة في تبسيط عملية تحسين الوكيل باستخدام رؤى من الاختبار والتحليل الواقعي. سيستغرق الأمر بضع لحظات وسيعرض النتائج.
مراجعة وتطبيق التغييرات
ستعرض شاشة مراجعة التعليمات المحدثة التغييرات المقترحة. هنا، يمكنك رؤية كيفية إضافة القواعد والإرشادات الجديدة إلى تعليمات الوكيل الحالية.
بعد التحسين:
يبرز النظام التحديثات المقترحة.
يمكنك رؤية ما تم تعديله وسببه بوضوح.
راجع التحسينات المقترحة بعناية.
مرر عبر التعليمات المحدثة للتأكد من أنها تلبي متطلباتك.
تأكد من أن اقتراحات الذكاء الاصطناعي تتماشى مع صوت علامتك التجارية وعمليات عملك.
انقر على قبول (Accept) لإنهاء التحديث.
إجراء التقييم مرة أخرى
بعد حفظ التغييرات، انقر على تشغيل الكل مرة أخرى لإعادة تقييم الوكيل باستخدام نفس حالات الاختبار. سيقوم النظام بإجراء التقييم بالتعليمات المحدثة. عند اكتمال الاختبار، يجب أن ترى أن جميع السيناريوهات قد اجتازت الاختبار.
توضح هذه العملية كيف تساعدك ميزات التحليل والتوصية في تحسين أداء وكيل الذكاء الاصطناعي الخاص بك بشكل تكراري.










