محرك الاختبار
أربعة مكوّنات متعاونة — المولّد والمشغّل والحَكَم والملخّص — مبنية على نماذج LLM تجارية أو مستضافة ذاتيًا وقابلة للتبديل. يحصل كل وكيل على حالات اختبار ملائمة لغرضه دون كتابة يدوية.
CXMind هي منصة الاختبار بالذكاء الاصطناعي لأي وكيل صوتي أو وكيل دردشة — لدعم العملاء والمبيعات ومكاتب المساعدة الداخلية والمساعدين الأذكياء والرعاية الصحية والخدمات المصرفية وغيرها. أنشئ آلاف حالات الاختبار الواقعية، وأدِر محادثات متعددة الأدوار، وقيّم كل رد من حيث الجودة والسلامة والامتثال وتجربة المستخدم — كل ذلك في دقائق، لا أسابيع.
الصوت والدردشة
قناتان، منصة واحدة
13
قضاة ذكاء اصطناعي متخصصون
18+
منصات الوكلاء المدعومة
OWASP
تغطية OWASP LLM Top 10
42
وكلاء الذكاء الاصطناعي
3,827
حالات الاختبار
94.2%
معدل النجاح
تراجع ليلي · قيد التنفيذ
412 / 580 حالة · مكتمل 71٪
نُشغّل برامج الاختبار لأبرز منصات الاتصالات
كيف يعمل CXMind
وصّل وكيلك. يقرأ CXMind إرشاداتك، ويولّد حالات اختبار واقعية، ويدير محادثات متعددة الأدوار، ويقيّم الناتج عبر كل بُعد مهم.
مصمّم لوكلاء بيئات الإنتاج
أربعة مكوّنات متعاونة — المولّد والمشغّل والحَكَم والملخّص — مبنية على نماذج LLM تجارية أو مستضافة ذاتيًا وقابلة للتبديل. يحصل كل وكيل على حالات اختبار ملائمة لغرضه دون كتابة يدوية.
منصة واحدة لكلتا القناتين — أرسل مكالمات SIP حقيقية إلى الوكلاء الصوتيين وأنظمة IVR، ونفّذ محادثات دردشة مكتوبة أو مستقلة تمامًا وموجّهة بالأهداف مع وكلاء LLM ووكلاء قائمين على النوايا أو أي webhook عبر HTTP. أحضر وكيلك، وسيتكفّل CXMind بالباقي.
OWASP LLM Top 10، وMITRE ATLAS، واختبارات حقن الإرشادات وكسر الحماية، واكتشاف بيانات PII مع قائمة سماح، إضافة إلى قواعد سياسات قابلة للتهيئة لـ HIPAA وPCI وSOC 2.
معدلات النجاح، ومئينات زمن الاستجابة، ودرجات الأبعاد، وفروقات الانحدار، وتقدم التشغيل المباشر — مع اكتشاف الاختبارات غير المستقرة وعزلها حتى يبقى معدل نجاحك صادقًا. تعمّق في أي اختبار لعرض النص الكامل ومنطق الحَكَم.
شغّل الاختبارات من GitHub Actions أو GitLab CI أو Jenkins أو Cloud Build — أو وفق جدول زمني. يندمج JUnit XML في خط الأنابيب مثل أي مجموعة اختبارات أخرى، وتصل التنبيهات إلى Slack أو Teams أو PagerDuty، ويفشل البناء تلقائيًا عند حدوث انحدار.
عزل المستأجرين على مستوى الصفوف، وRBAC دقيق، وتسجيل دخول موحد عبر OIDC/SAML، وتزويد SCIM، ومفاتيح المرور والمصادقة الثنائية، وسجلات التدقيق، وحصص LLM لكل مستأجر. مصمم للفرق التي تطلق على نطاق واسع.
شغّل مجموعة اعتماد TekVizion المدمجة على كتالوج مثبّت وذي إصدارات — اختبارات مرتبطة بمحاور OWASP LLM Top 10 وMITRE ATLAS وNIST AI RMF — واحصل على نتيجة متدرجة من البرونزي إلى البلاتيني مع تقرير PDF كامل.
أغرق وكيلك بمحادثات متزامنة — أو مكالمات صوتية حقيقية — بمستوى تزامن ومدة ووقت تفكير تتحكم فيها بنفسك. تعود إليك نتائج معدل المعالجة ومئينات زمن الاستجابة وأعداد الأخطاء، إضافة إلى مقارنة مرجعية تكشف تدهور الإجابات تحت الحِمل.
اسأل لماذا تراجع تشغيل ما، وأي الوكلاء يتراجع أداؤهم، وماذا تختبر تاليًا — مساعد حواري يستوعب منظومة اختباراتك كاملة. عندما يصوغ حالات اختبار أو مُقيّمين، ينتظر كل تعديل موافقتك الصريحة ويُسجَّل في سجل التدقيق.
المرونة الشاملة للوكلاء
المستخدمون الحقيقيون يصمتون ويغيّرون رأيهم ويلصقون نصوصًا مشوّهة ويشعرون بالإحباط ويختبرون الحدود. يوفّر CXMind إطارًا شاملاً للمرونة ينطبق على كل وكيل دون أي إعداد، ويقيّم مدى ذكاء وكيلك في التعافي.
11
عائلة اختبارات مرونة
90
حالة من تأليف المنصة
1 · الحزم الشاملة
تنطبق حزم المرونة والأمان والامتثال والأداء على كل وكيل فور التشغيل: الصمت والغموض والتصحيحات والحلقات والضغط العاطفي واختبار الحدود والتصعيد — جميعها من إعداد المنصة ومُدارة بالإصدارات.
2 · اختباراتك المولّدة
السيناريوهات الخاصة بالعمل والمولّدة من مواد تدريب وكيلك تغطي المهام التي يطرحها عملاؤك فعلًا — وتُجمَّد في حزمة مهام مثبتة عند الاعتماد.
3 · الاعتماد يشغّل الاثنين
يجمع تشغيل الاعتماد كل الحزم الشاملة مع حزمة المهام المجمدة لديك، ثم يصنّف النتيجة في مستوى معتمد — مع بوابة مستقلة للأعطال الحرجة لا يمكن لمعدل نجاح مرتفع تعويضها أبدًا.
القنوات
يعمل نفس المولّد والقائد والقضاة والسياسات على القناتين. قارن الصوت والدردشة جنبًا إلى جنب في نفس مجموعة الانحدار — سواء كنت تختبر نظام رد صوتي تفاعلي للدعم أو مساعدًا للمبيعات أو مكتب مساعدة داخلي.
حالات الاختبار الموجّهة بالأهداف لا تحتوي على خطوات مكتوبة. صف السيناريو والهدف — فيرتجل مشغّل الذكاء الاصطناعي محادثة دردشة حقيقية متعددة الأدوار، ويتكيّف مع كل ما يقوله وكيلك، ويواصل المحاولة حتى يتحقق الهدف أو يُعاق فعليًا. ثم يفصل حَكَم الأهداف في السؤال الوحيد المهم: هل أنجز الوكيل المهمة فعلًا؟
كل سيناريو في المكتبة يعمل بهذه الطريقة — ولأن لا شيء مكتوبًا مسبقًا، فإن كل إعادة تشغيل هي محادثة جديدة مستقلة تمامًا وليست إعادة عرض.
السيناريو
"استلم عميل منتجًا تالفًا وبدأ يشعر بالإحباط."
الهدف
"الحصول على موافقة على استرداد المبلغ ورقم تأكيد."
مشغّل الذكاء الاصطناعي — يرتجل نحو الهدف
"مرحبًا — وصل الكوب مكسورًا تمامًا. أريد استرداد نقودي."
"يسعدني المساعدة. تمت الموافقة على الاسترداد — رقم التأكيد #RF-20871."
حَكَم الأهداف
تم تحقيق الهدف — تأكيد الاسترداد مع الرقم المرجعي ✓
أسماء العلامات التجارية وعناوين الدعم ورموز المراجع — الكلمات الأهم هي التي يخطئ التعرف على الكلام في فهمها. يفحص CXMind المعلومات العامة لوكيلك ونواياه وردوده المتوقعة ونتائجه المقبولة بحثًا عن المصطلحات التي سيخطئ محرك التعرف في سماعها، ويقترحها للمراجعة.
لا يصل شيء إلى المتعرف حتى يعتمده إنسان. حدّد قوة ترجيح كل مصطلح، وصحّح صيغته المكتوبة والمنطوقة، وحوّل ما سمعته النصوص المدوّنة بدلًا منه إلى إعادة كتابة تلقائية.
ما سُمع
support at tech vision dot com
بعد التصحيح
support@tekvizion.com
المصطلحات المعتمدة
معتمد بشريًا · الإرسال إلى البوابة مفتاح اختياري منفصل
السياسات والاستناد
لا تكفي «الانطباعات» العامة لنماذج LLM لوكلاء الذكاء الاصطناعي المستخدمين في الإنتاج. يستند CXMind في كل حكم إلى شيئين تتحكم بهما: مكتبة السياسات القابلة لإعادة الاستخدام، ومجموعة RAG الخاصة بك من وثائق المنتج والأسئلة الشائعة وإجراءات التشغيل والنصوص وأدلة الامتثال.
Model Context Protocol
يتحدث CXMind بروتوكول Model Context Protocol. سجّل مرة واحدة خادم MCP معتمدًا من المستأجر، وسيكتشف CXMind تلقائيًا أدواته وموارده للقراءة فقط — جاهزة لتشغيل استيراد بيانات التدريب وتقييمات القضاة المخصّصين.
مصمم للمؤسسات
صُمم CXMind لأحمال عمل الذكاء الاصطناعي في الإنتاج عبر الصناعات المنظمة وغير المنظمة على حدٍّ سواء: كل مستأجر معزول تمامًا، وكل بايت مشفّر، وكل تشغيل اختباري مستدام. لا تُفقد الأعمال بسبب الأعطال، ولا تتجاوز الاختراقات حدود المستأجرين، ولا تأتي عمليات التدقيق بمفاجآت.
🗓 تشغيلات مجدولة
جداول cron أو فترات زمنية مع الإيقاف المؤقت والاستئناف والتشغيل الفوري.
🔔 قنوات الإشعارات
البريد الإلكتروني وSlack وTeams والرسائل النصية وPagerDuty وwebhooks عند أحداث التشغيل.
📝 رفع النصوص المدوّنة
المحادثات الحقيقية بصيغ JSON أو CSV أو DOCX أو PDF تتحول إلى مادة اختبار.
🌐 زحف الموقع الإلكتروني
استورد محتوى الموقع كأساس معرفي وحافظ على تحديثه في مكانه.
📦 مكتبة اختبارات جاهزة
حزم الأمان والامتثال والأداء، جاهزة للاستيراد.
🔀 مقارنة الانحدارات
تشغيلان جنبًا إلى جنب، وكل فرق مصنّف.
👁 وضع المراقبة
تنقّل في محادثة حية دورًا بدور.
📱 تطبيق جوال قابل للتثبيت
راقب التشغيلات وتصرّف بشأنها من هاتفك.
موضع ثقة قادة الصناعة
"نعمل معهم وكأنهم فريق آخر داخل Microsoft."
Microsoft
اتصالات المؤسسات
"مكّنتنا TekVizion من تحسين تفاعل العملاء ودرجات رضاهم."
AWS
منصة سحابية
"يمكننا الآن بـ«نقرة» واحدة إنجاز ما كان يستغرق 4 ساعات من الاختبار في 4 دقائق."
Bell Canada
خدمات صوت الناقل
"حررت TekVizion مهندسينا الأعلى قيمة للتركيز على المشاريع الحرجة."
Vodafone
اتصالات عالمية
سجّل الدخول إلى مستأجر CXMind الخاص بك، أو تواصل مع فريق TekVizion لإدراج أسطول وكلائك.