Moteur de test
Quatre composants coopérants — Générateur, Pilote, Juge, Résumeur — construits sur des LLM commerciaux ou auto-hébergés interchangeables. Chaque agent obtient des cas de test sur mesure sans rédaction manuelle.
CXMind est la plateforme de tests IA pour tout agent vocal ou de chat — support client, ventes, helpdesk interne, copilotes, santé, banque, peu importe le domaine. Générez des milliers de cas de test réalistes, pilotez des conversations multi-tours et évaluez chaque réponse en qualité, sécurité, conformité et UX — le tout en minutes, pas en semaines.
Voix + Chat
Les deux canaux, une plateforme
13
Juges IA spécialisés
18+
Plateformes d'agents prises en charge
OWASP
Couverture LLM Top 10
42
Agents IA
3,827
Cas de test
94.2%
Taux de réussite
Régression nocturne · en cours
412 / 580 cas · 71% terminés
Au cœur des programmes de tests des principales plateformes de communications
Comment fonctionne CXMind
Branchez votre agent. CXMind lit vos prompts, génère des cas de test réalistes, pilote des conversations multi-tours et note la sortie sur chaque dimension qui compte.
Conçu pour les agents en production
Quatre composants coopérants — Générateur, Pilote, Juge, Résumeur — construits sur des LLM commerciaux ou auto-hébergés interchangeables. Chaque agent obtient des cas de test sur mesure sans rédaction manuelle.
Une seule plateforme pour les deux canaux — pilotez de vrais appels SIP vers des agents vocaux et des IVR, et exécutez des conversations de chat scriptées ou entièrement autonomes guidées par un objectif face à des agents LLM, des bots fondés sur les intentions ou tout webhook HTTP. Apportez votre agent — CXMind s'occupe du reste.
OWASP LLM Top 10, MITRE ATLAS, sondes d'injection de prompts et de jailbreak, détection PII avec liste autorisée, et grilles de politique configurables pour HIPAA, PCI, SOC 2.
Taux de réussite, centiles de latence, scores par dimension, deltas de régression et progression en direct — avec détection des tests instables qui met en quarantaine les cas erratiques pour que votre taux de réussite reste honnête. Explorez chaque test pour la transcription complète et le raisonnement du juge.
Déclenchez des exécutions depuis GitHub Actions, GitLab CI, Jenkins ou Cloud Build — ou selon un planning. Le JUnit XML s'insère dans votre pipeline comme n'importe quelle suite, les alertes arrivent dans Slack, Teams ou PagerDuty, et le build échoue automatiquement en cas de régression.
Isolation des locataires au niveau des lignes, RBAC granulaire, SSO via OIDC/SAML, provisionnement SCIM, passkeys et 2FA, journaux d'audit et quotas LLM par locataire. Conçu pour les équipes qui livrent à grande échelle.
Exécutez la suite de certification intégrée de TekVizion sur un catalogue épinglé et versionné — des tests alignés sur l'OWASP LLM Top 10, MITRE ATLAS et le NIST AI RMF — et obtenez un résultat par paliers, de Bronze à Platine, avec un rapport PDF complet.
Soumettez votre agent à un flot de conversations simultanées — ou de vrais appels vocaux — avec une simultanéité, une durée et un temps de réflexion que vous contrôlez. Vous récupérez le débit, les centiles de latence et le nombre d'erreurs, plus une comparaison de référence qui détecte les réponses qui se dégradent sous charge.
Demandez pourquoi une exécution a régressé, quels agents déclinent ou quoi tester ensuite — un assistant conversationnel avec tout votre parc de tests en contexte. Lorsqu'il rédige des cas de test ou des juges, chaque écriture attend votre approbation explicite et figure dans le journal d'audit.
Résilience universelle des agents IA
Les vrais utilisateurs se taisent, changent d'avis, collent du texte illisible, s'énervent et testent les limites. CXMind fournit un cadre universel de résilience applicable à tout agent sans configuration et évalue la capacité de votre agent à se rétablir intelligemment.
11
familles de tests de résilience
90
cas créés par la plateforme
1 · Packs universels
Les packs résilience, sécurité, conformité et performance s'appliquent à tout agent dès le départ : silence, ambiguïté, corrections, boucles, pression émotionnelle, tests de limites et escalade, le tout créé par la plateforme et versionné.
2 · Vos tests générés
Les scénarios métier générés à partir des données d'entraînement de votre agent couvrent les missions que vos clients apportent réellement — et se figent dans une suite de mission épinglée lors de la certification.
3 · La certification exécute les deux
Une exécution de certification combine tous les packs universels avec votre suite de mission figée, puis classe le résultat dans un niveau certifié — avec une porte distincte d'échecs critiques qu'un taux de réussite élevé ne peut jamais racheter.
Canaux
Le même générateur, le même pilote, les mêmes juges et les mêmes politiques fonctionnent sur les deux canaux. Comparez voix et chat côte à côte dans la même suite de régression — qu'il s'agisse d'un SVI de support, d'un copilote de vente ou d'un helpdesk interne.
Les cas de test par objectif n'ont aucune étape scriptée. Décrivez le scénario et l'objectif — le driver IA improvise une vraie conversation de chat multi-tours, s'adapte à ce que répond votre agent et insiste jusqu'à atteindre l'objectif ou être réellement bloqué. Le Juge d'Objectif tranche ensuite la seule question qui compte : l'agent a-t-il vraiment accompli la tâche ?
Tous les scénarios de la bibliothèque fonctionnent ainsi — et comme rien n'est scripté, chaque réexécution est une conversation nouvelle et entièrement autonome, pas une rediffusion.
Scénario
« Un client a reçu un article endommagé et commence à s'énerver. »
Objectif
« Obtenir l'approbation d'un remboursement et un numéro de confirmation. »
Driver IA — improvisation vers l'objectif
« Bonjour — mon mug est arrivé en mille morceaux. Je veux être remboursé. »
« Je peux vous aider. Remboursement approuvé — confirmation #RF-20871. »
Juge d'Objectif
Objectif atteint — remboursement confirmé avec numéro de référence ✓
Noms de marque, adresses d'assistance, codes de référence : les mots qui comptent le plus sont ceux que la reconnaissance vocale comprend mal. CXMind analyse les informations publiques, les intentions, les réponses attendues et les résultats acceptés de votre agent pour repérer les termes qu'un système de reconnaissance entendra mal, et les propose à la relecture.
Rien n'atteint le système de reconnaissance sans validation humaine. Réglez le poids de chaque terme, corrigez ses formes écrite et orale, et transformez ce que la transcription a entendu à la place en réécriture automatique.
ENTENDU
support at tech vision dot com
CORRIGÉ
support@tekvizion.com
Termes approuvés
Validé par un humain · l'envoi à la passerelle est une option distincte
Politiques et ancrage
Les simples "impressions" d'un LLM générique ne suffisent pas pour des agents IA en production. CXMind ancre chaque jugement dans deux choses que vous maîtrisez : votre bibliothèque de politiques réutilisables et votre propre corpus RAG de documentation produit, FAQ, modes opératoires, scripts et manuels de conformité.
Model Context Protocol
CXMind parle le Model Context Protocol. Enregistrez une fois un serveur MCP approuvé par le tenant et CXMind découvre automatiquement ses outils et ressources en lecture seule — prêts à alimenter l'import de données d'entraînement et les évaluations par juges personnalisés.
Conçu pour l'entreprise
CXMind est conçu pour les charges IA en production dans les secteurs régulés comme non régulés : chaque tenant est totalement isolé, chaque octet est chiffré et chaque exécution de test est durable. Les pannes ne perdent pas de travail, les fuites ne franchissent pas les frontières des tenants et les audits ne réservent pas de surprises.
🗓 Exécutions planifiées
Planifications cron ou par intervalle avec pause, reprise et exécution immédiate.
🔔 Canaux de notification
E-mail, Slack, Teams, SMS, PagerDuty et webhooks sur les événements d'exécution.
📝 Import de transcriptions
Les conversations réelles en JSON, CSV, DOCX ou PDF deviennent du matériel de test.
🌐 Exploration de site web
Importez le contenu du site comme socle documentaire et gardez-le à jour en place.
📦 Bibliothèque de tests prédéfinis
Packs sécurité, conformité et performance, prêts à importer.
🔀 Comparaison de régressions
Deux exécutions côte à côte, chaque écart classifié.
👁 Mode observation
Parcourez une conversation en direct tour par tour.
📱 Application mobile installable
Surveillez et agissez sur les exécutions depuis votre téléphone.
La confiance des leaders du secteur
"Nous travaillons avec eux comme s'ils étaient une autre équipe au sein de Microsoft."
Microsoft
Communications d'entreprise
"TekVizion nous a permis d'améliorer l'engagement et la satisfaction de nos clients."
AWS
Plateforme cloud
"Nous pouvons désormais faire en 4 minutes, en un seul clic, ce qui prenait 4 heures de tests."
Bell Canada
Services voix opérateur
"TekVizion a libéré nos ingénieurs les plus précieux pour qu'ils se concentrent sur des projets critiques."
Vodafone
Communications mondiales
Connectez-vous à votre tenant CXMind, ou contactez l'équipe TekVizion pour intégrer votre flotte d'agents.