Tests d'agents augmentés par l'IA · par TekVizion

Testez chaque conversation.
Avant vos clients.

CXMind est la plateforme de tests IA pour tout agent vocal ou de chat — support client, ventes, helpdesk interne, copilotes, santé, banque, peu importe le domaine. Générez des milliers de cas de test réalistes, pilotez des conversations multi-tours et évaluez chaque réponse en qualité, sécurité, conformité et UX — le tout en minutes, pas en semaines.

Se connecter Fonctionnement Sans carte de crédit · beta sur invitation

Voix + Chat

Les deux canaux, une plateforme

13

Juges IA spécialisés

18+

Plateformes d'agents prises en charge

OWASP

Couverture LLM Top 10

cxmind.tekvizion.com/dashboard

42

Agents IA

3,827

Cas de test

94.2%

Taux de réussite

Résultats des tests · 30j +12,4 % de taux de réussite ↑

Régression nocturne · en cours

412 / 580 cas · 71% terminés

02:14

Au cœur des programmes de tests des principales plateformes de communications

Microsoft Cisco Zoom RingCentral Google AWS Vodafone

Comment fonctionne CXMind

Quatre composants spécialisés, une boucle de test continue.

Branchez votre agent. CXMind lit vos prompts, génère des cas de test réalistes, pilote des conversations multi-tours et note la sortie sur chaque dimension qui compte.

G Générateur Crée des cas de test à partir de prompts + docs D Pilote Simule des clients 🎙 Voix 💬 Chat B Votre agent IA Dialogflow · Lex · Genesys LLM · Twilio · Webhook Juges Note chaque réponse 🏛️ Polyvalent Qualité 🛡️ Sécurité 📋 Conformité 🚫 Toxicité 🔍 Hallucination Performance 🎯 Domaine 🎭 Comportement 🧠 Mémoire 🏁 Objectif 🎧 Conversation 📊 Résumeur Rapports JUnit · PDF Les échecs réalimentent le générateur — les régressions deviennent plus difficiles avec le temps

Conçu pour les agents en production

Tout ce qu'il faut pour livrer une IA conversationnelle en toute confiance.

Moteur de test

Quatre composants coopérants — Générateur, Pilote, Juge, Résumeur — construits sur des LLM commerciaux ou auto-hébergés interchangeables. Chaque agent obtient des cas de test sur mesure sans rédaction manuelle.

Voix et chat, toutes plateformes

Une seule plateforme pour les deux canaux — pilotez de vrais appels SIP vers des agents vocaux et des IVR, et exécutez des conversations de chat scriptées ou entièrement autonomes guidées par un objectif face à des agents LLM, des bots fondés sur les intentions ou tout webhook HTTP. Apportez votre agent — CXMind s'occupe du reste.

Sécurité et conformité intégrées

OWASP LLM Top 10, MITRE ATLAS, sondes d'injection de prompts et de jailbreak, détection PII avec liste autorisée, et grilles de politique configurables pour HIPAA, PCI, SOC 2.

Tableau de bord en temps réel

Taux de réussite, centiles de latence, scores par dimension, deltas de régression et progression en direct — avec détection des tests instables qui met en quarantaine les cas erratiques pour que votre taux de réussite reste honnête. Explorez chaque test pour la transcription complète et le raisonnement du juge.

Prêt pour CI/CD

Déclenchez des exécutions depuis GitHub Actions, GitLab CI, Jenkins ou Cloud Build — ou selon un planning. Le JUnit XML s'insère dans votre pipeline comme n'importe quelle suite, les alertes arrivent dans Slack, Teams ou PagerDuty, et le build échoue automatiquement en cas de régression.

Prêt pour l'entreprise

Isolation des locataires au niveau des lignes, RBAC granulaire, SSO via OIDC/SAML, provisionnement SCIM, passkeys et 2FA, journaux d'audit et quotas LLM par locataire. Conçu pour les équipes qui livrent à grande échelle.

Certifiez avant de lancer

Exécutez la suite de certification intégrée de TekVizion sur un catalogue épinglé et versionné — des tests alignés sur l'OWASP LLM Top 10, MITRE ATLAS et le NIST AI RMF — et obtenez un résultat par paliers, de Bronze à Platine, avec un rapport PDF complet.

Performance sous charge

Soumettez votre agent à un flot de conversations simultanées — ou de vrais appels vocaux — avec une simultanéité, une durée et un temps de réflexion que vous contrôlez. Vous récupérez le débit, les centiles de latence et le nombre d'erreurs, plus une comparaison de référence qui détecte les réponses qui se dégradent sous charge.

Votre superviseur de tests IA

Demandez pourquoi une exécution a régressé, quels agents déclinent ou quoi tester ensuite — un assistant conversationnel avec tout votre parc de tests en contexte. Lorsqu'il rédige des cas de test ou des juges, chaque écriture attend votre approbation explicite et figure dans le journal d'audit.

Résilience universelle des agents IA

Mesurez ce qui se passe quand les conversations dérapent.

Les vrais utilisateurs se taisent, changent d'avis, collent du texte illisible, s'énervent et testent les limites. CXMind fournit un cadre universel de résilience applicable à tout agent sans configuration et évalue la capacité de votre agent à se rétablir intelligemment.

11

familles de tests de résilience

90

cas créés par la plateforme

1 · Packs universels

La même exigence pour chaque agent.

Les packs résilience, sécurité, conformité et performance s'appliquent à tout agent dès le départ : silence, ambiguïté, corrections, boucles, pression émotionnelle, tests de limites et escalade, le tout créé par la plateforme et versionné.

2 · Vos tests générés

Votre métier, vos scénarios.

Les scénarios métier générés à partir des données d'entraînement de votre agent couvrent les missions que vos clients apportent réellement — et se figent dans une suite de mission épinglée lors de la certification.

3 · La certification exécute les deux

Un clic. Un verdict.

Une exécution de certification combine tous les packs universels avec votre suite de mission figée, puis classe le résultat dans un niveau certifié — avec une porte distincte d'échecs critiques qu'un taux de réussite élevé ne peut jamais racheter.

Canaux

Voix et chat — un seul moteur, un seul rapport.

Le même générateur, le même pilote, les mêmes juges et les mêmes politiques fonctionnent sur les deux canaux. Comparez voix et chat côte à côte dans la même suite de régression — qu'il s'agisse d'un SVI de support, d'un copilote de vente ou d'un helpdesk interne.

Canal vocal

Vrais appels vers n'importe quel agent vocal

  • Pilotez de vrais appels SIP / PSTN vers des agents vocaux, des IVR et des voice bots
  • Capturez les transcriptions ASR avec confiance par tour, MOS audio et latence
  • Testez DTMF, barge-in, musique d'attente, hand-off et transfert chaud
  • Les juges lisent les réponses vocales comme des transcriptions ASR — un mot mal entendu n'est pas une défaillance de l'agent
  • Coupé par un barge-in ? L'appelant se répète une fois, dans le même appel
  • Notez les réponses vocales avec les mêmes profils de juges que le chat
Canal chat

Conversations multi-tours face à n'importe quel agent

  • Flux scriptés, ou mode agentique par objectif — l'IA improvise chaque tour
  • Personas clients réalistes — argot, fautes de frappe, changements de sentiment
  • Assertions sur les appels d'outils/fonctions et vérifications de couverture d'intentions
  • Comparaison côte à côte avec le même prompt entre fournisseurs
Tests agentiques

Un scénario et un objectif. L'IA fait le reste.

Les cas de test par objectif n'ont aucune étape scriptée. Décrivez le scénario et l'objectif — le driver IA improvise une vraie conversation de chat multi-tours, s'adapte à ce que répond votre agent et insiste jusqu'à atteindre l'objectif ou être réellement bloqué. Le Juge d'Objectif tranche ensuite la seule question qui compte : l'agent a-t-il vraiment accompli la tâche ?

Tous les scénarios de la bibliothèque fonctionnent ainsi — et comme rien n'est scripté, chaque réexécution est une conversation nouvelle et entièrement autonome, pas une rediffusion.

Scénario

« Un client a reçu un article endommagé et commence à s'énerver. »

Objectif

« Obtenir l'approbation d'un remboursement et un numéro de confirmation. »

Driver IA — improvisation vers l'objectif

« Bonjour — mon mug est arrivé en mille morceaux. Je veux être remboursé. »

« Je peux vous aider. Remboursement approuvé — confirmation #RF-20871. »

Juge d'Objectif

Objectif atteint — remboursement confirmé avec numéro de référence ✓

ASR Word Boost

Apprenez votre vocabulaire au système de reconnaissance vocale.

Noms de marque, adresses d'assistance, codes de référence : les mots qui comptent le plus sont ceux que la reconnaissance vocale comprend mal. CXMind analyse les informations publiques, les intentions, les réponses attendues et les résultats acceptés de votre agent pour repérer les termes qu'un système de reconnaissance entendra mal, et les propose à la relecture.

Rien n'atteint le système de reconnaissance sans validation humaine. Réglez le poids de chaque terme, corrigez ses formes écrite et orale, et transformez ce que la transcription a entendu à la place en réécriture automatique.

ENTENDU

support at tech vision dot com

ASR 0.42

CORRIGÉ

support@tekvizion.com

Termes approuvés

TekVizion ×2.0 CXMind ×1.5 SIP LINK ×2.0 RF-20871 ×1.2
Budget de termes
62 / 100

Validé par un humain · l'envoi à la passerelle est une option distincte

Politiques et ancrage

Des juges qui connaissent votre produit et votre politique.

Les simples "impressions" d'un LLM générique ne suffisent pas pour des agents IA en production. CXMind ancre chaque jugement dans deux choses que vous maîtrisez : votre bibliothèque de politiques réutilisables et votre propre corpus RAG de documentation produit, FAQ, modes opératoires, scripts et manuels de conformité.

  • § Bibliothèque de politiques : grilles réutilisables (HIPAA, PCI, voix de marque, "jamais de prix") appliquées par agent ou par suite.
  • 📚 Jugement ancré RAG : le juge d'hallucination récupère le passage pertinent et évalue la réponse par rapport à votre source de vérité, pas par rapport à la mémoire du modèle.
  • Juges personnalisés : créez votre propre profil de notation quand le standard ne suffit pas — apportez vos prompt et grille.
  • 🧭 Bibliothèque de scénarios : scénarios agentiques réutilisables — chacun associe une situation à un objectif que l'IA poursuit en toute autonomie : authentification, transfert, escalade, remboursement, KYC, tâches multi-étapes.

Model Context Protocol

Connectez vos outils avec MCP.

CXMind parle le Model Context Protocol. Enregistrez une fois un serveur MCP approuvé par le tenant et CXMind découvre automatiquement ses outils et ressources en lecture seule — prêts à alimenter l'import de données d'entraînement et les évaluations par juges personnalisés.

  • Import automatisé des données d'entraînement — Planifiez des tâches d'ingestion qui intègrent les ressources MCP approuvées dans la base de connaissances de chaque agent — actualisées sur place, sans copier-coller, toujours à jour.
  • Juges personnalisés avec outils en direct — Associez des outils MCP en lecture seule à un juge personnalisé pour qu'il récupère des preuves en direct — commandes, état du compte, recherches de politiques — avant de noter une réponse.
  • 🛡 Lecture seule et encadré — Seuls les outils approuvés, activés et en lecture seule au schéma inchangé s'exécutent. Jamais d'appels en écriture ou destructeurs — appliqué à l'exécution.

Conçu pour l'entreprise

Sécurisé par défaut. Résilient par conception.

CXMind est conçu pour les charges IA en production dans les secteurs régulés comme non régulés : chaque tenant est totalement isolé, chaque octet est chiffré et chaque exécution de test est durable. Les pannes ne perdent pas de travail, les fuites ne franchissent pas les frontières des tenants et les audits ne réservent pas de surprises.

  • Isolation stricte des tenants — chaque enregistrement porte une frontière de tenant appliquée dans la couche de données, pas seulement dans l'application.
  • 🔒 Chiffrement partout — au repos et en transit, avec gestion de clés par tenant pour les secrets et identifiants.
  • Exécutions de tests résilientes — les exécutions survivent aux redémarrages et pannes d'infrastructure, reprenant depuis le dernier tour terminé sans intervention humaine.
  • § Politiques et ancrage intégrés — chaque jugement peut citer la politique pertinente et la source d'ancrage utilisée pour la vérification.
  • LLMs interchangeables — APIs commerciales, endpoints privés ou modèles auto-hébergés pour les déploiements souverains.
  • Prêt pour l'audit — piste d'audit complète, accès par rôle, SSO et quotas par tenant fournis d'origine.

Et le reste de la boîte à outils.

🗓 Exécutions planifiées

Planifications cron ou par intervalle avec pause, reprise et exécution immédiate.

🔔 Canaux de notification

E-mail, Slack, Teams, SMS, PagerDuty et webhooks sur les événements d'exécution.

📝 Import de transcriptions

Les conversations réelles en JSON, CSV, DOCX ou PDF deviennent du matériel de test.

🌐 Exploration de site web

Importez le contenu du site comme socle documentaire et gardez-le à jour en place.

📦 Bibliothèque de tests prédéfinis

Packs sécurité, conformité et performance, prêts à importer.

🔀 Comparaison de régressions

Deux exécutions côte à côte, chaque écart classifié.

👁 Mode observation

Parcourez une conversation en direct tour par tour.

📱 Application mobile installable

Surveillez et agissez sur les exécutions depuis votre téléphone.

La confiance des leaders du secteur

Deux décennies d'excellentes expériences utilisateur.

"Nous travaillons avec eux comme s'ils étaient une autre équipe au sein de Microsoft."
M

Microsoft

Communications d'entreprise

"TekVizion nous a permis d'améliorer l'engagement et la satisfaction de nos clients."
A

AWS

Plateforme cloud

"Nous pouvons désormais faire en 4 minutes, en un seul clic, ce qui prenait 4 heures de tests."
B

Bell Canada

Services voix opérateur

"TekVizion a libéré nos ingénieurs les plus précieux pour qu'ils se concentrent sur des projets critiques."
V

Vodafone

Communications mondiales

Prêt à certifier vos agents avant que vos clients ne le fassent ?

Connectez-vous à votre tenant CXMind, ou contactez l'équipe TekVizion pour intégrer votre flotte d'agents.