Silnik testowy
Czterech współpracujących agentów — Generator, Driver, Sędzia, Summarizer — zbudowanych na wymiennych komercyjnych lub samodzielnie hostowanych LLM. Każdy agent otrzymuje dopasowane przypadki testowe bez ręcznego pisania.
CXMind to oparta na SI platforma testowa dla dowolnego agenta głosowego lub czatowego — obsługa klienta, sprzedaż, wewnętrzny helpdesk, copiloty, opieka zdrowotna, bankowość i wiele innych. Generuj tysiące realistycznych przypadków testowych, prowadź wieloturowe rozmowy i oceniaj każdą odpowiedź pod kątem jakości, bezpieczeństwa, zgodności i UX — w minuty, nie tygodnie.
Głos + Czat
Oba kanały, jedna platforma
13
Wyspecjalizowani sędziowie SI
18+
Obsługiwane platformy agentów
OWASP
Pokrycie LLM Top 10
42
Agenty
3,827
Przypadki testowe
94.2%
Wskaźnik zaliczeń
Nocna regresja · w toku
412 / 580 przypadków · 71% ukończono
Napędzamy programy testowe wiodących platform komunikacyjnych
Jak działa CXMind
Podłącz swojego agenta. CXMind czyta Twoje prompty, generuje realistyczne przypadki testowe, prowadzi wieloturowe rozmowy i ocenia odpowiedzi we wszystkich wymiarach, które mają znaczenie.
Zbudowane z myślą o agentach produkcyjnych
Czterech współpracujących agentów — Generator, Driver, Sędzia, Summarizer — zbudowanych na wymiennych komercyjnych lub samodzielnie hostowanych LLM. Każdy agent otrzymuje dopasowane przypadki testowe bez ręcznego pisania.
Jedna platforma dla obu kanałów — kieruj prawdziwe połączenia SIP do agentów głosowych i IVR oraz uruchamiaj skryptowe lub w pełni autonomiczne, sterowane celem rozmowy czatowe z agentami LLM, agentami opartymi na intencjach lub dowolnym webhookiem HTTP. Przynieś swojego agenta — resztą zajmie się CXMind.
OWASP LLM Top 10, MITRE ATLAS, sondy prompt injection i jailbreak, wykrywanie PII z allowlistą, a także konfigurowalne rubryki polityk dla HIPAA, PCI i SOC 2.
Wskaźniki zaliczeń, percentyle opóźnień, oceny wymiarów, delty regresji i postęp na żywo — z wykrywaniem niestabilnych przypadków i ich kwarantanną, aby wskaźnik zaliczeń pozostał uczciwy. Wejdź w dowolny test, aby zobaczyć pełną transkrypcję i uzasadnienie sędziego.
Uruchamiaj testy z GitHub Actions, GitLab CI, Jenkinsa lub Cloud Build — albo według harmonogramu. JUnit XML trafia do pipeline'u jak każdy inny zestaw, alerty lądują w Slacku, Teams lub PagerDuty, a build automatycznie kończy się niepowodzeniem przy regresji.
Izolacja najemców na poziomie wierszy, precyzyjne RBAC, SSO przez OIDC/SAML, provisioning SCIM, passkeys i 2FA, dzienniki audytu i limity LLM per najemca. Dla zespołów wdrażających na dużą skalę.
Uruchom wbudowany zestaw certyfikacyjny TekVizion na przypiętym, wersjonowanym katalogu — testy zmapowane na OWASP LLM Top 10, MITRE ATLAS i NIST AI RMF — i otrzymaj wynik w skali od Brązu do Platyny z pełnym raportem PDF.
Zalej swojego agenta równoległymi rozmowami — lub prawdziwymi połączeniami głosowymi — o współbieżności, czasie trwania i czasie namysłu, które sam kontrolujesz. Wracają przepustowość, percentyle opóźnień i liczby błędów, plus porównanie z linią bazową, które wychwytuje odpowiedzi pogarszające się pod obciążeniem.
Zapytaj, dlaczego uruchomienie się pogorszyło, które agenty tracą jakość albo co testować dalej — konwersacyjny asystent z całym Twoim majątkiem testowym w kontekście. Gdy szkicuje przypadki testowe lub sędziów, każdy zapis czeka na Twoje wyraźne zatwierdzenie i trafia do dziennika audytu.
Uniwersalna odporność agentów
Prawdziwi użytkownicy milkną, zmieniają zdanie, wklejają nieczytelny tekst, tracą cierpliwość i testują granice. CXMind zapewnia uniwersalne ramy odporności, które działają dla każdego agenta bez konfiguracji, i ocenia, jak inteligentnie agent wraca na właściwe tory.
11
rodzin testów odporności
90
przypadków przygotowanych przez platformę
1 · Pakiety uniwersalne
Pakiety odporności, bezpieczeństwa, zgodności i wydajności działają dla każdego agenta od razu: cisza, niejednoznaczność, korekty, pętle, presja emocjonalna, testowanie granic i eskalacja — wszystko stworzone przez platformę i wersjonowane.
2 · Twoje wygenerowane testy
Scenariusze biznesowe generowane z materiałów treningowych twojego agenta pokrywają zadania, z którymi naprawdę przychodzą twoi klienci — i zostają zamrożone w przypiętym zestawie misji podczas certyfikacji.
3 · Certyfikacja uruchamia oba
Przebieg certyfikacji łączy wszystkie pakiety uniwersalne z zamrożonym zestawem misji i klasyfikuje wynik do certyfikowanego poziomu — z osobną bramką błędów krytycznych, której wysoki wskaźnik zaliczeń nigdy nie zrekompensuje.
Kanały
Ten sam generator, driver, sędziowie i polityki działają na obu kanałach. Porównuj głos i czat obok siebie w tej samej suicie regresji — niezależnie od tego, czy testujesz IVR wsparcia, copilot sprzedażowy czy wewnętrzny helpdesk.
Przypadki testowe oparte na celach nie mają skryptowanych kroków. Opisz scenariusz i cel — driver SI improwizuje prawdziwą, wieloturową rozmowę czatową, dostosowuje się do każdej odpowiedzi twojego agenta i naciska, aż cel zostanie osiągnięty lub faktycznie zablokowany. Następnie Sędzia Celu rozstrzyga jedyne pytanie, które się liczy: czy agent naprawdę wykonał zadanie?
Każdy scenariusz w bibliotece działa w ten sposób — a ponieważ nic nie jest skryptowane, każde ponowne uruchomienie to świeża, w pełni autonomiczna rozmowa, a nie odtworzenie.
Scenariusz
"Klient otrzymał uszkodzony produkt i zaczyna się irytować."
Cel
"Uzyskać zatwierdzenie zwrotu i numer potwierdzenia."
Driver SI — improwizuje w stronę celu
"Dzień dobry — mój kubek dotarł potłuczony. Chcę zwrot pieniędzy."
"Chętnie pomogę. Zwrot zatwierdzony — potwierdzenie #RF-20871."
Sędzia Celu
Cel osiągnięty — zwrot potwierdzony numerem referencyjnym ✓
Nazwy marek, adresy wsparcia, kody referencyjne — słowa, które znaczą najwięcej, to te, które rozpoznawanie mowy słyszy źle. CXMind skanuje publiczne informacje agenta, intencje, oczekiwane odpowiedzi i zaakceptowane wyniki w poszukiwaniu terminów, które system rozpoznawania usłyszy błędnie, i proponuje je do przeglądu.
Nic nie trafia do systemu rozpoznawania, dopóki człowiek tego nie zatwierdzi. Ustal siłę preferencji każdego terminu, popraw jego formę pisaną i mówioną, a to, co transkrypcja usłyszała zamiast niego, zamień w automatyczną korektę.
USŁYSZANE
support at tech vision dot com
POPRAWIONE
support@tekvizion.com
Zatwierdzone terminy
Zatwierdzone przez człowieka · wysyłka do bramki to osobny, opcjonalny przełącznik
Polityki i grounding
Generyczne „wyczucie” LLM nie wystarcza produkcyjnym agentom. CXMind opiera każdy osąd na dwóch rzeczach, które kontrolujesz: Twojej bibliotece zasad wielokrotnego użytku i Twoim własnym korpusie RAG zawierającym dokumentację produktu, FAQ, procedury, skrypty i podręczniki zgodności.
Model Context Protocol
CXMind mówi w Model Context Protocol. Zarejestruj raz zatwierdzony przez najemcę serwer MCP, a CXMind automatycznie wykryje jego narzędzia i zasoby tylko do odczytu — gotowe do zasilania importu danych treningowych i ocen sędziów niestandardowych.
Stworzone z myślą o przedsiębiorstwach
CXMind jest zaprojektowany dla produkcyjnych obciążeń SI w branżach regulowanych i nieregulowanych: każdy tenant jest w pełni izolowany, każdy bajt jest szyfrowany, a każde uruchomienie testu jest trwałe. Awarie nie powodują utraty pracy, naruszenia nie przekraczają granic tenantów, a audyty nie przynoszą niespodzianek.
🗓 Zaplanowane uruchomienia
Harmonogramy cron lub interwałowe z pauzą, wznowieniem i natychmiastowym startem.
🔔 Kanały powiadomień
E-mail, Slack, Teams, SMS, PagerDuty i webhooki przy zdarzeniach uruchomień.
📝 Przesyłanie transkrypcji
Prawdziwe rozmowy w JSON, CSV, DOCX lub PDF stają się materiałem testowym.
🌐 Indeksowanie witryny
Importuj treści witryny jako podstawę wiedzy i odświeżaj je na miejscu.
📦 Gotowa biblioteka testów
Pakiety bezpieczeństwa, zgodności i wydajności, gotowe do importu.
🔀 Porównanie regresji
Dwa uruchomienia obok siebie, każda różnica sklasyfikowana.
👁 Tryb obserwacji
Przechodź przez rozmowę na żywo tura po turze.
📱 Instalowalna aplikacja mobilna
Monitoruj uruchomienia i reaguj na nie z telefonu.
Zaufały nam liderzy branży
"Pracujemy z nimi jak z kolejnym zespołem wewnątrz Microsoftu."
Microsoft
Komunikacja korporacyjna
"TekVizion umożliwił nam poprawę zaangażowania klientów i wyników satysfakcji."
AWS
Platforma w chmurze
"Teraz wystarczy jedno kliknięcie, by w 4 minuty wykonać testy, które wcześniej zajmowały 4 godziny."
Bell Canada
Usługi głosowe operatorów
"TekVizion uwolnił naszych najcenniejszych inżynierów, by mogli skupić się na kluczowych projektach."
Vodafone
Komunikacja globalna
Zaloguj się do swojego tenantu CXMind lub porozmawiaj z zespołem TekVizion o wdrożeniu Twojej floty agentów.