Testowanie agentów wspierane przez SI · od TekVizion

Testuj każdą rozmowę.
Zanim zrobią to Twoi klienci.

CXMind to oparta na SI platforma testowa dla dowolnego agenta głosowego lub czatowego — obsługa klienta, sprzedaż, wewnętrzny helpdesk, copiloty, opieka zdrowotna, bankowość i wiele innych. Generuj tysiące realistycznych przypadków testowych, prowadź wieloturowe rozmowy i oceniaj każdą odpowiedź pod kątem jakości, bezpieczeństwa, zgodności i UX — w minuty, nie tygodnie.

Zaloguj się Jak to działa Bez karty kredytowej · beta tylko na zaproszenie

Głos + Czat

Oba kanały, jedna platforma

13

Wyspecjalizowani sędziowie SI

18+

Obsługiwane platformy agentów

OWASP

Pokrycie LLM Top 10

cxmind.tekvizion.com/dashboard

42

Agenty

3,827

Przypadki testowe

94.2%

Wskaźnik zaliczeń

Wyniki testów · 30 dni +12,4% wskaźnik zaliczeń ↑

Nocna regresja · w toku

412 / 580 przypadków · 71% ukończono

02:14

Napędzamy programy testowe wiodących platform komunikacyjnych

Microsoft Cisco Zoom RingCentral Google AWS Vodafone

Jak działa CXMind

Cztery wyspecjalizowane komponenty, jedna ciągła pętla testowa.

Podłącz swojego agenta. CXMind czyta Twoje prompty, generuje realistyczne przypadki testowe, prowadzi wieloturowe rozmowy i ocenia odpowiedzi we wszystkich wymiarach, które mają znaczenie.

G Generator Tworzy przypadki testowe na podstawie promptów i dokumentów D Driver Symuluje klientów 🎙 Głos 💬 Czat B Twój agent Dialogflow · Lex · Genesys LLM · Twilio · Webhook Sędziowie Oceń każdą odpowiedź 🏛️ Uniwersalny Jakość 🛡️ Bezpieczeństwo 📋 Zgodność 🚫 Toksyczność 🔍 Halucynacja Wydajność 🎯 Dziedzina 🎭 Zachowanie 🧠 Pamięć 🏁 Cel 🎧 Rozmowa 📊 Summarizer Raporty JUnit · PDF Niepowodzenia trafiają z powrotem do Generatora — regresje stają się z czasem trudniejsze

Zbudowane z myślą o agentach produkcyjnych

Wszystko, czego potrzebujesz, by z pewnością wdrażać konwersacyjne SI.

Silnik testowy

Czterech współpracujących agentów — Generator, Driver, Sędzia, Summarizer — zbudowanych na wymiennych komercyjnych lub samodzielnie hostowanych LLM. Każdy agent otrzymuje dopasowane przypadki testowe bez ręcznego pisania.

Głos i czat, dowolna platforma

Jedna platforma dla obu kanałów — kieruj prawdziwe połączenia SIP do agentów głosowych i IVR oraz uruchamiaj skryptowe lub w pełni autonomiczne, sterowane celem rozmowy czatowe z agentami LLM, agentami opartymi na intencjach lub dowolnym webhookiem HTTP. Przynieś swojego agenta — resztą zajmie się CXMind.

Bezpieczeństwo i zgodność wbudowane

OWASP LLM Top 10, MITRE ATLAS, sondy prompt injection i jailbreak, wykrywanie PII z allowlistą, a także konfigurowalne rubryki polityk dla HIPAA, PCI i SOC 2.

Pulpit w czasie rzeczywistym

Wskaźniki zaliczeń, percentyle opóźnień, oceny wymiarów, delty regresji i postęp na żywo — z wykrywaniem niestabilnych przypadków i ich kwarantanną, aby wskaźnik zaliczeń pozostał uczciwy. Wejdź w dowolny test, aby zobaczyć pełną transkrypcję i uzasadnienie sędziego.

Gotowy do CI/CD

Uruchamiaj testy z GitHub Actions, GitLab CI, Jenkinsa lub Cloud Build — albo według harmonogramu. JUnit XML trafia do pipeline'u jak każdy inny zestaw, alerty lądują w Slacku, Teams lub PagerDuty, a build automatycznie kończy się niepowodzeniem przy regresji.

Gotowe dla firm

Izolacja najemców na poziomie wierszy, precyzyjne RBAC, SSO przez OIDC/SAML, provisioning SCIM, passkeys i 2FA, dzienniki audytu i limity LLM per najemca. Dla zespołów wdrażających na dużą skalę.

Certyfikuj przed wdrożeniem

Uruchom wbudowany zestaw certyfikacyjny TekVizion na przypiętym, wersjonowanym katalogu — testy zmapowane na OWASP LLM Top 10, MITRE ATLAS i NIST AI RMF — i otrzymaj wynik w skali od Brązu do Platyny z pełnym raportem PDF.

Wydajność pod obciążeniem

Zalej swojego agenta równoległymi rozmowami — lub prawdziwymi połączeniami głosowymi — o współbieżności, czasie trwania i czasie namysłu, które sam kontrolujesz. Wracają przepustowość, percentyle opóźnień i liczby błędów, plus porównanie z linią bazową, które wychwytuje odpowiedzi pogarszające się pod obciążeniem.

Twój superwizor testów AI

Zapytaj, dlaczego uruchomienie się pogorszyło, które agenty tracą jakość albo co testować dalej — konwersacyjny asystent z całym Twoim majątkiem testowym w kontekście. Gdy szkicuje przypadki testowe lub sędziów, każdy zapis czeka na Twoje wyraźne zatwierdzenie i trafia do dziennika audytu.

Uniwersalna odporność agentów

Zmierz, co się dzieje, gdy rozmowy idą źle.

Prawdziwi użytkownicy milkną, zmieniają zdanie, wklejają nieczytelny tekst, tracą cierpliwość i testują granice. CXMind zapewnia uniwersalne ramy odporności, które działają dla każdego agenta bez konfiguracji, i ocenia, jak inteligentnie agent wraca na właściwe tory.

11

rodzin testów odporności

90

przypadków przygotowanych przez platformę

1 · Pakiety uniwersalne

Ta sama poprzeczka dla każdego agenta.

Pakiety odporności, bezpieczeństwa, zgodności i wydajności działają dla każdego agenta od razu: cisza, niejednoznaczność, korekty, pętle, presja emocjonalna, testowanie granic i eskalacja — wszystko stworzone przez platformę i wersjonowane.

2 · Twoje wygenerowane testy

Twój biznes, twoje scenariusze.

Scenariusze biznesowe generowane z materiałów treningowych twojego agenta pokrywają zadania, z którymi naprawdę przychodzą twoi klienci — i zostają zamrożone w przypiętym zestawie misji podczas certyfikacji.

3 · Certyfikacja uruchamia oba

Jedno kliknięcie. Jeden werdykt.

Przebieg certyfikacji łączy wszystkie pakiety uniwersalne z zamrożonym zestawem misji i klasyfikuje wynik do certyfikowanego poziomu — z osobną bramką błędów krytycznych, której wysoki wskaźnik zaliczeń nigdy nie zrekompensuje.

Kanały

Głos i czat — jeden silnik, jeden raport.

Ten sam generator, driver, sędziowie i polityki działają na obu kanałach. Porównuj głos i czat obok siebie w tej samej suicie regresji — niezależnie od tego, czy testujesz IVR wsparcia, copilot sprzedażowy czy wewnętrzny helpdesk.

Kanał głosowy

Realne połączenia do dowolnego agenta głosowego

  • Kieruj prawdziwe połączenia SIP / PSTN do agentów głosowych, IVR i agentów głosowych
  • Przechwytuj transkrypcje ASR z pewnością dla każdej tury, MOS audio i opóźnieniem
  • Testuj DTMF, barge-in, muzykę oczekiwania, przekazanie i ciepły transfer
  • Sędziowie czytają odpowiedzi głosowe jako transkrypcje ASR — źle usłyszane słowo nie jest błędem agenta
  • Przerwane przez barge-in? Dzwoniący powtarza się raz, w ramach tego samego połączenia
  • Oceniaj odpowiedzi głosowe tymi samymi profilami sędziów co czat
Kanał czatu

Wieloturowe rozmowy z dowolnym agentem

  • Przepływy skryptowe lub agentowy tryb celu — SI improwizuje każdą turę
  • Realistyczne persony klientów — slang, literówki, zmiany sentymentu
  • Asercje wywołań narzędzi/funkcji i weryfikacja pokrycia intencji
  • Porównanie obok siebie z tym samym promptem u różnych dostawców
Testowanie agentowe

Scenariusz i cel. Resztę zrobi SI.

Przypadki testowe oparte na celach nie mają skryptowanych kroków. Opisz scenariusz i cel — driver SI improwizuje prawdziwą, wieloturową rozmowę czatową, dostosowuje się do każdej odpowiedzi twojego agenta i naciska, aż cel zostanie osiągnięty lub faktycznie zablokowany. Następnie Sędzia Celu rozstrzyga jedyne pytanie, które się liczy: czy agent naprawdę wykonał zadanie?

Każdy scenariusz w bibliotece działa w ten sposób — a ponieważ nic nie jest skryptowane, każde ponowne uruchomienie to świeża, w pełni autonomiczna rozmowa, a nie odtworzenie.

Scenariusz

"Klient otrzymał uszkodzony produkt i zaczyna się irytować."

Cel

"Uzyskać zatwierdzenie zwrotu i numer potwierdzenia."

Driver SI — improwizuje w stronę celu

"Dzień dobry — mój kubek dotarł potłuczony. Chcę zwrot pieniędzy."

"Chętnie pomogę. Zwrot zatwierdzony — potwierdzenie #RF-20871."

Sędzia Celu

Cel osiągnięty — zwrot potwierdzony numerem referencyjnym ✓

ASR Word Boost

Naucz system rozpoznawania mowy swojego słownictwa.

Nazwy marek, adresy wsparcia, kody referencyjne — słowa, które znaczą najwięcej, to te, które rozpoznawanie mowy słyszy źle. CXMind skanuje publiczne informacje agenta, intencje, oczekiwane odpowiedzi i zaakceptowane wyniki w poszukiwaniu terminów, które system rozpoznawania usłyszy błędnie, i proponuje je do przeglądu.

Nic nie trafia do systemu rozpoznawania, dopóki człowiek tego nie zatwierdzi. Ustal siłę preferencji każdego terminu, popraw jego formę pisaną i mówioną, a to, co transkrypcja usłyszała zamiast niego, zamień w automatyczną korektę.

USŁYSZANE

support at tech vision dot com

ASR 0.42

POPRAWIONE

support@tekvizion.com

Zatwierdzone terminy

TekVizion ×2.0 CXMind ×1.5 SIP LINK ×2.0 RF-20871 ×1.2
Budżet terminów
62 / 100

Zatwierdzone przez człowieka · wysyłka do bramki to osobny, opcjonalny przełącznik

Polityki i grounding

Sędziowie znający Twój produkt i Twoje polityki.

Generyczne „wyczucie” LLM nie wystarcza produkcyjnym agentom. CXMind opiera każdy osąd na dwóch rzeczach, które kontrolujesz: Twojej bibliotece zasad wielokrotnego użytku i Twoim własnym korpusie RAG zawierającym dokumentację produktu, FAQ, procedury, skrypty i podręczniki zgodności.

  • § Biblioteka polityk: reużywalne rubryki (HIPAA, PCI, brand voice, „nigdy nie podawaj cen") stosowane per agent lub per suita.
  • 📚 Ocena oparta na RAG: sędzia halucynacji pobiera odpowiedni fragment i ocenia odpowiedź względem Twojego źródła prawdy, a nie pamięci modelu.
  • Niestandardowi sędziowie: stwórz własny profil oceny, gdy gotowy nie wystarcza — przynieś swój prompt + rubrykę.
  • 🧭 Biblioteka scenariuszy: wielokrotnego użytku scenariusze agentowe — każdy łączy sytuację z celem, który SI realizuje autonomicznie: uwierzytelnianie, przekazanie, eskalacja, zwrot, KYC, zadania wieloetapowe.

Model Context Protocol

Połącz swoje narzędzia z MCP.

CXMind mówi w Model Context Protocol. Zarejestruj raz zatwierdzony przez najemcę serwer MCP, a CXMind automatycznie wykryje jego narzędzia i zasoby tylko do odczytu — gotowe do zasilania importu danych treningowych i ocen sędziów niestandardowych.

  • Zautomatyzowany import danych treningowych — Zaplanuj zadania pozyskiwania, które wciągają zatwierdzone zasoby MCP do bazy wiedzy każdego agenta — odświeżane w miejscu, bez kopiuj-wklej, zawsze aktualne.
  • Niestandardowi sędziowie z narzędziami na żywo — Podłącz narzędzia MCP tylko do odczytu do niestandardowego sędziego, aby pobierał dowody na żywo — zamówienia, stan konta, zapytania o zasady — zanim oceni odpowiedź.
  • 🛡 Tylko do odczytu i nadzorowane — Uruchamiane są wyłącznie zatwierdzone, włączone narzędzia tylko do odczytu o niezmienionym schemacie. Nigdy wywołania zapisu ani destrukcyjne — egzekwowane w czasie wykonania.

Stworzone z myślą o przedsiębiorstwach

Bezpieczne domyślnie. Odporne z założenia.

CXMind jest zaprojektowany dla produkcyjnych obciążeń SI w branżach regulowanych i nieregulowanych: każdy tenant jest w pełni izolowany, każdy bajt jest szyfrowany, a każde uruchomienie testu jest trwałe. Awarie nie powodują utraty pracy, naruszenia nie przekraczają granic tenantów, a audyty nie przynoszą niespodzianek.

  • Rygorystyczna izolacja tenantów — każdy rekord ma granicę tenanta wymuszaną w warstwie danych, a nie tylko w aplikacji.
  • 🔒 Szyfrowanie wszędzie — w spoczynku i w transmisji, z obsługą kluczy w zakresie tenanta dla sekretów i poświadczeń.
  • Odporne uruchomienia testów — uruchomienia przeżywają restarty procesów i awarie infrastruktury, wznawiając się od ostatniej zakończonej tury bez interwencji człowieka.
  • § Polityki i grounding wbudowane — każdy osąd może powołać się na właściwą politykę i źródło groundingu, względem którego został zweryfikowany.
  • Wymienne LLM — komercyjne API, prywatne endpointy lub modele samodzielnie hostowane dla suwerennych wdrożeń.
  • Gotowe do audytu — pełny ślad audytu, dostęp oparty na rolach, SSO i limity per tenant od razu po wdrożeniu.

I reszta zestawu narzędzi.

🗓 Zaplanowane uruchomienia

Harmonogramy cron lub interwałowe z pauzą, wznowieniem i natychmiastowym startem.

🔔 Kanały powiadomień

E-mail, Slack, Teams, SMS, PagerDuty i webhooki przy zdarzeniach uruchomień.

📝 Przesyłanie transkrypcji

Prawdziwe rozmowy w JSON, CSV, DOCX lub PDF stają się materiałem testowym.

🌐 Indeksowanie witryny

Importuj treści witryny jako podstawę wiedzy i odświeżaj je na miejscu.

📦 Gotowa biblioteka testów

Pakiety bezpieczeństwa, zgodności i wydajności, gotowe do importu.

🔀 Porównanie regresji

Dwa uruchomienia obok siebie, każda różnica sklasyfikowana.

👁 Tryb obserwacji

Przechodź przez rozmowę na żywo tura po turze.

📱 Instalowalna aplikacja mobilna

Monitoruj uruchomienia i reaguj na nie z telefonu.

Zaufały nam liderzy branży

Dwie dekady wspaniałych doświadczeń użytkownika.

"Pracujemy z nimi jak z kolejnym zespołem wewnątrz Microsoftu."
M

Microsoft

Komunikacja korporacyjna

"TekVizion umożliwił nam poprawę zaangażowania klientów i wyników satysfakcji."
A

AWS

Platforma w chmurze

"Teraz wystarczy jedno kliknięcie, by w 4 minuty wykonać testy, które wcześniej zajmowały 4 godziny."
B

Bell Canada

Usługi głosowe operatorów

"TekVizion uwolnił naszych najcenniejszych inżynierów, by mogli skupić się na kluczowych projektach."
V

Vodafone

Komunikacja globalna

Gotowy, aby certyfikować swoje agenty, zanim zrobią to klienci?

Zaloguj się do swojego tenantu CXMind lub porozmawiaj z zespołem TekVizion o wdrożeniu Twojej floty agentów.