Swisper Sentinel

Glassbox-Testing, so einfach wie ein Chatbot-Prompt.

Schreibe Testszenarien in natürlicher Sprache. Sentinel übernimmt die nahtlose Testausführung der Schritte deines Agenten.

Du siehst jeden Schritt, den der Agent gemacht hat, und warum.

Das Testen agentischer Systeme erfordert grundlegend neue Ansätze.

Agentische Systeme sind nicht-deterministisch, sie warten auf menschliche Eingaben, übermitteln prozessübergreifende Zustände und koordinieren über Agenten hinweg.

Sentinel macht die gesamte Ausführung sichtbar und in natürlicher Sprache testbar.

Was Sentinel leistet

Vier Funktionen, ein Durchlauf. Volle Transparenz vom Prompt bis zum Urteil.

Schreiben, beobachten, Fehler erklären, und Qualität beurteilen.

01

SchreibenTEST SPEZIFIKATION

Schreibe Tests in natürlicher Sprache

  • Kein Scripting notwendig
  • Durchgängige Ausführung jedes Schrittes
  • Von dir definierte Validierungskriterien
Sentinel · Szenario bearbeiten
02

BeobachtenAufnahme des Tests

Beobachte deine Agenten bei der Arbeit

  • Jeder Durchlauf als Video
  • Aufnahmen, was der Agent gesehen und getan hat
  • Eine vollständige Beweiskette
Sentinel · Beobachten deine Agenten bei der Arbeit
03

ErklärenFehlersuche

Fehler erklärt, nicht nur markiert

  • Automatisierte Ursachenanalyse bei jedem Fehler
  • Identifikation des Agenten, des Urteils und der Begründung
  • Keine manuelle Rückverfolgung
Sentinel · Testlauf-Details
04

BeurteilenLLM-as-a-Judge

Qualität, jenseits von Bestanden / Nicht-bestanden

  • Modellbasierte Bewertung der Testkriterien
  • Urteil und Nachweis für jeden Test
  • Erfasst, was statische Prüfbedingungen verpassen
Sentinel · Testergebnisse

Volle Transparenz und Auditierbarkeit.

Jede Aktion und jeder Denkschritt wird protokolliert. Wenn ein Durchlauf fehlschlägt, kannst du den Test zurück verfolgen.

  • Aktion und Reasoning, Schritt für Schritt
  • Logs exportierbar als JSON oder Text
  • Beweise, nach denen Kontrollinstanzen fragen
Sentinel · Browser-Interaktionen

Das Ergebnis

Was sich ändert, wenn der ganze Durchlauf sichtbar ist.

Vollständig

Jeder Schritt abgedeckt

Koordination, Human-in-the-Loop und Zustand, alles getestet.

Video

Jeder Durchlauf ist auditierbar

Sieh in der Wiedergabe, was der Agent getan hat.

Ursache

Fehler erklärt

Der Agent, der Zustand und die Kriterien, die verletzt wurden.

Qualität

Regressionen erkannt

Die Beurteilung reicht über Bestanden/Nicht-Bestanden hinaus.

Sentinel ist ein QA-Entwickler, der beobachtet, beurteilt und erklärt.

Häufige Fragen

  • Ein Glass-Box-E2E-Testtool für KI-Agenten: Du schreibst Testszenarien in natürlicher Sprache, und Sentinel führt sie über jeden Schritt deiner Agenten aus.

  • Nein. Szenarien werden in natürlicher Sprache geschrieben, sodass Produkt- und QA-Teams Tests ohne Engineering erstellen können.

  • Sentinel liefert eine automatisierte Ursachenanalyse, was fehlgeschlagen ist, warum und wo, mit Video-Wiedergabe der Browser-Interaktionen des Agenten.

  • Ja. Sentinel testet komplexe Multi-Agenten-Abläufe end to end, mit Qualitätsbewertung per LLM-as-a-Judge.

Erlebe, wie Sentinel einen echten Agenten testet.

Wir führen ein Live-Szenario durchgängig aus und zeigen dir die Rückverfolgung.