Swisper Sentinel

Des tests en boîte transparente, aussi simples qu’une conversation avec un chatbot.

Rédigez vos scénarios de test en langage clair. Sentinel les exécute de bout en bout, à chaque étape franchie par vos agents.

Vous voyez chaque étape franchie par l’agent, et pourquoi il l’a franchie.

Tester des agents n’a rien à voir avec tester un logiciel.

Les systèmes agentiques sont non déterministes. Ils se coordonnent entre agents, s’interrompent pour recueillir une intervention humaine et conservent un état d’une étape à l’autre.

Sentinel rend toute l’exécution visible et testable en langage clair.

Ce que fait Sentinel

Quatre capacités. Une seule exécution. Une visibilité totale, de l’invite au verdict.

Rédigez-le, observez-le, expliquez l’échec, jugez la qualité.

01

RédigerAutomatisation des tests E2E

Rédigez vos tests en langage clair

  • Langage clair, sans script
  • Exécute chaque étape de bout en bout
  • Des critères de validation que vous définissez
Sentinel · Modifier le scénario
02

ObserverEnregistrement de l’exécution

Observez vos agents à l’œuvre

  • Chaque exécution capturée en vidéo
  • Revisionnez ce que l’agent a vu et fait
  • Une piste de preuves par défaut
Sentinel · Observez vos agents à l’œuvre
03

ExpliquerAnalyseur de bugs

Des échecs expliqués, pas seulement signalés

  • Analyse automatisée de la cause racine à chaque échec
  • Nomme l’agent, l’état et la décision
  • Aucune inspection manuelle des traces
Sentinel · Détails de l’exécution du test
04

JugerLLM comme juge

La qualité, au-delà du simple réussite/échec

  • Évaluation par modèle selon vos critères
  • Chaque vérification produit un verdict et des preuves
  • Détecte ce que les assertions strictes manquent
Sentinel · Résultats des tests

Transparence et auditabilité totales.

Chaque action et chaque élément de raisonnement sont consignés. En cas d’échec d’une exécution, vous lisez la trace.

  • Action et raisonnement, étape par étape
  • Journaux exportables en JSON ou en texte
  • Les preuves mêmes que vos auditeurs demanderont
Sentinel · Interactions du navigateur

Le résultat

Ce qui change lorsque toute l’exécution est visible.

Totale

Chaque étape couverte

Coordination, intervention humaine et état : tout est testé.

Vidéo

Chaque exécution est auditable

Voyez ce qu’a fait l’agent, en relecture.

Cause racine

Échecs expliqués

L’agent, l’état et la décision à l’origine de la panne.

Qualité

Régressions détectées

Le jugement dépasse les assertions réussite/échec.

C’est un ingénieur QA qui observe, juge et explique.

Questions fréquentes

  • Un outil de test de bout en bout en glass-box pour agents IA : vous rédigez des scénarios en langage naturel et Sentinel les exécute à chaque étape de vos agents.

  • Non. Les scénarios s'écrivent en langage naturel, si bien que les équipes produit et QA créent des tests sans ingénierie.

  • Sentinel fournit une analyse automatisée des causes racines, ce qui a échoué, pourquoi et où, avec relecture vidéo des interactions de l'agent.

  • Oui. Sentinel teste des flux multi-agents complexes de bout en bout, avec une évaluation de la qualité selon le principe LLM-as-a-Judge.

Voyez Sentinel tester un véritable agent.

Nous exécuterons un scénario réel de bout en bout et vous montrerons la trace.