Swisper Sentinel

Testing glassbox, semplice come scrivere a un chatbot.

Scrivete gli scenari di test in linguaggio naturale. Sentinel li esegue end-to-end, in ogni passaggio compiuto dai vostri agenti.

Vedete ogni passo compiuto dall’agente e il motivo per cui l’ha compiuto.

Testare gli agenti non è come testare il software.

I sistemi agentici sono non deterministici. Si coordinano tra agenti, si fermano per l’intervento umano e mantengono lo stato tra i passaggi.

Sentinel rende l’intera esecuzione visibile e testabile in linguaggio naturale.

Cosa fa Sentinel

Quattro funzionalità. Un’unica esecuzione. Visibilità completa dal prompt al verdetto.

Scrivetelo, osservatelo, spiegate il fallimento, giudicate la qualità.

01

ScriveteAutomazione dei test E2E

Scrivete i test in linguaggio naturale

  • Linguaggio naturale, nessuno scripting
  • Esegue ogni passaggio end-to-end
  • Criteri di validazione definiti da voi
Sentinel · Modifica scenario
02

OsservateRegistrazione dell’esecuzione

Osservate i vostri agenti all’opera

  • Ogni esecuzione catturata come video
  • Rivedete ciò che l’agente ha visto e fatto
  • Una traccia di evidenze per impostazione predefinita
Sentinel · Osservate i vostri agenti all’opera
03

SpiegateBug Analyzer

Fallimenti spiegati, non solo segnalati

  • Analisi automatica della causa radice a ogni fallimento
  • Individua l’agente, lo stato e la decisione
  • Nessuna ispezione manuale delle tracce
Sentinel · Dettagli dell’esecuzione del test
04

GiudicateLLM-as-a-Judge

Qualità, oltre il pass o fail

  • Valutazione basata su modello secondo i vostri criteri
  • Ogni controllo riporta verdetto ed evidenze
  • Cattura ciò che le asserzioni rigide non colgono
Sentinel · Risultati dei test

Trasparenza e auditabilità complete.

Ogni azione e ogni passaggio di ragionamento vengono registrati. Quando un’esecuzione fallisce, leggete la traccia.

  • Azione e ragionamento, passo dopo passo
  • Log esportabili in JSON o testo
  • Le stesse evidenze che i vostri auditor richiederanno
Sentinel · Interazioni del browser

Il risultato

Cosa cambia quando l’intera esecuzione è visibile.

Completa

Ogni passaggio coperto

Coordinamento, human-in-the-loop e stato, tutto testato.

Video

Ogni esecuzione è auditabile

Guardate cosa ha fatto l’agente, in replay.

Causa radice

Fallimenti spiegati

L’agente, lo stato e la decisione che hanno provocato il guasto.

Qualità

Regressioni individuate

Il giudizio va oltre le asserzioni pass/fail.

Questo è un ingegnere QA che osserva, giudica e spiega.

Domande frequenti

  • Uno strumento di test end-to-end glass-box per agenti IA: scrivete gli scenari in linguaggio naturale e Sentinel li esegue attraverso ogni passo dei vostri agenti.

  • No. Gli scenari si scrivono in linguaggio naturale, così i team di prodotto e QA creano test senza sviluppo.

  • Sentinel fornisce un'analisi automatizzata delle cause profonde, cosa è fallito, perché e dove, con riproduzione video delle interazioni dell'agente.

  • Sì. Sentinel testa flussi multi-agente complessi end-to-end, con valutazione della qualità tramite LLM-as-a-Judge.

Guardate Sentinel testare un agente reale.

Eseguiremo uno scenario dal vivo end-to-end e vi mostreremo la traccia.