botts.aiDocs

Test

Salva le conversazioni come test, descrivi cosa deve fare una buona risposta ed esegui ogni test con la configurazione attuale del tuo agente, per vedere cosa ha cambiato davvero una modifica a prompt, modello o strumenti.

I test ti permettono di verificare in un colpo solo come si comporta un agente in una serie di scenari, prima che i clienti vedano una modifica. Un test salvato è una conversazione che termina con un messaggio del cliente, più un'aspettativa: una descrizione in parole semplici di cosa deve fare una buona risposta successiva. Esegui tutti riproduce ogni test salvato con l'agente così com'è configurato in questo momento e valuta ogni risposta.

I test si trovano nella pagina dell'agente, nel gruppo Test della navigazione dell'agente: Test, Previsioni e Cronologia. Su uno schermo largo il gruppo all'inizio è chiuso: clicca sul titolo del gruppo Test per aprirlo, e la pagina ricorda la tua scelta.

Chi può usarli

I test seguono i permessi dell'agente. I ruoli Builder, Admin e Proprietario possono creare ed eseguire test; il ruolo Membro, limitato alla chat, non può aprire le pagine degli agenti. I test salvati sono condivisi con tutte le persone che possono vedere l'agente.

Test salvati

Un test salvato è composto da:

  • Conversazione: da 1 a 100 messaggi del cliente e dell'agente, che iniziano e finiscono con un messaggio del cliente. L'ultimo messaggio è quello a cui l'agente deve rispondere. I messaggi precedenti servono solo da contesto e non vengono mai valutati.
  • Aspettativa (obbligatoria): cosa deve fare una buona risposta, fino a 8'000 caratteri. Vedi Scrivere le aspettative.
  • Tag (facoltativi): fino a 20 etichette brevi per filtrare, come hours o returns.

Ogni agente può avere al massimo 200 test salvati. Non c'è un titolo: l'elenco mostra il messaggio del cliente che viene testato.

Primi passi

Finché un agente non ha il suo primo test, Test mostra una breve introduzione con il pulsante Configura. Il pulsante apre una guida in cinque passaggi: scegli la piattaforma, il modello e gli strumenti che un'esecuzione può usare, scrivi un primo test (un messaggio del cliente e cosa deve fare la risposta; Più tardi salta questo passaggio) e, quando un test è salvato, concludi con Esegui tutti. Queste scelte sono le stesse impostazioni del blocco Esegui tutti i test e vengono ricordate nel tuo browser. Quando ci sono dei test, il pulsante di aiuto nel blocco Esegui tutti i test (Guida alla configurazione) riapre la guida.

Tre modi per creare un test

1

Scrivilo tu

In Test clicca su Aggiungi test, scrivi il messaggio del cliente e, se ti serve contesto, usa Aggiungi messaggi precedenti per inserire prima un turno del cliente e uno dell'agente. La × accanto a uno scambio rimuove di nuovo entrambi i turni, così la conversazione continua ad alternarsi. (Aggiungi test compare quando l'agente ha almeno un test; per il primo usa il pulsante Configura dell'introduzione o salva una risposta.)

2

Salva una risposta dalla chat di prova

Sotto qualsiasi risposta dell'agente nel pannello Testa l'agente in Configura (vedi Testa l'agente), clicca su Salva come test. La conversazione fino a quel messaggio del cliente diventa il test, e la risposta originale viene conservata solo come riferimento.

3

Salva una conversazione reale con un cliente

In Chat, ogni risposta dell'agente ha lo stesso comando Salva come test. Viene copiato il ramo della conversazione che ha portato alla risposta; la risposta originale e l'eventuale pollice in su o in giù di chi ha visitato il sito vengono mostrati come riferimento. Una conversazione con allegati, o che inizia con un saluto dell'agente, non può essere importata così com'è: scrivine invece una versione solo testo che inizi con un messaggio del cliente.

L'editor può prepararti una bozza di aspettativa e di tag (Suggerisci un'aspettativa, Auto). Entrambe le funzioni chiamano un modello e costano crediti, ed entrambe producono bozze che puoi modificare prima di salvare. Quando apri l'editor da Salva come test, prepara automaticamente una bozza dell'aspettativa (fatturata allo stesso modo); se non è possibile, il campo resta vuoto e lo compili tu. Ogni risposta può essere salvata una sola volta. Dopo, il comando diventa Salvato come test e porta a Test. Le conversazioni usate per i test sono contrassegnate in Chat (per esempio «2 test») e nella panoramica delle conversazioni (un'icona a forma di beuta con il numero).

Scrivere le aspettative

L'aspettativa viene inviata solo al valutatore, mai all'agente, quindi non cambia il modo in cui l'agente risponde. Funziona meglio sotto forma di pochi requisiti concreti:

Tipo di requisitoEsempioCome viene verificato
Fatti«Di' che il sabato pomeriggio siamo chiusi: il sabato siamo aperti dalle 7:00 alle 13:00.»Solo rispetto al fatto che fornisci. «Indica gli orari di apertura corretti» non si può verificare, perché il valutatore non ha nessun'altra fonte attendibile, e il risultato è Non valutabile.
Comportamento e tono«Sii cortese. Rispondi nella lingua del cliente. Offri di confermare per telefono.»Dal valutatore, sulla base della risposta.
Lunghezza«Mantieni la risposta sotto i 300 caratteri.»Un semplice limite di caratteri sull'intera risposta, come questo, viene contato con precisione. I limiti circoscritti («ogni frase sotto i 100 caratteri»), condizionati («se il cliente lo chiede») o trasformati in un giudizio («sotto i 100 caratteri è troppo corta») sono lasciati al valutatore, che vede il numero esatto di caratteri.

Includi i fatti di riferimento

Il valutatore non conosce la tua attività. Se un test riguarda un fatto, inserisci il fatto nell'aspettativa. «Consiglia il Prodotto A» verifica che il Prodotto A venga consigliato; non può verificare caratteristiche del Prodotto A che non hai indicato.

Eseguire i test

Il blocco Esegui tutti i test in Test (visibile quando l'agente ha almeno un test salvato) stabilisce come funziona l'esecuzione:

  • Piattaforma: Sito web o Chat interna. Determina gli strumenti e il comportamento che l'agente avrebbe su quel canale. Entrambe sono disponibili su ogni piano a pagamento, perché un test non crea alcun deployment.
  • Modello: qualsiasi modello di testo che la tua organizzazione può usare. In un nuovo browser si parte dal modello e dalla piattaforma del primo deployment dell'agente.
  • Strumenti: un interruttore per ogni strumento. La ricerca nella conoscenza, la navigazione avanzata della base di conoscenza e la ricerca web sono attive per impostazione predefinita, se l'agente le ha. Le connessioni e gli altri strumenti di azione sono disattivati per impostazione predefinita e contrassegnati con Può eseguire azioni reali: se ne attivi uno, un test lo chiama davvero. Le connessioni che richiedono un login personale e gli strumenti che richiedono uno spazio di lavoro di chat attivo (esecuzione di codice, attività pianificate) non sono disponibili nei test.

Queste impostazioni vengono ricordate nel tuo browser, per ogni agente. Non modificano mai l'agente stesso.

Ogni test viene eseguito con la configurazione salvata attuale dell'agente: prompt, basi di conoscenza, strumenti e moduli così come sono in quel momento, solo con le connessioni dell'organizzazione. Non entrano in gioco né memorie dei clienti né l'identità di un membro, quindi un'esecuzione è uguale per chiunque la avvii.

Clicca su Esegui tutti per eseguire tutti i test salvati, anche quando l'elenco è filtrato. Per ogni agente può essere attiva una sola esecuzione alla volta. Puoi lasciare la pagina o ricaricarla: l'esecuzione continua e l'avanzamento viene mostrato in Cronologia. Interrompi dopo i test attuali annulla i test non ancora avviati e lascia terminare quelli in corso.

Per provare un singolo test, aprilo e clicca su Prova questo test. Un'anteprima usa le stesse impostazioni, mostra la risposta e la sua valutazione nella finestra di dialogo e non aggiunge nessuna voce alla cronologia.

Moduli nei test

Quando per un test è attivo Raccogli modulo (lo strumento Modulo / Cattura Lead dell'agente), l'agente può compilare e inviare il modulo come farebbe con un cliente, e la risposta viene valutata su questa base. L'invio in sé non viene salvato e non parte nessuna e-mail di notifica, quindi le esecuzioni dei test non creano mai lead.

Leggere i risultati

Ogni test termina con uno di questi esiti:

EsitoSignificato
SuperatoTutti i requisiti dell'aspettativa sono stati soddisfatti.
Non superatoAlmeno un requisito non è stato soddisfatto.
Non valutabileLa risposta è stata generata, ma almeno un requisito non ha potuto essere valutato (di solito un fatto senza riferimento nell'aspettativa) e nessun requisito è fallito, oppure non è stato possibile eseguire la valutazione stessa (per esempio perché i crediti sono finiti dopo la risposta). La motivazione indica quale dei due casi.
Errore di esecuzioneNon è stata generata nessuna risposta: il test è stato interrotto o ha superato il tempo massimo, l'agente ha restituito una risposta vuota, la conversazione è troppo lunga per il modello selezionato, i crediti sono finiti oppure non è stato possibile caricare l'agente.
Non eseguitoIl test non è mai partito, perché è stato usato Interrompi dopo i test attuali oppure l'esecuzione si è fermata quando i crediti sono finiti.

Apri un risultato per vedere la conversazione, l'aspettativa, la risposta generata e la valutazione per requisito, ciascuna con una breve motivazione. Il risultato registra anche la piattaforma, il modello e gli interruttori degli strumenti che sono stati usati.

Superato, Non superato e Non valutabile sono una valutazione della risposta fatta dall'IA rispetto alla tua aspettativa. Se un verdetto ti sorprende, prendilo come uno spunto per rendere l'aspettativa più precisa, non come una verità assoluta.

Cronologia

Cronologia elenca una voce per ogni Esegui tutti, dalla più recente, con le impostazioni e il numero di test superati, non superati, non valutabili, con errori e non eseguiti. Apri un'esecuzione per vedere i risultati dei singoli test. Un'esecuzione conserva gli input e le aspettative dei test così com'erano al suo avvio, quindi modificare o eliminare un test salvato in seguito non riscrive la cronologia; la riga del test salvato mostra Test modificato quando il suo ultimo risultato non corrisponde più al contenuto attuale.

Previsioni

Previsioni suggerisce le domande che i tuoi clienti probabilmente faranno prossimamente, a partire dalle conversazioni recenti dell'agente nel widget del sito web (le chiamate telefoniche e le chat interne non vengono usate). Clicca su Prevedi chat future per ricevere fino a dieci bozze, ognuna con una conversazione, un'aspettativa e dei tag, tutte già selezionate. Espandi una bozza per modificare l'ultimo messaggio del cliente e l'aspettativa o rimuovere dei tag, deseleziona quelle che non vuoi e clicca su Salva test selezionati per aggiungerle a Test. La previsione chiama un modello e costa crediti; un agente senza conversazioni recenti nel widget del sito web non ha nulla da cui partire per le previsioni.

Quanto costa un test

L'esecuzione di un test viene fatturata come il normale utilizzo: la risposta dell'agente e la sua valutazione costano crediti ciascuna, indicati separatamente nel risultato. Le risposte dei test non contano come messaggi dei clienti. Gli strumenti che l'agente chiama durante un test (ricerca web, lettura di pagine, connessioni) vengono fatturati come in una chat.

Cosa non fanno i test

  • Non modificano l'agente. Non c'è nessuna riscrittura automatica del prompt, nessuna scelta automatica del modello e nessun pulsante «correggi».
  • Non salvano un'istantanea della configurazione. Due esecuzioni degli stessi test dopo una modifica del prompt confrontano il prompt vecchio con quello nuovo, ed è proprio questo lo scopo.
  • Non usano le memorie dei clienti né le connessioni personali di un membro.
  • Non annullano le azioni reali. Uno strumento di azione attivo agisce una volta per test, senza nuovi tentativi; se esegui di nuovo i test, agisce di nuovo.

Ultimo aggiornamento: 4 ottobre 2026