CONSULENZA E IMPLEMENTAZIONE

Agenti AI aziendali con un compito preciso e limiti espliciti.

Un agente AI può consultare informazioni e usare strumenti per completare un’attività. Stolen Orbit progetta questi flussi intorno a obiettivi circoscritti, accessi limitati e punti di approvazione: il team deve poter capire, verificare e interrompere ciò che accade.

Parliamo del tuo processo

Che differenza c’è tra chatbot, workflow e agente AI?

Usiamo questa distinzione per progettare il lavoro, senza presumere che maggiore autonomia produca un risultato migliore. Se un flusso deterministico copre il bisogno, non serve aggiungere un agente.

Una distinzione pratica per scegliere il progetto
ApproccioQuando valutarlo
Chatbot o assistenteServe una conversazione o una proposta di testo; la persona decide ed esegue i passaggi successivi.
Workflow con regoleLa sequenza è conosciuta e le condizioni possono essere scritte in anticipo. L’AI può intervenire in un singolo passaggio.
Agente AIIl prossimo passo dipende dalle informazioni raccolte e il sistema deve scegliere tra strumenti e azioni autorizzati. Servono verifiche anche sul percorso, non solo sulla risposta.

Un esempio: preparare una risposta di assistenza.

  1. Leggere una richiesta e identificarne il contesto

    L’agente riceve una richiesta nel perimetro concordato e individua i dati che servono. Se mancano elementi essenziali, prepara una domanda o passa il caso a una persona.

  2. Consultare solo fonti autorizzate

    Può cercare in documenti approvati e leggere uno stato ordine se il richiedente e gli accessi sono stati verificati. Non deve accedere a tutti i dati solo perché tecnicamente disponibili.

  3. Preparare una proposta verificabile

    La bozza include i riferimenti utili alla revisione. Informazioni contraddittorie o non disponibili restano esplicite; non diventano una risposta inventata.

  4. Attendere l’approvazione prevista

    Nel primo pilota una persona verifica la proposta prima dell’invio. Rimborsi, modifiche d’ordine e impegni commerciali restano fuori perimetro salvo un progetto specifico.

Questo è un esempio progettuale. Non descrive risultati di un cliente né garantisce l’affidabilità di un agente su qualsiasi richiesta.

I controlli fanno parte del prodotto.

OWASP descrive la prompt injection come un rischio per i sistemi LLM: istruzioni inserite in contenuti esterni possono alterarne il comportamento. Per questo email, pagine e documenti consultati vanno trattati come dati non affidabili, non come autorizzazioni ad agire.

  • Elenco degli strumenti e delle azioni consentite; separazione tra consultazione e modifica.
  • Limiti a numero di passaggi, tempo di esecuzione e costo; interruzione quando il limite viene raggiunto.
  • Conferma umana per le azioni definite nel progetto e percorso di ritorno alla gestione manuale.
  • Traccia delle fonti e delle azioni, con contenuti conservati secondo la politica concordata.
  • Verifica degli input e degli output degli strumenti, compresi casi inattesi e tentativi di istruzioni malevole.

Valutare il risultato e il percorso seguito.

Il test deve comprendere richieste ordinarie, ambigue, fuori perimetro e contenuti che tentano di cambiare le istruzioni. Controlliamo qualità dell’output, correttezza delle azioni, accessi utilizzati, escalation e tempo necessario a una persona per verificare il lavoro.

Il primo pilota usa un insieme ristretto di fonti e strumenti. Concordiamo in anticipo quali errori bloccano l’avvio e quali richiedono correzione. Un aggiornamento di modello, strumenti o documenti può richiedere di ripetere la valutazione.

Quando un agente è una complessità evitabile.

Non lo proponiamo per trasferire un campo tra due sistemi, applicare una formula o seguire una sequenza già definita. Se non è possibile limitare gli accessi, verificare le azioni o assegnare un responsabile, è preferibile ridurre l’autonomia o fermarsi a un assistente che produce bozze.

DALLE IDEE A UN BRIEF

Un modello su cui lavorare.

Brief per il primo progetto AI

Modello Markdown da compilare: processo, dati, responsabili e criteri per proseguire o fermarsi.

Scarica il modello Markdown

Domande pratiche

Un agente AI può lavorare senza supervisione?

L’autonomia va decisa per singola azione e dopo una valutazione. Un primo progetto può restare in sola lettura o produrre bozze. Azioni con effetti su clienti, dati o denaro richiedono controlli proporzionati e un responsabile esplicito.

Può usare i nostri documenti interni?

Possiamo valutare una ricerca su fonti approvate, verificando aggiornamento, permessi e qualità. Recuperare un documento non garantisce che la risposta sia corretta: servono riferimenti consultabili e test su domande reali.

Come si evita che l’agente faccia troppe chiamate o continui all’infinito?

Si definiscono limiti di passaggi, durata e budget, condizioni di arresto e avvisi. I limiti vanno applicati dal sistema che esegue gli strumenti, non affidati soltanto alle istruzioni testuali del modello.

Qual è il primo processo da migliorare?

Porta un’attività concreta, gli strumenti che usate e il punto in cui il lavoro si blocca. Definiamo cosa serve per valutare un primo progetto.

Parliamo del tuo processo