Costruire un agente
Ogni parte del costruttore, a cosa serve e quali parti puoi tranquillamente ignorare.
Agenti nella barra laterale, poi Crea agente. Il costruttore è una lunga pagina unica con accanto un pannello Test, così puoi provare l'agente mentre lo costruisci.
Oppure chiedilo semplicemente in una chat. Descrivi l'agente che vuoi («crea un agente che controlla le notizie ogni mattina alle 7 e mi scrive un riassunto») e Asteria ne prepara la bozza. Vedrai una scheda con il nome, le istruzioni, gli strumenti e la pianificazione con la prossima esecuzione, e nulla viene creato finché non approvi quella scheda. Quello che ottieni è un agente normale: puoi aprirlo poi in questo costruttore e modificarlo come qualsiasi altro.
Alla maggior parte degli agenti servono tre cose: un nome, delle istruzioni e forse una raccolta. Tutto il resto c'è quando ti serve.
Nome e descrizione
Il nome è quello che tu e i tuoi colleghi digitate dopo @, quindi tienilo corto e specifico. Controllo Tono di Voce batte Assistente Marketing v2.
La descrizione dice cosa fa. I colleghi la vedono sulla scheda dell'agente, quindi scrivila per loro e non per te.
Sotto il nome vedrai un identificatore tipo brand-voice-check-a1b2c. È l'identificativo permanente dell'agente, usato dall'API. Non cambia quando rinomini l'agente.
Istruzioni
Il riquadro più importante della pagina, e quello su cui le persone investono meno. Fino a 5000 caratteri.
Scrivilo come un incarico per un nuovo collega competente. Copri:
Chi è e chi serve. "Controlli i testi di marketing per una fintech B2B che vende a direttori finanziari."
Com'è fatto un buon risultato. "Sicuro, semplice, specifico. Frasi corte. Niente superlativi."
Cosa evitare, concretamente. "Non usare mai: rivoluzionario, senza soluzione di continuità, che cambia le regole del gioco, sbloccare. Non promettere mai risultati che non possiamo documentare."
Cosa fare quando non è sicuro. È quello che tutti dimenticano e vale più di tutto il resto. "Se l'affermazione è fattuale e non riesci a verificarla dalla raccolta, segnalala invece di riscriverla."
La forma della risposta. "Rispondi prima con il testo corretto, poi con un breve elenco di cosa hai cambiato e perché."
Istruzioni vaghe producono agenti vaghi. "Sii utile e professionale" non gli dice niente che non stesse già facendo.
Strumenti
Cosa all'agente è permesso fare. Aggiungi strumento apre un catalogo raggruppato per origine:
Le funzionalità integrate, offerte come pacchetti:
- Ricerca web: cercare su internet e recuperare il contenuto di un URL
- Sandbox: eseguire codice, calcolare sui dati, produrre grafici e file
- Documenti: creare e modificare documenti, presentazioni e fogli di calcolo, con cronologia delle versioni
- Diagrammi: disegnare e modificare diagrammi di flusso e viste di architettura
I servizi collegati, se la tua organizzazione li ha abilitati e tu hai collegato il tuo account: Gmail, Google Calendar, Drive, Docs, Sheets, Slides.
Alcuni strumenti ne tirano dentro altri da cui dipendono, e il catalogo te lo dice ("Abilita anche…"). Uno strumento aggiunto in quel modo è contrassegnato così sai perché è lì.
Dai a un agente gli strumenti che il suo lavoro richiede e non uno di più. Un agente che può inviare email, prima o poi, invierà email. Conta soprattutto per gli agenti che condividi o che metti su una programmazione, dove nessuno guarda ogni esecuzione.
Puoi anche sovrascrivere la descrizione di uno strumento per dire a questo agente quando usarlo. Lascia stare, a meno che uno strumento non venga usato nel momento sbagliato.
Conoscenza
Due meccanismi diversi, e la differenza conta.
Raccolte fissate
Raccolte in cui l'agente cerca sempre, senza che nessuno le nomini. È questo il guadagno: in una chat normale devi nominare la raccolta, e un agente con raccolte fissate no.
Fissa le raccolte che il lavoro richiede sempre. Per un grande corpo di documenti, è questo lo strumento giusto.
File caricati
File il cui contenuto viene messo direttamente nel contesto dell'agente, a ogni singolo turno. Non cercati: presenti.
Usalo per materiale di riferimento corto e sempre pertinente: una guida di stile di una pagina, un glossario, un albero decisionale. C'è un budget di token che vedi mentre aggiungi i file, e un limite di 10 MB ciascuno.
La regola pratica: una manciata di pagine, fissale come file. Un mucchio di documenti, mettili in una raccolta. L'app te lo dice quando ti avvicini al limite, perché i file mangiano contesto che sarebbe potuto servire alla tua vera domanda.
Competenze
Procedure che l'agente può caricare quando sono pertinenti, invece di portarsele dietro nelle istruzioni tutto il tempo. Vedi Competenze.
Allega quelle che il lavoro di questo agente richiede. Non costano niente finché non vengono usate.
Sotto-agenti
Altri agenti a cui questo può passare del lavoro, fino a dieci. Ciascuno riceve un suggerimento di delega che dice al genitore quando usarlo.
Delega all'Analista Dati quando la domanda richiede cifre calcolate da un foglio di calcolo.
Ci sono due forme che vale la pena conoscere, e si adattano a problemi di dimensioni diverse.
Un agente che ogni tanto passa la palla
Il tuo agente fa il proprio lavoro e delega un passaggio specializzato. L'agente del tono di voce che passa una domanda sui dati a un analista.
Vacci quando un lavoro è per lo più una cosa sola con una deviazione occasionale.
Un orchestratore con una squadra dietro
Per un lavoro davvero complesso, costruiscilo come lo organizzeresti con delle persone. Diversi agenti specialisti, ciascuno stretto e bravo in una cosa sola, con solo gli strumenti e le raccolte che quella cosa richiede. Poi un agente orchestratore che è il tuo punto di ingresso nella chat, le cui istruzioni riguardano soprattutto quale specialista chiamare e quando.
Per un report mensile sui concorrenti, potrebbe essere:
- Ricercatore di Mercato: solo ricerca web. Trova e riassume quello che hanno pubblicato i concorrenti.
- Analista Dati: sandbox e la raccolta delle metriche. Calcola i nostri numeri.
- Redattore del Report: gli strumenti per i documenti e la raccolta di marca. Trasforma i risultati nel documento finale.
- Report Concorrenti (l'orchestratore): praticamente nessuno strumento proprio. Conosce la sequenza, chiama ogni specialista e assembla il risultato.
Tu parli solo ed esclusivamente con l'orchestratore.
I motivi per cui questo batte un unico agente grande:
Ogni specialista ha un incarico corto e affilato. Un unico agente che copre tutti e tre i lavori ha bisogno di istruzioni così lunghe che le regole importanti cominciano a perdersi.
Gli strumenti restano circoscritti. Il ricercatore non può scrivere documenti e il redattore non può navigare sul web, quindi nessuno dei due va a finire in un lavoro che non è il suo.
Puoi sistemare una parte senza toccare il resto. Il redattore che produce prosa noiosa è una modifica a un solo incarico.
Gli specialisti sono riutilizzabili. L'Analista Dati può stare sotto tre orchestratori diversi.
Il costo è reale: ogni passaggio aggiunge tempo e denaro, e un suggerimento di delega scritto male fa sì che l'orchestratore chiami lo specialista sbagliato o si faccia il lavoro da solo. Quindi scrivi i suggerimenti come regole decisionali, non come descrizioni:
Delega al Ricercatore di Mercato tutto ciò che richiede informazioni aggiornate dall'esterno dell'azienda. Non provare a rispondere a memoria.
Delega al Redattore del Report solo quando i risultati sono definiti. Non chiedergli mai di raccogliere niente.
Quando non farlo
La maggior parte degli agenti non dovrebbe avere sotto-agenti per niente. Un agente con un buon incarico batte un comitato, e se non riesci a dire in una frase perché un passaggio ha bisogno di un agente proprio, non ne ha bisogno.
Trigger
Una programmazione, così l'agente gira senza nessuno che guardi. Aggiungi trigger, poi scegli una frequenza:
Ogni giorno, Ogni giorno feriale, Ogni settimana, Ogni mese, oppure Personalizzato (cron) per tutto il resto. Imposta l'orario e il tuo fuso orario.
Ogni trigger mostra la sua ultima esecuzione e la prossima, e può essere spento senza essere eliminato.
L'output va al thread Esegui output dell'agente, raggiungibile dalla barra laterale. È in sola lettura, ma puoi selezionare qualsiasi testo e portarlo in una chat normale.
Un'esecuzione programmata non ha nessuno a cui chiedere. Usa i tuoi account collegati, quindi un trigger su un agente che può inviare email la invia a nome tuo. Sii deliberato su quali strumenti tiene un agente programmato.
Modello predefinito e temperatura
Modello predefinito si applica alle esecuzioni programmate. Lascialo vuoto e userà il tuo predefinito.
Temperatura sovrascrive quanto sono variate le risposte, ed è spenta per impostazione predefinita (eredita la tua preferenza personale). Abbassala per qualsiasi cosa fattuale e ripetitiva, alzala per il brainstorming. Alla maggior parte degli agenti non serve mai.
Suggerimenti
Domande di partenza mostrate quando qualcuno apre una chat con questo agente. Servono puramente agli esseri umani, e sono sproporzionatamente utili su un agente condiviso: insegnano a un collega a cosa serve l'agente nei due secondi prima che scriva qualcosa di vago.
Stato e zona pericolosa
Stato mette l'agente su Attivo o Inattivo. Inattivo conserva tutto ma lo toglie dalla circolazione, che è il modo reversibile di mandare in pensione qualcosa.
Elimina agente è definitivo.
Testare man mano
Il pannello Test sulla destra parla con l'agente con la sua configurazione attuale, comprese le modifiche non salvate alle istruzioni. Salva prima, poi testa, poi aggiusta.
Testa i casi scomodi, non quello facile. Dagli qualcosa fuori dalla sua competenza e guarda se rifiuta con criterio. Dagli qualcosa di ambiguo e guarda se chiede o tira a indovinare. È lì che si vede un incarico debole.
Utilizzo
Una volta che un agente è in uso, la sua sezione Utilizzo mostra quanto spesso viene invocato, da quante persone e quando è stato usato l'ultima volta. Utile per decidere se un agente condiviso ha attecchito oppure è morto in silenzio.