Einen Agenten bauen
Jeder Teil des Baukastens, wofür er da ist und welche Teile Sie getrost ignorieren können.
Agenten in der Seitenleiste, dann Agent erstellen. Der Baukasten ist eine lange Seite mit einem Bereich Testen daneben, damit Sie den Agenten ausprobieren können, während Sie ihn bauen.
Oder fragen Sie einfach im Chat. Beschreiben Sie den Agenten, den Sie möchten („Erstelle einen Agenten, der jeden Morgen um 7 Uhr die Nachrichten prüft und mir eine Zusammenfassung schreibt“), und Asteria entwirft ihn für Sie. Sie sehen eine Karte mit Name, Anweisungen, Werkzeugen und Zeitplan samt nächster Ausführung, und nichts wird erstellt, bevor Sie diese Karte bestätigen. Sie bekommen einen ganz normalen Agenten: Sie können ihn danach in diesem Baukasten öffnen und wie jeden anderen ändern.
Die meisten Agenten brauchen drei Dinge: einen Namen, Anweisungen und vielleicht eine Sammlung. Alles andere ist da, wenn Sie es brauchen.
Name und Beschreibung
Der Name ist das, was Sie und Ihre Kolleginnen nach @ tippen. Halten Sie ihn also kurz und konkret. Brand Voice Check schlägt Marketing Assistant v2.
Die Beschreibung sagt, was er tut. Kolleginnen und Kollegen sehen sie auf der Agentenkarte. Schreiben Sie sie also für die anderen und nicht für sich selbst.
Unter dem Namen sehen Sie eine Kennung wie brand-voice-check-a1b2c. Das ist das dauerhafte Kürzel des Agenten, das die API verwendet. Es ändert sich nicht, wenn Sie den Agenten umbenennen.
Anweisungen
Das wichtigste Feld auf der Seite und das, in das die Leute am wenigsten Mühe stecken. Bis zu 5000 Zeichen.
Schreiben Sie es wie ein Briefing für eine fähige neue Kollegin. Behandeln Sie:
Wer er ist und wem er dient. "Du prüfst Marketingtexte für ein B2B-Fintech, das an Finanzleitungen verkauft."
Wie gut aussieht. "Selbstbewusst, schlicht, konkret. Kurze Sätze. Keine Superlative."
Was zu vermeiden ist, ganz konkret. "Verwende nie: revolutionär, nahtlos, bahnbrechend, freisetzen. Versprich nie Ergebnisse, die wir nicht belegen können."
Was zu tun ist, wenn er unsicher ist. Das ist der Punkt, den alle vergessen, und er ist mehr wert als der ganze Rest. "Wenn eine Aussage eine Tatsachenbehauptung ist und du sie nicht aus der Sammlung belegen kannst, markiere sie, statt sie umzuschreiben."
Die Form der Antwort. "Antworte zuerst mit dem korrigierten Text, danach mit einer kurzen Liste dessen, was du geändert hast und warum."
Vage Anweisungen ergeben vage Agenten. "Sei hilfsbereit und professionell" sagt ihm nichts, was er nicht ohnehin schon tat.
Werkzeuge
Was der Agent tun darf. Werkzeug hinzufügen öffnet einen Katalog, nach Quelle gruppiert:
Integrierte Funktionen, als Pakete angeboten:
- Websuche: im Internet suchen und den Inhalt einer URL abrufen
- Sandbox: Code ausführen, über Daten rechnen, Diagramme und Dateien erzeugen
- Dokumente: Dokumente, Präsentationen und Tabellen erstellen und bearbeiten, mit Versionsverlauf
- Diagramme: Flussdiagramme und Architekturansichten zeichnen und bearbeiten
Verbundene Dienste, sofern Ihre Organisation sie freigeschaltet hat und Sie Ihr Konto verknüpft haben: Gmail, Google Kalender, Drive, Docs, Sheets, Slides.
Manche Werkzeuge ziehen andere nach sich, von denen sie abhängen, und der Katalog sagt es Ihnen ("Aktiviert außerdem …"). Ein so hinzugefügtes Werkzeug ist markiert, damit Sie wissen, warum es da ist.
Sie können außerdem die Beschreibung eines Werkzeugs überschreiben, um diesem Agenten zu sagen, wann er es einsetzen soll. Lassen Sie das in Ruhe, solange ein Werkzeug nicht zum falschen Zeitpunkt verwendet wird.
Wissen
Zwei verschiedene Mechanismen, und der Unterschied zählt.
Angeheftete Sammlungen
Sammlungen, die der Agent immer durchsucht, ohne dass jemand sie nennt. Das ist der Gewinn: In einem gewöhnlichen Chat müssen Sie die Sammlung nennen, ein Agent mit angehefteten Sammlungen nicht.
Heften Sie die Sammlungen an, die die Aufgabe immer braucht. Für eine große Menge Dokumente ist das das richtige Mittel.
Hochgeladene Dateien
Dateien, deren Inhalt direkt in den Kontext des Agenten gelegt wird, bei jedem einzelnen Zug. Nicht durchsucht, sondern präsent.
Nutzen Sie das für kurzes, immer relevantes Referenzmaterial: einen einseitigen Styleguide, ein Glossar, einen Entscheidungsbaum. Beim Hinzufügen von Dateien sehen Sie ein Token-Budget, und pro Datei gilt eine Grenze von 10 MB.
Die Faustregel: Eine Handvoll Seiten heften Sie als Dateien an. Einen Stapel Dokumente stecken Sie in eine Sammlung. Die App sagt genau das, wenn Sie an die Grenze kommen, denn Dateien fressen Kontext, der für Ihre eigentliche Frage da sein könnte.
Skills
Verfahren, die der Agent laden kann, wenn sie relevant sind, statt sie ständig in seinen Anweisungen mitzuschleppen. Siehe Skills.
Hängen Sie die an, die zur Aufgabe dieses Agenten gehören. Sie kosten nichts, solange sie nicht genutzt werden.
Sub-Agenten
Andere Agenten, an die dieser Arbeit abgeben kann, bis zu zehn. Jeder bekommt einen Delegierungshinweis, der dem Eltern-Agenten sagt, wann er ihn einsetzen soll.
Delegiere an Data Analyst, wenn die Frage Zahlen braucht, die aus einer Tabelle berechnet werden.
Es gibt zwei Bauformen, die man kennen sollte, und sie passen zu unterschiedlich großen Problemen.
Ein Agent, der gelegentlich abgibt
Ihr Agent erledigt seine eigene Aufgabe und delegiert einen spezialisierten Schritt. Der Markensprache-Agent, der eine Datenfrage an eine Analystin weitergibt.
Greifen Sie dazu, wenn eine Aufgabe überwiegend aus einer Sache besteht, mit gelegentlichem Abstecher.
Ein Orchestrator mit einem Team dahinter
Bauen Sie eine wirklich komplexe Aufgabe so, wie Sie sie personell besetzen würden. Mehrere Spezialagenten, jeder eng zugeschnitten und in einer Sache gut, jeweils nur mit den Werkzeugen und Sammlungen, die diese Sache braucht. Dazu ein Orchestrator-Agent, der Ihr Einstiegspunkt im Chat ist und dessen Anweisungen vor allem davon handeln, welchen Spezialisten er wann ruft.
Für einen monatlichen Wettbewerbsbericht könnte das so aussehen:
- Market Researcher: nur Websuche. Findet und fasst zusammen, was Wettbewerber veröffentlicht haben.
- Data Analyst: Sandbox und die Kennzahlen-Sammlung. Berechnet unsere Zahlen.
- Report Writer: die Dokumenten-Werkzeuge und die Marken-Sammlung. Macht aus den Erkenntnissen das fertige Ergebnis.
- Competitor Report (der Orchestrator): praktisch keine eigenen Werkzeuge. Er kennt die Reihenfolge, ruft jeden Spezialisten und setzt das Ergebnis zusammen.
Sie sprechen immer nur mit dem Orchestrator.
Warum das einen großen Einzelagenten schlägt:
Jeder Spezialist hat ein kurzes, scharfes Briefing. Ein einzelner Agent, der alle drei Aufgaben abdeckt, braucht Anweisungen, die so lang sind, dass die wichtigen Regeln darin untergehen.
Werkzeuge bleiben eng gefasst. Die Rechercheurin kann keine Dokumente schreiben und der Autor nicht im Web surfen, also verirrt sich keiner in fremde Arbeit.
Sie können einen Teil reparieren, ohne den Rest anzufassen. Wenn der Autor blasse Texte schreibt, ist das eine Änderung an genau einem Briefing.
Die Spezialisten sind wiederverwendbar. Data Analyst kann unter drei verschiedenen Orchestratoren sitzen.
Der Preis ist real: Jeder Sprung kostet Zeit und Geld, und ein schlecht geschriebener Delegierungshinweis führt dazu, dass der Orchestrator den falschen Spezialisten ruft oder die Arbeit selbst macht. Schreiben Sie die Hinweise also als Entscheidungsregeln, nicht als Beschreibungen:
Delegiere an Market Researcher alles, was aktuelle Informationen von außerhalb des Unternehmens braucht. Versuche nicht, aus dem Gedächtnis zu antworten.
Delegiere an Report Writer erst, wenn die Erkenntnisse feststehen. Bitte ihn nie, etwas zu recherchieren.
Wann lieber nicht
Die meisten Agenten sollten überhaupt keine Sub-Agenten haben. Ein gut gebriefter Agent schlägt ein Komitee, und wenn Sie nicht in einem Satz sagen können, warum ein Schritt einen eigenen Agenten braucht, dann braucht er keinen.
Auslöser
Ein Zeitplan, damit der Agent läuft, ohne dass jemand zusieht. Auslöser hinzufügen, dann eine Frequenz wählen:
Täglich, Werktags, Wöchentlich, Monatlich oder Benutzerdefiniert (Cron) für alles andere. Stellen Sie Uhrzeit und Zeitzone ein.
Jeder Auslöser zeigt seine letzte und seine nächste Ausführung und lässt sich abschalten, ohne ihn zu löschen.
Die Ausgabe landet im Thread Trigger-Ausgabe des Agenten, erreichbar über die Seitenleiste. Er ist schreibgeschützt, aber Sie können jeden Text markieren und in einen normalen Chat weiterreichen.
Ein geplanter Lauf hat niemanden, den er fragen kann. Er nutzt Ihre verbundenen Konten. Ein Auslöser auf einem Agenten, der E-Mails senden kann, sendet sie also in Ihrem Namen. Überlegen Sie genau, welche Werkzeuge ein geplanter Agent hält.
Standardmodell und Temperatur
Standardmodell gilt für geplante Ausführungen. Lassen Sie es leer, dann wird Ihr Standard verwendet.
Temperatur überschreibt, wie unterschiedlich die Antworten ausfallen, und ist standardmäßig aus (der Agent erbt Ihre persönliche Einstellung). Drehen Sie sie herunter für alles Sachliche und Wiederkehrende, herauf fürs Brainstorming. Die meisten Agenten brauchen sie nie.
Vorgeschlagene Fragen
Einstiegsfragen, die jemandem angezeigt werden, der einen Chat mit diesem Agenten öffnet. Rein für die Menschen gedacht und bei einem geteilten Agenten überproportional nützlich: Sie zeigen einer Kollegin in den zwei Sekunden, bevor sie etwas Vages tippt, wofür der Agent da ist.
Status und die Gefahrenzone
Status schaltet den Agenten auf Aktiv oder Inaktiv. Inaktiv behält alles, nimmt ihn aber aus dem Verkehr. Das ist der umkehrbare Weg, etwas außer Dienst zu stellen.
Agent löschen ist endgültig.
Testen, während Sie bauen
Der Bereich Testen auf der rechten Seite spricht mit dem Agenten in seiner aktuellen Konfiguration, einschließlich ungespeicherter Änderungen an den Anweisungen. Erst speichern, dann testen, dann anpassen.
Testen Sie die unangenehmen Fälle, nicht den einfachen. Geben Sie ihm etwas außerhalb seines Auftrags und sehen Sie, ob er vernünftig ablehnt. Geben Sie ihm etwas Mehrdeutiges und sehen Sie, ob er nachfragt oder rät. Genau da zeigt sich ein schwaches Briefing.
Nutzung
Sobald ein Agent im Einsatz ist, zeigt sein Bereich Nutzung, wie oft er aufgerufen wird, von wie vielen Personen und wann er zuletzt benutzt wurde. Nützlich, um zu entscheiden, ob ein geteilter Agent angekommen oder still gestorben ist.