Zurück
Werkstatt

Unser eigener KI-Mitarbeiter. Wie wir ihn gebaut haben und wie Sie das nachbauen

Von Henrik Horn · · 7 Minuten

Ein aufgeschlagenes Notizbuch mit Registerkarten, eine davon in Amber, daneben eine Tischklingel aus Messing auf dunklem Holz

Was da eigentlich läuft

Kein Chatfenster, sondern ein Mitarbeiter mit Gedächtnis, Werkzeugen und eigenen Aufgaben. Wir nennen ihn Steve.

Steve läuft in einem Container auf einem kleinen gemieteten Server. Er ist über einen Messenger erreichbar, hat Zugriff auf unsere Werkzeuge und arbeitet nachts an Aufgaben, die ihm jemand gegeben hat. Die Grundlage ist Hermes Agent von Nous Research, ein quelloffener Agent unter MIT-Lizenz, den man selbst betreibt.

Der Unterschied zu einem Chatbot liegt in drei Dingen. Er erinnert sich an das, was letzte Woche besprochen wurde. Er kann Dinge tun, nicht nur antworten. Und er wird nicht nur von Menschen angestoßen, sondern auch von einem Zeitplan und von Ereignissen aus anderen Systemen.

Chatbot
  • Jedes Gespräch beginnt bei null
  • Antwortet, handelt aber nicht
  • Wartet, bis jemand tippt
  • Wissen steckt im Kopf des Fragenden
Agent mit Gedächtnis
  • Kennt Vorgeschichte, Projekte und Entscheidungen
  • Legt an, aktualisiert, schreibt weg
  • Läuft auch nach Zeitplan und auf Zuruf von Systemen
  • Wissen liegt als Dateien vor und wächst mit

Die vier Bausteine

Egal mit welchem Werkzeug Sie bauen, es sind immer dieselben vier Teile. Wer einen davon auslässt, bekommt wieder einen Chatbot.

  1. 1

    Das Gedächtnis

    Bei uns ist das ein Ordner voller Markdown-Dateien, eine Notiz je Kunde, Projekt oder Entscheidung. Keine Datenbank, kein Vektorspeicher. Der Agent liest und schreibt dieselben Dateien, die auch ein Mensch in seinem Notizprogramm öffnet. Das klingt altmodisch und ist der wichtigste Baustein, weil man jederzeit hineinschauen und korrigieren kann.

  2. 2

    Die Werkzeuge

    Der Agent braucht Zugriff auf die Systeme, in denen die Arbeit passiert. Bei uns sind das CRM, Buchhaltung, Kalender und die eigenen Workflows. Angebunden über offizielle Schnittstellen, bei der Buchhaltung über einen selbst gebauten MCP-Server. Lesend ist harmlos, schreibend braucht klare Grenzen.

  3. 3

    Der Kanal

    Eine Stelle, an der man ihn erreicht und an der er sich meldet. Bei uns ein Messenger auf dem Telefon. Das ist bewusst dort, wo man ohnehin hinschaut. Ein Agent, den man erst in einem Browser-Tab öffnen muss, wird nicht benutzt.

  4. 4

    Die Auslöser

    Zeitplan und Ereignisse. Ein Morgenbriefing läuft nach Uhrzeit. Andere Aufgaben starten, wenn ein anderes System sich meldet, etwa ein Workflow in n8n oder ein Monitoring. Erst damit arbeitet der Agent, ohne dass jemand daran denkt.

Reihenfolge

Gedächtnis zuerst, dann ein Kanal, dann ein einziges Werkzeug, dann der erste Zeitplan. Wer mit zehn Anbindungen anfängt, debuggt wochenlang und hat nichts im Betrieb.

Wie wir gebaut haben

Zwei Anläufe, ein halbes Jahr Abstand. Der erste war ein Prototyp, der zweite läuft.

Der erste Versuch hieß Frank. Ein Agent im Messenger, der Deals, Kunden und Kalender kannte und Morgenbriefings schickte. Er hat bewiesen, dass die Idee trägt, und gleichzeitig gezeigt, woran es hängt. Sein Gedächtnis steckte in der Anwendung selbst. Wollte man etwas korrigieren, musste man mit ihm reden statt eine Datei zu ändern.

Der zweite Versuch drehte das um. Das Wissen liegt außerhalb des Agenten, in Dateien, die Mensch und Agent gleichberechtigt bearbeiten. Der Ordner liegt auf dem Server, wird in beide Richtungen mit dem Rechner abgeglichen und stündlich in ein privates Git-Repository gesichert. Der Mensch schreibt im Notizprogramm, der Agent schreibt im Container, beide sehen dieselbe Datei wenige Sekunden später.

  1. 1

    Gedächtnis aufsetzen

    Ein Ordner mit einer Startseite, die auf alles Weitere verweist, dazu Konventionen für Notizen. Eine Notiz je Sache, Quelle und Datum an jeder Zahl, keine geratenen Werte. Diese Regeln stehen selbst im Ordner, damit der Agent sie liest.

  2. 2

    Agent installieren und andocken

    Hermes im Container auf dem Server, der Ordner als Datenverzeichnis eingebunden. Danach ein Messenger als Kanal und ein erster Test, ob der Agent Notizen findet und anlegt.

  3. 3

    Werkzeuge nacheinander

    Erst das CRM, dann Buchhaltung, dann der Rest. Nach jedem Werkzeug ein paar Tage im Alltag, bevor das nächste kommt. So merkt man, welche Berechtigung wirklich gebraucht wird.

  4. 4

    Aufgaben nach Zeitplan

    Ein Morgenbriefing, ein Wochenrückblick. Kurz halten und immer an derselben Stelle ausliefern. Was niemand liest, wird abgeschaltet statt verschönert.

  5. 5

    Ereignisse von außen

    Zuletzt die Anbindung, über die andere Systeme den Agenten anstoßen. Bei uns kommen darüber Meldungen aus n8n herein. Eine Route schickt den Inhalt als Auftrag an den Agenten, eine zweite leitet reine Benachrichtigungen ohne Agent weiter, damit sie nichts kosten.

Vier Fallen, in die wir getreten sind

Alle vier haben nichts mit KI zu tun. Es sind Betriebsfragen.

  • Dateirechte. Der Abgleich legte Dateien unter einem anderen Benutzer an als dem, unter dem der Agent läuft. Er sah sein eigenes Gedächtnis also und durfte nicht hineinschreiben. Geholfen hat ein kleiner Dienst, der die Rechte alle 30 Sekunden zurechtrückt, und die Notiz, dass die saubere Lösung noch aussteht.
  • Zugangsdaten im Wissensarchiv. Der Ordner wird gesichert und synchronisiert. Alles darin liegt damit an mehreren Orten. Geheimnisse gehören deshalb in eine Datei auf dem Server, die nicht mitgesichert wird, und in die Notiz nur der Hinweis, wo sie liegt.
  • Kosten ohne Bremse. Jeder Anstoß von außen kostet einen Modelllauf. Deshalb gibt es Wege, die ohne Agent auskommen, dazu ein Limit je Minute und eine Erkennung doppelter Meldungen. Bei der Sprachausgabe steht eine Regel daneben, wann sie sich lohnt und wann Text reicht.
  • Offene Türen. Eine Adresse im Netz, die einen Agenten startet, ist ein Angriffspunkt. Jede Route hat ein eigenes Geheimnis, eine Signatur über Zeitstempel und Inhalt, ein enges Zeitfenster gegen Wiederholungen und eine Obergrenze für die Größe. Ohne gültige Signatur passiert nichts.
Die wichtigste Grenze

Der Agent pflegt Inhalte, nicht die Infrastruktur. Server, Abgleich, Backup und Zeitpläne richtet ein Mensch ein. Das steht so in seinen Regeln. Ein Agent, der sich selbst die Umgebung umbaut, ist am nächsten Morgen nicht mehr erklärbar.

So bauen Sie das selbst

Ein Wochenende reicht für die erste Fassung, wenn Sie klein anfangen. Danach wächst es mit jeder Woche.

  1. 1

    Entscheiden, wofür

    Schreiben Sie drei Aufgaben auf, die der Agent übernehmen soll. Gute erste Aufgaben sind zusammenfassen, erinnern und vorbereiten. Schlechte erste Aufgaben sind entscheiden und verschicken.

  2. 2

    Gedächtnis anlegen

    Ein Ordner mit Textdateien und eine Seite, die auf alles verweist. Dazu drei Regeln: eine Notiz je Sache, Quelle und Datum an jeder Zahl, nichts erfinden. Diese Regeln landen als Datei im Ordner.

  3. 3

    Agent aufsetzen

    Hermes läuft auf einem Rechner oder einem kleinen Server, der durchläuft. Ein Server ab etwa fünf Euro im Monat genügt für den Anfang. Alternativ tun es für den ersten Test auch ein Laptop und ein Terminal.

  4. 4

    Einen Kanal wählen

    Nehmen Sie den Messenger, den Sie ohnehin benutzen. Die erste Nachricht des Agenten sollte etwas sein, das Sie sonst selbst nachgeschaut hätten.

  5. 5

    Ein Werkzeug anbinden

    Genau eines, am besten lesend. Wer ein CRM hat, fängt dort an. Erst wenn das eine Woche ruhig läuft, kommt schreibender Zugriff dazu.

  6. 6

    Grenzen aufschreiben

    Was darf der Agent allein, was braucht Freigabe, wo endet sein Zuständigkeitsbereich. Diese Datei ist wichtiger als jede Anbindung. Wir haben sie einmal geschrieben und seitdem dreimal geschärft.

Dazu der ehrliche Hinweis. Nicht jedes Team braucht so etwas. Wenn Ihre Abläufe feststehen und oft laufen, ist ein Workflow in n8n die bessere Antwort. Er ist billiger, vorhersagbarer und leichter zu prüfen. Ein Agent lohnt sich dort, wo die Aufgabe jedes Mal etwas anders aussieht und trotzdem Wissen aus der Vorgeschichte braucht. Wann wir ganz von Automatisierung abraten, steht in diesem Beitrag.

Was wir daraus gelernt haben

Der Wert steckt nicht im Modell, sondern im Gedächtnis. Ein Agent mit gepflegten Notizen und zwei Werkzeugen ist nützlicher als einer mit dem besten Modell und leerem Kopf. Deshalb ist die erste Arbeit immer Ordnung, nicht Technik.

Weitere Beiträge

Alle Beiträge