Technischer Leitfaden

KI-Agent-Architektur: Komponenten zuverlässiger Arbeitsabläufe

2026-09-02·Lesezeit etwa 11 Minuten·Aktualisiert am 2026-09-02

Eine KI-Agent-Architektur ist die Software rund um ein Modell: Zustand, Abruf, Werkzeuge, Orchestrierung, Sicherheit und Bewertung. Eine gute Architektur macht Unsicherheit und Fehler sichtbar, statt sie hinter einer Gesprächsoberfläche zu verstecken.

Recherche und Transparenz: Die Architekturempfehlungen beruhen auf der offiziellen Dokumentation von OpenAI, Anthropic, LangChain, NISTabgerufen am 2. September 2026.

Referenzebenen

EbeneVerantwortungDesignfrage
OberflächeNimmt Ziele an und zeigt den StatusWas muss der Nutzer freigeben?
OrchestratorSteuert Schritte, Wiederholungen und StoppsKann jeder Übergang protokolliert werden?
ModellInterpretiert Kontext und schlägt Aktionen vorWelches Ausgabeschema ist nötig?
KontextRuft Dateien, Speicher und Status abWerden Berechtigungen vor dem Abruf geprüft?
WerkzeugeFühren externe Aktionen ausSind Aufrufe begrenzt und idempotent?
BewertungMisst Qualität und SicherheitWelche Fehler blockieren den Start?

Zustand und Speicher

Trennen Sie den temporären Laufstatus vom dauerhaften Projektspeicher. Speichern Sie Herkunft und Zeitstempel mit abgerufenen Fakten. Behandeln Sie eine frühere Modellantwort nicht ohne Quellen- und Prüfpolicy als verbindliche Erinnerung.

Zur Abgrenzung von Architektur und Arbeitsablauf hilft der Leitfaden zu agentischen Arbeitsabläufen: Architektur beschreibt Systemgrenzen, ein Arbeitsablauf die geordnete Arbeit des Systems.

Grenzen der Werkzeuge

Stellen Sie enge Funktionen statt uneingeschränkter Zugangsdaten bereit. Validieren Sie Argumente, setzen Sie Zeitlimits und verlangen Sie Bestätigung für Senden, Löschen, Kaufen oder Berechtigungsänderungen. Idempotenzschlüssel verhindern doppelte Nebenwirkungen bei Wiederholungen.

Abruf und Grounding

Rufen Sie nur Inhalte ab, auf die der Nutzer zugreifen darf. Fügen Sie Quellenkennungen in den Kontext ein und verlangen Sie Zitate oder Belegfelder. Bei leerem oder widersprüchlichem Abruf soll der Agent eskalieren, statt die Lücke zu füllen.

Mit einem reversiblen Teil beginnen

Prototypen Sie zuerst eine reine Leseaufgabe. Ein quellenbasiertes Briefing oder eine Klassifizierung liefert nützliche Spuren ohne irreversibles Risiko. Fügen Sie ein Werkzeug nach dem anderen hinzu und dokumentieren Sie seine Berechtigungsgrenze.

Anfrage- und Antwortverträge

Definieren Sie einen Vertrag zwischen den Ebenen. Die Anfrage enthält Ziel, Identität, erlaubte Quellen und Budget; die Antwort enthält Status, strukturierte Ausgabe, Zitate, Werkzeug-Aufrufe und offene Prüfpunkte.

Prompt
{
  "status": "needs_review",
  "claims": [],
  "sources": [],
  "open_questions": ["Der freigegebene Datensatz enthält nicht das letzte Quartal."]
}

Ein expliziter Status ist sicherer als ein flüssiger Absatz, der eine fehlende Quelle verschweigt.

Bewertung und Betrieb

Erstellen Sie normale, unvollständige, bösartige und mehrsprachige Testfälle. Verfolgen Sie Werkzeugfehler, Eskalationsrate, Latenz, Kosten und Korrekturen. Versionieren Sie Prompts, Werkzeuge, Modelleinstellungen und Richtlinien gemeinsam.

Checkliste für die Produktion

  • Wiederholbare Spuren für jeden Aufruf und jede Modellversion
  • Getrennte Zugangsdaten und Daten für Test und Produktion
  • Idempotente Schreibvorgänge und dokumentierter Rollback
  • Bewertungstests vor jeder Prompt- oder Modelländerung
  • Verantwortliche Person für Eskalationen und Vorfälle

Synchrone, asynchrone und menschliche Prüfpunkte

Kurze Klassifikationen können synchron laufen. Langer Abruf oder Dokumenterstellung sollte asynchron mit Fortschritt und Abbruch laufen. Setzen Sie menschliche Prüfpunkte vor irreversiblen Aktionen und bei Fehlern in Konfidenz, Berechtigung oder Richtlinie. Speichern Sie die Entscheidung im Laufstatus, damit Wiederholungen den Kontext behalten.

Kosten- und Latenzbudgets

Begrenzen Sie Modellrunden, Werkzeugaufrufe, Tokens und Laufzeit. Ein kleineres Modell reicht für einfache Extraktion; teure Schlussfolgerungen bleiben mehrdeutigen Fällen vorbehalten. Das Budget steuert den Betrieb und zeigt Nutzern, wann der Ablauf stoppt und Hilfe anfordert.

Häufige Fragen

Brauche ich eine Multi-Agent-Architektur?

Nein. Beginnen Sie mit einem Agenten und klaren Werkzeuge. Fügen Sie weitere Agenten nur bei wirklich unterschiedlichen Rollen, Berechtigungen oder Bewertungskriterien hinzu.

Wo gehört Sicherheit hin?

In jede Ebene: Identität, Abruf, Werkzeug-Berechtigungen, Geheimnisse, Protokolle und menschliche Freigabe. Sicherheit ist kein letzter Check.

Wie verringere ich Halluzinationen?

Verbessern Sie Quellen, begrenzen Sie Ausgaben, verlangen Sie Belege und machen Sie Unsicherheit handlungsrelevant. Der Prompt allein reicht nicht.

Was sollte ich zuerst prototypen?

Einen begrenzten, reversiblen Arbeitsablauf mit eindeutigem Prüfer. Validieren Sie den Kontrollpfad, bevor Sie weitere Werkzeuge hinzufügen.

Desktop- und Mobile-App herunterladen

Greife jederzeit und überall auf Ottermind zu.

Computer