Technischer Leitfaden
KI-Agent-Architektur: Komponenten zuverlässiger Arbeitsabläufe

Eine KI-Agent-Architektur ist die Software rund um ein Modell: Zustand, Abruf, Werkzeuge, Orchestrierung, Sicherheit und Bewertung. Eine gute Architektur macht Unsicherheit und Fehler sichtbar, statt sie hinter einer Gesprächsoberfläche zu verstecken.
Recherche und Transparenz: Die Architekturempfehlungen beruhen auf der offiziellen Dokumentation von OpenAI, Anthropic, LangChain, NISTabgerufen am 2. September 2026.
Referenzebenen
| Ebene | Verantwortung | Designfrage |
|---|---|---|
| Oberfläche | Nimmt Ziele an und zeigt den Status | Was muss der Nutzer freigeben? |
| Orchestrator | Steuert Schritte, Wiederholungen und Stopps | Kann jeder Übergang protokolliert werden? |
| Modell | Interpretiert Kontext und schlägt Aktionen vor | Welches Ausgabeschema ist nötig? |
| Kontext | Ruft Dateien, Speicher und Status ab | Werden Berechtigungen vor dem Abruf geprüft? |
| Werkzeuge | Führen externe Aktionen aus | Sind Aufrufe begrenzt und idempotent? |
| Bewertung | Misst Qualität und Sicherheit | Welche Fehler blockieren den Start? |
Zustand und Speicher
Trennen Sie den temporären Laufstatus vom dauerhaften Projektspeicher. Speichern Sie Herkunft und Zeitstempel mit abgerufenen Fakten. Behandeln Sie eine frühere Modellantwort nicht ohne Quellen- und Prüfpolicy als verbindliche Erinnerung.
Zur Abgrenzung von Architektur und Arbeitsablauf hilft der Leitfaden zu agentischen Arbeitsabläufen: Architektur beschreibt Systemgrenzen, ein Arbeitsablauf die geordnete Arbeit des Systems.
Grenzen der Werkzeuge
Stellen Sie enge Funktionen statt uneingeschränkter Zugangsdaten bereit. Validieren Sie Argumente, setzen Sie Zeitlimits und verlangen Sie Bestätigung für Senden, Löschen, Kaufen oder Berechtigungsänderungen. Idempotenzschlüssel verhindern doppelte Nebenwirkungen bei Wiederholungen.
Abruf und Grounding
Rufen Sie nur Inhalte ab, auf die der Nutzer zugreifen darf. Fügen Sie Quellenkennungen in den Kontext ein und verlangen Sie Zitate oder Belegfelder. Bei leerem oder widersprüchlichem Abruf soll der Agent eskalieren, statt die Lücke zu füllen.
Mit einem reversiblen Teil beginnen
Prototypen Sie zuerst eine reine Leseaufgabe. Ein quellenbasiertes Briefing oder eine Klassifizierung liefert nützliche Spuren ohne irreversibles Risiko. Fügen Sie ein Werkzeug nach dem anderen hinzu und dokumentieren Sie seine Berechtigungsgrenze.
Anfrage- und Antwortverträge
Definieren Sie einen Vertrag zwischen den Ebenen. Die Anfrage enthält Ziel, Identität, erlaubte Quellen und Budget; die Antwort enthält Status, strukturierte Ausgabe, Zitate, Werkzeug-Aufrufe und offene Prüfpunkte.
{
"status": "needs_review",
"claims": [],
"sources": [],
"open_questions": ["Der freigegebene Datensatz enthält nicht das letzte Quartal."]
}Ein expliziter Status ist sicherer als ein flüssiger Absatz, der eine fehlende Quelle verschweigt.
Bewertung und Betrieb
Erstellen Sie normale, unvollständige, bösartige und mehrsprachige Testfälle. Verfolgen Sie Werkzeugfehler, Eskalationsrate, Latenz, Kosten und Korrekturen. Versionieren Sie Prompts, Werkzeuge, Modelleinstellungen und Richtlinien gemeinsam.
Checkliste für die Produktion
- Wiederholbare Spuren für jeden Aufruf und jede Modellversion
- Getrennte Zugangsdaten und Daten für Test und Produktion
- Idempotente Schreibvorgänge und dokumentierter Rollback
- Bewertungstests vor jeder Prompt- oder Modelländerung
- Verantwortliche Person für Eskalationen und Vorfälle
Synchrone, asynchrone und menschliche Prüfpunkte
Kurze Klassifikationen können synchron laufen. Langer Abruf oder Dokumenterstellung sollte asynchron mit Fortschritt und Abbruch laufen. Setzen Sie menschliche Prüfpunkte vor irreversiblen Aktionen und bei Fehlern in Konfidenz, Berechtigung oder Richtlinie. Speichern Sie die Entscheidung im Laufstatus, damit Wiederholungen den Kontext behalten.
Kosten- und Latenzbudgets
Begrenzen Sie Modellrunden, Werkzeugaufrufe, Tokens und Laufzeit. Ein kleineres Modell reicht für einfache Extraktion; teure Schlussfolgerungen bleiben mehrdeutigen Fällen vorbehalten. Das Budget steuert den Betrieb und zeigt Nutzern, wann der Ablauf stoppt und Hilfe anfordert.
Häufige Fragen
Brauche ich eine Multi-Agent-Architektur?
Nein. Beginnen Sie mit einem Agenten und klaren Werkzeuge. Fügen Sie weitere Agenten nur bei wirklich unterschiedlichen Rollen, Berechtigungen oder Bewertungskriterien hinzu.
Wo gehört Sicherheit hin?
In jede Ebene: Identität, Abruf, Werkzeug-Berechtigungen, Geheimnisse, Protokolle und menschliche Freigabe. Sicherheit ist kein letzter Check.
Wie verringere ich Halluzinationen?
Verbessern Sie Quellen, begrenzen Sie Ausgaben, verlangen Sie Belege und machen Sie Unsicherheit handlungsrelevant. Der Prompt allein reicht nicht.
Was sollte ich zuerst prototypen?
Einen begrenzten, reversiblen Arbeitsablauf mit eindeutigem Prüfer. Validieren Sie den Kontrollpfad, bevor Sie weitere Werkzeuge hinzufügen.
