Technischer Leitfaden
Lange Aufgaben mit GPT-6: Agenten sinnvoll voranbringen

GPT-6 Astra kann ausgedehnte Projekte bearbeiten. Eine lange Ausführung ist aber nur nützlich, solange sie einem akzeptierten Ergebnis näherkommt. Geben Sie dem Agenten einen konkreten Meilenstein, eine Fortschrittsprüfung und genug gespeicherten Zustand für die Wiederaufnahme. Erweitern Sie den Umfang nach einer sinnvoll abgeschlossenen Phase.
Das gilt für Websites, Recherchedossiers, Repository-Migrationen und mehrteilige Dokumentlieferungen. Jede davon kann stundenlange Aktivität erzeugen, ohne die Kernanforderung zu lösen. Entscheidend ist, ob die jüngste Arbeit das Endergebnis nutzbarer macht.
Quellen: Matt Shumers Bewertung; Codex-Issue #43193; OpenAI-Ankündigung. Geprüft am 7. September 2026. Ergebnisse und Erfahrungen werden im Text den jeweiligen Autoren zugeordnet.
Was frühe Erfahrungen zeigen
Matt Shumers Astra-Test beschreibt ambitionierte Projekte, die langsamer vorankamen, als das Modell sich in Details verlor. Koordination half ihm, die Richtung zu halten. Langfristige Autonomie betrachtete er dennoch nicht als gelöst.
Ein öffentliches Codex-Issue zu Orchestrierung und Anweisungsbefolgung beschreibt hohen Verbrauch bei wiederholtem Prozessversagen. Das ist ein Nutzerbericht, keine gemessene Fehlerquote. Er verdeutlicht aber, warum zusätzliche Agentenaktivität nicht mit Fortschritt gleichgesetzt werden darf.
Daraus ergibt sich eine Gewohnheit: Prüfen Sie die Veränderung seit dem letzten Kontrollpunkt. Nähert sich kein Abnahmekriterium der Erfüllung, prüfen Sie den Plan vor mehr Laufzeit oder weiteren Agenten.
Die Art der Unterbrechung erkennen
Eine lange Aufgabe kann wegen einer offenen Entscheidung, eines Werkzeugfehlers, eines Anwendungsabbruchs oder einer Richtungsabweichung stoppen. Jeder Fall verlangt eine andere Antwort. Wiederholtes „Weiter“ behebt kaum eine fehlende Datei oder widersprüchliche Regeln.
OpenAIs GPT-6-Leitfaden beschreibt häufigere Rückfragen und eine stärkere Reaktion auf zugängliche Dateianweisungen. Er dokumentiert auch Steuerung im Turn und asynchrone Aufrufe. Das unterstützt die Koordination, garantiert aber keine unbegrenzt aktive Sitzung.
| Symptom | Zuerst prüfen | Sinnvolle Reaktion |
|---|---|---|
| Wiederholte Freigabefragen | Offene Entscheidung und bestehende Erlaubnis | Konkrete Wahl einmal klären |
| Kein neues Ergebnis | Offene Werkzeuge und Laufstatus | Tatsächliche Aktivität feststellen |
| Gleiche Tests oder Suchen | Erkenntnis des letzten Versuchs | Hypothese ändern oder Schleife stoppen |
| Erledigte Arbeit verschwindet | Gesicherter Zustand und Ergebnisversion | Von geprüften Dateien fortsetzen |
| Mehr Agenten, kaum Fortschritt | Zuständigkeit und Abhängigkeiten | Überschneidungen reduzieren |
Eine frühe Diskussion zur Dokumentprüfung schildert Stillstände trotz Kontrollpunkten und Koordinator. Es ist eine Einzelerfahrung, zeigt aber eine praktische Grenze: Ein Kontrollpunkt sichert Arbeit, stellt jedoch keinen Scheduler bereit und repariert keine gestoppte Laufzeitumgebung.
Beispiel: einen großen Dokumentbestand prüfen
Angenommen, das Team vergleicht Anforderungen aus mehreren Dokumenten. Dieses Beispiel profitiert von Chargen, weil Abdeckung und Befunde laufend geprüft werden können. Beginnen Sie mit einem Inventar statt sofort mit dem Abschlussbericht.
Phase 1: Bestand klären
Vergeben Sie Kennung, Version, Datum und Prüfstatus je Dokument. Erfassen Sie unlesbare Dateien und fehlende Verweise. Klären Sie die Prüffragen, damit kein Budget für Zusammenfassungen ohne Entscheidungsrelevanz verloren geht.
Phase 2: repräsentative Gruppe prüfen
Wählen Sie einige unterschiedlich aufgebaute und komplexe Dokumente. Verlangen Sie Befunde mit Seiten-, Abschnitts- oder Quellenkennung. Prüfen Sie diese erste Gruppe, bevor das Verfahren auf alles angewandt wird. Ein mangelhaftes Extraktionsformat wird bei Hunderten Wiederholungen teuer.
Phase 3: Gruppen zusammenführen
Der Abschluss sollte Aussagen, Definitionen und Anforderungen zwischen Dokumenten vergleichen. Dokumentieren Sie Widersprüche und erklären Sie den Vorrang einer Version. Eine frühe Zusammenfassung wird nicht allein dadurch maßgeblich, dass spätere Agenten sie statt der Originaldatei erhalten.
Phase 4: Vollständigkeit nachweisen
Gleichen Sie Bericht und Inventar ab. Jedes notwendige Dokument muss geprüft, begründet ausgeschlossen oder noch offen sein. Ein sauber gestalteter Bericht mit fehlender Abdeckung ist unvollständig, auch wenn die fertigen Abschnitte korrekt sind.
Dokument-ID | Version | Prüfstatus | Befunddatei | Offene Fragen
A-01 | 3 | Geprüft | findings-a01 | Keine
A-02 | 2 | Blockiert | findings-a02 | Anhang fehlt
A-03 | 1 | Offen | - | Noch ungeprüftSo hat eine Ersatzsitzung einen klaren Einstieg. Ein menschlicher Prüfer kann die Abdeckung kontrollieren, ohne den gesamten Chat nachzuvollziehen.
Festlegen, was ein Kontrollpunkt bewahrt
Ein nützlicher Kontrollpunkt enthält Arbeitszustand und Nachweis seiner Richtigkeit. „Phase zwei fertig“ reicht nicht, wenn niemand die Ausgabe findet. Nennen Sie Ergebnispfad, Eingabeversion, erledigte Prüfungen und verbleibende Abweichung.
Bei Code speichern Sie Revision und relevante Testergebnisse, bei Recherche Quellenlinks und Abrufdatum, bei Tabellen Originalmappe und angewandte Änderungen. Bearbeitet eine andere Person das Ergebnis, aktualisieren Sie den Kontrollpunkt vor der Fortsetzung, damit der Agent nicht mit veralteten Annahmen arbeitet.
Wählen Sie natürliche Grenzen. Nach jedem Satz zu sichern schafft Verwaltung, erst nach Stunden zu sichern verteuert die Wiederherstellung. Eine erledigte Gruppe, eine geprüfte Änderung oder eine geklärte Designentscheidung eignet sich meist gut.
Ohne doppelte Arbeit neu starten
Setzen Sie diesen Meilenstein anhand des gespeicherten Aufgabenstands fort.
Prüfen Sie vorhandene Ergebnisse vor Änderungen.
Erkennen Sie erledigte Abnahmekriterien und wiederholen Sie sie nicht.
Kontrollieren Sie den Ausgang früher versuchter externer Aktionen.
Arbeiten Sie am nächsten unerfüllten Kriterium weiter.
Widersprechen sich Protokoll und Dateien, klären Sie das zuerst.Versucht und abgeschlossen sind verschiedene Zustände. Ein Werkzeug kann einen Datensatz erstellen und danach einen Timeout melden. Lesen Sie vor der Wiederholung das Zielsystem, um den Ausgang festzustellen. Bei lokalen Dateien prüfen Sie, ob ein Teilergebnis vervollständigt statt überschrieben werden kann.
Budget an nützlichen Fortschritt knüpfen
Ein begrenzter Pilot zeigt den realen Arbeitsbedarf. Bei Dokumentprüfungen zählen verifizierte Dokumente und korrigierte Befunde, bei Code akzeptierte Verhaltensweisen. Berücksichtigen Sie menschliche Prüfzeit: Umfangreiche Ausgaben mit stundenlangem Reparaturbedarf sind nicht zwingend produktiv.
Definieren Sie das Verhalten kurz vor Budgetende: Ergebnis speichern, Aufgabenstand aktualisieren und nächste Entscheidung nennen. Ein Tokenlimit stoppt weitere Kosten, sichert aber keine brauchbare Übergabe. Die Übergabe muss Teil des Auftrags sein.
Verbessert sich der Fortschritt über Kontrollpunkte hinweg nicht, stoppen Sie die Ausweitung und suchen den Engpass. Nötig sein können eine Quelle, ein kleinerer Meilenstein, ein anderes Werkzeug oder eine menschliche Entscheidung. Mehr Denkaufwand ist nur eine mögliche Maßnahme.
Die erste Ziellinie definieren
„Das gesamte Produkt bauen“ enthält zu viele unausgesprochene Entscheidungen. Beginnen Sie mit einem prüfbaren Ausschnitt: einem funktionierenden Ablauf, einer validierten Analyse oder einem migrierten Baustein. Er sollte zeigen, ob das Modell das Projekt versteht.
| Projekt | Erster Meilenstein | Nachweis |
|---|---|---|
| Website | Ein Kernablauf funktioniert | Reproduzierbare Interaktionsprüfungen |
| Recherche | Zentrale Aussagen sind belegt | Aussagenliste mit Links und offenen Fragen |
| Migration | Ein repräsentativer Pfad ist umgestellt | Alt- und Neuverhalten stimmen wo nötig überein |
| Berichtspaket | Ein vollständiger Abschnitt erfüllt den Auftrag | Quellenprüfung und Leserabnahme |
Setzen Sie den Meilenstein vor dem Start. Zieländerungen nach jedem Zwischenergebnis erschweren die Unterscheidung zwischen Korrektur und Umfangswachstum.

Fortschrittsansicht zur Review-Vorbereitung von Matt Shumer. Die Zähler erfassen Fortschritt, sind aber keine unabhängige Prüfung.
Ein kompaktes Aufgabenprotokoll führen
Das Modell braucht aktuelles Ziel, Entscheidungen, Dateien, gescheiterte Ansätze und offene Prüfungen. Ein langer Chat ist dafür nicht immer der beste Speicher. Führen Sie einen kurzen, kontrollierbaren und korrigierbaren Stand.
Aktueller Meilenstein:
Abnahmekriterien:
Ergebnis- und Quellenpfade:
Getroffene Entscheidungen:
Verworfene Ansätze und Gründe:
Geprüfte Ergebnisse:
Offene Probleme:
Nächste Aktion:Aktualisieren Sie ihn nach relevanten Ergebnissen oder Richtungsänderungen. Er sollte keine Erzählung jedes Werkzeugaufrufs werden, sondern die nächste Entscheidung erleichtern.
Drei Formen von Stillstand erkennen
Einen gescheiterten Ansatz wiederholen
Fragen Sie nach neuen Belegen für einen weiteren Versuch. Ein vorübergehender Werkzeugfehler kann Wiederholung rechtfertigen, identisches Denken ohne neue Daten weniger. Speichern Sie Fehlversuche, damit spätere Sitzungen sie nicht erneut entdecken.
Details polieren, bevor der Kern funktioniert
Der Agent kann Text oder Gestaltung verbessern, während der zentrale Ablauf noch kaputt ist. Gehen Sie zu den Abnahmekriterien zurück und nennen Sie die wichtigste offene Anforderung. Erledigen Sie diese vor mehr Feinschliff.
Umfang erweitern, statt Mehrdeutigkeit zu klären
Bei unklarem Auftrag baut das Modell möglicherweise Infrastruktur, statt eine fehlende Entscheidung zu lösen. Lassen Sie die kleinste Unklarheit benennen, die den Entwurf verändert. Klären Sie sie vor einer umfassenden Neufassung.
Unterbrechungen wiederaufnehmbar machen
OpenAIs Astra-Ankündigung weist auf mögliche Unterbrechungen legitimer Arbeit durch Schutzmaßnahmen hin. Auch Netzwerkprobleme, Abstürze und Nutzeränderungen können Läufe stoppen. Speichern Sie nutzbare Zwischenstände und prüfen Sie den Zustand vor der Fortsetzung.
Eine wiederaufgenommene Aufgabe sollte aktuelle Dateien und Protokoll lesen, Erledigtes erkennen und beim nächsten offenen Kriterium fortfahren. Wurde möglicherweise eine externe Aktion ausgeführt, prüfen Sie ihr Ergebnis vor einer Wiederholung.
Prompt-Vorlage für lange Aufgaben
Erreichen Sie diesen Meilenstein: [konkretes Ergebnis].
Abnahmekriterien: [beobachtbare Prüfungen].
Erlaubte Materialien und Werkzeuge: [Umfang].
Führen Sie einen kurzen Stand mit Entscheidungen und geprüftem Fortschritt.
Priorisieren Sie offene Kernanforderungen vor Feinschliff.
Bei Stillstand nennen Sie Hindernis und benötigte Belege.
Am Budgetlimit liefern Sie nutzbare Ergebnisse und die nächste Aktion.Nicht jedes Projekt benötigt mehrere Agenten. Ergänzen Sie eine Rolle nur bei eigenständigem, unabhängig prüfbarem Ergebnis. Koordination erzeugt selbst Arbeit, besonders wenn mehrere Agenten dasselbe Artefakt bearbeiten.
Fortschritt und Kosten gemeinsam messen
Verfolgen Sie erfüllte Kriterien, Prüferkorrekturen, Laufzeit und Verbrauch. Ein hilfreicher Stand sagt etwa: Zwei von drei Abläufen bestehen, der dritte hat einen reproduzierbaren Fehler, der Patch ist prüfbereit. „Noch in Arbeit“ reicht nicht, um eine weitere Stunde zu rechtfertigen.
Halten Sie Auftrag, Quellen, Entwürfe und Prüfentscheidungen in Ottermind zusammen. Für kleinere Startaufgaben verwenden Sie die Vorlagen unter GPT-6 verwenden, für Integrationsbudgets den API-Leitfaden.
Häufige Fragen
Kann GPT-6 mit einem Prompt ein Projekt abschließen?
Manche Entwickler beschreiben einen solchen Anfang. Umgebung, Werkzeuge, Vorarbeit und spätere Kontrolle bleiben wichtig. Beginnen Sie mit einem konkreten Meilenstein.
Wie lange sollte ein Agent laufen?
Setzen Sie ein passendes Budget und prüfen Sie an sinnvollen Kontrollpunkten. Eine universell nützliche Dauer gibt es nicht.
Was tun, wenn nur Kleinigkeiten verbessert werden?
Nennen Sie die wichtigste offene Anforderung erneut und verschieben Sie optionale Verfeinerungen bis zu ihrer Erfüllung.
Helfen mehr Agenten bei langsamem Fortschritt?
Klären Sie zuerst die Ursache. Fehlende Anforderungen oder falsche Ansätze brauchen Klärung beziehungsweise Korrektur, nicht mehr Parallelität.
Was sollte ein gestoppter Lauf zurückgeben?
Nutzbare Ergebnisse, verifizierte Befunde, offene Probleme und eine konkrete nächste Aktion, damit bereits erledigte Schritte nicht wiederholt werden.
