Guide technique
Tâches longues avec GPT-6 : maintenir des progrès utiles

GPT-6 Astra peut traiter des projets de longue durée, mais une exécution n'est utile que si elle se rapproche d'un résultat accepté. Donnez à l'agent un jalon précis, un moyen de vérifier ses progrès et suffisamment d'état sauvegardé pour reprendre après interruption. Élargissez le périmètre après une phase significative.
Cela concerne un site, un dossier de recherche, une migration de dépôt ou un ensemble de documents. Chacun peut générer des heures d'activité sans résoudre le besoin central. La question est de savoir si le travail récent rend le résultat final plus utilisable.
Sources: analyse de Matt Shumer; issue Codex no 43193; annonce OpenAI. Consultées le 7 septembre 2026. Les résultats et expériences sont attribués à leurs auteurs dans le texte.
Les enseignements des premiers retours
L'analyse d'Astra par Matt Shumer décrit des projets ambitieux qui ralentissaient lorsque le modèle s'attardait sur les détails. Une organisation de coordination l'a aidé à conserver le cap, sans pour autant résoudre entièrement l'autonomie de longue durée.
Une issue publique Codex sur l'orchestration et le suivi des consignes associe forte consommation et échecs répétés du processus. C'est un témoignage utilisateur, pas un taux d'échec mesuré, mais il illustre pourquoi l'activité supplémentaire des agents ne doit pas être confondue avec une progression.
Ces expériences suggèrent une habitude : examiner ce qui a changé depuis le dernier point de contrôle. Si aucun critère d'acceptation ne se rapproche de l'achèvement, revoyez le plan avant d'ajouter du temps ou des agents.
Identifier le type d'interruption
Une tâche longue peut s'arrêter faute de décision, à cause d'un outil, d'un arrêt de l'application ou d'une dérive du travail. Chaque cause appelle une réponse différente. Répéter « continuez » ne résout généralement ni un fichier manquant ni une consigne contradictoire.
Le guide GPT-6 d'OpenAI décrit une propension accrue aux demandes de précision et une sensibilité aux instructions présentes dans les fichiers accessibles. Il documente aussi le pilotage en cours de tour et les outils asynchrones. Ces capacités facilitent la coordination, mais ne garantissent pas qu'une session quelconque s'exécute indéfiniment.
| Symptôme | Premier contrôle | Réponse utile |
|---|---|---|
| Demandes d'approbation répétées | Décision ouverte et autorisation existante | Clarifier une fois le choix précis |
| Aucun nouveau livrable ou résultat | Outil en attente et statut d'exécution | Vérifier si le processus est encore actif |
| Tests ou recherches répétés | Preuve obtenue au dernier essai | Changer d'hypothèse ou arrêter la boucle |
| Travail achevé qui disparaît | État sauvegardé et version du livrable | Reprendre depuis les fichiers vérifiés |
| Davantage d'agents, peu d'avancée | Responsabilités et dépendances | Réduire le chevauchement |
Une discussion initiale sur la revue documentaire décrit des blocages malgré des points de contrôle et un coordinateur. C'est une expérience isolée, mais elle rappelle une limite concrète : sauvegarder la progression ne fournit pas un ordonnanceur et ne répare pas un environnement arrêté.
Exemple complet : revoir un grand corpus documentaire
Supposons que votre équipe doive comparer les exigences de plusieurs documents. Cet exemple gagne à être traité par lots, car il permet de vérifier couverture et constats au fil de l'avancée. Commencez par un inventaire plutôt que demander immédiatement le rapport final.
Phase 1 : inventorier l'existant
Attribuez à chaque document un identifiant, une version, une date et un statut de revue. Notez les fichiers illisibles et références manquantes. Définissez les questions auxquelles la revue doit répondre, pour éviter de dépenser le budget en résumés sans effet sur la décision.
Phase 2 : examiner un lot représentatif
Choisissez quelques documents de structures et de complexités différentes. Exigez des constats reliés à une page, une section ou un identifiant. Contrôlez ce premier lot avant d'appliquer la méthode à l'ensemble. Un mauvais format d'extraction devient coûteux lorsqu'il est répété des centaines de fois.
Phase 3 : rapprocher les lots
La synthèse finale doit comparer affirmations, définitions et exigences entre documents. Consignez les contradictions et expliquez quelle version prévaut. Le premier résumé ne devient pas une autorité simplement parce que les agents suivants l'ont reçu à la place des originaux.
Phase 4 : vérifier l'achèvement
Rapprochez le rapport de l'inventaire. Chaque document nécessaire doit être examiné, exclu pour une raison explicite ou encore ouvert. Un rapport soigné dont la couverture est lacunaire reste incomplet, même si les parties terminées sont exactes.
ID document | Version | Revue | Fichier de constats | Questions ouvertes
A-01 | 3 | Terminé | findings-a01 | Aucune
A-02 | 2 | Bloqué | findings-a02 | Annexe manquante
A-03 | 1 | En attente | - | Pas encore examinéUne nouvelle session dispose ainsi d'un point de départ clair, et le relecteur peut auditer la couverture sans rejouer la conversation.
Définir ce qu'un point de contrôle doit conserver
Un bon point de contrôle contient l'état du travail et la preuve que cet état est juste. « Phase deux terminée » ne suffit pas si personne ne trouve le résultat. Indiquez chemin du livrable, version de l'entrée, critères vérifiés et écart restant.
Pour le code, notez la révision et les tests pertinents. Pour la recherche, gardez liens et dates de consultation. Pour les tableurs, préservez le classeur d'entrée et les changements appliqués. Si quelqu'un modifie le livrable, actualisez la sauvegarde avant de continuer, afin d'éviter les hypothèses périmées.
Choisissez des limites naturelles. Sauvegarder après chaque phrase crée de l'administration ; attendre plusieurs heures rend la reprise coûteuse. Un lot achevé, un changement validé ou une décision résolue constituent souvent de bons points de passage.
Reprendre sans refaire le travail
Reprenez ce jalon à partir du suivi sauvegardé.
Inspectez les livrables actuels avant de les modifier.
Identifiez les critères déjà remplis et ne recommencez pas leur travail.
Vérifiez l'issue de toute action externe précédemment tentée.
Continuez par le prochain critère non satisfait.
Si les fichiers contredisent le suivi, expliquez et réconciliez d'abord.Il faut distinguer tentative et réalisation. Un outil peut créer un enregistrement puis dépasser son délai. Avant de réessayer, consultez la destination pour déterminer ce qui s'est passé. Pour les fichiers locaux, cherchez un résultat partiel à achever plutôt qu'à écraser.
Lier le budget aux progrès utiles
Un pilote limité permet d'estimer le travail nécessaire. Pour les documents, suivez les pièces vérifiées et constats corrigés ; pour le code, les comportements acceptés. Incluez la révision humaine, car une sortie volumineuse nécessitant des heures de réparation n'est pas forcément productive.
Précisez la conduite à tenir à l'approche de la limite : sauvegarder le livrable, mettre à jour le suivi et présenter la prochaine décision. Un plafond de tokens bloque la dépense, mais ne garantit pas une transmission utile. Cette transmission doit faire partie du contrat.
Si plusieurs points de contrôle ne montrent plus de progrès, suspendez l'élargissement et cherchez le goulot d'étranglement. Il peut manquer une source, un jalon plus restreint, un outil différent ou une décision humaine. Augmenter le raisonnement n'est qu'une intervention possible.
Fixer une première ligne d'arrivée
« Construisez tout le produit » contient trop de décisions implicites. Commencez par une partie vérifiable : un parcours fonctionnel, une analyse validée ou un composant migré. Elle doit être assez utile pour révéler si le modèle comprend le projet.
| Projet | Premier jalon | Preuve |
|---|---|---|
| Site | Un parcours essentiel fonctionne | Contrôles d'interaction reproductibles |
| Recherche | Les principales affirmations sont étayées | Tableau des affirmations, liens et questions ouvertes |
| Migration | Un chemin représentatif est converti | Ancien et nouveau comportements concordent là où nécessaire |
| Dossier de rapports | Une section complète correspond au brief | Contrôle des sources et relecture |
Fixez le jalon avant de lancer. Changer d'objectif après chaque résultat intermédiaire rend difficile la distinction entre correction et dérive du périmètre.

Suivi de préparation de la revue de Matt Shumer. Les compteurs consignent l'avancement sans constituer une validation indépendante.
Tenir un suivi compact
Le modèle a besoin de l'objectif actuel, des décisions, fichiers, tentatives échouées et vérifications restantes. Une longue transcription n'est pas toujours le meilleur moyen de retrouver ces informations. Maintenez une courte fiche inspectable et corrigeable.
Jalon actuel :
Critères d'acceptation :
Emplacement des livrables et sources :
Décisions prises :
Approches écartées et motifs :
Résultats vérifiés :
Problèmes ouverts :
Prochaine action :Actualisez cette fiche après un résultat significatif ou un changement de direction important. Évitez d'en faire le récit de chaque appel d'outil : elle doit faciliter la décision suivante.
Reconnaître trois formes de stagnation
Répéter une approche infructueuse
Demandez quelle nouvelle preuve justifie l'essai suivant. Réessayer après une panne transitoire peut être raisonnable ; répéter le même raisonnement sans information nouvelle l'est moins. Conservez les échecs pour que la prochaine session ne les redécouvre pas.
Peaufiner avant de terminer l'essentiel
L'agent peut polir le texte ou les détails visuels alors que le parcours central ne fonctionne pas. Revenez aux critères et repérez le plus important encore ouvert. Terminez-le avant d'ajouter des finitions.
Étendre le périmètre pour résoudre une ambiguïté
Si la demande est floue, le modèle peut bâtir davantage d'infrastructure plutôt que résoudre le choix manquant. Demandez la plus petite incertitude qui change la conception. Réglez-la avant une refonte étendue.
Préparer la reprise après interruption
L'annonce d'Astra prévient que les protections peuvent arrêter du travail légitime. Réseau, plantage et changement de demande peuvent aussi interrompre l'exécution. Sauvegardez les résultats utiles pendant le travail et vérifiez leur état avant de reprendre.
Une session relancée doit lire les fichiers et le suivi actuels, identifier le travail achevé et poursuivre le prochain critère ouvert. Si une action externe a pu être réalisée, vérifiez son résultat avant de la répéter.
Modèle de prompt pour une tâche longue
Achevez ce jalon : [résultat précis].
Critères d'acceptation : [contrôles observables].
Matériaux et outils autorisés : [périmètre].
Tenez un bref suivi des décisions et progrès vérifiés.
Priorisez les exigences essentielles inachevées avant les finitions.
En cas de stagnation, expliquez l'obstacle et la preuve nécessaire.
À la limite du budget, livrez les résultats utilisables et l'action suivante.Tous les projets ne nécessitent pas plusieurs agents. Ajoutez un rôle distinct seulement s'il produit une sortie vérifiable indépendamment. La coordination peut devenir une charge, surtout lorsque plusieurs agents éditent le même livrable.
Mesurer ensemble progression et coût
Suivez critères remplis, corrections humaines, durée et consommation totale. Un point de contrôle utile peut préciser que deux parcours sur trois passent, que le troisième échoue de façon reproductible et que le correctif est prêt à relire. « Toujours en cours » ne suffit pas à décider si une heure de plus est justifiée.
Conservez brief, sources, brouillons et décisions dans Ottermind. Pour commencer plus petit, utilisez les modèles de comment utiliser GPT-6 ; pour les budgets d'intégration, consultez le guide API.
Questions fréquentes
GPT-6 peut-il finir un projet à partir d'un prompt ?
Certains créateurs décrivent ce point de départ, mais environnement, outils, préparation et révision ultérieure comptent toujours. Commencez par un jalon précis.
Combien de temps laisser un agent travailler ?
Fixez un budget adapté et contrôlez l'avancement aux étapes utiles. Il n'existe pas de durée universelle.
Que faire s'il ne peaufine que des détails ?
Rappelez le critère ouvert le plus important et reportez les finitions facultatives jusqu'à sa satisfaction.
Faut-il ajouter des agents quand le travail ralentit ?
Identifiez d'abord la cause. Des exigences manquantes ou une mauvaise approche appellent clarification ou correction, pas davantage de parallélisme.
Que doit rendre une exécution arrêtée ?
Des livrables utilisables, des résultats vérifiés, les questions ouvertes et une prochaine action concrète, pour reprendre sans refaire les étapes achevées.
