Guide technique

Tâches longues avec GPT-6 : maintenir des progrès utiles

2026-09-07·9 min de lecture·Mis à jour le 2026-09-07

GPT-6 Astra peut traiter des projets de longue durée, mais une exécution n'est utile que si elle se rapproche d'un résultat accepté. Donnez à l'agent un jalon précis, un moyen de vérifier ses progrès et suffisamment d'état sauvegardé pour reprendre après interruption. Élargissez le périmètre après une phase significative.

Cela concerne un site, un dossier de recherche, une migration de dépôt ou un ensemble de documents. Chacun peut générer des heures d'activité sans résoudre le besoin central. La question est de savoir si le travail récent rend le résultat final plus utilisable.

Sources: analyse de Matt Shumer; issue Codex no 43193; annonce OpenAI. Consultées le 7 septembre 2026. Les résultats et expériences sont attribués à leurs auteurs dans le texte.

Les enseignements des premiers retours

L'analyse d'Astra par Matt Shumer décrit des projets ambitieux qui ralentissaient lorsque le modèle s'attardait sur les détails. Une organisation de coordination l'a aidé à conserver le cap, sans pour autant résoudre entièrement l'autonomie de longue durée.

Une issue publique Codex sur l'orchestration et le suivi des consignes associe forte consommation et échecs répétés du processus. C'est un témoignage utilisateur, pas un taux d'échec mesuré, mais il illustre pourquoi l'activité supplémentaire des agents ne doit pas être confondue avec une progression.

Ces expériences suggèrent une habitude : examiner ce qui a changé depuis le dernier point de contrôle. Si aucun critère d'acceptation ne se rapproche de l'achèvement, revoyez le plan avant d'ajouter du temps ou des agents.

Identifier le type d'interruption

Une tâche longue peut s'arrêter faute de décision, à cause d'un outil, d'un arrêt de l'application ou d'une dérive du travail. Chaque cause appelle une réponse différente. Répéter « continuez » ne résout généralement ni un fichier manquant ni une consigne contradictoire.

Le guide GPT-6 d'OpenAI décrit une propension accrue aux demandes de précision et une sensibilité aux instructions présentes dans les fichiers accessibles. Il documente aussi le pilotage en cours de tour et les outils asynchrones. Ces capacités facilitent la coordination, mais ne garantissent pas qu'une session quelconque s'exécute indéfiniment.

SymptômePremier contrôleRéponse utile
Demandes d'approbation répétéesDécision ouverte et autorisation existanteClarifier une fois le choix précis
Aucun nouveau livrable ou résultatOutil en attente et statut d'exécutionVérifier si le processus est encore actif
Tests ou recherches répétésPreuve obtenue au dernier essaiChanger d'hypothèse ou arrêter la boucle
Travail achevé qui disparaîtÉtat sauvegardé et version du livrableReprendre depuis les fichiers vérifiés
Davantage d'agents, peu d'avancéeResponsabilités et dépendancesRéduire le chevauchement

Une discussion initiale sur la revue documentaire décrit des blocages malgré des points de contrôle et un coordinateur. C'est une expérience isolée, mais elle rappelle une limite concrète : sauvegarder la progression ne fournit pas un ordonnanceur et ne répare pas un environnement arrêté.

Exemple complet : revoir un grand corpus documentaire

Supposons que votre équipe doive comparer les exigences de plusieurs documents. Cet exemple gagne à être traité par lots, car il permet de vérifier couverture et constats au fil de l'avancée. Commencez par un inventaire plutôt que demander immédiatement le rapport final.

Phase 1 : inventorier l'existant

Attribuez à chaque document un identifiant, une version, une date et un statut de revue. Notez les fichiers illisibles et références manquantes. Définissez les questions auxquelles la revue doit répondre, pour éviter de dépenser le budget en résumés sans effet sur la décision.

Phase 2 : examiner un lot représentatif

Choisissez quelques documents de structures et de complexités différentes. Exigez des constats reliés à une page, une section ou un identifiant. Contrôlez ce premier lot avant d'appliquer la méthode à l'ensemble. Un mauvais format d'extraction devient coûteux lorsqu'il est répété des centaines de fois.

Phase 3 : rapprocher les lots

La synthèse finale doit comparer affirmations, définitions et exigences entre documents. Consignez les contradictions et expliquez quelle version prévaut. Le premier résumé ne devient pas une autorité simplement parce que les agents suivants l'ont reçu à la place des originaux.

Phase 4 : vérifier l'achèvement

Rapprochez le rapport de l'inventaire. Chaque document nécessaire doit être examiné, exclu pour une raison explicite ou encore ouvert. Un rapport soigné dont la couverture est lacunaire reste incomplet, même si les parties terminées sont exactes.

Consigne
ID document | Version | Revue       | Fichier de constats | Questions ouvertes
A-01        | 3       | Terminé     | findings-a01        | Aucune
A-02        | 2       | Bloqué      | findings-a02        | Annexe manquante
A-03        | 1       | En attente  | -                   | Pas encore examiné

Une nouvelle session dispose ainsi d'un point de départ clair, et le relecteur peut auditer la couverture sans rejouer la conversation.

Définir ce qu'un point de contrôle doit conserver

Un bon point de contrôle contient l'état du travail et la preuve que cet état est juste. « Phase deux terminée » ne suffit pas si personne ne trouve le résultat. Indiquez chemin du livrable, version de l'entrée, critères vérifiés et écart restant.

Pour le code, notez la révision et les tests pertinents. Pour la recherche, gardez liens et dates de consultation. Pour les tableurs, préservez le classeur d'entrée et les changements appliqués. Si quelqu'un modifie le livrable, actualisez la sauvegarde avant de continuer, afin d'éviter les hypothèses périmées.

Choisissez des limites naturelles. Sauvegarder après chaque phrase crée de l'administration ; attendre plusieurs heures rend la reprise coûteuse. Un lot achevé, un changement validé ou une décision résolue constituent souvent de bons points de passage.

Reprendre sans refaire le travail

Consigne
Reprenez ce jalon à partir du suivi sauvegardé.
Inspectez les livrables actuels avant de les modifier.
Identifiez les critères déjà remplis et ne recommencez pas leur travail.
Vérifiez l'issue de toute action externe précédemment tentée.
Continuez par le prochain critère non satisfait.
Si les fichiers contredisent le suivi, expliquez et réconciliez d'abord.

Il faut distinguer tentative et réalisation. Un outil peut créer un enregistrement puis dépasser son délai. Avant de réessayer, consultez la destination pour déterminer ce qui s'est passé. Pour les fichiers locaux, cherchez un résultat partiel à achever plutôt qu'à écraser.

Lier le budget aux progrès utiles

Un pilote limité permet d'estimer le travail nécessaire. Pour les documents, suivez les pièces vérifiées et constats corrigés ; pour le code, les comportements acceptés. Incluez la révision humaine, car une sortie volumineuse nécessitant des heures de réparation n'est pas forcément productive.

Précisez la conduite à tenir à l'approche de la limite : sauvegarder le livrable, mettre à jour le suivi et présenter la prochaine décision. Un plafond de tokens bloque la dépense, mais ne garantit pas une transmission utile. Cette transmission doit faire partie du contrat.

Si plusieurs points de contrôle ne montrent plus de progrès, suspendez l'élargissement et cherchez le goulot d'étranglement. Il peut manquer une source, un jalon plus restreint, un outil différent ou une décision humaine. Augmenter le raisonnement n'est qu'une intervention possible.

Fixer une première ligne d'arrivée

« Construisez tout le produit » contient trop de décisions implicites. Commencez par une partie vérifiable : un parcours fonctionnel, une analyse validée ou un composant migré. Elle doit être assez utile pour révéler si le modèle comprend le projet.

ProjetPremier jalonPreuve
SiteUn parcours essentiel fonctionneContrôles d'interaction reproductibles
RechercheLes principales affirmations sont étayéesTableau des affirmations, liens et questions ouvertes
MigrationUn chemin représentatif est convertiAncien et nouveau comportements concordent là où nécessaire
Dossier de rapportsUne section complète correspond au briefContrôle des sources et relecture

Fixez le jalon avant de lancer. Changer d'objectif après chaque résultat intermédiaire rend difficile la distinction entre correction et dérive du périmètre.

Tableau public de Matt Shumer montrant la progression et les phases de préparation de sa revue

Suivi de préparation de la revue de Matt Shumer. Les compteurs consignent l'avancement sans constituer une validation indépendante.

Tenir un suivi compact

Le modèle a besoin de l'objectif actuel, des décisions, fichiers, tentatives échouées et vérifications restantes. Une longue transcription n'est pas toujours le meilleur moyen de retrouver ces informations. Maintenez une courte fiche inspectable et corrigeable.

Consigne
Jalon actuel :
Critères d'acceptation :
Emplacement des livrables et sources :
Décisions prises :
Approches écartées et motifs :
Résultats vérifiés :
Problèmes ouverts :
Prochaine action :

Actualisez cette fiche après un résultat significatif ou un changement de direction important. Évitez d'en faire le récit de chaque appel d'outil : elle doit faciliter la décision suivante.

Reconnaître trois formes de stagnation

Répéter une approche infructueuse

Demandez quelle nouvelle preuve justifie l'essai suivant. Réessayer après une panne transitoire peut être raisonnable ; répéter le même raisonnement sans information nouvelle l'est moins. Conservez les échecs pour que la prochaine session ne les redécouvre pas.

Peaufiner avant de terminer l'essentiel

L'agent peut polir le texte ou les détails visuels alors que le parcours central ne fonctionne pas. Revenez aux critères et repérez le plus important encore ouvert. Terminez-le avant d'ajouter des finitions.

Étendre le périmètre pour résoudre une ambiguïté

Si la demande est floue, le modèle peut bâtir davantage d'infrastructure plutôt que résoudre le choix manquant. Demandez la plus petite incertitude qui change la conception. Réglez-la avant une refonte étendue.

Préparer la reprise après interruption

L'annonce d'Astra prévient que les protections peuvent arrêter du travail légitime. Réseau, plantage et changement de demande peuvent aussi interrompre l'exécution. Sauvegardez les résultats utiles pendant le travail et vérifiez leur état avant de reprendre.

Une session relancée doit lire les fichiers et le suivi actuels, identifier le travail achevé et poursuivre le prochain critère ouvert. Si une action externe a pu être réalisée, vérifiez son résultat avant de la répéter.

Modèle de prompt pour une tâche longue

Consigne
Achevez ce jalon : [résultat précis].
Critères d'acceptation : [contrôles observables].
Matériaux et outils autorisés : [périmètre].
Tenez un bref suivi des décisions et progrès vérifiés.
Priorisez les exigences essentielles inachevées avant les finitions.
En cas de stagnation, expliquez l'obstacle et la preuve nécessaire.
À la limite du budget, livrez les résultats utilisables et l'action suivante.

Tous les projets ne nécessitent pas plusieurs agents. Ajoutez un rôle distinct seulement s'il produit une sortie vérifiable indépendamment. La coordination peut devenir une charge, surtout lorsque plusieurs agents éditent le même livrable.

Mesurer ensemble progression et coût

Suivez critères remplis, corrections humaines, durée et consommation totale. Un point de contrôle utile peut préciser que deux parcours sur trois passent, que le troisième échoue de façon reproductible et que le correctif est prêt à relire. « Toujours en cours » ne suffit pas à décider si une heure de plus est justifiée.

Conservez brief, sources, brouillons et décisions dans Ottermind. Pour commencer plus petit, utilisez les modèles de comment utiliser GPT-6 ; pour les budgets d'intégration, consultez le guide API.

Questions fréquentes

GPT-6 peut-il finir un projet à partir d'un prompt ?

Certains créateurs décrivent ce point de départ, mais environnement, outils, préparation et révision ultérieure comptent toujours. Commencez par un jalon précis.

Combien de temps laisser un agent travailler ?

Fixez un budget adapté et contrôlez l'avancement aux étapes utiles. Il n'existe pas de durée universelle.

Que faire s'il ne peaufine que des détails ?

Rappelez le critère ouvert le plus important et reportez les finitions facultatives jusqu'à sa satisfaction.

Faut-il ajouter des agents quand le travail ralentit ?

Identifiez d'abord la cause. Des exigences manquantes ou une mauvaise approche appellent clarification ou correction, pas davantage de parallélisme.

Que doit rendre une exécution arrêtée ?

Des livrables utilisables, des résultats vérifiés, les questions ouvertes et une prochaine action concrète, pour reprendre sans refaire les étapes achevées.

Téléchargez l’app desktop et mobile

Accédez à Ottermind à tout moment, où que vous soyez.

Ordinateur