Compaction serveur (API)
Fonctionnalité bêta de l’API Claude (compact-2026-01-12) : équivalent paramétrable du résumé-automatique-claude-ai, pour les agents et workflows long-running.
Mécanisme
- Seuil de déclenchement configurable (
trigger, défaut 150K tokens d’input) - Une fois atteint, l’API insère une étape : le modèle résume la conversation
- Le résumé devient un bloc spécial
type: "compaction" - Requêtes suivantes : on renvoie ce bloc → l’API ignore tout ce qui précède, repart du résumé
Paramètres utiles
instructions: remplace complètement le prompt de résumé par défaut (ex : “priorise le code et les décisions techniques”)pause_after_compaction: pause juste après le résumé pour injecter des messages manuellement avant de continuer (garder certains échanges “mot pour mot”)
Points pratiques
- Étape de résumé = appel supplémentaire → compte dans facturation et rate limit (visible dans
usage.iterations) - Se combine avec mise-en-cache-des-prompts pour éviter de recacher tout le system prompt à chaque compaction
- Variante
compact-2026-09-04: compaction “à la demande”, en tâche de fond, plutôt que par seuil automatique
Limite importante
Ne peut pas rattraper une requête déjà trop grosse — voir dépassement-de-prompt-unique. Il faut compacter avant de dépasser la fenêtre, pas après.