Claude Code s'est arrêté : ce n'est pas forcément le modèle qui a lâché. En 2026, le cas le plus fréquent, c'est d'avoir buté sur le Session Limit, le quota hebdomadaire, ou le plafond Opus à part. Les trois plafonds tournent en même temps, les messages d'erreur se ressemblent, et les parades n'ont rien à voir.
Anthropic ne publie pas de volumes Token précis : les forfaits se décrivent en multiples du Pro. Cet article reprend le mécanisme officiel — quotas hebdo Pro, Max 5x et 20x, fenêtre glissante de 5 heures, consommation de tokens, horaires de reset, et ce que coûte un dépassement via API ou Usage Credits.
Distinguez d'abord les trois plafonds
Un abonnement Claude Code a trois verrous en parallèle. Session et quota hebdo sont partagés entre tous les modèles : /model ne vous en sort pas. Seul le plafond Opus est propre à ce modèle.
You've hit your session limit · resets 3:45pm
You've hit your weekly limit · resets Mon 12:00am
You've hit your Opus limit · resets 3:45pm
| Plafond | Rôle | Forme | Changer de modèle aide-t-il ? |
|---|---|---|---|
| Session (5 h) | Freiner un pic trop violent | Fenêtre glissante, la conso expire progressivement | Non, tous les modèles |
| Quota hebdomadaire | Plafonner le volume de la semaine | Reset selon le cycle du compte | Non, tous les modèles |
| Plafond Opus | Protéger le modèle le plus cher | Compteur séparé | Oui, Sonnet / Haiku permettent de continuer |
L'offre Free n'inclut pas Claude Code. Web, Desktop et Claude Code puisent dans le même pool.
Pro vs Max : comparer les quotas hebdo
Les prix font foi sur la page tarifaire officielle Claude (septembre 2026) :
| Forfait | Mensuel | vs Pro | Pour qui |
|---|---|---|---|
| Pro | $20 (environ $17 en annuel) | 1× | Une session, usage intermittent |
| Max 5x | $100 | 5× Session + quota hebdo | Claude Code tous les jours, à temps plein |
| Max 20x | $200 | 20× Session + quota hebdo | Multi-sessions, gros dépôts, agents longs |
Retours communautaires (pas un tableau Token officiel, juste un ordre de grandeur) : Pro tient environ 40–80 heures de calcul Sonnet utiles par semaine ; Max 5x plutôt 140–240 heures Sonnet, plus une marge Opus ; Max 20x peut aller à 240–480 heures Sonnet. La durée réelle dépend du modèle, de la longueur du contexte et du volume des sorties d'outils — pas du « nombre de messages ».
Depuis le 6 mai 2026, la fenêtre de 5 heures des forfaits payants a à peu près doublé, et les réductions aux heures de pointe ont disparu. Le quota hebdo a déjà eu une promo +50 % : c'est /usage sur votre compte qui fait foi, pas un fil de l'an dernier.
Ne confondez pas Fable 5 et le quota hebdomadaire
Fable 5 est un modèle premium plus cher, pas le modèle par défaut. Sur Max / sièges avancés, vous pouvez y consacrer jusqu'à 50 % du quota hebdo — une tranche du même pool, pas 50 % en plus. Sur Pro, Fable 5 bascule généralement en Usage Credits dès la première requête.
Pour comparer la valeur d'un abonnement avec Cursor, voir Cursor Pro en vaut-il la peine ? Analyse des coûts réels.
Session Limit : 5 heures glissantes, pas un reset à l'heure pile
Le Session Limit mesure les tokens consommés sur les 5 dernières heures, pas un « reset tous les jours à 9 h ».
- Un pic de 9 h à 11 h se recharge progressivement l'après-midi, pas d'un coup à une heure ronde.
- L'erreur donne une heure précise, par exemple
resets 3:45pm. C'est le point où la fenêtre se vide ; en attendant, la capacité remonte déjà. - Les sessions parallèles du même compte partagent ce pool. Trois fenêtres ≈ ×3 de conso ; en mode plan, une équipe d'agents tourne officiellement autour de 7× une session normale.
Max n'annule pas le Session Limit : il agrandit seulement le seau de 5× ou 20×. Deux comptes Max 5x ($200) coûtent autant qu'un Max 20x, mais vous donnent deux fenêtres indépendantes — souvent plus rentable en travail parallèle.
Consommation de tokens : les cinq vrais gouffres
Les plafonds comptent en tokens / calcul, pas en tours de conversation. Un scan Opus d'un gros dépôt peut coûter plus que cinquante courts messages Haiku.
- Choix du modèle : Opus / Fable coûtent plusieurs fois Sonnet ou Haiku. Par défaut,
/model sonnetou Haiku ; Opus seulement pour les vrais nœuds. - Contexte long : toute la conversation est renvoyée à chaque requête. Une session ouverte toute la journée, même un « continue », facture tout l'historique.
- Cache miss : sous abonnement, le Prompt Cache tient environ 1 heure ; en Usage Credits ou clé API, il tombe souvent à 5 minutes. Une pause déjeuner trop longue, et la première requête de l'après-midi est facturée en entrée complète.
- Sorties d'outils : un
grepde 4000 lignes, un log de tests entier, un fichier source de 6000 lignes — tout entre dans le contexte et se renvoie aux tours suivants. - Parallèle et tâches planifiées : multi-agents et cron emportent le contexte complet à chaque tir. Une session idle est presque gratuite ; les résumés en arrière-plan restent légers, pas les scheduled tasks.
Ordre pour économiser : tâche sans lien → /clear (gratuit), pas /compact d'abord (la compaction est elle-même une grosse requête) ; gardez CLAUDE.md vers 200 lignes, les détails dans des Skills chargés à la demande. Pour écrire des Skills : modèles Claude Code Skills 2026 (100+ exemples gratuits).
# Dans la session : changer de modèle et d'effort
/model sonnet
/effort low
# Tâche sans lien : renommer puis vider, moins cher que compact
/rename api-auth-fix
/clear
Lire les horaires de reset
| Plafond | Reset | Où regarder |
|---|---|---|
| Session 5 h | Glissant, l'erreur donne l'heure | Message d'erreur, /usage, status line |
| Quota hebdo | Cycle du compte (souvent lundi 0 h) | /usage, claude.ai → Settings → Usage |
| Plafond Opus | Cycle indépendant | Idem ; changer de modèle pour continuer tout de suite |
/usage lit l'historique local de la session. L'usage d'un autre ordinateur ou de claude.ai n'y figure pas. Pour le compte entier, c'est la page Usage du web qui fait foi.
Une status line personnalisée peut afficher les deux fenêtres en continu :
{
"rate_limits": {
"five_hour": { "used_percentage": 23.5, "resets_at": 1738425600 },
"seven_day": { "used_percentage": 41.2, "resets_at": 1738857600 }
}
}
Une fois le mur atteint : attendre, rétrograder, ou payer le surplus
- Session / quota hebdo : changer de modèle ne sert à rien. Attendez que la fenêtre se recharge, ou continuez avec
/usage-creditsau tarif API (plafond mensuel possible ; plafond de rachat quotidien souvent à $2,000). - Plafond Opus :
/model sonnetou Haiku tout de suite, le travail continue. - HTTP 429 : c'est un plafond de débit API, pas une fenêtre d'abonnement. Vérifiez d'abord qu'aucun
ANTHROPIC_API_KEYn'est mal posé dans l'environnement, puis baissez la concurrence.
Sur Team / Enterprise sans droits de facturation, /usage-credits envoie une demande à l'admin. Une fois sur Credits, le cache vit moins longtemps : le même travail « coûte » plus.
Pour le lien avec le « contrôle d'ordinateur par l'IA », voir Claude Code et OpenAI Computer Use : la relation en 2026.
Abonnement vs API : lequel coûte moins cher
L'abonnement a les fenêtres 5 h et hebdo ; une clé API n'a ni l'une ni l'autre — seulement tokens et débit par minute. Le surplus Usage Credits = tarif API standard.
Tarifs officiels (par million de tokens, septembre 2026, Claude API Pricing) :
| Modèle | Entrée | Sortie | Cache hit |
|---|---|---|---|
| Haiku 4.5 | $1 | $5 | $0.10 |
| Sonnet 5 | $2 | $10 | $0.20 |
| Opus 5 / 4.8 | $5 | $25 | $0.50 |
| Fable 5 | $10 | $50 | $1 (plus bas sur 5.1) |
Ordre de grandeur : une tâche agent moyenne ≈ 80k entrée + 8k sortie, environ $0.24 en Sonnet 5 ; le même volume en Opus 5 ≈ $0.60. Un Prompt Cache hit peut ramener l'entrée à ~10 % (Fable 5.1 ≈ 2,5 %). Le Batch API fait encore −50 %, mais c'est asynchrone — peu adapté au code interactif.
Comment choisir :
- Une ou deux sessions concentrées par jour → Pro suffit en général.
- Journées pleines en semaine, Session Limit fréquent → Max 5x.
- Plusieurs fenêtres en parallèle, gros dépôt → Max 20x, ou deux Max 5x sur des comptes séparés.
- Batch de nuit, asynchrone OK → API / Batch souvent moins cher qu'un forfait trop juste.
- Dépassement ponctuel → Usage Credits, pas besoin d'upgrader tout le mois.
Questions fréquentes
Le Session Limit compte-t-il les messages ?
Non. Les trois plafonds suivent les tokens et le calcul. Plus le contexte est long, les sorties d'outils volumineuses et le modèle cher, plus ça brûle vite.
Passer à Sonnet lève-t-il la limite de session ou hebdomadaire ?
Non. Seul le plafond Opus se rétablit tout de suite en changeant de modèle. Session et quota hebdo sont partagés par tous les modèles.
Max a-t-il encore des limites ?
Oui. Max multiplie seulement les quotas session et hebdo de Pro par 5 ou 20. Le mécanisme ne change pas.
L'API a-t-elle des fenêtres de 5 heures et hebdomadaires ?
Non. L'API facture au token ; ce que vous heurtez, c'est le débit d'organisation (429), pas une fenêtre d'abonnement.
Quelle source fait foi pour les chiffres de quota ?
/usage et la page Usage de claude.ai. Les heures et comptes de messages dans les articles tiers sont des estimations ; Anthropic peut ajuster multiplicateurs et promos à tout moment.
Dépenser le quota là où ça compte — et une machine qui tient
Les limites Claude Code suivent les tokens cloud, mais l'agent lit le dépôt en local, lance les tests, ouvre MCP. Fermez le portable : session coupée, cache mort, et la première requête de l'après-midi est facturée en entrée complète. Un Mac mini consomme environ 4W au repos — assez pour laisser un terminal ouvert 24 h/24, pour que /usage et la fenêtre glissante suivent votre rythme, pas le clapet.
La mémoire unifiée Apple Silicon rend plus stables l'indexation des gros dépôts et les tests en parallèle ; Unix natif, Homebrew, Docker, SSH : macOS est prêt à l'emploi, et le computer-use de Claude Code a macOS pour terrain principal. Face à une machine Windows au même prix : moins de plantages, mieux en non-supervisé ; Gatekeeper et SIP réduisent aussi le risque d'un agent qui tourne longtemps.
Si vous calculez déjà chaque token du quota hebdo, un Mac cloud stable et sobre évite de « couper la session puis rebrûler le contexte » — voir les forfaits, et dépensez les tokens à corriger du code, pas à se réchauffer.
