Home → Assistenza
Claude Code: API Error 400 prompt is too long
Tutto ciò che la sessione ha visto viene reinviato a ogni turno. Poche letture di file grandi o un solo output di comando molto lungo possono portare la conversazione oltre la finestra del modello, e da quel momento nulla di ciò che scrivi è abbastanza piccolo da starci.
Cosa vedi
API Error: 400 {"type":"error","error":{"type":"invalid_request_error","message":"prompt is too long"}}The session worked for an hour and then every message failsFailure starts right after reading a large file or a long command outputStarting a new session fixes it immediately
Perché succede
Le sessioni degli agenti sono cumulative per progettazione: il modello ha bisogno del contesto precedente per restare coerente. Il prezzo è che una singola lettura di un file da 40.000 token resta nella trascrizione per il resto della sessione.
Il colpevole abituale è l'output degli strumenti più che i tuoi messaggi. Un dump di log completo, una grande risposta JSON o un elenco di directory non filtrato possono essere più grandi di tutto ciò che hai scritto in un'intera giornata.
La compattazione aiuta, ma non è istantanea. Una volta superato il limite, la richiesta che dovrebbe avviare la compattazione può essere essa stessa rifiutata, ed è per questo che la sessione sembra bloccata.
Come risolvere
- Avvia una nuova sessione per un nuovo compitoLa soluzione più economica, che riduce anche la fattura: i token di input vengono addebitati a ogni turno, quindi una sessione gonfia costa di più per messaggio oltre a fallire.
- Leggi meno, filtra di piùPreferisci grep e intervalli di righe mirati alla lettura di file interi, e fai passare gli output lunghi dei comandi attraverso head o un filtro prima che entrino nella trascrizione.
- Controlla la base URL se è iniziato all'improvvisoUn cambiamento improvviso senza crescita della sessione può significare che sei passato a un modello con una finestra più piccola. Verifica quale modello sta usando davvero la sessione.
Su APICLAN la stessa regola vale per la fatturazione e per il limite: ogni turno reinvia l'intera conversazione, quindi i token di input si accumulano. Le letture dalla cache attenuano il costo ma non la finestra: quei token continuano a contare.
Articoli correlati
Ultima verifica: 2026-10-01. Scritto a partire da problemi diagnosticati su un gateway
compatibile con OpenAI in produzione, non raccolto da altri siti.