Start → Hilfe

Claude Code: API Error 400 prompt is too long

Alles, was die Sitzung gesehen hat, wird bei jedem Durchlauf erneut gesendet. Ein paar große Dateien oder eine sehr lange Befehlsausgabe können die Unterhaltung über das Fenster des Modells hinausschieben, und ab dann ist nichts, was Sie eintippen, klein genug.

Was Sie sehen

Warum das passiert

Agent-Sitzungen sind bewusst kumulativ – das Modell braucht den früheren Kontext, um stimmig zu bleiben. Der Preis dafür: Eine einzige gelesene Datei mit 40.000 Tokens bleibt für den Rest der Sitzung im Verlauf.

Meist sind Tool-Ausgaben schuld, nicht Ihre Nachrichten. Ein kompletter Log-Dump, eine große JSON-Antwort oder ein ungefiltertes Verzeichnislisting kann größer sein als alles, was Sie den ganzen Tag getippt haben.

Komprimierung hilft, aber nicht sofort. Ist das Limit erst überschritten, kann die Anfrage, die die Komprimierung auslösen würde, selbst abgelehnt werden – deshalb wirkt die Sitzung festgefahren.

So beheben Sie es

  1. Für eine neue Aufgabe eine frische Sitzung startenDie billigste Lösung, und sie senkt auch die Rechnung: Input-Tokens werden bei jedem Durchlauf berechnet, eine aufgeblähte Sitzung kostet also pro Nachricht mehr und scheitert obendrein.
  2. Weniger lesen, mehr filternBevorzugen Sie grep und gezielte Zeilenbereiche gegenüber ganzen Dateien, und leiten Sie lange Befehlsausgaben durch head oder einen Filter, bevor sie in den Verlauf gelangen.
  3. Die Base URL prüfen, wenn es plötzlich anfingEine plötzliche Änderung ohne Wachstum kann bedeuten, dass Sie zu einem Modell mit kleinerem Fenster gewechselt sind. Prüfen Sie, welches Modell die Sitzung tatsächlich nutzt.
Bei APICLAN gilt für die Abrechnung dieselbe Regel wie für das Limit: Jeder Durchlauf sendet die ganze Unterhaltung erneut, Input-Tokens summieren sich also. Cache-Lesevorgänge mildern die Kosten, nicht das Fenster – die Tokens zählen trotzdem dazu.

Verwandte Themen

Unexpected token '<' beim Aufruf einer OpenAI-kompatiblen API401 invalid API key – wenn der Schlüssel richtig aussieht und trotzdem scheitert

Zuletzt geprüft am 2026-10-01. Geschrieben aus Problemen, die auf einem laufenden OpenAI-kompatiblen Gateway diagnostiziert wurden – nicht von anderen Seiten zusammengetragen.