Ana sayfa → Yardım
context_length_exceeded – sınıra gerçekte neler sayılır
Girdi ve istenen çıktı birlikte pencereye sığmalıdır. Tüm mesaj geçmişiniz her çağrıda sayılır ve max_tokens önceden ayrılır – yani istem tek başına sığacak olsa bile istek bu rezervasyon yüzünden başarısız olabilir.
Gördüğünüz hata
This model's maximum context length is N tokens, however you requested M tokenscontext_length_exceededinvalid_request_error: prompt is too longThe call worked yesterday and fails today with the same code
Neden oluyor
Sohbet API'leri durumsuzdur. Her tur tüm geçmişi yeniden gönderir, yani bir saattir süren bir konuşma tek bir mesaj değil hepsini gönderir. Sabah çalışan kodun hiçbir şey değişmeden öğleden sonra başarısız olmaya başlamasının sebebi budur.
max_tokens bir rezervasyondur, alacağınız şeyin üst sınırı değil. 8.000 çıktı token'ı istemek, istem daha ölçülmeden bütçeden 8.000 düşer.
Sistem istemleri, araç tanımları ve few-shot örnekleri diff'te genellikle görünmez ama sayımda fazlasıyla vardır. Büyük bir araç şeması her bir çağrıda binlerce token tutabilir.
Nasıl düzeltilir
- max_tokens'ı gerçekten ihtiyacınız olana düşürünEn hızlı çözüm ve insanların atladığı çözüm. Cevaplar iki paragrafsa 8.000 token ayırmak hiçbir şey kazandırmaz, size alana mal olur.
- Mevcut mesajı değil geçmişi kısaltınSistem istemini, son birkaç turu ve öncesinin kısa bir özetini tutun. En eski turları atmak, şu an sorduğunuzu kısaltmaktan çok daha fazla alan kazandırır.
- Araç tanımlarını sayınAraç şemanızı serileştirip ölçün. Kullanılmayan araçları çıkarmak, konuşmaya yapacağınız her şeyden daha fazla alan açar.
Bağlam pencereleri modele göre değişir ve APICLAN'daki her model sayfası pencereyi fiyatın yanında listeler. Geçmişi kısaltmak faturayı da doğrudan düşürür, çünkü girdi token'ları her turda ücretlendirilir.
İlgili konular
Son kontrol: 2026-10-01. Canlı bir OpenAI uyumlu ağ geçidinde teşhis edilen
sorunlardan yazılmıştır, başka sitelerden derlenmemiştir.