|
|
@@ -49,6 +49,28 @@ class OpenAICompatProvider(LLMProvider):
|
|
|
"zhipu": ("https://open.bigmodel.cn/api/paas/v4", "glm-4", "ZHIPU_API_KEY"),
|
|
|
}
|
|
|
|
|
|
+ # 各模型真实输入上限(token)。base.py 默认 200000 对 qwen-max 是错的——qwen-max
|
|
|
+ # 实际只有 30720(dashscope 报 "Range of input length should be [1, 30720]")。
|
|
|
+ # 不设对的话 ConversationLam 的 max_history(min(cw//2,80000))会放行 80000 token
|
|
|
+ # 历史 → 累积超限 → 400。按模型名前缀匹配,未知则保持 config 原值。
|
|
|
+ _MODEL_CONTEXT_WINDOWS = {
|
|
|
+ "qwen-max": 30720, "qwen-plus": 131072, "qwen-turbo": 1000000,
|
|
|
+ "qwen-long": 10000000, "qwen2.5": 32768, "qwen2": 32768, "qwen3": 32768,
|
|
|
+ "deepseek": 65536, "moonshot-v1-8k": 8192, "moonshot-v1-32k": 32768,
|
|
|
+ "moonshot-v1-128k": 128000, "gpt-4o": 128000, "gpt-4-turbo": 128000,
|
|
|
+ "gpt-4": 8192, "glm-4": 128000,
|
|
|
+ }
|
|
|
+
|
|
|
+ @classmethod
|
|
|
+ def _resolve_context_window(cls, model: str):
|
|
|
+ m = (model or "").lower()
|
|
|
+ # 最长前缀优先(qwen-max-longcontext 命中 qwen-max;但更具体的先匹配)
|
|
|
+ best = None
|
|
|
+ for key, cw in cls._MODEL_CONTEXT_WINDOWS.items():
|
|
|
+ if m.startswith(key) and (best is None or len(key) > len(best[0])):
|
|
|
+ best = (key, cw)
|
|
|
+ return best[1] if best else None
|
|
|
+
|
|
|
def __init__(self, config: ProviderConfig, provider_name: str = "openai",
|
|
|
api_key: str = "", base_url: str = "", model: str = ""):
|
|
|
super().__init__(config)
|
|
|
@@ -68,6 +90,11 @@ class OpenAICompatProvider(LLMProvider):
|
|
|
if model:
|
|
|
self.config.model = model
|
|
|
|
|
|
+ # 按真实模型设 context_window(治 qwen-max 被当 200000 → 历史超 30720 → 400)。
|
|
|
+ _cw = self._resolve_context_window(self.config.model)
|
|
|
+ if _cw:
|
|
|
+ self.config.context_window = _cw
|
|
|
+
|
|
|
# L03: Token-usage accumulator — mirrors ClaudeCodeProvider.get_usage()
|
|
|
# so agentpaas cost tracking works for any provider.
|
|
|
self._usage_input = 0
|