LLM推論初出 8/30 08:42
Claude Code × Ollamaのコンテキスト上限を整理する — 1Mモデルが200kに縮む3つの原因と解法
https://zenn.dev/topics/ai/feed2026/8/30
AI要約
OllamaでClaude Codeを使用する際、コンテキスト上限が1Mから200kに圧縮される原因を3つ特定し、alias設定による解決策を提示。
AI要点
- Ollamaのクラウドモデル(例: glm-5.3:cloud)は1Mコンテキストを持つが、Claude Codeでは200kに圧縮される現象が発生する。
- この現象は、Ollama、Claude Code、ollama launchの3つのレイヤーでコンテキスト上限値がそれぞれ設定されていることに起因する。
- Claude Codeは未知のモデルIDに対し、デフォルトで200kコンテキストウィンドウを仮定してauto-compactを行う。
- ollama launchはモデル名の検証を先に行うため、Claude Code用の記法(例: `[1m]`)が伝わらず、モデル名として認識されない。
- 環境変数 `CLAUDE_CODE_MAX_CONTEXT_TOKENS=1048576` を設定することで、1Mコンテキストの実力を取り戻すことができる。
なぜ重要か
OllamaとClaude Code間のコンテキスト上限に関する複雑な設定問題を、レイヤー構造と設計意図から詳細に解明し、具体的な解決策(環境変数設定)を提示することで、ユーザーがAIモデルの性能を最大限に引き出すための実践的な知識を提供する。