LLM推論初出 7/24 20:21
GPT-5.5登場 — Terminal-Bench 2.0で82.7%、エージェント特化モデルの実像
https://zenn.dev/topics/ai/feed2026/7/24
AI要約
OpenAIが発表したGPT-5.5について、Terminal-Bench 2.0で82.7%のスコアを記録したこと、エージェント特化モデルとしての位置づけ、そしてAPI利用料金などを解説。Claude Opus 4.7登場直後の新モデル投入であり、その性能と課金体系の理解を深めることを目的としている。
AI要点
- OpenAIがエージェント型コーディングに特化した新モデル「GPT-5.5」を発表、APIでも利用可能になった。
- Terminal-Bench 2.0で82.7%を記録し、複数ツールを長時間利用するタスク完遂能力に優れるとされる。
- API料金は入力 $5/1M tok、出力 $30/1M tokだが、272Kトークン超のセッションでは入力2倍・出力1.5倍に増加する。
- Claude Opus 4.7とは得意領域が異なり、コーディング能力重視ならOpus、長時間ツール利用エージェントならGPT-5.5と使い分けが有効。
- 長時間エージェント運用では高額なAPI料金が発生する可能性があり、セッション管理によるコスト最適化が重要となる。
なぜ重要か
GPT-5.5はエージェント型コーディングに特化し、長時間タスク実行能力を強化したが、API料金体系は長文コンテキスト利用時に大幅に上昇するため、コスト効率を考慮した運用設計が不可欠となる。