LLM推論初出 7/31 12:06
OpenAIがGPT-5.6のハーネスを改善してARC-AGI-3のスコアを3倍に向上させることに成功、モデル自体の性能だけでなくハーネスも重要であることを示す
https://gigazine.net/news/rss_2.0/2026/7/31
AI要約
OpenAIは、AIの知能を未知のゲームで測定するベンチマーク「ARC-AGI-3」におけるスコアを3倍に向上させた方法を解説しました。GPT-5.6のハーネス改善がモデル自体の性能向上に寄与したことを示しており、AI開発における重要な知見を提供しています。
AI要点
- OpenAIは、GPT-5.6モデルの性能向上に貢献する「ハーネス」の改善に成功した。
- これにより、ARC-AGI-3ベンチマークのスコアが3倍に向上した。
- モデル自体の性能だけでなく、学習を補助するハーネスの最適化も重要であることを示唆している。
なぜ重要か
GPT-5.6のハーネス改善による大幅な性能向上は、大規模言語モデルの学習効率と性能限界を引き上げる新たなアプローチを示しており、今後のAIモデル開発の方向性に影響を与える可能性がある。