LLM推論初出 9/5 19:42
OpenAI、GPT-6 Astraのベンチマーク数値を公開数日後に変更
OpenAI Changed GPT-6 Astra's Benchmark Numbers Days After Its Launch
https://startupfortune.com/feed/2026/9/5
AI要約
OpenAIが、GPT-6 Astraのベンチマーク数値を発表後に修正していたことが判明した。幻覚率の低減やサイバーセキュリティスコアの向上といった修正は、製品を有利に見せるためのものだった可能性がある。他社製品のスコアにも影響が及んでいる。
AI要点
- OpenAIがGPT-6 Astraのベンチマーク数値を公開数日後に変更しました。
- 変更には、幻覚(ハルシネーション)率の半減やサイバーセキュリティスコアの向上が含まれます。
- 一部のベンチマークは、商用利用できない特殊な環境下での計測結果でした。
- OpenAIは「AGI(汎用人工知能)時代」の到来を宣言しています。
なぜ重要か
AIモデルのベンチマーク数値の変更は、その評価手法の信頼性や透明性に関する議論を提起し、ユーザーがAIモデルの能力を正確に理解するための注意喚起となります。