LLM推論初出 9/11 15:28
「Critical」という格付けをGPT-6 Astraが受け取った週、このタスクが触れていいリポジトリは2つしかなかった
https://zenn.dev/topics/ai/feed·2026/9/11
AI要約
OpenAIの新モデル「GPT-6 Astra」が、セキュリティ対策を外した状態でエクスプロイト開発ベンチマーク「ExploitBench」で100%のスコアを記録。未知の脆弱性を発見し、システムへの権限昇格チェーンを構築した。サイバー能力が「Critical」レベルに到達したことを報告。
AI要点
- OpenAIのGPT-6 Astraは、安全対策なしでExploitBenchスコア100%を記録し、「Critical」レベルのサイバー能力を持つと発表された。
- Astraはゼロデイ脆弱性を2件発見し、サンドボックスエスケープと権限昇格チェーンを構築した。
- AnthropicのClaude Fable 5.1/Mythos 5.1もサイバー関連リクエストを分類し、高リスク利用を制限する設計を採用している。
- GPT-6 Astraは、防御担当者向けに段階的に制限緩和される「OpenAI Daybreak」プログラムを用意している。
- AIの能力向上に伴い、全部禁止ではなく用途ごとに許可・禁止・条件付き許可を分ける段階的な安全対策が重要になっている。
なぜ重要か
最先端AIモデルが高度なサイバー能力を示す一方で、その悪用リスクも増大しており、OpenAIやAnthropicは用途に応じた段階的なアクセス制御や安全対策を導入している。これは、AIの能力向上と社会実装における、安全性と利便性のバランスを取ることの重要性を示している。