メインコンテンツへスキップ
Cernoval
トップ
Topic
Claude Opus 4.8
モデル
ベンチマーク
Stanford LegalBench
0.823
2026-08-24
Super-Agent benchmark
100%
2026-05-28
Online-Mind2Web
84%
2026-05-28
Legal Agent Benchmark
10%
2026-05-28
関連トピック
同じ記事で一緒に扱われたトピックです。
Opus 4.7
GLM-5.2
GPT5.5
Opus 5
Claude Opus
Claude Opus 5
Alibaba's Qwen3.8-Max
Ornith-1.5
DeepSeek-V4-Flash-Vision-Exp
判明している事実
コーディング能力:
向上
長文処理能力:
向上
計算速度:
Opus 4.7 の 2.5 倍
オンライントラッキング:
84%
法律エージェントベンチマーク:
10% 以上
関連レポート・記事
[1927] Claude Opus 4.8
★10
【2026年5月】Claude Opus 4.8がリリース!Dynamic Workflows・誠実性向上・API変更点まとめ
★9
[21313] Thomson Reuters、Claudeへの依存を減らすため独自AIモデルを構築
★9
トピック一覧
トップに戻る