LLM推論初出 9/2 08:57
Claude Fable 5.1で素晴らしいアニメーションのペリカンが作れた
Claude Fable 5.1 made me a really nice animated pelican
https://simonwillison.net/atom/everything/2026/9/2
AI要約
AnthropicのClaude Fable 5.1は、コーディング、知識作業、長期的な問題解決タスクにおいて新基準を打ち立てるとされています。特に、新しいベンチマーク「Terminal-Bench-Science 0.1」で高いスコアを記録し、その能力を示しています。
AI要点
- Claude Fable 5.1で「ペリカンが自転車に乗るSVG」を生成するデモを実行。
- 低・中レベルの推論設定では、ペリカンSVG生成時に推論がスキップされる挙動が見られた。
- 高レベル設定では推論が行われ、SVGレイアウトの計画などが示された。
- Claude Fable 5.1は科学分野のベンチマークで大幅にスコアを向上させた。
なぜ重要か
最新AIモデルの推論能力や、特定タスク(ここではSVG生成)における挙動の差異が明らかになり、モデルの性能評価や実用上の限界を理解する上で参考になります。