LLM推論初出 7/22 06:13
GPT-5.6、Claude、Gemini、Grokでモナ・リザを「描く」
"Drawing" the Mona Lisa with GPT-5.6, Claude, Gemini, and Grok
https://hacker-news.firebaseio.com/v02026/7/22
AI要約
GPT-5.6、Claude、Gemini、Grokといった主要なLLMを用いて「モナ・リザ」を描画する試みが行われました。各モデルの画像生成能力と、テキスト指示からの創造的な解釈能力が比較評価されています。
AI要点
- GPT-5.6、Claude、Gemini、Grokの4つの視覚モデルでモナ・リザの描画を試みた。
- モデルは、色、線の太さ、筆圧を設定し、ストロークを描き、消去する。
- 描画タスクは、モデルの能力を測るためのオープンエンドで曖昧なタスクである。
- Claude Fable 5は、最も時間がかかり、コストも高かったが、出力は劣っていた。
- Grok 4.5は描画タスクで苦戦し、オープンウェイトモデルは実用的ではなかった。
なぜ重要か
最先端の視覚モデルに「描画」というオープンエンドなタスクを実行させることで、ベンチマークだけでは見えないモデル間の能力差や、タスク遂行コストを可視化する。