Tag
LLMによるソーシャルシミュレーションはスケーリングで改善されるか?
本研究では、大規模言語モデル(LLM)のスケールアップが社会的シミュレーションの精度向上に寄与するかを検証した。Gemma、Llama、OLMo、Phi、Qwen、Yiを含む35のベースLLMを評価した結果、Yi 1.5 34Bが65%の精度を達成したが、対数スケールでの性能向上の速度は遅く、計算資源の限界が示唆された。