LLM推論初出 6/10 02:49
推論モデルにおける将来の行動予測により、より良いステアリングが可能に
Predicting Future Behaviors in Reasoning Models Enables Better Steering
https://export.arxiv.org/api/query2026/6/10
AI要約
大規模推論モデル(LRM)の将来の挙動を予測する能力が、より効果的なテスト時ステアリングに繋がることを示唆。内部特徴量ではなく、将来の行動を予測するプローブを学習ターゲットとする。