LLM推論初出 5/27 02:55
スパースオートエンコーダーからのモデル内部情報でLLMポストトレーニングデータエンジニアリングをガイド
Guiding LLM Post-training Data Engineering with Model Internals from Sparse Autoencoders
https://export.arxiv.org/api/query2026/5/27
AI要約
スパースオートエンコーダ(SAE)を用いてLLMの内部表現からデータ特性(多様性、難易度、品質)を抽出し、ファインチューニング用データエンジニアリングをガイドするフレームワーク「SAERL」を提案。