エージェント初出 8/25 02:54
Prime Agent: 自己改善型RLMハーネス
Prime Agent: A Self-Improving RLM Harness
https://export.arxiv.org/api/query·2026/8/24
AI要約
大規模言語モデル(LLM)エージェントが長期間のタスクを遂行するためのフレームワーク「Prime Agent」を提案。IPython REPLと継続的なハルネスにより、外部情報や計算、過去の履歴、スキルなどを効果的に管理・利用します。
AI要点
- Prime Agentは、言語モデルが長期的なエージェンシーを発揮するために必要な外部情報と計算を扱うためのオープンソースハーネスである。
- IPython REPLとContinual Harnessにより、プログラムによるコンテキスト処理、テスト時の計算、履歴、メモリ、スキルを維持する。
- 再帰的なサブエージェントは、直接のエージェント間通信を通じて協調し、人間の検査と管理を可能にする。
- Prime Agentは、実行、回復、検証、リソースアカウンティングを標準化し、モデルの真の最大能力を測定する。
- ARC-AGI-3 RHAEで成功率を30%から95.5%に向上させ、様々な長文コーディングタスクで既存のハーネスを凌駕する。
なぜ重要か
Prime Agentは、言語モデルが外部ツールと連携し、長期的な記憶と推論能力を持つことで、より高度な自律的エージェントとして機能するための基盤を構築し、AIの応用範囲を広げる。