ハードウェア重要度 ★9
FurnitureVLA:Vision-Language-Actionモデルによる長期間の二腕家具組み立て学習
FurnitureVLA: Learning Long-Horizon Bimanual Furniture Assembly with Vision-Language-Action Model
https://export.arxiv.org/api/query·2026/7/1
AI要約
現実スケールの双腕による家具組み立てを、Vision-Language-Actionモデル(VLA)を用いて行う「FurnitureVLA」を提案。タスクを形式化し、シミュレーションパイプラインとVRテレオペレーションシステムを開発。
AI要点
- Vision-Language-Actionモデル(VLA)を用いた二腕による家具組み立て学習システム「FurnitureVLA」が提案された。
- 現実スケールの双腕ロボットによる家具組み立てタスクを学習する。
- タスクの形式化、シミュレーションパイプライン、VRテレオペレーションシステムを開発した。
- ロボットによる複雑な実世界タスク実行能力の向上を目指している。
なぜ重要か
FurnitureVLAは、VLAモデルと現実スケールのロボット操作を組み合わせることで、複雑な物理的タスクにおけるAIの応用範囲を広げ、自律型ロボットシステムの開発を加速させます。