Skip to content
VLA 線 · 查看同日 AI 報告 →查看同日 AI 报告 →
VLA 研究日報 Pulsar
LIVE
— AI 線今日無資料 —— AI 线今日无资料 —

VLA 研究日報VLA 研究日报

共 25 篇

🔧 技術技术

VLA [Massachusetts Institute of Technology]

Learning More from Less: Reinforcement Learning from Hindsight

Iris Xu et al. · 提出事后强化学习方法以提高 VLA 后训练的样本效率,利用历史 rollout 数据进行回溯更新。直接针对 VLA 训练成本高痛点,提供具体的 RL 精调改进方案,具有高复用价值。

📖 背景閱讀背景阅读

VLA [Massachusetts Institute of Technology]

Prompt-Driven Exploration

Sunshine Jiang et al. · 提出基于提示的探索方法以克服 RL 中随机抖动导致的局部采样局限。虽可能应用于机器人,但摘要未明确提及机器人实验或 Embodied AI 场景,暂归为相邻领域方法论。