Skip to content
VLA 線 · 查看同日 AI 報告 →查看同日 AI 报告 →
VLA 研究日報 Pulsar
LIVE
— AI 線今日無資料 —— AI 线今日无资料 —

VLA 研究日報VLA 研究日报

共 38 篇

🔧 技術技术

VLA [Stanford|Li]、[Stanford|Wu]

TrAct: Bridging Robot Control and Visual Prediction with Visual Tracks

Zhi Cao et al. · 提出以 visual tracks(视觉轨迹)作为与具体 embodiment 无关的中间表征,替代动作条件信号桥接机器人控制与世界模型视觉预测,直击动作与图像空间弱对齐的核心问题,对视频预测式世界模型设计有直接参考价值。

📖 背景閱讀背景阅读

VLA [University of Liverpool]

Gripper-aware Vision Language Action Models

Hanyi Zhang et al. · 在 VLA 中显式编码夹爪状态与感知信息以提升抓取和操作表现,弥补多数 VLA 忽视末端执行器配置的建模缺口,属输入表征层面的工程改进。

VLA [S-Lab, Nanyang Technological University]

VLANeXt: Recipes for Building Strong VLA Models

Xiao-Ming Wu et al. · 系统性地给出构建强 VLA 的配方(架构、数据、训练策略选择),通过大量消融提炼可靠实践,属 recipes 类工作总结,对自建 VLA 有实践指南价值。

VLA [The Hong Kong University of Science and Technology (Guangzhou)]

Platonic Representation Hypothesis on World Models

Wenhow Li et al. · 实证检验世界模型所学表征是否趋同于共享的柏拉图式表征,揭示多任务世界模型内部表征收敛规律,理论性工作,对理解 WAM 表征有间接启发。