Skip to content
VLA 線 · 查看同日 AI 報告 →查看同日 AI 报告 →
VLA 研究日報 Pulsar
LIVE
— AI 線今日無資料 —— AI 线今日无资料 —

VLA 研究日報VLA 研究日报

共 36 篇

⚡ 突破

VLA [NVIDIA]

Cosmos 3: Omnimodal World Models for Physical AI

NVIDIA et al. · NVIDIA发布Cosmos 3,提出全能模态世界模型,统一处理语言、图像、视频、音频及动作序列。显著推进了物理AI的世界建模能力,为VLA提供强大的先验和仿真基础,超越当前SOTA。

🔧 技術技术

VLA

Geometric Action Model for Robot Policy Learning

Jisang Han et al. · 提出几何动作模型(GAM),通过3D物理推理增强通用机器人策略的空间理解。相比传统VLA,更强调几何一致性,为解决长程依赖和空间错位提供新视角。

📖 背景閱讀背景阅读

VLA

Verifiable Foundation Models for Robot Safety

Davide Corsi et al. · 探讨基础模型在机器人控制中的可验证性与安全性问题,旨在解决黑盒模型的不可解释性。属于安全/形式化验证方向,对VLA部署有参考意义但非直接算法改进。

VLA

World Value Models for Robotic Manipulation

Zhihao Wang et al. · 探索世界价值模型在机器人操作中的应用,强调深度时间理解以准确估计价值。属于世界模型与RL结合的前沿探索,但目前主要停留在理论框架或初步实验阶段。

VLA

NavWM: A Unified Navigation World Model for Foresight-Driven Planning

Conventional visual navigation policies often struggle with myopic decision-making and mode collapse in complex environments. While world models offer a promising alternative, existing paradigms typically isolate perception, generation, and control, failing to capture their shared spatio-temporal dynamics. In this paper, we propose NavWM, a unified navigation world model that seamlessly integrates latent world reasoning, multimodal action prediction, and controllable visual generation. At its co

hf-papers 閱讀原文