Skip to content
雙週報告双周报告 | 2026.08.27 – 09.09

深度分析深度分析 · 2026年9月9日

AI App線AI App线 VLA線VLA线 社交情報社交情报 校準校准

🤔

双周反思 | 2026-08-27 – 2026-09-09

读完没立场 = 这两周在消费而不在研究

1️⃣

380 篇样本中 ⚡ 级突破论文为零,📖(增量)占 67.9%,15 个方法族全部减速或冷却。你认为这是范式触顶的明确信号,还是当前 RSS 采集范围存在盲区?如果给你一周额外算力,你会把搜索半径扩大到哪个子领域?

2️⃣

CALVIN 和 LIBERO 全部核心切分已饱和,但 21 次 SOTA 刷新仍集中在这两个基准上。继续在这些基准上刷分是在推进 VLA 能力,还是在制造学术通货膨胀?如果明天所有实验室同时放弃 CALVIN/LIBERO,VLA 研究靠什么证明自己的进步?

3️⃣

产业端:Genesis v1.4.0(9/6 发布,支持轨迹回放与 bit-exact replay)、宇树格斗机器人、小鹏 XOS 6.3.0 搭载 Infini-VLA。学术界动量全面衰退的同时产业在狂奔。你认为学术界是否已经失去了定义 VLA 下一代标准的资格?如果是,谁在接棒?

4️⃣

flow_matching(27 篇,0.6)与 rl_finetuning(38 篇,1.03)双强组合成为唯一解,instruction_tuning(3 篇,0.11)和 diffusion_policy(11 篇,0.23)接近死亡。这是技术收敛还是学术从众?如果 6 个月后出现一个用扩散策略在真实机器人上超越 flow+RL 的工作,它最可能长什么样?

5️⃣

过去两周社交情报完全静音——零一级信号、零二级信号。这是产业进入静默部署期,还是我们的信号源已经老化?结合VLA-Precision(在线 RL 后训练)和TacPAC(触觉+世界动作模型)这两篇 🔧 级论文的出现,你认为下一个社交引爆点会来自哪个方向?

🔬

TacPAC 给 world-action model 补上了触觉通道,用触觉预测做实时动作修正。但它的核心洞察是 timing mismatch——预测先于执行,触觉反馈在执行中到达。你能说清 TacPAC 具体用什么机制桥接这个时间差吗?如果不能,这篇论文是你这两周最该精读的材料。

🔬

VLA-Precision 提出 asymmetric co-bootstrapping 组织真机在线 RL 样本,解决价值信号不可靠和 VLA 推理开销大的双重瓶颈。你能画出它的双策略交互流程图吗?如果让你把这个框架迁移到你的触觉 VLA 管线上,第一个要改的组件是什么?

🔬

Reasoning Without Inference Cost 提出 latent semantic scaffolding——在训练时将推理结构嵌入潜空间,部署时丢弃推理模块。这个"训练时推理、部署时不推理"的范式,跟传统的 knowledge distillation 本质区别在哪?如果推理信息真的完全编码进了 latent space,为什么现有的 VLA 策略在分布外场景依然脆弱?