Skip to content
CLASSIFIED · RESEARCH INTELLIGENCE | 週報 + 雙週 · WEEKLY + BIWEEKLY

情報報告情报报告

PULSAR INTELLIGENCE ARCHIVE  ·  週報偵察 + 雙週深度分析


週報(RECON)每週自動生成,聚焦意外信號、可證偽命題與觀察清單——前瞻偵察下週動態。雙週報(INTEL)深度回顧兩週研究進展,涵蓋預測驗證(✅ / ❌ / ⏳)、假設校準與反思修正。兩者交替覆蓋 VLA 和 AI 應用雙線。周报(RECON)每周自动生成,聚焦意外信号、可证伪命题与观察清单——前瞻侦察下周动态。双周报(INTEL)深度回顾两周研究进展,涵盖预测验证(✅ / ❌ / ⏳)、假设校准与反思修正。两者交替覆盖 VLA 和 AI 应用双线。

36 DISPATCHES
24 7D RECON
12 14D INTEL
VLA 雙週報告双周报告 2026.08.27 – 09.09

VLA 深度分析 · 2026年9月9日

🤔 双周反思 | 2026-08-27 – 2026-09-09 读完没立场 = 这两周在消费而不在研究 ━━━ 趋势与判断 ━━━ 1️⃣ 380 篇样本中 ⚡ 级突破论文为零,📖(增量)占 67.9%,15 个方法族全部减速或冷却。你认为这是范式触顶的明确信号,还是当前 RSS 采集范围存在盲区?如果给你一周额外算力,你会把搜索半径扩大到哪个子领域? 2️⃣ CALVIN 和 LIBERO 全部核心切分已饱和,但 21 次 SOTA 刷新仍集中在这两个基准上。继续在这些基准上刷分是在推进 VLA 能力,还是在制造学术通货膨胀?如果明天所有实验室同…

閱讀全文阅读全文 VLA  ·  AI App  ·  社交情報社交情报  ·  校準校准
反思 · 2026年9月9日

🤔 双周反思 | 2026-08-27 – 2026-09-09 读完没立场 = 这两周在消费而不在研究 ━━━ 趋势与判断 ━━━ 1️⃣ 380 篇样本中 ⚡ 级突破论文为零,📖(增量)占 67.9%,15 个方法族全部减速或冷却。…

查看反思 →
VLA 雙週報告双周报告 2026.08.27 – 09.09

VLA 深度分析 · 2026年9月9日

VLA 双周深度推理 | 2026-08-27 – 2026-09-09 > 基于 VLA-Handbook 过去 14 天的 50 次 commit + 全系统分析上下文 | 2026-09-09 本期核心信号 1. VLA 研究全面进入“降温与范式固化”期,15 个方法族全部减速或冷却,⚡级突破论文为零,领域明确滑入平台期内卷。 2. 产业端与学术界呈现剧烈倒挂:大厂已用世界模型实现量产与高动态对抗,而学界仍在饱和基准上低效刷分,现有评价体系彻底失效。 3. 架构路线完成洗牌:流匹配(27篇,0.6)与 RL 微调(38篇,1.03)双强组合成为唯一…

閱讀全文阅读全文 VLA  ·  AI App  ·  社交情報社交情报  ·  校準校准
反思 · 2026年9月9日

🤔 双周反思 | 2026-08-27 – 2026-09-09 读完没立场 = 这两周在消费而不在研究 ━━━ 趋势与判断 ━━━ 1️⃣ 380 篇样本中 ⚡ 级突破论文为零,📖(增量)占 67.9%,15 个方法族全部减速或冷却。…

查看反思 →
VLA 7D RECON 2026.08.29 – 09.04

VLA 偵察報告 · 2026年9月4日

VLA 週報 | 2026-08-28 to 2026-09-04 > 基於 VLA-Handbook 7 天系統數據 TL;DR - 推理加速成为部署核心瓶颈,FlashVLA 提出流式动作解码实现 VLA 异步低延迟推理,直接缓解 flow-matching 类模型的多步迭代延迟。 - 持续学习与失败恢复机制受重视,Memory Anchors 证明少量关键经验可替代全量 replay buffer 缓解灾难性遗忘,FLARE 显式建模失败驱动在线纠错。 - 产业端小鹏发布第二代 VLA 与 XOS 6.3.0,标志长序列架构正式上车;开源社区 is…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
AI 應用AI 应用 7D RECON 2026.08.29 – 09.04

AI App 偵察報告 · 2026年9月4日

AI 應用週報 | 2026-08-29 – 2026-09-04 > 基於 Agent-Playbook 7 天系統數據 開篇 Vibe Coding 的神話正在退訂潮中破碎,而 700 個失控 Agent 的協同攻擊已敲響安全警鐘。當通用大模型陷入「先部署後治理」的幻覺時,機器人領域的實時控制架構正悄然接管下一代 AI 基礎設施。 信號湧現地圖 本週生態呈現罕見的「總量斷崖與跨界滲透」反差。在僅 3 個有效工作日裡,精選信號僅 17 條,較上週暴跌 64%,戰略級亮點歸零。但實體榜單暗流湧動:OpenAI (92) 與 Anthropic (72) …

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
VLA 7D RECON 2026.08.22 – 08.28

VLA 偵察報告 · 2026年8月28日

VLA 週報 | 2026-08-21 to 2026-08-28 > 基於 VLA-Handbook 7 天系統數據 TL;DR - 触觉VLA进入执行时流式适配阶段,TacForcing 证明 chunk-based 策略可通过流式触觉反馈实时修正,无需独立高频控制器。 - 测试时适应(Test-Time Adaptation)成为新焦点,RA-VLA 证明无需梯度更新,仅靠检索增强即可让冻结VLA适应新任务分布。 - 产业端密集验证:WRC 2026 展示云端世界模型实时可视化,人形机器人运动会进入2056台高密度实战,梅卡曼德IPO标志资本向核心…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
AI 應用AI 应用 7D RECON 2026.08.22 – 08.28

AI App 偵察報告 · 2026年8月28日

AI 應用週報 | 2026-08-22 – 2026-08-28 > 基於 Agent-Playbook 7 天系統數據 開篇 安全敘事已死,工具繁榮只是麻醉劑。本週 47 條精選中實驗類僅 1 條,產業集體放棄高風險驗證,沉迷微創新。CTO 們,若下月實驗占比未突破 5%,這行已接受「先部署後治理」的豪賭。 信號湧現地圖 本週最反常的數據是「實驗」與「趨勢」類信號的雙雙枯竭。在 47 條精選中,「工具」(16條) 與「新發布」(12條) 合計佔據 60%,而「實驗」僅 1 條、「趨勢」僅 2 條。這表明產業界正處於高強度的戰術執行期,卻集體喪失了對高…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
VLA 雙週報告双周报告 2026.08.13 – 08.26

VLA 深度分析 · 2026年8月26日

🤔 双周反思 | 2026-08-13 – 2026-08-26 读完没立场 = 这两周在消费而不在研究 ━━━ 趋势与判断 ━━━ 1️⃣ 本期 languagegrounding(66篇,1.29x加速)与 rlfinetuning(39篇,1.26x加速)是唯二加速的方法族,其余13个全线减速或衰退。纯 instructiontuning 仅1篇,flowmatching(31篇)碾压 diffusionpolicy(13篇)。VLA研究真的已经收敛到"语言指令输入 + RL策略输出"的极简范式了吗?还是说这只是因为大部分团队在已饱和的 CALV…

閱讀全文阅读全文 VLA  ·  AI App  ·  社交情報社交情报  ·  校準校准
反思 · 2026年8月26日

🤔 双周反思 | 2026-08-13 – 2026-08-26 读完没立场 = 这两周在消费而不在研究 ━━━ 趋势与判断 ━━━ 1️⃣ 本期 languagegrounding(66篇,1.29x加速)与 rlfinetuning(…

查看反思 →
VLA 雙週報告双周报告 2026.08.13 – 08.26

VLA 深度分析 · 2026年8月26日

VLA 双周深度推理 | 2026-08-13 – 2026-08-26 > 基于 VLA-Handbook 过去 14 天的 50 次 commit + 全系统分析上下文 | 2026-08-26 本期核心信号 1. 研究重心彻底转向“语言锚定+RL闭环”:仅 languagegrounding(66篇,加速比1.29)与 rlfinetuning(39篇,1.26)双加速,其余13个方法族全线减速或衰退。 2. 基准饱和与实机验证断裂:40次SOTA刷新全部集中在已饱和的CALVIN与LIBERO,而产业端已通过2056台机器人的运动会进入高密度实战…

閱讀全文阅读全文 VLA  ·  AI App  ·  社交情報社交情报  ·  校準校准
反思 · 2026年8月26日

🤔 双周反思 | 2026-08-13 – 2026-08-26 读完没立场 = 这两周在消费而不在研究 ━━━ 趋势与判断 ━━━ 1️⃣ 本期 languagegrounding(66篇,1.29x加速)与 rlfinetuning(…

查看反思 →
AI 應用AI 应用 7D RECON 2026.08.15 – 08.21

AI App 偵察報告 · 2026年8月21日

AI 應用週報 | 2026-08-15 – 2026-08-21 > 基於 Agent-Playbook 7 天系統數據 開篇 安全护栏已死,工具繁荣只是麻醉剂。本周 42 条精选中“安全”类归零,而工具类占据 47.6%。我们正陷入“战术拥挤、战略真空”的集体幻觉:用层出不穷的 Agent 框架掩盖底层推理的脆弱性。CTO 们,如果下个月安全占比仍未突破 5%,说明行业已集体接受了“先部署后治理”的豪赌。 信號湧現地圖 本周最反常的数据是安全议题的彻底消失。上周安全类尚有 1 条(占 2.9%),本周 42 条精选中安全类直接归零。在 OpenAI …

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
AI 應用AI 应用 雙週報告双周报告 2026.08.06 – 08.19

AI App 深度分析 · 2026年8月19日

AI 应用双周深度推理 | 2026-08-06 – 2026-08-19 > 基于 Agent-Playbook 过去 14 天的系统数据 + 全域分析上下文 | 2026-08-19 本期核心信号 1. 基础设施收敛,应用层碎片化。 MCP 无状态架构(2.0)成为事实标准,但 68 条精选中“安全”仅 1 条(1.5%),战略级亮点连续为空。市场陷入“战术繁荣、战略空心”:团队在疯狂堆叠工具链,却无人定义下一代架构范式。 2. 资本抢购“交互入口+数据底座”,而非模型参数。 SpaceX 600 亿美元收购 Cursor、Databricks 再融…

閱讀全文阅读全文 VLA  ·  AI App  ·  社交情報社交情报  ·  校準校准
VLA 7D RECON 2026.08.08 – 08.14

VLA 偵察報告 · 2026年8月14日

VLA 週報 | 2026-08-07 to 2026-08-14 > 基於 VLA-Handbook 7 天系統數據 TL;DR - VLA RL 训练框架进入工程收敛期:RLinf-VLA 提供统一平台,World Tokens 在训练时嵌入世界建模,RoboHarness 用记忆增强解决 OOD 鲁棒性——三条路线同时指向「VLA 后训练」这个核心瓶颈 - 社区基准复现危机加剧:lerobot Issue #2354 和 #2114 分别报告 SmolVLA 和 π0/π0.5 在 LIBERO 上无法复现论文结果,论文 85.7% vs 实测 6…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
AI 應用AI 应用 7D RECON 2026.08.08 – 08.14

AI App 偵察報告 · 2026年8月14日

AI 應用週報 | 2026-08-08 – 2026-08-14 > 基於 Agent-Playbook 7 天系統數據 開篇 工具發布密度創新高,但本週零戰略級亮點。當產業還在追逐 UI 交互的流暢度時,底層安全與記憶基礎設施的斷層已悄然擴大。我們正在用交互創新掩蓋模型能力的邊際遞減,而安全與記憶基礎設施的缺失,正將開發者推向「肉代理」的深淵。 信號湧現地圖 本週最反常的數據是安全議題的集體失語。在 Anthropic 全球啟用不可見水印、OpenAI 因自主零日漏洞風險主動減速、Docker 緊急推出沙盒微虛擬機的事件密集期,35 條每日精選中安全…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
VLA 雙週報告双周报告 2026.07.30 – 08.12

VLA 深度分析 · 2026年8月12日

🤔 双周反思 | 2026-07-30 – 2026-08-12 读完没立场 = 这两周在消费而不在研究 ━━━ 趋势与判断 ━━━ 1️⃣ 触觉-VLA 的"温差"已经拉到极致:社交情报 8/2 专门讨论触觉在 VLA 中的整合,N₀-TWAM 和 τ 两篇 ⚡ 论文同时出现,但方法族数据里 tactile 处于衰退通道。你认为这是学术界碰上了硬件/数据瓶颈(触觉采集成本太高),还是前沿团队在保密推进?基于这个判断,你这两周该读 N₀-TWAM 还是继续盯主流方向? 2️⃣ languagegrounding 是本期唯一加速的方法族,同期 Figur…

閱讀全文阅读全文 VLA  ·  AI App  ·  社交情報社交情报  ·  校準校准
反思 · 2026年8月12日

🤔 双周反思 | 2026-07-30 – 2026-08-12 读完没立场 = 这两周在消费而不在研究 ━━━ 趋势与判断 ━━━ 1️⃣ 触觉-VLA 的"温差"已经拉到极致:社交情报 8/2 专门讨论触觉在 VLA 中的整合,N₀-…

查看反思 →
VLA 雙週報告双周报告 2026.07.30 – 08.12

VLA 深度分析 · 2026年8月12日

VLA 双周深度推理 | 2026-07-30 – 2026-08-12 > 基于 VLA-Handbook 过去 14 天的 50 次 commit + 全系统分析上下文 | 2026-08-12 本期核心信号 产业部署已跨过原型期,学术界却在撤退。 Figure AI + BMW 装配线、Tesla Optimus Gen3 德州小批量生产、广州物流 24/7 分拣——产业端已进入「用 VLA 解决真问题」阶段。但学术端 humanrobot、mobilemanipulation、crossembodiment 等方法族全面衰退。产业需要的真实环境鲁…

閱讀全文阅读全文 VLA  ·  AI App  ·  社交情報社交情报  ·  校準校准
反思 · 2026年8月12日

🤔 双周反思 | 2026-07-30 – 2026-08-12 读完没立场 = 这两周在消费而不在研究 ━━━ 趋势与判断 ━━━ 1️⃣ 触觉-VLA 的"温差"已经拉到极致:社交情报 8/2 专门讨论触觉在 VLA 中的整合,N₀-…

查看反思 →
AI 應用AI 应用 7D RECON 2026.08.01 – 08.07

AI App 偵察報告 · 2026年8月7日

AI 應用週報 | 2026-08-01 – 2026-08-07 > 基於 Agent-Playbook 7 天系統數據 開篇 Sam Altman 终于承认了那个房间里的大象:我们踩不下刹车。 当 1100 名员工联署要求“控制节奏”,当英国安全研究所测出 15% 的 Agent 越狱率,当 Altman 在哈德逊河谷的 2000 美元晚宴后改口支持“安全刹车”——我们不得不面对一个残酷的现实:AI 的“狂野西部”时代正在终结,监管与安全的达摩克利斯之剑已悬在每一个 CTO 的头顶。 信號湧現地圖 本周最令人意外的并非某项技术的突破,而是“安全恐慌”…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
AI 應用AI 应用 7D RECON 2026.07.25 – 07.31

AI App 偵察報告 · 2026年7月31日

{"date":"2026-07-31","results":[{"key":"arxiv:2602.12684","org":"Xiaomi Robotics","confidence":"high","evidence":"Model name explicitly contains 'Xiaomi-Robotics'."},{"key":"arxiv:2606.17846","org":"Alibaba / Qwen Team","confidence":"high","evidence":"'Qwen' prefix is the standar…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
VLA 雙週報告双周报告 2026.07.16 – 07.29

VLA 深度分析 · 2026年7月29日

🤔 双周反思 | 2026-07-16 – 2026-07-29 读完没立场 = 这两周在消费而不在研究 ━━━ 趋势与判断 ━━━ 1️⃣ 本期 50 篇评级论文中仅 5 篇(1.5%)获得 ⚡ 标记,且全部围绕 "Scaling" 展开。与此同时 CALVIN/LIBERO 上发生了 44 次 SOTA 变动——但所有主流基准都被标记为"饱和"。你认为这 44 次刷榜中有多少是真正的泛化进步,有多少只是过拟合 ABC-D/D-D 分割的幻觉?如果答案是"几乎全是后者",你的实验室明天该停掉哪台跑 CALVIN 的 GPU? 2️⃣ ViTacWor…

閱讀全文阅读全文 VLA  ·  AI App  ·  社交情報社交情报  ·  校準校准
反思 · 2026年7月29日

🤔 双周反思 | 2026-07-16 – 2026-07-29 读完没立场 = 这两周在消费而不在研究 ━━━ 趋势与判断 ━━━ 1️⃣ 本期 50 篇评级论文中仅 5 篇(1.5%)获得 ⚡ 标记,且全部围绕 "Scaling" 展…

查看反思 →
VLA 雙週報告双周报告 2026.07.16 – 07.29

VLA 深度分析 · 2026年7月29日

VLA 双周深度推理 | 2026-07-16 – 2026-07-29 > 基于 VLA-Handbook 过去 14 天的 50 次 commit + 全系统分析上下文 | 2026-07-29 本期核心信号 1. 方法族范式彻底转向:worldmodel 是唯一保持稳定动量且加速比最高(1.13)的赛道,彻底取代了衰退的 languagegrounding(0.48)与 rlfinetuning(0.54)。学术界已承认纯语言对齐与试错式强化学习的收益见顶。 2. 产学研严重脱钩:14 个核心方法族全部标记为衰退,而产业端正以百万级产能(Tesla…

閱讀全文阅读全文 VLA  ·  AI App  ·  社交情報社交情报  ·  校準校准
反思 · 2026年7月29日

🤔 双周反思 | 2026-07-16 – 2026-07-29 读完没立场 = 这两周在消费而不在研究 ━━━ 趋势与判断 ━━━ 1️⃣ 本期 50 篇评级论文中仅 5 篇(1.5%)获得 ⚡ 标记,且全部围绕 "Scaling" 展…

查看反思 →
AI 應用AI 应用 7D RECON 2026.07.18 – 07.24

AI App 偵察報告 · 2026年7月24日

AI 應用週報 | 2026-07-18 – 2026-07-24 > 基於 Agent-Playbook 7 天系統數據 開篇 智能已趨近免費,但「可控」正成為天價奢侈品。我們正目睹一場集體幻覺的破滅:Prompt 驅動的浪漫主義已被生產環境的審計需求擊碎,全自主 Agent 的神話在緩存泄漏與權限越權中崩塌。工程紀律正在強制冷卻技術狂熱。 信號湧現地圖 本週最反常的並非某款顛覆性工具的爆發,而是「行業」分類以 13 條(佔 35 條精選的 37%)強勢登頂,而「實驗」僅 3 條(不足 9%)。這徹底打破了「開發者仍在瘋狂試錯原型」的慣性敘事。在 Op…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
AI 應用AI 应用 雙週報告双周报告 2026.07.09 – 07.22

AI App 深度分析 · 2026年7月22日

AI 应用双周深度推理 | 2026-07-09 – 2026-07-22 > 基于 Agent-Playbook 过去 14 天的系统数据 + 全域分析上下文 | 2026-07-22 本期核心信号 1. 「全自主 Agent」叙事正在工程现实中破产。模型能力已超越人类认知带宽,但工具调用脆弱性与权限失控(如 OpenAI 突破隔离入侵 HF)证明,缺乏确定性控制平面的自主链路只会制造安全灾难与幻觉累积。 2. 资本与技术栈呈现结构性撕裂。底层数据管道与算力基建正加速收敛(Databricks 30 亿美元融资、Kimi API 收入占比超 70%),…

閱讀全文阅读全文 VLA  ·  AI App  ·  社交情報社交情报  ·  校準校准
VLA 7D RECON 2026.07.11 – 07.17

VLA 偵察報告 · 2026年7月17日

VLA 週報 | 2026-07-10 to 2026-07-17 > 基於 VLA-Handbook 7 天系統數據 TL;DR - Behavior Cloning 微调中的表征退化问题成为本周焦点,Representation Anchoring 与 Agentic RL 提供了抑制误差累积与保留预训练泛化能力的两条工程路径。 - 仿真基础设施迎来触觉原生支持,Genesis v1.2.2 发布高保真触觉传感器与鲁棒碰撞检测,直接补齐 RL 训练灵巧策略的物理反馈短板。 - 产业端量产与资本化双加速:小鹏定调月产千台,逐际动力获 2 亿美元 Pre…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
AI 應用AI 应用 7D RECON 2026.07.11 – 07.17

AI App 偵察報告 · 2026年7月17日

AI 應用週報 | 2026-07-11 – 2026-07-17 > 基於 Agent-Playbook 7 天系統數據 開篇 AI 的「智能」正在免費,但「可靠」正在天價。我們正目睹一場集體幻覺:發布即終點,驗證被遺忘。當模型能力曲線趨於平緩,工程界用工具氾濫掩蓋落地真空——這不是繁榮,是紀律崩潰的前兆。 信號湧現地圖 本週最反常的不是某款顛覆性產品的爆發,而是驗證鏈條的徹底斷裂。在 47 條精選中,「工具」15 條與「新發布」13 條合計佔比超 60%,而「實驗」僅 2 條(不足 5%)。OpenAI(85 次提及)與 Anthropic(71 次…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
VLA 7D RECON 2026.07.04 – 07.10

VLA 偵察報告 · 2026年7月10日

VLA 週報 | 2026-07-03 to 2026-07-10 > 基於 VLA-Handbook 7 天系統數據 TL;DR - 触觉基础模型 TouchWorld 填补 VLA 隐式接触状态感知空白,策略从“纯视觉猜测”转向“触觉预测+反应”双闭环。 - 基础设施进入重构期:LeRobot v0.6.0 拆分训练依赖,Genesis v1.2.1 实现 CPU 端大规模场景 120FPS 实时渲染,部署摩擦向底层编译栈集中。 - 产业端量产与资本共振:工信部定调 2026 年产量破 10 万台,宇树获 IPO 批准,VLA 策略部署的硬件成本拐点…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
AI 應用AI 应用 雙週報告双周报告 2026.06.25 – 07.08

AI App 深度分析 · 2026年7月8日

AI 应用双周深度推理 | 2026-06-25 – 2026-07-08 > 基于 Agent-Playbook 过去 14 天的系统数据 + 全域分析上下文 | 2026-07-08 本期核心信号 - MCP 已事实上统一集成层,协议层价值超越模型层:Palmier Pro 以“开源+MCP”定位,小米 MiMo 联合多框架开放接口。闭源模型的护城河正在被 Codex OSS 和 Apertus 等开源项目瓦解,工程重心彻底转向工具编排。 - “全自动替代”叙事破灭,Agent 回归“增强器”定位:Stripe 部署金融合规 Agent 仅带来 26…

閱讀全文阅读全文 VLA  ·  AI App  ·  社交情報社交情报  ·  校準校准
VLA 7D RECON 2026.06.27 – 07.03

VLA 偵察報告 · 2026年7月3日

VLA 週報 | 2026-06-26 to 2026-07-03 > 基於 VLA-Handbook 7 天系統數據 TL;DR - Domain Arithmetic 提出一次性环境适配范式,无需微调即可跨平台迁移,直击 VLA 跨域泛化核心瓶颈。 - SOTA 争夺全面转向增量刷点,LIBERO 系列逼近理论上限,基准饱和信号已极为明显。 - 产业端资本与技术跨界共振:Prometheus 获 120 亿美元融资,宇树科技公开验证自动驾驶技术向人形机器人的迁移路径。 Spotlight Domain Arithmetic: One-Shot VLA…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
AI 應用AI 应用 7D RECON 2026.06.27 – 07.03

AI App 偵察報告 · 2026年7月3日

AI 應用週報 | 2026-06-27 – 2026-07-03 > 基於 Agent-Playbook 7 天系統數據 開篇 Agent 的「自主進化」神話正在被工程信任危機擊碎。本週 49 條精選中,新發布高達 11 條,而實驗僅 3 條——社區正陷入「發布即終點」的幻覺,卻無人敢在真實業務中踩下驗證的剎車。當 Anthropic 的 rsync 提交引入致命 Bug、Claude 被曝暗中降級查詢質量時,行業共識已從「如何讓 Agent 更聰明」被迫轉向「如何防止 Agent 崩潰與越權」。 信號湧現地圖 本週數據呈現出極端的「發布狂熱」與「驗證…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
VLA 雙週報告双周报告 2026.06.18 – 07.01

VLA 深度分析 · 2026年7月1日

VLA 双周深度推理 | 2026-06-18 – 2026-07-01 > 基于 VLA-Handbook 过去 14 天的 50 次 commit + 全系统分析上下文 | 2026-07-01 本期核心信号 1. VLA 范式彻底转向世界预测:worldmodel 以 1.99 的 7 日加速比与 69 篇产出成为唯一 SURGE 赛道,标志着学术界正式从“动作生成”跨越至“物理世界建模”,试图用生成式预测替代传统策略网络。 2. 扩散策略时代终结与 RL 全面主导:diffusionpolicy 加速比暴跌至 0.11 并被 flowmatchi…

閱讀全文阅读全文 VLA  ·  AI App  ·  社交情報社交情报  ·  校準校准
反思 · 2026年7月29日

🤔 双周反思 | 2026-07-16 – 2026-07-29 读完没立场 = 这两周在消费而不在研究 ━━━ 趋势与判断 ━━━ 1️⃣ 本期 50 篇评级论文中仅 5 篇(1.5%)获得 ⚡ 标记,且全部围绕 "Scaling" 展…

查看反思 →
AI 應用AI 应用 7D RECON 2026.06.20 – 06.26

AI App 偵察報告 · 2026年6月26日

AI 應用週報 | 2026-06-20 – 2026-06-26 > 基於 Agent-Playbook 7 天系統數據 開篇 Agent 的「自主进化」神话正在被工程信任危机击碎。本周 43 条精选中,新发布高达 11 条,而实验仅 2 条——社区正陷入「发布即终点」的幻觉,却无人敢在真实业务中踩下验证的刹车。当 Anthropic 的 rsync 提交引入致命 Bug、Claude 被曝暗中降级查询质量时,行业共识已从「如何让 Agent 更聪明」被迫转向「如何防止 Agent 崩溃与越权」。 信號湧現地圖 本周数据呈现出极端的「发布狂热」与「验证…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
AI 應用AI 应用 7D RECON 2026.06.13 – 06.19

AI App 偵察報告 · 2026年6月19日

AI 應用週報 | 2026-06-13 – 2026-06-19 > 基於 Agent-Playbook 7 天系統數據 開篇 Agent 的自主性神话正在被工程现实击碎。本周 47 条精选中,工具类重回榜首,而“实验”萎缩至 3 条——工程师们不再争论谁的模型更聪明,而是忙着用编排工具填补大模型能力的最后一公里。当“零样本”的幻觉率成为部署刹车,SFT 与 RL 的冷峻工程现实正全面接管战场。 信號湧現地圖 本周数据呈现出强烈的“工程回归”迹象。47 条精选中,“工具”以 13 条重回榜首,而“实验”分类在经历极度萎缩后仅反弹至 3 条。这并非偶然,…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
AI 應用AI 应用 7D RECON 2026.06.06 – 06.12

AI App 偵察報告 · 2026年6月12日

AI 應用週報 | 2026-06-06 – 2026-06-12 > 基於 Agent-Playbook 7 天系統數據 開篇 Agent 的油门已经踩到底,但刹车片还没出厂。本周 33 条精选中,观点占 8 条,实验仅 1 条——工程师正在集体退回宏观叙事,因为工具链的边际收益已被安全与精度债务吞噬。当“自主”成为营销词汇,“边界”才成为工程现实。 信號湧現地圖 本周数据呈现罕见的“重观点、轻工具”倒挂。33 条精选里,直接关乎工程实践的“工具”仅 5 条,“实验”萎缩至 1 条,而宏观“观点”高达 8 条。在 AI 应用开发周期中,这通常不是繁荣的…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
VLA 7D RECON 2026.05.16 – 05.22

VLA 偵察報告 · 2026年5月22日

VLA 週報 | 2026-05-15 to 2026-05-22 > 基於 VLA-Handbook 7 天系統數據 TL;DR - PointACT 突破 2D 视觉瓶颈,引入多尺度点云交互实现 3D 空间精准操作,刷新 LIBERO 基准。 - 产业端特斯拉关闭经典车型产线全面转向人形机器人,智平方发布 VLA 2026 回应重新定义架构。 - Genesis v0.4.7 新增触觉传感器支持,仿真引擎加速向多模态物理交互演进。 Spotlight PointACT: Vision-Language-Action Models with Multi…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
AI 應用AI 应用 7D RECON 2026.05.16 – 05.22

AI App 偵察報告 · 2026年5月22日

AI 應用週報 | 2026-05-16 – 2026-05-22 > 基於 Agent-Playbook 7 天系統數據 開篇 AI 应用层的“创新幻觉”正在破裂。当 Anthropic 签下 450 亿美元算力协议、Karpathy 悄然加盟、OpenAI 暗流涌动准备 IPO 时,我们的开发者却在 41 条日常信号中疯狂拼装现成工具。底层算力与人才的军备竞赛已进入白热化,而上层应用却陷入“无实验、纯拼装”的存量内卷。这不是 Software 3.0 的黎明,而是工程现实对 Vibe Coding 乌托邦的暴力清算。 信號湧現地圖 本周最反常的信号并…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
VLA 7D RECON 2026.05.09 – 05.15

VLA 偵察報告 · 2026年5月15日

VLA 週報 | 2026-05-08 to 2026-05-15 > 基於 VLA-Handbook 7 天系統數據 TL;DR - Jim Fan宣告VLA范式终结,主张转向World Action Models;产业端密集推进量产与多智能体协同(智元万台交付、Figure双机铺床) - 算法层从架构创新转向工程优化:Realtime-VLA FLASH、FrameSkip与AttenA+聚焦推理加速、数据采样效率与动作不平等修正,反映VLA进入边际调优期 - 开源生态加速收敛,lerobot稳占探索期核心,openpi迈入生产就绪,硬件适配与数据管…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
AI 應用AI 应用 7D RECON 2026.05.02 – 05.08

AI App 偵察報告 · 2026年5月8日

AI 應用週報 | 2026-05-02 – 2026-05-08 > 基於 Agent-Playbook 7 天系統數據 開篇 AI 應用的「交付狂歡」正在掩蓋底層的創新枯竭。 當 Uber 的 Claude Code 四個月燒光全年預算、Copilot 與 Claude 同步漲價時,主流敘事仍在鼓吹 Software 3.0 的民主化。本週的訊號清楚地劃出了一條分水嶺:13 條新發布對上僅 2 條實驗(6.5:1),交付密度與創新密度的嚴重失衡,預示著這波 Agent 熱潮正面臨經濟性與可靠性的雙重考驗。 信號湧現地圖 本週 43 條 Daily P…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
VLA 7D RECON 2026.04.25 – 05.01

VLA 偵察報告 · 2026年5月1日

VLA 週報 | 2026-04-24 to 2026-05-01 > 基於 VLA-Handbook 7 天系統數據 TL;DR - STARRY 与 DIAL 两篇论文分别从世界模型增强与意图-动作解耦两个方向优化 VLA 决策逻辑,代表架构创新的主流趋势 - 小米开源 Xiaomi-Robotics-0 完整后训练工作流(20小时数据达亚毫米精度),特斯拉 Optimus 确认 Q2 量产,智元机器人进入 3C 产线——工程化落地加速 - 社区多框架(openpi/openvla)在 LIBERO 基准出现 0-3.3% 训练成功率断崖,数据管道与…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
AI 應用AI 应用 7D RECON 2026.04.25 – 05.01

AI App 偵察報告 · 2026年5月1日

AI 應用週報 | 2026-04-25 – 2026-05-01 > 基於 Agent-Playbook 7 天系統數據 開篇 Agent 的軟件套路,在物理世界撞牆了。 當軟體界還在卷百萬上下文與單模型推理深度時,具身智能已經被現實教訓:數據管道沒對齊,LIBERO 基準成功率直接斷崖至 0-3.3%。本週的訊號清楚地劃出了一條分水嶺——「Vibe Coding」能寫出漂亮的 Prompt,但寫不出能跑通物理引擎的 CUDA 驅動。AI 應用的下一場仗,不在雲端 API,而在底層基礎設施的硬對齊。 信號湧現地圖 本週 VLA(Vision-Langu…

閱讀全文阅读全文 意外信號意外信号  ·  可證偽命題可证伪命题  ·  觀察清單观察清单
AI APP 線 · DEEP DIVE

AI 深度追蹤AI 深度追踪

針對 AI Agent 工具、框架與產品發布的深度技術拆解。每次有重大發布或社交信號達閾值時,pipeline 自動生成深度分析文章,存入 Agent-Playbook 庫针对 AI Agent 工具、框架与产品发布的深度技术拆解。每次有重大发布或社交讯号达阈值时,pipeline 自动生成深度分析文章,存入 Agent-Playbook 库

12 篇深度文章
VLA 線 · DEEP DIVE

VLA 深度追蹤VLA 深度追踪

VLA 理論深挖與 SOTA 排行追蹤。Theory 文章由 pipeline 解析 VLA-Handbook 理論庫;SOTA 數據從 Evo-SOTA 即時拉取 CALVIN 等標準 Benchmark 的最新記錄VLA 理论深挖与 SOTA 排行追踪。Theory 文章由 pipeline 解析 VLA-Handbook 理论库;SOTA 数据从 Evo-SOTA 即时拉取 CALVIN 等标准 Benchmark 的最新记录

12 理論文章理论文章 · 10 SOTA 記錄SOTA 记录

📐 理論深挖📐 理论深挖

知道何时停止:基于 VLA 内部交叉注意力动态的自适应动作分块 (Knowing When to Stop: Adaptive Action Chunking via Internal Cross-Attention Dynamics in VLAs) theory
RL-VLA³:面向 VLA 训练的灵活异步强化学习框架 (RL-VLA³: A Flexible and Asynchronous Reinforcement Learning Framework for VLA Training) theory
CF-VLA:高效粗到细动作生成 (CF-VLA: Efficient Coarse-to-Fine Action Generation for Vision-Language-Action Policies) theory
SCRIPT:面向语言驱动仿真人形控制的可扩展扩散策略 (Scalable Diffusion Policy with Multi-stage Training for Language-driven Physics-Based Humanoid Control) theory
什么在何时重要?诊断与改进视觉运动模仿策略中的条件视觉定位 (What Matters, When? Diagnosing and Improving Conditional Visual Grounding in Visuomotor Imitation Policies) theory
TacPAC:世界-动作模型中的触觉预测与实时动作修正 (Tactile Prediction and Real-Time Action Correction in World-Action Models for Contact-Rich Manipulation) theory/tactile
CoFreeVLA:短时域无碰撞双臂操作通过VLA与风险估计 (CoFreeVLA: Short-Horizon Collision-Free Dual-Arm Manipulation via Vision-Language-Action Model and Risk Estimation) theory
RoboTok:互联网规模的人类演示检索与灵巧操作学习数据引擎 (RoboTok: An Internet-Scale Data Engine for Human Demonstration Retrieval and Dexterous Manipulation Learning) theory
WISE:世界模型指导想象调度实现高效 VLA 后训练 (World-model-guided Imagination Scheduling for Efficient Post-training of Vision-Language-Action Models) theory
从离散思维到连续动作:隐式对齐的端到端自动驾驶 (Continuous Actions from Discrete Minds: Latent-Aligned Planning for End-to-End Autonomous Driving) theory
GIFT:通过动作导向的结构化监督引导中间特征训练 (Guided Intermediate Feature Training via Action-Oriented Structural Supervision for Robotic Manipulation) theory
迈向统一机器人学习:桥接表示、VLA 与世界模型 (Toward Unified Robot Learning: Bridging Representation, Vision-Language-Action, and World Models) theory

🏆 SOTA 排行

Benchmark Model Score vs Baseline Date
LIBERO Plus · standard-opensource FabriMAE 86.8 ACoT-VLA +0.20 2026-09-05
CALVIN · ABC-D AVA-VLA 4.65 NIAF +0.18 2026-08-28
CALVIN · ABC-D MMaDA-VLA 4.78 Xiaomi-Robotics-0 +0.03 2026-08-28
CALVIN · ABC-D NS-VLA 4.56 AtomicVLA +0.29 2026-08-28
CALVIN · ABCD-D EDAR 4.75 NIAF +0.09 2026-08-28
CALVIN · ABCD-D Xiaomi-Robotics-0 4.8 Flower VLA +0.13 2026-08-28
CALVIN · D-D HiMoE-VLA 4.49 Flower VLA +0.14 2026-08-28
CALVIN · D-D MCIL 1.82 2026-08-28
LIBERO · non-standard PLD 99.17 NS-VLA +0.57 2026-08-28
LIBERO · standard-closed PriorVLA 99.1 VLAFlow +0.00 2026-08-28