系列:VLA 解码手记

VLA 解码手记(三):π 系列演进——Physical Intelligence 的 VLA 路线

1. π0:把 VLA 做成”通用接口”(2024-10)

Physical Intelligence 的 π0 定了基线:

2. π0-Fast:离散化提速

在 π0 上加动作离散化 + 自回归,换取推理速度。是”连续 vs 离散”两条路线的工程折中,适合延迟敏感场景。

3. π0.5:跨本体 + 任务分解(2025-04)

4. π0.6*:RL 专精(RECAP)

用强化学习在已训 VLA 上做专精打磨(RECAP 思路),把特定任务成功率再往上推。是”通用预训练 + 专精后训练”的典型后半段。

5. π0.7:记忆 + 组合泛化(2026-04)

π0.7 是系列目前的顶点,几个关键升级:

π 系列演进主线 π0FlowMatch 50Hz π0-Fast离散化提速 π0.5跨本体+分解 π0.6*RL 专精 π0.7记忆+组合泛化

图:π 系列的演进——底座升级、跨本体、RL 专精、记忆与组合泛化

6. 演进主线(一句话)

VLM 底座升级 → 跨本体复用 → RL 专精打磨 → 记忆 + 组合泛化。通用 VLA 正从”能干活”走向”比专精策略更强”。

7. 承上启下

π 系列是海外标杆。下一篇看国内:蚂蚁灵波 LingBot-VLA 2.0 的”一脑多机”、小米的开源实时 VLA、腾讯 HyVLA 的 FlowPRO——以及一处常见混淆的澄清。

觉得有用?欢迎点赞、收藏,或请作者喝咖啡 ☕️

支付宝收款码

支付宝

微信收款码

微信

💬 留言

评论由 Giscus 驱动(基于 GitHub Discussions)。 当前仓库 NaphJohn/LLM-blog 尚未启用 Discussions:请在 GitHub 仓库 Settings → General → Features 勾选 Discussions 后刷新本页,评论区即自动显示。