Research KB

SRC-2604.04198 Source

视频动作模型作零样本驱动器(Liu et al.);引用 G2DP 为扩散+稠密引导的规划思路。

id SRC-2604.04198
type source
kind paper
title DriveVA: Video Action Models are Zero-Shot Drivers
authors Mengmeng Liu, Dian-Kun Zhang, Jiuming Liu, Jian-Feng Cui, Hong-Bin Xie, Guang Chen, Hangjun Ye, Michael Ying Yang, Francesco Nex, Hao Cheng
venue arXiv 2026
arxiv 2604.04198
doi 10.48550/arXiv.2604.04198
tier 0
lifecycle EXTRACTED
epistemic n/a
ingested 2026-09-03
version arXiv:2604.04198
source-hash sha256:0000000000000000000000000000000000000000000000000000000000000000
source-role g2dp-citation-neighbor
g2dp-anchor SRC-2606.26017
g2dp-relation CITES_G2DP | 本工作引用 G2DP 作参照——视频动作模型做零样本驱动的设定中,G2DP 代表『扩散 + 稠密引导』的规划思路。
citation-count-s2 14

把视频动作模型当作零样本驱动器(Liu et al.):以视频动作表征直接驱动规划,无需额外适配即可跨任务部署。

与 G2DP 的关系(SRC-2606.26017:本工作引用 G2DP 作参照——视频动作模型做零样本驱动的设定中,G2DP 代表『扩散 + 稠密引导』的规划思路。

时间倒置:arXiv 号段 2026-04,早于 G2DP(2026-06)。

引用(1)

  • SRC-2606.26017 G2DP:时空占据栅格+路线进度融合为可微 cost volume,去噪末段注入引导,nuPlan 纯模仿 SOTA;本引用簇中心。