Vista

用视频生成让自动驾驶预判未来,提升泛化与安全

Vista是一个面向自动驾驶的通用世界模型,来自NeurIPS 2024。它解决的核心问题是:自动驾驶系统如何在没有标注数据的情况下,预测和想象未来的驾驶场景。Vista通过视频生成技术,从历史驾驶数据中学习环境动态,能够生成多视角、多时段的未来帧,并支持根据文本指令或轨迹控制生成结果。其关键能力包括:大规模预训练、跨场景泛化、以及作为交互式模拟器用于策略学习与评估。模型采用扩散架构,支持高分辨率视频生成,为自动驾驶提供数据增强、闭环仿真和规划预训练等能力。

开源 free 视频生成
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 901
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类视频生成
开发团队OpenDriveLab
所属国家
定价模式free
价格说明开源项目,Apache-2.0 许可证,可自由使用和部署,无付费版本。
访问状态
是否开源是
开源协议Apache-2.0
主要语言Python
技术栈/模型autonomous-driving,video-generation,world-model
GitHub 星标★ 901
30天Star增速
HF 下载量
上线时间2024-05-10 00:00:00
最近更新2026-09-23 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

核心亮点

  • 支持多相机视角和多种天气/时段,泛化性强
  • 可基于文本指令或轨迹控制生成,交互灵活
  • 提供预训练模型和代码,便于复现与二次开发

不足之处

  • 早期项目,文档和社区支持待观察
  • 对计算资源要求高,推理速度可能受限

适用场景

  • 自动驾驶闭环仿真与策略评估
  • 驾驶场景数据增强与稀缺场景生成
  • 多模态驾驶预训练与表征学习

替代项目

GAIA-1、DriveDreamer、WoVoGen

项目介绍

Vista 是行业应用领域的开源项目,由 OpenDriveLab 开发,2024 年首次发布。

在全站 13,090 个收录项目中,它的 GitHub 星标数(901)位列前 30%,在行业应用分类中处于中上游。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-23。Apache-2.0 许可证,可自由使用和部署,无付费版本。

它主要面向的使用场景是:自动驾驶闭环仿真与策略评估。同类可对比的替代方案包括 GAIA-1、DriveDreamer、WoVoGen。

上一篇:VideoActionModel

下一篇:OpenDWM

同类项目推荐

xmgai-like 开源

换脸、艺术二维码随手玩,副业灵感一包带走。

本开源 AI 副业搞钱项目集成了强大功能,包括 AI 艺术二维码生成、AI 换脸、Delle3 绘画等···

★ 60 2026-08-09
spoken-to-signed-translation 开源

把口语文本一路转成手语视频的流水线

a text-to-gloss-to-pose-to-video pipeline for spoken to signed language translation

★ 102 2026-09-11
LiveTranslate 开源

直播看片实时翻译,字幕秒出,跨语言无压力

Real-time audio translation, captures system audio + mic, runs ASR (Whisper/SenseVoi···

★ 691 2026-08-13