MultiWorld

多智能体多视角视频生成,让机器人训练更真实

MultiWorld 是一个可扩展的多智能体多视角视频世界模型的开源实现,旨在通过扩散模型生成交互式视频,解决机器人领域对多智能体协同和动态环境建模的需求。该项目支持动作条件生成,能够根据智能体的动作预测并生成相应的视频帧,从而模拟多智能体在复杂环境中的交互。其核心能力包括多视角视频生成、动作条件控制、以及基于世界模型的交互式视频模拟。MultiWorld 特别适用于机器人学习、游戏生成和交互式视频等场景,为多智能体系统的训练和评估提供高保真的视觉反馈。项目基于 Python 实现,采用 diffusion 模型架构,目前处于早期阶段,但已展示了在可扩展性和多智能体建模方面的潜力。

开源 free 视频生成
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 258
维护状态 低维护
是否开源
定价模式 free

项目数据

分类视频生成
开发团队CIntellifusion
所属国家
定价模式free
价格说明开源项目,代码公开,可自行部署,无在线服务,完全免费。
访问状态
是否开源
开源协议NOASSERTION
主要语言Python
技术栈/模型action-conditioned,diffusion-models,game-generation,interactive-video,multi-agent,robotics,video-generation,worldmodel
GitHub 星标★ 258
30天Star增速
HF 下载量
上线时间2026-04-20 00:00:00
最近更新2026-09-18 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数2

使用教程

核心亮点

  • 支持多智能体协同和多视角视频生成,适合复杂场景模拟
  • 动作条件生成,能根据输入动作预测视频帧,提升交互性
  • 基于扩散模型,生成视频质量高,细节丰富

不足之处

  • 项目处于早期阶段,文档和社区支持待观察
  • 依赖计算资源大,训练和推理成本高

适用场景

  • 机器人多智能体协作训练与评估
  • 游戏场景的交互式视频生成
  • 自动驾驶多视角环境模拟

替代项目

Genie、World Models、VideoPoet

项目介绍

MultiWorld 是视频领域的开源项目,由 CIntellifusion 开发,是 2026 年新上线的项目。

它收录于视频分类,该分类目前共有 472 个项目,GitHub 星标数为 258。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-18。代码公开,可自行部署,无在线服务,完全免费。

它主要面向的使用场景是:机器人多智能体协作训练与评估。同类可对比的替代方案包括 Genie、World Models、VideoPoet。

上一篇:Kiwi-Edit

下一篇:Mojito

同类项目推荐

MoneyPrinterTurbo 开源

输入一句话,高清短视频自动出炉,文案配音全包了

利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频。Generate HD short ···

★ 125106 2026-08-09
seedance-2.0-api 开源

快速上手字节Seedance 2.0,文本/图片一键生成视频

Seedance 2.0 API — text-to-video and image-to-video examples

★ 334 2026-08-26
openscreen 开源

免费无水印录屏做演示,替代 Screen Studio

Record your screen, ship a demo. Free and open-source, GPU-accelerated, no watermark···

★ 3185 2026-08-10
auto-subs 开源

在剪辑软件里直接生成字幕,省去导出导入的麻烦

On-device subtitle generation that connects directly to DaVinci Resolve, Premiere, a···

★ 4266 2026-08-10