vla

本站收录 10 个带「vla」标签的 AI 开源项目

alpamayoalpamayo 是 NVIDIA 开源的 10B 参数推理型 VLA(视觉-语言-动作)模型,专为自动驾驶设计。它把驾驶轨迹预测与 Chain-of-Caus★ 2,034VLA-HandbookVLA-Handbook 是一份面向算法工程师的全中文学习与面试手册,聚焦 VLA(Vision-Language-Action)这一具身智能核心方向。它解决的★ 685LoongForgeLoongForge 是一个面向大模型训练的统一高性能框架,支持在 NVIDIA GPU 和昆仑芯 XPU 上训练 LLM、VLM、扩散模型及具身智能模型。它解★ 666inspect-robotsinspect-robots 是一个面向物理 AI(具身智能)的开源评测框架,目标是把机器人策略与视觉-语言-动作(VLA)模型的评估标准化。它解决的核心问题是★ 649awesome-vla-for-ad这是一个聚焦视觉-语言-动作模型(VLA)在自动驾驶领域应用的精选资源列表,系统梳理了该方向从过去到未来的研究脉络。项目解决了自动驾驶领域研究者难以快速获取VL★ 490WorldFoundryWorldFoundry 是一个面向世界模型(World Model)的统一推理与评估基础设施,旨在解决视频生成、视觉-语言-动作(VLA)及世界动作模型(WA★ 317alpamayo-recipesalpamayo-recipes 是 NVIDIA Alpamayo 的开发者中心,面向自动驾驶与物理 AI 场景,提供一整套可直接运行的模型配方。它解决的核心★ 198flux-actionflux-action 是 Black Forest Labs 开源的 7B 世界动作模型(World Action Model),以开放权重形式发布,目标是把★ 149verl-vlaverl-vla 是一个面向视觉-语言-动作(VLA)模型的统一后训练框架,基于 verl 生态构建,目标是把机器人策略的迭代流程标准化。它解决的核心问题是:V★ 119LabVLALabVLA是一个面向科学实验室场景的视觉-语言-动作(VLA)模型开源项目。它旨在解决机器人在科研实验室中执行复杂操作任务时,缺乏对专业仪器、试剂和流程理解的★ 104