high-performance-computing

本站收录 10 个带「high-performance-computing」标签的 AI 开源项目

metaflowNetflix 开源的 AI/ML 系统构建与管理框架,帮助开发者轻松编写、运行和部署机器学习流水线。它提供了简洁的 Python API,支持本地开发与云端规★ 10,283alpaAlpa 是一个用于训练和服务大规模神经网络的计算框架,其核心目标是自动并行化。它解决了用户在分布式系统上运行超大模型时面临的并行策略选择复杂性问题,通过自动将★ 3,178metal-flash-attentionmetal-flash-attention 是一个基于 Apple Metal 高性能计算框架的 FlashAttention 移植实现,专为在 Apple 芯★ 612soperatorsoperator 是一个 Kubernetes 原生算子,用于在 Kubernetes 集群中运行和管理 Slurm 工作负载。它解决了传统 HPC 环境中 ★ 441datablationsdatablations 是一个研究数据受限条件下语言模型扩展规律的开源项目,由 Hugging Face 的研究人员发布。它通过系统的实验,探究当训练数据量有★ 345hongbomiao.comhongbomiao.com 是一个个人研发实验室,旨在促进知识共享。它由 Python 驱动,结合了现代基础设施技术,构建了一个集研究、开发与知识传播于一体的★ 299albucorealbucore 是 Albumentations 团队拆分出的底层图像处理库,用 OpenCV、NumPy、SimSIMD 等实现高性能基础算子,供 Albu★ 123easydisteasydist 是一个面向多生态系统的自动化并行化系统与基础设施,旨在简化分布式训练和推理的复杂性。它通过自动识别模型中的并行化机会,并生成高效的并行执行方案★ 81kernel-skillskernel-skills 是一个面向 AI 编程代理的开源技能库,专注于高性能计算内核的编写、优化与调试,覆盖 CUDA、Triton 以及量化负载场景。它解★ 80hummingbirdhummingbird 是一个轻量级、零依赖的 C 语言运行时,专为大规模开源混合专家(MoE)语言模型设计。它通过统一 SSD、RAM 和 VRAM 为单一智★ 58