triton

本站收录 10 个带「triton」标签的 AI 开源项目

Liger-KernelLiger-Kernel 是 LinkedIn 开源的一套面向大语言模型训练的 Triton 内核集合,目标是解决 LLM 微调与训练中显存占用高、计算效率低的★ 6,636SageAttention清华开源的量化注意力算子,相较 FlashAttention 可实现 2~5 倍加速,在语言、图像与视频模型上均保持端到端指标不损失,被 ICLR 2025、I★ 3,953FlagGemsFlagGems 是一个用 Triton 语言实现的大语言模型算子库,目标是提供一套高性能、可移植的 GPU 算子集合,替代或补充 PyTorch 原生算子以及★ 1,125llm-algo-leetcodellm-algo-leetcode 是一个面向大模型算法与系统方向的开源实战教程,以 Jupyter Notebook 为主要载体,把大模型入门到进阶所需的核心★ 619comfyui-triton-and-sageattention-installer这是一个为 ComfyUI 用户设计的跨平台安装工具,专门解决 Triton 和 SageAttention 在 Windows 环境下安装困难的问题。Comf★ 234isaac_ros_object_detectionisaac_ros_object_detection 是 NVIDIA 为 ROS 2 生态提供的图像空间目标检测加速包,属于 Isaac ROS 系列。它把深★ 204clearml-servingClearML Serving 是 ClearML 生态中的模型服务编排与仓库解决方案,用于将训练好的机器学习模型部署为生产级推理服务。它解决的是模型从实验到上★ 170keda-gpu-scalerkeda-gpu-scaler 是一个基于 KEDA 外部 gRPC 扩展器的 GPU 自动扩缩容组件。它通过 DaemonSet 方式在每个节点上运行,直接利★ 131llm-scratch-pytorch这是一个从零开始用PyTorch实现大语言模型(LLM)的教学型项目,面向初学者,通过逐步构建GPT-2风格的模型来理解LLM的核心原理。项目解决了“只懂调用A★ 101kernel-skillskernel-skills 是一个面向 AI 编程代理的开源技能库,专注于高性能计算内核的编写、优化与调试,覆盖 CUDA、Triton 以及量化负载场景。它解★ 80