Qwen2.5-Math

数学推理专用大模型,解方程、证明题更准更稳

Qwen2.5-Math是阿里通义千问团队推出的数学专用大语言模型系列,基于Qwen2.5底座,专注于数学推理与问题求解。它解决通用大模型在数学计算、符号推理和复杂应用题上准确率不足的问题,提供从0.5B到72B多种参数规模,支持纯文本和思维链(CoT)推理。核心能力包括:高精度算术运算、代数与几何问题求解、多步逻辑推理,以及通过集成奖励模型(如Qwen2.5-Math-RM)进行强化学习优化。该系列在GSM8K、MATH等基准上表现优异,部分模型超越同等规模通用模型。项目开源了模型权重、推理代码和训练细节,便于研究者和开发者微调或直接部署。

开源 free 开源模型
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 1084
维护状态 低维护
是否开源 是
定价模式 free

项目预览

项目数据

分类开源模型
开发团队QwenLM
所属国家
定价模式free
价格说明开源模型,可自行部署,完全免费使用。
访问状态
是否开源是
开源协议
主要语言Python
技术栈/模型large-language-models,mathematics,qwen2
GitHub 星标★ 1084
30天Star增速
HF 下载量
上线时间2024-08-08 00:00:00
代码更新—
仓库体积—
本站数据更新—
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数2

Star 增长趋势

本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整

正在加载星标数据…

技术标签

使用教程

—

难度:进阶 约 20 分钟 部署方式:模型权重 5 步

⚠ 该项目 README 未提供完整安装说明,以下步骤为通用流程,请以官方文档为准。

环境要求

  • 能访问 Hugging Face 或 ModelScope 以获取模型权重
  • 本地磁盘空间足以存放所选规模的权重文件(72B 体积很大)
  • Python 运行环境(项目开发语言为 Python)

安装与启动步骤

  1. 1确认模型选型

    README 提供 1.5B/7B/72B 三种规模:base 适合微调与 few-shot,Instruct 用于对话,按用途挑。

  2. 2查找模型权重

    访问 Hugging Face 或 ModelScope 的 Qwen 组织页,搜索以 Qwen2.5-Math- 开头的检查点即可找到全部模型。

  3. 3下载选定权重

    在对应模型页下载权重文件到本地目录,72B 规模较大,需提前预留充足磁盘空间。

  4. 4区分模型用途

    Qwen2.5-Math-72B 为基座模型,适合 few-shot 推理与微调;72B-Instruct 才是对话模型。

  5. 5设置评估提示

    README 给出评估 Qwen2.5-Math-Instruct 系列时的提示类型配置,运行评估前先设置该变量。

    PROMPT_TYPE="qwen25-math-cot"

关键配置

配置项必填说明示例
PROMPT_TYPE是评估 Qwen2.5-Math-Instruct 系列时指定思维链提示类型qwen25-math-cot

如何确认成功

README 未给出完整启动命令;若能按设置好的 CoT 提示类型正常输出推理过程,即说明配置生效。

常见问题

Q:应该下载哪个模型?

A:需要对话解题选 Qwen2.5-Math-*-Instruct;用于微调或 few-shot 推理选 base 版;需要奖励模型则选 Qwen2.5-Math-RM-72B。

Q:从哪里获取模型权重?

A:访问 Hugging Face 或 ModelScope 的 Qwen 组织页面,搜索以 Qwen2.5-Math- 开头的检查点,即可找到全部开源模型。

Q:README 里有安装命令吗?

A:本次节选只给出模型列表与评估提示类型,未包含依赖安装与完整运行命令,需参考官方文档站点补齐。

Q:72B 模型普通显卡能跑吗?

A:README 未说明硬件要求,但 72B 权重体积很大,通常需要大显存或多卡环境,建议先用 1.5B 跑通流程。

注意事项

  • README 节选未提供依赖安装与完整启动命令,实际操作前请查阅官方文档站点。
  • Qwen2.5-Math-72B 是基座模型,Qwen2.5-Math-72B-Instruct 才是对话模型,不要混用。
  • 评估 Instruct 系列时需按 README 将 PROMPT_TYPE 设为 qwen25-math-cot。

核心亮点

  • 在GSM8K和MATH基准上准确率显著高于同尺寸通用模型,数学任务更可靠
  • 提供0.5B到72B多规格模型,适配从边缘设备到云端的不同部署需求
  • 支持思维链(CoT)推理,并配套奖励模型,便于强化学习调优

不足之处

  • 模型聚焦数学领域,泛化到其他NLP任务能力有限
  • 文档和社区生态相对薄弱,示例和教程不够丰富

适用场景

  • 教育科技:自动解题、数学辅导与作业批改
  • 科研辅助:公式推导、数学定理验证
  • 金融分析:复杂数值计算与风险评估建模

替代项目

DeepSeekMath、MathGPT、Llemma

项目介绍

Qwen2.5-Math 是开源模型领域的开源项目,由 QwenLM 开发,2024 年首次发布。

在全站 13,655 个收录项目中,它的 GitHub 星标数(1,084)位列前 30%,在开源模型分类中处于中上游。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2025-01-11。可自行部署,完全免费使用。从国内网络环境看,可直接访问。

它主要面向的使用场景是:教育科技:自动解题、数学辅导与作业批改。同类可对比的替代方案包括 DeepSeekMath、MathGPT、Llemma。

上一篇:Me-LLaMA

下一篇:KnowLM

同类项目推荐

Machine-Learning 开源

跟着博客笔记,边看边跑机器学习代码

All content related to machine learning from my blog

★ 115 2026-08-09
CoreML-Models 开源

下载即用的苹果端 AI 模型库,免去转换烦恼

Core ML model zoo for iOS/macOS — PyTorch models converted to ready-to-use .mlpacka···

★ 1878 2026-08-10