wechat-download-api

一键导出公众号全部文章,还能喂给 AI 用

wechat-download-api 是一个基于 Python 的开源服务,专门解决微信公众号文章难以批量获取和订阅的问题。它提供完整的 API 接口,支持将单个公众号的全部历史文章一键导出为 Markdown、HTML、Word、PDF、EPUB、Excel、JSON 七种格式,方便本地存档、二次加工或数据迁移。项目内置 IP 代理池和反风控机制,能有效降低抓取过程中的封禁风险。同时,它实现了 RSS 订阅功能,让用户能像订阅传统博客一样追踪公众号更新。更重要的是,该项目支持 MCP(Model Context Protocol),可无缝接入各类 AI Agent 工具,使 AI 助手能够实时获取公众号内容作为知识源,适用于情报分析、内容聚合、自动化工作流等场景。整体设计注重易用性和扩展性,提供清晰的 API 文档和部署指南。

开源 unknown 智能体
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 1132
维护状态 维护中
是否开源 是
定价模式 unknown

项目数据

分类智能体
开发团队tmwgsicp
所属国家
定价模式unknown
价格说明定价信息待确认
访问状态
是否开源是
开源协议AGPL-3.0
主要语言Python
技术栈/模型ai-agent,mcp,rss,rss-feed,wechat,wechat-article
GitHub 星标★ 1132
30天Star增速
HF 下载量
上线时间2026-02-23 00:00:00
最近更新2026-09-23 00:00:00
维护状态维护中
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数2

使用教程

难度:入门 约 10 分钟 部署方式:Docker 6 步

环境要求

  • 已安装 Docker 和 Docker Compose(也可改用项目自带的 bash start.sh 一键脚本)
  • 拥有一个微信公众号(订阅号、服务号均可),需用管理员微信扫码登录
  • 如需抓取完整文章内容,建议准备 2-3 个 SOCKS5 代理(可自建,降低风控风险)
  • 本地电脑即可运行,不强制要求公网服务器;仅远程访问时才需要域名或内网穿透

安装与启动步骤

  1. 1克隆项目代码

    把项目源码下载到本地并进入项目目录,后续所有命令都在该目录下执行。

    git clone https://github.com/tmwgsicp/wechat-download-api.git
    cd wechat-download-api
  2. 2复制配置文件

    把 env.example 复制成 .env,服务启动时会读取该文件;登录后的微信凭证也会自动写入这里。

    cp env.example .env
  3. 3填写必要配置

    编辑 .env,重点是 SITE_URL 必须改成实际访问地址(否则 RSS 图片不显示);有条件再填 PROXY_URLS 代理池。

  4. 4启动服务

    使用 docker-compose 后台启动容器,默认监听 5000 端口,数据挂载到本地 data 目录。

    docker-compose up -d
  5. 5或用 docker run 启动

    不想用 compose 时可改用单条 docker run,注意先确保当前目录下已有 .env 文件,否则挂载会失败。

    docker run -d 
      -p 5000:5000 
      -v $(pwd)/data:/app/data 
      -v $(pwd)/.env:/app/.env 
      --name wechat-api 
      tmwgsicp/wechat-download-api:latest
  6. 6扫码登录

    浏览器打开登录页,用公众号管理员微信扫码,成功后凭证自动保存到 .env,有效期约 4 天。

关键配置

配置项必填说明示例
SITE_URL是网站实际访问地址,用于 RSS 图片代理,不配会导致图片无法显示http://localhost:5000
PORT否服务监听端口,默认 50005000
PROXY_URLS否SOCKS5 代理池地址,强烈建议配置以避免账号风控socks5://myuser:mypass@1.2.3.4:1080
WEBHOOK_URL否Webhook 通知地址,支持企业微信机器人,用于登录过期预警https://qyapi.weixin.qq.com/cgi-bin/webhook/send?key=xxxxxxx
RSS_POLL_INTERVAL否RSS 轮询间隔(秒),默认 36003600
RATE_LIMIT_GLOBAL否全局每分钟请求上限,默认 10,调低可降低风控概率10

如何确认成功

浏览器打开 http://localhost:5000/login.html 能看到登录页,微信扫码成功并提示凭证已保存即部署完成。

常见问题

Q:必须有自己的公众号吗?

A:需要。本工具通过微信公众平台后台登录凭证调用接口,用管理员微信扫码登录后,即可获取任意公众号的公开文章,不限于自己的号。

Q:登录凭证会过期吗?

A:会,有效期约 4 天,过期后需重新扫码。可配置 WEBHOOK_URL,在过期前 24 小时、6 小时收到提醒。

Q:本地电脑不买服务器能用吗?

A:可以。在本地启动服务后通过 localhost 就能完成扫码登录和所有功能;只有要从手机 RSS 阅读器等其它设备远程访问时,才需要公网服务器或内网穿透。

Q:RSS 里的图片显示不出来怎么办?

A:多半是 SITE_URL 没配成实际访问地址。局域网填 http://192.168.1.100:5000 这类地址,公网填 https://你的域名.com,改完重启服务。

Q:会触发微信风控封号吗?

A:不配代理直连微信可能出现频繁验证、账号限制或 IP 封禁。启用完整内容获取时,建议配置 2-3 个 SOCKS5 代理分散请求。

注意事项

  • SITE_URL 必须配置为实际访问地址(IP 或域名),否则 RSS 图片无法正常显示。
  • PROXY_URLS 为可选项但强烈建议配置,配合项目内置的 Chrome TLS 指纹模拟可有效规避风控。
  • 扫码登录凭证保存在 .env 中,约 4 天过期,过期需重新扫码,注意别把 .env 泄露或提交到仓库。
  • 官方镜像支持 linux/amd64 与 linux/arm64(Apple Silicon、树莓派、ARM 服务器均可运行)。

核心亮点

  • 支持整号文章批量导出,且输出格式多达 7 种,覆盖文档、电子书和结构化数据
  • 内置 IP 代理池和反风控策略,显著降低高频抓取时的封号风险
  • 提供 MCP 接口,可直接接入 Claude、LangChain 等 AI Agent,扩展性强

不足之处

  • 依赖非官方接口,存在被微信平台策略变更导致失效的风险
  • 文档/社区待观察

适用场景

  • 个人或团队备份公众号历史文章,防止内容被删除
  • 将公众号内容转为 PDF/EPUB 用于离线阅读或分发
  • 作为 AI Agent 的知识检索源,实现公众号内容的智能问答或摘要

替代项目

WeChat article downloader、wechat2rss、wewe-rss

项目介绍

wechat-download-api 是搜索知识领域的开源项目,由 tmwgsicp 开发,是 2026 年新上线的项目。

在全站 13,109 个收录项目中,它的 GitHub 星标数(1,132)位列前 30%,在搜索知识分类中处于中上游。

近 42 天,它的 GitHub 星标从 995 增加到 1,132,净增 137。

项目仍在小幅维护中,最近一次代码更新于 2026-09-23。从国内网络环境看,可直接访问。

它主要面向的使用场景是:个人或团队备份公众号历史文章,防止内容被删除。同类可对比的替代方案包括 WeChat article downloader、wechat2rss、wewe-rss。

上一篇:telegram-search

下一篇:best-of-ai

同类项目推荐

firecrawl 开源

网页抓取像喝水一样简单,开发者省下整周加班

The web data API to search, scrape, and interact at scale.

★ 183325 2026-08-09
contoso-chat 开源

一键跑通 Azure RAG 应用,从代码到评估部署全流程

This sample has the full End2End process of creating RAG application with Prompty an···

★ 766 2026-08-09
graphify 开源

整个代码库画成一张图,找问题一眼定位

Turn any codebase, with its docs, SQL schemas, configs, and PDFs, into a queryable k···

★ 120493 2026-08-09
WeKnora 开源

文档往里一扔,自动变成啥都能答的知识库

Open-source LLM knowledge platform: turn raw documents into a queryable RAG, an auto···

★ 28895 2026-08-09