chatgpt-failures

看AI翻车现场,理性用大模型

这是一个记录ChatGPT及类似大模型失败案例的公开档案库。它系统性地收集、分类和展示AI模型在各类任务中产生的错误输出,包括逻辑错误、事实性错误、代码错误等。项目以网页形式呈现,方便用户浏览和检索典型失败案例,帮助开发者、研究者和普通用户直观了解当前AI模型的局限性,从而更理性地使用AI工具,并为模型改进提供参考。

开源 free 对话助手
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 595
维护状态 低维护
是否开源 是
定价模式 free

项目数据

分类对话助手
开发团队giuven95
所属国家
官网地址
定价模式free
价格说明开源项目,无在线服务,需自行部署,完全免费。
访问状态
是否开源是
开源协议
主要语言Python
技术栈/模型bing,chatbot,chatgpt,error,failure,new-bing,openai
GitHub 星标★ 595
30天Star增速
HF 下载量
上线时间2023-01-02 00:00:00
最近更新2026-09-19 00:00:00
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

使用教程

核心亮点

  • 真实案例驱动,直观展示模型边界,比抽象论文更有说服力
  • 分类清晰,便于按错误类型快速检索,实用性强
  • 以档案形式持续积累,社区可贡献案例,具有长期价值

不足之处

  • 项目已停止维护,案例更新停滞,时效性不足
  • 缺乏结构化数据导出或API,二次分析不便

适用场景

  • 开发者评估模型可靠性时,快速查看常见失败模式
  • 普通用户在使用AI前,了解其潜在风险与局限
  • 研究者收集失败样本,用于模型改进或测试集构建

替代项目

AI Incident Database、Hallucination Leaderboard、BigBench

项目介绍

chatgpt-failures 是评测安全领域的开源项目,由 giuven95 开发,2023 年首次发布。

它收录于评测安全分类,该分类目前共有 466 个项目,GitHub 星标数为 595。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-09-19。无在线服务,需自行部署,完全免费。

它主要面向的使用场景是:开发者评估模型可靠性时,快速查看常见失败模式。同类可对比的替代方案包括 AI Incident Database、Hallucination Leaderboard、BigBench。

上一篇:appworld

下一篇:Multi-Modality-Arena

同类项目推荐

akto 开源

给 AI 应用做安全体检,防提示注入和数据泄露

Akto is the fastest growing AI Security platform for your teams to secure AI agents,···

★ 1517 2026-08-20
XSafeClaw 开源

给 AI 智能体装上安全盾,自动红队测试找漏洞

Introducing XSafeClaw: The Open-Source Agent Safety Platform from Fudan University

★ 164 2026-08-10
deepteam 开源

自动模拟越狱攻击,提前测出 LLM 安全漏洞

DeepTeam is a framework to red team LLMs and AI agents.

★ 2937 2026-09-12