testing

本站收录 45 个带「testing」标签的 AI 开源项目

puppeteerPuppeteer 是一个由 Google 维护的 Node.js 库,提供高级 JavaScript API 来控制无头 Chrome 或 Firefox 浏★ 95,636brunobruno 是一个开源的 API 探索与测试 IDE,定位为 Postman 和 Insomnia 的轻量级替代品。它专注于解决传统 API 工具在协作、版本管★ 47,273promptfoopromptfoo 是一个开源的 LLM 评估与红队测试框架,用于系统化测试提示词、智能体(agents)和 RAG 应用。它解决了 AI 应用开发中缺乏标准化★ 25,560fakerFaker 是一个 Python 库,用于生成各种逼真的假数据,如姓名、地址、邮箱、电话、文本、日期、公司信息等。它解决了开发、测试和演示阶段需要大量真实感数据★ 19,415robotframeworkRobot Framework 是一个基于 Python 的通用自动化测试与机器人流程自动化(RPA)框架。它采用关键字驱动和表格化语法,让测试用例和自动化任务★ 11,919pestPest 是面向 PHP 开发者的现代化测试框架,构建在 PHPUnit 之上,用更简洁优雅的语法重写测试体验。它解决了传统 PHPUnit 测试代码冗长、断言★ 11,729artemisARTEMIS 是一个用自然语言驱动 Android 自动化的开源框架,目标是把「帮我点开设置、登录账号、完成下单」这类口语化指令,转成可靠可复现的端到端操作流★ 10,646mockserver-monorepoMockServer 是一个用于测试的 HTTP(S) 模拟服务器和代理,旨在解决开发与测试过程中对 API 依赖、网络不稳定及故障注入的需求。它允许你模拟任意★ 4,978mimesisMimesis 是一个 Python 库,用于生成逼真的假数据,支持多种语言和地区(locale)。它解决了开发、测试和演示阶段需要大量真实感测试数据的问题,无★ 4,840agent-deviceagent-device 是一个面向 AI 代理的移动设备控制命令行工具,旨在让 AI 代理能够直接操作 iOS 和 Android 设备,完成自动化测试、应用★ 4,817cliQA Wolf 官方命令行工具,把端到端测试能力从网页控制台搬到任何地方:本地终端、CI 流水线,甚至 AI Agent。它基于 Playwright 封装,用★ 3,450duskLaravel Dusk 是 Laravel 官方提供的端到端测试与浏览器自动化工具。它让 PHP 开发者无需手写复杂的 WebDriver 协议代码,就能用接★ 1,946evalplusevalplus 是一个用于严格评估大语言模型生成代码质量的基准测试框架,源自 NeurIPS 2023 与 COLM 2024 论文。它针对现有代码生成评测(★ 1,821testkubeTestkube 是一个开源的 Kubernetes 原生测试平台,专为 AI 驱动的工程团队设计。它解决了在云原生和 AI 应用开发中,测试工具碎片化、难以集★ 1,662testzeus-herculesHercules 是一个开源的 AI 测试代理,旨在通过自然语言指令自动化端到端测试,覆盖 UI、API、安全、可访问性和视觉验证。它解决了传统测试脚本编写和维★ 1,173HydraLabHydraLab 是一个智能云测试平台,旨在让云端测试变得简单易用。它解决了移动应用和跨平台应用在真实设备上执行端到端测试时面临的设备管理复杂、环境搭建繁琐、测★ 1,030alumniumAlumnium 是一个用 AI 驱动的端到端测试框架,目标是让 Agent 和工程师都能用自然语言编写和维护 UI 自动化测试。它把 LLM 作为测试执行的大★ 1,011claude-code-skillsclaude-code-skills 是一个为 Claude Code 和 Codex 等 AI 编程助手提供独立工程技能的开源项目。它解决的核心问题是:AI ★ 566Static-to-Dynamic-LLMEvalStatic-to-Dynamic-LLMEval 是论文《Recent advances in large language model benchmarks★ 500qgate-modelqgate-model 是一个面向 ML/AI 领域的元模型(meta-model)定义库,由 Iguazio 团队开发,用于统一描述机器学习工作负载、数据管道★ 405fuzz4allFuzz4All 是一个利用大型语言模型(LLM)实现通用模糊测试(Fuzzing)的开源框架。它解决传统模糊测试工具针对特定语言或输入格式定制、难以泛化的问题★ 338kaizenkaizen 是一个用 Python 编写的 AI 驱动开发自动化工具,旨在解决开发者日常工作中重复、繁琐的任务,如代码审查、测试生成、文档更新等。它通过理解项★ 304qgate-sln-mlrunqgate-sln-mlrun 是一个面向 MLRun、Iguazio 和 Nuclio 的质量门禁解决方案,用于检查 MLRun 实现和交付的质量。它通过自动★ 299orchestkitOrchestKit 是一个针对 Claude Code 的 AI 开发工具包,提供 114 个技能、37 个智能体和 212 个钩子,旨在将 Claude C★ 284lazy-birdlazy-bird 是一个通用的开发自动化工具,旨在为任意项目提供自动化开发流程。它集成 Claude Code,能够自主实现功能、运行测试并创建 Pull R★ 236agent-inspectagent-inspect 是一个面向 TypeScript/Node.js 开发者的本地执行树可视化工具,旨在解决 AI 代理运行过程不透明、难以调试的问题。★ 233arksimarksim 是一个用于对话式 AI 智能体的开源评估与模拟测试框架。它通过模拟真实用户与智能体进行交互,在智能体上线前自动发现潜在错误,帮助开发者提升对话系统★ 230gem-teamgem-team 是一个将 AI 编码转化为工程化流程的开源项目,旨在解决 AI 辅助开发中缺乏规范化、可重复流程的问题。它提供了一套工具和框架,帮助团队将 A★ 224EvalForgeEvalForge 是一个面向 AI/LLM 应用的评测与质量门禁工具,用 Python 编写。它解决的核心问题是:团队在 CI 中评测模型或 RAG 系统时,★ 211empiricalempirical 是一个用于测试和评估大语言模型(LLM)及其配置的开源基础设施工具。它帮助开发者在应用开发过程中,针对所有关键场景对模型进行系统性的测试和评★ 166promptpexpromptpex 是一个专注于提示词(Prompt)测试生成的开源项目,旨在为 LLM 应用开发者提供系统化的提示词评估与测试方案。它解决的核心问题是:提示词★ 165krakenKraken CI 是一个用 Python 编写的持续集成与测试系统,旨在为开发团队提供自托管的 CI/CD 解决方案。它解决了传统 CI 工具在配置复杂、资源★ 160awesome-agvawesome-agv 是一个面向 AI 编程代理的规则与最佳实践集合库,旨在通过系统化的标准和规范提升 AI 编码代理(如 Claude Code、Antig★ 157glanceglance 是一个基于 AI 的浏览器自动化 MCP 服务器,专为 Claude Code 设计,让你能在终端里通过自然语言指令完成网页导航、点击、截图和测试★ 156AgentEvalAgentEval 是一个面向 .NET 生态的 AI Agent 评测工具包,旨在为 .NET 开发者提供与 Python 生态中 RAGAS、PromptF★ 151playwright-rustplaywright-rust 是微软 Playwright 浏览器自动化框架的 Rust 语言绑定,让 Rust 开发者无需切换到 Node.js 或 Pyt★ 149antigravity-testing-kit这是一个由 Anh Tester 为软件测试社区构建的 AI 智能体工具包,专门用于在 Antigravity 平台上配置测试相关的 AI Agent。它包含一★ 140botsimBotSIM 是一个面向商业聊天机器人的端到端仿真测试工具包,旨在帮助开发者高效评估、诊断和优化对话系统。它通过数据增强(如释义生成)和用户模拟器,自动生成多样★ 116awesome-copilot-for-testers这是一个面向测试人员的 GitHub Copilot 资源集合,核心是把测试自动化中反复出现的任务(如编写 Playwright 测试、生成测试数据、分析失败用★ 114autoarenaautoarena 是一个用于自动化评估和排名大语言模型(LLM)、RAG 系统及提示词(prompt)的开源工具。它通过自动化的两两对比(head-to-he★ 108production-ready-data-science-code这是一个将杂乱的数据科学 notebook 转化为生产级代码的指南型项目,通过具体示例覆盖测试、CI/CD、MLOps 和可扩展部署实践。它解决了数据科学项目从★ 105testing-mltesting-ml 是一个面向机器学习工程师的实践指南,旨在通过测试代码、数据和模型来构建可靠的 ML 系统。项目以 Jupyter Notebook 形式呈★ 95xlflowxlflow 是一个面向 AI 智能体的命令行框架,专门用于编辑、测试、运行、追踪和对比 Excel VBA 项目。它解决了传统 VBA 开发中缺乏现代化工具链★ 87PyBreezePyBreeze 是一个面向开发者的 Python 自动化助手,旨在将多种自动化能力整合到 IDE 中,减少上下文切换。它内置了针对现代自动化场景的模块,覆盖 ★ 65litmusLitmus 是一个面向生成式 AI 应用开发的 LLM 测试与评估平台。它通过友好的用户界面,帮助开发者系统化地构建和评估基于大语言模型的应用性能。项目解决了★ 52