statistics

本站收录 17 个带「statistics」标签的 AI 开源项目

smileSmile是一个基于Java的统计机器智能与学习引擎,专注于提供全面、高效的机器学习与数据挖掘工具。它解决了Java生态中缺乏功能完整且性能优异的ML库的问题,★ 6,414Data-Science-Roadmap这是一个面向数据科学学习者的从零到一路线图,覆盖数据分析、数据工程、机器学习、深度学习、大数据、数据可视化等核心领域,并提供面试准备、简历模板和速查表等实用资源★ 4,380AI-Engineer-HeadquartersAI-Engineer-Headquarters 是一个面向 AI 工程师的知识库与工具集,以 Jupyter Notebook 形式组织,汇集了构建机器学习模★ 3,689raftRAFT 是 NVIDIA 开源的 CUDA 加速算法与基础原语库,面向机器学习和信息检索场景。它把常用但实现复杂的底层算子(如距离计算、聚类、线性代数、最近邻★ 1,042Ultimate-Data-Science-Toolkit---From-Python-Basics-to-GenerativeAI这是一个面向数据科学和生成式AI学习者的开源课程/资源库,以Jupyter Notebook形式提供从Python基础到生成式AI的完整学习路径。项目旨在解决数★ 973cuvscuVS 是 NVIDIA 开源的 GPU 向量搜索与聚类库,属于 RAPIDS 生态的基础设施组件。它把近似最近邻搜索(ANN)、距离计算、邻居图构建和聚类等★ 857advanced-machine-learning-engineer-roadmap-2024这是一个面向2024年的全栈机器学习工程师学习路线图,旨在帮助学习者系统掌握从数据处理、模型开发到部署运维的完整技能链。项目以结构化的路线图形式,梳理了成为全栈★ 703tracemltraceml 是 Polyaxon 生态下的 AI/ML 数据追踪与可视化引擎,专注于解决机器学习实验中的指标跟踪、数据漂移检测和模型可解释性问题。它提供了一★ 534popmonpopmon 是一个用于监控 Pandas 或 Spark 数据框稳定性的开源库。它通过自动计算数据分布、统计指标和相关性等特征,并基于历史数据或预期值进行对比★ 511aramgg_clientaramgg_client 是一款面向《英雄联盟》极地大乱斗(ARAM)及 Mayhem 模式的 Windows 桌面伴侣工具,基于 Electron + Vu★ 440data-scientist-roadmap2024这是一个面向数据科学家和机器学习工程师的学习路线图项目,以 Jupyter Notebook 形式整理了从基础到进阶所需的资源和主题。项目旨在为想进入数据科学领★ 355StatsPAIStatsPAI 是一个面向智能体(Agent)的原生 Python 库,专注于因果推断与应用计量经济学。它提供统一的 API 接口,覆盖广泛的因果推断方法,如★ 325frourosFrouros 是一个开源的 Python 库,专门用于机器学习系统中的漂移检测。它解决的是模型上线后因数据分布变化(概念漂移、数据漂移)导致性能下降的问题。核★ 261Data-science-ML-and-DL-Resources这是一个面向机器学习、深度学习和数据科学学习者的免费资源集合仓库。它系统地整理了笔记、课程、视频、项目、文章和代码仓库链接,覆盖了从Python、SQL基础到C★ 199whylogs-javawhylogs-java 是 whylogs 的 Java 实现,用于对机器学习数据管道进行端到端的画像(profiling)和监控。它解决的是 ML 数据质量★ 177Machine-Learning这是一个个人博客配套的机器学习内容仓库,以 Jupyter Notebook 形式收录了作者博客中关于机器学习的全部代码和讲解。项目主要解决机器学习入门者缺乏系★ 115MLFlowClient.jlMLFlowClient.jl 是一个 Julia 语言的 MLflow 客户端库,旨在让 Julia 用户能够无缝集成 MLflow 的机器学习生命周期管理功★ 59