scikit-learn
本站收录 21 个带「scikit-learn」标签的 AI 开源项目
best-of-ml-python这是一个精选的机器学习Python库排行榜,每周自动更新,按GitHub星标数排序,帮助开发者快速发现和评估优秀的ML工具。它解决了机器学习生态中库数量庞大、质★ 23,828
autogluonAutoGluon 是一个自动化机器学习(AutoML)库,旨在用三行代码实现快速且准确的模型训练。它解决了传统机器学习中模型选择、超参数调优和特征工程耗时费力★ 10,754
pycaretPython 生态中的开源低代码 AutoML 平台,几行代码即可完成数据预处理、模型训练、调参与对比。4.0 版本采用 sklearn 原生引擎并引入 Rea★ 9,848
scikit-llmscikit-llm 是一个将大语言模型无缝集成到 scikit-learn 生态的开源 Python 库。它解决了传统机器学习流程中难以直接调用 LLM 的问★ 3,534
katibKatib 是一个基于 Kubernetes 的自动化机器学习(AutoML)平台,旨在解决在云原生环境中进行超参数调优、神经网络架构搜索(NAS)和早停(Ea★ 1,704
skforecastskforecast 是一个基于 Python 的时间序列预测库,它允许用户直接使用 scikit-learn 兼容的机器学习模型(如随机森林、XGBoost、★ 1,537
skopsskops 是一个专注于 scikit-learn 模型共享与生产的 Python 库。它解决了机器学习模型在训练后难以标准化保存、分享和部署的问题。核心能力包★ 528
modelstoremodelstore 是一个 Python 库,用于机器学习模型的版本管理、导出和保存。它解决了模型在训练后难以统一管理和复现的问题,支持将模型保存到本地文件系★ 403
Sklearn-genetic-optsklearn-genetic-opt 是一个面向 scikit-learn 的超参数优化与特征选择工具,采用进化算法(如遗传算法)自动搜索最佳模型配置。它解决★ 390
upginiupgini 是一个面向机器学习的数据搜索与增强库,旨在帮助数据科学家快速从数百个公共和商业外部数据源(包括开放及商业大语言模型)中查找并添加相关特征到 ML/★ 358
machine-learning这是一个面向所有人的免费AI学习与教学资源库,旨在通过协作方式帮助初学者和爱好者共同学习人工智能。项目以Jupyter Notebook为主要载体,提供从基础概★ 231
watchtowerAIShield Watchtower 是一个用于AI模型洞察与漏洞扫描的开源工具,旨在帮助开发者和安全团队深入理解AI模型的行为,并识别潜在的安全风险。它通过★ 203
fake-news这是一个从零构建假新闻检测器的开源项目,覆盖从想法到模型部署的完整流程。项目以Jupyter Notebook为主要载体,逐步演示如何收集数据、清洗文本、特征工★ 171
pymiloPyMilo 是一个专注于机器学习模型序列化与反序列化的 Python 库,旨在解决不同 ML 框架(如 scikit-learn、XGBoost 等)模型在保★ 169
mlops-projects这是一个面向实战的 MLOps 项目合集,旨在帮助学习者通过动手实践掌握机器学习工程在生产环境中的落地技能。项目以 Jupyter Notebook 为主要载体★ 112
omegamlomegaml 是一个面向 MLOps 的一站式 AI 交付平台,旨在简化机器学习模型的开发、部署和管理流程。它解决了企业在将模型从实验环境推向生产时面临的复杂★ 107
mloperatormloperator 是一个面向 Kubernetes 的机器学习/AI 训练、推理服务及智能体沙箱的 Operator 和控制器。它解决了在 Kubernet★ 95
ai-ml-roadmap这是一个面向2025年AI和机器学习初学者的学习路线图项目,旨在提供从基础到进阶的系统化学习路径。它解决了初学者面对海量AI/ML资源时不知从何入手、学习路径不★ 90
polyaxon-examplespolyaxon-examples 是 Polyaxon 平台的官方示例代码库,提供了一系列教程和示例,帮助用户快速上手 Polyaxon。Polyaxon 是★ 67
hypertunehypertune 是一个用于超参数优化的 Python 库,旨在简化机器学习模型的调参流程。它解决了手动网格搜索或随机搜索效率低、难以找到最优参数组合的问题。★ 63
sklearn-diagnosesklearn-diagnose 是一个面向 Scikit-learn 模型的 AI 诊断工具,旨在帮助数据科学家快速识别模型训练中的常见问题,如过拟合、数据泄★ 62