pre-trained-model

本站收录 10 个带「pre-trained-model」标签的 AI 开源项目

unilmUniLM是微软开源的大规模自监督预训练模型系列,旨在统一处理自然语言理解与生成任务。它基于Transformer架构,通过掩码语言建模、序列到序列建模等预训练★ 22,226KnowLMKnowLM 是一个开源的知识增强大语言模型框架,旨在提升大模型在知识密集型任务上的表现。它通过整合外部知识库、知识图谱和结构化数据,在预训练、微调和推理阶段注★ 1,386KnowledgeEditingPapersKnowledgeEditingPapers 是一个精选论文列表,聚焦于大语言模型(LLM)的知识编辑(Knowledge Editing)领域。知识编辑旨在高★ 1,248FasterViTFasterViT 是一个面向视觉任务的高效 Transformer 模型,由 NVIDIA 研究人员开发,相关论文发表于 ICLR 2024。它旨在解决传统 ★ 925ModelsGenesisModels Genesis 是医学图像分析领域最早的基础模型之一,由 MICCAI 2019 青年科学家奖和 MEDIA 2020 最佳论文奖背书。它通过自监★ 794UrbanGPTUrbanGPT 是一个面向城市时空数据的大语言模型,发表于 KDD 2024。它旨在解决传统时空预测模型难以泛化到未见城市或区域的问题,通过将大语言模型与时空★ 460SuPreMSuPreM 是一个面向医学影像分析的3D预训练模型库,基于ICLR 2024 oral论文提出。它利用9,262个CT体数据和25个标注类别进行监督预训练,解★ 433rust-mlops-templaterust-mlops-template 是一个正在开发中的开源项目,旨在使用 Rust 语言构建机器学习运维(MLOps)解决方案的模板。它针对当前 MLOps★ 385helicalhelical 是一个专注于基因组学和转录组学模态的预训练生物基础模型框架,旨在为研究人员提供开箱即用的先进生物模型。它解决了生物信息学领域模型复用难、标准化缺★ 231awesome-data-contamination这是一个关于大语言模型评估中数据污染问题的论文列表项目。数据污染指预训练数据中混入下游评估测试集,导致模型评估分数虚高、结果失真。该项目系统整理了相关研究论文,★ 119