long-context
本站收录 13 个带「long-context」标签的 AI 开源项目
InternLMInternLM 是由上海人工智能实验室开源的大型语言模型系列,涵盖 InternLM、InternLM2、InternLM2.5 和 InternLM3 等多★ 7,280
LongLoRALongLoRA 是一个针对大语言模型的长上下文微调方案,由 MIT 等机构提出,相关论文入选 ICLR 2024 Oral。它解决了在有限算力下将预训练模型(★ 2,686
HeliosHelios 是一个专注于实时长视频生成的扩散模型开源项目,旨在解决当前视频生成模型推理速度慢、生成时长受限的问题。它支持图像到视频(image-to-vide★ 2,176
LongWriterLongWriter 是一个旨在释放长上下文大语言模型(LLM)万字级生成能力的开源项目,由清华大学提出,相关论文被 ICLR 2025 接收。它解决了当前长上★ 1,874
kvpresskvpress 是一个专注于大语言模型(LLM)KV 缓存压缩的 Python 库,旨在让 KV 缓存压缩变得简单易用。它解决了长上下文推理中 KV 缓存占用大★ 1,222
ringattentionringattention 是一个专注于大上下文场景的注意力机制优化项目,旨在解决长序列处理中计算和内存开销过大的问题。它通过环形(ring)分布策略,将注意力★ 773
halogen-flash-serverhalogen-flash-server 是一个面向 AMD Strix Halo(gfx1151)平台的本地大模型推理部署脚本,目标是让用户以最快速度在搭载该★ 729
InfiniteBenchInfiniteBench 是论文《∞Bench: Extending Long Context Evaluation Beyond 100K Tokens》的★ 393
LooGLELooGLE 是 ACL 2024 发布的面向长上下文语言模型的评测基准,旨在系统评估模型对超长文档的理解与生成能力。它解决了现有基准在长文本任务上区分度不足、★ 200
PersonaMemPersonaMem 是 COLM 2025 论文的开源基准测试,用于评估大语言模型在动态用户画像和个性化回复方面的能力。它解决了现有评测缺乏对长期、动态用户记★ 197
LoongLoong 是 EMNLP 2024 的 Oral 论文项目,专注于长上下文大语言模型(LLM)的评测基准。它针对现有长文本评测任务中“文档被截断”或“仅需单文★ 154
LongRAGLongRAG 是一个面向长上下文问答的检索增强生成(RAG)范式,发表于 EMNLP 2024。它针对传统 RAG 在处理长文档时检索粒度粗、上下文利用率低的★ 122
LongLLaDALongLLaDA 是一个面向扩散式大语言模型(Diffusion LLM)的长上下文能力增强方案,由 AAAI26 论文提出。扩散式 LLM 与传统自回归模型★ 56