llama3.java

纯 Java 跑 Llama 3,不装 Python 也能本地推理

llama3.java 是一个纯 Java 实现的 Llama 3 及后续版本的大语言模型推理库,无需依赖 C/C++ 或 Python 环境,即可在 JVM 上直接加载 GGUF 格式模型并执行生成任务。它解决了 Java 生态中缺乏高性能原生 LLM 推理方案的问题,让 Java 开发者能无缝集成本地或私有的 LLM 能力。核心能力包括:支持 GGUF 模型加载、SIMD 加速(利用 CPU 指令集优化)、与 OpenAI 兼容的 API 接口,以及基于 Transformers 的模型转换工具。项目处于早期阶段,但已具备基本的文本生成功能,适合作为 Java 环境下的轻量级推理引擎,用于构建离线聊天机器人、智能文档处理或边缘设备上的 AI 应用。

开源 free 对话助手
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 816
维护状态 低维护
是否开源 是
定价模式 free

项目预览

项目数据

分类对话助手
开发团队mukel
所属国家
官网地址
定价模式free
价格说明开源项目,MIT许可证,完全免费,可自行部署使用。
访问状态
是否开源是
开源协议MIT
主要语言Java
技术栈/模型chatgpt,genai,gguf,huggingface,java,llama,llama3,llamacpp,llm,llm-inference,llms,openai,simd,transformers
GitHub 星标★ 816
30天Star增速
HF 下载量
上线时间2024-04-25 00:00:00
代码更新—
仓库体积—
本站数据更新—
维护状态低维护
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数3

Star 增长趋势

本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整

正在加载星标数据…

技术标签

使用教程

—

核心亮点

  • 纯 Java 实现,零原生依赖,部署简单,适合 JVM 技术栈团队
  • 内置 SIMD 优化,在 CPU 上推理性能优于纯解释型方案
  • 兼容 GGUF 格式,可直接使用 HuggingFace 上的主流量化模型

不足之处

  • 项目早期,功能稳定性与生态成熟度待验证
  • 文档/社区待观察

适用场景

  • Java 后端服务中嵌入本地 LLM 推理,避免外部 API 调用
  • 离线环境下的智能客服或文档摘要工具
  • 教学或研究场景,用于理解 Transformer 推理的 Java 实现

替代项目

llama.cpp、LangChain4j、DJL (Deep Java Library)

项目介绍

llama3.java 是基础设施领域的开源项目,由 mukel 开发,2024 年首次发布。

在全站 13,635 个收录项目中,它的 GitHub 星标数(816)位列前 30%,在基础设施分类中处于中上游。

项目已超过三个月没有代码更新,维护节奏明显放缓,最近一次代码更新于 2026-04-24。MIT许可证,完全免费,可自行部署使用。

它主要面向的使用场景是:Java后端服务中嵌入本地LLM推理,避免外部API调用。同类可对比的替代方案包括 llama.cpp、LangChain4j、DJL (Deep Java Library)。

上一篇:token-limit

下一篇:gemma4.java

同类项目推荐

freebuff-proxy 开源

聚合多账号,一键接入 OpenAI 兼容 API,轻松管理会话。

[DEPRECATED / UNMAINTAINED] No longer maintained.

★ 303 2026-08-20
microduck 开源

用 Rust 造一只会走路的桌面小鸭,快速上手双足机器人。

A Tiny biped duck robot

★ 9099 2026-09-10
soperator 开源

用 Kubernetes 原生方式运行 Slurm,简化 HPC 集群管理。

Run Slurm in Kubernetes

★ 442 2026-08-10
ollama 开源

一条命令本地跑起大模型,免费、私密、不卡顿

Get up and running with Kimi, GLM, MiniMax, DeepSeek, gpt-oss, Qwen, Gemma and other···

★ 182135 2026-08-09