llama.vscode

本地跑 Llama,离线也能智能补全代码

llama.vscode 是一个 VS Code 扩展,利用本地运行的 LLM(如 Llama 系列模型)提供代码和文本补全功能。它解决了在编辑器中依赖云端 API 进行 AI 补全的隐私和延迟问题,通过 llama.cpp 等后端在本地推理,实现离线、低延迟的智能补全。核心能力包括:基于上下文的代码补全、多模型支持(如 Llama 2/3、Code Llama)、自定义提示词模板、以及通过 llama.cpp 的 GPU 加速。该扩展强调用户对数据和模型的控制,适合注重隐私的开发者。

开源 free 开源模型
访问官网 ↗ GitHub ↗ 文档 ↗
GitHub 星标 ★ 1528
维护状态 活跃
是否开源 是
定价模式 free

项目预览

项目数据

分类开源模型
开发团队ggml-org
所属国家
官网地址
定价模式free
价格说明开源 VS Code 扩展,MIT 许可证,完全免费,无付费版本。
访问状态
是否开源是
开源协议MIT
主要语言TypeScript
技术栈/模型copilot,developer-tool,extension,llama,llm,vscode
GitHub 星标★ 1528
30天Star增速
HF 下载量
上线时间2025-01-06 00:00:00
代码更新—
仓库体积—
本站数据更新—
维护状态活跃
中文支持
访问方式
移动端支持
综合评分
收录时间2026-08-09
浏览次数6

Star 增长趋势

本站每日记录该项目 GitHub 星标变化,观测越久曲线越完整

正在加载星标数据…

技术标签

使用教程

—

难度:入门 约 15 分钟 部署方式:本地安装 6 步

环境要求

  • 已安装 VS Code(扩展本体运行在 VS Code 中)
  • macOS 需已安装 Homebrew;Windows 需 Windows Package Manager (winget)
  • Linux 需自行下载 llama.cpp 最新二进制并把其 bin 目录加入 PATH
  • 一台能运行 llama.cpp 的本地机器(低端硬件也可,扩展支持智能上下文复用)

安装与启动步骤

  1. 1安装 VS Code 扩展

    从 VS Code 扩展市场安装 llama-vscode(扩展 ID 为 ggml-org.llama-vscode),也可在 Open VSX 获取;安装后无需其他依赖即可在编辑器中使用。

    code --install-extension ggml-org.llama-vscode
  2. 2安装 llama.cpp

    启动 llama-vscode 后会自动安装 llama.cpp(Mac 走 brew,Windows 走 winget)。也可点状态栏的 llama-vscode 或按 Ctrl+Shift+M 打开菜单,选择 Install/Upgra

  3. 3Linux 用户装 llama.cpp

    Linux 不自动安装:从 llama.cpp 官方 releases 下载最新二进制,解压后把其中的 bin 目录加入系统 PATH,确保命令行可调用。

  4. 4选择环境 Env

    在 llama-vscode 菜单中选 Select/start env...,选中一个包含模型的环境(Env 是一组模型,选中/取消会同时启用其中所有模型)。

  5. 5打开 Llama Agent

    按 Ctrl+Shift+A 或从 llama-vscode 菜单选 Show Llama Agent 打开智能体视图,前提是已为 Agent 选择好 Env。

  6. 6发起对话/补全

    在 Agent 中写查询,需要时可点 @ 按钮附加文件;在编辑器里正常输入即可触发补全建议。

关键配置

配置项必填说明示例
模型选择(Model selection)否分别为补全、聊天、嵌入、工具选择所用模型在 llama-vscode 菜单中配置
Max text generation time否控制单次补全的最大文本生成时间在扩展设置中按需调整
Context scope否控制光标周围纳入提示的上下文范围在扩展设置中按需调整

如何确认成功

状态栏出现 llama-vscode 图标;按 Ctrl+L 能手动触发补全建议;Ctrl+Shift+A 能打开 Llama Agent 并正常返回结果。

常见问题

Q:Linux 上 llama.cpp 怎么装?

A:自动安装仅覆盖 Mac 和 Windows。Linux 请到 llama.cpp 的 releases 页下载最新二进制,解压后把 bin 目录加入 PATH。

Q:补全建议怎么接受?

A:Tab 接受整条建议,Shift+Tab 只接受第一行,Ctrl/Cmd + 右方向键接受下一个词,Ctrl+L 手动开关建议。

Q:需要联网或云端 API 吗?

A:不需要,推理通过本地 llama.cpp 完成,代码不出本机;扩展也内置了部分本地与外部预定义模型。

Q:手机上能用吗?

A:可以,README 提到可通过 Telegram bot 访问 llama-vscode 的 agents。

Q:怎么管理多个模型?

A:在菜单里对模型和 Env 进行添加、删除、导出、导入,Env 作为一组模型的集合统一选中或取消。

注意事项

  • 详情与更多用法见项目 wiki:https://github.com/ggml-org/llama.vscode/wiki
  • 扩展还支持 Deep Link,如 vscode://ggml-org.llama-vscode?view=agent&prompt=Hello 可直接打开 Agent 并带入提示词
  • 可通过扩展菜单导出/导入模型与 Env,便于在多台机器间复用配置

核心亮点

  • 完全本地推理,代码不出本机,隐私安全
  • 支持多种 Llama 系列模型,灵活切换
  • 利用 llama.cpp 实现 GPU 加速,补全速度快

不足之处

  • 需要用户自行配置模型和 llama.cpp,上手门槛较高
  • 补全质量依赖模型大小,小模型效果一般
  • 文档/社区待观察

适用场景

  • 隐私敏感的开发环境,如金融、医疗项目
  • 离线或弱网环境下需要 AI 辅助编程
  • 希望深度定制补全模型和提示词的开发者

替代项目

Continue、Tabby、Fitten Code

项目介绍

llama.vscode 是编程开发领域的开源项目,由 ggml-org 开发,2025 年首次发布。

在全站 13,635 个收录项目中,它的 GitHub 星标数(1,528)位列前 30%,在编程开发分类中处于中上游。

近 44 天,它的 GitHub 星标从 1,483 增加到 1,528,净增 45。

项目目前处于活跃维护状态,最近一次代码更新于 2026-09-28。开源 VS Code 扩展,MIT 许可证,完全免费,无付费版本。

它主要面向的使用场景是:隐私敏感的开发环境,如金融、医疗项目。同类可对比的替代方案包括 Continue、Tabby、Fitten Code。

上一篇:tlm

下一篇:mex

同类项目推荐

bolt.new 开源

想到啥说啥,网页应用当场生成直接能用

Prompt, run, edit, and deploy full-stack web applications. -- bolt.new -- Help Cente···

★ 16572 2026-08-09
fuzz4all 开源

用大模型自动生成测试输入,发现各种软件漏洞

️Fuzz4All: Universal Fuzzing with Large Language Models

★ 338 2026-08-09
ponytail 开源

教 AI 学会偷懒,不写代码反而更快交付

Makes your AI agent think like the laziest senior dev in the room. The best code is ···

★ 153669 2026-08-09
pi-agent-desktop 开源

下载即用的桌面 AI 编程助手,免配置免命令行

Pi — A cross-platform AI coding agent, bringing the Claude Code experience to your ···

★ 475 2026-09-25