
toshllm
让 Intel Mac 的 AMD 显卡也能本地跑大模型
toshllm 是一款原生 macOS 应用,专为搭载 AMD 显卡的 Intel Mac(含黑苹果/Hackintosh 机器)提供本地大语言模型运行能力。传统上,llama.cpp 等推理框架在 macOS 上主要依赖 Apple Silicon 的 Metal 加速,Intel Mac 用户尤其是使用 AMD 独显的机器往往只能退回 CPU 推理,速度慢、体验差。toshllm 通过 Swift 与 Metal 直接对接 AMD GPU,让这类设备也能获得 GPU 加速的本地推理。它内置模型加载、对话交互与参数调节界面,基于 SwiftUI 构建,开箱即用,无需命令行折腾。核心能力包括:调用 AMD GPU 执行 Metal 计算、本地加载 GGUF 等常见模型格式、提供图形化聊天窗口,并针对 Intel Mac 的硬件特性做适配。对于想在自己老款或黑苹果 Mac 上离线跑大模型的用户,这是一个少见的针对性方案。
项目数据
使用教程
核心亮点
- 专门填补 Intel Mac + AMD GPU 本地推理的空白,同类工具基本只支持 Apple Silicon
- 原生 SwiftUI 应用,图形界面开箱即用,不用手动编译 llama.cpp 或敲命令行
- 基于 Metal 直接调用 AMD GPU,相比纯 CPU 推理能明显提升生成速度
不足之处
- 仅覆盖 Intel Mac + AMD GPU 这一小众硬件组合,适用人群窄
- 项目处于早期,模型兼容性、稳定性和文档完善度有待观察
适用场景
- 黑苹果用户想在本地离线运行大模型做对话或写作
- 老款 Intel Mac 配 AMD 独显,不想依赖云端 API 保护隐私
- 开发者测试 AMD GPU 在 macOS 下的 Metal 推理性能
替代项目
llama.cpp、Ollama、LM Studio
项目介绍
同类项目推荐
freebuff-proxy
开源
聚合多账号,一键接入 OpenAI 兼容 API,轻松管理会话。
OpenAI-compatible gateway for FreeBuff coding models. Token pool, session lifecycle,···
microduck
开源
用 Rust 造一只会走路的桌面小鸭,快速上手双足机器人。
A Tiny biped duck robot
soperator
开源
用 Kubernetes 原生方式运行 Slurm,简化 HPC 集群管理。
Run Slurm in Kubernetes
ollama
开源
一条命令本地跑起大模型,免费、私密、不卡顿
Get up and running with Kimi, GLM, MiniMax, DeepSeek, gpt-oss, Qwen, Gemma and other···