Apfel:在终端里调用 macOS 内置 LLM
介绍 Apfel 对 macOS FoundationModels 的 CLI 与本地 API 封装,说明 Apple Intelligence 可用性、系统模型下载、兼容接口及外部工具边界。
直接回答:Apfel 是调用 Apple FoundationModels 的 Swift 工具,提供终端、聊天和兼容部分 OpenAI 调用的本地服务。端侧模型需在支持的设备、系统与地区语言条件下可用,不能把本地推理简单等同于只使用 Neural Engine。
Apfel 是什么、不是什么
Apfel 不是模型。它是封装 FoundationModels 框架的小型 Swift 二进制,在终端用法与苹果原生 API 之间做翻译。Apfel 本身不另带模型权重,但 Apple Intelligence 模型需要由系统准备或下载,必须启用且检查可用性。
三个接口:脚本与快速查询用的 UNIX CLI;对话用的交互聊天;模拟 OpenAI API 的 HTTP 服务器——现有 SDK 指向它可复用兼容的调用,但需核对支持字段和行为。
要求与安装
Apple Silicon Mac(M1 或更新)+ macOS 26 + 开启 Apple Intelligence + Homebrew:
brew install apfel
安装时间取决于环境,系统模型是否就绪与工具安装是两回事。
CLI 用法
apfel --stream "作为语言模型你能做什么?"
--stream 逐 token 输出,长回答可读。模型本地运行,断网可用——纯本地模型推理不需云 API;如果接入远程 MCP 或其他工具,相关数据仍可能出网。
脚本化与文件输入
标准 UNIX 行为,输出可管道可重定向:
apfel "写一个模拟基础计算器的 Python 函数" > calculator-draft.py
apfel -f calculator-draft.py "审查这段代码并提两个改进建议"
-f 把文件内容作为上下文传入。重定向会覆盖同名文件,先确认草稿路径不存在;生成内容可能含说明或代码围栏,必须检查和测试后再运行,模型的自我审查不替代独立验收。
OpenAI 兼容服务器与对比 Ollama
兼容服务支持的路径、流式、工具和参数是有限集合,不能宣称任意 SDK 只改 URL 就全功能兼容。启动时限制监听地址并按官方配置认证,不把未保护的本地推理端口暴露公网。
Ollama 管理可选模型;Apfel 使用系统可用模型与其限制。Apfel 不负责下载独立权重,不代表系统模型零下载或服务零维护。
局限性
- 模型只有约 3B——复杂推理与长文写作能力有限
- 锁定 macOS 26 + Apple Silicon,无跨平台
- 能力边界由苹果模型更新节奏决定,不可自行换模型
常见问题(FAQ)
Q:数据一定不出本机吗?
A:纯端侧推理与远程工具应分别检查,日志和调用客户端也可能转发内容。
Q:生成脚本能直接执行吗?
A:先检查、测试并限制权限,不将模型输出直接传给 shell 或覆盖重要文件。
Q:支持所有 M1 以上 Mac 吗?
A:还需支持的 macOS、Apple Intelligence 开启、模型就绪及适用地区语言条件。
参考资料
资料核对日期:2026 年 9 月 29 日。本文基于公开文档整理,代码片段和评估方案未作独立运行或性能验证;厂商测试结果已注明来源。