本地推理
依托 Apple 原生的 MLX Swift 框架,在进程内高速执行。你的提示词和数据绝不会离开 Mac。
macOS 原生应用
在 Mac 上完全离线运行本地 AI 模型(Llama、Qwen)。这款专为 Apple 芯片打造的菜单栏工具,通过快捷指令、macOS 服务或内置的浮动聊天窗口,把高速的本地推理引擎开放给整个系统。
功能
依托 Apple 原生的 MLX Swift 框架,在进程内高速执行。你的提示词和数据绝不会离开 Mac。
直接在 Apple 的“快捷指令”App 中触发并串联 AI 查询,实现工作流自动化。
在 Safari、Xcode 或“邮件”中选中文本,右键即可用模型的输出就地替换(改写、摘要、翻译)。
独立的浮动聊天窗口,带多轮对话记录,方便与已加载的模型快速交流。
闲置超时后自动卸载模型,并清理 Metal 缓存,把统一内存归还给 macOS。
输入任意 Hugging Face Hub ID 即可自动下载模型,也可以指向你本地的权重目录。
自动化
LocalModel Bridge 提供系统级的 AppIntents,让你顺畅地掌控离线推理。
把提示词发送给本地模型,并在快捷指令中直接接收生成的文本。
在重复性任务开始前,于后台预先加载模型配置,为系统内存预热。
自动化任务一结束就卸载模型,立即释放 Mac 的统一内存。
数据隐私
所有提示词、处理过的文档和对话都不会离开你的电脑。推理在本地离线完成。
模型运算通过 Metal 着色器,在 Apple 芯片的核心上进程内执行,不涉及任何外部云服务器。
网络访问被严格限制在你主动发起的 Hugging Face 模型下载,以及本地主机的 API。
应用不会收集、监控或传输任何使用数据、提示词或所选模型。
安全保证:无需账户即可完全离线运行,下载模型之后不再需要联网。
阅读完整隐私政策 →支持
我们乐于协助你配置模型文件、设置快捷指令,或接入本地 API 服务器。
查看支持与常见问题 →