关键要点
- Locally AI可完全离线、在设备本地运行开源模型——Llama、Gemma、Qwen和DeepSeek。
- 支持平台:iPhone、iPad和Mac,针对Apple Silicon优化。
- 模型下载完成后即无需联网。
- 隐私优先定位:开发者表示推理在设备本地进行,不产生云端调用。
- 仅限Apple平台——没有Windows或Android版本,其他系统的用户需要另选应用。
- 任何面向手机和平板的设备端应用都存在的核心取舍:能够舒适运行在移动硬件上的模型规模,在复杂、多步骤的推理任务上会落后于前沿级云端模型。
📍 简单一句话
Locally AI是一款适用于iPhone、iPad和Mac的应用,可完全在设备本地运行开源语言模型——包括Llama、Gemma、Qwen和DeepSeek——并针对Apple Silicon优化,因此模型下载完成后,聊天既不需要联网也不需要任何云端调用。
💬 简单来说
Locally AI不会把你的消息发送到某家公司的服务器,而是把一个体积紧凑的AI模型下载到你的iPhone、iPad或Mac上,直接在本地运行。下载完成后,你可以打开飞行模式,应用照样能用,因为开发者秉持隐私优先的设计理念,对话内容本身完全不需要离开你的设备。
📌注: 本评测基于locallyai.app及该应用官方页面公开披露的信息撰写。撰写时未独立验证价格、确切的模型列表、存储大小及最低系统版本要求——下载前请以官网或App Store页面的最新信息为准。
Locally AI是什么?
Locally AI是一款直接在iPhone、iPad和Mac上运行开源语言模型的应用,不会将对话发送到云端服务。 它专为Apple Silicon构建并优化——Apple Silicon是苹果目前在iPhone、iPad和Mac产品线中使用的芯片架构,这意味着该应用被设计为利用这些芯片提供的设备端神经网络和GPU硬件,而不是把手机当作连接远程服务器的瘦客户端。
核心模型阵容包括Llama(Meta的开放权重模型系列)、Gemma(Google的开放权重模型系列)、Qwen(阿里巴巴的开放权重模型系列)以及DeepSeek(DeepSeek的开放权重模型系列)——这些都是可以作为独立文件分发、并且无需厂商控制的API即可运行的开源模型。Locally AI将对这些模型的访问打包进一个同时适用于移动端和桌面端的单一界面,用户无需自行获取模型文件,也无需另外运行推理服务器。
一旦某个模型完成下载到设备,Locally AI生成回复就不再需要联网——推理在本地进行,使用设备自身的处理器和内存。这就是"离线"的实际含义:只要提前下载好模型,应用就可以在飞行模式下、在飞机上,或在任何没有网络连接的地方使用。
Locally AI支持哪些模型?
Locally AI支持多个主流开源模型系列——Llama、Gemma、Qwen和DeepSeek——以及其他开源模型,全部可以完全在设备本地运行。 这四个系列覆盖了广泛的应用场景,是目前使用最广泛的开放权重模型之一,分别由不同的组织维护(Meta、Google、阿里巴巴和DeepSeek)。
- Llama — Meta的开放权重模型系列,在整个本地LLM生态中被广泛用作通用聊天和推理的基线模型。
- Gemma — Google的开放权重模型系列,与Google的Gemini模型出自同一研究谱系,常用于设备端和边缘部署。
- Qwen — 阿里巴巴的开放权重模型系列,以强大的多语言支持和适应受限硬件的多种模型规模而著称。
- DeepSeek — DeepSeek的开放权重模型系列,以相对模型规模而言具有竞争力的推理性能而受到认可。
- 其他开源模型 — Locally AI表示除上述四大旗舰系列外还支持其他开源模型,进一步扩大了可在设备本地运行的模型选择范围。
Locally AI在各平台上的表现
iPhone
- 预期表现:
- Locally AI可在iPhone上运行,应用针对Apple Silicon的设备端神经网络和GPU硬件进行了优化。下载受支持的模型后,聊天可完全离线进行。
- 重要提示:
- 应用的公开营销页面并未列出确切的最低iOS版本要求及各机型性能表现——下载前请查看App Store页面了解当前的机型兼容性。
iPad
- 预期表现:
- Locally AI可在iPad上运行,共享与iPhone相同的设备端模型集合和离线行为。更大的屏幕,以及许多iPad机型上相当甚至更强的Apple Silicon性能,可能让长时间的对话会话更舒适。
- 重要提示:
- 与iPhone相同,下载模型前请在App Store查看当前的最低iPadOS版本要求及存储空间要求。
Mac
- 预期表现:
- Locally AI可在Mac上运行,Apple Silicon(M系列芯片)通常比iPhone或iPad拥有更多统一内存,这对应用支持的最大模型可能很重要。
- 重要提示:
- Locally AI针对搭载Apple Silicon的Mac优化;应用的公开营销页面并未说明其在基于Intel芯片的Mac上的表现——安装前请确认你的Mac芯片是否兼容。
取舍:优势与局限
隐私优先的设备端推理
- 实际使用中的含义:
- 模型下载完成后,对话在设备本地处理,而不是发送到云端服务进行推理。
- 局限 / 说明:
- 应用的初始安装和模型下载本身需要联网,未来的应用更新也很可能需要联网。
模型下载后可离线使用
- 实际使用中的含义:
- 设置完成后,聊天无需联网即可运行——适用于航班、旅行或网络不稳定的地区。
- 局限 / 说明:
- 你需要提前规划,在还有网络连接时下载好想使用的模型。
针对Apple Silicon优化
- 实际使用中的含义:
- 应用旨在充分利用当前一代iPhone、iPad和Mac芯片中的设备端神经网络和GPU硬件。
- 局限 / 说明:
- 这也意味着Locally AI仅限Apple平台——没有Windows或Android版本供这些平台的用户使用。
一个应用即可访问多个开源模型系列
- 实际使用中的含义:
- Llama、Gemma、Qwen和DeepSeek,再加上其他开源模型,都可从同一界面获取,无需手动获取模型文件。
- 局限 / 说明:
- 可下载模型的确切列表及其存储大小并未在应用的公开营销页面上完整公布;请在应用内查看当前的选择。
没有持续的云端推理费用
- 实际使用中的含义:
- 由于推理在你自己的设备上运行,设备本地处理的聊天不会产生按消息或按token计费的API账单。
- 局限 / 说明:
- 设备端推理会消耗设备的电池和处理能力,且应用本身的定价本次评测未做独立核实——请查看当前的App Store页面。
iPhone、iPad和Mac统一生态
- 实际使用中的含义:
- Apple用户可以在手机、平板和电脑上使用同一系列应用。
- 局限 / 说明:
- 将工作分布在Windows或Android设备上的用户,需要为这些平台另选应用。
Locally AI与替代方案对比
Locally AI
- 最适合:
- 希望为主流开源模型系列使用简单、隐私优先应用的Apple用户
- 平台重点:
- iPhone/iPad/Mac(针对Apple Silicon优化)
- 模型灵活性:
- Llama、Gemma、Qwen、DeepSeek,以及其他开源模型
- 主要局限:
- 仅限Apple平台——没有Windows或Android应用
关于Locally AI的文章(2篇)
- Locally AI Review (2026): Private Offline LLMs on iPhone, iPad and Mac更新于 2026年9月4日
- Best Local LLM Apps for iPhone in 2026 (Run AI Without WiFi)更新于 2026年9月1日
其他提及:
Loci
- 最适合:
- 希望在更多设备上获得低门槛私密聊天体验的跨平台用户
- 平台重点:
- iPhone/iPad/Android/Mac/Windows(5个平台)
- 模型灵活性:
- 精选模型库,包含Gemma、Qwen、Llama和Phi;不支持导入自定义GGUF
- 主要局限:
- 模型选择局限于精选库;无法导入自定义GGUF文件
Private LLM
- 最适合:
- 希望深度掌控模型和量化设置的Apple用户
- 平台重点:
- iPhone/iPad/Mac(仅限Apple)
- 模型灵活性:
- 140多个模型,支持OmniQuant和GPTQ量化格式
- 主要局限:
- 相比追求简洁的应用,配置更为繁琐
关于Private LLM的文章(10篇)
- AnythingLLM Mobile Review (2026): On-Device Chat + RAG更新于 2026年9月6日
- Chapper Review (2026): AI & LM Studio Client for iPhone, iPad, and Mac更新于 2026年9月6日
- Layla Review (2026): On-Device AI Companion App for Android and iOS更新于 2026年9月6日
- LLM Farm Review (2026): Open-Source GGUF App, Off the App Store更新于 2026年9月6日
- Maid Review (2026): Open-Source Local LLM Chat App for Android更新于 2026年9月6日
- RikkaHub Review (2026): Multi-Provider AI Chat for Android更新于 2026年9月6日
- Private LLM Review (2026): On-Device AI Chat for iPhone, iPad, and Mac更新于 2026年9月5日
- Chatty-mini Review (2026): Private, Local-First GGUF Chat on Android更新于 2026年9月4日
- Best Local LLM Apps for iPhone in 2026 (Run AI Without WiFi)更新于 2026年9月1日
- Loci AI Review (2026): Offline AI for iPhone, Android, iPad, Mac and Windows更新于 2026年8月22日
另有4篇未显示
Ollama(在Mac上)
- 最适合:
- 希望在Mac上获得完整命令行和API控制权的开发者
- 平台重点:
- Mac/Windows/Linux(仅桌面端,无原生移动应用)
- 模型灵活性:
- Ollama模型库中的任意模型,外加自定义GGUF导入
- 主要局限:
- 以命令行为主的工作流;没有原生iPhone或iPad应用
谁适合使用Locally AI
- 只用Apple设备、希望一个应用覆盖iPhone、iPad和Mac的用户。 如果你完全处于Apple生态系统中,不需要Windows或Android支持,Locally AI用一个应用就能覆盖你所有三种设备类型。
- 希望默认使用设备端推理的隐私敏感用户。 模型下载完成后,处理对话无需依赖云端连接——这对优先考虑将聊天内容留在远程服务器之外的用户来说是个直接的选择。
- 经常出行、网络不稳定的用户。 由于模型下载后聊天可完全离线运行,航班、偏远地区或不可靠的网络都不会中断应用的核心功能。
- 希望访问多个主流开源模型系列、又不想自己获取文件的用户。 Llama、Gemma、Qwen和DeepSeek都可在应用内直接使用,无需查找和管理各个独立的模型文件。
- 希望在Apple硬件上无云端费用地体验主流开源模型的用户。 由于推理在设备本地运行,本地处理的聊天不会产生按消息计费的API账单。
谁不适合使用Locally AI
- Windows或Android用户。 Locally AI仅限Apple平台(iPhone、iPad、Mac);其他平台的用户需要选择别的应用,例如覆盖包括Windows和Android在内五个平台的Loci。
- 想要导入任意自定义GGUF文件的用户。 如果你的工作流依赖运行来自Hugging Face的特定微调或小众模型文件,而不是从Locally AI支持的模型系列中选择,那么围绕GGUF导入构建的、操作更手动的工具会更适合你。
- 期待前沿模型级推理质量的用户。 能够舒适运行在手机或平板上的开源模型,为了这种便携性会在推理深度上有所妥协;面对高风险分析、复杂多步骤推理或大量编码工作的用户,针对这些特定任务可能仍需要前沿级的云端模型。
- 希望以命令行或API为先获得控制权的开发者。 想要脚本化推理、与现有工具集成,或在Mac上无界面运行模型的用户,可能更倾向于搭配或替代消费级聊天应用,使用Ollama这类面向开发者的工具。
- 尚未针对自己的具体用途查阅应用当前隐私政策和定价的用户。 本评测反映的是撰写时公开披露的信息;在将该应用用于敏感场景之前,请在官网或App Store页面确认当前的定价、确切的模型列表和隐私细节。
常见问题
Locally AI是什么?
Locally AI是一款适用于iPhone、iPad和Mac的应用,可直接在设备本地运行开源语言模型——包括Llama、Gemma、Qwen和DeepSeek——并针对Apple Silicon优化。模型下载完成后即可完全离线运行,聊天无需联网。
Locally AI在没有网络连接的情况下能用吗?
就聊天而言,可以。应用安装并下载好模型后,推理在设备本地进行,不需要联网——应用可以在飞行模式下使用。安装应用以及首次下载模型时需要联网。
Locally AI支持哪些模型?
Locally AI支持多个主流开源模型系列:Llama(Meta)、Gemma(Google)、Qwen(阿里巴巴)和DeepSeek,以及其他开源模型。可下载模型的确切列表及其存储大小可在应用内或官网locallyai.app查看。
Locally AI支持Android或Windows吗?
不支持。Locally AI专为iPhone、iPad和Mac打造,并针对Apple Silicon优化。如果Android或Windows用户想要类似的离线优先、注重隐私的应用,可以考虑Loci等跨平台替代方案,它支持iPhone、iPad、Android、Mac和Windows。
Locally AI私密吗?
Locally AI以隐私优先作为定位:模型下载完成后,推理在设备本地进行,而不是通过云端调用。至于当前完整的隐私政策——包括应用自身为诊断或分析目的收集的任何数据——请查看官网或App Store的隐私标签,因为本评测反映的是公开披露的信息,并未能独立核实每一项技术层面的隐私声明。
Locally AI需要多少存储空间?
存储需求取决于你下载的模型;适用于设备端推理的常见开源模型文件大小大致在1GB到数GB之间不等。截至目前,各支持模型的确切存储大小并未在应用的公开营销页面上完整公布——下载前请查看应用内的模型列表,尤其是在存储空间有限的设备上。
Locally AI能取代ChatGPT或Claude吗?
对于适合移动或桌面硬件上运行的开源模型来完成的任务——起草文案、总结、一般性问答、私人笔记等——Locally AI可以作为私密、可离线使用的替代方案。对于前沿级推理、特别复杂的编码任务,或需要实时联网信息支撑的回答,ChatGPT、Claude等云端模型仍然更胜一筹,因为它们运行的模型规模远大于手机或平板所能舒适承载的范围。
Locally AI与Loci相比如何?
Locally AI仅限Apple平台(iPhone、iPad、Mac),并专门针对Apple Silicon优化,支持Llama、Gemma、Qwen、DeepSeek及其他开源模型。Loci覆盖五个平台——iPhone、iPad、Android、Mac和Windows——并提供精选模型库。如果你完全处于Apple生态系统中,选择Locally AI;如果你还需要Android或Windows支持,选择Loci。更多详情请参阅我们完整的Loci AI评测。
使用Locally AI需要特定的iPhone、iPad或Mac机型吗?
Locally AI针对Apple Silicon优化,因此搭载Apple Silicon芯片的设备是其目标机型。截至撰写本文时,应用的公开营销页面并未列出确切的最低设备或系统版本要求——下载前请查看当前的App Store页面,了解Locally AI所标明的最低要求。
总评
对于希望使用隐私优先、设备端应用与Llama、Gemma、Qwen、DeepSeek等主流开源模型系列对话,同时不想离开Apple生态系统或手动管理模型文件的Apple用户来说,Locally AI是一个直接明了的选择。它对Apple Silicon的优化,以及模型下载后完全离线运行的特性,非常适合优先考虑将对话内容留在远程服务器之外、并偏好应用体验而非命令行工作流的用户。它的取舍在于平台覆盖范围:Locally AI不支持Windows或Android,需要这些平台的用户应转而考虑Loci等跨平台应用。想要导入任意自定义GGUF文件,或需要更深入量化控制的用户,应将其与Private LLM、Ollama等配置更繁琐的工具进行比较。对于其目标用户群——希望在没有技术门槛的情况下,私密、离线地使用主流开源模型的Apple用户——Locally AI填补了一个明确的细分需求。
资料来源
- Locally AI官网 — 产品概览、支持的模型系列、平台可用性。
- Loci官网 — 跨平台对比参考。
- Loci AI Review: Private Offline AI on iPhone, Android, iPad and Mac — 本文用于替代方案对比的配套评测。
