Skip to main content
PromptQuorum
/고급 로컬 LLM/Locally AI 리뷰(2026): iPhone·iPad·Mac에서 쓰는 프라이빗 오프라인 LLM
Mobile & Edge LLMs

Locally AI 리뷰(2026): iPhone·iPad·Mac에서 쓰는 프라이빗 오프라인 LLM

·8분 소요·Hans Kuepper 저 · PromptQuorum 창립자, 멀티 모델 AI 디스패치 도구 · PromptQuorum

Locally AI는 Llama, Gemma, Qwen, DeepSeek 같은 오픈 모델과 Apple 기기 안에서만 대화하고 싶은 사람에게 특히 매력적인, 간단하고 프라이버시 우선인 앱을 찾는 경우 강점이 있습니다. iPhone, iPad, Mac에서 작동하며 Apple Silicon에 최적화되어 있고, 모델을 다운로드하면 완전히 오프라인으로 작동합니다 — 클라우드 호출 없이, 채팅에 인터넷 연결도 필요 없습니다. Apple 생태계를 벗어나지 않고 추론 인프라를 직접 관리하지 않으면서 프라이빗한 온디바이스 AI를 원하는 사용자를 위해 만들어졌습니다. Windows나 Android 지원이 필요하거나, 임의의 커스텀 GGUF 파일을 가져오고 싶거나, 폰이나 태블릿에서 수십억 파라미터급 오픈 모델이 제공할 수 있는 범위를 넘어서는 최상급 추론이 필요한 사용자는 Loci 같은 앱과 비교하거나 Mac에서 Ollama 같은 도구로 모델을 직접 관리해야 합니다.

개발사 Locally AI가 만든 Locally AI는 Llama, Gemma, Qwen, DeepSeek 등 오픈소스 언어 모델을 iPhone, iPad, Mac에서 직접 실행하는 앱으로, Apple Silicon에 최적화되어 있습니다. 모델을 다운로드하면 완전히 기기 내에서 작동합니다. 채팅에 인터넷 연결이 필요 없으며, 개발사의 프라이버시 우선 방침에 따라 대화가 추론을 위해 클라우드 서비스로 전송되지 않습니다. 이 앱을 고려하는 사람에게 실질적인 질문은 Apple 하드웨어에서 온디바이스 추론이 가능한지가 아닙니다 — Apple Silicon은 이를 위한 신경망 및 GPU 성능을 충분히 갖추고 있습니다 — 오히려 GGUF 파일을 직접 고르거나 양자화를 조정하거나 필요한 VRAM을 계산하지 않고도 Locally AI가 그 추론 주변에 실용적인 앱 경험을 제공하는지입니다.

이 페이지에는 타사 제품에 대한 참조 링크가 포함되어 있습니다. PromptQuorum은 어떤 제휴 프로그램에도 등록되어 있지 않습니다 — 이는 수수료가 발생하지 않는 일반 링크입니다. 링크 클릭 및 이후 단계는 전적으로 귀하의 책임입니다. 이 링크는 PromptQuorum의 어떠한 보증이나 검증을 나타내지 않습니다.

Locally AI 공식 사이트 방문 →제품 링크 · 공개됨
Locally AI 리뷰(2026): iPhone·iPad·Mac에서 쓰는 프라이빗 오프라인 LLM

핵심 요점

  • Locally AI는 오픈소스 모델인 Llama, Gemma, Qwen, DeepSeek를 완전히 오프라인으로, 기기 내에서 실행한다.
  • 지원 플랫폼: iPhone, iPad, Mac. Apple Silicon 최적화.
  • 모델을 다운로드하면 이후 인터넷 연결이 필요 없다.
  • 프라이버시 우선 방침: 개발사는 추론이 기기 내에서 이뤄지며 클라우드 호출이 없다고 밝힌다.
  • Apple 전용 — Windows나 Android 버전이 없어, 다른 OS 사용자는 다른 앱이 필요하다.
  • 폰과 태블릿용 온디바이스 앱이라면 공통적으로 겪는 핵심 트레이드오프: 모바일 하드웨어에 무리 없이 들어가는 모델 크기는 복잡하고 다단계적인 추론 작업에서 최상급 클라우드 모델에 뒤처진다.

📍 한 문장으로

Locally AI는 iPhone, iPad, Mac용 앱으로, Llama, Gemma, Qwen, DeepSeek를 포함한 오픈소스 언어 모델을 완전히 기기 내에서 실행하며 Apple Silicon에 최적화되어 있어, 모델을 다운로드하면 인터넷 연결이나 클라우드 호출 없이 채팅할 수 있습니다.

💬 쉽게 말하면

메시지를 기업 서버로 보내는 대신, Locally AI는 소형 AI 모델을 iPhone, iPad, Mac에 다운로드해 그 자리에서 실행합니다. 다운로드가 끝난 뒤 비행기 모드를 켜도 계속 작동하는데, 개발사의 프라이버시 우선 설계 덕분에 대화 내용 자체는 기기를 벗어날 필요가 없기 때문입니다.

📌참고: 이 리뷰는 locallyai.app과 앱의 공식 게재 정보에 공개된 사실을 바탕으로 작성되었습니다. 가격, 정확한 모델 목록, 저장 용량, 최소 OS 버전은 작성 시점에 독립적으로 검증하지 않았습니다 — 다운로드 전 공식 사이트나 App Store 게재 정보에서 최신 세부 정보를 확인하세요.

Locally AI란 무엇인가?

Locally AI는 대화를 클라우드 서비스로 보내지 않고 iPhone, iPad, Mac에서 오픈소스 언어 모델을 직접 실행하는 앱입니다. Apple이 현재 iPhone, iPad, Mac 라인업 전반에 사용하는 칩 아키텍처인 Apple Silicon을 위해 만들어지고 최적화되어 있습니다. 즉 이 앱은 전화기를 원격 서버를 위한 씬 클라이언트로 취급하는 대신, 해당 칩이 제공하는 기기 내 신경망 및 GPU 하드웨어를 활용하도록 설계되었습니다.

핵심 모델 구성에는 Llama(Meta의 오픈 웨이트 모델 계열), Gemma(Google의 오픈 웨이트 모델 계열), Qwen(Alibaba의 오픈 웨이트 모델 계열), DeepSeek(DeepSeek의 오픈 웨이트 모델 계열)가 포함됩니다 — 모두 독립 파일로 배포되어 벤더가 통제하는 API 없이 실행될 수 있는 오픈소스 모델입니다. Locally AI는 이런 모델에 대한 접근을 모바일과 데스크톱 모두에 적합한 단일 인터페이스로 묶어 제공하므로, 사용자가 모델 파일을 직접 구하거나 별도의 추론 서버를 운영할 필요가 없습니다.

모델이 기기로의 다운로드를 마치면, Locally AI는 응답을 생성하는 데 인터넷 연결이 필요하지 않습니다 — 추론은 기기 자체의 프로세서와 메모리를 사용해 로컬에서 실행됩니다. 이것이 "오프라인"의 실질적 의미입니다. 모델을 미리 다운로드해두면 비행기 모드나 기내, 또는 연결이 전혀 없는 어디서든 앱을 사용할 수 있습니다.

Locally AI는 어떤 모델을 지원하나?

Locally AI는 Llama, Gemma, Qwen, DeepSeek라는 주요 오픈소스 모델 계열 여러 개와 그 외 오픈 모델들을 지원하며, 모두 완전히 기기 내에서 실행할 수 있습니다. 이 네 계열은 광범위한 사용 사례를 아우르며 오늘날 가장 널리 쓰이는 오픈 웨이트 모델 중 일부에 속합니다. 각각 서로 다른 조직(Meta, Google, Alibaba, DeepSeek)이 관리합니다.

  • Llama — Meta의 오픈 웨이트 모델 계열로, 로컬 LLM 생태계 전반에서 범용 채팅 및 추론의 기준으로 널리 쓰인다.
  • Gemma — Google의 오픈 웨이트 모델 계열로, Google의 Gemini 모델과 같은 연구 계보에서 나왔으며 온디바이스 및 엣지 배포에 흔히 쓰인다.
  • Qwen — Alibaba의 오픈 웨이트 모델 계열로, 강력한 다국어 지원과 제한된 하드웨어에 맞는 다양한 모델 크기로 알려져 있다.
  • DeepSeek — DeepSeek의 오픈 웨이트 모델 계열로, 모델 크기 대비 경쟁력 있는 추론 성능으로 인정받는다.
  • 그 외 오픈 모델 — Locally AI는 이 4대 주력 계열 외에도 추가 오픈 모델을 지원한다고 밝히고 있어, 기기에서 실행할 수 있는 선택지를 넓힌다.

플랫폼별 Locally AI

iPhone

예상되는 내용:
Locally AI는 iPhone에서 작동하며, 앱은 Apple Silicon의 기기 내 신경망 및 GPU 하드웨어를 활용하도록 최적화되어 있습니다. 지원되는 모델을 다운로드하면 채팅은 완전히 오프라인으로 작동합니다.
중요 참고 사항:
정확한 최소 iOS 버전과 기기별 성능은 앱의 공개 마케팅 페이지에 게재되어 있지 않습니다 — 다운로드 전 App Store 게재 정보에서 현재 기기 호환성을 확인하세요.

iPad

예상되는 내용:
Locally AI는 iPad에서 작동하며, iPhone과 동일한 기기 내 모델 구성과 오프라인 동작을 공유합니다. 더 큰 화면과, 많은 iPad 모델에서 비슷하거나 더 강력한 Apple Silicon 성능은 긴 세션을 더 편하게 만들어 줄 수 있습니다.
중요 참고 사항:
iPhone과 마찬가지로, 모델을 다운로드하기 전 App Store에서 현재 최소 iPadOS 버전과 저장 공간 요구 사항을 확인하세요.

Mac

예상되는 내용:
Locally AI는 Mac에서 작동하며, Apple Silicon(M 시리즈 칩)은 일반적으로 iPhone이나 iPad보다 더 많은 통합 메모리를 제공하는데, 이는 앱이 지원하는 가장 큰 모델에서 중요할 수 있습니다.
중요 참고 사항:
Locally AI는 Apple Silicon 탑재 Mac에 최적화되어 있습니다. Intel 기반 Mac에서의 동작은 앱의 공개 마케팅 페이지에서 다뤄지지 않습니다 — 설치 전 Mac 칩 호환성을 확인하세요.

장단점: 이점과 한계

프라이버시 우선 온디바이스 추론

실제 사용에서의 의미:
모델을 다운로드하면 대화는 추론을 위해 클라우드 서비스로 보내지는 대신 기기 내에서 처리됩니다.
한계 / 참고 사항:
앱의 초기 설치와 모델 다운로드 자체는 인터넷 연결이 필요하며, 향후 앱 업데이트도 마찬가지일 가능성이 높습니다.

모델 다운로드 후 오프라인 사용 가능

실제 사용에서의 의미:
설정이 끝나면 인터넷 연결 없이 채팅이 작동합니다 — 비행이나 여행, 연결이 불안정한 지역에서 유용합니다.
한계 / 참고 사항:
아직 연결이 있는 동안 사용하려는 모델을 미리 계획하고 다운로드해야 합니다.

Apple Silicon에 최적화

실제 사용에서의 의미:
앱은 현세대 iPhone, iPad, Mac 칩이 제공하는 기기 내 신경망 및 GPU 하드웨어를 활용하도록 만들어졌습니다.
한계 / 참고 사항:
이는 Locally AI가 Apple 전용이라는 뜻이기도 합니다 — 해당 플랫폼 사용자를 위한 Windows나 Android 버전은 없습니다.

하나의 앱에서 여러 오픈 모델 계열에 접근

실제 사용에서의 의미:
Llama, Gemma, Qwen, DeepSeek에 더해 다른 오픈 모델들도 모델 파일을 직접 구할 필요 없이 하나의 인터페이스에서 이용할 수 있습니다.
한계 / 참고 사항:
다운로드 가능한 모델의 정확한 목록과 저장 용량은 앱의 공개 마케팅 페이지에 전부 게재되어 있지 않습니다. 현재 구성은 앱 자체에서 확인하세요.

반복되는 클라우드 추론 비용 없음

실제 사용에서의 의미:
추론이 자신의 기기에서 실행되므로, 기기 내에서 처리된 채팅에는 메시지당 또는 토큰당 API 청구가 발생하지 않습니다.
한계 / 참고 사항:
온디바이스 추론은 기기의 배터리와 처리 능력을 소모하며, 앱 자체의 가격은 이번 리뷰에서 독립적으로 검증하지 않았습니다 — 현재 App Store 게재 정보를 확인하세요.

iPhone, iPad, Mac을 아우르는 단일 생태계

실제 사용에서의 의미:
Apple 사용자는 전화기, 태블릿, 컴퓨터에서 동일한 앱 계열을 사용할 수 있습니다.
한계 / 참고 사항:
Windows나 Android 기기로 작업을 분산하는 사용자는 해당 플랫폼용으로 별도의 앱이 필요합니다.

Locally AI와 대안 비교

Locally AI

적합한 사용자:
주요 오픈 모델 계열을 위한 간단하고 프라이버시 우선인 앱을 원하는 Apple 사용자
플랫폼 초점:
iPhone/iPad/Mac(Apple Silicon 최적화)
모델 유연성:
Llama, Gemma, Qwen, DeepSeek, 그 외 오픈 모델
주요 한계:
Apple 전용 — Windows나 Android 앱 없음
Locally AI 관련 문서 (2개)

기타 언급:

Loci

적합한 사용자:
더 많은 기기에서 부담 없는 프라이빗 채팅을 원하는 크로스플랫폼 사용자
플랫폼 초점:
iPhone/iPad/Android/Mac/Windows(5개 플랫폼)
모델 유연성:
Gemma, Qwen, Llama, Phi를 포함한 큐레이션 라이브러리. 커스텀 GGUF 가져오기 불가
주요 한계:
모델 선택이 큐레이션 라이브러리로 제한되고, 커스텀 GGUF 파일을 가져올 수 없음

Private LLM

적합한 사용자:
모델과 양자화를 깊이 제어하고 싶은 Apple 사용자
플랫폼 초점:
iPhone/iPad/Mac(Apple 전용)
모델 유연성:
OmniQuant, GPTQ 양자화 형식을 지원하는 140개 이상의 모델
주요 한계:
단순함을 지향하는 앱보다 설정이 더 복잡함
Private LLM 관련 문서 (10개)

표시되지 않은 4개 더보기

Ollama(Mac에서)

적합한 사용자:
Mac에서 완전한 명령줄 및 API 제어를 원하는 개발자
플랫폼 초점:
Mac/Windows/Linux(데스크톱 전용, 네이티브 모바일 앱 없음)
모델 유연성:
Ollama 라이브러리의 모든 모델, 커스텀 GGUF 가져오기 지원
주요 한계:
명령줄 중심 워크플로. iPhone이나 iPad용 네이티브 앱 없음

Locally AI가 적합한 사용자

  • iPhone, iPad, Mac 전반에 걸쳐 앱 하나만 쓰고 싶은 Apple 전용 사용자. Apple 생태계 안에 완전히 머물러 있고 Windows나 Android 지원이 필요 없다면, Locally AI 하나로 세 가지 기기 유형을 모두 커버할 수 있습니다.
  • 기본적으로 온디바이스 추론을 원하는 프라이버시 중시 사용자. 모델을 다운로드하면 대화 처리에 클라우드 연결이 필요 없습니다 — 대화 내용을 원격 서버 밖에 두는 것을 우선시하는 사용자에게 직접적으로 맞는 선택입니다.
  • 여행자, 연결이 불안정한 사용자. 모델 다운로드 후 채팅이 완전히 오프라인으로 작동하므로 비행, 오지, 신뢰할 수 없는 네트워크가 앱의 핵심 기능을 방해하지 않습니다.
  • 직접 파일을 구하지 않고도 여러 주요 오픈 모델 계열에 접근하고 싶은 사용자. Llama, Gemma, Qwen, DeepSeek는 개별 모델 파일을 찾고 관리할 필요 없이 앱 안에서 바로 이용할 수 있습니다.
  • 클라우드 비용 없이 Apple 하드웨어에서 주요 오픈소스 모델을 써보고 싶은 사용자. 추론이 기기 내에서 실행되므로 로컬에서 처리된 채팅에는 메시지당 API 청구가 발생하지 않습니다.

Locally AI가 적합하지 않은 사용자

  • Windows나 Android 사용자. Locally AI는 Apple 전용(iPhone, iPad, Mac)이므로, 다른 플랫폼 사용자는 Windows와 Android를 포함한 5개 플랫폼을 지원하는 Loci 같은 다른 앱이 필요합니다.
  • 임의의 커스텀 GGUF 파일을 가져오고 싶은 사용자. Locally AI가 지원하는 모델 계열 중에서 선택하는 대신 Hugging Face에서 가져온 특정 파인튜닝 모델이나 틈새 모델 파일을 실행하는 데 워크플로가 의존한다면, GGUF 가져오기를 중심으로 한 더 수동적인 도구가 더 잘 맞습니다.
  • 최상급 모델 수준의 추론 품질을 기대하는 사용자. 폰이나 태블릿에서 무리 없이 작동하도록 크기가 맞춰진 오픈 모델은 그 휴대성과 맞바꿔 추론 깊이를 일부 희생합니다. 고위험 분석, 복잡한 다단계 추론, 코딩 비중이 큰 작업을 하는 사용자는 해당 특정 작업에 대해 여전히 최상급 클라우드 모델이 필요할 수 있습니다.
  • 명령줄 또는 API 우선 제어를 원하는 개발자. 추론을 스크립트화하거나 기존 도구와 통합하거나 Mac에서 헤드리스로 모델을 실행하고 싶은 사용자는 소비자용 채팅 앱과 함께, 또는 그 대신 Ollama 같은 개발자 중심 도구를 선호할 수 있습니다.
  • 자신의 구체적인 사용 사례에 대해 앱의 현재 개인정보 처리방침과 가격을 확인하지 않은 사람. 이 리뷰는 작성 시점에 공개된 정보를 반영합니다 — 민감한 용도로 앱에 의존하기 전에 공식 사이트나 App Store 게재 정보에서 현재 가격, 정확한 모델 목록, 개인정보 세부 사항을 확인하세요.

자주 묻는 질문

Locally AI란 무엇인가요?

Locally AI는 iPhone, iPad, Mac용 앱으로, Llama, Gemma, Qwen, DeepSeek를 포함한 오픈소스 언어 모델을 기기 내에서 직접 실행하며 Apple Silicon에 최적화되어 있습니다. 모델을 다운로드하면 완전히 오프라인으로 작동하며, 채팅에 인터넷 연결이 필요 없습니다.

Locally AI는 인터넷 연결 없이 작동하나요?

채팅에 한해서는 그렇습니다. 앱을 설치하고 모델을 다운로드하면 추론은 기기 내에서 실행되며 인터넷 연결이 필요 없습니다 — 앱은 비행기 모드에서도 사용할 수 있습니다. 앱을 설치하고 모델을 처음 다운로드할 때는 인터넷 연결이 필요합니다.

Locally AI는 어떤 모델을 지원하나요?

Locally AI는 Llama(Meta), Gemma(Google), Qwen(Alibaba), DeepSeek라는 주요 오픈소스 모델 계열과 그 외 오픈 모델을 지원합니다. 다운로드 가능한 모델의 정확한 목록과 저장 용량은 앱 내부 또는 공식 사이트 locallyai.app에서 확인할 수 있습니다.

Locally AI는 Android나 Windows에서도 쓸 수 있나요?

아니요. Locally AI는 iPhone, iPad, Mac용으로 만들어졌으며 Apple Silicon에 최적화되어 있습니다. 비슷하게 오프라인 우선이고 프라이버시에 초점을 맞춘 앱을 원하는 Android나 Windows 사용자는 iPhone, iPad, Android, Mac, Windows를 지원하는 Loci 같은 크로스플랫폼 대안을 살펴봐야 합니다.

Locally AI는 정말 프라이빗한가요?

Locally AI는 프라이버시 우선을 표방합니다: 모델을 다운로드하면 클라우드 호출이 아니라 기기 내에서 추론이 이뤄집니다. 앱 자체가 진단이나 분석 목적으로 수집하는 데이터를 포함해 현재의 완전한 개인정보 처리방침을 확인하려면 공식 사이트나 App Store의 개인정보 보호 라벨을 참고하세요. 이 리뷰는 공개된 정보를 반영한 것으로, 모든 기술적 프라이버시 주장을 독립적으로 검증하지는 못했습니다.

Locally AI에는 저장 공간이 얼마나 필요한가요?

저장 공간 요구 사항은 다운로드하는 모델에 따라 다릅니다. 온디바이스 추론에 일반적으로 쓰이는 크기의 오픈 모델 파일은 각각 대략 1GB에서 수 GB 사이일 수 있습니다. 지원되는 각 모델의 정확한 현재 저장 용량은 앱의 공개 마케팅 페이지에 전부 게재되어 있지 않습니다 — 특히 여유 저장 공간이 적은 기기에서는 다운로드 전 앱 내 모델 목록을 확인하세요.

Locally AI가 ChatGPT나 Claude를 대체할 수 있나요?

모바일이나 데스크톱 하드웨어에서 실행되는 오픈소스 모델에 적합한 작업 — 초안 작성, 요약, 일반적인 질의응답, 개인 메모 작성 등 — 이라면 Locally AI는 프라이빗하고 오프라인으로 쓸 수 있는 대안이 될 수 있습니다. 최상급 추론, 특히 복잡한 코딩 작업이나 실시간 웹 기반 답변에 대해서는 ChatGPT나 Claude 같은 클라우드 모델이 여전히 더 뛰어난데, 이는 폰이나 태블릿에 무리 없이 들어가는 크기를 훨씬 뛰어넘는 모델을 실행하기 때문입니다.

Locally AI는 Loci와 비교하면 어떤가요?

Locally AI는 Apple 전용(iPhone, iPad, Mac)이며 Apple Silicon에 특화되어 최적화되어 있고, Llama, Gemma, Qwen, DeepSeek, 그 외 오픈 모델을 지원합니다. Loci는 iPhone, iPad, Android, Mac, Windows 다섯 개 플랫폼을 큐레이션된 모델 라이브러리로 지원합니다. Apple 생태계 안에 완전히 머무른다면 Locally AI를, Android나 Windows 지원도 필요하다면 Loci를 선택하세요. 자세한 내용은 Loci AI 전체 리뷰를 참고하세요.

Locally AI를 쓰려면 특정 iPhone, iPad, Mac 모델이 필요한가요?

Locally AI는 Apple Silicon에 최적화되어 있으므로 Apple Silicon 칩을 탑재한 기기가 대상입니다. 작성 시점 기준으로 앱의 공개 마케팅 페이지에는 정확한 최소 기기나 OS 버전이 나와 있지 않습니다 — 다운로드 전 현재 App Store 게재 정보에서 Locally AI가 명시하는 최소 요구 사항을 확인하세요.

총평

Locally AI는 Apple 생태계를 벗어나지 않고 모델 파일을 직접 관리하지 않으면서 Llama, Gemma, Qwen, DeepSeek 같은 대형 오픈소스 모델 계열과 대화할 수 있는 프라이버시 우선 온디바이스 앱을 원하는 Apple 사용자에게 직관적인 선택입니다. Apple Silicon 최적화와 모델 다운로드 후 완전히 오프라인으로 작동한다는 점은 대화를 원격 서버 밖에 두는 것을 우선시하고 명령줄 워크플로보다 앱 경험을 선호하는 사용자에게 잘 맞습니다. 트레이드오프는 플랫폼 범위에 있습니다: Locally AI는 Windows나 Android를 지원하지 않으므로, 해당 플랫폼이 필요한 사용자는 대신 Loci 같은 크로스플랫폼 앱을 살펴봐야 합니다. 임의의 커스텀 GGUF 파일을 가져오고 싶거나 더 깊은 양자화 제어가 필요한 사용자는 Private LLM이나 Ollama처럼 설정이 더 복잡한 도구와 비교해야 합니다. 대상 사용자층 — 기술적 부담 없이 주요 오픈 모델에 프라이빗하고 오프라인으로 접근하고 싶은 Apple 사용자 — 에게 Locally AI는 명확한 틈새를 채웁니다.

출처

← 고급 로컬 LLM으로 돌아가기