Skip to main content
PromptQuorumPromptQuorum
/Smart Home/스마트 홈용 로컬 음성→텍스트: Whisper + HA (2026)
Local AI & LLMs in the Smart Home

스마트 홈용 로컬 음성→텍스트: Whisper + HA (2026)

·8분 분량·Hans Kuepper 저 · PromptQuorum 창립자, 멀티 모델 AI 디스패치 도구 · PromptQuorum

로컬 Whisper는 Home Assistant에 비공개 음성→텍스트를 제공합니다. Whisper 애드온을 설치하고 하드웨어에 맞는 모델 크기를 선택하고 Wyoming 프로토콜을 통해 Assist에 연결하십시오. 더 작은 모델이 더 빠르고 더 큰 모델이 더 정확합니다. 어떤 것도 클라우드 서비스로 전송되지 않습니다.

로컬 Whisper는 Home Assistant에 클라우드 없는 비공개 음성→텍스트를 제공합니다. 정확도, 속도, 하드웨어의 균형에 맞는 Whisper 모델 크기를 선택한 후 Wyoming 프로토콜을 통해 Assist에 연결합니다. 이 가이드는 로컬 STT가 중요한 이유, Whisper 모델 크기, Wyoming 설정, 하드웨어 요구 사항, 정확도 조정 방법을 다룹니다.

스마트 홈용 로컬 음성→텍스트: Whisper + HA (2026)

핵심 요점

  • Whisper는 로컬에서 실행되는 오픈 음성→텍스트 모델입니다. 어떤 오디오도 직접 소유한 하드웨어를 떠나지 않습니다
  • Whisper 애드온(faster-whisper)을 사용하십시오. Wyoming을 통해 Assist에 연결됩니다
  • 모델 크기는 tiny → base → small → medium → large입니다. 더 크면 더 정확하고 더 느립니다
  • CPU 전용 하드웨어에서는 tiny/base/small을 선호하십시오. GPU가 있으면 medium/large가 실용적입니다
  • Whisper는 다국어를 지원하므로 다른 언어 명령도 클라우드 서비스 없이 변환됩니다
  • 더 큰 모델로 가기 전에 더 좋은 마이크와 올바른 모델로 정확도를 조정하십시오

로컬 음성→텍스트를 사용하는 이유

로컬 음성→텍스트는 음성 녹음을 직접 소유한 하드웨어에 유지하므로 어떤 오디오도 제3자에게 업로드되지 않습니다. 오프라인으로도 동작하고 요청당 비용도 없습니다.

  • 프라이버시: 클라우드 어시스턴트는 녹음을 전송하고 보관할 수 있습니다. 로컬 Whisper는 그렇지 않습니다 — 스마트 홈 프라이버시 위험을 참조하십시오.
  • 오프라인: 인터넷 장애 중에도 변환이 동작합니다.
  • 비용 없음: 로컬 변환에 사용당 요금이 없습니다.

어떤 Whisper 모델 크기를 사용해야 합니까?

직접 소유한 하드웨어에서 허용 가능한 정확도를 제공하는 가장 작은 Whisper 모델을 선택하십시오. CPU 전용에는 tiny/base/small, GPU가 있을 때는 medium/large입니다. 더 큰 모델은 억양과 잡음 있는 오디오에 대한 정확도를 속도를 희생해 향상합니다.

  • 미니 PC CPU에서는 small을 기본값으로 사용하십시오. 정확도가 부족할 때만 medium/large로 전환하십시오.
  • Raspberry Pi에서는 사용 가능한 지연 시간을 유지하기 위해 tiny/base를 사용하십시오.
모델상대 정확도상대 속도최적 용도
tiny가장 낮음가장 빠름저전력 CPU, 짧은 명령
base낮음매우 빠름Raspberry Pi, 간단한 문장
small양호빠름미니 PC CPU, 일상 사용
medium높음보통GPU 또는 강력한 CPU
large가장 높음가장 느림GPU, 억양/잡음 있는 공간
Home Assistant에서 상대 속도별 Whisper 모델 크기: tiny와 base는 Raspberry Pi에서 가장 빠르고, small은 미니 PC CPU의 기본값이며, medium은 GPU나 강력한 CPU가 필요하고, large는 가장 느리지만 억양과 소음에 가장 정확합니다.
Home Assistant에서 상대 속도별 Whisper 모델 크기: tiny와 base는 Raspberry Pi에서 가장 빠르고, small은 미니 PC CPU의 기본값이며, medium은 GPU나 강력한 CPU가 필요하고, large는 가장 느리지만 억양과 소음에 가장 정확합니다.

Wyoming 설정

Whisper 애드온은 Assist가 음성→텍스트에 사용하는 Wyoming 엔드포인트를 노출합니다. 설정은 설치 → 모델 선택 → 파이프라인에서 선택입니다.

  1. 1
    애드온 스토어에서 Whisper 애드온(faster-whisper)을 설치하십시오.
  2. 2
    애드온 설정에서 모델 크기를 설정하고 시작하십시오.
  3. 3
    애드온이 자동으로 Wyoming 음성→텍스트 서비스로 등록됩니다.
  4. 4
    설정 → 음성 어시스턴트에서 Assist 파이프라인의 STT 엔진으로 Whisper를 설정하십시오.
  5. 5
    음성 하드웨어를 추가하기 전에 Assist 디버그 도구에서 변환을 테스트하십시오.

하드웨어 요구 사항

Whisper는 소형 모델의 경우 CPU에서 실행되고 medium/large 모델의 경우 GPU가 도움이 됩니다. 호스팅하는 기기에 맞게 모델 크기를 조정하십시오.

  • Raspberry Pi: 허용 가능한 지연 시간을 위해 tiny/base를 유지하십시오.
  • 미니 PC(CPU): small이 잘 동작합니다. medium은 가능하지만 더 느립니다 — 로컬 스마트 홈을 위한 최고의 하드웨어를 참조하십시오.
  • GPU/NPU가 있을 때: 높은 정확도를 위해 medium과 large가 실용적이 됩니다.
  • 허브가 Pi인 경우 Wyoming를 통해 더 강력한 별도 기기에서 Whisper를 실행할 수 있습니다.
Whisper 모델 크기를 하드웨어에 맞추는 결정 트리: GPU가 없으면 Raspberry Pi는 tiny/base를, 미니 PC는 small을 실행하며, GPU나 NPU가 있으면 medium이 실용적이고 large는 억양이나 소음이 있는 공간에 적합합니다.
Whisper 모델 크기를 하드웨어에 맞추는 결정 트리: GPU가 없으면 Raspberry Pi는 tiny/base를, 미니 PC는 small을 실행하며, GPU나 NPU가 있으면 medium이 실용적이고 large는 억양이나 소음이 있는 공간에 적합합니다.

정확도 조정

가장 큰 Whisper에 의존하기 전에 좋은 마이크와 올바른 모델로 개선하십시오. 홈 명령의 경우 모델 크기보다 오디오 품질이 더 중요한 경우가 많습니다.

  • 화자 근처에 품질 좋은 마이크 또는 음성 위성 하드웨어를 사용하십시오.
  • 마이크가 있는 곳의 배경 소음을 줄이십시오.
  • 잘못된 변환을 피하기 위해 애드온에서 올바른 언어를 설정하십시오.
  • large로 바로 건너뛰지 말고 한 번에 하나씩 모델 크기를 올리고 재테스트하십시오.

자주 묻는 질문

Home Assistant에 어떤 Whisper 모델을 사용해야 합니까?

미니 PC CPU에서는 small을 기본값으로, Raspberry Pi에서는 tiny 또는 base를 사용하고, 억양이나 잡음 있는 공간에서 더 높은 정확도가 필요할 때만 GPU가 있을 경우 medium 또는 large를 사용하십시오. 한 번에 하나씩 크기를 올리고 재테스트하십시오.

로컬 Whisper에 GPU가 필요합니까?

small 이하에는 필요 없습니다. 이 모델들은 CPU에서 실행됩니다. GPU는 주로 medium과 large를 실시간 사용에 충분히 빠르게 만듭니다. Wyoming 프로토콜을 통해 더 강력한 기기에서 Whisper를 오프로드할 수도 있습니다.

로컬 Whisper 오프라인이 얼마나 정확합니까?

올바른 모델과 좋은 마이크로 정확도가 강합니다. 더 큰 모델은 억양과 소음을 더 잘 처리합니다. 명확한 홈 명령의 경우 미니 PC의 small 모델이 보통 충분히 정확하며 완전히 오프라인으로 실행됩니다.

로컬 Whisper가 다국어를 지원합니까?

예. Whisper는 많은 언어를 지원하므로 다른 언어 명령도 클라우드 서비스 없이 로컬에서 변환됩니다. 최상의 결과를 위해 애드온 설정에서 언어를 설정하십시오.

← Smart Home으로 돌아가기