핵심 요점
- Whisper는 로컬에서 실행되는 오픈 음성→텍스트 모델입니다. 어떤 오디오도 직접 소유한 하드웨어를 떠나지 않습니다
- Whisper 애드온(faster-whisper)을 사용하십시오. Wyoming을 통해 Assist에 연결됩니다
- 모델 크기는 tiny → base → small → medium → large입니다. 더 크면 더 정확하고 더 느립니다
- CPU 전용 하드웨어에서는 tiny/base/small을 선호하십시오. GPU가 있으면 medium/large가 실용적입니다
- Whisper는 다국어를 지원하므로 다른 언어 명령도 클라우드 서비스 없이 변환됩니다
- 더 큰 모델로 가기 전에 더 좋은 마이크와 올바른 모델로 정확도를 조정하십시오
로컬 음성→텍스트를 사용하는 이유
로컬 음성→텍스트는 음성 녹음을 직접 소유한 하드웨어에 유지하므로 어떤 오디오도 제3자에게 업로드되지 않습니다. 오프라인으로도 동작하고 요청당 비용도 없습니다.
- 프라이버시: 클라우드 어시스턴트는 녹음을 전송하고 보관할 수 있습니다. 로컬 Whisper는 그렇지 않습니다 — 스마트 홈 프라이버시 위험을 참조하십시오.
- 오프라인: 인터넷 장애 중에도 변환이 동작합니다.
- 비용 없음: 로컬 변환에 사용당 요금이 없습니다.
어떤 Whisper 모델 크기를 사용해야 합니까?
직접 소유한 하드웨어에서 허용 가능한 정확도를 제공하는 가장 작은 Whisper 모델을 선택하십시오. CPU 전용에는 tiny/base/small, GPU가 있을 때는 medium/large입니다. 더 큰 모델은 억양과 잡음 있는 오디오에 대한 정확도를 속도를 희생해 향상합니다.
- 미니 PC CPU에서는 small을 기본값으로 사용하십시오. 정확도가 부족할 때만 medium/large로 전환하십시오.
- Raspberry Pi에서는 사용 가능한 지연 시간을 유지하기 위해 tiny/base를 사용하십시오.
| 모델 | 상대 정확도 | 상대 속도 | 최적 용도 |
|---|---|---|---|
| tiny | 가장 낮음 | 가장 빠름 | 저전력 CPU, 짧은 명령 |
| base | 낮음 | 매우 빠름 | Raspberry Pi, 간단한 문장 |
| small | 양호 | 빠름 | 미니 PC CPU, 일상 사용 |
| medium | 높음 | 보통 | GPU 또는 강력한 CPU |
| large | 가장 높음 | 가장 느림 | GPU, 억양/잡음 있는 공간 |
Wyoming 설정
Whisper 애드온은 Assist가 음성→텍스트에 사용하는 Wyoming 엔드포인트를 노출합니다. 설정은 설치 → 모델 선택 → 파이프라인에서 선택입니다.
- 1애드온 스토어에서 Whisper 애드온(faster-whisper)을 설치하십시오.
- 2애드온 설정에서 모델 크기를 설정하고 시작하십시오.
- 3애드온이 자동으로 Wyoming 음성→텍스트 서비스로 등록됩니다.
- 4설정 → 음성 어시스턴트에서 Assist 파이프라인의 STT 엔진으로 Whisper를 설정하십시오.
- 5음성 하드웨어를 추가하기 전에 Assist 디버그 도구에서 변환을 테스트하십시오.
하드웨어 요구 사항
Whisper는 소형 모델의 경우 CPU에서 실행되고 medium/large 모델의 경우 GPU가 도움이 됩니다. 호스팅하는 기기에 맞게 모델 크기를 조정하십시오.
- Raspberry Pi: 허용 가능한 지연 시간을 위해 tiny/base를 유지하십시오.
- 미니 PC(CPU): small이 잘 동작합니다. medium은 가능하지만 더 느립니다 — 로컬 스마트 홈을 위한 최고의 하드웨어를 참조하십시오.
- GPU/NPU가 있을 때: 높은 정확도를 위해 medium과 large가 실용적이 됩니다.
- 허브가 Pi인 경우 Wyoming를 통해 더 강력한 별도 기기에서 Whisper를 실행할 수 있습니다.
정확도 조정
가장 큰 Whisper에 의존하기 전에 좋은 마이크와 올바른 모델로 개선하십시오. 홈 명령의 경우 모델 크기보다 오디오 품질이 더 중요한 경우가 많습니다.
- 화자 근처에 품질 좋은 마이크 또는 음성 위성 하드웨어를 사용하십시오.
- 마이크가 있는 곳의 배경 소음을 줄이십시오.
- 잘못된 변환을 피하기 위해 애드온에서 올바른 언어를 설정하십시오.
- large로 바로 건너뛰지 말고 한 번에 하나씩 모델 크기를 올리고 재테스트하십시오.
자주 묻는 질문
Home Assistant에 어떤 Whisper 모델을 사용해야 합니까?
미니 PC CPU에서는 small을 기본값으로, Raspberry Pi에서는 tiny 또는 base를 사용하고, 억양이나 잡음 있는 공간에서 더 높은 정확도가 필요할 때만 GPU가 있을 경우 medium 또는 large를 사용하십시오. 한 번에 하나씩 크기를 올리고 재테스트하십시오.
로컬 Whisper에 GPU가 필요합니까?
small 이하에는 필요 없습니다. 이 모델들은 CPU에서 실행됩니다. GPU는 주로 medium과 large를 실시간 사용에 충분히 빠르게 만듭니다. Wyoming 프로토콜을 통해 더 강력한 기기에서 Whisper를 오프로드할 수도 있습니다.
로컬 Whisper 오프라인이 얼마나 정확합니까?
올바른 모델과 좋은 마이크로 정확도가 강합니다. 더 큰 모델은 억양과 소음을 더 잘 처리합니다. 명확한 홈 명령의 경우 미니 PC의 small 모델이 보통 충분히 정확하며 완전히 오프라인으로 실행됩니다.
로컬 Whisper가 다국어를 지원합니까?
예. Whisper는 많은 언어를 지원하므로 다른 언어 명령도 클라우드 서비스 없이 로컬에서 변환됩니다. 최상의 결과를 위해 애드온 설정에서 언어를 설정하십시오.
