Key Takeaways
- text-generation-webui(github.com/oobabooga/textgen)는 AGPL 3.0 하에 무료 오픈소스로 제공되며, GitHub 스타는 47,600개 이상입니다.
- 이 프로젝트는 2022년 12월 개발자 "oobabooga"가 AUTOMATIC1111의 Stable Diffusion WebUI에서 영감을 받아 만들었습니다.
- 2026년 4월(버전 4.5.2)에 프로젝트는 "TextGen"으로 이름을 바꾸고 새 저장소로 이전했습니다. 기존 이름과 URL은 여전히 그곳으로 리다이렉트됩니다.
- 현재 지원되는 백엔드는 llama.cpp, ik_llama.cpp, Transformers, ExLlamaV3, TensorRT-LLM이며, AutoGPTQ나 ExLlamaV2 같은 이전 로더는 지원이 중단되었습니다.
- 2026년 5월 업데이트에서 네이티브 Electron 데스크톱 앱이 추가되어 LM Studio 같은 턴키 도구와의 설정 복잡도 격차를 크게 줄였습니다.
text-generation-webui는 개발자 "oobabooga"가 2022년 12월에 만든 무료 오픈소스(AGPL 3.0) 로컬 LLM 인터페이스로, llama.cpp, ExLlamaV3, Transformers, TensorRT-LLM을 통해 모델을 직접 실행하며, 2026년 4월 "TextGen"으로 이름을 바꾸고 네이티브 데스크톱 앱을 출시했습니다.
Open WebUI와 달리 text-generation-webui는 단순히 모델 서버와 통신하는 것이 아니라, 여러분의 컴퓨터에서 모델을 로드하고 실행하는 엔진 그 자체이며, 텍스트 생성 방식을 세밀하게 조정할 수 있는 매우 많은 설정을 제공합니다.
빠른 사실: text-generation-webui (TextGen)
- 라이선스: AGPL 3.0(완전한 오픈소스)
- 플랫폼: Windows, Linux, macOS(휴대용 Electron 빌드 또는 전체 Python/Conda 설치)
- 웹사이트 / GitHub: github.com/oobabooga/textgen (이전에는 github.com/oobabooga/text-generation-webui)
- 통계: 스타 47,600개 이상, 포크 약 6,000개, 기여자 약 380~395명
- 비용: 무료, 배후 회사 없음, 유료 등급 없음
- 핵심 기능: 로컬 모델을 직접 실행(llama.cpp, ExLlamaV3, Transformers, TensorRT-LLM)하며, 설정 가능한 채팅 UI, LoRA 학습, 도구 호출 API를 제공
text-generation-webui란 무엇인가?
text-generation-webui는 로컬 언어 모델을 로드하고 실행하는 동시에 그 채팅 인터페이스까지 제공하는 무료 오픈소스 애플리케이션입니다. Open WebUI처럼 서버 앞단에 서는 도구와 달리, 그 자체가 추론 엔진이며 단순한 클라이언트가 아닙니다. 모델이 배포된 형식에 맞춰 선택할 수 있도록 여러 백엔드 엔진을 지원합니다: llama.cpp를 통한 GGUF, ExLlamaV3를 통한 EXL3, Transformers를 통한 풀 프리시전, TensorRT-LLM을 통한 최적화된 추론입니다.
휴대용 데스크톱 빌드(압축 해제 후 더블클릭, 네이티브 Electron 창 옵션 포함)로 제공되거나, LoRA 파인튜닝과 이미지 생성까지 원하는 사용자를 위한 더 큰 의존성 세트를 필요로 하는 전체 Python 설치로도 제공됩니다.
2022년부터 이어온 이 프로젝트의 정체성은 제어의 깊이입니다. 샘플링 파라미터, 프롬프트 템플릿, 확장 기능, 도구 호출을 지원하는 OpenAI/Anthropic 호환 API가 모두 내장되어 있으며, 그 대가로 단일 목적의 소비자용 앱보다 학습 곡선이 가파릅니다.
역사: oobabooga의 사이드 프로젝트에서 "TextGen"까지
이 저장소는 2022년 12월 21일, GitHub 아이디 "oobabooga"로만 알려진 개발자에 의해 만들어졌습니다. 저희가 확인할 수 있는 어떤 자료에서도 실명은 공개된 적이 없습니다. 프로젝트의 위상에도 불구하고 유지 관리자는 줄곧 신원을 비공개로 유지해 왔습니다. 프로젝트 자체 문서에 따르면 이는 이미지 생성 분야의 선행 도구인 AUTOMATIC1111의 Stable Diffusion WebUI와 같은 정신, 같은 Gradio 프레임워크로 만들어졌다고 설명합니다.
2023년 8월, 유지 관리자는 벤처캐피털 회사 Andreessen Horowitz(a16z)로부터 오픈소스 지원금을 받아 독립적인 전업 개발을 계속 이어갔습니다. 이는 VC 회사가 회사가 아닌 개인 오픈소스 유지 관리자에게 직접 자금을 지원한 초기 사례 중 하나입니다. (a16z의 1차 자료를 통해 정확한 지원금 액수를 독자적으로 확인할 수 없었으므로, 이 세부사항은 미확인으로 처리해야 합니다.)
이 프로젝트의 가장 큰 변화는 2026년에 찾아왔는데, 단순한 UI 조정이 아니라 완전한 리브랜딩이었습니다: 2026년 4월 15일 출시된 버전 4.5.2에서 프로젝트 이름이 "text-generation-webui"에서 "TextGen"으로 바뀌었고, GitHub 저장소가 `github.com/oobabooga/textgen`으로 이전되었습니다(기존 URL은 자동으로 리다이렉트됩니다). 이후 빠르게 여러 릴리스가 이어졌습니다: 4.6.2(4월 23일)는 도구 호출 확인 기능과 stdio MCP 서버 지원을 추가했고, 4.7.3(5월 3일)은 네이티브 Electron 데스크톱 앱을 출시했습니다. 이는 프로젝트 역사상 가장 큰 사용성 변화로, 브라우저 탭 도구를 진짜 더블클릭 애플리케이션으로 바꾸었으며, DGX Spark aarch64 빌드와 llama.cpp 텐서 병렬화도 함께 추가되었습니다. 4.8(5월 7일)은 채팅 작성 화면을 재설계했고, 4.9(5월 20일)는 MTP 추측 디코딩과 실시간 초당 토큰 수 표시를 추가했습니다.
리브랜딩과 함께 지원되는 백엔드 목록도 크게 바뀌었습니다: AutoGPTQ, AutoAWQ, 그리고 원조 ExLlama/ExLlamaV2 로더는 더 이상 현재 README에 포함되지 않으며, 대신 llama.cpp, ik_llama.cpp, Transformers, ExLlamaV3, TensorRT-LLM이 현재 라인업을 이루고 있습니다.
text-generation-webui로 실제로 무엇을 할 수 있는가?
- 하드웨어에 맞는 백엔드로 모델을 실행합니다. GGUF 양자화 모델에는 llama.cpp, NVIDIA GPU의 EXL3 양자화에는 ExLlamaV3, 풀 프리시전에는 Transformers, 최적화된 NVIDIA 추론에는 TensorRT-LLM을 선택할 수 있습니다. 모두 같은 UI에서 가능합니다.
- LoRA로 모델을 파인튜닝합니다. Training 탭은 채팅 형식 또는 원시 텍스트 데이터셋에 대한 LoRA 파인튜닝을 지원하며, 학습을 일시 중지했다가 재개할 수 있습니다. 대부분의 턴키 채팅 앱에는 아예 없는 기능입니다.
- 도구 호출 API로 자동화합니다. OpenAI 및 Anthropic 호환 API 서버가 커스텀 Python 함수와 MCP(Model Context Protocol) 서버를 지원하므로, 외부 스크립트와 에이전트가 여러분이 대화 중인 것과 같은 모델을 통해 도구를 호출할 수 있습니다.
- 작업에 맞게 채팅 모드를 전환합니다. 직접적인 질의응답을 위한 Instruct 모드, 페르소나 기반 대화를 위한 Chat 모드, 이 둘의 하이브리드인 Chat-Instruct, 대화 형식을 벗어난 자유 형식 텍스트 완성을 위한 Notebook 모드가 있습니다.
- 이미지와 문서를 첨부합니다. 비전 지원 모델은 첨부된 이미지를 처리할 수 있으며, PDF/DOCX 파일도 대화에 바로 업로드할 수 있습니다.
- 같은 앱에서 이미지를 생성합니다. 내장된 이미지 생성 탭은 텍스트 모델과 함께 diffusers 기반 이미지 모델(예: Z-Image-Turbo)을 지원합니다.
text-generation-webui는 누구에게 적합한가?
text-generation-webui는 로컬 모델이 텍스트를 생성하는 방식에 영향을 미치는 모든 설정을 확인하고 제어하고 싶은 사람들을 위해 만들어졌습니다. 모든 선택을 대신 해주는 앱을 원하는 사람을 위한 것이 아닙니다.
- ✅ 별도의 학습 파이프라인 없이 LoRA로 모델을 파인튜닝하고 싶다 → 내장된 Training 탭이 이를 직접 처리합니다.
- ✅ 모델마다 백엔드 엔진을 선택하고 싶다 → llama.cpp, ExLlamaV3, Transformers, TensorRT-LLM을 모두 하나의 앱에서 사용할 수 있습니다.
- ✅ 로컬 도구 호출 API를 기반으로 에이전트나 스크립트를 만들고 싶다 → MCP를 지원하는 OpenAI/Anthropic 호환 API가 서드파티 브리지 없이 이를 처리합니다.
- ✅ 브라우저 탭이 아닌 진짜 데스크톱 앱을 원한다 → 2026년 Electron 재구축으로 더블클릭 실행 경험을 제공합니다.
- ❌ 이해할 설정이 전혀 없는 가장 단순한 원클릭 채팅 경험을 원한다 → LM Studio를 대신 사용해 보세요.
- ❌ 캐릭터 카드, 로어북, 롤플레이 전용 도구가 필요하다 → SillyTavern을 프론트엔드로, text-generation-webui를 백엔드 중 하나로 짝지어 사용하세요.
- 확신이 서지 않는다면: 사용 중인 OS와 GPU에 맞는 휴대용 빌드를 다운로드해 더블클릭하고, 먼저 llama.cpp를 통해 작은 GGUF 모델을 로드해 보세요. LoRA 학습과 API는 나중에 탐색해도 됩니다.
언제 text-generation-webui를 사용하지 말아야 하는가?
제어의 깊이가 text-generation-webui의 핵심이며, 바로 그 점이 몇 가지 상황에서는 잘 맞지 않는 이유이기도 합니다.
- 설정을 전혀 하고 싶지 않다면: 2026년의 Electron 앱이 나온 뒤에도, 단일 목적의 소비자용 채팅 앱보다 더 많은 설정(샘플링 파라미터, 백엔드 선택, 프롬프트 템플릿)이 노출됩니다.
- 내장된 멀티유저 계정이나 팀 접근 제어가 필요하다면: 로그인 시스템이나 역할 기반 접근 제어가 없습니다. 단일 사용자용 로컬 애플리케이션입니다. 이런 기능이 필요하다면 Open WebUI를 사용하세요.
- 캐릭터 카드와 로어북을 활용한 롤플레이가 주된 용도라면: text-generation-webui에는 전용 롤플레이 도구가 없습니다. 대신 SillyTavern을 프론트엔드로 짝지어 사용하세요.
- 보장된 지원 계약이 필요하다면: 이는 한 명의 개발자가 유지 관리하는 커뮤니티 프로젝트로, 상업용 지원 등급이나 SLA가 없습니다.
- 클라우드 모델만 사용하고 싶다면: 이는 자체 하드웨어에서 로컬로 모델을 실행하기 위해 만들어졌으며, LibreChat 같은 도구처럼 클라우드 제공사의 API 키를 관리하는 클라이언트가 아닙니다.
text-generation-webui는 어떻게 설치하는가?
학습과 이미지 생성이 필요한지에 따라 지원되는 설치 경로가 두 가지 있습니다:
- 1. 휴대용 빌드(대부분의 사용자에게 권장). github.com/oobabooga/textgen/releases에서 사용 중인 OS와 GPU에 맞는 압축 파일을 다운로드하세요. CUDA, Vulkan, ROCm, CPU 전용 빌드가 각각 별도로 제공됩니다. 압축을 풀고 `textgen` 실행 파일을 더블클릭하면 기본적으로 네이티브 Electron 창이 열립니다(기존의 브라우저 탭 UI를 `http://127.0.0.1:7860`에서 사용하려면 `--no-electron`을 지정하세요).
- 2. 전체 설치(LoRA 학습과 이미지 생성에 필요). 저장소를 클론하고 `start_windows.bat`, `start_linux.sh`, 또는 `start_macos.sh`를 실행하세요. Conda 환경이 설정되고 의존성이 자동으로 설치됩니다(디스크 공간 약 10GB 필요).
- 3. Docker. 벤더별(NVIDIA, AMD, Intel, CPU)로 별도의 Dockerfile이 제공됩니다. 해당 디렉터리에서 `docker compose up --build`를 실행하세요.
- 4. 모델 다운로드. 내장된 Model 탭으로 Hugging Face에서 모델을 직접 가져오거나, GGUF 파일을 `models/` 폴더에 직접 넣은 뒤 이에 맞는 백엔드를 선택하세요.
- 5. 채팅 모드를 선택하세요. 용도에 따라 Parameters 탭에서 Instruct, Chat, Chat-Instruct, 또는 Notebook 모드를 선택하세요.
- 전체 문서는 프로젝트 위키에서 관리됩니다.
가격: 무료 오픈소스
비교할 가격 등급 자체가 없습니다. text-generation-webui는 처음부터 완전히 무료였습니다.
- 언제나, 누구에게나 무료입니다. 이 소프트웨어는 AGPL 3.0 하에 라이선스되며, 유료 버전도, 구독도, 이를 판매하는 회사도 없습니다.
- 호스팅 버전이 없습니다. 자체 하드웨어에서 실행하도록 설계되었으며, 공식적인 클라우드 호스팅 "서비스형 TextGen"은 존재하지 않습니다.
- 자금 지원 이력. 유지 관리자는 2023년 Andreessen Horowitz로부터 일회성 오픈소스 지원금을 받아 전업 개발을 이어갔습니다. 이는 개발자의 시간을 지원한 것일 뿐 상업용 제품을 만든 것이 아니며, 라이선스를 바꾸거나 유료 등급을 도입하지도 않았습니다.
- 실질적인 비용은 하드웨어뿐입니다. 로컬로 모델을 실행하므로 실제 비용은 이미 보유한 GPU나 CPU뿐입니다. 소프트웨어 자체에서 발생하는 토큰당 또는 메시지당 요금은 없습니다.
text-generation-webui vs KoboldCpp vs LM Studio vs Open WebUI: 무엇을 선택할까?
이 네 가지 도구는 겹치지만 서로 다른 문제를 해결합니다. 셋은 모델을 직접 실행하고, 하나는 별도의 백엔드를 위한 프론트엔드입니다.
도구 | 링크 | 최적 용도 | 모델 직접 실행 | LoRA 파인튜닝 | 멀티유저 | 라이선스 |
|---|---|---|---|---|---|---|
| text-generation-webui (TextGen) | github.com/oobabooga/textgen | 깊은 설정 자유도: 여러 백엔드, LoRA 학습, 도구 호출 API | 가능(llama.cpp, ExLlamaV3, Transformers, TensorRT-LLM) | 가능 | 불가 | AGPL 3.0 |
| KoboldCpp | github.com/LostRuins/koboldcpp | 가볍고 창작 글쓰기/롤플레이에 친화적인 백엔드, SillyTavern과 손쉬운 연동 | 가능(llama.cpp 기반) | 불가 | 불가 | AGPL 3.0 |
| LM Studio | lmstudio.ai | GGUF 모델을 다운로드하고 실행하는 가장 단순한 턴키 GUI | 가능(네이티브) | 불가 | 불가 | 무료(비공개 소스) |
| Open WebUI | openwebui.com | 별도로 운영되는 백엔드를 위한 셀프 호스팅 멀티유저 프론트엔드 | 불가(Ollama/vLLM/API 필요) | 불가 | 가능(역할 지원) | Open WebUI License |
text-generation-webui를 백엔드로 사용할 수 있는 캐릭터/롤플레이 중심 채팅에 대해서는 SillyTavern을 참고하세요. 백엔드와 서빙 엔진을 더 폭넓게 비교하려면 text-generation-webui vs vLLM vs llama.cpp를 참고하세요.
text-generation-webui에서 흔히 저지르는 실수
- 잘못된 백엔드가 선택된 상태로 GGUF 파일을 로드하는 것. 모델 형식에 맞게 백엔드를 선택하세요: GGUF는 llama.cpp, EXL3는 ExLlamaV3, 풀 프리시전 safetensors는 Transformers입니다.
- GitHub에서 "text-generation-webui"를 검색해 상위 결과가 "TextGen"인 것을 보고 프로젝트가 버려졌다고 오해하는 것. 이는 2026년 4월부터 새 이름과 저장소 URL로 바뀐, 동일하게 활발히 유지 관리되는 프로젝트입니다. 기존 URL은 단순히 리다이렉트될 뿐입니다.
- AutoGPTQ나 원조 ExLlama를 언급하는 오래된 가이드를 사용하는 것. 해당 로더들은 더 이상 현재 백엔드 라인업에 포함되지 않습니다. 대신 llama.cpp나 ExLlamaV3를 사용하세요.
- 내장 멀티유저 로그인을 기대하는 것. 계정 시스템이 없습니다. 여러 사람이 별도의 접근 권한을 필요로 한다면 공유 백엔드 앞단에 Open WebUI 같은 다른 도구가 필요합니다.
- 캐릭터 카드가 있는 롤플레이 프론트엔드로 사용하려는 것. 로어북이나 캐릭터 카드 시스템이 없습니다. 이런 용도에는 SillyTavern을 대신 짝지어 사용하세요.
text-generation-webui에 대한 자주 묻는 질문
text-generation-webui는 TextGen과 같은 것인가요?
네. 버전 4.5.2(2026년 4월 15일)에서 프로젝트가 "text-generation-webui"에서 "TextGen"으로 이름을 바꾸고 GitHub 저장소를 github.com/oobabooga/textgen로 이전했습니다. 동일한 개발자가 유지 관리하며 동일한 스타 수와 커밋 이력을 이어가고 있습니다. 이전 저장소 URL은 새 URL로 자동 리다이렉트됩니다.
text-generation-webui는 누가 만들었나요?
"oobabooga"라는 아이디를 쓰는 개발자가 이 프로젝트를 만들었으며, 첫 커밋 날짜는 2022년 12월 21일입니다. 저희가 확인할 수 있는 어떤 자료에서도 실명은 공개된 적이 없습니다.
text-generation-webui는 무료인가요?
네, 완전히 무료입니다. AGPL 3.0 라이선스이며 배후 회사가 없고 유료 등급도 없습니다. 유지 관리자는 2023년 Andreessen Horowitz로부터 일회성 오픈소스 지원금을 받아 전업 개발을 이어갔지만, 이것이 상업용 제품을 만든 것은 아닙니다.
text-generation-webui는 어떤 백엔드를 지원하나요?
2026년 기준으로 지원되는 백엔드는 llama.cpp, ik_llama.cpp, Transformers, ExLlamaV3, TensorRT-LLM입니다. 이전 버전의 백엔드인 AutoGPTQ, AutoAWQ, 원조 ExLlama/ExLlamaV2는 현재 코드베이스에서 더 이상 지원 목록에 없습니다.
text-generation-webui는 LoRA 파인튜닝을 지원하나요?
네. Training 탭은 멀티턴 채팅 데이터셋이나 원시 텍스트를 사용한 LoRA 파인튜닝을 지원하며, 학습을 일시 중지했다가 재개할 수 있습니다.
text-generation-webui에는 API가 있나요?
네. OpenAI 호환 API와 Anthropic 호환 API를 모두 제공하며(Chat, Completions, Messages 방식 엔드포인트 포함), 커스텀 Python 함수나 MCP 서버를 통한 도구 호출을 지원하고, 선택적으로 --api-key/--admin-key 인증도 지원합니다.
text-generation-webui는 롤플레이에 적합한가요?
세밀한 샘플링 파라미터 제어 덕분에 롤플레이에도 사용할 수 있지만, 롤플레이 전용 소프트웨어는 아닙니다. 캐릭터 카드, 로어북, 그룹 채팅 기능이 없습니다. 롤플레이 전용 프론트엔드로는 SillyTavern을 참고하세요. SillyTavern은 text-generation-webui를 백엔드 중 하나로 사용할 수 있습니다.
text-generation-webui는 이제 브라우저가 필요 없나요?
반드시 필요하지는 않습니다. 버전 4.7.3(2026년 5월)부터 휴대용 빌드는 기본적으로 네이티브 Electron 데스크톱 창으로 열립니다. 기존의 브라우저 탭 인터페이스(http://127.0.0.1:7860)를 선호한다면 --no-electron 플래그를 사용하세요.
text-generation-webui는 KoboldCpp와 어떻게 다른가요?
KoboldCpp는 창작 글쓰기와 롤플레이에 특화되어 있으며, SillyTavern용 가벼운 백엔드로 흔히 사용됩니다. text-generation-webui는 더 폭넓고 설정 자유도가 높으며, 더 많은 백엔드 엔진과 LoRA 학습, 더 완전한 API를 제공하지만 그만큼 이해해야 할 설정도 더 많습니다.
text-generation-webui는 Open WebUI와 어떻게 다른가요?
Open WebUI는 서버 기반의 멀티유저 프론트엔드로, 일반적으로 Ollama나 다른 백엔드 앞단에 위치합니다. text-generation-webui는 단일 사용자용 데스크톱/로컬 앱으로서 그 자체가 추론 엔진 호스트입니다. 별도로 관리되는 백엔드에 연결하는 것이 아니라 모델을 직접 실행합니다.
출처
- text-generation-webui / TextGen 소스 코드, README, 릴리스 — github.com/oobabooga/textgen
- GitHub API 저장소 데이터(생성일, 라이선스, 스타 수)
- 프로젝트 위키 및 문서 — github.com/oobabooga/textgen/wiki