Key Takeaways
- LiteLLM의 오픈소스 프록시는 사용량과 무관하게 무료입니다 — OpenAI 호환 엔드포인트 하나 뒤에 100개 이상의 공급자 API를 두고, 지출 추적·예산·레이트 리밋까지 무료 요금제에 포함됩니다.
- OpenRouter는 구독료를 받지 않지만 Stripe 충전액의 약 5.5%(최소 0.80달러), 암호화폐는 5%를 가져가며, 월 25,000달러(종량제) 또는 200,000달러(엔터프라이즈)를 넘는 부분에 5%의 BYOK 수수료가 붙습니다.
- Portkey는 Palo Alto Networks에 인수되었고(2026년 5월 29일 완료) Prisma AIRS에 통합되는 중입니다. 이제는 엔터프라이즈 보안 구매로 다루십시오.
- LiteLLM의 GitHub 저장소는 2026년 8월 기준 약 5.75만 개의 스타와 1.1만 개의 포크를 보유하고 있으며, 세 제품 중 가장 명확한 공개 채택 지표입니다.
- OpenRouter는 380개 이상의 모델을 제공하며, 가입에서 멀티모델 호출이 실제로 동작하기까지 가장 빠른 경로입니다.
- 솔직한 손익분기점: 월 모델 지출의 5.5%가 프록시 운영 비용을 넘어서는 순간부터 셀프 호스팅이 더 저렴해집니다.
- 게이트웨이 자체를 건너뛰어야 하는 경우: 단일 공급자를 낮고 예측 가능한 사용량으로 호출하고 있으며, 두 번째 공급자를 추가할 계획이 없을 때입니다.
🏆 최선의 선택: 셀프 호스팅인가, 게이트웨이 임대인가
돌릴 곳이 있다면 LiteLLM을 직접 운영하고, 없다면 OpenRouter를 쓰십시오. 이 질문 하나가 어떤 기능 목록보다 확실하게 이 선택을 결정합니다. 세 도구 모두 단일 API, 장애 대응, 비용 추적이라는 게이트웨이의 핵심 역할은 이미 충족하고 있기 때문입니다.
셀프 호스팅인가, 호스팅형 게이트웨이인가
다음의 경우 로컬 LLM을 사용하십시오:
- •이미 서비스를 운영하고 있고 프록시를 유지 보수할 수 있음 — LiteLLM은 어떤 사용량에서도 추가 요금이 없습니다
- •월 모델 지출이 충분히 커서 5%가 실제 금액으로 다가옴(월 500달러를 넘으면 대부분의 소규모 호스팅 비용을 초과합니다)
- •실패한 요청을 어느 공급자가 처리할지 정확히 통제해야 함 — 예를 들어 EU 데이터 소재지 경계 안에 머물러야 하는 경우
- •망 분리 환경 배포가 필요함(LiteLLM Enterprise가 명시적으로 지원)
다음의 경우 클라우드 모델을 사용하십시오:
- •DevOps 여력이 없고 운영 중인 서비스를 떠안고 싶지 않음
- •한 시간 안에 380개 이상의 모델을 호출하고 싶음 — OpenRouter에 필요한 것은 API 키 하나뿐입니다
- •지출 규모가 작아서 절약되는 시간에 비하면 약 5.5%가 미미함
- •이미 Palo Alto Networks 보안 제품을 구매하고 있고 Prisma AIRS 안에서 게이트웨이를 통제하고 싶음
빠른 결정:
- →무료이며 셀프 호스팅 → LiteLLM(Apache 라이선스 오픈소스 코어, 스타 약 5.75만 개)
- →인프라 없이 오늘 바로 모델을 → OpenRouter(380개 이상의 모델, 충전액에 약 5.5%)
- →엔터프라이즈 AI 보안 거버넌스 → Portkey / Prisma AIRS(Production 월 49달러, Enterprise는 문의)
- →공급자 한 곳, 낮은 사용량 → 게이트웨이 불필요 — SDK를 직접 호출하십시오
LLM API 게이트웨이란 무엇입니까
LLM API 게이트웨이는 애플리케이션과 여러 모델 공급자 사이에 놓여 일관된 단일 API를 제공하는 라우팅 계층입니다. OpenAI, Anthropic, Google을 비롯한 각 공급자마다 별도의 연동 코드를 작성하는 대신, 게이트웨이를 한 번 호출하면 공급자별 형식과 인증, 장애 대응을 처리하고 대부분의 구현에서는 비용 추적과 레이트 리밋까지 맡습니다.
이 이점은 프로덕션에 공급자가 둘 이상일 때에만 생깁니다. 공급자가 하나뿐인 애플리케이션에서 게이트웨이는 대가 없는 추상화 계층일 뿐입니다. 공급자 난립이 이미 접착 코드와 온콜 대응 비용을 초래하고 있다면 도입하고, 그렇지 않다면 넘어가십시오.
LLM API 게이트웨이는 애플리케이션의 호출을 OpenAI 호환 단일 인터페이스를 통해 여러 모델 공급자로 라우팅하고, 원래 API 위에 장애 대응·비용 추적·레이트 리밋을 더합니다.
AI 모델용 전원 어댑터라고 생각하십시오. 코드는 하나의 콘센트에만 꽂고, 공급자마다 플러그 모양이 다른 문제는 어댑터가 흡수합니다. 플러그를 하나만 쓴다면 어댑터는 필요 없습니다.
LiteLLM vs OpenRouter vs Portkey: 전체 비교
모든 항목에서 이기는 게이트웨이는 없습니다. 비용과 통제력은 LiteLLM, 도입 속도는 OpenRouter, 엔터프라이즈 거버넌스는 Prisma AIRS가 앞섭니다. 가격과 요금제 내용은 2026년 8월 27일 각 공급사 공식 페이지에서 확인했습니다. 올해 게이트웨이 가격이 여러 차례 바뀌었으므로 이 페이지가 게시된 지 90일이 넘었다면 다시 확인하십시오.
| 기준 | LiteLLM | OpenRouter | Portkey (Prisma AIRS) |
|---|---|---|---|
| 적합 대상 | 완전한 통제를 원하고 수수료를 피하려는 셀프 호스팅 팀 | 인프라 없이 빠르게 멀티모델 작업 | 이미 Palo Alto 보안을 구매 중인 기업 |
| 가격 | 무료(오픈소스); Enterprise는 연간·문의 | 구독 없음; Stripe 약 5.5%, 암호화폐 5% | 무료 월 1만 로그; Production 월 49달러; Enterprise 문의 |
| 셀프 호스팅 | 가능 — 핵심 설계이며 매니지드 프록시도 선택 가능 | 불가 — 호스팅 API 접근만 제공 | Enterprise에서 프라이빗 클라우드 배포 가능 |
| 공급자 / 모델 | 100개 이상의 공급자 API | 380개 이상의 모델 제공 | 저장소가 이전에 1,600개 이상 LLM을 표방 |
| 장애 대응 | 가능 — 오픈소스 버전에서 체인 설정 가능 | 가능 — 플랫폼 차원에서 자동 처리 | 가능 — 모든 요금제에서 폴백과 부하 분산 |
| 비용 추적 | 가능 — 오픈소스 버전에 지출 추적과 예산 포함 | 가능 — 요청별 크레딧 대시보드 | 가능 — 비용 배분과 가상 키별 예산 |
| 레이트 리밋 | 가능 — 오픈소스 버전 | 계정 단위 전역(사용자 설정 불가) | Enterprise에서 세밀한 제어 |
| 제휴 프로그램 | 확인되지 않음 | 확인되지 않음 | 확인되지 않음(Palo Alto의 것은 B2B) |
⚠️Warning: 2026년 5월 이전에 기록된 가격은 더 이상 Portkey를 설명하지 못합니다. 오래된 기사나 스크린샷의 수치를 인용하기 전에 Prisma AIRS의 현행 조건을 Palo Alto Networks에 확인하십시오.
셀프 호스팅 경로: LiteLLM이 기본 선택인 이유
LiteLLM이 커뮤니티의 기본 선택인 이유는 무료 버전이 체험판이 아니라 제품 전체이기 때문입니다. 지출 추적, 예산, 레이트 리밋, 장애 대응 체인이 모두 오픈소스 코어에 들어 있습니다. Enterprise가 더하는 것은 SSO, SCIM, 전담 지원, 망 분리 배포이지 라우팅 자체가 아닙니다.
LiteLLM의 오픈소스 프록시는 100개가 넘는 LLM 공급자 API를 OpenAI 호환 인터페이스로 호출하며, 라이선스 비용도 요청당 추가 비용도 없고 이는 어떤 사용량에서도 동일합니다.
LiteLLM — 종합적으로 최적의 게이트웨이
무료, 셀프 호스팅, GitHub 스타 약 5.75만 개 — 사실상의 표준에 가장 가까운 존재
LiteLLM의 핵심 프록시는 무료이자 오픈소스이며, 100개가 넘는 공급자 API를 OpenAI 호환 엔드포인트로 라우팅합니다. 여기서 유일하게 모델 지출에 비율 가산을 붙이지 않는 선택지이고, 의미 있는 사용량에서 절대 금액 기준으로 가장 저렴한 이유도 바로 그것입니다. 약 5.75만 개의 스타와 1.1만 개의 포크(2026년 8월)는 세 도구 중 가장 강력한 유지 보수 지표로, 프로덕션 라우팅 계층을 2년 뒤에도 관리될 프로젝트에 맡기는 상황에서는 중요한 신호입니다. 실제로 지불하는 대가는 운영입니다. 서비스를 돌리고 모니터링하고 업데이트하는 것은 여러분입니다.
장점
- +요청당 과금도 비율 가산도 없음 — 어떤 사용량에서도 무료
- +장애 대응 체인, 예산, 레이트 리밋이 모두 무료 오픈소스 버전에 포함
- +라우팅 로직과 데이터 소재지를 완전히 통제
- +Enterprise가 망 분리 배포를 명시적으로 지원
단점
- –가용성, 패치, 모니터링의 책임은 모두 여러분에게 있음
- –Enterprise 가격은 문의 방식이라 예산 수립에 쓸 공개 수치가 없음
- –DevOps 여력이 전혀 없는 팀에는 맞지 않음
호스팅 경로: OpenRouter와 Prisma AIRS
게이트웨이를 직접 운영하는 대신 임대하는 데에는 홍보 문구가 아닌 실질적인 이유가 있습니다. 가용성, 업데이트, 시크릿 관리, 그리고 요청 경로에 놓인 서비스라면 피할 수 없는 온콜 대응 같은 진짜 인프라 작업을 덜 수 있습니다. 호스팅형 게이트웨이는 직접이라면 하나씩 연동해야 할 공급자 커버리지도 함께 제공합니다.
대가는 지출에 비례해 늘어나는 수수료와, 장애 대응에 대한 덜 정밀한 통제입니다. 사용량이 중간 수준이면 괜찮은 거래이고, 크면 나쁜 거래입니다. 손익분기점의 정확한 계산은 아래 비용 섹션에 있습니다.
OpenRouter — 설정이 필요 없는 최적의 게이트웨이
API 키 하나로 380개 이상의 모델, 운영할 서버는 없음
OpenRouter는 아무것도 없는 상태에서 동작하는 멀티모델 애플리케이션까지 가는 가장 빠른 경로입니다. 가입하고 API 키를 받으면 같은 날 380개 이상의 모델을 호출할 수 있습니다. 구독료는 없고 수수료는 계정 충전에 붙습니다. Stripe 크레딧 구매 시 약 5.5%(최소 0.80달러), 암호화폐는 5%입니다. 5%의 BYOK 수수료는 BYOK로 라우팅된 월 지출이 25,000달러(종량제) 또는 200,000달러(엔터프라이즈)를 넘어야 발생하므로, 가벼운 사용에서는 추가 비용이 없습니다. 장애 대응은 자동이지만 플랫폼 차원에서 이뤄집니다. 공급자에 오류가 나면 여러분이 체인을 설정하지 않아도 동등한 모델로 넘길 수 있습니다.
장점
- +인프라가 전혀 필요 없음 — API 키 하나가 준비의 전부
- +380개 이상의 모델 제공으로, 수작업으로 연동할 수 있는 수를 훨씬 넘어섬
- +구독 없음; 가벼운 BYOK 사용은 무료 한도 안에 머무름
- +설정 없이 공급자 간 자동 장애 대응
단점
- –약 5.5%의 수수료가 누적되어 사용량이 크면 부담이 커짐
- –레이트 리밋이 계정 단위 전역이라 사용자가 직접 설정할 수 없음
- –실패한 요청을 어느 공급자가 처리하는지에 대한 통제가 약해, 엄격한 데이터 소재지 규정에서는 문제가 됨
Portkey / Prisma AIRS — 엔터프라이즈 보안 구매
이제 Palo Alto Networks 보안 플랫폼 안의 AI 게이트웨이
Portkey는 여전히 게이트웨이의 역할을 합니다. 모든 요금제에서 자동 폴백, 부하 분산, 비용 배분, 가상 키별 예산 관리를 제공하며, 무료 Developer 요금제는 월 1만 로그, Production 요금제는 월 49달러에 10만 로그입니다. 바뀐 것은 범주입니다. Palo Alto Networks가 2026년 5월 29일 인수를 완료한 이후로는 독립 라우터가 아니라 Prisma AIRS 보안 플랫폼 안의 AI 게이트웨이로 자리매김했습니다. 이미 엔터프라이즈 AI 거버넌스를 도입하는 중이라면 잘 맞고, 민첩하고 독립적인 도구를 원했다면 맞지 않습니다.
장점
- +무료 요금제를 포함한 전 요금제에서 폴백과 부하 분산 제공
- +비용 배분과 가상 키별 예산 관리 기본 탑재
- +Enterprise에서 프라이빗 클라우드 배포 가능
- +게이트웨이 라우팅과 폭넓은 AI 보안 거버넌스를 결합
단점
- –더 이상 독립적이지 않으며 로드맵과 가격이 대형 보안 기업을 따라감
- –2026년 5월 이전의 가격과 요금제 구조는 이미 낡았을 수 있음
- –벤더 중립성이 게이트웨이를 원한 이유의 일부였다면 맞지 않음
규모가 커지면 각 게이트웨이 비용은 얼마입니까
LiteLLM의 오픈소스 코어는 사용량과 무관하게 무료로 유지되고, OpenRouter의 비용은 충전한 금액에 대한 비율이며, Portkey의 비용은 로그 규모와 계약 조건에 따라 늘어납니다. 아래 표는 공개된 약 5.5%의 Stripe 수수료에 대한 단순 계산입니다. 추정치가 아니라 이 선택을 좌우하는 바로 그 숫자입니다.
LiteLLM 운영 비용을 달러로 제시하지 않은 것은 의도적입니다. 이 프록시는 상시 구동되는 작은 서비스이고, 그 비용은 어디에서 돌리는지에 전적으로 달려 있습니다. 마지막 열에 여러분의 호스팅 비용을 넣으면 결론은 저절로 나옵니다.
한국 독자를 위한 참고: 세 공급사 모두 미국 달러로 청구하며 원화 가격표는 없습니다. 따라서 명세서에는 환율과 카드사에 따라 해외 이용 수수료가 더해집니다.
| 월 모델 지출 | OpenRouter 수수료(약 5.5%) | LiteLLM 라이선스 비용 | 셀프 호스팅이 유리한 기준 |
|---|---|---|---|
| 200달러 | 약 11달러/월(약 132달러/년) | 0달러 | 월 11달러 미만 |
| 500달러 | 약 27.50달러/월(약 330달러/년) | 0달러 | 월 27.50달러 미만 |
| 2,000달러 | 약 110달러/월(약 1,320달러/년) | 0달러 | 월 110달러 미만 |
| 10,000달러 | 약 550달러/월(약 6,600달러/년) | 0달러 | 월 550달러 미만 |
월 모델 지출이 충분히 커서 5% 이상의 가산이 절대 금액으로 유의미하다면 LiteLLM을 쓰십시오. 그 수수료가 프록시 운영에 드는 엔지니어링 시간보다 저렴하다면 OpenRouter를 쓰십시오. 같은 계산을 하드웨어에 적용한 내용은 로컬 LLM 비용 계산기에 있습니다.
•Info: 수수료는 구매한 크레딧에 부과되며 요청 건마다 붙지 않습니다. 별도의 5% BYOK 수수료도 BYOK로 라우팅된 월 지출이 25,000달러(종량제) 또는 200,000달러(엔터프라이즈)를 넘어야 시작됩니다. 그 한도 안에서는 BYOK에 추가 비용이 없습니다.
Portkey의 소유권 변경이 이 결정에 중요한 이유
Portkey는 더 이상 독립 제품이 아닙니다. Palo Alto Networks가 2026년 5월 29일 인수를 완료했고 보안 플랫폼 Prisma AIRS에 통합하고 있습니다. 이것은 단순한 명칭 변경이 아닙니다. 오늘 가벼운 도구로 도입한 게이트웨이가 제품 주기 한 번 안에 가격이 재조정되거나 범위가 바뀌거나 더 큰 보안 제품군의 일부로만 판매될 수 있습니다.
민첩한 스타트업 제품이라는 이유로 Portkey를 검토하고 있었다면 그 전제는 더 이상 성립하지 않습니다. 확정하기 전에 현행 조건을 Palo Alto Networks에 직접 확인하십시오. 인수된 제품은 통합 첫 6~12개월 사이에 가격, 요금제 구조, 지원 모델이 바뀌는 일이 흔합니다.
Palo Alto Networks는 2026년 5월 29일 Portkey 인수를 완료했으며, 이를 보안 플랫폼 Prisma AIRS 안의 AI 게이트웨이로 통합하고 있습니다.
각 게이트웨이는 장애 대응을 어떻게 처리합니까
세 제품 모두 공급자 장애 시 자동 전환을 지원하며, 차이는 그 정책을 누가 작성하는가에 있습니다. LiteLLM과 Portkey는 장애 대응 체인과 부하 분산 규칙을 여러분이 통제하는 설정에서 정의할 수 있게 합니다. OpenRouter는 플랫폼 차원에서 처리합니다. 공급자에 오류가 나면 자동으로 동등한 모델로 넘길 수 있지만, 어느 모델로 넘길지에 대한 통제는 덜 정밀합니다.
- LiteLLM — 자체 설정에서 정의하는 장애 대응 체인; 실패한 요청을 어느 대체 모델이 처리할지에 대해 가장 정밀한 통제 제공
- Portkey / Prisma AIRS — 전 요금제에서 자동 폴백과 부하 분산을 제공하며 플랫폼에서 설정
- OpenRouter — 플랫폼 차원의 공급자 자동 전환; 설정할 체인도 없고 어느 공급자가 넘겨받을지에 대한 보장도 없음
누가 어떤 게이트웨이를 써야 합니까
인프라를 갖춘 개발자는 기본적으로 LiteLLM을, 운영 부담 없는 멀티모델 접근을 원하는 팀은 OpenRouter를, Palo Alto 스택 안에 있는 기업은 Prisma AIRS를 검토해야 합니다. 그 이후는 팀 규모, 컴플라이언스 요건, 운영 부담에 대한 감내 수준이 결정합니다.
- 여러 모델로 시제품을 만드는 1인 개발자와 소규모 스타트업 → OpenRouter. API 키 하나, 380개 이상의 모델, 돌볼 서버 없음. 사용량이 크고 비용에 매우 민감하다면 피하십시오. 수수료가 누적됩니다.
- 프로덕션에서 멀티모델 애플리케이션을 운영하는 플랫폼 팀 → 셀프 호스팅 LiteLLM. 무료이고 커뮤니티의 기본 선택이며, 라우팅과 데이터 소재지 통제권을 유지합니다. 서비스를 운영할 여력이 없다면 피하십시오.
- 이미 Palo Alto Networks 제품을 도입 중인 기업 → Prisma AIRS 안의 Portkey. 이제 거버넌스·보안 계층으로 제공되므로 1년 전과는 제안 내용이 다릅니다.
- 망 분리 배포가 필요한 규제 산업 → LiteLLM Enterprise가 명시적으로 지원합니다. Prisma AIRS의 현행 배포 옵션은 Palo Alto Networks에 직접 확인하십시오. 인수 후 통합은 단기적으로 제공 범위를 바꿉니다. 로컬 LLM의 엔터프라이즈 컴플라이언스도 참고하십시오.
- 단일 공급자를 낮은 사용량으로 호출하는 팀 → 게이트웨이 불필요. SDK를 직접 호출하고 두 번째 공급자를 추가할 때 다시 검토하십시오.
EU, 일본, 중국의 LLM 게이트웨이
게이트웨이가 어디서 동작하는지가 프롬프트의 행선지를 결정합니다. 그래서 세 주요 시장에서 게이트웨이 선택은 비용 문제가 아니라 컴플라이언스 결정이 됩니다.
LLM 게이트웨이 선택 시 흔한 실수
- 1세 도구에서 "게이트웨이"가 같은 뜻이라고 가정하는 것
Why it matters: LiteLLM은 셀프 호스팅 프록시, OpenRouter는 호스팅 API, Portkey는 이제 보안 플랫폼의 일부입니다. 기능 목록을 비교하기 전에 각 공급사의 현행 제품 페이지를 읽으십시오. 동등하다고 가정해서는 안 됩니다. - 2수수료를 계산하지 않고 대규모 프로덕션에 OpenRouter를 선택하는 것
Why it matters: 월 모델 지출이 10,000달러라면 약 5.5%의 수수료는 월 약 550달러, 연 6,600달러입니다. 편의성만이 아니라 실제 지출로 이 계산을 해보십시오. - 3두 번째 공급자가 프로덕션에 들어오기 전에 게이트웨이를 도입하는 것
Why it matters: 게이트웨이의 핵심 가치는 장애 대응을 갖춘 다중 공급자 라우팅입니다. 공급자 하나에 모델 하나뿐이라면 추상화 계층과 새로운 장애 지점, 학습 곡선을 아무 대가 없이 더하는 셈입니다. - 42026년 5월 이전에 기록된 Portkey 가격을 인용하는 것
Why it matters: Palo Alto 인수 이전의 가격 페이지와 블로그 글은 현행 Prisma AIRS 조건을 반영하지 못할 수 있습니다. 오래된 스크린샷을 근거로 구매를 결정하기 전에 공급사에 확인하십시오. - 5GitHub 스타를 기능 비교로 읽는 것
Why it matters: LiteLLM의 약 5.75만 개 스타는 커뮤니티 신뢰와 2년 뒤에도 프로젝트가 관리될 가능성을 뜻하는 것이지, Portkey나 OpenRouter보다 기능이 많다는 뜻이 아닙니다. 채택 지표가 아니라 비교표를 보십시오.
게이트웨이 자체를 건너뛰어야 하는 경우
단일 LLM 공급자를 낮고 예측 가능한 사용량으로 호출하고 있으며 가까운 시일 내에 두 번째를 추가할 계획이 없다면, 세 제품 모두 제쳐 두십시오. 게이트웨이는 운영 복잡도(셀프 호스팅)나 비율 수수료(호스팅형)를 더하는 대신, 아직 쓰지도 않는 다중 공급자 이점을 제공할 뿐입니다.
공급자의 SDK를 직접 호출하고, 실제로 두 번째 모델이나 공급자를 추가하는 날 이 판단을 다시 하십시오. 한 단계 아래에도 같은 논리가 적용됩니다. 호스팅 API를 호출할지 자체를 아직 고민 중이라면 로컬 LLM vs 클라우드 API를 먼저 읽으십시오. 가장 저렴한 게이트웨이는 끝내 필요하지 않았던 게이트웨이입니다.
💡Tip: 유용한 기준: 자신의 코드에 특정 공급자 전용 분기를 처음 쓰게 되는 순간이 게이트웨이를 도입할 때입니다. 그 조건문이야말로 게이트웨이가 없애기 위해 존재하는 접착 코드입니다.
자주 묻는 질문
LLM API 게이트웨이란 무엇입니까?
여러 LLM 공급자를 호출하기 위한 일관된 단일 API를 애플리케이션에 제공하는 라우팅 계층이며, 대개 원래 API 위에 장애 대응, 비용 추적, 레이트 리밋을 더합니다. 여러분은 게이트웨이를 호출하고, 공급자별 형식과 인증은 게이트웨이가 처리합니다. 이 이점은 프로덕션에 공급자가 둘 이상일 때에만 실현됩니다.
LiteLLM은 정말 무료입니까?
2026년 8월 기준 LiteLLM 자체 가격 페이지에 따르면 오픈소스 코어는 무료이자 셀프 호스팅이며 라이선스 비용이 없습니다. 어떤 사용량에서도 요청당 가산이 없습니다. Enterprise 요금제(SSO, SCIM, 전담 지원, 망 분리 배포)는 요청 규모에 맞춘 연간 맞춤 가격이며 30일 체험이 포함됩니다.
OpenRouter는 요청 건당 과금합니까?
직접 과금하지는 않습니다. OpenRouter의 수수료는 계정 충전에 부과되며, Stripe 크레딧 구매 시 약 5.5%(최소 0.80달러), 암호화폐는 5%입니다. 별도의 5% BYOK 수수료는 BYOK로 라우팅된 월 지출이 종량제에서 25,000달러, 엔터프라이즈에서 200,000달러를 넘을 때에만 적용됩니다.
Portkey는 아직 독립 회사입니까?
아닙니다. Palo Alto Networks 자체 보도자료에 따르면 이 회사는 2026년 5월 29일 Portkey 인수를 완료했으며, 이를 보안 플랫폼 Prisma AIRS의 핵심 AI 게이트웨이로 통합하고 있습니다. 2026년 5월 이전의 가격이나 로드맵 정보는 낡았을 수 있는 것으로 다루십시오.
가장 많은 공급자를 지원하는 게이트웨이는 무엇입니까?
OpenRouter는 2026년 8월 기준 자체 사이트에 380개 이상의 모델을 게시하고 있습니다. LiteLLM 문서는 100개 이상의 공급자 연동을 설명하는데, 공급자 하나가 여러 모델을 제공하므로 단위가 다릅니다. Portkey의 게이트웨이 저장소는 이전에 1,600개 이상의 LLM을 표방했으나, 인수를 고려하면 다시 확인해야 할 수치입니다.
Portkey를 셀프 호스팅할 수 있습니까?
인수 이전 가격 페이지에 따르면 Portkey/Prisma AIRS는 Enterprise 요금제에서 프라이빗 클라우드 배포를 제공했습니다. 인수 후 통합은 첫해에 배포 옵션을 자주 바꾸므로, 현행 셀프 호스팅 조건은 Palo Alto Networks에 직접 확인하십시오.
세 곳 중 제휴 프로그램이 있는 곳이 있습니까?
2026년 8월 기준 LiteLLM, Portkey, OpenRouter 어디에서도 공개되고 확인 가능한 제휴나 추천 프로그램을 찾지 못했습니다. 이 페이지의 모든 제품 링크는 PromptQuorum에 아무런 수익도 발생시키지 않는 일반 공개 링크입니다. 상황이 바뀌면 실제 프로그램 조건에 맞는 고지를 담아 이 페이지를 갱신하겠습니다.
셀프 호스팅과 호스팅형 게이트웨이 중 무엇을 골라야 합니까?
월 모델 지출의 5.5%를 상시 구동되는 작은 서비스의 운영 비용과 비교하십시오. 손익분기점 아래에서는 여러분의 시간까지 계산에 넣으면 OpenRouter가 더 저렴하고, 그 위에서는 셀프 호스팅 LiteLLM이 절대 금액에서 앞섭니다. 컴플라이언스 기준을 하나 더 더하십시오. 어느 공급자가 요청을 처리했는지 밝혀야 한다면 계산과 무관하게 셀프 호스팅입니다.
최종 결론
- LiteLLM을 쓰십시오, 만약 셀프 호스팅이 가능하고 반복 비용 없이 라우팅을 완전히 통제하고 싶다면 — 다음 단계: 오픈소스 프록시를 배포하고 애플리케이션의 기본 URL을 그쪽으로 지정하십시오.
- OpenRouter를 쓰십시오, 만약 인프라 없이 오늘 바로 멀티모델 접근이 필요하다면 — 다음 단계: API 키를 만들고 계정을 충전하되 약 5.5%의 수수료를 예산에 반영하십시오.
- Portkey / Prisma AIRS를 쓰십시오, 만약 이미 Palo Alto Networks 보안 제품을 구매하거나 검토 중이고 게이트웨이 기능까지 함께 묶고 싶다면 — 다음 단계: Palo Alto Networks에 직접 연락해 인수 후 현행 조건을 다시 확인하십시오.
- 세 제품 모두 건너뛰십시오, 만약 단일 공급자를 낮은 사용량으로 호출하고 가까운 시일 내 다중 공급자 계획이 없다면 — 다음 단계: 두 번째 공급자를 추가할 때 다시 검토하십시오.