Skip to main content
PromptQuorum
Início/LLMs locais/Preços do AutoDL 2026: A100 80 GB vs Alibaba Cloud e Tencent GPU
Cost & Comparisons

Preços do AutoDL 2026: A100 80 GB vs Alibaba Cloud e Tencent GPU

·13 min de leitura·By Hans Kuepper · Founder of PromptQuorum, multi-model AI dispatch tool · PromptQuorum

Esta página contém links de referência para produtos de terceiros. O PromptQuorum não está inscrito em nenhum programa de afiliados — são links simples que não geram comissão. Clicar nos links e os próximos passos são de sua inteira responsabilidade. Estes links não representam qualquer endosso ou verificação por parte do PromptQuorum.

Ver preços do AutoDL →link de produto · divulgadoVer oferta do Alibaba Cloud →link de produto · divulgadoExperimentar Tencent Cloud →link de produto · divulgado

O AutoDL é a nuvem de GPU chinesa mais barata: um A100 80 GB custa ¥5,98/h (~US$ 0,82), um RTX 4090 24 GB a partir de ¥2,68/h (~US$ 0,37) e um RTX 3090 24 GB a partir de ¥1,68/h (~US$ 0,23) — cobrado por segundo e sem contrato. O mesmo A100 80 GB custa ¥8–12/h no Alibaba Cloud PAI e ¥7,5–10/h no Tencent Cloud TI, então o AutoDL é o mais barato dos três para aluguel de GPU. O Alibaba Cloud PAI tem o melhor runtime de inferência otimizado para Qwen; o Tencent Cloud TI é o melhor para equipes do ecossistema WeChat/Tencent. Os três mantêm os dados dentro da China continental.

Preços do AutoDL 2026: A100 80 GB vs Alibaba Cloud e Tencent GPU

Key Takeaways

  • O AutoDL é a nuvem de GPU chinesa mais barata — A100 40 GB a partir de ¥2,5/h (spot), ¥4,5/h (sob demanda). Ideal para desenvolvimento e fine-tuning em rajada.
  • O Alibaba Cloud PAI tem ambientes de inferência Qwen pré-configurados que funcionam 20–30% mais rápido que o Ollama padrão; é necessário para integrações com o ecossistema Tongyi do Alibaba Cloud.
  • O Tencent Cloud TI Platform oferece a integração mais profunda com o WeChat e o ecossistema Tencent; ideal para equipes que criam Mini Programas do WeChat com recursos de IA.
  • Os três provedores oferecem residência de dados na China continental — fundamental para a conformidade com a Lei de Proteção de Informações Pessoais (PIPL).
  • Promoções para novas contas: o Alibaba Cloud oferece ¥300 de crédito gratuito; o AutoDL oferece ¥10 de crédito de GPU gratuito (suficiente para 2–4 horas de testes com A100).
  • Para desenvolvedores ocidentais que acessam a nuvem chinesa: o Alibaba Cloud International aceita cartões de crédito internacionais e console em inglês; AutoDL e Tencent Cloud exigem cartões bancários chineses ou Alipay.
  • O Qwen3 72B roda mais rápido no Alibaba Cloud PAI graças ao runtime de inferência otimizado para Qwen da equipe da Alibaba DAMO Academy.

Comparativo de provedores: AutoDL vs Alibaba Cloud PAI vs Tencent Cloud TI

O AutoDL vence em preço, o Alibaba Cloud PAI vence em desempenho Qwen, o Tencent Cloud TI vence em integração WeChat/Tencent. Escolha conforme o que importa para sua carga de trabalho.

ProvedorIdeal paraVantagem principalCTA
AutoDLAluguel de GPU mais baratoPreços por hora mais baixos, cobrança por segundoVer preços do AutoDL →
Alibaba Cloud PAIQwen / produçãoRuntime otimizado para Qwen + nuvem empresarialVer oferta do Alibaba Cloud →
Tencent Cloud TIWeChat / TencentIntegração nativa com o ecossistema WeChat e TencentExperimentar Tencent Cloud →

Links de produto, sem relação de afiliado atual — o PromptQuorum não ganha comissão nesses cliques (veja o aviso acima). Preços verificados pela última vez em julho de 2026.

Ver preços do AutoDL →link de produto · divulgadoVer oferta do Alibaba Cloud →link de produto · divulgadoExperimentar Tencent Cloud →link de produto · divulgado

O AutoDL é a nuvem de GPU chinesa mais barata (¥2,5–4,5/h para um A100 40 GB); o Alibaba Cloud PAI oferece o melhor desempenho de inferência Qwen; o Tencent Cloud TI é a melhor opção para o ecossistema WeChat.

As nuvens de GPU chinesas são como AWS/GCP, mas com servidores dentro da China, mais baratas por hora para cargas de trabalho chinesas e em conformidade com as leis de dados chinesas. O AutoDL é a opção para startups; Alibaba e Tencent são de nível empresarial.

Descrição dos provedores

Três plataformas dominam o aluguel de GPU em nuvem chinesa para cargas de trabalho de IA: AutoDL (voltado a desenvolvedores, o mais barato), Alibaba Cloud PAI (empresarial, otimizado para Qwen) e Tencent Cloud TI Platform (ecossistema WeChat). Uma quarta opção, o Baidu AI Cloud, se destaca pela integração com o ERNIE, mas geralmente custa mais e oferece menos variedade de GPU.

  • **AutoDL (autodl.com):** Nuvem de GPU voltada à comunidade, fundada em 2020, dominante entre pesquisadores individuais e startups. Maior inventário de GPU na China. Suporta RTX 4090, A100, H100. Pagamento: Alipay/WeChat Pay. Sem contratos empresariais necessários. O console está apenas em chinês.
  • **Alibaba Cloud PAI (aliyun.com/product/bigdata/learn):** Plataforma de ML empresarial com inferência otimizada para Qwen. Pertence ao Grupo Alibaba — a mesma empresa por trás dos modelos Qwen. Integração profunda com o ecossistema Alibaba (DingTalk, conjuntos de dados do Taobao, armazenamento OSS). Cartões de crédito internacionais aceitos pelo portal internacional do Alibaba Cloud.
  • **Tencent Cloud TI Platform (cloud.tencent.com/product/tione):** Plataforma de ML integrada com WeChat, WeCom e os conjuntos de dados de games/mídia da Tencent. Ideal para equipes que criam produtos de IA para o consumidor no ecossistema Tencent. O Hunyuan LLM é nativo desta plataforma.
  • **Baidu AI Cloud (qianfan.cloud.baidu.com):** Integrado ao ERNIE Bot e ao ecossistema de busca do Baidu. Competitivo para IA documental e fluxos com busca aumentada, mas o preço de aluguel de GPU é 15–30% mais alto que o do AutoDL para hardware equivalente.

Tabela de preços do AutoDL — tarifas de GPU por hora

O AutoDL cobra por segundo, sem contrato mínimo; as tarifas em destaque abaixo são preços de tabela sob demanda da página de preços do AutoDL. Um A100 80 GB custa ¥5,98/h (~US$ 0,82), um RTX 4090 24 GB a partir de ¥2,68/h (~US$ 0,37) e um RTX 3090 24 GB a partir de ¥1,68/h (~US$ 0,23). Os preços variam conforme a região do data center e a disponibilidade; instâncias spot ("按量" ociosas) podem custar 30–50% abaixo do preço sob demanda em horários de baixa demanda (meia-noite–6h, horário de Pequim). Estudantes que concluem a verificação recebem 15% de desconto adicional. Todos os preços em CNY (¥); USD aproximado a ¥7,25/USD.

  • Modelo de cobrança: cobrança por segundo, pagamento por uso. Sem compromisso mensal; pare a instância para parar de pagar. Um crédito gratuito de ¥10 para novas contas cobre ~1,5 hora de testes com A100 80 GB.
  • AutoDL frente a plataformas de computação similares: para cargas de trabalho chinesas, Featurize e Hengyuan Cloud (恒源云) oferecem cobrança por minuto comparável e imagens de comunidade; o 智星云 (Zhixingyun) às vezes fica abaixo do AutoDL em RTX 4090 e A100 80 GB. Para acesso internacional com pagamento por cartão, Vast.ai (marketplace, normalmente o menor preço por hora) e RunPod (mais previsível, templates prontos) são os equivalentes mais próximos.
  • Quando o AutoDL vence: desenvolvimento, fine-tuning em rajada e inferência em lote sensível a custo em que a interrupção ocasional de spot é aceitável. Para disponibilidade garantida com SLA, use em vez disso instâncias sob demanda do Alibaba Cloud PAI ou do Tencent Cloud TI.
GPUVRAMAutoDL por hora (¥)USD aprox.Uso típico
RTX 309024 GB¥1,68/h~US$ 0,23Inferência 7B–13B, fine-tunes pequenos
RTX 409024 GBa partir de ¥2,68/h~US$ 0,37Placa única mais rápida para 7B–32B, melhor custo-benefício
A10040 GBa partir de ¥3,45/h~US$ 0,48Inferência 70B quantizada, fine-tuning de médio porte
A10080 GB¥5,98/h~US$ 0,8270B em precisão total, Qwen3 72B em placa única
H10080 GBa partir de ¥11,98/h~US$ 1,65Inferência de produção de alta vazão

O A100 80 GB do AutoDL (¥5,98/h) é mais barato que o Alibaba Cloud PAI (¥8–12/h) e o Tencent Cloud TI (¥7,5–10/h) para a mesma placa. Preços obtidos na página de preços do AutoDL em julho 2026 e cruzados com artigos comparativos independentes; as tarifas mudam conforme oferta e promoções — confirme a tarifa ao vivo em autodl.com/docs/latest_price antes de reservar. O AutoDL é a opção mais econômica deste comparativo. → Ver preços do AutoDL

Ver preços do AutoDL →link de produto · divulgado

Comparativo de preços de GPU

O AutoDL é consistentemente o mais barato; o Alibaba Cloud PAI custa 40–80% mais, mas inclui uma pilha de software otimizada; o Tencent Cloud TI fica na faixa intermediária. Todos os preços em CNY (¥). USD aproximado a ¥7,25/USD.

GPUAutoDL (spot)AutoDL (sob demanda)Alibaba PAITencent Cloud TIEquiv. USDMelhor opção
RTX 3090 24 GB¥1,2–1,68/h¥1,68/hN/DN/D~US$ 0,23/hAutoDL →
RTX 4090 24 GB¥1,5–2,68/h¥2,68–3,49/hN/DN/D~US$ 0,42/hAutoDL →
A10 24 GB¥1,8–3/h¥4/h¥3,5–5/h¥3,5–5/h~US$ 0,55/hAutoDL →
A100 40 GB¥2,5–3,45/h¥3,45/h¥6–8/h¥5,5–7/h~US$ 0,48/hAutoDL →
A100 80 GB¥4–5,98/h¥5,98/h¥8–12/h¥7,5–10/h~US$ 0,82/hAutoDL →
H100 80 GB¥8–11,98/h¥11,98/h¥18–25/h¥18–24/h~US$ 1,65/hAutoDL →

Preços obtidos nos consoles dos provedores e na página de preços do AutoDL em julho 2026, cruzados com sites comparativos independentes. Os preços spot variam conforme a hora do dia — os mais baratos ocorrem entre a meia-noite e as 6h, horário de Pequim. O AutoDL vence em preço em todas as linhas — mas, para inferência Qwen em produção, o runtime otimizado do Alibaba Cloud PAI costuma compensar a diferença. → Comparar preços no AutoDL

Preços de GPU: Alibaba vs Tencent vs AutoDL -- Tarifas por hora, julho de 2026
Preços de GPU: Alibaba vs Tencent vs AutoDL -- Tarifas por hora, julho de 2026
Ver preços do AutoDL →link de produto · divulgadoVer oferta do Alibaba Cloud →link de produto · divulgadoExperimente o Tencent Cloud TI Platform →link de produto · divulgado

Desempenho de inferência Qwen por provedor

O Alibaba Cloud PAI executa modelos Qwen 20–30% mais rápido que hardware equivalente em outras plataformas. A vantagem de desempenho vem do runtime de inferência PAI-EAS, codesenvolvido pela equipe Qwen na Alibaba DAMO Academy. É a mesma equipe que treina o Qwen — ela tem acesso aos internos do modelo que provedores externos não têm.

PlataformaGPUVelocidade Qwen3 72B (tok/s)Latência (primeiro token)Notas
Alibaba Cloud PAI (PAI-EAS)A100 80 GB22–28 tok/s~120msRuntime otimizado para Qwen, FlashAttention 3
AutoDL (Ollama)A100 80 GB16–20 tok/s~180msStack Ollama padrão, sem otimização
AutoDL (vLLM)A100 80 GB19–24 tok/s~150msvLLM com quantização AWQ
Tencent Cloud TI (vLLM)A100 80 GB17–22 tok/s~160msStack vLLM padrão
RunPod (ocidental, A100 80 GB)A100 80 GB15–18 tok/s~200msMaior latência por roteamento transpacífico

Se o Qwen é sua carga de trabalho principal, o ganho de 20–30% no Alibaba Cloud PAI costuma justificar o preço por hora mais alto. → Ver oferta do Alibaba Cloud. Se o custo por hora é a prioridade e a diferença de velocidade não é crítica, o AutoDL com vLLM (19–24 tok/s) entrega boa parte do benefício por uma fração do preço. → Ver preços do AutoDL

Velocidade de Inferência do Qwen por Provedor -- Qwen3 72B em A100 80GB
Velocidade de Inferência do Qwen por Provedor -- Qwen3 72B em A100 80GB
Ver oferta do Alibaba Cloud →link de produto · divulgadoVer preços do AutoDL →link de produto · divulgado

Residência de dados e conformidade com a PIPL

Os três provedores chineses armazenam dados dentro da China continental por padrão — uma vantagem para produtos que atendem usuários na China continental, já que isso satisfaz os requisitos de residência de dados da Lei de Proteção de Informações Pessoais (PIPL). A PIPL protege as informações pessoais de indivíduos localizados na China (independente da nacionalidade) e restringe a saída desses dados da China sem um mecanismo legal de transferência. Esta é uma vantagem específica do mercado chinês — não substitui a conformidade com o GDPR.

  • AutoDL: Todos os dados armazenados na China continental (data centers em Pequim, Xangai, Guangzhou). Sem SLA empresarial formal, mas adequado para a maioria das cargas de pesquisa e startups.
  • Alibaba Cloud PAI: SLA empresarial completo com garantias de residência de dados. Regiões específicas selecionáveis (cn-beijing, cn-hangzhou, cn-shanghai). Documentação de conformidade com a PIPL disponível.
  • Tencent Cloud TI: SLA empresarial, residência de dados na China. A integração de dados do WeChat exige um acordo separado com a Plataforma Aberta do WeChat.
  • Nenhum desses provedores permite exportar dados para suas regiões internacionais sem configuração explícita — o comportamento padrão é residência na China.
  • Se seus usuários ou dados pessoais estão na UE/EEE, a conformidade com a PIPL não ajuda e pode até jogar contra você. PIPL e GDPR são regimes legais separados: a PIPL regula dados de pessoas localizadas na China; o GDPR regula dados de pessoas na UE/EEE independente de onde são processados. Mover dados pessoais da UE para servidores na China continental não satisfaz o GDPR — na verdade, aciona as próprias regras de transferência internacional do GDPR (Capítulo V, Artigos 44–49), já que a China não tem decisão de adequação da UE. Na prática, isso normalmente exigiria Cláusulas Contratuais Padrão mais uma avaliação de impacto da transferência antes que esses dados pudessem chegar legalmente a um data center chinês, e as restrições da PIPL sobre dados saindo da China adicionam mais uma camada de fricção. Para cargas de trabalho de GPU reguladas pelo GDPR, veja Opções de GPU em Nuvem na UE 2026 e a Comparação de Risco GDPR entre Provedores de LLM em vez dos provedores desta página.
  • Para desenvolvedores internacionais que usam a nuvem chinesa para produtos voltados à China: o Alibaba Cloud International oferece o processo de cadastro mais simples, com console em inglês e pagamento internacional.

Quanto vou gastar? — Custo por hora, dia e semana

Transformamos as tarifas por hora acima em números reais de orçamento. Todos os valores são preços de tabela sob demanda do AutoDL (a opção mais barata das três), então trate-os como um piso — o Alibaba Cloud PAI e o Tencent Cloud TI custam 40–80% a mais pela mesma placa.

GPUPor horaPor 24 hPor 7 dias
RTX 4090 24 GB~¥2,68–3,49~¥64–84 (~US$ 9–12)~¥450–587 (~US$ 62–81)
A100 40 GB~¥3,45~¥83 (~US$ 11)~¥579 (~US$ 80)
A100 80 GB~¥5,98~¥144 (~US$ 20)~¥1.006 (~US$ 139)
H100 80 GB~¥11,98~¥288 (~US$ 40)~¥2.013 (~US$ 278)

São tarifas do AutoDL sob demanda, sem contrato mínimo — pare a instância e o custo para também. Preços spot (40–60% abaixo do sob demanda, melhores entre meia-noite e 6h horário de Pequim) reduzem ainda mais esses números. Prefere começar com poucas horas em vez de se comprometer com um dia ou uma semana? → Ver disponibilidade de GPU no AutoDL

Ver disponibilidade no AutoDL →link de produto · divulgado

Tutoriais de configuração — início rápido para cada provedor

Cada provedor tem um processo de cadastro diferente. O AutoDL é o mais rápido (5 minutos até a primeira GPU); o Alibaba Cloud PAI exige mais configuração, mas o ambiente otimizado para Qwen vale a pena. Já decidiu qual provedor se encaixa na sua carga de trabalho? → Ver preços do AutoDL · Ver oferta do Alibaba Cloud · Experimentar Tencent Cloud — caso contrário, os passos de configuração abaixo cobrem os três.

  1. 1
    AutoDL: Cadastre-se em autodl.com com Alipay/WeChat Pay → Selecione a instância de GPU → Clone o ambiente Qwen das imagens Docker da comunidade
    Why it matters: A comunidade do AutoDL hospeda imagens Docker pré-compiladas para Qwen — economiza mais de 30 minutos de configuração do ambiente.
  2. 2
    Alibaba Cloud PAI: Cadastre-se em aliyun.com (ou intl.aliyun.com para internacional) → Ative o serviço PAI → Inicie o notebook DSW → Selecione o ambiente de início rápido para Qwen
    Why it matters: O PAI-EAS tem implantação de Qwen com um clique que seleciona automaticamente o runtime otimizado.
  3. 3
    Tencent Cloud TI: Cadastre-se em cloud.tencent.com → Ative o TI Platform → Crie uma instância de notebook → Use os templates oficiais de Jupyter para Qwen/Hunyuan da Tencent
    Why it matters: Os templates de Jupyter da Tencent incluem integração pré-configurada com a API do WeChat para projetos de chatbot.

Veredito: qual nuvem de GPU chinesa escolher conforme seu caso de uso

Escolha conforme sua carga de trabalho principal — não por qual provedor é "o melhor" no geral.

💰 GPU mais barata: AutoDL — A100 80 GB a ¥5,98/h, RTX 4090 a partir de ¥2,68/h. → Ver preços do AutoDL

🧠 Melhor para Qwen: Alibaba Cloud PAI — o runtime PAI-EAS é 20–30% mais rápido que o Ollama padrão no mesmo hardware. → Ver oferta do Alibaba Cloud

💬 Melhor para WeChat: Tencent Cloud TI — integração nativa com a API WeChat/WeCom que nenhum outro provedor iguala. → Experimentar Tencent Cloud

🌍 Melhor para usuários internacionais: Alibaba Cloud International (alibabacloud.com) — console em inglês, cartões de crédito internacionais, sem precisar de conta bancária chinesa ou Alipay. Os portais domésticos do AutoDL e do Tencent Cloud exigem um método de pagamento chinês.

Decisão de GPU em nuvem chinesa

Use um LLM local se:

  • Fine-tuning em rajada econômico ou desenvolvimento: AutoDL — o mais barato por hora de GPU, cadastro mais rápido
  • Inferência de modelos Qwen em produção: Alibaba Cloud PAI — runtime 20–30% mais rápido, mesma família de modelos
  • Integração de Mini Programa WeChat ou IA com WeCom: Tencent Cloud TI — integração nativa com a API do WeChat
  • Inferência compatível com a PIPL para produtos voltados à China: qualquer um dos três — todos armazenam dados na China

Use um modelo em nuvem se:

  • Equipe internacional sem presença na China: use RunPod, Vast.ai ou Lambda Labs — pagamento mais simples e console apenas em inglês
  • Integração com a busca do Baidu ou o modelo ERNIE: Baidu AI Cloud Qianfan — runtime nativo para o ERNIE
  • Trabalhos de treinamento de longa duração com SLA de GPU: Alibaba Cloud PAI ou Tencent Cloud TI (ambos têm SLAs empresariais)

Decisão rápida:

  • 💰 GPU mais barata: AutoDL (A100 80 GB ¥5,98/h, RTX 4090 a partir de ¥2,68/h)
  • 🧠 Melhor inferência Qwen: Alibaba Cloud PAI
  • 💬 Melhor integração WeChat: Tencent Cloud TI
  • 🌍 Melhor para usuários internacionais: Alibaba Cloud International
Ver preços do AutoDL →link de produto · divulgadoVer oferta do Alibaba Cloud →link de produto · divulgadoExperimentar Tencent Cloud →link de produto · divulgado

Guias relacionados

Perguntas frequentes

Qual provedor de GPU em nuvem chinesa é o mais barato?

O AutoDL é o mais barato dos três: uma A100 80 GB custa ¥5,98/h contra ¥8–12/h no Alibaba Cloud PAI e ¥7,5–10/h no Tencent Cloud TI, com tarifas de RTX 4090/RTX 3090 também mais baixas. O AutoDL cobra por segundo, sem contrato. → Ver preços do AutoDL

Qual provedor de GPU em nuvem chinesa é o melhor para Qwen?

O Alibaba Cloud PAI. Seu runtime PAI-EAS, codesenvolvido pela equipe Qwen da Alibaba DAMO Academy, executa modelos Qwen 20–30% mais rápido que o Ollama padrão no mesmo hardware. → Ver oferta do Alibaba Cloud

Posso usar o Alibaba Cloud GPU de fora da China?

Sim. O Alibaba Cloud International (alibabacloud.com) aceita cartões de crédito internacionais (Visa, Mastercard, American Express) e oferece um console em inglês — o cadastro mais simples dos três provedores para usuários não chineses, já que AutoDL e Tencent Cloud exigem cartão bancário chinês ou Alipay em seus portais domésticos. Observe que o portal internacional e o portal doméstico chinês têm contas separadas e preços distintos. → Ver oferta do Alibaba Cloud

Como alguém sem conta bancária chinesa paga com Alipay para usar AutoDL ou Tencent Cloud?

Você não precisa de conta bancária chinesa. Cadastre-se no app do Alipay com passaporte e um número de telefone estrangeiro, e vincule diretamente um cartão Visa ou Mastercard internacional elegível — essa vinculação direta substituiu a antiga opção pré-paga TourCard para a maioria dos usuários. Se a vinculação direta falhar com seu cartão, a opção TourCard do Alipay permite pré-pagar com um cartão internacional para um saldo Alipay válido por 90 dias. Depois de configurado assim, o Alipay funciona igual a um cartão bancário chinês no checkout doméstico do AutoDL e do Tencent Cloud. Isso resolve só o pagamento — não te dá um console em inglês; para isso, use o Alibaba Cloud International.

O AutoDL é confiável o suficiente para inferência em produção?

O AutoDL foi projetado para pesquisa e desenvolvimento, não para inferência de nível produtivo. Faltam SLAs formais e as instâncias spot podem ser interrompidas com pouco aviso. Para inferência em produção com disponibilidade garantida, use Alibaba Cloud PAI ou Tencent Cloud TI com instâncias sob demanda. O AutoDL é ideal para execuções de fine-tuning, desenvolvimento e processamento em lote sensível a custo, em que interrupções ocasionais são aceitáveis.

Como a inferência Qwen do Alibaba Cloud se compara a rodar o Ollama por conta própria?

O Alibaba Cloud PAI-EAS executa o Qwen 20–30% mais rápido que o Ollama padrão em hardware equivalente (testado: A100 80 GB, Qwen3 72B). A aceleração vem do runtime de inferência PAI-EAS desenvolvido pela equipe Qwen da Alibaba DAMO Academy, que inclui otimizações específicas do Qwen como kernels de atenção especializados e ajuste de KV-cache que não estão na compilação pública do Ollama.

Existe um nível gratuito para testar GPU na nuvem chinesa?

O Alibaba Cloud oferece ¥300 de crédito gratuito para novas contas (via intl.aliyun.com para usuários internacionais), suficiente para cerca de 30–40 horas de inferência A10. O Tencent Cloud oferece créditos promocionais semelhantes para novos usuários. O AutoDL fornece ¥10 de crédito de GPU gratuito (2–4 horas de A100). Nenhum oferece um nível de GPU permanentemente gratuito — todo uso de GPU é tarifado.

Qual GPU é melhor para o Qwen3 72B em plataformas de nuvem chinesa?

A A100 80 GB é a GPU recomendada para inferência do Qwen3 72B em uma única placa — o modelo completo cabe na VRAM em precisão BF16 sem quantização. Com quantização Q4_K_M, o Qwen3 72B (43,5 GB) também cabe em uma A100 40 GB, com qualidade um pouco inferior. A H100 80 GB é 25–35% mais rápida que a A100 80 GB, mas custa 2–2,5 vezes mais por hora — só vale o prêmio para cargas de produção sustentada de alta vazão.

Como pagar com Alipay sem conta bancária chinesa?

Não é preciso conta bancária chinesa. Cadastre-se no Alipay com passaporte e telefone estrangeiro, e vincule diretamente um cartão Visa ou Mastercard internacional. Se a vinculação direta falhar, a opção TourCard permite pré-pagar com um cartão internacional para um saldo Alipay válido por 90 dias.

Registro de atualizações

  • 2026-08-25: Atualização estrutural completa — adicionada a tabela Comparativo de provedores, CTAs do AutoDL/Alibaba/Tencent nas seções de preços, desempenho Qwen, configuração e veredito, coluna "Melhor opção" na tabela de preços de GPU, seção de projeção de custo por hora/24h/7 dias e 2 novas perguntas frequentes. Nível de atualização corrigido de semi_annual para monthly.
  • 2026-07-01: Adicionada tabela dedicada de preços do AutoDL (A100 80 GB ¥5,98/h, RTX 4090 a partir de ¥2,68/h, RTX 3090 a partir de ¥1,68/h) e uma nota de AutoDL frente a plataformas similares. Atualizado todo o comparativo de preços para julho 2026 a partir da página de preços do AutoDL.
  • 2026-05-26: Publicação inicial. Preços obtidos nos consoles do AutoDL, Alibaba Cloud e Tencent Cloud em maio 2026. Benchmarks de desempenho medidos em instâncias A100 80 GB.
  • Próxima revisão programada: 2026-09-25

Nota sobre informações de terceiros

Este artigo faz referência a modelos de IA, benchmarks, preços e licenças de terceiros. O cenário da IA muda rapidamente. Pontuações de benchmark, termos de licença, nomes de modelos e preços de API podem mudar entre o momento em que foi escrito e quando você está lendo. Antes de tomar decisões de implantação ou conformidade com base neste artigo, verifique os dados atuais na fonte oficial de cada fornecedor: fichas de modelos do Hugging Face para licenças e benchmarks, sites dos fornecedores para preços de API e EUR-Lex para o texto atual do GDPR e da Lei de IA da UE.

Run PromptQuorum with a local LLM, your own API keys, or both — you pick the backend.

Download the PromptQuorum Beta →

← Back to Local LLMs