Skip to main content
PromptQuorum
Início/LLMs locais/Atualizações de modelos LLM locais 2026: Todos os grandes lançamentos open-weight do ano
Best Models

Atualizações de modelos LLM locais 2026: Todos os grandes lançamentos open-weight do ano

·8 min de leitura·By Hans Kuepper · Founder of PromptQuorum, multi-model AI dispatch tool · PromptQuorum

A partir de julho de 2026, os maiores lançamentos de LLM local são: Google Gemma 4, Alibaba Qwen3.6, Z.ai GLM-5.2, Meta Llama 3.3 70B, DeepSeek-R1 e as famílias Qwen3/Qwen3-Coder. Todos disponíveis via Ollama e LM Studio.

A partir de julho de 2026, os maiores lançamentos de LLM local do ano são: Google Gemma 4 (junho de 2026), Alibaba Qwen3.6 (junho de 2026), Z.ai GLM-5.2 (junho de 2026), Meta Llama 3.3 70B (dezembro de 2025), DeepSeek-R1 (janeiro de 2025), famílias Qwen3 e Qwen3-Coder (setembro de 2025), Microsoft Phi-4 (dezembro de 2024) e Google Gemma 3 (fevereiro de 2026). Este artigo rastreia todos os grandes lançamentos de modelos com suas especificações principais e disponibilidade no Ollama.

Key Takeaways

  • GLM-5.2 (jun 2026): modelo open-weights nº1 no Artificial Analysis Intelligence Index v4.1 (51 pts, 4º geral); licença MIT. Ainda não está na biblioteca do Ollama.
  • Qwen3.6 27B (jun 2026): 84% MMLU, contexto de 262K, 201 idiomas -- sucessor do Qwen3. `ollama pull batiai/qwen3.6-27b:q4`.
  • Gemma 4 26B-A4B e Gemma 4 E2B (jun 2026): substituem o Gemma 3; a variante E2B roda com ~2 GB de RAM em um Raspberry Pi 5. `ollama pull gemma4:26b`.
  • Llama 3.3 70B (dez 2025): disponível via `ollama pull llama3.3:70b`. Melhor modelo open-weight de propósito geral.
  • Qwen3 32B (set 2025): excelente para código e multilíngue. `ollama pull qwen3:32b`.
  • DeepSeek-R1 (jan 2025): raciocínio passo a passo. `ollama pull deepseek-r1:14b`.
  • Gemma 3 (fev 2026): eficiente, bom para hardware com 8 GB de VRAM.
  • Phi-4 Mini (dez 2024): leve, excelente desempenho em hardware de baixo custo.

Esta página rastreia todos os principais lançamentos de LLM local de código aberto com suas especificações principais, pontuações de benchmark e disponibilidade no Ollama, organizados por trimestre para que você veja o que foi lançado e quando.

Novos modelos de IA local surgem o tempo todo, e é difícil saber quais são realmente novos e quais são apenas reedições. Esta página é um registro contínuo: cada entrada mostra o modelo, quando foi lançado e se já está disponível no Ollama, para que você possa verificar rapidamente se está perdendo algo que vale a pena experimentar.

Quais modelos LLM locais foram lançados no T2–T3 2026?

A partir de julho de 2026, três lançamentos superaram a onda do T1 2026 e agora definem o estado da arte para modelos executáveis localmente. Veja Melhores LLMs locais 2026 para o ranking completo atual e GLM-5.2: Open-Weights na Fronteira para uma análise aprofundada do GLM-5.2.

ModeloLançamentoDesenvolvedorCaracterística principalOllama
GLM-5.2Junho 2026Z.aiModelo open-weights mais bem classificado no Artificial Analysis Intelligence Index v4.1 (51 pts, nº1 open, 4º geral); licença MIT; ~744B de parâmetrosAinda não está na biblioteca do Ollama -- requer API hospedada ou quantização GGUF da comunidade
Qwen3.6 27BJunho 2026Alibaba84% MMLU, contexto de 262K, 201 idiomas -- sucessor do Qwen3; superado pelo Qwen3.8-27B em agosto de 2026ollama pull batiai/qwen3.6-27b:q4
Gemma 4 26B-A4BJunho 2026GoogleArquitetura MoE (26B total, ~4B ativos), 89% AIME 2026 -- sucessor do Gemma 3ollama pull gemma4:26b
Gemma 4 E2BJunho 2026Google2,3B de parâmetros efetivos, ~2 GB de RAM, contexto de 128K, roda em um Raspberry Pi 5ollama pull gemma4:e2b

Nota sobre informações de terceiros

Este artigo faz referência a modelos de IA, benchmarks, preços e licenças de terceiros. O cenário da IA muda rapidamente. Pontuações de benchmark, termos de licença, nomes de modelos e preços de API podem mudar entre o momento em que foi escrito e quando você está lendo. Antes de tomar decisões de implantação ou conformidade com base neste artigo, verifique os dados atuais na fonte oficial de cada fornecedor: fichas de modelos do Hugging Face para licenças e benchmarks, sites dos fornecedores para preços de API e EUR-Lex para o texto atual do GDPR e da Lei de IA da UE.

Run PromptQuorum with a local LLM, your own API keys, or both — you pick the backend.

Download the PromptQuorum Beta →

← Back to Local LLMs