Key Takeaways
- GLM-5.2 (jun 2026): modelo open-weights nº1 no Artificial Analysis Intelligence Index v4.1 (51 pts, 4º geral); licença MIT. Ainda não está na biblioteca do Ollama.
- Qwen3.6 27B (jun 2026): 84% MMLU, contexto de 262K, 201 idiomas -- sucessor do Qwen3. `ollama pull batiai/qwen3.6-27b:q4`.
- Gemma 4 26B-A4B e Gemma 4 E2B (jun 2026): substituem o Gemma 3; a variante E2B roda com ~2 GB de RAM em um Raspberry Pi 5. `ollama pull gemma4:26b`.
- Llama 3.3 70B (dez 2025): disponível via `ollama pull llama3.3:70b`. Melhor modelo open-weight de propósito geral.
- Qwen3 32B (set 2025): excelente para código e multilíngue. `ollama pull qwen3:32b`.
- DeepSeek-R1 (jan 2025): raciocínio passo a passo. `ollama pull deepseek-r1:14b`.
- Gemma 3 (fev 2026): eficiente, bom para hardware com 8 GB de VRAM.
- Phi-4 Mini (dez 2024): leve, excelente desempenho em hardware de baixo custo.
Esta página rastreia todos os principais lançamentos de LLM local de código aberto com suas especificações principais, pontuações de benchmark e disponibilidade no Ollama, organizados por trimestre para que você veja o que foi lançado e quando.
Novos modelos de IA local surgem o tempo todo, e é difícil saber quais são realmente novos e quais são apenas reedições. Esta página é um registro contínuo: cada entrada mostra o modelo, quando foi lançado e se já está disponível no Ollama, para que você possa verificar rapidamente se está perdendo algo que vale a pena experimentar.
Quais modelos LLM locais foram lançados no T2–T3 2026?
A partir de julho de 2026, três lançamentos superaram a onda do T1 2026 e agora definem o estado da arte para modelos executáveis localmente. Veja Melhores LLMs locais 2026 para o ranking completo atual e GLM-5.2: Open-Weights na Fronteira para uma análise aprofundada do GLM-5.2.
| Modelo | Lançamento | Desenvolvedor | Característica principal | Ollama |
|---|---|---|---|---|
| GLM-5.2 | Junho 2026 | Z.ai | Modelo open-weights mais bem classificado no Artificial Analysis Intelligence Index v4.1 (51 pts, nº1 open, 4º geral); licença MIT; ~744B de parâmetros | Ainda não está na biblioteca do Ollama -- requer API hospedada ou quantização GGUF da comunidade |
| Qwen3.6 27B | Junho 2026 | Alibaba | 84% MMLU, contexto de 262K, 201 idiomas -- sucessor do Qwen3; superado pelo Qwen3.8-27B em agosto de 2026 | ollama pull batiai/qwen3.6-27b:q4 |
| Gemma 4 26B-A4B | Junho 2026 | Arquitetura MoE (26B total, ~4B ativos), 89% AIME 2026 -- sucessor do Gemma 3 | ollama pull gemma4:26b | |
| Gemma 4 E2B | Junho 2026 | 2,3B de parâmetros efetivos, ~2 GB de RAM, contexto de 128K, roda em um Raspberry Pi 5 | ollama pull gemma4:e2b |