Principais conclusões
- O Foundry Local é a ferramenta de inferência de IA no dispositivo da Microsoft; código-fonte em github.com/microsoft/Foundry-Local, site do projeto foundrylocal.ai
- SDKs nativos para C#, JavaScript, Rust e Python, além de detecção automática de aceleração por hardware que escolhe o provedor de execução ideal — NPU, GPU ou CPU — conforme o dispositivo
- Funciona em Windows, macOS (Apple Silicon) e Linux, segundo o README oficial; os leitores devem verificar diretamente o repositório oficial para a cobertura completa de plataformas em qualquer classe específica de dispositivo
- Pacote leve, cerca de 20 MB
- A licença é dividida: o SDK tem licença MIT, enquanto a CLI é distribuída sob os próprios termos de licença de software proprietários da Microsoft — um produto não totalmente de código aberto
- Distinto do Azure AI Foundry: o Foundry Local roda no dispositivo e não exige uma assinatura do Azure para uso apenas local, enquanto o Azure AI Foundry é a plataforma em nuvem separada da Microsoft para criar e implantar IA em escala; os dois são projetados para interoperar em fluxos de trabalho híbridos
- O catálogo de modelos selecionado inclui famílias como Qwen, DeepSeek, Mistral, Phi e GPT-OSS, além do Whisper para transcrição de áudio — cada modelo baixado tem seus próprios termos de licença separados
- Expõe uma API compatível com a OpenAI (incluindo os formatos de solicitação/resposta da OpenAI Responses API) por meio de um servidor web local, e usa o ONNX Runtime para a inferência
- O repositório no GitHub mostra 2.541 estrelas, verificado em github.com/microsoft/Foundry-Local em 5 de setembro de 2026
📍 Em uma frase
O Foundry Local é a ferramenta de inferência de IA no dispositivo da Microsoft — SDKs nativos para C#, JavaScript, Rust e Python, detecção automática de aceleração por hardware e um catálogo de modelos selecionado — e é um produto separado do Azure AI Foundry, a plataforma em nuvem.
💬 Em termos simples
O Foundry Local permite que um desenvolvedor crie um aplicativo que roda modelos de IA diretamente na máquina Windows, Mac ou Linux de um usuário, escolhendo automaticamente o chip (NPU, GPU ou CPU) mais rápido naquele dispositivo específico, sem precisar de uma conta em nuvem para uso local. Não é a mesma coisa que o Azure AI Foundry, a plataforma em nuvem da Microsoft — os dois podem trabalhar juntos, mas o objetivo inteiro do Foundry Local é rodar offline, no dispositivo.
📌Nota: Esta review é o complemento aprofundado da entrada do Foundry Local no Local LLM Software Directory — veja essa página para comparar o Foundry Local rapidamente com dezenas de outras ferramentas de IA local.
O que é o Foundry Local?
O Foundry Local é a ferramenta de inferência de IA no dispositivo da Microsoft — uma solução de IA local de ponta a ponta para criar aplicativos que rodam inteiramente no dispositivo do usuário. Seu repositório no GitHub o descreve como reunindo SDKs nativos, aceleração por hardware automática e um catálogo de modelos selecionado em um pacote leve, voltado a desenvolvedores cuja inferência precisa acontecer no próprio dispositivo, não em um servidor remoto.
- Função principal: executar a inferência de modelos de IA localmente em um dispositivo, com o runtime detectando e usando automaticamente a melhor aceleração por hardware disponível
- SDKs nativos: C#, JavaScript, Rust e Python, para que desenvolvedores integrem a inferência local em aplicativos escritos em cada uma dessas linguagens sem um wrapper separado
- Detecção automática de aceleração por hardware: o runtime escolhe o provedor de execução ideal — NPU, GPU ou CPU — para o dispositivo em que roda, em vez de exigir que o desenvolvedor fixe essa escolha no código
- Catálogo de modelos: um conjunto selecionado de modelos, não um sistema de upload aberto e irrestrito
- Desenvolvedor: Microsoft; a organização no GitHub que hospeda o código é microsoft
- Repositório canônico: github.com/microsoft/Foundry-Local; site do projeto: foundrylocal.ai
Foundry Local vs. Azure AI Foundry
Esta é a distinção mais importante sobre o Foundry Local: o Foundry Local não é o mesmo produto que o Azure AI Foundry, a plataforma em nuvem da Microsoft para criar e implantar IA em escala. Segundo o próprio posicionamento da Microsoft, o Foundry Local é "a pilha de runtime de IA local de alto desempenho que leva o poder do Azure AI Foundry aos dispositivos cliente" — uma frase que sinaliza uma relação deliberada entre os dois, não produtos idênticos.
Onde a inferência roda
- Foundry Local:
- Inteiramente no próprio dispositivo do usuário
- Azure AI Foundry:
- A infraestrutura em nuvem da Microsoft
Conta do Azure necessária
- Foundry Local:
- Não, para uso apenas local
- Azure AI Foundry:
- Sim, é um serviço de nuvem do Azure
Capacidade offline
- Foundry Local:
- Sim, depois que os modelos são baixados
- Azure AI Foundry:
- Não, é uma plataforma em nuvem hospedada
Objetivo principal
- Foundry Local:
- Inferência no dispositivo para aplicativos cliente
- Azure AI Foundry:
- Criar e implantar soluções de IA em escala de nuvem
Os dois produtos são projetados para interoperar em fluxos de trabalho híbridos — um desenvolvedor pode prototipar e testar localmente com o Foundry Local e depois escalar uma carga de trabalho para os endpoints em nuvem do Azure AI Foundry quando precisar de mais capacidade do que um único dispositivo pode oferecer —, mas continuam sendo produtos separados, e o Foundry Local não exige uma assinatura do Azure para uso apenas local. Não assuma que os dois nomes se referem à mesma coisa, nem que instalar o Foundry Local cria alguma dependência de uma conta do Azure.
Marcos do Foundry Local
A Microsoft lançou o Foundry Local como contraparte no dispositivo de sua plataforma mais ampla Azure AI Foundry, voltada a desenvolvedores cuja inferência precisa rodar em hardware cliente em vez de na nuvem.
- 1Lançamento inicial — ferramenta de inferência no dispositivo
Why it matters: O Foundry Local foi lançado posicionado especificamente como a contraparte local, no dispositivo cliente, do Azure AI Foundry, e não como um produto independente sem relação com a estratégia de IA em nuvem da Microsoft. - 2Em andamento — expansão dos SDKs nativos (C#, JavaScript, Rust, Python)
Why it matters: Vários SDKs nativos significam que desenvolvedores em diferentes ecossistemas de linguagens podem integrar a inferência no dispositivo sem escrever seus próprios bindings em torno de uma única implementação de referência. - 3Em andamento — ONNX Runtime como mecanismo de inferência
Why it matters: Construir sobre o ONNX Runtime, em vez de um mecanismo de inferência específico do projeto, permite ao Foundry Local se beneficiar do próprio ecossistema de aceleração por hardware e provedores de execução do ONNX Runtime. - 4Em andamento — expansão do catálogo de modelos selecionado
Why it matters: O catálogo cresceu para incluir famílias de modelos como Qwen, DeepSeek, Mistral, Phi e GPT-OSS, além do Whisper para transcrição de áudio, ampliando o que um desenvolvedor pode rodar localmente pela mesma superfície de SDK. - 5Em andamento — superfície de API compatível com a OpenAI
Why it matters: Expor uma API compatível com a OpenAI, incluindo os formatos de solicitação/resposta da OpenAI Responses API, reduz o custo de integração para aplicativos já construídos contra essa forma de API.
O que você pode fazer com o Foundry Local?
O conjunto de recursos do Foundry Local se concentra em facilitar a integração da inferência no dispositivo para um desenvolvedor, segundo seu README no GitHub.
- SDKs nativos — SDKs de C#, JavaScript, Rust e Python para integrar a inferência local diretamente em aplicativos escritos em cada linguagem
- Detecção automática de aceleração por hardware — o runtime escolhe o provedor de execução ideal (NPU, GPU ou CPU) conforme o dispositivo, sem exigir que o desenvolvedor detecte e configure isso manualmente
- Catálogo de modelos selecionado — famílias de modelos como Qwen, DeepSeek, Mistral, Phi e GPT-OSS, além do Whisper para transcrição de áudio; o catálogo é selecionado, não um sistema de upload aberto, e cada modelo tem seus próprios termos de licença separados
- API compatível com a OpenAI — um servidor web local que suporta formatos de solicitação e resposta da OpenAI, incluindo o formato da OpenAI Responses API, para aplicativos já integrados a essa forma de API
- Inferência com ONNX Runtime — os modelos rodam via ONNX Runtime, que gerencia a execução real no caminho de aceleração por hardware detectado
- Pegada leve — uma instalação de cerca de 20 MB para o runtime em si, com os modelos baixados separadamente do catálogo
- CLI para gerenciamento de modelos — comandos como
foundry model run <model-name>efoundry model listpara executar e listar modelos a partir de um terminal - Suporte multiplataforma — Windows, macOS (Apple Silicon) e Linux, segundo o README oficial
Exemplos de uso: três formas de usar o Foundry Local
Estes são fluxos de trabalho construídos a partir da CLI e dos SDKs documentados do Foundry Local acima — não casos de uso hipotéticos.
Instalação e primeiros passos
O Foundry Local é uma ferramenta de desenvolvimento de CLI e SDK, não um único aplicativo de consumidor com botões de download por sistema operacional, portanto a instalação acontece via GitHub Releases e gerenciadores de pacotes de cada linguagem, não por um instalador assinado a partir de uma página de marketing.
- 1Baixe o instalador da CLI para sua plataforma em GitHub Releases — as tags de versão seguem um padrão como
cli-preview-0.10.0; verifique diretamente a página de Releases para a versão atual em vez de assumir um número específico. - 2Para desenvolvimento em Python, instale o SDK do PyPI:
pip install foundry-local-sdk. - 3Para desenvolvimento em JavaScript/Node, instale o SDK do npm:
npm install foundry-local-sdk. - 4Execute um modelo do catálogo para confirmar que a instalação funciona:
foundry model run qwen2.5-0.5b. - 5Liste os modelos disponíveis a qualquer momento com
foundry model list. - 6Em hardware compatível, a detecção automática de aceleração por hardware do Foundry Local escolhe NPU, GPU ou CPU por você; nenhuma configuração manual do provedor de execução é necessária para o caminho padrão.
Preços e licenciamento do Foundry Local
O Foundry Local é gratuito para instalar e usar, sem necessidade de assinatura para inferência apenas local. No entanto, o licenciamento é mais sutil do que um único termo geral: o SDK tem licença MIT, enquanto a CLI é distribuída sob os próprios termos de licença de software proprietários da Microsoft — confirmado pelo próprio arquivo LICENSE do projeto. Não é correto descrever o produto inteiro como "código aberto" ou totalmente "licenciado sob MIT".
Foundry Local vs. Ollama
O Foundry Local e o Ollama são comparados porque ambos permitem que um desenvolvedor execute modelos localmente por meio de uma CLI e uma API — a diferença real para um leitor decidindo entre os dois está no mecanismo de inferência por trás e em qual ecossistema (os SDKs da Microsoft vs. um runtime agnóstico de hardware baseado em llama.cpp) se encaixa melhor no aplicativo-alvo.
Objetivo principal
- Foundry Local:
- Ferramenta de inferência no dispositivo com SDKs nativos para criar aplicativos
- Ollama:
- Runtime local de modelos e API de uso geral
Mecanismo de inferência
- Foundry Local:
- ONNX Runtime, com seleção automática de NPU/GPU/CPU conforme o dispositivo
- Ollama:
- Mecanismo embutido baseado em llama.cpp
SDKs nativos
- Foundry Local:
- C#, JavaScript, Rust, Python
- Ollama:
- Sem SDKs próprios; existem bibliotecas da comunidade para várias linguagens
Catálogo de modelos
- Foundry Local:
- Catálogo selecionado (Qwen, DeepSeek, Mistral, Phi, GPT-OSS, Whisper)
- Ollama:
- Biblioteca de modelos grande e amplamente aberta
Licença
- Foundry Local:
- Dupla: o SDK é MIT, a CLI segue os termos de licença proprietários da Microsoft
- Ollama:
- MIT (código aberto)
Plataformas
- Foundry Local:
- Windows, macOS (Apple Silicon), Linux, segundo o README oficial
- Ollama:
- Roda em qualquer máquina Mac, Windows ou Linux
Se um desenvolvedor quiser especificamente uma seleção automática de aceleração por hardware entre NPU, GPU e CPU com SDKs nativos de C#, JavaScript, Rust ou Python — por exemplo, para criar um aplicativo cliente para Windows ou multiplataforma —, o design do Foundry Local se encaixa diretamente nesse caso de uso. Se um desenvolvedor quiser a biblioteca de modelos mais ampla e um runtime totalmente de código aberto, o fluxo de trabalho do Ollama é a opção mais direta. Veja a review completa do Ollama para mais detalhes.
Quem deveria usar o Foundry Local?
Se vale a pena adotar o Foundry Local depende principalmente de você estar construindo um aplicativo (em vez de apenas querer uma interface de chat) e se as linguagens de SDK da Microsoft e sua abordagem de aceleração por hardware combinam com seu projeto.
Foundry Local vs. outras ferramentas de IA local
O Foundry Local está no segmento de runtimes e gerenciadores, ao lado de outras ferramentas que executam modelos localmente por meio de uma CLI ou API. Veja o Local LLM Software Directory para o catálogo completo.
- Ollama — um runtime local de modelos e API de uso geral baseado em llama.cpp, totalmente licenciado sob MIT, com uma biblioteca de modelos maior e mais aberta e sem exigência de SDK específico da Microsoft. A opção mais direta se você quiser a maior compatibilidade de hardware e escolha de modelos em vez de SDKs nativos de C#/JavaScript/Rust/Python. Veja a review completa do Ollama.
- LM Studio — um aplicativo de desktop focado em interface gráfica para inferência local, com um navegador de modelos embutido e um recurso de chat com documentos, voltado a usuários finais em vez de desenvolvedores integrando um SDK. Uma opção mais próxima do que o Foundry Local se você quiser um aplicativo gráfico polido em vez de uma ferramenta de desenvolvimento de CLI e SDK. Veja a review completa do LM Studio.
- Docker Model Runner — um recurso de CLI e API incluído no Docker Desktop/Engine para desenvolvedores que já trabalham em um fluxo baseado em Docker, outra opção a comparar com a abordagem de SDK nativo do Foundry Local se sua stack for centrada em contêineres. Veja a review completa do Docker Model Runner.
Erros comuns ao avaliar o Foundry Local
A maior parte da confusão sobre o Foundry Local vem de confundi-lo com o Azure AI Foundry, ou de assumir que o produto inteiro é de código aberto.
Perguntas frequentes
O que é o Foundry Local?
O Foundry Local (github.com/microsoft/Foundry-Local) é a ferramenta de inferência de IA no dispositivo da Microsoft — uma solução de IA local de ponta a ponta para criar aplicativos que rodam inteiramente no dispositivo do usuário, com SDKs nativos para C#, JavaScript, Rust e Python.
O Foundry Local é a mesma coisa que o Azure AI Foundry?
Não. O Foundry Local é um produto separado, no dispositivo, que roda inteiramente no dispositivo de um usuário sem exigir uma assinatura do Azure para uso apenas local. O Azure AI Foundry é a plataforma em nuvem da Microsoft para criar e implantar IA em escala. Os dois são projetados para interoperar em fluxos de trabalho híbridos, mas não são o mesmo produto.
O Foundry Local é de código aberto?
Parcialmente. O SDK tem licença MIT, mas a CLI é distribuída sob os próprios termos de licença de software proprietários da Microsoft, segundo o arquivo LICENSE do projeto. Não é correto chamar o produto inteiro de código aberto.
O Foundry Local é gratuito?
Sim, o Foundry Local em si é gratuito para instalar e usar em inferência exclusivamente local, sem necessidade de assinatura. Modelos individuais baixados têm seus próprios termos de licença separados, e qualquer uso do Azure AI Foundry junto com ele em um fluxo de trabalho híbrido gera a cobrança separada do Azure.
Como instalo o Foundry Local?
Baixe o instalador da CLI em GitHub Releases, instale o SDK do Python com pip install foundry-local-sdk, ou instale o SDK de JavaScript/Node com npm install foundry-local-sdk.
Quais plataformas o Foundry Local suporta?
Windows, macOS (Apple Silicon) e Linux, segundo o README oficial. Verifique diretamente o repositório oficial para a cobertura completa de plataformas e dispositivos antes de assumir que uma classe específica de dispositivo é suportada.
Quais modelos estão disponíveis no catálogo do Foundry Local?
O catálogo é selecionado e inclui famílias de modelos como Qwen, DeepSeek, Mistral, Phi e GPT-OSS, além do Whisper para transcrição de áudio. Cada modelo tem seus próprios termos de licença separados.
O Foundry Local expõe uma API compatível com a OpenAI?
Sim. O Foundry Local fornece um servidor web local que suporta formatos de solicitação e resposta da OpenAI, incluindo o formato da OpenAI Responses API, para que aplicativos construídos contra essa forma de API possam se integrar com mudanças mínimas.
Qual mecanismo de inferência o Foundry Local usa?
O Foundry Local usa o ONNX Runtime para a inferência, com detecção automática de aceleração por hardware que escolhe o provedor de execução ideal — NPU, GPU ou CPU — conforme o dispositivo.
Quantas estrelas no GitHub o Foundry Local tem?
O repositório do Foundry Local (github.com/microsoft/Foundry-Local) mostrava 2.541 estrelas em 5 de setembro de 2026, segundo a verificação do diretório deste site. Verifique o repositório diretamente para uma contagem atual, já que ela muda com o tempo.
