Meilleur mini PC pour un serveur Ollama en continu (2026)

Cette page contient des liens de référence vers des produits tiers. PromptQuorum n'est inscrit à aucun programme d'affiliation — ce sont de simples liens qui ne génèrent aucune commission. Cliquer sur les liens et vos prochaines étapes relèvent entièrement de votre responsabilité. Ces liens ne représentent aucune approbation ou vérification par PromptQuorum.
Points clés
- ✓Les mini PC consomment 15–45 W vs 200–350 W pour les GPU de bureau — économies significatives en 24/7
- ✓UM890 Pro fait tourner les modèles 7B en CPU seul à 12–18 tok/s — bien pour serveur API
- ✓AOOSTAR GEM12 Pro + eGPU OCuLink = accélération GPU sans PC de bureau
- ✓Mac Mini M4 Pro : 48 Go de mémoire unifiée pour les modèles 32B — meilleure option macOS
- ✓Beelink SER8 est le point d'entrée à moins de 400 € avec 32 Go pour 7B et 13B
Meilleurs mini PC pour serveur Ollama always-on — Classement
Minisforum UM890 Pro — Meilleur choix global
Le Minisforum UM890 Pro tourne avec l'AMD Ryzen 9 8945HS (8 cœurs, jusqu'à 5,2 GHz) et supporte jusqu'à 96 Go de DDR5-5600 double canal — assez pour charger Llama 3.3 70B en Q4 entièrement en RAM. L'iGPU Radeon 780M (12 CU RDNA3) accélère les modèles 7B et 13B à 8–14 tok/s via ROCm. CPU seul 7B Q4 : ~12–18 tok/s. Consommation au repos : ~15 W. Sous charge (GPU actif) : ~35–45 W. Prix : ~470 € (32 Go/1 To) à 570 € (64 Go).
AOOSTAR GEM12 Pro OCuLink — Meilleur pour eGPU
L'AOOSTAR GEM12 Pro OCuLink ajoute un port OCuLink qui connecte une GPU externe en PCIe 4.0 x4 (64 Gbps) — assez pour faire tourner une RTX 3090 à pleine vitesse avec Ollama. Sans eGPU : comme les autres mini PC, 13–18 tok/s en CPU seul. Avec eGPU RTX 3090 : 60–80 tok/s sur 7B Q4. Adaptateur OCuLink vers PCIe requis (~28 €). Prix nu : ~360 € ; avec 32 Go/1 To : ~450 €.
Beelink SER8 — Meilleur choix budget
Le Beelink SER8 tourne avec l'AMD Ryzen 7 8745HS (8 cœurs, jusqu'à 4,9 GHz), 32 Go de DDR5 et 1 To de NVMe pour ~420 €. Vitesse Ollama : ~10–15 tok/s sur 7B Q4. Consommation au repos : 10–15 W. RAM évolutive (non soudée sur la révision 8745HS actuelle). Idéal pour débuter avec Ollama always-on sans dépenser 500+ €.
Apple Mac Mini M4 Pro — Meilleur pour macOS
Le Mac Mini M4 Pro (GPU 24 cœurs, 48 Go de mémoire unifiée, ~1399 €) est le seul mini PC à faire tourner les modèles 32B à vitesse GPU de série. Ollama sur Apple Silicon utilise Metal — les 48 Go de mémoire unifiée chargent Qwen3 32B Q4 (~18 Go) à 20–30 tok/s. Consommation : 18–30 W sous Ollama. Idéal pour les utilisateurs macOS qui veulent un serveur maison silencieux.
Quick Answers
Un mini PC peut-il faire tourner des modèles 13B ou plus à vitesse utile ?▾
Ollama fonctionne-t-il bien comme serveur réseau sur un mini PC ?▾
Vous voulez les détails complets ?
Lire le guide complet →