Skip to main content
PromptQuorum

Meilleur mini PC pour un serveur Ollama en continu (2026)

Meilleur mini PC pour un serveur Ollama en continu (2026)

Cette page contient des liens de référence vers des produits tiers. PromptQuorum n'est inscrit à aucun programme d'affiliation — ce sont de simples liens qui ne génèrent aucune commission. Cliquer sur les liens et vos prochaines étapes relèvent entièrement de votre responsabilité. Ces liens ne représentent aucune approbation ou vérification par PromptQuorum.

Hardware & PerformanceIntermédiaire

Points clés

  • Les mini PC consomment 15–45 W vs 200–350 W pour les GPU de bureau — économies significatives en 24/7
  • UM890 Pro fait tourner les modèles 7B en CPU seul à 12–18 tok/s — bien pour serveur API
  • AOOSTAR GEM12 Pro + eGPU OCuLink = accélération GPU sans PC de bureau
  • Mac Mini M4 Pro : 48 Go de mémoire unifiée pour les modèles 32B — meilleure option macOS
  • Beelink SER8 est le point d'entrée à moins de 400 € avec 32 Go pour 7B et 13B

Meilleurs mini PC pour serveur Ollama always-on — Classement

1

Minisforum UM890 Pro — Meilleur choix global

Le Minisforum UM890 Pro tourne avec l'AMD Ryzen 9 8945HS (8 cœurs, jusqu'à 5,2 GHz) et supporte jusqu'à 96 Go de DDR5-5600 double canal — assez pour charger Llama 3.3 70B en Q4 entièrement en RAM. L'iGPU Radeon 780M (12 CU RDNA3) accélère les modèles 7B et 13B à 8–14 tok/s via ROCm. CPU seul 7B Q4 : ~12–18 tok/s. Consommation au repos : ~15 W. Sous charge (GPU actif) : ~35–45 W. Prix : ~470 € (32 Go/1 To) à 570 € (64 Go).

Minisforum UM890 Pro sur Amazon.frlien produit · divulgué
2

AOOSTAR GEM12 Pro OCuLink — Meilleur pour eGPU

L'AOOSTAR GEM12 Pro OCuLink ajoute un port OCuLink qui connecte une GPU externe en PCIe 4.0 x4 (64 Gbps) — assez pour faire tourner une RTX 3090 à pleine vitesse avec Ollama. Sans eGPU : comme les autres mini PC, 13–18 tok/s en CPU seul. Avec eGPU RTX 3090 : 60–80 tok/s sur 7B Q4. Adaptateur OCuLink vers PCIe requis (~28 €). Prix nu : ~360 € ; avec 32 Go/1 To : ~450 €.

3

Beelink SER8 — Meilleur choix budget

Le Beelink SER8 tourne avec l'AMD Ryzen 7 8745HS (8 cœurs, jusqu'à 4,9 GHz), 32 Go de DDR5 et 1 To de NVMe pour ~420 €. Vitesse Ollama : ~10–15 tok/s sur 7B Q4. Consommation au repos : 10–15 W. RAM évolutive (non soudée sur la révision 8745HS actuelle). Idéal pour débuter avec Ollama always-on sans dépenser 500+ €.

Beelink SER8 sur Amazon.frlien produit · divulgué
4

Apple Mac Mini M4 Pro — Meilleur pour macOS

Le Mac Mini M4 Pro (GPU 24 cœurs, 48 Go de mémoire unifiée, ~1399 €) est le seul mini PC à faire tourner les modèles 32B à vitesse GPU de série. Ollama sur Apple Silicon utilise Metal — les 48 Go de mémoire unifiée chargent Qwen3 32B Q4 (~18 Go) à 20–30 tok/s. Consommation : 18–30 W sous Ollama. Idéal pour les utilisateurs macOS qui veulent un serveur maison silencieux.

Apple Mac Mini M4 Pro sur Amazon.frlien produit · divulgué

Quick Answers

Un mini PC peut-il faire tourner des modèles 13B ou plus à vitesse utile ?
Oui, avec assez de RAM. L'UM890 Pro avec 64 Go fait tourner Llama 3.3 13B Q8 entièrement en RAM à ~8–12 tok/s en CPU seul, et 10–18 tok/s avec l'iGPU Radeon 780M. Pour les modèles 30B+, le Mac Mini M4 Pro (48 Go) est la seule option mini PC sous 1500 €.
Ollama fonctionne-t-il bien comme serveur réseau sur un mini PC ?
Oui. Définissez OLLAMA_HOST=0.0.0.0 et Ollama répond aux requêtes de tous les appareils du LAN. Avec Open WebUI (Docker), vous avez une interface navigateur pour téléphones, tablettes et PC. Gère une requête simultanée sans problème.

Vous voulez les détails complets ?

Lire le guide complet →