¿Mejor SSD para cargar modelos rápido en 2026?

Esta página contiene enlaces de referencia a productos de terceros. PromptQuorum no participa en ningún programa de afiliados — son enlaces simples que no generan comisión. Hacer clic en los enlaces y los pasos siguientes son de su entera responsabilidad. Estos enlaces no representan ningún respaldo ni verificación por parte de PromptQuorum.
Respuesta rápida
Un NVMe PCIe Gen4 de 2 TB, como el Samsung 990 Pro, carga un modelo 7B en cerca de un segundo gracias a su velocidad de lectura secuencial nominal de ~7.450 MB/s. El WD Black SN850X 2 TB rinde casi igual — compra el que salga más barato en un vendedor de confianza, ya que los precios de SSD han variado mucho en 2026.
- ▸Un NVMe Gen4 de 2 TB carga un modelo 7B en cerca de un segundo y un modelo 14B en pocos segundos — 7-10 veces más rápido que un SSD SATA.
- ▸La velocidad del SSD solo cambia el tiempo de carga y cambio de modelo. No cambia los tokens por segundo una vez que el modelo está en marcha — eso es cuestión de GPU/VRAM.
- ▸Coloca la carpeta de modelos de Ollama o LM Studio en el NVMe, no en la unidad del sistema operativo, para aprovechar todo el beneficio.
Puntos clave
- ✓Mejor opción: Samsung 990 Pro 2 TB (PCIe Gen4 NVMe). Mejor alternativa: WD Black SN850X 2 TB — compra el que salga más barato en un vendedor de confianza
- ✓El dato más importante de esta página: un SSD más rápido acelera la carga y el cambio de modelos, no la generación de texto — los tokens por segundo dependen de la GPU y el ancho de banda de memoria, no del almacenamiento
- ✓2 TB es el mínimo práctico en cuanto tienes más de dos o tres modelos cuantizados en disco
- ✓No compres una unidad PCIe Gen5 solo para la carga de LLM — la ganancia real frente a Gen4 es menor de lo que sugieren las cifras de la ficha técnica, salvo que ya cueste lo mismo que una unidad Gen4
Mejor opción: Samsung 990 Pro 2 TB (PCIe Gen4 NVMe)
El Samsung 990 Pro 2 TB es el mejor SSD para carga rápida de modelos LLM: su lectura secuencial nominal de ~7.450 MB/s carga un modelo 14B Q4 (~9 GB) en RAM en pocos segundos, frente a 15+ segundos en un SSD SATA y más de un minuto en un disco duro. Si el Samsung sale notablemente más caro al comparar precios, elige el WD Black SN850X 2 TB en su lugar — ambos son unidades PCIe Gen4 con un rendimiento práctico casi idéntico para este uso.
PCIe Gen4 NVMe es el punto óptimo para la mayoría de configuraciones. Si tu placa base tiene un slot PCIe 5.0 M.2 (Intel serie 700, AMD X670E/B650E o más nueva) y una unidad Gen5 como el Samsung 9100 Pro cuesta igual o menos que una Gen4 — algo que ha pasado repetidamente en 2026 dada la volatilidad de los precios de SSD —, es una buena compra. No cambies de placa base solo para tener Gen5 en la carga de LLM: la ganancia real de tiempo frente a Gen4 es menor de lo que sugieren las cifras de lectura secuencial.
Compra 2 TB o más. Unos pocos modelos cuantizados (7B, 8B, 13B, 14B en varias cuantizaciones) llenan 1 TB rápido. 2 TB dejan espacio para el sistema operativo, frameworks y una docena de modelos sin tener que borrar y volver a descargar constantemente. Para una biblioteca de modelos más grande, consulta nuestra guía de NAS y almacenamiento más abajo, con opciones de 4 TB+ y almacenamiento en red.
Velocidad del SSD vs. velocidad de inferencia: qué cambia realmente
Una vez que un modelo está cargado en RAM o VRAM, el SSD prácticamente no tiene nada que ver con los tokens por segundo. Un SSD más rápido acelera tres cosas: el primer arranque de un modelo, el cambio entre modelos y la copia o descarga de archivos de modelo.
No acelera la generación de texto, la inferencia de la GPU ni los tokens por segundo — eso depende de la GPU, la VRAM y el ancho de banda de memoria. Comprar un SSD más rápido esperando una generación más veloz es el error más común sobre este tema. Si lo que buscas son más tokens por segundo, la compra correcta es una GPU, no almacenamiento.
Tipos de SSD comparados para carga de modelos LLM
La velocidad de lectura secuencial es la única característica que importa para la carga de modelos. La tabla muestra cuánto tarda aproximadamente cada tipo de unidad en cargar un modelo 14B Q4 (~9 GB) de disco a RAM, calculado a partir de la lectura secuencial nominal de cada unidad, no medido en laboratorio — el tiempo real varía según la carga del sistema, pero el orden se mantiene.
| Tipo de unidad | Lectura secuencial | Tiempo de carga modelo 9 GB | Veredicto |
|---|---|---|---|
| PCIe Gen5 NVMe (ej. Samsung 9100 Pro) | ~13.000-14.700 MB/s | ~1-2 s | Bien si la placa base soporta Gen5 y el precio está cerca de Gen4 |
| PCIe Gen4 NVMe (ej. Samsung 990 Pro) | ~7.000 MB/s | ~2-4 s | Mejor opción para la mayoría |
| PCIe Gen3 NVMe | ~3.500 MB/s | ~3-7 s | Aceptable |
| SSD SATA | ~550 MB/s | ~15-25 s | Notablemente lento — actualiza si es posible |
| HDD (7200 RPM) | ~150 MB/s | ~60-90 s | Evitar para LLMs |
Lectura relacionada
- ▸Mejor GPU por menos de $600 para LLMs locales — combina un SSD rápido con la GPU adecuada
- ▸Mejor mini PC para LLM local — muchos mini PCs incluyen SSDs más lentos
- ▸¿Cuánta RAM necesita un modelo 7B? — la RAM importa más que el SSD para la velocidad de inferencia
- ▸Mejor NAS y almacenamiento para modelos de IA locales — para 4 TB+ y varios modelos
Respuestas rápidas sobre SSD para LLMs locales
¿Un SSD más rápido acelera la inferencia?▾
¿Vale la pena PCIe Gen5 frente a Gen4 para LLMs?▾
¿Por qué cambian tanto los precios de SSD en 2026?▾
¿Cuánto almacenamiento SSD necesito para LLMs locales?▾
¿La unidad del sistema operativo tiene que ser el mismo SSD?▾
¿Quieres el desglose completo?
Leer la guía completa →Prompt Bites relacionados