NVIDIA (custom build) · PC con GPU
RTX 4090 24GB Build
Máxima velocidad con modelos de 30B
- 24 GBmemoria de GPU (VRAM)
- 14Bcabe en memoria (Q4, 8k)
- 14Bpráctico (estimación)
- 600 Wconsumo máximo
- ~2.500 €precio orientativo
¿Qué puede ejecutar?
Elige una tarea o un tamaño de modelo. La barra compara lo que necesita con la memoria útil de esta máquina.
- Pesos del modelo
- Caché de contexto
- Motor + extras (Whisper, embeddings)
Cómo lo calculamos
Pesos = parámetros × bits por peso / 8 (Q4_K_M ≈ 4,85; Q8_0 ≈ 8,5). Caché = tokens de contexto × tamaño por token del modelo de referencia (capas × cabezas KV × dimensión × 2 × 2 bytes). Más 1,5 GB de motor. Memoria útil = total menos lo que se queda el sistema (3–6 GB en memoria compartida, 0,5 GB en una GPU). Holgado = cabe en el 85 %. Es una estimación de ±20 %: mídelo en tu máquina antes de decidir. Cómo elegir el archivo GGUF
¿Cuándo sale más barato que la nube?
Ajusta tu uso. Comparamos la compra más la luz con lo que pagarías a una API en la nube.
| Mes | Equipo propio | Nube |
|---|
- Equipo propio (compra + luz)
- API en la nube
Supuestos: 0,25 €/kWh (media en España, editable), 1 USD = 0,92 €, 3 tokens de entrada por cada 1 de salida, y la máquina a consumo máximo todas las horas que está encendida (el peor caso). Precios de API verificados el 9-9-2026. No incluye tu tiempo ni el mantenimiento. Ojo: la nube compara con un modelo de frontera y aquí correrías uno abierto más pequeño; es una comparación de coste, no de calidad.
Aprende con esta máquina
- ComfyUI: genera 100 imágenes de producto en minutos con IA localTutorial para usar el workflow de generación por lotes de ComfyUI. Crea imágenes de producto, gráficos para redes sociales y assets de marketing a escala.
- CUDA en Fedora: monta una estación de IA local en una tardeInstala el driver de NVIDIA desde RPM Fusion, pon Ollama a usar la GPU en cinco minutos y compila llama.cpp con el toolkit CUDA según la guía oficial de Fedora.
- Llama 3.3 70B en tu hardware: qué necesita y cuándo compensaLa memoria que de verdad necesita un modelo de 70B, velocidades medidas y citadas en un Mac de 64 GB, dos GPU de 24 GB y nuestra GB10, y cuándo supera a un 8B.
- Cuantización GGUF: elige el archivo correcto para tu máquinaCómo leer el nombre de un archivo GGUF, elegir entre Q4_K_M, Q5 y Q8 según tu memoria y medir tú mismo velocidad, memoria y calidad con tres comandos.
Sáltatela si…
- va a estar encendida todo el día en una oficina: consume hasta 600 W y una GPU de sobremesa hace ruido.
- necesitas modelos de 70B: no caben en esta memoria de GPU.
Ficha y procedencia de los datos
| CPU | AMD Ryzen 7 / Intel i7 |
|---|---|
| GPU | RTX 4090 24GB |
| NPU | N/A (CUDA cores) |
| Memoria | 24 GB (memoria de GPU (VRAM)); útil para el modelo ≈ 23.5 GB |
| Velocidad | 130 tok/s con 30B estimación del fabricante o la comunidad, no medida por nosotros |
| Precio | ~2.500 € orientativo, revisado 2026-09-19; mira el precio real en la tienda |
Solo publicamos como "medido" lo que corre en nuestras máquinas. Política editorial