Apple · Sobremesa compacto
Mac Studio M4 Max (48GB)
Varios modelos a la vez, 546 GB/s de ancho de banda
- 48 GBmemoria unificada
- 32Bcabe en memoria (Q4, 8k)
- 32Bpráctico (estimación)
- 75 Wconsumo máximo
- ~2.300 €precio orientativo
¿Qué puede ejecutar?
Elige una tarea o un tamaño de modelo. La barra compara lo que necesita con la memoria útil de esta máquina.
- Pesos del modelo
- Caché de contexto
- Motor + extras (Whisper, embeddings)
Cómo lo calculamos
Pesos = parámetros × bits por peso / 8 (Q4_K_M ≈ 4,85; Q8_0 ≈ 8,5). Caché = tokens de contexto × tamaño por token del modelo de referencia (capas × cabezas KV × dimensión × 2 × 2 bytes). Más 1,5 GB de motor. Memoria útil = total menos lo que se queda el sistema (3–6 GB en memoria compartida, 0,5 GB en una GPU). Holgado = cabe en el 85 %. Es una estimación de ±20 %: mídelo en tu máquina antes de decidir. Cómo elegir el archivo GGUF
¿Cuándo sale más barato que la nube?
Ajusta tu uso. Comparamos la compra más la luz con lo que pagarías a una API en la nube.
| Mes | Equipo propio | Nube |
|---|
- Equipo propio (compra + luz)
- API en la nube
Supuestos: 0,25 €/kWh (media en España, editable), 1 USD = 0,92 €, 3 tokens de entrada por cada 1 de salida, y la máquina a consumo máximo todas las horas que está encendida (el peor caso). Precios de API verificados el 9-9-2026. No incluye tu tiempo ni el mantenimiento. Ojo: la nube compara con un modelo de frontera y aquí correrías uno abierto más pequeño; es una comparación de coste, no de calidad.
Aprende con esta máquina
- Hardware para IA local 2026: qué comprar con tu presupuestoCatálogo de compra de IA local por tramos de presupuesto, con benchmarks de terceros por dispositivo y cinco preguntas para saber qué tramo necesitas de verdad.
- Cuantización: modelos de 70B en hardware de consumoGGUF, AWQ, GPTQ — las técnicas de compresion que hacen que modelos de IA de nivel empresarial quepan en hardware de consumo. Guía práctica con requisitos.
- Google Gemma 4: análisis de la familia de modelos abiertosAnálisis práctico de las cuatro variantes de Gemma 4 — E2B, E4B, 26B MoE y 31B Dense — con specs, comandos Ollama y límites reales.
- Cuantización GGUF: elige el archivo correcto para tu máquinaCómo leer el nombre de un archivo GGUF, elegir entre Q4_K_M, Q5 y Q8 según tu memoria y medir tú mismo velocidad, memoria y calidad con tres comandos.
Sáltatela si…
- una API en la nube ya te cubre y tu volumen es bajo: mira el cálculo de amortización.
Ficha y procedencia de los datos
| CPU | Apple M4 Max (16-core) |
|---|---|
| GPU | 40-core GPU |
| NPU | 16-core Neural Engine |
| Memoria | 48 GB (memoria unificada); útil para el modelo ≈ 42 GB |
| Velocidad | 18 tok/s con 70B estimación del fabricante o la comunidad, no medida por nosotros |
| Precio | ~2.300 € orientativo, revisado 2026-09-19; mira el precio real en la tienda |
Solo publicamos como "medido" lo que corre en nuestras máquinas. Política editorial