Raspberry Pi + Hailo · Placa / edge
RPi 5 + AI HAT+ 2
Formación, prototipos y modelos pequeños
- 16 GBmemoria unificada
- 7–8Bcabe en memoria (Q4, 8k)
- 3Bpráctico (estimación)
- 15 Wconsumo máximo
- ~200 €precio orientativo
¿Qué puede ejecutar?
Elige una tarea o un tamaño de modelo. La barra compara lo que necesita con la memoria útil de esta máquina.
- Pesos del modelo
- Caché de contexto
- Motor + extras (Whisper, embeddings)
Cómo lo calculamos
Pesos = parámetros × bits por peso / 8 (Q4_K_M ≈ 4,85; Q8_0 ≈ 8,5). Caché = tokens de contexto × tamaño por token del modelo de referencia (capas × cabezas KV × dimensión × 2 × 2 bytes). Más 1,5 GB de motor. Memoria útil = total menos lo que se queda el sistema (3–6 GB en memoria compartida, 0,5 GB en una GPU). Holgado = cabe en el 85 %. Es una estimación de ±20 %: mídelo en tu máquina antes de decidir. Cómo elegir el archivo GGUF
¿Cuándo sale más barato que la nube?
Ajusta tu uso. Comparamos la compra más la luz con lo que pagarías a una API en la nube.
| Mes | Equipo propio | Nube |
|---|
- Equipo propio (compra + luz)
- API en la nube
Supuestos: 0,25 €/kWh (media en España, editable), 1 USD = 0,92 €, 3 tokens de entrada por cada 1 de salida, y la máquina a consumo máximo todas las horas que está encendida (el peor caso). Precios de API verificados el 9-9-2026. No incluye tu tiempo ni el mantenimiento. Ojo: la nube compara con un modelo de frontera y aquí correrías uno abierto más pequeño; es una comparación de coste, no de calidad.
Aprende con esta máquina
- Hardware para IA local 2026: qué comprar con tu presupuestoCatálogo de compra de IA local por tramos de presupuesto, con benchmarks de terceros por dispositivo y cinco preguntas para saber qué tramo necesitas de verdad.
- Tus primeros 3 agentes de IA en local: guía para pymesDespliega tres agentes de IA en hardware propio con Ollama y MCP, por orden de seguridad e impacto, empezando por un resumen diario en una placa de 80 EUR.
- IA edge en las fábricas españolas: cómo se despliegaMantenimiento predictivo, control de calidad y soporte al operario con IA en planta: casos de uso, un kit de hardware inicial y cómo empezar en una pyme española.
- Cuantización GGUF: elige el archivo correcto para tu máquinaCómo leer el nombre de un archivo GGUF, elegir entre Q4_K_M, Q5 y Q8 según tu memoria y medir tú mismo velocidad, memoria y calidad con tres comandos.
Sáltatela si…
- quieres modelos de 7–8B con soltura: aquí van justos o no caben.
Ficha y procedencia de los datos
| CPU | 4-core Arm Cortex-A76 |
|---|---|
| GPU | VideoCore VII |
| NPU | 40 TOPS (Hailo) |
| Memoria | 16 GB (memoria unificada); útil para el modelo ≈ 13 GB |
| Velocidad | 8 tok/s con 4B estimación del fabricante o la comunidad, no medida por nosotros |
| Precio | ~200 € orientativo, revisado 2026-09-19; mira el precio real en la tienda |
Solo publicamos como "medido" lo que corre en nuestras máquinas. Política editorial