Para developers
Tu modelo de código, en tu máquina
Misma API que ya usas, sin factura por token y sin que tu código salga de tu red. Diez minutos con Ollama y un modelo de 7B.
41 tok/s qwen2.5-coder:7b · 6,6 GB cargado · medido en nuestra DGX Spark el 4-10-2026
Empieza en 10 minutos
- Instala Ollama desde ollama.com.
- Descarga el modelo y llama a la API compatible con OpenAI:
ollama pull qwen2.5-coder:7b
curl http://localhost:11434/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{"model": "qwen2.5-coder:7b",
"messages": [{"role": "user", "content": "Escribe una función en Python que invierta una cadena"}]}'Desde Python, cambia solo la URL base del cliente oficial de OpenAI:
from openai import OpenAI
# El cliente exige una clave; Ollama la ignora.
client = OpenAI(base_url="http://localhost:11434/v1", api_key="ollama")
reply = client.chat.completions.create(
model="qwen2.5-coder:7b",
messages=[{"role": "user", "content": "Explica este error: KeyError en la línea 12"}],
)
print(reply.choices[0].message.content)Cualquier editor o herramienta que acepte una URL base compatible con OpenAI puede apuntar a http://localhost:11434/v1. Con 16 GB de RAM, un modelo de 7B va holgado; para más calidad, mira la clase de 32B en hardware.
Qué pasa en tu máquina
Tu editor habla con una API local idéntica a la de OpenAI; el modelo corre en tu GPU. No hay cable hacia fuera.
| En local Ollama en tu máquina | API en la nube un proveedor externo | |
|---|---|---|
| Dónde corre el modelo | En tu máquina | En el servidor del proveedor |
| Tu código sale de tu red | No | Sí |
| Factura por token | No | Sí |
| Funciona sin conexión | Sí | No |
| Velocidad medida por nosotros | 41 tok/s | No la hemos medido; no publicamos cifras ajenas. |
Máquinas que mueven un asistente de código
Las más baratas que lo ejecutan con holgura y a una velocidad práctica (misma regla que en el catálogo).
Herramientas para agentes, MCP y prompts
Constructor de agentesDefine un agente y exporta su configuración.Constructor MCPEsqueleto de un servidor MCP para tus herramientas.Constructor de skillsEmpaqueta instrucciones reutilizables para tu asistente.Constructor de pluginsAgrupa skills, agentes y hooks en un plugin.Generador de promptsEstructura un prompt y puntúalo.Calculadora de VRAMQué modelo cabe en tu GPU antes de descargar.Dev Playground30 ejercicios en el navegador que se comprueban solos: streaming, JSON, RAG, reintentos.
Guías para developers
- Conecta Claude Code a un modelo local con OllamaTres variables de entorno ponen Claude Code sobre un modelo local de Ollama: configuración, qué queda en tu máquina, qué no y qué medimos con tres modelos.
- CUDA en Fedora: monta una estación de IA local en una tardeInstala el driver de NVIDIA desde RPM Fusion, pon Ollama a usar la GPU en cinco minutos y compila llama.cpp con el toolkit CUDA según la guía oficial de Fedora.
- Cuantización GGUF: elige el archivo correcto para tu máquinaCómo leer el nombre de un archivo GGUF, elegir entre Q4_K_M, Q5 y Q8 según tu memoria y medir tú mismo velocidad, memoria y calidad con tres comandos.
- llama.cpp en Intel Arc con SYCL: 16 GB de VRAM asequiblesCompila llama.cpp con el backend SYCL de Intel, ejecuta un modelo de 8B en una Arc A770 o B580 y conoce con cifras de terceros la velocidad que puedes esperar.
- Tu pasarela de agentes con OpenClaw y Ollama en un comandoInstala OpenClaw, conéctalo a un modelo local de Ollama, programa tu primera automatización y dimensiona su memoria con cifras medidas en nuestra pasarela.
- Qwen 2.5 Coder 7B en tu máquina en 20 minutosAnálisis de Qwen2.5-Coder-7B con Ollama: velocidad y memoria medidas, tres tareas de pyme con prompts exactos, límites honestos y conexión con VS Code y n8n.
- RAG local con n8n y Ollama sobre tus documentosTutorial paso a paso para montar un pipeline RAG con n8n, Ollama y ChromaDB en tu propio hardware, con comandos, tiempos medidos y coste por consulta cero.
- Agentes de IA para pymes: de dónde sale de verdad el retornoQué hacen los agentes de IA en una pyme, tres patrones de despliegue local, por qué no se sostienen las cifras de ROI publicadas y cómo medir el tuyo.
- Tus primeros 3 agentes de IA en local: guía para pymesDespliega tres agentes de IA en hardware propio con Ollama y MCP, por orden de seguridad e impacto, empezando por un resumen diario en una placa de 80 EUR.