Literalmente tres minutos. Sin bromas.
Si te han dicho que montar IA local es complicado, te han mentido. En 2026, instalar un asistente de IA privado en tu ordenador es tan fácil como instalar una app del móvil. Tres pasos, tres minutos, cero conocimientos técnicos.
Vamos a ello.
Lo que necesitas antes de empezar
- Un ordenador con Windows, Mac o Linux
- 8 GB de RAM como mínimo (16 GB recomendado para modelos más grandes)
- Conexión a internet (solo para la descarga inicial)
- 5 GB de espacio libre en disco
Paso 1: Instala Docker
Docker es el programa que ejecuta todo. Sin Docker no hay IA local.
Windows y Mac
Descarga Docker Desktop, instálalo como cualquier programa y ábrelo. Listo.
Linux (Ubuntu/Debian)
sudo apt update && sudo apt install -y docker.io docker-compose-v2 sudo systemctl enable --now docker sudo usermod -aG docker $USER
Cierra sesión y vuelve a entrar para que el grupo docker funcione.
Paso 2: Descarga y ejecuta
Abre una terminal (o PowerShell en Windows) y ejecuta:
git clone https://git.d0a1.es/devops/quickstart.git cd d0a1/quickstart docker compose up -d
Docker descargará las imágenes de Ollama y Open WebUI (unos 2 GB la primera vez). Cuando termine, tu asistente de IA ya está corriendo.
Paso 3: Abre tu asistente
Abre el navegador y ve a http://localhost:3000
Verás una interfaz tipo ChatGPT, pero privada. La primera vez, el modelo llama3.2:3b se descargará automáticamente (unos 3.8 GB). Una vez descargado, funciona sin internet.
Elige tu modelo
Ollama soporta docenas de modelos. Cambia el modelo por defecto editando docker-compose.yml:
| Modelo | RAM necesaria | Disco | Ideal para |
|---|---|---|---|
| llama3.2:3b | 8 GB | 3.8 GB | Conversación general (viene por defecto) |
| mistral:7b | 16 GB | 7.7 GB | Respuestas rápidas y concisas |
| llama3.1:8b | 16 GB | 9.3 GB | Mejor razonamiento |
| qwen2.5:7b | 16 GB | 8.5 GB | Multilingüe (español, inglés, chino) |
| gemma2:2b | 8 GB | 2.7 GB | Equipo antiguo o con poca RAM |
Verifica que funciona sin internet
Desconecta el WiFi. Abre http://localhost:3000. Escribe algo. Si responde, tu IA es 100% local. Tus datos nunca salieron de tu equipo.
Tips
- El primer mensaje tarda más — el modelo se está cargando en memoria. A partir del segundo mensaje va rápido.
- Si va lento — usa un modelo más pequeño (gemma2:2b funciona en 4 GB de RAM).
- Si quieres GPU — en Linux, instala los drivers de NVIDIA y Docker usará tu tarjeta gráfica automáticamente. En Mac, Apple Silicon ya está soportado.
- Para parar — ejecuta
docker compose down. Para reiniciar:docker compose up -d.
Y ahora qué?
Ya tienes tu propio asistente de IA. Gratis. Privado. Sin suscripciones.
Si quieres más — automatizaciones con n8n, búsqueda semántica con Qdrant, un agente con memoria — consulta nuestra guía de despliegue en VPS.