Servicios
Infraestructura para IA y LLMs
Despliegue privado de modelos de lenguaje y pipelines RAG. Puestas en producción de alto rendimiento con vLLM y PagedAttention, clusters locales con Ollama, integración de bases vectoriales con ChromaDB y cuantización de modelos (AWQ/GGUF) para inferencia rápida sin dependencia de la nube.
Arquitectura de Contenedores & MLOps
Traducción de dependencias complejas de aplicaciones e IA en stacks limpios y reproducibles con Docker Compose y Podman. Desde microservicios aislados hasta contenedores con GPU pass-through, garantizando despliegues versionados y predecibles.
Ingeniería de Sistemas Linux
Configuración de servidores, ajuste de kernel, bastionado (hardening) y administración continua. Desde el aprovisionamiento bare-metal inicial hasta la optimización en Fedora, Debian, RHEL y Ubuntu para cargas de trabajo críticas.
Auditoría de Infraestructura y Seguridad
Revisión exhaustiva de tu despliegue actual — identificando cuellos de botella, problemas de uso de VRAM/GPU y vulnerabilidades. Recomendaciones prácticas para optimización de costes, seguridad de contenedores y resiliencia del sistema.
Herramientas y Habilidades
IA & Inferencia
vLLM · Hugging Face · ONNX Runtime · CUDA · Ollama · Cuantización (AWQ / GGUF) · ChromaDB · LlamaIndex · OpenWebUI · Python
Sistemas & Contenedores
Linux (Fedora, Debian, RHEL, Ubuntu) · Docker · Docker Compose · Podman (Rootless) · Systemd · Bash · Git · Ajuste de Kernel · Windows Server
Redes & Seguridad
WireGuard · Tailscale · Nginx · Proxy Inverso · Cloudflare Tunnels · FIDO2 / Passkeys · DNS · Configuración de Firewalls
Observabilidad
Prometheus · Grafana · Beszel · Netdata
Hardware & Electrónica
Raspberry Pi · ESP32 · Arduino · Diseño de Circuitos · Soldadura · KiCad · FreeCAD
Software Empresarial & Docs
Odoo ERP · Markdown · Inkscape · Microsoft Excel · Office 365
Workstation de IA dedicada (Ryzen 9 + RTX 5070) y dos servidores Linux ejecutando más de 15 servicios autoalojados. Descubre el hardware y el stack de modelos locales.
Ver el laboratorio y hardware →Proyectos
LEMoE
↗Middleware de IA que enruta peticiones semánticamente entre múltiples modelos expertos locales. Resultado: Hasta un 40% de reducción en costes de APIs de IA y posibilidad de ejecución completa en hardware on-premise estándar.
Docker · Python · OllamaSRag
↗Pipeline RAG en contenedores que conecta bases de datos de documentos a un modelo de lenguaje. Resultado: Privacidad de datos garantizada al 100% y arquitectura escalable lista para procesar miles de documentos internos simultáneamente.
ChromaDB · Docker ComposePRRPC
↗Demonio Linux que integra hardware y software sobre Wayland. Controla un monitor de estado físico mediante un protocolo USB personalizado. Resultado: Eliminación de retrasos en monitorización manual, logrando actualizaciones de estado de hardware en tiempo real con latencia inferior a 5ms.
Linux · Wayland · HardwareBlog
↗Escritura técnica en inglés y español. Artículos sobre Linux, infraestructura, automatización y hardware.
Escritura · Linux · SistemasLaboratorio & Workstation
→El hardware que ejecuta todo esto. Workstation de IA dedicada (Ryzen 9 + RTX 5070), dos servidores, 7.1 TB de almacenamiento y cómputo GPU local sin dependencia de la nube.
Ryzen 9 · RTX 5070 · HP EliteDesk · Raspberry Pi 4BÚltimas entradas del Blog
Todos los artículos ↗De Ollama a Producción: Desplegando vLLM con PagedAttention y métricas en tiempo real
Guía práctica para desplegar vLLM en producción con Docker: optimiza VRAM con PagedAttention, gestiona concurrencia y monitoriza métricas clave en tiempo real.
Contacto
Si necesitas un socio de infraestructura fiable — alguien que entienda tu stack de principio a fin — hablemos.