2025 — Presente
Site Reliability Engineer (autónomo)
- Diseño y operación de homelab con 13 servicios en producción 24/7 durante 365 días, uptime medido 99.7% (3 outages planeados, 0 no planeados). Stack: Proxmox VE + ZFS + KVM/LXC + Oracle Cloud free tier.
- Operación de VPS público (pentagran.duckdns.org) con Docker, nginx y ACME cert rotation automática. Sirve ~30 páginas estáticas + API Fastify con 13 endpoints.
- Desarrollo de 3 agentes IA operativos (Lia, Codex, Palomino) con roles separados. Memoria compartida vía vault Obsidian + Git. Estimación: ~200 horas/año automatizadas.
- Reducción del 40% en tiempo de respuesta a incidentes mediante 23 runbooks documentados tras cada post-mortem. Ej.: restaurar cert SSL pasó de 8h (mes 3) a 45min (mes 8).
- Detección y diagnóstico de 4 fallos críticos: cert SSL expirado, ZFS ARC consumiendo toda la RAM, RAID1 degraded por disco muerto, swapfile faltante en Oracle free tier.
13servicios en producción
99.7%uptime 12m
23runbooks
40%reducción tiempo incidentes
3agentes IA
0downtime no planificado
Proxmox VE 9ZFSKVM/LXCDockerTailscalenginxLet's EncryptOracle CloudHermes AgentOllama Cloud