Infraestructura de IA soberana — demostración de código abierto

Plataforma de IA local (On-Premise)
de alto rendimiento

Diseño, despliegue y operación de una infraestructura de IA local y soberana — desde el hardware de bajo nivel hasta los LLM y los flujos RAG. Una realización de código abierto, documentada y reproducible: lo que se muestra aquí funciona y demuestra que una organización puede alojar su propia IA manteniendo el control de sus datos, sin dependencia de la nube.

Proxmox VE 9.2 RTX 5090 VFIO Passthrough Ollama + LLM RAG Vectoriel Docker ZFS 192 Go DDR5

Enfoque y filosofía

📖
Cuaderno de referencia compartido
Este portafolio es mi cuaderno de bitácora técnico. Cada página documenta lo que aprendí, cómo resolví un problema y los recursos que me ayudaron. De libre acceso.
🌿
Open Source primero
Cada herramienta elegida en este portafolio tiene una alternativa libre y abierta. Git, Proxmox, Ollama, Python, nginx — la transparencia y la comunidad están en el centro de cada decisión técnica.
🔧
Del terreno a la producción
26 años de experiencia — 7 años en seguridad de sistemas, 19 años como jefe de proyecto en un laboratorio de análisis. Lo que se presenta aquí fue diseñado, desplegado y mantenido en condiciones reales.

Áreas de competencia

Arquitectura — Visión general
Visión general
La plataforma por capas · del hardware a la IA de consumo
Infraestructura de hardware
Infraestructura
AMD Ryzen 9 9950X3D · RTX 5090 · 192 Go DDR5
OSS
Hipervisor Proxmox VE
Virtualización
Proxmox 9.2.2 · KVM · QEMU · Templates
OSS
Reverse Proxy
Infraestructura
VM200 · Nginx · TLS · Certbot · Fail2ban · publicación HTTPS
GPU Passthrough VFIO
Virtualización
VFIO · IOMMU · PCIe Passthrough RTX 5090
OSS
Almacenamiento ZFS
Almacenamiento
Conjuntos de datos de IA · Snapshots · Arquitectura de almacenamiento
OSS
Sistemas operativos
SO
Debian · Ubuntu · Alpine · Windows 11
OSS
IA local y LLM
IA / ML
Ollama · Open WebUI · Llama · Mistral · Gemma
OSS
RAG y bases de datos vectoriales
IA / ML
PostgreSQL · pgvector · bge-m3 · HNSW
OSS
IA generativa de imágenes
IA / ML
ComfyUI · Flux · GPU Computing
OSS
Speech AI — Whisper
IA / ML
Voz a texto · IA multimodal · procesamiento de audio
OSS
Agentes IA — Hermes y OpenCode
IA / Agentes
VM301 · estación agéntica Linux · OpenCode · Hermes · inferencia GPU remota
Estación de desarrollo IA — DeepSeek Harness
Dev / IA
VM302 · Windows 11 · VSCodium · Python · Node.js · DeepSeek Harness (preliminar)
MIT
Segundo Cerebro OpenCode
IA / Agentes
Kit Markdown · memoria duradera · OpenCode · validación humana · licencia MIT (prototipo)
OSS
Docker y contenerización
DevOps
Docker Compose · Aislamiento · Servicios de IA
OSS
Nextcloud
Servicios
Archivos autoalojados · Docker · MariaDB
FAIR-CODE
n8n — Automatización
Servicios
Flujos de trabajo · Docker · PostgreSQL externo · API de Ollama
Red
Red
Bridge Proxmox · SSH · Firewall · NAT
OSS
Python
Dev
venv · pip · requirements.txt · Scripts IA
OSS
Git
DevOps
GitHub vs GitLab · GitLab autoalojado · higiene de repositorios

Niveles de dominio

Virtualización / ProxmoxAvanzado
GPU Passthrough VFIOAvanzado
Infraestructura de IAAvanzado
Seguridad de sistemas (Antivirus, Firewall)Avanzado
Gestión de proyectos de TIExperto
Linux (Debian/Ubuntu)Intermedio+
Windows Server/DesktopIntermedio+
IA local (LLM / Ollama)Intermedio+
Docker / ContenerizaciónIntermedio
Nextcloud / AutoalojamientoIntermedio
DevOps (IaC, plantillas)Intermedio
ZFS / AlmacenamientoIntermedio
CUDA / NVIDIAIntermedio
Git / GitLab / GitHubIntermedio
RAG / pgvector / EmbeddingsBásico+
Python / venv / pipBásico+

Presentación del proyecto

Contexto: Diseño de una plataforma de IA local de alto rendimiento basada en Proxmox VE, una GPU NVIDIA RTX 5090 en passthrough VFIO, virtualización Windows/Linux, almacenamiento ZFS, infraestructura Docker, alojamiento de LLM locales (Ollama), RAG vectorial (PostgreSQL/pgvector), automatización n8n y herramientas multimodales (Whisper, ComfyUI).

Vocación: demostrar que una organización — una entidad local (ayuntamiento) o una pyme — puede alojar sus propios servicios de IA y automatización manteniéndose soberana sobre su infraestructura y sus datos. Algunos componentes están en producción, otros validados en la plataforma de diseño o en despliegue.

infraestructura → virtualización → despliegue → operación de IA, construida íntegramente con herramientas de código abierto.