- Ubuntu Server 24.04 LTS
- 4 vCPU, 8 GiB de memoria, 64 GiB de almacenamiento de sistema
- Identidad propia procedente de un clon completo de la plantilla Ubuntu Server
- Cloud-Init, SSH y agente invitado validados
- OpenCode 1.18.25
- Hermes Agent 0.20.6
- Sin modelo ni GPU local
- Instalación y versión de OpenCode verificadas
- Instalación de Hermes verificada mediante su diagnóstico integrado
- Endpoint compatible con OpenAI de Ollama alcanzado desde VM301
- Modelo
qwen3.6:35bdetectado por el cliente - Generación directa exitosa
- Generación real de OpenCode exitosa con el mismo modelo
- Generación real de Hermes exitosa con
qwen3.6:35b— contexto servido de 65.536 tokens, conjunto de herramientas deliberadamente restringido - Benchmark de OpenCode superado en tareas de Python, HTML y JSON de n8n (revisión y correcciones puntuales cuando fue necesario)
Esta validación demuestra la cadena completa entre un agente de desarrollo aislado y la inferencia local acelerada por GPU.
VM301
├── Hermes Agent
├── OpenCode
└── API d'inférence autorisée sur le réseau privé
└── Ollama sur la VM GPU
└── modèles locaux chargés sur la RTX 5090La VM cliente permanece ligera. El almacenamiento de los modelos, su carga en memoria de vídeo y las optimizaciones de inferencia siguen centralizadas en el nodo GPU. La API no se publica directamente en Internet y su acceso está limitado a clientes explícitamente autorizados.
qwen3.6:35b es la referencia validada para Hermes, con un contexto de 65.536 tokens.
qwen3-coder:30b está validado con OpenCode para tareas de desarrollo: Python funcionó directamente, mientras que HTML y JSON de n8n requirieron cada uno una corrección puntual antes de la validación final.
- Generación y mantenimiento de código Python
- Creación de páginas y componentes HTML
- Producción de datos estructurados en JSON
- Preparación de workflows de n8n
- Análisis de repositorios y modificaciones multiarchivo
- Redacción de documentación técnica
Los workflows de n8n generados siguen sujetos a validación humana: control de sintaxis, importación desactivada y revisión antes de cualquier activación, especialmente en presencia de expresiones, llamadas de red o credenciales.
- Ningún puerto de inferencia publicado directamente en Internet
- Filtrado explícito de las máquinas cliente
- Configuración cliente sin token cuando el endpoint privado no lo requiere
- Secretos, direcciones y reglas internas excluidos de la fuente pública
- Futuro acceso remoto previsto mediante túnel privado autenticado, y no mediante la apertura del puerto de Ollama
- Creación reproducible de una VM a partir de una plantilla depurada
- Instalación y diagnóstico de clientes agénticos recientes
- Integración de una API autoalojada compatible con OpenAI
- Separación entre el puesto agéntico y el cómputo GPU
- Filtrado de red según el principio de mínimo privilegio
- Validación progresiva de una cadena LLM completa
- Distinción documental entre estado validado y experimentación en curso
- la persistencia de la aplicación de VM301 aún debe verificarse tras un reinicio;
- la estación de desarrollo Windows está documentada por separado en la página VM302, con sus propias validaciones del 20 de septiembre de 2026 — estas no validan la recuperación tras reinicio de VM301;
- el acceso remoto de los puestos cliente deberá pasar por una arquitectura VPN dedicada y validada.