HomeBlogSelf-Hosting

Cómo desplegar un asistente de IA personal en un VPS — paso a paso

Un asistente alojado en un portátil muere en el momento en que cierras la tapa. Un servidor de 6 $ al mes nunca duerme. Esto es lo que realmente hace falta para tener tu propia IA funcionando 24/7 — cada paso, cada punto de fallo habitual, y el atajo de un solo comando al final.

15 de julio de 2026 VPS

Primero, el modelo mental. Un asistente de IA autoalojado tiene dos partes: el modelo (la inteligencia, normalmente una API en la nube — no puedes ejecutar pesos de un modelo de frontera en un servidor barato, y no lo necesitas) y la capa de agente (todo lo que lo convierte en tuyo: memoria, historial de conversaciones, integraciones, tareas programadas). La capa de agente es lo que alojas tú. Es ligera, no necesita GPU, y es la parte que acumula tus datos — exactamente por eso pertenece a una máquina que tú controlas.

Lo que necesitas antes de empezar: un VPS (~5–15 $/mes), una fuente de modelo (una clave de API o una suscripción de IA), una cuenta de Telegram, y una hora aproximadamente.

Paso 1 — Elige el servidor

Cualquier proveedor de VPS de buena reputación sirve. La especificación honesta para una capa de agente: 1–2 vCPU, 2–4 GB de RAM, 20+ GB de disco. Resiste la tentación de la mejora — estás ejecutando un proceso Node y una base de datos SQLite, no entrenando un modelo. Elige una región cercana a ti (latencia) o cercana a tu zona de confort legal (jurisdicción — para algunas personas eso es exactamente el punto).

Paso 2 — Higiene básica, antes que nada

Cinco minutos que evitan el noventa por ciento de los desastres: entra con claves SSH y desactiva el inicio de sesión por contraseña; crea un usuario que no sea root; activa las actualizaciones de seguridad desatendidas; enciende un cortafuegos que solo permita SSH. Nada de esto es específico de la IA — es la diferencia entre «mi servidor» y «el nodo de una botnet de otro».

Paso 3 — Instala el entorno de ejecución

Para la mayoría de las pilas de asistente modernas eso significa Node.js LTS más git. Una regla importa más que cualquier elección de herramientas: los secretos viven en un archivo de entorno con permisos restringidos, nunca en el código. Tu clave de API del modelo y el token del bot son las llaves de la identidad de tu asistente; trátalos como la contraseña de tu correo.

Paso 4 — Conecta la interfaz

No necesitas construir una app — ya llevas la interfaz encima. Crea un bot con el BotFather de Telegram (tarda un minuto y no cuesta nada), pon el token en tu archivo de entorno, y tu asistente adquiere una ventana de chat en todos los dispositivos que tienes, con mensajes de voz, archivos y fotos incluidos.

Paso 5 — Dale una memoria que sobreviva

Un asistente sin persistencia es un pez de colores con factura de servidor. Las conversaciones, los datos extraídos y la configuración deben acabar en una base de datos en el disco del VPS — SQLite es realmente suficiente a escala personal. Después programa una copia de seguridad diaria de esa base de datos hacia una segunda ubicación. (Por qué la arquitectura de memoria importa más de lo que la gente cree tiene su propio artículo.)

Paso 6 — El paso que todo el mundo se salta: supervisión de procesos

Aquí es donde mueren en silencio la mayoría de las instalaciones por tu cuenta. Ejecutar el asistente en una sesión de terminal significa que se detiene cuando la sesión se cierra. Ejecutarlo con nohup significa que se detiene en el primer fallo no gestionado — en silencio, a las 3 de la madrugada, y te enteras días después. La respuesta real es un servicio systemd con Restart=always: los fallos lo reinician, los reinicios del sistema lo reinician, y el sistema de arranque de la máquina —no tu memoria— es responsable de que siga vivo. Este único paso es la diferencia entre «un script que ejecuté una vez» y «un asistente que responde a cualquier hora».

Lo que cuestan los errores

Cada paso que te saltas tiene un precio. Higiene omitida: un servidor comprometido que lee toda la memoria de tu asistente. Persistencia omitida: meses de contexto acumulado desaparecidos con un solo reinicio de proceso. Supervisión omitida: un asistente en el que dejas de confiar poco a poco, porque a veces simplemente… no está. Y seguir alojándolo en el portátil después de todo: recordatorios que no saltan, mensajes que se quedan sin responder, trabajo programado que nunca se ejecuta — exactamente aquello para lo que querías un asistente.

El atajo

Todo lo anterior es una tarde si disfrutas con la infraestructura — y una tarea recurrente si no. Avelina AI es exactamente esta arquitectura, empaquetada: un instalador guiado coloca el agente en tu VPS con la interfaz de Telegram, la base de datos de memoria persistente, la supervisión de procesos y las copias de seguridad diarias ya conectadas, y actualizaciones firmadas a partir de ahí. Acabas con todo lo que construye esta guía —incluida la parte donde todos los datos acumulados se quedan en tu servidor— sin montarlo a mano.

Preguntas frecuentes

¿Necesito una GPU?
No. La capa de agente es ligera; el modelo se llama vía API. Una GPU solo importa si más adelante decides ejecutar pesos de modelo locales.

¿No puedo simplemente usar mi portátil?
Hasta que cierres la tapa, sí. Un asistente siempre activo necesita una máquina siempre activa — ese es todo el argumento a favor de un VPS.

¿Coste total de funcionamiento?
5–15 $/mes por el servidor más el uso de tu modelo. Infraestructura ≈ dos cafés al mes.

¿Qué es lo que realmente lo hace «24/7»?
La supervisión de procesos (systemd, Restart=always) — no el servidor en sí. Las máquinas se mantienen encendidas; los procesos sin supervisión no.

¿Puedo conseguir esto sin la configuración manual?
Sí — es exactamente lo que hace el instalador de Avelina AI, la misma arquitectura, un solo comando.

La versión terminada de esta guía, en un solo comando