Mycel
Agentes y automatización

Montar la IA en un servidor tuyo: decisiones de despliegue, una a una

Poner el agente en un servidor en vez de en un portátil no es lo mismo que tenerlo en local: cambian el uptime, la GPU, el reparto de máquinas y quién administra qué. Esta página es la lista de decisiones operativas que hay que tomar, en el orden en que aparecen, para quien va a ser responsable de que eso siga encendido.

Gratis e ilimitado · Sin tarjeta · El cómputo lo pone tu equipo
Pantalla Sesiones de Mycel con una tarea terminada: las herramientas usadas una a una y, al lado, los ficheros entregados con su vista previa.
Una tarea real: el agente declara el entregable, ejecuta sus herramientas una a una y deja los ficheros listos para descargar.

Cómo funciona, paso a paso

  1. 1

    Eliges máquina: servidor de oficina o VPS europeo, con o sin GPU.

  2. 2

    Despliegas el Nodo, como ejecutable o en contenedor, y lo emparejas con la cuenta de la organización.

  3. 3

    Decides el modelo: local en esa máquina, clave de API o Nodo Cloud con GPU.

  4. 4

    Registras las carpetas, repartes roles por persona y separas el Nodo público del interno.

1

Dónde y cómo se despliega

El Nodo es un ejecutable sin dependencias más allá de su librería de sockets: no arrastra un entorno que haya que mantener, ni una base de datos que administrar. Para una sola máquina, el binario suelto suele ser lo más simple. Si tu casa va por contenedores, hay despliegue con contenedores documentado y se integra en lo que ya tengas.

El servidor puede ser el de la oficina o un VPS europeo tuyo. Lo que sale de tu red en este nivel es solo la orquestación: el encargo viaja por nuestro relevo hasta tu Nodo. El contenido de la tarea no, porque el relevo no tiene columnas donde guardarlo. Si quieres una mano para montarlo en vuestro servidor, escribe a Ramón López y lo veis.

2

GPU sí o GPU no, y cuánta

La GPU solo hace falta si quieres el modelo corriendo en esa máquina. El número a llevarse a la reunión de compras es un modelo de 30B, del orden de 24 GB entre memoria de GPU y RAM, que es el mínimo con el que una tarea de varios pasos sale entera. Por debajo, el agente se pierde en el paso cuarto.

Sin GPU, el mismo Nodo trabaja con tu clave de API: el modelo corre fuera, los prompts van del servidor directamente al proveedor que elijas sin pasar por nosotros, y en tu máquina solo se ejecutan las herramientas. Un servidor modesto sobra para eso. Al conectar, el asistente de configuración detecta el hardware que hay y te dice qué paquete de modelos aguanta, así que no hace falta adivinar.

3

Uptime, separación de máquinas y mantenimiento

Dos cosas obligan a que el Nodo esté siempre encendido: las automatizaciones, cuyo reloj vive en él y no en la nube, y los chatbots publicados, que dejan de responder en cuanto la máquina cae. Eso convierte «lo dejo en mi portátil» en una decisión que se paga un viernes por la noche.

El Nodo que sirve chatbots públicos no debería ser la misma máquina donde viven los expedientes de tus clientes, porque un chatbot responde a partir de la carpeta que indexes. Y el mantenimiento se reduce a dos rutinas: actualizar el binario del Nodo, porque las garantías que se aplican son las de su versión, y comprobar que las copias de la versión anterior de los ficheros, que el Nodo guarda antes de modificar o borrar, caen en un sitio que entra en tu backup.

En una frase

El ángulo operativo: dónde poner el Nodo, con o sin GPU, en contenedores o como ejecutable, qué uptime necesita y cómo separar lo público de lo interno.

Qué necesitas

  • Un servidor Linux, Windows o macOS bajo tu administración.
  • GPU con ~24 GB si quieres modelos locales ahí; si no, tu clave de API.
  • Conectividad del servidor con la plataforma: sin ella el Nodo no recibe encargos nuevos.

Qué te llevas

  • Un Nodo corriendo en tu infraestructura, con sus automatizaciones disparándose ahí.
  • Chatbots servidos desde una máquina siempre encendida, sin depender de un portátil.
  • Traza exportable en JSON de cada tarea, con el autor, para tus revisiones internas.

Dónde ocurre cada cosa

  1. Tu equipo

    Hace el encargo

  2. Tu Nodo

    Pone el cómputo

  3. La red

    Aporta el conocimiento

Preguntas frecuentes

¿Puedo desplegarlo con contenedores?

Sí, hay despliegue por contenedores documentado. Para una sola máquina el ejecutable suelto suele ser más simple, porque el Nodo no arrastra dependencias más allá de su librería de sockets.

¿Necesita conexión a internet permanente?

El modelo local funciona sin salir a internet, pero el Nodo necesita alcanzar la plataforma para recibir encargos desde el navegador y para que los chatbots enruten. Sin conexión no puedes mandarle trabajo nuevo, aunque los ficheros sigan donde estaban.

¿Cuántos Nodos puedo tener?

Los que quieras, y no cuestan nada. El patrón habitual en una organización con datos sensibles es al menos dos: uno de cara a internet para los chatbots y otro interno para los expedientes, con carpetas y roles repartidos por persona en cada uno.

¿Qué mantenimiento pide?

Poco: mantener el binario actualizado y vigilar el disco. No hay base de datos que administrar en el Nodo, y las copias de la versión anterior de cada fichero tocado se guardan en tu propia carpeta de trabajo, así que basta con que esa ruta entre en tu backup.

Pruébalo con tus propios documentos

Creas la cuenta, abres el Nodo y le encargas la primera tarea. Es gratis e ilimitado: el cómputo lo pone tu equipo, así que no hay nada que racionar.