Mycel
Preguntas frecuentes

Qué modelo local necesita una empresa, y con qué máquina se sostiene

La conversación sobre modelos locales se llena de nombres y de comparativas que caducan en un trimestre. Lo que no caduca es el orden de magnitud, y esa es la parte que sirve para pedir presupuesto: para trabajo autónomo de varios pasos hace falta un modelo de 30B, del orden de 24 GB entre memoria de GPU y RAM. Con ese número delante, el resto se decide solo.

Actualizado el 6 de agosto de 20264 min de lectura

Panel de entregables de una tarea de Mycel: las pestañas de los ficheros producidos, el peso del documento y la vista previa de su contenido.
Los ficheros que produce la tarea, con su vista previa y su botón de descarga.

Por qué 30B y no el pequeño que ya te funciona

Un modelo pequeño responde estupendamente a una pregunta suelta, y por eso engaña. Donde se cae es en el bucle: el agente ejecuta un paso, mira el resultado, corrige y sigue, y en el cuarto o el quinto un modelo corto se olvida de lo que ya hizo, repite trabajo y acaba entregando algo que parece un resultado sin serlo.

Mycel ajusta las instrucciones al modelo que tiene delante: con uno local pequeño usa un guion más estrecho, y con uno capaz le da el juego completo de herramientas. Ningún guion arregla un modelo que no da la talla, y por eso el requisito se dice antes de que nadie se descargue nada.

No es un modelo, son tres

El principal, para código y razonamiento, es el de los 30B. Además hace falta uno de visión, para analizar imágenes, y uno de embeddings, que es el que permite indexar una carpeta y preguntarle a tus documentos. Esos dos son pequeños al lado del principal, pero ocupan disco y suelen faltar en los presupuestos.

No hay que elegirlos a ciegas: cuando el Nodo conecta, el asistente de configuración detecta el hardware de esa máquina (GPU y su memoria, memoria unificada en Apple Silicon, RAM, CPUs) y propone el paquete completo que aguanta, con descarga de una vez y barra de progreso. Es la diferencia entre elegir de una lista de nombres y aceptar una recomendación hecha sobre tu equipo.

El software es gratis; el cómputo, no

Conviene decirlo entero, porque «gratis e ilimitado» se malinterpreta: Mycel no cuesta nada y no tiene límite de tareas ni de usuarios. Pero el cómputo lo pones tú, y el cómputo cuesta: o una máquina con esa memoria, que se paga una vez, o la tarifa por uso de tu proveedor de API, o el alquiler de un servidor con GPU.

Aquí no vas a encontrar un precio de GPU ni una tarifa de tokens. Cambian cada pocos meses y una cifra vieja te hace un presupuesto peor que no tener ninguna. Lo estable, y lo que sirve para pedir precio, son los 30B y los 24 GB.

Cómo funciona, paso a paso

  1. Miras la memoria de tu equipo: 24 GB entre GPU y RAM es la línea del modo local.
  2. Instalas Ollama, conectas el Nodo y dejas que te recomiende el paquete de modelos.
  3. Le encargas una tarea de varios pasos, no una pregunta, y juzgas por el entregable.
  4. Si el equipo no llega, conectas tu clave de API o un Nodo Cloud y sigues igual.

Qué necesitas

  • Ollama con un modelo de 30B (~24 GB entre GPU y RAM) para el principal.
  • Espacio en disco para los modelos de visión y de embeddings del paquete.
  • Si no llegas: tu clave de API, con su tarifa por uso, o un Nodo Cloud alquilado.

Qué te llevas

  • Un paquete de modelos (principal, visión y embeddings) ajustado a esa máquina.
  • Trabajo autónomo de varios pasos sin que ningún prompt salga del equipo.
  • Coste por tarea cero una vez pagada la máquina: no hay contador que mirar.

Más preguntas

¿Sirve un portátil sin GPU dedicada?

Para encargos de un solo paso, sí. Para trabajo de varios pasos se queda corto. En ese equipo la opción sensata es la clave de API: el modelo corre fuera y las herramientas siguen corriendo en tu máquina, así que los ficheros no se mueven.

¿Un modelo local es peor que uno de la nube?

A partir de 30B es perfectamente utilizable para trabajo de varios pasos. Los de frontera siguen siendo mejores en tareas largas y enrevesadas. Lo relevante no es cuál gana en abstracto, sino si el tuyo hace tu trabajo sin que el dato salga.

¿Cuánto cuesta la máquina?

No ponemos precio porque el mercado de GPU se mueve cada trimestre y una cifra desactualizada engaña más que ayuda. Con los 30B y los 24 GB puedes pedir presupuesto a cualquier proveedor y comparar tú, que es lo honesto.

Pruébalo con tus propios documentos

Creas la cuenta, abres el Nodo y le encargas la primera tarea. Es gratis e ilimitado: el cómputo lo pone tu equipo, así que no hay nada que racionar.