Modelos LLM

Elige motor local (Ollama) o API externa. Tres ranuras: chat (pensar), reflect (razonar) y embed (recordar).

En uso ahora

Chat · pensamiento

Reflect · razonamiento

Embed · memoria

1

Fuente del modelo

Local en el VPS, o proveedor cloud con API key

2

Descargar modelo

Recomendados o nombre exacto de Ollama

3

Ranuras locales 0

Elige chat y embed entre los instalados, luego guarda

Cargando modelos…

Guardar y aplicar

Persiste en el servidor y actualiza el motor en caliente