Conectar tu propio servidor de modelo
Mnemosyne puede llamar a un servidor de modelo que sea tuyo en vez de a un proveedor. Sirve cualquier servidor compatible con la API de OpenAI: vLLM, Ollama, TGI, o una pasarela interna. La tarjeta se llama «Tu propio servidor», en los ajustes de Inteligencia.
Los dos campos que cuentan
La URL base es la dirección de tu servidor. Viene de ti y de ningún otro sitio. Hace falta el
esquema: http://host:puerto o https://host:puerto. En una red privada http:// va
perfectamente y no se rechaza. Una dirección sin esquema se rechaza en vez de adivinarse, porque
adivinar haría llamar a la máquina equivocada en silencio.
El nombre del modelo es texto libre. Es el nombre exacto al que responde tu servidor, y no se traduce, ni se completa, ni se sustituye por un valor por defecto. No hay lista donde elegir: nadie más que tú sabe qué aloja tu servidor.
La clave API es opcional. Muchos servidores internos no piden ninguna, y cuando no das ninguna, no se envía ninguna cabecera de autorización.
Comprobar antes de contar con ello
La tarjeta muestra la dirección que se llama de verdad, calculada por la misma función que usan
las respuestas. Así ves si el /v1 que añadiste, u omitiste, produce la llamada que crees.
El botón de comprobación interroga la lista de modelos en esa misma dirección y te dice qué encontró. Un servidor que responde pero no expone catálogo no se declara averiado: es una pasarela que no publica su lista, no una avería.
Lo que esta ruta no hace
No trata imágenes. Un adjunto visual se rechaza antes en vez de enviarse a un servidor del que nadie sabe si sabe leerlo.
No muestra coste. Mnemosyne no conoce la factura de tu propia máquina, así que no inventa una cifra y tampoco dice «gratis».