Aller au contenu principal

Réglages → Intelligence

Les deux modèles sur lesquels Mnemosyne OS tourne se choisissent ici : celui qui transforme vos notes en vecteurs (la mémoire) et celui qui vous répond (l'intelligence). L'entrée du rail s'appelle Intelligence ; la page est titrée Moteurs IA et son sous-titre dit Configure l’embedding sémantique et l’intelligence de Mnemosyne OS.

Contrairement à la page Voix, celle-ci a un bouton Enregistrer, et presque rien n'est écrit tant que vous ne l'avez pas pressé. Les rares exceptions sont listées en fin de page.

Pour ce que les modèles sont (crédits, routes, ce qu'est un vecteur), voir Modèles et crédits. Cette page parle des réglages.

L'en-tête : Enregistrer, le mode actif, l'avertissement du trousseau

  • Enregistrer est en haut à droite. Il est mis en valeur dès que quelque chose a changé, et un badge ● Non enregistré apparaît à côté. Après un enregistrement il dit Enregistré ✓ pendant deux secondes.
  • Enregistrer fait deux choses. Tout ce qui n'est pas un secret (mode, modèle et dimension d'embedding, modèle d'intelligence, interrupteur de fallback, modèles choisis par provider, adresse de votre propre serveur) est gardé dans les réglages de l'app. Les clés API passent par un autre chemin : le processus principal écrit chaque clé non vide dans ~/.mnemosyne/keys.enc, un fichier chiffré avec le trousseau du système (DPAPI sous Windows, Keychain sous macOS, libsecret ou kwallet sous Linux). Une clé enregistrée n'est jamais renvoyée à la page de réglages : le champ affiche un état « enregistrée » masqué à la place.
  • Mode actif est un badge, pas un choix. Il dit Hybride quand le mode d'embedding est hybride, Cloud quand l'embedding et l'intelligence tournent tous deux dans le cloud, 100% Local quand les deux tournent sur votre machine, et Hybride pour tout autre mélange.
Quand l'OS ne sait pas chiffrer

Si le trousseau du système est indisponible, un bandeau ambre apparaît sous l'en-tête : Le chiffrement de l'OS est indisponible sur cette machine — les clés API ne peuvent pas être enregistrées de façon sécurisée et ne survivront pas à un redémarrage. L'app refuse d'écrire une clé en clair. La clé que vous tapez marche pour la session en cours ; elle a disparu au prochain lancement.

Le reste de la page est trois colonnes numérotées. Sur une fenêtre de réglages étroite elles se replient sur deux, puis une, la colonne d'intelligence en premier.

Colonne 01 — Embedding

Modèle de vectorisation sémantique. Un encadré d'avertissement permanent se tient sous le sous-titre : ⚠ Changer après indexation = ré-indexation complète de tous les vaults.

Le mode d'embedding

Trois cartes empilées. Le défaut est 100% Local.

CarteLa note de l'app
100% LocalLocalLlama / Ollama uniquement. Zéro réseau. Aucune donnée ne quitte ta machine.
100% CloudN’importe quel provider cloud configuré (Vertex, OpenAI, Jina…). Haute précision.
HybridLocal + Cloud en parallèle simultané. Si internet tombe — le vecteur local est déjà là.

Hybrid sélectionné, un bandeau ambre répète la note de la carte. L'hybride calcule deux vecteurs pour chaque chronique : le modèle local primaire, plus le text-embedding-004 de Google via Vertex, en parallèle. Il a donc besoin du JSON de compte de service Vertex de la colonne 03.

La formulation de la carte locale

La carte locale dit encore « LocalLlama / Ollama ». L'embedder local tourne en réalité dans le processus de l'app ; il n'y a aucun chemin Ollama. La phrase est un héritage, le comportement est celui que vous voulez : zéro réseau.

Dimensions

Une rangée de pastilles : 384D, 512D, 768D ★, 1024D, 1536D. La rangée s'appelle Dimensions en mode cloud et Primaire en mode local ou hybride. 768 est la dimension native et le défaut ; l'étoile ne s'affiche que tant qu'elle est active. Choisir une dimension sélectionne automatiquement le premier modèle du catalogue à cette taille, et une ligne sous les pastilles compte n modèles disponibles (local et cloud ensemble). Si la dimension active n'est pas 768, un encadré répète l'avertissement de ré-indexation.

Le modèle d'embedding

Des cartes à cliquer, filtrées par mode (modèles locaux en mode local et hybride, modèles cloud en mode cloud) et par dimension. Chaque carte montre un glyphe (local) ou (cloud), le nom, des étiquettes et la taille du téléchargement. Le modèle recommandé porte une puce ★ Recommended (la puce est en anglais dans toutes les langues) et se classe en premier : nomic quand l'interface est en anglais, multilingual-e5 pour toute autre langue. Ce modèle local 768D recommandé est aussi la sélection par défaut.

ModèleDimsTourneTailleÉtiquettes
all-MiniLM-L6-v2384local22 MBultra-light, fast
paraphrase-MiniLM-L12-v2384local120 MBmultilingual
jina-embeddings-v2-small-en512local65 MBJina AI, 8k ctx
nomic-embed-text v1.5768local274 MBmultilingual, ★ pour l'anglais
multilingual-e5-base768local278 MBMicrosoft, multilingual, ★ pour les autres langues
bge-base-en-v1.5768local210 MBBAAI
Jina AI (cloud)768cloudcloud, API key (jina-embeddings-v3)
Vertex gecko768cloudGoogle Cloud, cloud (text-embedding-004)
bge-large-en-v1.51024local617 MBhigh precision, BAAI
gte-large1024local620 MBAlibaba DAMO
OpenAI text-embedding-31536cloudcloud, OpenAI, API key (text-embedding-3-small)

Sous le modèle local sélectionné, un contrôle de téléchargement : ↓ Télécharger depuis HuggingFace, puis une fine barre de progression avec le pourcentage, la vitesse et l'ETA et un bouton Annuler, puis Enregistré ✓ une fois les poids sur le disque. Les modèles déjà téléchargés sont détectés à l'ouverture de la page.

Deux messages de liste vide s'affichent en anglais dans toutes les langues : — Configure a cloud provider in column 3 (mode cloud sans modèle cloud à cette dimension) et — No models at this dimension.

Même dimension, espace différent

Changer le mode, le modèle ou la dimension d'embedding une fois vos vaults indexés casse le rappel tant que chaque vault n'est pas re-vectorisé. Même à dimension égale, un modèle différent est un espace vectoriel différent. Enregistrer vous demande confirmation avant de laisser passer (voir Changer le modèle d'embedding), et la re-vectorisation elle-même est Tout reconstruire sur la page Vaults.

Colonne 02 — Intelligence

Comprend, raisonne, répond. Facilement configurable. La sélection par défaut est la première ligne de Google DeepMind, affichée Gemini 3.6 Flash.

La barre d'outils en haut de la colonne porte Coûts à gauche (il ouvre le journal des appels) et, à droite, deux boutons de vue : Vue liste () et Vue logos (). La vue est mémorisée entre les sessions ; la vue liste est le défaut.

J'ai mes propres API

Un encadré au-dessus du choix de modèle, toujours affiché :

  • J'ai mes propres API — pas de crédits offerts, une case à cocher. Masque la demande de crédits gratuits. Ton solde reste intact. C'est une préférence : elle masque la demande de crédits gratuits du portefeuille et laisse la quête beta accepter une clé à vous. Elle ne touche jamais le solde côté serveur et se décoche.
  • Cochée, la case vérifie votre route (un appel de catalogue gratuit, aucun token dépensé) et imprime un verdict, avec un bouton ↻ Revérifier. Pendant la vérification : Vérification de ta route…
VerdictCe que ça veut dire
Aucune intelligence configurée pour l'instant.Rien de sélectionné. En couleur d'avertissement.
Modèle local actif — rien ne quitte cette machine.Un modèle GGUF local est le modèle principal.
Encore sur les crédits offerts, pas sur ta clé.Mnemosyne Cloud est sélectionné.
OpenAI a confirmé ta clé. (avec le nom du provider)La liste de modèles du provider a répondu avec votre clé.
Clé enregistrée pour MiniMax — il n'offre aucun moyen de la confirmer.Le provider ne publie pas de liste. Un inconnu, pas un échec.
OpenAI injoignable — ta clé n'est pas testée, pas refusée.Réseau. Un inconnu, pas un échec.
OpenAI a refusé ta clé.Le provider a répondu par une erreur d'authentification. En couleur d'avertissement.

La vue logos

Une grille de tuiles, une par provider ci-dessous plus une tuile Local. Une tuile dont la clé est enregistrée (ou, pour Google Cloud, dont le JSON est renseigné ; pour votre propre serveur, dont l'adresse est renseignée) est en couleur ; les autres sont grisées avec un cadenas et l'infobulle clé API requise. Cliquer une tuile en couleur change de modèle en un clic. Cliquer une tuile grisée ramène à la vue liste, ouverte sur ce provider. La tuile Local ouvre un panneau vert titré Local · aucune clé requise avec la liste des modèles locaux, son contrôle de téléchargement et le formulaire d'ajout.

La vue liste : les providers

Un groupe repliable par provider. Le groupe qui contient le modèle courant s'ouvre tout seul. Chaque en-tête montre le nom du provider, une indication, et un badge qui nomme le modèle réellement envoyé (votre choix, ou la ligne par défaut).

GroupeIndication sous le nomLigne par défaut
Mnemosyne CloudCrédits sponsorisés · aucune clé APIRapide (Flash Lite · le plus économique en crédits ★) et Raisonnement (Flash · meilleur en génération & raisonnement · consomme ×6 de crédit)
Google DeepMindaistudio.google.comGemini 3.6 Flash et Gemini 3.5 Flash
Google CloudMême JSON que l'embedding ✔Vertex · Gemini 3.6 Flash (Deep Think · raisonnement · JSON partagé ★) et Vertex · Gemini 3.5 Flash (Rapide · JSON partagé)
OpenAIplatform.openai.comGPT-4o
Anthropicconsole.anthropic.comClaude Opus 5
Groqconsole.groq.com · gratuit (limité)Groq / GPT-OSS 120B
Mistral AIconsole.mistral.aiMistral Large
DeepSeekplatform.deepseek.comDeepSeek V4 Flash
Alibaba Model Studiomodelstudio.console.alibabacloud.comQwen3.8-Max
MiniMaxplatform.minimax.io · idéal pour le roleplayMiniMax M2-her (Défaut · roleplay immersif · multi-tour ★) et MiniMax M2 (Défaut · général · raisonnement · code)
Votre propre serveurvLLM, Ollama, TGI ou une passerelle internesa propre carte, plus bas

Pour les groupes qui vont chercher leur liste de modèles en direct (Google DeepMind, OpenAI, Anthropic, Groq, Mistral AI, DeepSeek, Alibaba Model Studio), la ligne par défaut porte une note du type Défaut · raisonnement · modifiable ci-dessous ★ et le vrai choix se fait dans le sélecteur Modèle. Mnemosyne Cloud, Google Cloud et MiniMax montrent des lignes fixes : une ligne radio par modèle.

À l'intérieur d'un groupe

Ouvert, un groupe montre, dans cet ordre :

  1. Le champ de clé API, un par provider. Son libellé est le nom du provider suivi de — API Key (ou — JSON credentials pour Vertex) ; ce suffixe est en anglais dans toutes les langues. Noms de providers : Google AI Studio, OpenAI, Anthropic, Groq, Mistral AI, DeepSeek, Alibaba Model Studio, MiniMax, Vertex AI, Jina AI, OpenAI (embedding), Self-hosted. C'est un champ de mot de passe avec un œil (Afficher la clé / Masquer la clé) et un texte indicatif qui montre le préfixe attendu (AIzaSy…, sk-…, sk-ant-…, gsk_…, jina_…). Dessous : Chiffrée localement — ne quitte jamais ta machine. Une fois une clé enregistrée et le champ intact, la ligne devient ✓ Enregistrée — laisse vide pour la conserver. Les deux lignes MiniMax partagent une seule clé.

  2. Les lignes fixes, pour Mnemosyne Cloud, Google Cloud et MiniMax seulement.

  3. Modèle, le sélecteur, pour tous les providers sauf Google Cloud (le modèle suit le palier) et Mnemosyne Cloud.

    • Charger demande au provider sa propre liste, avec votre clé enregistrée : une clé à moitié tapée n'est jamais sondée. Le bouton dit Interrogation… puis Recharger. Il est grisé tant que rien n'est tapé ni enregistré.
    • Au-delà de trois modèles, une boîte Filtrer… apparaît. Les ids preview, experimental, nightly, alpha, beta et release candidate descendent sous les stables. La liste n'est jamais tronquée ; elle défile.
    • La première ligne est le défaut : son libellé plus Défaut du provider. La choisir efface votre choix.
    • Choisir un modèle dans un groupe qui n'est pas l'actif sélectionne aussi ce provider.
    • La ligne d'état dit Vide = le modèle par défaut du provider. N'importe quel id qu'il accepte marche. au repos, Liste obtenue avec ta clé — suggestions à la saisie. une fois chargée, et Cette clé n'atteint aucun modèle. quand la liste est revenue vide.
    • Saisir un id à la main révèle un champ texte (Id exact du modèle). Un id absent de la liste obtenue est signalé Absent de la liste du provider — sera envoyé tel quel.
    La liste a échoué avecL'app dit
    UNSUPPORTEDCe provider ne publie pas de liste — saisis l'id.
    NO_KEYRenseigne d'abord une clé.
    AUTHClé refusée par le provider.
    HTTPLe provider a renvoyé une erreur — voir les logs.
    NETWORKProvider injoignable.
    UNAVAILABLECette build ne sait pas lister les modèles — redémarre l'app.

    Le détail brut s'imprime en monospace sous la phrase. Taper une nouvelle clé efface le verdict précédent.

  4. Ton tarif provider, pour tous les providers sauf Mnemosyne Cloud : deux champs décimaux, ↑ pour l'entrée et ↓ pour la sortie, en $ / 1M tokens. Ils s'enregistrent quand vous quittez le champ, et seulement si les deux sont remplis : Les deux champs ou aucun — un demi-tarif chiffrerait un côté et mettrait l'autre à zéro. Il n'y a aucune grille de prix embarquée, par choix. Le tarif alimente le panneau des Coûts.

Entrer une clé API cloud

  1. Créer une clé chez le provider

    L'indication sous le nom de chaque provider pointe vers sa console (aistudio.google.com, platform.openai.com, console.anthropic.com…). Créez une clé là-bas et copiez-la. Pour Google Cloud il vous faut à la place un fichier JSON de compte de service, entré dans la colonne 03.

  2. Ouvrir le groupe du provider

    En Vue liste, cliquez l'en-tête du provider. En Vue logos, cliquez sa tuile grisée : la page repasse en vue liste, ouverte dessus.

  3. Coller la clé

    Collez-la dans le champ libellé du nom du provider et — API Key. Les caractères restent masqués ; Afficher la clé les révèle. La clé n'est pas vérifiée dans sa forme : la seule vérification est la liste de modèles des étapes suivantes.

  4. Enregistrer

    Pressez Enregistrer, en haut à droite. Le bouton dit Enregistré ✓, la clé est écrite dans ~/.mnemosyne/keys.enc, et le champ dit maintenant ✓ Enregistrée — laisse vide pour la conserver. Rien n'est sondé avant ce point.

  5. Vérifier avec la liste de modèles

    Cliquez Charger sous Modèle. Une liste des modèles du provider et la ligne Liste obtenue avec ta clé — suggestions à la saisie. veulent dire que la clé marche. Clé refusée par le provider. veut dire qu'elle ne marche pas. Provider injoignable. ne dit rien sur la clé. Choisissez un modèle, ou laissez Défaut du provider, et Enregistrer de nouveau.

  6. En option : la vérification de route

    Cochez J'ai mes propres API — pas de crédits offerts. Son verdict nomme le provider qui a confirmé votre clé, et ↻ Revérifier répète la vérification quand vous voulez.

Les clés sont rangées par provider, donc entrer une clé dans le groupe ou dans la colonne 03 est le même geste. Il n'y a pas de bouton de suppression pour une clé enregistrée sur cette page (seul le JSON Vertex a un Retirer) ; laisser un champ vide conserve ce qui est enregistré.

Crédits Mnemosyne Cloud

Sélectionner Rapide ou Raisonnement montre une carte de crédits à la place d'un champ de clé. Mnemosyne Cloud est sans clé : l'app signe chaque appel avec votre portefeuille souverain et la passerelle compte le crédit que le fondateur vous a accordé.

  • Crédits Mnemosyne Cloud, avec un bouton ⟳ Actualiser le solde.
  • Pendant la lecture : Vérification du solde de crédits…
  • Puis un gros montant restants, le montant utilisés face au montant accordé, et une barre d'usage qui passe au rouge au-dessus de 90 %. Dessous : Inférence sponsorisée via la passerelle Mnemosyne — aucune clé API requise.
La carte ditPourquoi
Aucun crédit accordé à ce wallet — demande l'accès au fondateur, ou choisis un autre fournisseur.La passerelle ne connaît aucun crédit pour ce portefeuille.
Accès suspendu par le fondateur.Le crédit existe et est suspendu.
Wallet souverain verrouillé — déverrouille-le pour utiliser tes crédits.Le portefeuille est verrouillé.
Service de crédits injoignable suivi d'un codeTout le reste.

Les crédits et ce qu'ils achètent sont expliqués dans Modèles et crédits. La ligne Raisonnement coûte six fois la ligne Rapide par appel, et la note de la ligne le dit.

Votre propre serveur

Le groupe Votre propre serveur est une seule carte : Un serveur compatible OpenAI sur votre propre réseau. Vos questions et les passages retrouvés y vont, et jamais sur l'internet public. Taper dans n'importe lequel de ses champs sélectionne cette route. Elle n'est jamais facturée : le panneau des Coûts montre son coût comme inconnu, pas comme zéro. La suite est dans Votre propre serveur.

  • URL de base, texte indicatif http://10.0.0.12:8000/v1. http:// est accepté volontairement : http:// convient sur un réseau privé. Sous le champ, une ligne à la fois : Appelle : suivi de l'endpoint exact …/chat/completions que la route frappera (sans chemin, /v1 est ajouté ; un chemin tapé est respecté ; un /chat/completions final est retiré) ; ou Ajoutez le schéma : http://hôte:port ou https://hôte:port pour une valeur illisible ; ou Seuls http:// et https:// sont joignables. pour tout autre schéma. Un champ vide à Enregistrer retire l'adresse enregistrée.
  • Modèle, texte libre, texte indicatif Qwen/Qwen2.5-72B-Instruct. Le nom exact auquel votre serveur répond. Il n'y a aucune liste à choisir : votre serveur est seul à le savoir. Le nom est envoyé tel que tapé, jamais traduit, et il n'y a aucun défaut.
  • Clé API (facultative), le même champ chiffré que pour les autres providers. Vide, la route n'envoie aucun en-tête Authorization.
  • Vérifier ce serveur (Vérification… pendant l'appel) interroge /models sur la même base que les réponses, avec l'adresse actuellement dans la boîte, enregistrée ou non. Il est grisé tant que l'adresse ne se lit pas.
  • Utiliser ce serveur sélectionne la route ; sélectionnée, il est grisé et dit Utilisé.
La vérification ditCe que ça veut dire
Joignable. 12 modèles servis. avec des puces cliquables (jusqu'à 12, puis +n autres)Le serveur liste des modèles. Une puce remplit le champ Modèle.
Joignable. Il n'annonce aucun modèle, tapez le nom vous-même.Le serveur a répondu par une liste vide.
Ce serveur a refusé les identifiants. (rouge)L'authentification a échoué.
Aucune réponse à cette adresse. (neutre)Rien n'a répondu : réseau, ou pas d'adresse.
Il a répondu, mais pas par une liste de modèles. Beaucoup de passerelles n'en publient aucune, et les réponses ne passent pas par là. (neutre)Toute autre réponse. Pas un échec.

Le code brut s'imprime à côté de chaque phrase qui n'est pas un succès. Seul le refus est rouge : un inconnu n'est jamais dessiné comme un échec.

Les images sur cette route

Votre propre serveur ne reçoit pas d'images : l'app refuse un envoi d'image sur cette route plutôt que de deviner ce que le serveur sait faire.

Local

Après un séparateur ou, un bandeau vert : Local · aucune clé requise. Les modèles GGUF en dessous tournent dans l'app (via node-llama-cpp, pas Ollama). Chaque ligne montre le nom, une description (en anglais dans toutes les langues), un badge vert ✓ Téléchargé quand le fichier est sur le disque et, pour un modèle que vous avez ajouté, une puce Perso et un contrôle (Supprimer le modèle). Le contrôle de téléchargement (↓ Télécharger depuis HuggingFace, progression, Annuler, Enregistré ✓) se tient sous la ligne sélectionnée.

ModèleLa note de l'app
Qwen3.5 2B (Q4)1.3 GB · RAM min 4 GB · 262k context ★
Qwen3.5 0.8B (Q4)0.5 GB · RAM min 2 GB · smallest that still fits memory
Qwen3 4B Instruct (Q4)2.5 GB · RAM min 5 GB · 262k context · no thinking pass ★
Qwen3.5 4B (Q4)2.7 GB · RAM min 6 GB · 262k context · reasoning
Gemma 4 E2B (Q4)3.1 GB · RAM min 6 GB · 131k context · Google
Gemma 3 4B (Q4)2.5 GB · RAM min 5 GB · 131k context · Google
Qwen3.5 9B (Q4)5.7 GB · RAM min 12 GB · 262k context · reasoning ★
Gemma 4 E4B (Q4)5.0 GB · RAM min 10 GB · 131k context · Google
Qwen2.5 Coder 7B (Q4)4.7 GB · RAM min 8 GB · code
Qwen2.5 Coder 3B (Q4)1.9 GB · RAM min 4 GB · code
Qwen 2.5 3B (Q4)2.0 GB · RAM min 3 GB · 2024
Qwen 2.5 1.5B (Q4)1.0 GB · RAM min 2 GB · 2024
SmolLM2 1.7B (Q4)1.0 GB · RAM min 2 GB · 2024
Phi-3 Mini (Q4)2.2 GB · RAM min 4 GB · 2024 · only 4k context
Llama 3 8B (Q4)4.7 GB · RAM min 6 GB · 2024 · only 8k context
Mistral 7B (Q4)4.4 GB · RAM min 6 GB · 2023
DeepSeek-R1 7B (Q4)4.7 GB · reasoning · 2025
Qwen 2.5 7B (Q4)4.7 GB · RAM min 6 GB · 2024

Les huit derniers sont des modèles dépassés, gardés pour que les installations existantes continuent de marcher.

Le GPU pour ces modèles

Si ces modèles utilisent votre carte NVIDIA se décide sur la page NVIDIA, pas ici.

Ajouter un modèle

Un bouton en pointillés + Ajouter un modèle ouvre un formulaire : Colle un lien HuggingFace, ou choisis un .gguf que tu as déjà.

  • Deux onglets : Lien HuggingFace (un champ texte, texte indicatif https://huggingface.co/owner/repo/blob/main/model.Q4_K_M.gguf) et Fichier local (un chemin en lecture seule et Choisir un .gguf…, qui ouvre une boîte de dialogue filtrée sur .gguf).
  • Nom (facultatif).
  • Annuler et Ajouter ( pendant le travail). En cas de succès le nouveau modèle est sélectionné et son contrôle de téléchargement apparaît.
Le formulaire refuse avec
Colle un lien HuggingFace ou un owner/repo.
Ce modèle est protégé : accepte sa licence sur HuggingFace d'abord.
Introuvable sur HuggingFace — vérifie le lien.
Ce fichier n'est pas un .gguf.
Aucun fichier .gguf dans ce lien — ouvre la page du fichier sur HuggingFace et copie cette URL.
Ça ne ressemble pas à un dépôt HuggingFace (attendu : owner/nom).
Ce modèle est découpé en plusieurs fichiers, impossible à télécharger ici. Choisis une quantisation en fichier unique.
HuggingFace est injoignable. Vérifie ta connexion et réessaie.
Ce fichier n'existe plus à cet emplacement.
Choisis un fichier .gguf.

Tout autre échec montre le message brut. Ajouter ou retirer un modèle perso prend effet tout de suite ; ça n'attend pas Enregistrer.

Fallback local si le réseau tombe

Affiché en vue liste seulement, tant que l'intelligence sélectionnée est un modèle cloud : un interrupteur pleine largeur avec un éclair, Fallback local si le réseau tombe, bascule automatiquement sur un modèle local. Éteint par défaut, et forcé éteint dès que vous choisissez un modèle local comme modèle principal. Allumé, un bloc ambre Modèle de fallback montre une seconde liste de modèles locaux (défaut Phi-3 Mini (Q4)), son contrôle de téléchargement et le formulaire d'ajout.

Colonne 03 — Accès

Le sous-titre dépend de ce que vos choix exigent : Clés API pour les modèles cloud sélectionnés. quand au moins une clé est requise, sinon Aucune clé requise — tout tourne en local.

Une clé est « requise » pour un embedding cloud ou hybride (la clé du provider d'embedding ; l'hybride exige toujours Vertex), pour un modèle d'intelligence cloud (sauf Mnemosyne Cloud, sans clé, et votre propre serveur, dont la clé facultative vit dans sa carte), et pour un modèle Vertex.

  • Rien de requis : un cadenas, Mode 100% Local, Aucune donnée ne quitte ta machine. Les modèles tournent directement dans Mnemosyne OS.
  • Vertex AI (l'en-tête ▲ Vertex AI est en anglais dans toutes les langues), quand l'embedding ou l'intelligence passe par Google Cloud. Un badge vert nomme ce que le JSON sert : Embedding, Intelligence, ou les deux. Sous Service Account JSON, une boîte en lecture seule montre le chemin choisi (ou — Fichier sélectionné), un bouton Parcourir ouvre une boîte de dialogue, et une fois un chemin renseigné un bouton rouge Retirer l'efface. Le chemin n'est pas un secret ; il est gardé dans la configuration de l'app, pas dans le fichier de clés chiffré. C'est le seul identifiant de cette page avec un geste de retrait : un chemin vidé est supprimé au prochain Enregistrer.
  • Les autres providers : un champ de mot de passe par provider requis (Google AI Studio, OpenAI, Anthropic, Groq, Mistral AI, DeepSeek, Alibaba Model Studio, MiniMax, Jina AI, OpenAI (embedding)), texte indicatif Clé API… ou le préfixe du provider. Ce sont les mêmes champs que ceux des groupes de la colonne 02 : taper dans l'un remplit l'autre.
  • Le pied de colonne, avec un cadenas : Toutes les clés sont chiffrées localement dans ~/.mnemosyne/keys.enc.

Changer le modèle d'embedding

Quand le mode, le modèle ou la dimension d'embedding que vous allez enregistrer diffère de ce qui a été enregistré la dernière fois, Enregistrer ouvre une boîte de dialogue au lieu d'enregistrer :

  • Changer le modèle d'embedding ?
  • Tes vaults sont indexés avec le modèle de vectorisation actuel. Le changer ne les ré-indexe PAS automatiquement — tant que tu ne re-vectorises pas chaque vault, la recherche mémoire renverra des résultats incohérents ou vides (même à dimension égale, un modèle différent = un espace vectoriel différent). Re-vectorise tes vaults après la sauvegarde.
  • Annuler / Changer quand même. Cliquer hors de la boîte annule.

Une première configuration, sans rien d'enregistré, ne montre jamais cette boîte. La re-vectorisation elle-même est Tout reconstruire sur la page Vaults, qui purge les vecteurs de chaque vault et relit chaque dossier surveillé.

Le panneau des Coûts

Le bouton Coûts de la colonne 02 ouvre le journal des appels. Il lit le journal local (les 500 derniers appels) et, quand il le peut, le relevé d'usage de la passerelle pour Mnemosyne Cloud. Les deux sont tenus à part parce qu'ils ne sont pas également vrais.

  • Une ligne de totaux : le nombre d'appels, ↑ tokens entrés · ↓ tokens sortis, le coût connu, et, quand des appels n'ont pas de tarif, combien sont non chiffrés. Un journal qui n'a pas été lu affiche , jamais 0. Vider efface le journal local seulement.
  • Les appels BYOK partent de ta machine vers ton provider — le détail facturé est chez lui, il ne nous est pas connu. Renseigne ton tarif, on compte les tokens.
  • Débité — Mnemosyne Cloud, seulement quand la passerelle a renvoyé des entrées : le montant dépensé et une table heure, modèle, tokens entrés et sortis, coût. Quand le relevé est borné : Relevé borné : les appels anciens sortent, donc ces lignes peuvent totaliser moins que le mouvement du solde.
  • La table du journal local : Heure, Modèle, Facturation, ↑, ↓, Coût. La cellule de facturation dit Débité pour Mnemosyne Cloud, Votre serveur pour la route auto-hébergée, Estimé pour tout le reste. Un coût que l'app n'a pas pu calculer affiche , jamais 0. Un appel raté montre son modèle en rouge, l'erreur dans l'infobulle.
  • Lecture du journal… pendant le chargement, Aucun appel enregistré. quand il est vide, Journal indisponible. quand le journal ne se lit pas.

Ce qui s'enregistre, et quand

Rien sur cette page n'est écrit avant Enregistrer, à ces exceptions près :

  • le tarif provider, enregistré quand vous quittez ses champs (les deux remplis) ;
  • la case J'ai mes propres API ;
  • la préférence vue liste / vue logos ;
  • l'ajout ou le retrait d'un modèle perso ;
  • les téléchargements de modèles, qui démarrent au clic.

Et les pièges à retenir :

  • Une clé enregistrée ne revient jamais sur la page et ne peut pas en être supprimée ; vide la conserve. Seul le chemin du JSON Vertex a un bouton Retirer.
  • La liste de modèles n'est jamais obtenue qu'avec une clé enregistrée.
  • Votre propre serveur : l'adresse ne vient que de vous, le nom du modèle est envoyé tel que tapé, et la vérification rapporte « aucune réponse » comme un inconnu, pas comme un refus.
  • Changer l'embedding après indexation exige un Tout reconstruire sur la page Vaults.