Réglages → NVIDIA
Un interrupteur, pour une seule chose : si les modèles GGUF locaux choisis sur la page Intelligence tournent sur votre carte NVIDIA. L'entrée du rail s'appelle NVIDIA ; la page est titrée Réglages NVIDIA, avec l'œil vert de NVIDIA, et son sous-titre dit Accélération GPU pour les modèles d'IA locaux.
L'interrupteur s'enregistre dès que vous le basculez. Il n'y a pas de bouton Enregistrer.
Détection
Une fois la configuration chargée, un bandeau dit ce que l'app a trouvé :
- ✓ GPU NVIDIA détecté : suivi du modèle et de sa VRAM en Mo, sur fond vert ;
- ⓘ Aucun GPU NVIDIA détecté. CUDA nécessite une carte GeForce ou RTX — laissez cette option désactivée pour conserver le backend automatique Vulkan/CPU.
La détection fait de son mieux (elle reconnaît les noms que le système rapporte) et ne verrouille pas l'interrupteur : vous pouvez le basculer dans un sens ou dans l'autre.
Activer l'accélération CUDA
Activer l'accélération CUDA : Privilégier votre GPU NVIDIA pour les modèles locaux — repli automatique sur le CPU si CUDA est indisponible.
Ce qu'il écrit vaut la peine d'être su. Allumé demande un backend automatique : CUDA est essayé d'abord, puis Vulkan ou le processeur. Éteint impose le processeur. L'interrupteur ne demande jamais CUDA seul, donc l'allumer ne peut pas vous laisser avec un modèle qui refuse de se charger. Tout ce qui n'est pas un choix explicite du processeur se lit comme allumé, donc sur une installation neuve l'interrupteur est allumé.
Si le réglage ne peut pas être écrit, l'interrupteur revient en arrière et la page imprime Impossible d'enregistrer le réglage : avec la raison.
L'installeur empaqueté embarque les backends CPU et Vulkan pour les modèles locaux ; les binaires CUDA ont été laissés de côté pour garder le téléchargement léger. Sur un tel build l'interrupteur ne change rien de visible : le backend automatique se replie tout seul. Il aide là où le backend CUDA est présent.
Pourquoi l'activer
Les quatre raisons de la page elle-même :
- Inférence locale bien plus rapide — CUDA génère les réponses plusieurs fois plus vite que sur le CPU.
- Décharge les calculs lourds sur le GPU, votre CPU reste donc libre pour le reste du système.
- Des salves de calcul plus courtes et efficaces, au lieu de saturer tous les cœurs du CPU pendant des minutes.
- Tout reste 100 % local — des modèles plus gros deviennent utilisables sans aucune API cloud.
Redémarrer
Après tout changement : ⚠ Redémarrez l'application pour appliquer le nouveau backend GPU. avec un bouton ambre Redémarrer (Redémarrage…). Le nouveau backend n'est utilisé qu'après un redémarrage.
Les autres interrupteurs GPU
Cette page ne concerne que les modèles de langage locaux. Trois autres pages ont leur propre choix de GPU, séparé :
- la page Images bascule l'embedder d'images sur CUDA (Basculer sur GPU) ;
- la page OCR a un moteur GPU, MinerU, derrière la licence Engramm ;
- la page Apparence choisit le processeur graphique utilisé pour le rendu (la carte neurale, par exemple), sans rapport avec l'inférence.
Le widget Diagnostics système montre ce que la machine rapporte.