Ajustes → NVIDIA
Un interruptor, para una sola cosa: si los modelos GGUF locales elegidos en la página Inteligencia corren en tu tarjeta NVIDIA. La entrada del carril se llama NVIDIA; la página se titula Ajustes NVIDIA, con el ojo verde de NVIDIA, y su subtítulo dice Aceleración por GPU para los modelos de IA locales.
El interruptor se guarda en cuanto lo cambias. No hay botón Guardar.
Detección
Una vez cargada la configuración, un banner dice lo que la app encontró:
- ✓ GPU NVIDIA detectada: seguido del modelo y su VRAM en MB, sobre fondo verde;
- ⓘ No se detectó ninguna GPU NVIDIA. CUDA necesita una tarjeta GeForce o RTX — deja esta opción desactivada para conservar el backend automático Vulkan/CPU.
La detección es de mejor esfuerzo (reconoce los nombres que reporta el sistema) y no bloquea el interruptor: puedes cambiarlo en cualquier sentido.
Activar la aceleración CUDA
Activar la aceleración CUDA: Priorizar tu GPU NVIDIA para los modelos locales — vuelve a la CPU automáticamente si CUDA no está disponible.
Lo que escribe merece saberse. Encendido pide un backend automático: CUDA se prueba primero, luego Vulkan o la CPU. Apagado fija la CPU. El interruptor nunca pide CUDA a solas, así que encenderlo no puede dejarte con un modelo que se niega a cargar. Todo lo que no sea una elección explícita de la CPU se lee como encendido, así que en una instalación nueva el interruptor está encendido.
Si el ajuste no se puede escribir, el interruptor vuelve atrás y la página imprime No se pudo guardar el ajuste: con el motivo.
El instalador empaquetado incluye los backends CPU y Vulkan para los modelos locales; los binarios CUDA se dejaron fuera para mantener ligera la descarga. En una versión así el interruptor no cambia nada visible: el backend automático se repliega solo. Ayuda donde el backend CUDA está presente.
Por qué activarla
Las cuatro razones de la propia página:
- Inferencia local mucho más rápida — CUDA genera las respuestas varias veces más rápido que en la CPU.
- Descarga los cálculos pesados en la GPU, así tu CPU queda libre para el resto del sistema.
- Ráfagas de cálculo más cortas y eficientes, en lugar de saturar todos los núcleos de la CPU durante minutos.
- Todo permanece 100 % local — modelos más grandes se vuelven utilizables sin ninguna API en la nube.
Reiniciar
Tras cualquier cambio: ⚠ Reinicia la aplicación para aplicar el nuevo backend de GPU. con un botón ámbar Reiniciar (Reiniciando…). El nuevo backend solo se usa tras un reinicio.
Los otros interruptores de GPU
Esta página solo concierne a los modelos de lenguaje locales. Otras tres páginas tienen su propia elección de GPU, separada:
- la página Imágenes cambia el embedder de imágenes a CUDA (Cambiar a GPU);
- la página OCR tiene un motor GPU, MinerU, tras la licencia Engramm;
- la página Apariencia elige el procesador gráfico usado para el renderizado (el mapa neuronal, por ejemplo), sin relación con la inferencia.
El widget Diagnóstico del sistema muestra lo que reporta la máquina.