Saltar al contenido principal

Ajustes → Imágenes

Theia es la parte de Mnemosyne OS que recuerda imágenes. Esta página la activa, instala lo que necesita y aloja los dos motores que comparten su Python: el recorte de fondo y la generación local de imágenes. La entrada del carril se llama Imágenes; la página se titula Memoria de imágenes (Theia) y su subtítulo dice Tus imágenes se vuelven recuerdos: encuéntralas por significado, color o parecido — todo local.

Cada control de esta página actúa en cuanto haces clic. No hay botón Guardar. La página abre con Cargando estado…; si el estado no se puede leer, No se pudo leer el estado de Theia. y Reintentar.

Para lo que la memoria de imágenes hace una vez en marcha, mira Theia y Memoria de imágenes; para las imágenes en la Galería y el Estudio de imágenes, mira sus páginas. Esta página trata de los ajustes.

Activación

Activar la memoria de imágenes: Las carpetas vigiladas empiezan a ingerir las imágenes (png, jpg, webp…). Desactivado = nada cambia. Apagado por defecto, guardado al instante.

Opt-in, y solo para carpetas nuevas

Con el interruptor apagado, nada cambia respecto a las imágenes. Encenderlo añade las extensiones de imagen a las carpetas nuevas que vincules en Configurar DocWatch; una carpeta vinculada antes conserva su lista de extensiones hasta que la edites con .

Instalación

Se muestra una vez encendida la memoria de imágenes. Tres pasos en escalera: un paso hecho dice ✓ Listo, uno por hacer muestra un botón, uno en curso muestra un indicador giratorio, la etapa (Preparando el entorno, Instalando dependencias, Finalizando) y un porcentaje, con una barra violeta bajo la escalera. Las tareas corren en segundo plano y sobreviven a salir de la página, una a la vez: Otra tarea de Theia ya está en curso — espera a que termine.

  1. Motor de visión: Runtime Python local para el embedder de imágenes (~500 MB, una sola vez). Botón Instalar.
  2. Modelo SigLIP 2: Los pesos del modelo de imagen (~1,5 GB), fijados a una versión exacta. Botón Descargar, disponible una vez listo el motor.
  3. Indexar tus imágenes: Calcula vectores, miniaturas y paletas de color para las imágenes ya presentes en tus cofres. Botón Indexar ahora, disponible una vez listos motor y modelo. Este paso nunca se marca como hecho: es una pasada que puedes repetir.

Mientras corre una pasada, una línea la cuenta: el cofre, n imagen(es) indexada(s), hechas/total (pct%) cuando se midió un total (nunca un porcentaje inventado), y n fallo(s) cuando los hay.

Con motor y modelo listos y nada en curso, un recuadro de estado dice uno de: Pasada de indexación en curso…, Pasada programada — empieza en breve, Última pasada con su hora y n imagen(es) indexada(s) (más, cuando procede, n refrescada(s) sin re-embedding, n fallo(s), n archivo(s) ausente(s)), o Aún ninguna pasada en esta sesión. Debajo: La indexación es automática — al arrancar, cuando llegan imágenes y en la primera consulta. Este botón solo fuerza una pasada inmediata. La página se refresca cada tres segundos mientras una pasada está programada o en curso.

Rendimiento

Se muestra cuando se detecta una tarjeta compatible con CUDA o el motor ya corre en CUDA, y el motor está listo. Aceleración GPU (CUDA): Calcula los vectores de imagen en la GPU (nombre): varias veces más rápido en importaciones grandes. seguido de El runtime CUDA ya está en esta máquina: sin descarga. o Descarga única del runtime CUDA (~2,4 GB). El botón es Cambiar a GPU. El paso solo dice ✓ Listo cuando el motor ha demostrado que corre en CUDA.

Durante el cambio

El runtime se comparte con los motores de voz, así que una máquina que ya pagó los 2,4 GB por uno de ellos lo instala sin conexión. Mientras corre el intercambio, toda tarea de imagen se niega a arrancar; una pasada de indexación en vuelo se detiene limpiamente y se reanuda en la GPU.

Documentos

Se muestra una vez encendida la memoria de imágenes. Extraer las imágenes contenidas en documentos Word: Crea una carpeta _mnemosyne-images en cada carpeta vigilada, con las imágenes encontradas en tus .docx. Desactivado = no se escribe nada. Apagado por defecto: tiene su propio interruptor porque escribe archivos reales en tus carpetas. Encendido: Los documentos que ya están en memoria se leen en el próximo inicio: su contenido no ha cambiado, así que nada los reabre antes.

Los archivos extraídos aterrizan en _mnemosyne-images/<documento>/ dentro de la propia carpeta vigilada, nunca en una carpeta de la app, y esa carpeta la omite la vigilancia para que cada imagen entre en memoria una sola vez.

Motor

Con la memoria de imágenes encendida y el motor caliente, una línea dice Motor: seguido del dispositivo (o cuando se desconoce) y el id del modelo.

Recorte de fondo

Se muestra en cuanto el motor está listo, incluso con la memoria de imágenes apagada. Dos tarjetas, Estándar (BiRefNet lite · 224 MB · unos segundos por imagen, la predeterminada) y Alta calidad (BiRefNet completo · 973 MB · los mejores bordes para fotos), guardadas al instante. Cada tarjeta añade · se descarga en el primer uso hasta que sus pesos están en disco, y luego ✓ Listo.

Lo usa el clic derecho → Quitar el fondo en los stickers y fotos del lienzo. El modelo elegido se descarga en el primer uso. Las imágenes de 768 px o menos usan siempre el Estándar: a ese tamaño el resultado es idéntico y mucho más rápido.

Ambos modelos tienen licencia MIT y el recorte corre en la CPU. El gesto en sí está en el Lienzo.

Generar en esta máquina

Se muestra una vez listo el motor: el motor local de generación de imágenes, el mismo panel que el Estudio de imágenes pliega en su carril. Toma prestado el Python del motor de visión.

  • Cargando los modelos… mientras carga la lista; No se pudo leer la lista de modelos. y Reintentar si falla.
  • Un chip de memoria mientras un modelo está en RAM: su tamaño en GB, o En memoria cuando el tamaño no se puede leer (nunca 0). El modelo está cargado en RAM para que la siguiente imagen empiece de inmediato. Se libera solo tras diez minutos sin uso. Liberar lo libera ahora.
  • Una línea de máquina: n GB de RAM, m de memoria de vídeo, o una cantidad ilegible de memoria de vídeo cuando la app no puede leerla.
  • Cuando faltan las dependencias: Instalar el motor local, y luego Instalando con un porcentaje y la etapa.

Cuenta de Hugging Face

Se muestra cuando el catálogo contiene un modelo con licencia por aceptar o hay un token guardado. Algunos modelos se niegan a descargarse sin una cuenta propia. Mnemosyne no guarda ninguna copia: usted acepta la licencia en la página del editor y presta un token que puede revocar.

  • Sin conectar: Basta con un token de lectura. No pegue uno con permiso de escritura., un enlace Crear un token de lectura que abre la página de tokens de Hugging Face en tu navegador, un campo de contraseña (hf_...) y Conectar (Comprobando...).
  • Conectado: ✓ Cuenta conectada, y luego Comprobar y Desconectar.
  • Veredictos: Conectado como nombre; Hugging Face rechazó este token. Cree uno nuevo y vuelva a conectarse.; No se pudo contactar con Hugging Face: el token está guardado pero sin comprobar. (un desconocido, no un error); Eso no parece un token de Hugging Face, que normalmente empieza por hf_. Guardado de todos modos.
  • Rechazos antes de guardar nada: Pegue primero un token., Ese token contiene un espacio o un salto de línea. Cópielo de nuevo por sí solo., Eso es una dirección web, no un token. Ábrala y copie el token que muestra., y Esta máquina se negó a guardar el token de forma segura, así que no se guardó nada.

El token se sella en el llavero del sistema y nunca se vuelve a leer; el campo se vacía una vez guardado.

En un llavero Linux que no sella

Cuando el llavero del sistema es el backend en claro basic_text, una línea roja lo dice: En esta máquina el llavero del sistema sella los secretos con una clave públicamente conocida: considere este token guardado en claro. La página nunca lo oculta.

El catálogo de modelos

Una barra de orden: Por categoría (por defecto), Para esta máquina, Más rápido, Mejor calidad. Las categorías, ocultas las vacías: Ilustración, Anime y manga, Fotográfico, Rápido, menos detalle, Polivalente, Gama alta, para una estación de trabajo.

Cada fila: el nombre, un chip recomendado en el modelo sugerido, el tamaño en GB, y cómo encaja en esta máquina: rápido aquí, lento aquí, demasiado grande para esta máquina, o velocidad desconocida. Un modelo con licencia por aceptar dice Necesita su cuenta de Hugging Face, lleva un botón Abrir la página de este modelo en Hugging Face, y queda desactivado hasta que se conecta una cuenta (Este modelo exige aceptar su licencia. Conecte su cuenta de Hugging Face y luego acepte la licencia en la página del modelo.).

  • Descargar cuenta pct% · etapa con un botón Detener: Detiene la descarga. Lo ya descargado se conserva, así que se reanuda donde quedó. Una descarga detenida dice Detenido con Reanudar; una interrumpida muestra Reintentar.
  • Listo: ✓ Listo y una papelera. La papelera pide dos clics (¿Eliminar?): Quita tamaño de este disco. Habrá que descargarlo otra vez., y luego n GB liberados.
  • Una descarga pedida mientras corre otra tarea espera: Un trabajo a la vez: este empieza cuando termine el que está en curso. La licencia de cada modelo es la ayuda emergente de su botón de descarga.

Tus propios modelos

Tus propios modelos lista lo que añadiste, cada uno con un botón Quitar, y un campo, autor/modelo, o una carpeta de este disco, con un + (Añadir un modelo) para añadir uno.

La línea de abajo

Todo se ejecuta en esta máquina: el modelo lee tus imágenes en local y las miniaturas se guardan dentro del cofre, protegidas como los recuerdos a los que pertenecen. Los errores de cualquier acción se imprimen abajo con y el mensaje. En Windows, un arranque de motor rechazado dice Windows se negó a iniciar el motor de imágenes. Reiniciar Mnemosyne lo soluciona; si vuelve a ocurrir, reinicia el ordenador.

Lo que sale de la máquina en esta página: un token de Hugging Face, enviado a Hugging Face cuando lo conectas o lo compruebas y cuando se descarga un modelo con licencia por aceptar; las propias descargas de modelos. Tus imágenes, nunca.

Trampas

  • La memoria de imágenes es opt-in y solo toca las carpetas vigiladas nuevas; edita las antiguas a mano.
  • La extracción de imágenes de documentos escribe archivos en tus carpetas vigiladas; es su propio interruptor, apagado por defecto, y los documentos ya en memoria se ponen al día en el próximo inicio.
  • El cambio a GPU descarga unos 2,4 GB una vez y nunca se marca como hecho sin prueba de que CUDA funciona.
  • Los modelos de generación con licencia por aceptar necesitan tu propia cuenta de Hugging Face y tu propia aceptación de la licencia, en Hugging Face.
  • Eliminar un modelo de generación descargado es una retirada del disco en dos clics, irreversible.