Saltar al contenido principal

Voz

Mnemosyne OS no solo escribe — escucha y habla. Sube el sonido y mira una conversación real (pregunta hecha en el inglés con acento francés del fundador, respuesta en voz alta):

El modo de voz, en vivo: la aurora escucha, transcribe mientras hablas, y responde en voz alta — transcripción en pantalla.

El modo de voz

Pulsa el logo Infinity (∞) arriba en la app y la aurora toma la pantalla. Desde ahí:

  • Habla con naturalidad — tus palabras se transcriben en vivo bajo el orbe.
  • Di « open notes » — o simplemente charla: comandos y conversación se mezclan libremente.
  • Di « goodbye » (o pulsa Esc) para terminar.

El orbe responde en voz alta y por escrito — la respuesta completa queda legible en pantalla mientras la pronuncia.

Las voces

Tres motores de salida, elegidos durante el onboarding o en cualquier momento en los Ajustes:

  • System (sin conexión) — las voces integradas de tu OS, cero descargas.
  • Local neural — voces naturales sintetizadas en tiempo real, a coste cero, en tu propia GPU. El motor se descarga una vez y luego funciona sin conexión para siempre.
  • ElevenLabs (cloud) — trae tu cuenta de ElevenLabs si quieres sus voces.
Tiempo real, coste cero — CUDA necesario

El motor neural local es el punto dulce: síntesis en tiempo real, sin API, sin factura, nada sale de tu máquina — y necesita una GPU NVIDIA (CUDA) para sostener esa velocidad. ¿Sin CUDA? Las voces System siguen funcionando totalmente sin conexión, y ElevenLabs cubre la ruta cloud.

Un botón Test voice te deja escuchar antes de decidir. Y en cualquier chat, el interruptor Companion voice (panel de opciones) hace que las respuestas se lean solas.

Clonar una voz

Dale a Mnemosyne una voz que signifique algo para ti: la de tu ídolo, la de un familiar, la de un ser querido que ya no está — la voz de Mnemosyne se volverá la suya, para ti, en tu máquina.

  • Cinco segundos bastan. Cualquier grabación clara de la persona hablando — un mensaje de voz, un vídeo — es suficiente para empezar.
  • Para el mejor resultado, haz que la voz lea el pasaje de abajo: una habitación silenciosa, el mejor micrófono que tengas, un ritmo natural. Toma unos treinta segundos y cubre lo que el motor necesita — preguntas, números, sonidos suaves y duros:

La memoria es una casa extraña: algunas puertas se abren con un sonido, otras con un perfume. Esta mañana conté tres, trece, treinta y un escalones bajo un cielo de julio. ¿Recuerdas el barco azul, el puerto tranquilo, la tormenta a lo lejos? Pregúntame mañana — guardaré cada detalle: las risas, el susurro, el matiz exacto de la tarde. Cero cosas olvidadas. Todo, exactamente donde lo dejaste.

Tu voz sigue siendo tuya

Los motores de voz también saben trabajar con una voz clonada — y ese poder se trata como lo que es: la voz es la primera capacidad sensible del OS. Ninguna app ni agente accede a una voz sin un diálogo explícito que te lo pida — no existe ningún camino silencioso, ni siquiera para los cartuchos integrados.

Dónde más aparece la voz

  • MnemoReader lee tus PDF en voz alta con los mismos motores.
  • El chat sabe escuchar (micrófono) y hablar (companion voice) sin entrar en el modo de voz completo.