Saltar al contenido principal

Calliope, la voz

Las Musas son las hijas de Mnemosyne, y la mayor, Calliope, es literalmente « la de la bella voz ». Así que la voz lleva su nombre: Theia la hermana le da ojos a Mnemosyne, Calliope su hija le da la voz. La app la etiqueta Voice hoy.

Mnemosyne OS escucha y habla. Sube el sonido y mira una conversación real, con la pregunta hecha en el inglés con acento francés del fundador y la respuesta en voz alta:

El modo de voz, en vivo: la aurora escucha, transcribe mientras hablas, y responde en voz alta: transcripción en pantalla.

El modo de voz​

Pulsa el logo Infinity (∞) arriba en la app y el orbe de escucha toma la pantalla, una aurora que reacciona a tu voz. Desde ahí:

  • Habla con naturalidad. Tus palabras se transcriben en vivo bajo el orbe.
  • Di « open notes », o simplemente charla. Comandos y conversación se mezclan libremente.
  • Di « goodbye » (o pulsa Esc) para terminar.

El orbe responde en voz alta y por escrito, así que la respuesta completa queda legible en pantalla mientras la pronuncia.

Las voces​

Tres motores de salida, elegidos durante el onboarding o en cualquier momento en Ajustes → Voz, donde cada control de esa página se explica uno por uno:

  • Sistema (sin conexión): las voces integradas de tu OS, cero descargas.
  • Neural local: voces naturales sintetizadas en tiempo real, a coste cero, en tu propia GPU. El motor se descarga una vez y luego funciona sin conexión para siempre. Estas voces forman parte de la licencia Engramm.
  • ElevenLabs (cloud): trae tu cuenta de ElevenLabs si quieres sus voces.
Tiempo real, coste cero, CUDA necesario

El motor neural local es el punto dulce: síntesis en tiempo real, sin API, sin factura, nada que salga de tu máquina. Necesita una GPU NVIDIA (CUDA) para sostener esa velocidad. Sin CUDA, las voces Sistema siguen funcionando totalmente sin conexión, y ElevenLabs cubre la ruta cloud.

Un botón Probar la voz te deja escuchar antes de decidir. Y en cualquier chat, el interruptor Voz compañera (panel de opciones) hace que las respuestas se lean solas.

Clonar una voz​

Dale a Mnemosyne OS una voz que signifique algo para ti: la de tu ídolo, la de un familiar, la de un ser querido que ya no está. La voz de Mnemosyne se volverá la suya, para ti, en tu máquina.

  • Cinco segundos bastan. Cualquier grabación clara de la persona hablando, un mensaje de voz, un vídeo, es suficiente para empezar.
  • Para el mejor resultado, haz que la voz lea el pasaje de abajo: una habitación silenciosa, el mejor micrófono que tengas, un ritmo natural. Toma unos treinta segundos y cubre lo que el motor necesita, preguntas, números, sonidos suaves y duros:

La memoria es una casa extraña: algunas puertas se abren con un sonido, otras con un perfume. Esta mañana conté tres, trece, treinta y un escalones bajo un cielo de julio. ¿Recuerdas el barco azul, el puerto tranquilo, la tormenta a lo lejos? Pregúntame mañana. Guardaré cada detalle: las risas, el susurro, el matiz exacto de la tarde. Cero cosas olvidadas. Todo, exactamente donde lo dejaste.

Tu voz sigue siendo tuya​

Una voz clonada es un poder lo bastante grande como para que el OS la trate como su primera capacidad sensible. Ninguna app ni ningún agente consigue una voz sin un diálogo que te lo pida antes. No existe ningún camino silencioso, y los cartuchos integrados tampoco tienen atajo.

Dónde más aparece la voz​

  • MnemoReader lee tus PDF en voz alta con los mismos motores.
  • El chat sabe escuchar (micrófono) y hablar (companion voice) sin entrar en el modo de voz completo.