Manual de Usuario — Narrador de Texto a Voz 6.4

Guía completa para utilizar la aplicación sin conocimientos técnicos. Cada módulo se explica por separado, con su función y la forma correcta de usarlo.

Lectura de textoMulti narradorVoces especialesGemini TTSMezclaGrabación y descarga

📝 Módulo 1 — Editor de texto

Aquí se escribe o pega la noticia, cuento, anuncio, guion o cualquier texto que se desea narrar.

Caja principal

Recibe el texto que leerá la voz seleccionada.

Importar archivo

Carga un archivo de texto desde la computadora.

Limpiar texto

Borra el contenido actual para comenzar otro trabajo.

Consejo: usa puntos, comas y signos de interrogación para obtener una lectura más natural.

🗣️ Módulo 2 — Voces del navegador

Son voces disponibles en el navegador o sistema operativo. Normalmente no consumen créditos.

Selector de voz

Elige la voz principal.

Actualizar voces

Vuelve a cargar la lista disponible.

Velocidad

Hace que la voz hable más rápido o más lento.

Tono

Hace la voz más grave o más aguda.

Volumen

Aumenta o reduce el nivel de lectura.

Brillo, calidez y presencia

Permiten aclarar, suavizar o destacar la voz.

🎮 Módulo 3 — Controles principales

ControlFunción
▶ Leer textoComienza la lectura.
Ⅱ PausarDetiene temporalmente sin perder el punto.
▶ ContinuarReanuda desde el punto pausado.
■ DetenerCancela la lectura y, cuando corresponde, la grabación.
Limpiar textoVacía el editor.
● Grabar AudioInicia la captura del sonido.
↧ Descargar audioGuarda el archivo procesado.
Funcionamiento comprobado: el botón cambia a “🔴 Grabando...” y vuelve automáticamente a “● Grabar Audio” cuando la sesión termina.

👥 Módulo 4 — Multi narrador

Permite crear conversaciones con varias voces y textos independientes.

Activar Multi narrador

Cambia de narrador único a varias ventanas.

Agregar narrador

Crea una nueva ventana.

Nombre

Identifica al personaje o participante.

Voz individual

Cada ventana puede usar una voz diferente.

Texto individual

Cada narrador lee solo su propio texto.

Eliminar o limpiar

Quita una ventana o todas las ventanas.

Orden: se reproduce N1, luego N2, N3 y así sucesivamente.

✨ Módulo 5 — Gemini TTS

Genera audio mediante inteligencia artificial.

Usar Gemini TTS

Activa Gemini en lugar de la voz normal.

API Key

Clave personal del usuario; debe mantenerse privada.

Modelo

Selecciona el modelo de generación.

Voz Gemini

Elige la voz disponible en el servicio.

Importante: Gemini puede consumir créditos. Las voces del navegador suelen ser suficientes para trabajos normales sin gastar tokens.

🎚️ Módulo 6 — Procesador de Voz Especial

Este módulo transforma la voz para crear estilos como monstruo, robot, locutor, personaje o tráiler. Cada control modifica una parte concreta del sonido.

Encendido y control general

● ACTIVO

Enciende el procesador y aplica la voz especial a la grabación final.

↻ RESET

Devuelve todos los controles a sus valores iniciales.

● BYPASS

Permite escuchar la voz original sin borrar los ajustes.

AudioCore Engine

Indica que el motor de procesamiento está disponible.

Navegación del procesador

BACK

Regresa a la opción o preset anterior.

NEXT

Avanza a la opción o preset siguiente.

MENU

Abre las opciones internas del procesador.

ENTER

Confirma la opción seleccionada.

Frecuencia, ganancia y gráfica

FREQ

Controla el tiempo o frecuencia principal del efecto.

GAIN

Aumenta o reduce la fuerza del efecto.

Gráfica central

Muestra visualmente cómo se modifica el sonido.

IN / OUT / COMP

Indican entrada, salida y acción del compresor.

Canales e indicadores de señal

INPUTS 1–4

Muestran las señales que entran al procesador.

EDIT 5–6

Representan las etapas donde se modifica la voz.

OUTPUTS 7–9

Muestran la señal después del procesamiento.

Casillas azules

Activan o desactivan cada canal.

Barras de nivel

Verde es normal; amarillo, fuerte; rojo, saturación.

Controles de procesamiento

PROF. — Profundidad

Hace la voz más profunda o más ligera.

PRES. — Presencia

Añade claridad y cercanía a la voz.

SAT. — Saturación

Agrega fuerza y carácter al sonido.

ECO

Define el retraso de la repetición.

CANT. — Cantidad

Controla cuánto eco se añade.

MIX

Mezcla la voz original con la procesada.

COMP. — Compresión

Equilibra las partes suaves y fuertes.

ATAQ. — Ataque

Define qué tan rápido actúa el compresor.

SAL. — Salida

Ajusta el volumen final del procesador.

Presets y configuraciones guardadas

Guardar preset

Guarda la combinación actual de controles.

Preset actual

Muestra el estilo de voz seleccionado.

Lista desplegable

Permite elegir directamente otro preset.

Cargar preset

Recupera una configuración guardada.

Cómo leer los valores: debajo de cada control aparece su valor actual. Puede mostrarse en milisegundos, decibelios, porcentajes o números decimales. Mueve los controles poco a poco y escucha el resultado.
Para evitar distorsión: si las barras permanecen en rojo o la voz suena quebrada, reduce SAT., CANT., MIX, GAIN o SAL. y vuelve a probar.
Configuración de ejemplo observada: “Monstruo profundo” combina profundidad alta, presencia moderada, saturación reforzada, eco corto, poca cantidad de eco, mezcla alta, compresión media y salida controlada.

🎛️ Módulo 7 — Mezclador de audio

ControlFunción
Voz principalNivel de la narración.
EfectosVolumen de efectos adicionales.
Tono de fondoNivel de música o ambiente.
MicrófonoNivel del micrófono cuando se incluye.
SistemaNivel del audio capturado del equipo.
Salida maestraVolumen final de toda la mezcla.
Solo TTSDa prioridad a la voz generada.
Incluir sistemaAgrega el sonido del sistema.
Incluir micrófonoAgrega el micrófono.
Normalización automáticaAjusta el nivel general.
Recortar silencioElimina silencios innecesarios.
PerfilGuarda o recupera una configuración completa.

🎵 Módulo 8 — Efectos y tonos

Efecto de voz

Agrega un efecto adicional.

Tono de fondo

Agrega música o ambiente.

Actualizar

Vuelve a cargar los catálogos del backend.

Limpiar efectos

Retira el efecto y el tono seleccionados.

🔴 Módulo 9 — Grabación

Pulsa ● Grabar Audio.
Comprueba que cambie a 🔴 Grabando....
Pulsa ▶ Leer texto o reproduce el audio.
Pulsa ■ Detener o espera el cierre automático.
Espera el procesamiento.
Descarga el resultado.
Protección aprobada: la grabación se detiene después de 1 minuto continuo sin señal. Mientras haya audio, no existe un límite total de duración.

💾 Módulo 10 — Descargas

MP3

Formato práctico para compartir y publicar.

WAV

Formato de mayor calidad para edición.

MP4

Formato compatible con usos audiovisuales.

Eliminar

Borra el archivo generado y limpia la línea de tiempo.

🕘 Módulo 11 — Historial reciente

Modo utilizado

Muestra si fue narración normal o multi narrador.

Voces

Muestra las voces empleadas.

Resumen

Presenta una parte corta del texto.

Limpiar historial

Borra las referencias guardadas en el navegador.

🚀 Guías rápidas

Narración sencilla

Pega el texto.
Elige una voz.
Ajusta velocidad, tono y volumen.
Pulsa Leer texto.

Crear un MP3 procesado

Pega el texto.
Elige voz y procesador especial.
Pulsa Grabar Audio.
Pulsa Leer texto.
Detén o espera el cierre automático.
Descarga el MP3.

Conversación con varias voces

Activa Multi narrador.
Agrega ventanas.
Asigna nombre, voz y texto.
Pulsa Leer texto.

🛠️ Problemas comunes

SituaciónSolución
No aparecen vocesPulsa Actualizar voces y espera unos segundos.
No se escucha la narraciónRevisa el volumen del navegador, sistema y aplicación.
El archivo queda en silencioComprueba que haya audio real durante la grabación.
El botón sigue grabandoEspera el cierre automático o pulsa Detener.
No se activa DescargarEspera a que finalice el procesamiento.
Gemini muestra errorRevisa API Key, modelo y tiempo de respuesta.
Demasiado ecoReduce Eco, Ganancia o Mix.
La voz distorsionaReduce Saturación, Output o volumen maestro.
No cargan efectosComprueba el backend y pulsa Actualizar.