Transcribir audio a texto con IA en tu navegador

Abre tu grabación y elige Analizar ▸ Transcribir…. Auditius ejecuta Whisper, un modelo de IA de reconocimiento de voz, en tu propio dispositivo: lo descargas una vez, cuando pulsas Descargar, y a partir de ahí tu audio nunca sale del navegador. Cada palabra guarda su tiempo, así que puedes hacer clic en ella para oírla y exportar subtítulos.

  • Gratis
  • Sin instalar nada ni crear cuenta
  • Tus archivos no salen de tu ordenador
  • En español e inglés

Cómo transcribir una grabación paso a paso

La transcripción trabaja sobre el archivo abierto en el editor o sobre la parte que selecciones.

  1. Pulsa Abrir una grabación para transcribir, o usa Archivo ▸ Abrir… (Ctrl+O), y elige tu audio.
  2. Si solo quieres transcribir una parte, selecciónala arrastrando. Si no, se usa el archivo entero.
  3. Elige Analizar ▸ Transcribir…
  4. Escoge el Modelo: Preciso (small, 252 MB) o Rápido (base, 80 MB). Pon el Idioma en Detección automática, Español o Inglés, y el Rango en Selección o Todo el archivo.
  5. La primera vez, pulsa Descargar. El modelo se guarda en este navegador, así que solo lo descargas una vez.
  6. Pulsa Transcribir. Al terminar, el texto aparece en el panel Transcripción, junto a la forma de onda.
  7. Haz clic en cualquier palabra para reproducir desde ella, o Mayús+clic en otra para seleccionar el audio hasta ella.

Qué puedes hacer con la transcripción

La transcripción es algo más que texto: cada palabra conserva su inicio y su final en la grabación.

  • Mientras suena el archivo, la palabra actual se resalta en el panel Transcripción.
  • Exportar SRT y Exportar VTT guardan subtítulos. Las líneas se cortan al final de cada frase y en las pausas largas, no pasan de 42 caracteres ni de 6 segundos y siguen la línea de tiempo del archivo aunque solo hayas transcrito una selección.
  • Añadir marcas por frase crea una marca de rango por cada frase, en un solo paso que puedes deshacer. Las encuentras en Edición ▸ Lista de marcas…, listas para saltar de una frase a otra.
  • Si cierras el panel, Ventana ▸ Transcripción lo vuelve a mostrar. Archivo ▸ Guardar sesión… conserva la transcripción junto al archivo.

Cómo elegir el modelo y conseguir mejor texto

Preciso (Whisper small) es el que conviene para español. Rápido (Whisper base) va unas tres veces más deprisa, pero en español se equivoca bastante, así que resérvalo para borradores.

  • La Detección automática decide el idioma con los primeros 30 segundos. Si la grabación empieza con música o en otro idioma, elige tú el idioma.
  • Los fragmentos muy cortos se transcriben mal. Dale al menos unos segundos de voz.
  • Las grabaciones largas se procesan en ventanas de 30 segundos mientras avanza una barra de progreso. El navegador usa la tarjeta gráfica mediante WebGPU cuando puede, y si no, el procesador, que es más lento.
  • Si editas el audio después de transcribirlo, el panel avisa de que los tiempos de las palabras pueden no coincidir. Pulsa Volver a transcribir para actualizarlos.

Adónde va tu grabación

A ningún sitio. Los archivos del modelo se descargan la primera vez que pulsas Descargar y se quedan en este navegador. Después, la transcripción se hace en tu dispositivo, y tanto el audio como el texto se quedan ahí, así que sirve para entrevistas, reuniones y otras grabaciones privadas.

Preguntas frecuentes

¿En qué idiomas puede transcribir Auditius?

Puedes elegir español o inglés, o dejar que la Detección automática decida con los primeros 30 segundos. Para español, usa el modelo Preciso.

¿Tengo que descargar el modelo de transcripción cada vez?

No. Tras la primera descarga se queda en este navegador y se reutiliza. El primer modelo que descargas trae además un motor de 27 MB que comparten los demás. Puedes borrar los modelos cuando quieras desde la ventana de modelos del menú Opciones.

¿Cómo saco subtítulos SRT o VTT de una grabación?

Transcríbela con Analizar ▸ Transcribir… y pulsa Exportar SRT o Exportar VTT en la parte de arriba del panel Transcripción. Las líneas de subtítulo se construyen con los tiempos de cada palabra.

¿Se sube mi grabación para transcribirla?

No. El modelo de reconocimiento de voz se ejecuta en tu navegador, en tu propio dispositivo. Solo se descarga el modelo, una vez; tu audio y el texto resultante no se envían a ningún sitio.

¿Puedo transcribir el audio de un vídeo?

Auditius no abre archivos de vídeo. Exporta la pista de audio desde tu programa de vídeo, ábrela aquí y transcríbela; los subtítulos que exportes en SRT o VTT quedan sincronizados con el audio.

Herramientas de audio