Qué hace la herramienta
La herramienta convierte la voz de un audio en texto editable con un modelo Whisper basado en el navegador. Antes de la transcripción, el navegador puede preparar el audio mediante un decodificador WASM, descargar el modelo y luego usar los recursos de tu computadora o teléfono.
Cómo usarla
- Añade un archivo de audio en un formato compatible con tu navegador.
- Elige un idioma de voz o mantén la detección automática.
- Inicia la transcripción y observa las etapas: preparación de audio, carga del modelo, reconocimiento y resultado.
- Revisa el texto, edítalo si es necesario y luego cópialo o descarga un archivo TXT.
Formatos, calidad de voz y precisión
El transcriptor sirve para notas de voz, entrevistas, clases, podcasts y audios de mensajería. Normalmente funcionan MP3, WAV, M4A, OGG, WebM y otros archivos cuando el navegador o el decodificador WASM pueden leerlos. Después de abrirlos, el sonido se prepara para el reconocimiento, así que la claridad de la voz importa más que el contenedor original.
El ruido, la música de fondo, el eco, varias personas hablando a la vez y las grabaciones muy bajas reducen la precisión. Un bitrate alto no garantiza una transcripción mejor, pero el audio muy comprimido con artefactos es más difícil de reconocer. Para podcasts y subtítulos conviene dividir grabaciones largas y revisar nombres, números y términos técnicos.
Procesamiento local y límites del navegador
El reconocimiento se ejecuta en tu dispositivo: el navegador descarga el modelo Whisper y usa CPU, memoria y a veces aceleración de hardware. El archivo de audio no se sube al servidor de All Tools, por lo que la herramienta es práctica para notas de trabajo, borradores de transcripción y mensajes personales.
La primera ejecución puede tardar porque el modelo debe cargarse. Las grabaciones largas consumen mucha memoria, sobre todo en teléfonos y portátiles antiguos; si la pestaña se cierra o aparece un error, prueba con un archivo más corto, cierra otras pestañas o usa un navegador de escritorio.