O que a ferramenta faz
A ferramenta transforma fala de áudio em texto editável com um modelo Whisper baseado no navegador. Antes da transcrição, o navegador pode preparar o áudio por meio de um decodificador WASM, baixar o modelo e então usar os recursos do seu computador ou telefone.
Como usar
- Adicione um arquivo de áudio em um formato compatível com seu navegador.
- Escolha um idioma de fala ou mantenha a detecção automática.
- Inicie a transcrição e acompanhe as etapas: preparação do áudio, carregamento do modelo, reconhecimento e resultado.
- Revise o texto, edite se necessário e depois copie-o ou baixe um arquivo TXT.
Formatos, qualidade da fala e precisão
O transcritor é útil para notas de voz, entrevistas, aulas, podcasts e áudios de mensageiros. MP3, WAV, M4A, OGG, WebM e outros arquivos costumam funcionar quando o navegador ou o decodificador WASM consegue lê-los. Depois de abrir o arquivo, o som é preparado para reconhecimento, então a fala clara importa mais que o contêiner original.
Ruído, música de fundo, eco, falas sobrepostas e gravações muito baixas reduzem a precisão. Um bitrate alto não garante uma transcrição melhor, mas áudio muito comprimido com artefatos é mais difícil de reconhecer. Para podcasts e legendas, divida gravações longas e revise nomes, números e termos técnicos.
Processamento local e limites do navegador
O reconhecimento roda no seu dispositivo: o navegador baixa o modelo Whisper e usa CPU, memória e às vezes aceleração de hardware. O arquivo de áudio não é enviado ao servidor do All Tools, o que torna a ferramenta prática para notas de trabalho, rascunhos de transcrição e mensagens pessoais.
A primeira execução pode demorar porque o modelo precisa carregar. Gravações longas exigem muita memória, especialmente em celulares e notebooks antigos; se a aba travar ou o navegador mostrar erro, tente um arquivo menor, feche outras abas ou use um navegador de desktop.