1.Grave ou envie
Grave uma nota de voz ou escolha um arquivo de áudio ou vídeo compatível no seu dispositivo.

Envie um arquivo de áudio ou vídeo, ou grave uma nota de voz, e receba uma transcrição editável. Teste gravações de até 5 minutos sem criar uma conta.
Suporta MP3, WAV, M4A, MP4 e mais
MP3, WAV, M4A, FLAC, OGG, AAC, MP4, MOV, AVI, MKV, WebM
Até 5 minutos sem conta; contas gratuitas recebem 15 minutos por dia. Os arquivos são enviados com segurança ao serviço remoto de transcrição para processamento. Detalhes de privacidade
Atualizar para Pro →Grave uma nota de voz ou escolha um arquivo de áudio ou vídeo compatível no seu dispositivo.

Depois de gravar ou enviar, encaminhe o arquivo ao serviço de transcrição e acompanhe o progresso.

Revise e edite a transcrição; depois, copie ou exporte no formato desejado.

A tecnologia de fala para texto transforma fala gravada em linguagem escrita. Esta ferramenta usa um fluxo de trabalho baseado em arquivos: grava ou aceita um arquivo completo de áudio ou vídeo, envia esse arquivo para o serviço de transcrição e retorna um texto que você pode revisar e editar.
Comece com uma gravação que contenha fala audível. Você pode gravar uma nota de voz no espaço de trabalho ou enviar um arquivo existente de um telefone, computador, aplicativo de mensagens, plataforma de reunião ou câmera.
Após escolher Transcrever, o serviço analisa o sinal de áudio e prevê as palavras que melhor correspondem aos sons falados e ao contexto. Também pode retornar o idioma detectado e informações de tempo quando esses detalhes estiverem disponíveis.
A transcrição retornada abre em um espaço de trabalho editável. Corrija palavras incertas, adicione formatação, copie o texto, exporte-o ou use a transcrição como fonte para as ferramentas de assistente, resumo e tradução.
O controle de upload aceita contêineres comuns de áudio e vídeo, incluindo MP3, WAV, M4A, FLAC, OGG, AIFF, WMA, OPUS, AAC, MP4, MOV, AVI, MKV e WebM. Escolher um fluxo de trabalho específico para o formato pode ajudar a preparar o arquivo fonte correto e a exportação.
MP3 é útil para entrevistas, palestras e gravações compartilhadas porque é amplamente suportado e geralmente menor que um arquivo não compactado. A transcrição ainda precisa de revisão quando a compressão, ruído ou volume baixo obscurecem a fala.
Para detalhes de preparação e revisão adaptados a este formato, use o guia de conversão de MP3 para texto antes de enviar uma gravação importante.
M4A, AAC, OGG e OPUS são comuns em telefones e aplicativos de mensagens. Você pode enviar a gravação salva diretamente quando sua extensão de arquivo for aceita; não é necessário converter toda nota de voz para MP3 primeiro.
Gravações salvas por dispositivos Apple podem seguir o fluxo de trabalho de M4A para texto para verificações específicas do formato.
Arquivos WAV e AIFF frequentemente preservam mais do sinal original, embora um arquivo maior sozinho não garanta uma transcrição melhor. Posicionamento do microfone, saturação, sobreposição e ruído de fundo ainda importam.
Para gravações sem perdas ou estilo estúdio, revise o guia de WAV para texto e sua lista de verificação de qualidade.
Arquivos MP4, MOV, AVI, MKV e WebM podem ser enviados quando a trilha sonora falada é a informação necessária. O serviço transcreve a fala audível da mídia, não descreve o que aparece visualmente em cada quadro.
Para entrevistas, apresentações e filmagens de câmera, o fluxo de trabalho de MP4 para texto explica como preparar o áudio do vídeo para revisão.
Uma transcrição editável é útil para leitura, enquanto legendas também precisam de dados de tempo e estrutura de arquivo de legenda. Contas Pro podem exportar SRT e VTT após a transcrição ser verificada.
Se legendas forem o produto final, siga o guia de áudio para legenda SRT para revisar o tempo e as quebras de linha.
Uma extensão familiar não prova que um arquivo contém áudio reproduzível. Confirme que a gravação abre, contém fala e não está vazia antes de enviar. Se um dispositivo produziu um formato incomum, exporte uma cópia suportada sem recomprimir repetidamente.
O serviço de transcrição pode detectar e transcrever múltiplos idiomas falados, mas o resultado ainda depende do idioma, sotaque, qualidade do áudio e clareza da gravação. A interface do site está localizada em 13 idiomas, e o espaço de trabalho de tradução ativo atualmente oferece 13 opções de idiomas de destino.
Você não precisa assumir uma precisão universal a partir de um rótulo de idioma. Envie a gravação, verifique o idioma detectado mostrado com o resultado quando disponível, e revise se nomes, frases em idiomas mistos e expressões locais foram interpretados corretamente.
Para um exemplo bilíngue focado, veja o guia de transcrição de áudio em espanhol e seus critérios de revisão.
A interface está disponível em inglês, alemão, espanhol, francês, italiano, português, russo, chinês, árabe, japonês, polonês, holandês e vietnamita. A mudança de idioma da interface altera rótulos e orientações; não força a gravação enviada a usar o mesmo idioma.
Após a existência de uma transcrição, a ferramenta de tradução oferece Inglês, Alemão, Espanhol, Francês, Italiano, Português, Russo, Chinês, Árabe, Japonês, Polonês, Holandês e Vietnamita. O menu de destino é um recurso separado da detecção automática do idioma da gravação.
Uma vez que a transcrição está pronta, o espaço de trabalho pode usar esse texto como contexto para três tarefas separadas. Essas ferramentas não substituem a transcrição; elas ajudam você a questioná-la, condensá-la ou criar uma versão traduzida para trabalho.
Use o painel de chat de IA para fazer perguntas baseadas na transcrição, como quais decisões foram tomadas, que datas foram mencionadas ou quais tarefas de acompanhamento aparecem na conversa. Verifique o conteúdo citado contra a transcrição antes de agir.
A ferramenta de resumo condensa a transcrição para que você possa escanear as ideias principais antes de ler passagens importantes na íntegra. Um resumo pode omitir nuances, qualificações ou pontos de vista minoritários, então deve ser usado como auxílio de navegação e não como substituto da revisão.
Escolha um idioma alvo após a transcrição para criar uma versão traduzida do texto. A qualidade da tradução varia com o contexto e terminologia; nomes, números, linguagem jurídica, médica e termos técnicos devem ser verificados por um revisor fluente ou qualificado.
Mensagens de voz são fáceis de enviar, mas difíceis de buscar, citar ou escanear silenciosamente. Salve ou compartilhe o arquivo de áudio real no seu dispositivo, envie-o no espaço de trabalho, aguarde o processamento e então revise a transcrição editável.
Mensagens de voz do WhatsApp comumente usam áudio OGG ou OPUS. Salve ou compartilhe o arquivo da nota de voz do telefone, depois selecione esse arquivo no carregador. Se o sistema operacional alterar o contêiner durante o compartilhamento, confirme que o arquivo resultante ainda reproduz antes do envio.
Para mensagens gravadas no telefone e clipes salvos, o guia de transcrição de memo de voz cobre um fluxo completo de móvel para texto.
Apple Voice Memos frequentemente produzem áudio M4A, enquanto apps gravadores Android podem criar M4A, AAC, OGG ou outro formato suportado. Envie a gravação original clara quando possível, pois encaminhar e recomprimir repetidamente pode dificultar o reconhecimento da fala baixa.
Se precisar capturar uma nova mensagem no navegador, use o fluxo de trabalho de transcrição de gravador de voz desde a gravação até a revisão.
Exporte ou salve o áudio do correio de voz em vez de reproduzi-lo em outro microfone quando o dispositivo permitir essa opção. Áudio direto geralmente evita eco de sala e uma segunda camada de compressão, embora nomes e números para retorno ainda precisem de verificação cuidadosa.
Para detalhes de retorno de chamada e triagem de mensagens, siga o guia de transcrição de correio de voz antes de confiar no texto.
A transcrição cria um documento de trabalho pesquisável a partir de material falado. O fluxo de trabalho mais útil depende se você precisa encontrar evidências, preparar conteúdo, capturar decisões, fazer legendas ou criar uma versão em texto para acessibilidade e revisão.
Uma transcrição ajuda produtores a encontrar citações, esboçar episódios, redigir notas do programa e identificar segmentos que precisam de correção. Nomes de falantes, marcas e reivindicações sensíveis ao tempo devem ser verificadas contra o áudio antes da publicação.
Para preparação de episódios e verificações editoriais, use o fluxo de trabalho de transcrição de podcast como referência específica do formato.
Texto pesquisável pode facilitar localizar decisões, perguntas e temas mais do que avançar em uma gravação longa. Confirme consentimento e regras institucionais antes da gravação, depois distinga declarações literais de qualquer resumo gerado por IA posteriormente.
Pensamentos gravados podem se tornar um rascunho mais fácil de editar do que uma página em branco. Uma transcrição também pode fornecer uma alternativa em texto para material falado, mas publicação acessível pode exigir identificação do falante, sinais sonoros, tempo e correção manual além da transcrição bruta.
Não existe uma única porcentagem honesta de precisão para toda gravação. Os resultados mudam com o idioma falado, qualidade do microfone e codec, ruído de fundo, falantes sobrepostos, distância do microfone, pronúncia e vocabulário usado.
Use a gravação original quando possível, mantenha a fala em um nível audível estável e evite saturação. Se você controla a gravação, posicione o microfone perto o suficiente para fala clara e reduza música, eco, vento e conversas concorrentes.
Nomes, números de telefone, endereços de e-mail, datas, preços, medidas, citações e termos especializados podem mudar de significado quando um caractere ou palavra está errado. Compare esses detalhes diretamente com o áudio antes de compartilhar ou usar a transcrição.
A transcrição é uma representação gerada por modelo da gravação, não prova que cada palavra está correta. Um resumo ou resposta de chat adiciona outra camada interpretativa. Mantenha o áudio, a transcrição corrigida e a saída de IA derivada separadamente para que os leitores saibam qual fonte estão usando.
Você pode testar uma gravação de até 5 minutos sem conta. Uma conta gratuita inclui 15 minutos de transcrição por dia e 10 chamadas de IA por dia. Os arquivos são enviados com segurança para o serviço remoto de transcrição para processamento.
O uso anônimo é destinado a testes curtos. Uma conta gratuita oferece as cotas diárias de transcrição e IA indicadas. O Pro custa US$ 9 por mês ou US$ 84 por ano e é destinado a quem precisa do fluxo de trabalho pago e opções de exportação.
Você pode editar e copiar o resultado no espaço de trabalho. Contas gratuitas podem exportar TXT e JSON. Contas Pro podem exportar adicionalmente SRT, VTT, PDF e DOCX, então a escolha certa depende se você precisa de texto simples, dados estruturados, legendas ou um documento.
A gravação é enviada para um serviço remoto; não é transcrita inteiramente no seu navegador. Antes de enviar áudio confidencial, regulado ou de terceiros, confirme que você tem permissão e que o fluxo de trabalho atende às regras de privacidade, retenção, contratuais e organizacionais aplicáveis ao material.
Respostas claras sobre gravação, arquivos suportados, idiomas, edição, ferramentas de IA, limites de conta, exportações e processamento remoto.