Software de fala para texto

Software de fala para texto, sem chute

Envie um arquivo de áudio ou vídeo, ou cole um link para uma gravação. Você recebe uma transcrição com identificação de falantes e marcações de tempo em 99 idiomas, além de resumos, tarefas e exportações limpas. Os primeiros 10 minutos de qualquer arquivo são grátis e sem conta.

Prefere ditar em vez de enviar um arquivo? Experimente a digitação por voz ao vivo no navegador

Os primeiros 10 minutos de qualquer arquivo são grátis sem conta. Contas grátis: 10 minutos de transcrição, uma única vez. Pro: ilimitado, a partir de $9.99/mês na cobrança anual.

Como converter fala em texto

  1. 1
    Traga seu áudioEnvie um arquivo MP3, WAV, M4A, MP4, MOV ou WebM, ou cole um link público para uma gravação. O áudio é extraído do vídeo automaticamente, então não há nada para converter antes.
  2. 2
    Informe o idioma faladoEscolha o idioma antes de começar. Informar isso de antemão permite que o modelo se otimize para o conjunto de sons certo em vez de adivinhar, que é de onde vem a maioria das transcrições no idioma errado. São 99 idiomas, com a saída na escrita nativa.
  3. 3
    Leia, edite e exporteSua transcrição chega com identificação de falantes e marcações de tempo. Ler e copiar é grátis. Os planos pagos acrescentam downloads em TXT, PDF, DOCX, SRT, VTT e JSON, além de resumos com IA, tarefas e decisões.

O que você recebe de volta

Rótulos de falante que separam quem falou e quando ao longo de toda a gravação
Marcações de tempo por palavra às quais você pode saltar, para cada citação continuar verificável
99 idiomas com saída na escrita nativa, não em texto romanizado
11 modelos de IA ajustados por tarefa: entrevistas, podcasts, aulas, reuniões e pesquisa
Tarefas, decisões e um rascunho de e-mail pronto para enviar extraídos da transcrição e escritos no próprio idioma dela
Um editor de verdade: corrija uma palavra, deixe um comentário, mantenha o histórico de versões

Quão precisa ela é, medido

Publicamos nossos próprios números em vez de uma porcentagem de marketing. Em um conjunto de teste público de seis arquivos (fala limpa do LibriSpeech, inglês com sotaque nigeriano do OpenSLR 70 e uma reunião de quatro pessoas do corpus AMI), o produto em produção teve uma taxa média de erro por palavra de 6.43%, medida em July 24, 2026. Áudio de reunião com falas sobrepostas é bem mais difícil do que fala limpa, e o relatório detalha cada arquivo, inclusive aqueles em que nos saímos pior.

Ler o relatório completo

O que as pessoas dizem sobre as transcrições

How easy it makes working with other tools, it's speed and it's efficiency. The interface is well coded and visually appealing. This is an incredible tool.
David E. · Marketing Manager
Best transcription tool I've ever used. The accuracy is amazing and the turnaround time is incredibly fast. Highly recommend!
Emily K. · Journalist
The multilingual support is what sold me. Transcribes French and Spanish recordings just as well as English.
Sofia G. · Translator

O mesmo motor, via API

Se você está integrando fala para texto no seu próprio produto, os planos Developer e Business expõem uma API REST: crie uma chave no painel, envie um arquivo ou uma URL, consulte o resultado e recupere a transcrição com marcações de tempo e rótulos de falante. Os retornos por webhook estão no plano Business.

Ver planos com API

Perguntas frequentes

A conversão de fala em texto é grátis?
Os primeiros 10 minutos de qualquer arquivo são transcritos de graça sem conta. Uma conta grátis adiciona 10 minutos de transcrição, entregues uma única vez e não recarregados, que podem ser usados em até 3 arquivos por dia de 10 minutos cada. Ler e copiar o texto continua grátis; os downloads de arquivo e a duração ilimitada vêm com um plano pago a partir de $9.99/mês na cobrança anual.
Qual é a precisão da transcrição automática?
Depende muito mais do áudio do que da ferramenta. Com fala limpa e microfone próximo, nossa taxa de erro por palavra medida fica perto de 1%. Em uma reunião de quatro pessoas com falas sobrepostas, passa de 20%. Publicamos o conjunto de teste inteiro na nossa página de referência de precisão em vez de citar um número só. Conte com revisar nomes, jargão e tudo que for dito por cima de ruído de fundo.
Quais idiomas são aceitos?
99 idiomas, com a transcrição escrita na escrita própria de cada um: árabe em alfabeto árabe, hindi em devanágari, japonês em kana e kanji. Escolha o idioma antes de enviar. Os resumos com IA e as tarefas são gerados no mesmo idioma da transcrição, não traduzidos para o inglês.
Posso converter a fala de um vídeo?
Sim. Envie MP4, MOV, WebM ou MKV e a faixa de áudio é extraída para você: não é preciso converter o vídeo antes. Você também pode colar um link público para uma gravação em vez de enviar um arquivo.
Ela identifica quem está falando?
Sim. A diarização de falantes roda em toda transcrição: separa as vozes e as rotula como Falante 1, Falante 2 e assim por diante. Ela não sabe os nomes reais: você renomeia um falante uma vez no editor e o rótulo se atualiza na transcrição inteira.
O que acontece com meu áudio depois?
Os arquivos do plano grátis são apagados em até 7 dias. Os planos pagos deixam você escolher o período de retenção (30 dias por padrão, até manter o arquivo indefinidamente) e você pode apagar qualquer arquivo por conta própria a qualquer momento.

Transforme sua primeira gravação em texto

Nada para instalar, sem cartão. Os primeiros 10 minutos são por nossa conta.

Começar a transcrever