
Como Sair do Treinamento de IA com Seu Áudio: Guia por Fornecedor (2026)
Summarize this article with:
A maioria das APIs de transcrição não treina com seu áudio por padrão, mas vários serviços voltados ao consumidor treinam, sendo o Otter.ai o caso mais contestado em litígio ativo. A Deepgram torna o treinamento opt-in com um parâmetro de consulta; o registro de dados do Google também é opt-in. A posição mais arriscada é usar um produto que treina por padrão e esconde o opt-out. Linguagem contratual em um DPA é a proteção mais forte, acima de qualquer botão no app.
A maioria dos serviços de transcrição não treina com seu áudio por padrão. Mas "maioria" não é "todos", e os que treinam raramente deixam isso claro logo de cara. Este guia mostra o que cada grande provedor realmente faz, verificado nas páginas de política atuais de julho de 2026, com o caminho para desativar o treinamento quando ele existe.
Por Que Isso Importa Mais do Que Você Imagina
Quando seu áudio entra em um pipeline de treinamento, duas coisas acontecem que são difíceis de reverter:
- O modelo aprende padrões estatísticos do seu conteúdo, incluindo vocabulário específico do seu domínio, estilos de fala e, às vezes, assuntos sensíveis.
- Remover sua contribuição depois não é possível. Você pode apagar o arquivo original, mas os pesos do modelo ainda carregam a influência dele.
Para podcasts e anotações de reuniões, isso é uma preocupação pequena. Para ligações com clientes, conversas médicas, estratégia interna ou entrevistas com fontes protegidas, é uma exposição real. A pergunta não é só "meu áudio está armazenado?", mas "meu áudio está ensinando algo?"
Veja a transcrição de IA é privada para o panorama mais amplo além do treinamento.
Três Categorias de Provedores
Categoria 1: Sem treinamento estrutural. O serviço usa um modelo pré-treinado em modo de inferência. Seu áudio é processado e descartado. Não existe pipeline de treinamento no qual o provedor possa inserir seus dados, independentemente da política.
Categoria 2: Treinamento opcional. O treinamento está desativado por padrão. Você pode oferecer seus dados voluntariamente, às vezes em troca de descontos ou melhorias de precisão.
Categoria 3: Treinamento ativado por padrão. Seu áudio entra no pipeline de treinamento a menos que você desative ativamente. Esses provedores exigem mais atenção.
A categoria 3 é a pior postura. A categoria 1 é a mais simples de confiar. A categoria 2 é aceitável se você confirmar que o padrão está realmente desativado.
A Realidade de Cada Provedor
| Provedor | Padrão no treinamento? | Caminho de exclusão | Observações |
|---|---|---|---|
| OpenAI Whisper API | Não | Não necessário | Dados da API excluídos do treinamento por padrão |
| Deepgram | Não (opt-in) | Parâmetro de consulta mip_opt_out=true | Participantes recebem preço com desconto |
| Google Cloud STT | Não (opt-in) | Desative pelo Cloud Console | Registro de dados é opt-in; preço menor para participantes |
| AWS Transcribe | Não (opt-in) | Desativado por padrão | Programa de Melhoria de Serviço é opt-in |
| Otter.ai | Sim | Incerto / contatar suporte | Áudio desidentificado usado; litígio federal ativo (2025-2026) |
| Rev.com | Sim (IA proprietária) | Enviar e-mail para support@rev.com | Dados usados anonimamente na IA interna da Rev; LLMs de terceiros excluídos |
| Fireflies.ai | Não | Não necessário | Política de Retenção Zero de Dados; fornecedores proibidos por contrato |
| Descript | Não (opt-in) | Desativado por padrão | Modelos de produção não usam dados de usuários; P&D apenas com opt-in |
| Happy Scribe | Sim | Contatar dataprotection@happyscribe.com | Política de privacidade permite treinamento de ML sob "interesses legítimos" |
| TurboScribe | Não | Não necessário | Política explícita: sem treinamento de IA com mídia ou transcrições do usuário |
Políticas mudam. Verifique os termos atuais antes de confiar nesta tabela. Datas verificadas: julho de 2026.

OpenAI Whisper API
Dados da API são excluídos do treinamento por padrão. A página de privacidade empresarial da OpenAI garante que dados enviados pela API não são usados para treinar modelos. Isso vale para todos os clientes da API, incluindo o endpoint Whisper. Nenhum botão de exclusão é necessário, pois o padrão já é desligado.
Note a diferença: isso é a API. O produto de consumo ChatGPT da OpenAI tem outra política e historicamente usou dados de conversas para treinamento, a menos que você desativasse nas configurações da conta.
Retenção Zero de Dados (ZDR) está disponível para clientes empresariais elegíveis em endpoints suportados, onde os dados são processados em memória e não retidos após a solicitação. ZDR não é um recurso de autoatendimento, requer trabalho com sua equipe de conta.
Verificado em: openai.com/policies, julho de 2026.
Deepgram
O treinamento é opcional, por meio do Programa de Parceria para Melhoria de Modelos. Clientes padrão não são inscritos por padrão. Para excluir explicitamente uma solicitação, adicione mip_opt_out=true como parâmetro de consulta em qualquer chamada de API. Dados de solicitações que optaram por sair são retidos apenas pelo tempo necessário para concluir a solicitação.
Participantes do programa recebem preços com desconto, optar por sair não gera penalidade, apenas significa abrir mão do desconto de participante. Se você não quer nenhum risco de treinamento, adicione o parâmetro e aceite o preço padrão.
Verificado em: developers.deepgram.com/docs/the-deepgram-model-improvement-partnership-program, julho de 2026.
Para um detalhamento completo dos preços dos níveis da Deepgram, veja Deepgram Nova-3 explicado.
Google Cloud Speech-to-Text
O registro de dados é opcional. Isso é o oposto do que a versão anterior deste post sugeria. Clientes que NÃO ativam o registro de dados têm seu áudio processado e descartado, não é armazenado para melhoria de modelos. Preços mais baixos são oferecidos a clientes que optam por participar.
Se você já ativou o registro de dados em um projeto, os dados registrados antes de desativá-lo permanecem nos sistemas do Google. Solicitações futuras não são registradas após a desativação, mas o registro histórico não pode ser revertido.
Caminho para verificar: Console do Cloud, APIs e Serviços, API Cloud Speech, aba Registro de dados. Confirme que está desativado. Capture uma captura de tela.
Verificado em: docs.cloud.google.com/speech-to-text/docs/enable-data-logging, julho de 2026.
AWS Transcribe
O Programa de Melhoria de Serviço da AWS é opt-in. Os dados dos clientes não são usados para melhorar os modelos, a menos que você se inscreva ativamente. Segundo a documentação da AWS, o padrão para clientes de API é não participar do treinamento de melhoria de serviço.
Se a sua conta teve algum opt-in habilitado, verifique pelo Painel de Saúde do Serviço da AWS ou pelo console da AWS nas preferências da sua conta.
Verificado em: documentação da AWS, julho de 2026.
Otter.ai
O Otter treina com áudio de clientes desidentificado por padrão. A política de privacidade dele afirma explicitamente que usa "Informações de Reuniões e Uploads", incluindo gravações de áudio e transcrições, para treinar sua IA proprietária, após um processo de desidentificação. Revisores humanos não estão envolvidos, mas o treinamento em si é automático e ativado por padrão.
Minha opinião: a alegação de desidentificação é exatamente o que está sendo contestado em uma ação coletiva federal ativa (protocolada em dezembro de 2025, ainda em andamento em julho de 2026), que acusa o Otter de gravar conversas privadas e usá-las para treinar modelos sem consentimento adequado. "Desidentificado" não é o mesmo que "não usado". Até que esse litígio seja resolvido, eu trataria o Otter como Categoria 3 e assumiria que o treinamento está ativado por padrão.
O caminho para opt-out não é um simples botão de configuração. Você precisaria entrar em contato com o Otter diretamente; o link "Não Venda ou Compartilhe Minhas Informações Pessoais" no rodapé cobre os direitos de privacidade da Califórnia de forma ampla, mas não se aplica claramente ao treinamento com áudio.
Verificado em: otter.ai/privacy-policy, julho de 2026.
Rev.com
A Rev usa dados de clientes de forma anônima para treinar sua própria IA proprietária, conforme sua política de privacidade. Isso não é treinamento de LLM de terceiros; a Rev afirma que não compartilha dados com provedores externos de IA para treinamento. Mas seus modelos internos de IA aprendem com as transcrições dos clientes.
Clientes podem optar por não participar enviando um e-mail para support@rev.com. Não existe um botão no produto; você envia a solicitação por e-mail e ela fica registrada nos arquivos deles.
Para transcrição humana na Rev, vale um outro conjunto de preocupações: pessoas reais revisam seu áudio. A Rev faz triagem de seus transcritores e exige que assinem NDAs, mas o ponto continua de pé: olhos (e ouvidos) humanos alcançam o conteúdo. Escolha transcrição por IA na Rev se quiser evitar revisão humana.
Caminho de opt-out: envie um e-mail para support@rev.com pedindo para excluir seus dados do treinamento.
Verificado em: rev.com/security, support.rev.com/hc/en-us/articles/19509652584717-AI-Training-Opt-Out, julho de 2026.
Fireflies.ai
A Fireflies proíbe explicitamente o treinamento de IA com dados de reuniões de clientes. Sua política de privacidade (atualizada em 6 de março de 2026) afirma que não usa informações pessoais para treinamento de modelos de IA e impõe retenção zero de dados com seus fornecedores, ou seja, processadores terceiros não podem armazenar conteúdo de reuniões após a entrega. Os fornecedores são contratualmente proibidos de treinar com esses dados.
Não é necessário optar por sair; isso é uma política de base, não um compromisso de adesão voluntária.
Verificado em: fireflies.ai/privacy-policy, julho de 2026.
Descript
Os modelos de produção na Descript não usam dados de clientes. Os modelos internos de P&D usam apenas dados de usuários que optaram por compartilhar informações. Não há planos de usar dados de usuários que optaram por sair em nenhuma etapa.
Uma única ressalva: os recursos de voz por IA (a ferramenta de clonagem de voz Overdub) usam dados de voz com desidentificação para pesquisa em tecnologia de voz. Se você usa transcrição geral, isso não se aplica.
Verificado em: descript.com/privacy, julho de 2026.
Happy Scribe
A Happy Scribe treina modelos de aprendizado de máquina com conteúdo de clientes. Sua política de privacidade, na Seção II (Dados de Conteúdo), afirma: "Poderemos armazenar o Conteúdo para treinar nossos algoritmos de aprendizado de máquina." A base legal apresentada é "interesses legítimos" sob o GDPR.
Nenhum mecanismo explícito de opt-out é descrito no documento da política. Sob o GDPR, usuários podem se opor ao processamento baseado em interesses legítimos, mas o Happy Scribe não publicou um caminho de autoatendimento. Contate dataprotection@happyscribe.com se você precisar disso por escrito.
O Happy Scribe é uma empresa constituída na UE com data centers na UE, o que oferece alguma proteção processual, mas a residência na UE não elimina o uso para treinamento.
Verificado em: happyscribe.com/privacy, julho de 2026.
TurboScribe
A política do TurboScribe declara explicitamente que ele não treina modelos de IA ou aprendizado de máquina com arquivos de mídia ou transcrições dos usuários. Nenhum opt-out é necessário. O serviço roda o Whisper em modo de inferência.
Verificado em: turboscribe.ai/privacy, julho de 2026.
Como Verificar se a Afirmação é Real
Uma declaração na política é um ponto de partida, não uma garantia. As verificações práticas:
- Leia os Termos de Serviço e a política de privacidade atuais. Procure pela palavra específica "treinar" ou "aprendizado de máquina" em ambos os documentos. Linguagem vaga como "melhorar nossos serviços" sem esclarecimento é um sinal para fazer perguntas de acompanhamento.
- Verifique a data de atualização da política de privacidade. Uma política atualizada pela última vez em 2022 pode não refletir as práticas atuais.
- Solicite confirmação por escrito. Envie um e-mail ao suporte e pergunte especificamente: "Meus dados de áudio entram em algum pipeline de treinamento de modelo?" A resposta vira um registro.
- Obtenha um DPA com linguagem explícita de não treinamento. Para clientes empresariais, o Acordo de Processamento de Dados é o mecanismo contratual. Inclua linguagem como: "O Fornecedor não deverá usar Dados do Cliente, incluindo gravações de áudio ou transcrições, para treinar, ajustar ou de qualquer outra forma melhorar qualquer modelo de inteligência artificial, exceto com o consentimento expresso por escrito do Cliente." Isso é executável; um botão de alternância não é.
- Veja qual modelo é usado. Se o provedor lista o Whisper Large-v3, um modelo pré-treinado da OpenAI, o provedor não consegue facilmente ajustá-lo com seus dados. Modelos proprietários de ponta a ponta são mais difíceis de auditar.
Para mais detalhes sobre como suas opções contratuais funcionam na prática, veja acordos de transcrição e confidencialidade.
O Argumento Estrutural Contra o Treinamento
A alegação de privacidade mais forte não é baseada em política, mas em arquitetura. Se um serviço usa um modelo de fundação como o Whisper Large-v3 em modo de inferência pura, o provedor não tem a infraestrutura para incorporar seu áudio em atualizações de treinamento. Treinar o Whisper exige a configuração original de treinamento da OpenAI; re-treinar com áudio de clientes não é algo que uma empresa SaaS típica faz.
É por isso que provedores de modelos pré-treinados como TurboScribe e ferramentas baseadas na API do Whisper ficam na Categoria 1. A alegação é estrutural, não apenas uma declaração em um documento.
Se você precisa de garantia máxima, transcrição no dispositivo vs. na nuvem cobre o caso de hospedar o Whisper no seu próprio hardware, onde o modelo nunca sai do seu ambiente.
A Posição do ConvertAudioToText
Se você precisa de uma transcrição limpa sem um bot de reunião ou um pipeline de treinamento proprietário tocando seus dados, o ConvertAudioToText usa o Whisper Large-v3 e a AssemblyAI apenas em modo de inferência. Nenhum dos pipelines é re-treinado com áudio de clientes. Contas empresariais podem solicitar um DPA com linguagem explícita contra treinamento.
O Quadro de Decisão
- Seu áudio é sensível? Se não, a maioria dos provedores respeitáveis funciona bem.
- Se sim: verifique se o provedor usa treinamento por padrão (Otter, Happy Scribe, IA proprietária da Rev) e opte por não participar ou escolha outro provedor.
- Você precisa de linguagem contratual contra treinamento? Obtenha um DPA que a inclua, não apenas um botão no aplicativo.
- Você precisa de garantia estrutural contra treinamento? Escolha um provedor que use modelos pré-treinados em modo de inferência (ferramentas baseadas em Whisper, TurboScribe, Fireflies).
- O conteúdo é extraordinariamente sensível? Hospede o Whisper no seu próprio hardware.
Para contextos regulados pelo GDPR, consulte transcrição em conformidade com o GDPR para o enquadramento regulatório, que envolve mais do que política de treinamento.
FAQ
A OpenAI usa áudio da API Whisper para treinar seus modelos?
Não. A política de privacidade empresarial da OpenAI afirma que dados enviados pela API não são usados para treinar modelos. Isso se aplica por padrão a todos os clientes da API, incluindo aqueles que usam o endpoint Whisper. Você não precisa fazer nada para optar por sair; o padrão já é desativado. A Retenção Zero de Dados está disponível para clientes empresariais que buscam garantia adicional.
Como faço para optar por sair do treinamento de modelos da Deepgram?
O Programa de Parceria para Melhoria de Modelos da Deepgram é opt-in, ou seja, você não é inscrito por padrão. Se quiser excluir explicitamente solicitações individuais da API, adicione mip_opt_out=true como parâmetro de consulta. Dados de solicitações com opt-out são retidos apenas pelo tempo necessário para processar a solicitação. Participantes do programa recebem preços com desconto, mas optar por sair não gera nenhuma penalidade.
A Otter.ai treina com minhas gravações de reuniões?
Sim, de acordo com a política de privacidade da Otter. A Otter treina sua IA proprietária com gravações de áudio e transcrições de reuniões de clientes, com dados desidentificados. O treinamento é automático e ativado por padrão. Uma ação coletiva federal ativa, aberta em 2025, questiona se essa prática atendeu aos padrões de consentimento informado. Se treinar com o conteúdo das suas reuniões é inaceitável, esse é um motivo firme para escolher outro provedor.
O registro de dados do Google Cloud Speech-to-Text é ativado por padrão?
Não. O registro de dados do Google Cloud Speech-to-Text é opt-in. A menos que você tenha ativado ativamente no seu Cloud Console, seu áudio é processado e descartado. Clientes que optam por participar recebem preços mais baixos em troca de contribuir com dados. Se você tem um projeto existente onde o registro pode ter sido ativado anteriormente, verifique a configuração atual em Cloud Console, APIs e Serviços, Cloud Speech API, aba Registro de dados.
Qual é a proteção mais forte contra um fornecedor treinar com meu áudio?
Uma combinação de duas coisas: um DPA com linguagem contratual explícita proibindo o treinamento, e escolher um provedor cuja arquitetura técnica torne o treinamento com seus dados estruturalmente inviável (como um que use um modelo Whisper pré-treinado em modo somente inferência). Um DPA é aplicável em tribunal; um botão no aplicativo não é. A não realização estrutural de treinamento (sem infraestrutura de treinamento, modelo apenas pré-treinado) é mais difícil de contornar, mesmo que uma política mude depois.
Fontes
- Política de uso de dados da OpenAI: openai.com/policies/how-your-data-is-used-to-improve-model-performance
- Programa de Parceria para Melhoria de Modelos da Deepgram: developers.deepgram.com/docs/the-deepgram-model-improvement-partnership-program
- Registro de dados do Google Cloud Speech-to-Text: docs.cloud.google.com/speech-to-text/docs/enable-data-logging
- Termos de registro de dados do Google Cloud: cloud.google.com/speech-to-text/docs/data-logging-terms
- Política de privacidade do Otter.ai: otter.ai/privacy-policy
- Cobertura de litígio do Otter.ai: ktslaw.com/en/Blog/GlobalPrivacy-and-CybersecurityLaw/2025/9/Otterai-Suit-Highlights-Risks-of-Using-User-Data-to-Train-AI
- Opção de exclusão de treinamento de IA da Rev.com: support.rev.com/hc/en-us/articles/19509652584717-AI-Training-Opt-Out
- Política de privacidade do Fireflies.ai (atualizada em 6 de março de 2026): fireflies.ai/privacy-policy
- Privacidade da Descript: descript.com/privacy
- Política de privacidade do Happy Scribe: happyscribe.com/privacy
- Política de privacidade do TurboScribe: turboscribe.ai/privacy
Try transcription free
Convert any audio or video to clean, unwatermarked text — speaker labels, timestamps, and AI summaries included. First 10 minutes free, no account.
Related Articles

Best Transcription Tool Alternatives, Honestly Compared (2026)
Leaving Otter, Descript, Transkriptor, Rev, or TurboScribe? Honest, sourced comparisons of every major transcription tool: real limits, verified pricing, and where each one genuinely wins.

Looking for a Transkriptor Alternative? Here's the Honest Math (2026)
Transkriptor meters your minutes and lets unused ones expire monthly. Here is its real 2026 pricing decoded, when staying is rational, and the unlimited alternatives at the same sticker price.