
Exclusão automática de arquivos de transcrição: retenção sob seu controle
Summarize this article with:
Retenção sob seu controle
A maioria das ferramentas de transcrição mantém seus arquivos indefinidamente por padrão. Isso significa que meses de gravações de áudio ficam armazenados no sistema de outra pessoa, contendo conversas com clientes, reuniões internas ou notas de voz privadas, disponíveis para qualquer pessoa que consiga acesso à sua conta ou aos sistemas do provedor. A exclusão automática muda esse padrão: os arquivos têm um tempo de vida definido e desaparecem conforme o cronograma, sem necessidade de nenhuma ação.
Este post aborda como os principais serviços de transcrição tratam a retenção hoje (verificado em julho de 2026), como configurar a exclusão para refletir o seu risco real e o aspecto de conformidade sem as evasivas de sempre.
O problema do padrão de manter tudo
Quando você envia um áudio para um serviço de transcrição, o padrão típico é:
- Áudio armazenado indefinidamente até você excluí-lo
- Transcrição armazenada no mesmo cronograma indefinido
- Backups com sua própria janela de retenção, geralmente mais longa
- Metadados dos trabalhos persistindo enquanto os arquivos existirem
Isso cria problemas que a maioria dos usuários percebe tarde demais.
A privacidade se acumula com o tempo. Depois de um ano de uploads semanais, você tem mais de 50 gravações contendo coisas ditas em confiança. Cada uma delas é uma potencial exposição em caso de vazamento de dados ou pedido de descoberta judicial.
O Artigo 5(1)(e) do GDPR exige explicitamente limitação de armazenamento. O regulamento estabelece que os dados pessoais devem ser "mantidos em uma forma que permita a identificação dos titulares dos dados por não mais tempo do que o necessário para as finalidades para as quais os dados pessoais são processados". Armazenamento indefinido com limpeza manual não satisfaz isso. Você precisa de um período de retenção definido, documentado e aplicado.
O impacto de um vazamento escala com o volume de dados mantidos. Um provedor que guarda três anos de áudio de cada cliente expõe muito mais em um incidente do que um que guarda trinta dias.
A exclusão automática resolve os três problemas transformando a retenção em um padrão configurado, em vez de uma tarefa manual.
Como a retenção realmente funciona nos principais serviços
A tabela abaixo resume o que cada serviço faz por padrão e quanto controle você tem, com base na documentação dos fornecedores verificada em julho de 2026.
| Serviço | Retenção padrão do áudio | Exclusão automática configurável? | Observações |
|---|---|---|---|
| CATT | Plano gratuito: exclusão automática em 7 dias; planos pagos: configurado pelo usuário | Sim, por conta e por arquivo | Áudio excluído do armazenamento R2 conforme programado; o usuário controla a janela |
| Otter.ai | Indefinida (itens excluídos ficam na Lixeira por 30 dias) | Somente Enterprise | Retenção personalizada para áudio, transcrição ou ambos; requer configuração pelo gerente de conta |
| Rev (AI API) | Até 90 dias, depois purga automática | Configurável via ticket de suporte | Exclusão manual também disponível a qualquer momento |
| Fireflies | Indefinida; a exclusão manual é imediata | Somente Enterprise | O modo "Somente resumo" exclui o áudio após a geração do resumo; a exclusão automática de reuniões antigas é recurso Enterprise |
| TurboScribe | Indefinida até você excluir | Sem exclusão automática integrada | A exclusão da conta purga dados ativos em até 7 dias e backups em até 90 dias |
| Happy Scribe | Indefinida; janela de recuperação de 10 dias após a exclusão | Sem exclusão automática programada | Infraestrutura sediada na UE; a exclusão é iniciada pelo usuário |
| Trint | Indefinida; arquivos são excluídos em até 48h após o cancelamento | Opções personalizadas para Enterprise | Metadados de backup retidos por até 1 ano |
| AWS Transcribe | 90 dias se usar o bucket gerenciado pelo serviço | O cliente controla seu próprio S3 | Trazer o próprio bucket = a retenção é inteiramente sua |
O padrão é consistente: exclusão automática como comportamento padrão é raro. A maioria dos serviços depende de o usuário lembrar de fazer a limpeza.

O que "excluído" realmente significa
Antes de configurar a retenção, ajuda entender a realidade em duas fases da exclusão na nuvem.
Exclusão lógica é quando o arquivo desaparece do seu painel e a API retorna "não encontrado". Isso acontece rapidamente, muitas vezes imediatamente.
Exclusão física é quando os bytes de fato são removidos dos sistemas de armazenamento e backup. Isso acontece depois. Na maioria dos sistemas compatíveis com S3, incluindo o Cloudflare R2, objetos marcados para exclusão são removidos de forma irreversível, mas a propagação do backup leva horas a dias. A Trint deixa explícito que os metadados de backup podem persistir por até um ano depois que um arquivo é excluído.
Para conteúdo em que você precisa de irreversibilidade documentada, pergunte especificamente ao fornecedor:
- Qual é o SLA entre a exclusão lógica e a física?
- Os backups seguem o mesmo cronograma do armazenamento primário?
- Existe uma opção de "apagamento seguro" ou fragmentação criptográfica?
Para a maioria dos casos de uso empresariais, a exclusão padrão lógica-então-física é adequada. Para conteúdo coberto por obrigações de retenção legal ou sigilo entre advogado e cliente, consulte seu jurídico antes de presumir que a exclusão de qualquer ferramenta é forensicamente irreversível. Veja transcrição e sigilo entre advogado e cliente para detalhes sobre esse cenário.
Configurando a retenção para refletir o seu risco
O período de retenção correto não é "o mais longo possível por conveniência" nem "o mais curto possível pela privacidade". É o mínimo que satisfaz seu fluxo de trabalho, suas obrigações de conformidade e suas necessidades reais de reprocessamento.
Um exercício útil: para cada tipo de gravação que sua equipe manipula, responda cinco perguntas.
- Por que preciso do áudio em primeiro lugar?
- Por quanto tempo eu poderia plausivelmente precisar reprocessá-lo ou baixá-lo novamente?
- Por quanto tempo a transcrição precisa permanecer disponível?
- Qual é o requisito de conformidade aplicável?
- Qual é a exposição em caso de vazamento ou descoberta judicial se este arquivo vazar?
O período de retenção deve ser o mínimo que satisfaça todas as cinco. Para a maioria das equipes:
- Chamadas de clientes: 14 a 30 dias de áudio, 90 dias de transcrição
- Reuniões internas: 7 a 14 dias de áudio, 30 dias de transcrição
- Notas de voz e anotações pontuais: 7 dias de áudio, 30 dias de transcrição
- Material jornalístico e de pesquisa com fontes: indefinido para ambos, com documentação de consentimento separada
Para conteúdo sensível (terapia, consultas jurídicas, estratégia confidencial), a resposta para o áudio costuma ser "excluir imediatamente após a confirmação da transcrição". O áudio cumpriu sua função. A transcrição é o que você precisava.
Controles de retenção do CATT
Entre as ferramentas da tabela, o CATT é uma das poucas que adota exclusão automática como padrão, em vez de armazenamento indefinido. Uploads no plano gratuito são excluídos automaticamente em 7 dias. Usuários pagos definem sua própria janela, desde a exclusão imediata após o processamento até retenções mais longas para trabalho de arquivamento. O ajuste individual por arquivo é útil: mantenha o padrão da conta em 7 dias, mas estenda a retenção para uma gravação específica que você sabe que vai precisar revisitar.
A exclusão do armazenamento R2 é real. Arquivos cujo TTL configurado expirou retornam 404 na aplicação e são removidos do armazenamento subjacente. A afirmação na versão antiga deste post de que o CATT herdava a "propagação de backup de alguns dias" do R2 era imprecisa: as exclusões do R2 são declaradas irreversíveis no nível do objeto. Não há um cofre de backup separado retendo arquivos excluídos. Se quiser mais detalhes, teste: envie um arquivo não sensível, espere passar da janela de retenção e confirme que ele retorna não encontrado.
Se você quer transcrição direta ao ponto, sem bot de reunião, sem onboarding e com retenção que tem como padrão a exclusão em vez do acúmulo, a ferramenta de áudio para texto do CATT permite configurar isso uma vez no nível da conta e esquecer.
O ângulo de conformidade sem exageros
O Artigo 5 do GDPR traz dois princípios relevantes:
Minimização de dados (Artigo 5(1)(c)): colete apenas o que você precisa. Limitação de armazenamento (Artigo 5(1)(e)): mantenha por não mais tempo do que o necessário.
A exclusão automática transforma o segundo princípio de um processo manual em um controle técnico. Isso importa porque a fiscalização do GDPR espera retenção documentada e aplicada, não "tínhamos a intenção de fazer a limpeza".
O que você não pode fazer: apontar para o recurso de exclusão automática de um fornecedor e se declarar em conformidade com o GDPR. Conformidade é uma propriedade da sua implantação, dos seus processos e dos seus acordos, não um selo de recurso. Você precisa de:
- Um Acordo de Processamento de Dados com seu fornecedor de transcrição (cobrindo os subprocessadores dele e a retenção praticada por eles)
- Períodos de retenção documentados no seu Registro das Atividades de Tratamento
- Evidência de que o controle técnico (exclusão automática) é testado e funciona
A CCPA na Califórnia, a LGPD no Brasil e a PIPEDA no Canadá contêm conceitos análogos de minimização. A implementação prática é a mesma: defina, documente, aplique tecnicamente. Veja transcrição em conformidade com o GDPR para o fluxo completo de conformidade e a transcrição com IA é privada para o que a privacidade realmente exige de um relacionamento com fornecedor.
Quando uma retenção mais longa faz sentido
Existem casos legítimos para manter o áudio além das janelas curtas acima.
Arquivos jornalísticos e de pesquisa. Material de fonte que sustenta trabalho publicado pode precisar ser retido por anos para se defender de contestações legais. Isso exige documentação de consentimento separada e um período de retenção justificado, não simplesmente deixar o padrão ativado.
Setores regulados com retenção obrigatória. Serviços financeiros frequentemente exigem 5 a 7 anos para certas comunicações. O registro de prontuários de saúde tem seu próprio cronograma. Nesses casos, configure a retenção para corresponder ao requisito regulatório, documente a citação normativa e use um fornecedor cujo DPA suporte esse modelo de retenção.
Bibliotecas de conteúdo educacional. Gravações de aulas, materiais de treinamento e palestras de conferências em que o valor é de arquivo. Esses pertencem a um sistema de arquivamento dedicado, não ao armazenamento padrão de um serviço de transcrição genérico.
Para esses casos, defina a retenção deliberadamente e documente o porquê. A posição de conformidade que você quer é "escolhemos esta retenção com base neste requisito documentado", não "nunca configuramos um período de retenção".
Testando se a exclusão realmente funciona
Não confie no marketing. Faça um teste.
- Envie um arquivo não sensível com uma janela de retenção curta (24 horas, se o seu plano permitir).
- Espere passar da janela.
- Tente acessar o arquivo pela interface normal e pela URL direta de armazenamento, se tiver.
- Confirme que ele retorna "não encontrado" ou equivalente.
Se um provedor afirma ter exclusão automática, mas o arquivo ainda está acessível depois da janela configurada, a implementação está quebrada. Esse teste custa dez minutos e revela mais do que a página de privacidade.
Perguntas frequentes
Excluir um arquivo de um serviço de transcrição garante que ele desapareça imediatamente?
Nem sempre. A maioria dos serviços usa primeiro a exclusão lógica (o arquivo desaparece da sua interface), seguida da purga física dos backups ao longo de dias ou semanas. A Trint, por exemplo, retém metadados de backup por até um ano após a exclusão. Para conteúdo genuinamente sensível, verifique os termos de retenção de backup e recuperação de desastres do fornecedor, não apenas o botão de exclusão visível ao usuário.
Usar um serviço com exclusão automática já satisfaz o GDPR?
Não. O Artigo 5(1)(e) do GDPR exige que você, como controlador dos dados, documente um período de retenção justificado e o aplique. Usar uma ferramenta com exclusão automática ajuda a aplicá-lo tecnicamente, mas você ainda precisa definir o período, documentar a justificativa nos seus registros de tratamento e garantir que qualquer subprocessador (o fornecedor de transcrição) esteja vinculado a um Acordo de Processamento de Dados. Exclusão automática é um mecanismo, não um certificado de conformidade.
Quais serviços de transcrição oferecem exclusão automática e quais exigem limpeza manual?
Exclusão automática ou retenção configurável existe em: CATT (plano gratuito com exclusão automática em 7 dias, configurável pelo usuário), Rev AI API (máximo de 90 dias, configurável via suporte), Otter.ai Enterprise (políticas de retenção personalizadas) e Fireflies Enterprise (exclusão automática de reuniões antigas). Limpeza somente manual como padrão: Happy Scribe (armazenamento indefinido, janela de recuperação de 10 dias), TurboScribe (somente manual, purga de backups em 90 dias ao excluir a conta), Trint (manual, Enterprise recebe opções personalizadas). O AWS Transcribe exclui a saída do bucket gerenciado pelo serviço após 90 dias; se você usa seu próprio bucket S3, a retenção fica inteiramente a seu critério.
Que período de retenção devo usar para arquivos de áudio com conversas sensíveis?
Para sessões de terapia, consultas jurídicas, discussões médicas ou estratégia comercial confidencial: exclua o arquivo de áudio imediatamente após a confirmação da transcrição, ou em no máximo 24 horas. A transcrição em si pode ter uma janela maior (30 a 90 dias) se você precisar dela para revisão. Alinhe a retenção do áudio à janela realista em que um reprocessamento poderia algum dia ser necessário, não à conveniência geral. A maioria das pessoas nunca reprocessa o áudio depois que a transcrição é confirmada.
Fontes
- Artigo de ajuda sobre política personalizada de retenção de dados do Otter.ai: https://help.otter.ai/hc/en-us/articles/19500988656279-Set-a-custom-Data-Retention-policy
- Suporte de privacidade e segurança da Rev.com: https://support.rev.com/hc/en-us/articles/29708931771661-Privacy-And-Security
- FAQ da Rev AI API (retenção de trabalhos de 30 dias): https://docs.rev.ai/faq
- Modos de gravação do Fireflies para conformidade: https://guide.fireflies.ai/articles/3598930706
- Política de privacidade do TurboScribe: https://turboscribe.ai/privacy
- Ajuda sobre retenção de dados do Happy Scribe: https://help.happyscribe.com/en/articles/6087162-how-long-does-happyscribe-keep-my-data
- Segurança de dados e conformidade da Trint: https://trint.com/security
- Documentação de entrada e saída de dados do AWS Transcribe: https://docs.aws.amazon.com/transcribe/latest/dg/how-input.html
- Documentação de exclusão de objetos do Cloudflare R2: https://developers.cloudflare.com/r2/objects/delete-objects/
- Texto do Artigo 5 do GDPR: https://gdpr-info.eu/art-5-gdpr/
- Política de privacidade do ConvertAudioToText: https://convertaudiototext.com/privacy
Try transcription free
Convert any audio or video to clean, unwatermarked text — speaker labels, timestamps, and AI summaries included. First 10 minutes free, no account.
Related Articles
How to Add Timestamps to a Transcript
Learn how to add timestamps to a transcript with an audio-to-text tool, then export timestamped SRT or VTT subtitle files for easy navigation and editing.
How to Transcribe a Conference Talk to Text
Learn how to transcribe a conference talk or keynote to text, label speakers, and export SRT, VTT, or TXT using a straightforward upload or URL workflow.