Mais de 90 idiomas · identificação de falantes · SRT / VTT · resultados em ~1 minuto

Transforme áudio e vídeo em texto preciso

Envie um podcast, uma reunião ou uma aula — áudio ou vídeo. Detectamos o idioma, marcamos quem disse o quê e devolvemos um texto pesquisável, com replay por frase e exportação de legendas.

Entre para transcrever seu primeiro arquivo

Contas gratuitas têm 3 transcrições por dia. Sem cartão de crédito, sem contagem regressiva de teste.

Grátis: 3 arquivos por dia, de até 30 minutos cada, renova à meia-noite UTC · uma gravação de 30 minutos leva cerca de um minuto · sem cartão de crédito

Funciona comMP3WAVM4AAACFLACOGGMP4MOVWEBMMKV

Grátis todos os dias.

3 transcrições por dia por nossa conta — e cada arquivo recebe o kit completo, não uma amostra limitada.

Identificação de falantes

Uma caixa de seleção, e cada linha volta marcada por voz e com código de tempo.

Editor com replay por frase

Clique em qualquer frase para ouvir aquele momento exato — conferir uma citação leva segundos.

Legendas em um clique

Exporte SRT ou VTT e leve direto para o YouTube, Premiere ou Final Cut.

Seis formatos de exportação

TXT, DOCX, PDF, CSV, SRT, VTT — baixe vários de uma vez.

Um acervo pesquisável

Encontre o minuto em que um assunto apareceu em vez de reouvir horas de gravação.

Vídeo direto

Envie MP4, MOV, WEBM ou MKV como está — sem extrair o áudio antes.

Usado porPodcastersJornalistasEstudantesPesquisadoresTimes de produtoAdvogadosMédicosEditores de vídeoCriadores de cursos

Com tecnologia Whisper.

O modelo de voz da OpenAI processa seus arquivos — aqui está quando ele é preciso, e quando não é.

Dois motores, roteados automaticamente

O Whisper cuida da maioria dos arquivos; um motor de diarização assume com áudio longo ou de vários falantes. O arquivo decide — você nunca escolhe modelo.

Precisão honesta

Quase perfeito com um microfone decente. Espere erros em nomes, jargões e vozes sobrepostas — sem promessas de 100%. Teste com seu próprio áudio de graça.

Marcações de tempo verificáveis

Tempos nativos do modelo, normalmente com precisão de um segundo — clique em qualquer linha e confira contra o áudio.

Mais de 90 idiomas, detectados automaticamente

Inglês, espanhol, japonês, chinês e mais. Gravações mistas ficam com o idioma predominante.

Privado por padrão

Armazenado criptografado, nunca usado para treinar modelos, nenhum humano escuta — some quando você apaga.

Preço fixo, nada de taxímetro.

Serviços por minuto transformam uma única hora de áudio numa fatura de US$ 10–15. Aqui, um preço fixo cobre tudo o que você transcrever no mês — e o plano grátis nunca expira.

Grátis

$0/ para sempre

Para experimentar — ou para uso leve no dia a dia.

  • 3 transcrições por dia, todos os dias
  • Arquivos de até 30 minutos / 50MB
  • Marcações de tempo e identificação de falantes
  • Exportação em TXT, PDF, DOCX, CSV, SRT, VTT
  • Mais de 90 idiomas
  • Fila de processamento padrão
Mais popular

Ilimitado

$10/ mês, cobrado anualmente (US$ 120)

Para quem transcreve como parte do trabalho.

  • Transcrições ilimitadas
  • Identificação de falantes em todos os arquivos
  • Todas as ferramentas de IA — resumos, limpeza, tradução
  • Processamento prioritário
  • Sem limite de duração por arquivo — arquivos de até 100MB

Perguntas que as pessoas realmente fazem.

Sobre precisão, privacidade, limites e o que “grátis” significa de verdade. Incluindo as céticas.

Quão preciso é, de verdade?

Com áudio limpo — um microfone decente, um ou dois falantes, pouco ruído de fundo — espere um texto quase perfeito com deslizes ocasionais em nomes e jargões. A precisão cai com muitas vozes sobrepostas, sotaques fortes ou salas barulhentas. O melhor teste é o seu próprio áudio: as primeiras transcrições são grátis.

Por que preciso entrar com o Google?

O login é o que nos permite dar a cada pessoa uma cota diária gratuita de verdade, em vez de uma amostra única. Um clique com o Google — sem inventar senha, sem aquele vaivém de confirmação de e-mail, e recebemos apenas seu nome, e-mail e avatar.

O que o plano grátis realmente inclui?

3 transcrições por dia, para sempre — cada uma com até 30 minutos. Não é um teste de 7 dias nem um crédito único. O contador zera à meia-noite UTC. Se precisar de mais ou de arquivos mais longos, o plano Ilimitado remove os dois tetos.

Quais idiomas são suportados?

Mais de 90, incluindo inglês, espanhol, português, francês, alemão, japonês, coreano e chinês. O idioma é detectado automaticamente — gravações com vários idiomas geralmente ficam com o predominante.

Funciona com arquivos de vídeo?

Sim. Envie MP4, MOV, WEBM ou MKV e transcrevemos a trilha de áudio diretamente — sem precisar extrair o áudio antes.

Como funciona a identificação de falantes?

Marque “Identificar falantes” antes de enviar. A IA separa as vozes e rotula cada trecho (Falante 1, Falante 2, …). É mais confiável com turnos claros — entrevistas, reuniões, podcasts — e menos quando as pessoas falam ao mesmo tempo.

Posso confiar nas marcações de tempo?

Elas vêm direto do modelo de voz e normalmente ficam a menos de um segundo do áudio. Clique em qualquer linha do editor para ouvir a gravação original naquele momento e conferir você mesmo. As exportações de legenda mantêm os tempos originais de cada trecho, então as legendas se alinham no seu editor de vídeo.

Meu áudio é privado?

Seus arquivos são privados da sua conta, armazenados criptografados, nunca compartilhados e nunca usados para treinar modelos de IA. A transcrição roda apenas em sistemas automatizados — nenhum humano ouve seu áudio. Apague um arquivo e ele some do nosso armazenamento.

O que posso exportar?

Documentos PDF e DOCX, texto simples (TXT), planilhas (CSV) e arquivos de legenda (SRT, VTT) — com marcações de tempo opcionais por seção. Você pode selecionar vários formatos e baixar tudo de uma vez.

Exatamente quais formatos de arquivo posso enviar?

Áudio: MP3, WAV, M4A, AAC, FLAC, OGG, OPUS, WMA, AIFF. Vídeo: MP4, MOV, WEBM, MKV, MPEG, AVI. Se seu gravador ou editor produziu, quase certamente funciona — e se algum formato falhar, avise que a gente adiciona.

Por que é tão mais barato que transcrição humana?

Porque nenhum humano faz o trabalho. Um transcritor profissional cobra US$ 1–2 por minuto de áudio e precisa de dias; um modelo de voz nos custa centavos por hora e leva cerca de um minuto. Você troca uma pequena margem de precisão por uma diferença de preço de cem vezes — e, para o que for publicar, pode clicar em cada linha e verificar contra o áudio.

Quanto eu realmente posso transcrever?

Grátis: 3 arquivos por dia, todos os dias — até 90 gravações por mês sem pagar um centavo. Ilimitado: sem teto no número de transcrições; a única regra é uma conta por pessoa.

Quem está por trás disso?

Oi 👋 — o Transcript.so é feito por um time independente e pequeno, não por um gigante inflado de capital de risco. Respondemos nosso próprio e-mail de suporte, lançamos melhorias toda semana e mantemos o serviço rápido e acessível porque nossos custos foram projetados para serem baixos.

A próxima gravação não precisa virar uma noite de digitação.

Sua primeira transcrição está a um minuto — grátis, sem cartão.

Transcreva um arquivo — grátis