Limpar transcrição sem tempos, sem nomes, em parágrafos.
Cole a transcrição ou abra um arquivo SRT, VTT, SBV, TXT ou JSON. A limpeza tira os tempos (00:01:02, [01:02]), os números e setas da legenda, os nomes de quem fala e marcações como [Música] e (risos), e junta as linhas quebradas em parágrafos. Você vê o antes e o depois na hora.
Grátis, sem cadastroComo limpar uma transcrição
- 01
Cole o texto ou abra o arquivo
Serve a transcrição copiada do YouTube, uma legenda SRT, VTT ou SBV, um TXT com tempos ou o JSON de uma transcrição. O formato é reconhecido sozinho.
- 02
Escolha o que tirar
Tempos, nomes de quem fala, marcações de som e hesitações, cada um com a sua chave. Decida também se quer parágrafos, uma frase por linha ou as linhas como estão.
- 03
Copie ou baixe
O texto limpo muda a cada opção. Compare a contagem de palavras antes e depois, copie com um clique ou baixe em TXT.
Como tirar os tempos de uma transcrição do YouTube?
Quando você copia a transcrição de um vídeo do YouTube, cada trecho vem com o tempo em uma linha separada (0:00, 0:04, 1:15) e o texto quebrado em pedaços curtos. Às vezes vem também uma linha como "1 minuto e 5 segundos", que é o texto para leitores de tela. Cole tudo aqui: os tempos e essas linhas saem, e o texto vira parágrafos.
Os tempos são reconhecidos em todos os jeitos comuns: [00:01:02], (1:02), 00:01:02,500, 01:00:00:12 com quadros, intervalos como 00:01 - 00:05 e as linhas de tempo de SRT e VTT com a seta -->. Um horário no meio da frase, como "o culto começa às 10:30", fica no texto, porque não é um tempo de transcrição.
Se você precisa dos tempos, desligue a primeira opção: cada parágrafo começa com o tempo do trecho onde ele começa, no formato [01:02], ou [01:02:03] quando a gravação passa de uma hora.
| Na transcrição | No texto limpo |
|---|---|
| 0:04 ao nosso encontro | ao nosso encontro |
| [00:01:02] Bom dia | Bom dia |
| 00:00:01,000 --> 00:00:03,000 | (sai inteira) |
| o culto é às 10:30 | o culto é às 10:30 |
Como tirar os nomes dos falantes e as marcações [Música]?
Transcrições de reunião, entrevista e podcast costumam abrir cada fala com o nome: "Falante 1:", "SPEAKER_00:", "Entrevistador:" ou o nome da pessoa. Você escolhe entre tirar todos, tirar só os genéricos (e manter os nomes de verdade) ou manter tudo. Mesmo quando o nome sai, a troca de pessoa continua virando um parágrafo novo, para a conversa não se misturar.
Para não apagar texto por engano, um nome só conta como falante quando é genérico, quando aparece em mais de uma fala ou quando a maior parte das linhas tem um nome. Assim, um "Nota: tragam pratos" solto num texto comum continua lá.
As marcações de som também saem: tudo entre colchetes, como [Música] e [Aplausos], os parênteses que descrevem um som, como (risos), (tosse) e (inaudível), e as letras de música entre ♪. Parênteses com conteúdo, como (2019) ou (ver capítulo 3), ficam.
Como juntar linhas quebradas de uma legenda em parágrafos?
Legenda é feita para a tela: cada bloco tem duas linhas curtas, e a frase continua no bloco seguinte. Para ler, revisar ou publicar, isso precisa virar texto corrido. A opção de parágrafos junta todas as linhas e corta um parágrafo novo a cada quantas frases você escolher (quatro, por padrão). Uma linha em branco no original e a troca de quem fala sempre começam um parágrafo.
Legendas automáticas muitas vezes vêm sem pontuação nenhuma. Nesse caso não dá para contar frases, então os parágrafos são cortados por tamanho, cerca de vinte palavras por frase pedida. Também dá para pedir uma frase por linha, que ajuda a revisar ou a montar um roteiro, ou manter as linhas como estão e só tirar o que sobra.
A última opção arruma o acabamento: tira espaços duplos e espaços antes de vírgula e ponto, apaga a vírgula que sobra quando uma hesitação sai e coloca letra maiúscula no começo das frases. Abreviações como Dr. e pág. não são confundidas com fim de frase.
Dá para tirar o "ahn" e o "hum" da transcrição?
Dá, com a opção de hesitações, que vem desligada. Ela tira só os sons que não querem dizer nada em nenhuma frase: em português, ahn, hum, hmm e é... (com reticências, porque o é sozinho é verbo); em inglês, um, uh e erm; em espanhol, eh, mmm e este... com reticências. O idioma é reconhecido pelo próprio texto.
Palavras que às vezes são vício e às vezes não, como tipo, né, então e assim, ficam no texto. Apagar todas mudaria o sentido de frases como "esse tipo de luz". Para saber quantas vezes elas aparecem, use o contador de vícios de linguagem.
Mais que limpar o texto. A transcrição já sai pronta para ler.
Perguntas frequentes
Como copiar a transcrição de um vídeo do YouTube sem os tempos?
Abra a transcrição do vídeo no YouTube, selecione o texto todo e copie. Cole aqui com a opção de tirar os tempos ligada: os tempos, as linhas de leitura de tela e as quebras somem, e o texto vira parágrafos que você copia ou baixa em TXT.
Como transformar um SRT em texto corrido?
Abra o arquivo SRT ou cole o conteúdo. Os números de cada legenda, as linhas com a seta --> e as tags de itálico saem, e as linhas de cada bloco são juntadas em frases e parágrafos. Funciona também com VTT, SBV e o JSON de uma transcrição.
A limpeza muda as palavras do texto?
Não. Ela só tira o que você escolheu: tempos, nomes de quem fala, marcações de som e, se ligar, hesitações como ahn e hum. O acabamento mexe em espaços, vírgulas que sobraram e letras maiúsculas no começo das frases. Nenhuma palavra é trocada ou corrigida.
Consigo manter os nomes de quem fala?
Sim. Escolha manter os nomes, ou tirar só os genéricos, como Falante 1 e SPEAKER_00, e manter os nomes reais. Em todos os casos, cada troca de pessoa começa um parágrafo novo.
Por que o texto ficou num parágrafo só?
Provavelmente o texto não tinha pontuação, o que é comum em legendas automáticas. Sem pontos, os parágrafos são cortados por tamanho. Diminua o número de frases por parágrafo ou escolha manter as linhas para ver a divisão original.
A ferramenta é grátis?
Sim. É grátis, sem cadastro e sem limite de uso. Um plano do FilmScribe só faz sentido se você quiser que nós transcrevamos a gravação, com quem falou e o tempo de cada frase.
Tem o vídeo? A transcrição sai limpa daqui. Com quem falou e quando.
Envie o arquivo ou cole o link do YouTube. Nós transcrevemos palavra por palavra, separamos quem fala, dividimos em capítulos e você baixa em TXT com ou sem tempos e nomes.
Veja o resultado no seu material antes de cadastrar o cartão.