Pular para o conteúdo

Corrigir acentos da legenda e salvar em UTF-8.

Para corrigir os acentos de uma legenda, arraste o arquivo SRT. Descobrimos em que codificação ele foi salvo, como Windows-1252, ISO-8859-1 ou UTF-16, consertamos textos com ç e ã no lugar de ç e ã e mostramos cada linha antes e depois. Você baixa em UTF-8, com ou sem BOM, pronto para a TV.

Grátis, sem cadastro
Como usar

Como corrigir os acentos da legenda

  1. 01

    Arraste o arquivo

    SRT, VTT, ASS, SBV, SUB ou TXT. Use o arquivo, não o texto copiado, porque é nos bytes que a codificação aparece.

  2. 02

    Confira o antes e depois

    Mostramos a codificação encontrada, a quebra de linha e cada linha que muda, do jeito que a TV mostrava e do jeito que vai ficar.

  3. 03

    Baixe em UTF-8

    Com ou sem BOM, com quebra de linha CRLF ou LF. O arquivo sai com o mesmo nome, pronto para ficar ao lado do vídeo.

Por que a legenda aparece com ? ou à no lugar dos acentos

Todo texto é guardado como números, e a codificação é a tabela que diz qual número é qual letra. O ç, por exemplo, é um byte só em Windows-1252 e dois bytes em UTF-8. Quando a legenda foi salva numa tabela e o player lê com outra, a letra sai errada. Como o português e o espanhol usam muitos acentos, o problema aparece em quase toda fala.

São dois sintomas diferentes. Se aparece ? ou um losango com ?, o arquivo está em Windows-1252 ou ISO-8859-1 e o player espera UTF-8. Se aparece ç no lugar de ç e ã no lugar de ã, aconteceu o contrário: um UTF-8 foi aberto como Windows-1252 e salvo de novo assim, às vezes mais de uma vez. Corrigimos os dois casos.

Você vêDeveria serO que aconteceu
Cora��oCoraçãoArquivo em Windows-1252 lido como UTF-8
CoraçãoCoraçãoUTF-8 lido como Windows-1252 e salvo de novo
CoraçãoCoraçãoO mesmo erro, duas vezes
“Amém–Amém”Aspas curvas de um UTF-8 lido errado
Cora??oCoraçãoAcento perdido antes: não tem volta

Como descobrimos a codificação certa do arquivo

Primeiro olhamos as marcas no começo do arquivo, que identificam UTF-8 com BOM e UTF-16. Sem marca, testamos se os bytes formam um UTF-8 válido; um arquivo em Windows-1252 com acentos quase nunca forma. Se não for UTF-8, separamos Windows-1252, ISO-8859-1 e ISO-8859-15 pelos bytes que só existem em cada uma, como as aspas curvas do Windows e o símbolo do euro.

Depois procuramos o texto estragado em duas camadas, como ç e “, e reconstruímos cada letra, linha por linha. Linhas que já estavam certas ficam como estão, então um arquivo com uma parte boa e outra quebrada também sai inteiro. Antes de baixar, você vê a lista de cada linha que muda.

UTF-8, UTF-8 com BOM ou ANSI: qual escolher para TV, player e editor

UTF-8 é a escolha certa quase sempre: YouTube, VLC, Premiere, DaVinci Resolve, Final Cut e as TVs atuais leem sem problema. O BOM é uma marca de três bytes no começo do arquivo que avisa que ele é UTF-8. Algumas TVs, pen drives em aparelhos de DVD e programas antigos do Windows só reconhecem o UTF-8 com essa marca. Se a TV continuar mostrando símbolos, baixe de novo com BOM.

O ANSI, ou Windows-1252, só vale para aparelhos muito antigos que não leem UTF-8 de jeito nenhum. Ele guarda os acentos do português e do espanhol, mas não emojis, notas musicais ou outros alfabetos. Na quebra de linha, CRLF é o padrão do Windows e o mais seguro para TVs; LF é o padrão do Mac e do Linux, e os players atuais aceitam os dois.

  • TV ou player atual, YouTube, editores de vídeo: UTF-8.
  • TV antiga que ainda mostra símbolos: UTF-8 com BOM.
  • Aparelho de DVD antigo que não aceita UTF-8: ANSI.

Quando o acento não tem mais volta

Se o arquivo já foi salvo com ? ou com o losango � no lugar das letras, a informação sumiu antes de chegar aqui: o arquivo guarda o ponto de interrogação, não o acento. Nenhuma ferramenta adivinha com segurança se n?o é não ou nao. Avisamos quantas palavras estão assim para você procurar o arquivo original ou corrigir à mão.

Para não cair nisso de novo, salve sempre em UTF-8. No Bloco de Notas do Windows, escolha UTF-8 em Codificação na hora de salvar; desde 2019 ele já usa UTF-8 por padrão. Ao baixar legendas, prefira as que já vêm em UTF-8.

Perguntas frequentes

Por que a legenda aparece sem acento na TV?

Porque o arquivo foi salvo numa codificação, quase sempre Windows-1252, e a TV lê como UTF-8. Converta para UTF-8 aqui; se a TV ainda mostrar símbolos, baixe com BOM, que avisa a TV de que o arquivo é UTF-8.

Como corrigir ç e ã na legenda?

Arraste o arquivo ou cole o texto. Esses pares aparecem quando um UTF-8 foi aberto como Windows-1252 e salvo de novo. Reconstruímos as letras, mesmo que o erro tenha acontecido mais de uma vez.

Como saber a codificação de um arquivo SRT?

Arraste o arquivo e veja o campo Codificação encontrada. Distinguimos UTF-8 com e sem BOM, UTF-16, Windows-1252, ISO-8859-1 e ISO-8859-15.

O que é UTF-8 com BOM?

É UTF-8 com três bytes no começo que avisam a codificação. Não muda o texto. Use quando uma TV ou programa antigo continuar mostrando símbolos com o UTF-8 comum.

A correção muda o tempo ou o texto da legenda?

Não. Só as letras com acento quebrado mudam. Números, tempos e quebras de linha das falas continuam iguais, e a lista de linhas corrigidas mostra cada mudança.

Funciona com legenda em espanhol?

Funciona. Ñ, ¿, ¡, acentos e ü do espanhol são corrigidos do mesmo jeito, assim como o francês, o italiano e o alemão.

Quer legenda sem esse tipo de problema? Nós transcrevemos o vídeo.

Envie o vídeo ou o link do YouTube. Nós transcrevemos com acentos e pontuação e você baixa o SRT em UTF-8, junto com cortes legendados.

Veja o resultado no seu material antes de cadastrar o cartão.