Corrigir acentos da legenda e salvar em UTF-8.
Para corrigir os acentos de uma legenda, arraste o arquivo SRT. Descobrimos em que codificação ele foi salvo, como Windows-1252, ISO-8859-1 ou UTF-16, consertamos textos com ç e ã no lugar de ç e ã e mostramos cada linha antes e depois. Você baixa em UTF-8, com ou sem BOM, pronto para a TV.
Grátis, sem cadastro- Codificação encontrada
- Quebra de linha
Cansou de consertar legenda alheia? Nós geramos a legenda certa direto do vídeo.
Linhas corrigidas
Antes: como um player que espera UTF-8 mostra o arquivo. Depois: o texto que vai no arquivo novo.
| Linha | Antes | Depois |
|---|
Como corrigir os acentos da legenda
- 01
Arraste o arquivo
SRT, VTT, ASS, SBV, SUB ou TXT. Use o arquivo, não o texto copiado, porque é nos bytes que a codificação aparece.
- 02
Confira o antes e depois
Mostramos a codificação encontrada, a quebra de linha e cada linha que muda, do jeito que a TV mostrava e do jeito que vai ficar.
- 03
Baixe em UTF-8
Com ou sem BOM, com quebra de linha CRLF ou LF. O arquivo sai com o mesmo nome, pronto para ficar ao lado do vídeo.
Por que a legenda aparece com ? ou à no lugar dos acentos
Todo texto é guardado como números, e a codificação é a tabela que diz qual número é qual letra. O ç, por exemplo, é um byte só em Windows-1252 e dois bytes em UTF-8. Quando a legenda foi salva numa tabela e o player lê com outra, a letra sai errada. Como o português e o espanhol usam muitos acentos, o problema aparece em quase toda fala.
São dois sintomas diferentes. Se aparece ? ou um losango com ?, o arquivo está em Windows-1252 ou ISO-8859-1 e o player espera UTF-8. Se aparece ç no lugar de ç e ã no lugar de ã, aconteceu o contrário: um UTF-8 foi aberto como Windows-1252 e salvo de novo assim, às vezes mais de uma vez. Corrigimos os dois casos.
| Você vê | Deveria ser | O que aconteceu |
|---|---|---|
| Cora��o | Coração | Arquivo em Windows-1252 lido como UTF-8 |
| Coração | Coração | UTF-8 lido como Windows-1252 e salvo de novo |
| Coração | Coração | O mesmo erro, duas vezes |
| “Amém†| “Amém” | Aspas curvas de um UTF-8 lido errado |
| Cora??o | Coração | Acento perdido antes: não tem volta |
Como descobrimos a codificação certa do arquivo
Primeiro olhamos as marcas no começo do arquivo, que identificam UTF-8 com BOM e UTF-16. Sem marca, testamos se os bytes formam um UTF-8 válido; um arquivo em Windows-1252 com acentos quase nunca forma. Se não for UTF-8, separamos Windows-1252, ISO-8859-1 e ISO-8859-15 pelos bytes que só existem em cada uma, como as aspas curvas do Windows e o símbolo do euro.
Depois procuramos o texto estragado em duas camadas, como ç e “, e reconstruímos cada letra, linha por linha. Linhas que já estavam certas ficam como estão, então um arquivo com uma parte boa e outra quebrada também sai inteiro. Antes de baixar, você vê a lista de cada linha que muda.
UTF-8, UTF-8 com BOM ou ANSI: qual escolher para TV, player e editor
UTF-8 é a escolha certa quase sempre: YouTube, VLC, Premiere, DaVinci Resolve, Final Cut e as TVs atuais leem sem problema. O BOM é uma marca de três bytes no começo do arquivo que avisa que ele é UTF-8. Algumas TVs, pen drives em aparelhos de DVD e programas antigos do Windows só reconhecem o UTF-8 com essa marca. Se a TV continuar mostrando símbolos, baixe de novo com BOM.
O ANSI, ou Windows-1252, só vale para aparelhos muito antigos que não leem UTF-8 de jeito nenhum. Ele guarda os acentos do português e do espanhol, mas não emojis, notas musicais ou outros alfabetos. Na quebra de linha, CRLF é o padrão do Windows e o mais seguro para TVs; LF é o padrão do Mac e do Linux, e os players atuais aceitam os dois.
- TV ou player atual, YouTube, editores de vídeo: UTF-8.
- TV antiga que ainda mostra símbolos: UTF-8 com BOM.
- Aparelho de DVD antigo que não aceita UTF-8: ANSI.
Quando o acento não tem mais volta
Se o arquivo já foi salvo com ? ou com o losango � no lugar das letras, a informação sumiu antes de chegar aqui: o arquivo guarda o ponto de interrogação, não o acento. Nenhuma ferramenta adivinha com segurança se n?o é não ou nao. Avisamos quantas palavras estão assim para você procurar o arquivo original ou corrigir à mão.
Para não cair nisso de novo, salve sempre em UTF-8. No Bloco de Notas do Windows, escolha UTF-8 em Codificação na hora de salvar; desde 2019 ele já usa UTF-8 por padrão. Ao baixar legendas, prefira as que já vêm em UTF-8.
Mais que consertar acento. A legenda nasce certa do seu vídeo.
Perguntas frequentes
Por que a legenda aparece sem acento na TV?
Porque o arquivo foi salvo numa codificação, quase sempre Windows-1252, e a TV lê como UTF-8. Converta para UTF-8 aqui; se a TV ainda mostrar símbolos, baixe com BOM, que avisa a TV de que o arquivo é UTF-8.
Como corrigir ç e ã na legenda?
Arraste o arquivo ou cole o texto. Esses pares aparecem quando um UTF-8 foi aberto como Windows-1252 e salvo de novo. Reconstruímos as letras, mesmo que o erro tenha acontecido mais de uma vez.
Como saber a codificação de um arquivo SRT?
Arraste o arquivo e veja o campo Codificação encontrada. Distinguimos UTF-8 com e sem BOM, UTF-16, Windows-1252, ISO-8859-1 e ISO-8859-15.
O que é UTF-8 com BOM?
É UTF-8 com três bytes no começo que avisam a codificação. Não muda o texto. Use quando uma TV ou programa antigo continuar mostrando símbolos com o UTF-8 comum.
A correção muda o tempo ou o texto da legenda?
Não. Só as letras com acento quebrado mudam. Números, tempos e quebras de linha das falas continuam iguais, e a lista de linhas corrigidas mostra cada mudança.
Funciona com legenda em espanhol?
Funciona. Ñ, ¿, ¡, acentos e ü do espanhol são corrigidos do mesmo jeito, assim como o francês, o italiano e o alemão.
Quer legenda sem esse tipo de problema? Nós transcrevemos o vídeo.
Envie o vídeo ou o link do YouTube. Nós transcrevemos com acentos e pontuação e você baixa o SRT em UTF-8, junto com cortes legendados.
Veja o resultado no seu material antes de cadastrar o cartão.