Resposta rápidaCSV com acentos errados (ç no lugar de ç, ã no lugar de ã) quase nunca é arquivo corrompido: é o arquivo em UTF-8 sendo lido como ANSI (Windows-1252), ou o contrário. Para corrigir, abra pela importação de dados escolhendo UTF-8, ou converta o arquivo para UTF-8 com BOM, que o Excel reconhece. Se forem vários CSVs, padronize todos de uma vez antes de importar.
O relatório veio do sistema, você dá dois cliques e a planilha mostra "São Paulo", "AçaÃ" e "Informações". Ou acontece o inverso: a planilha sobe no sistema da loja e os nomes dos produtos chegam com losangos de interrogação no lugar das letras acentuadas.
Os dois sintomas têm a mesma raiz. Quem pesquisa "csv acentos errados" costuma achar que o arquivo estragou, mas o CSV com acentos errados é um problema de encoding, a "tabela" que o programa usa para transformar bytes em letras. Entendendo isso, a correção leva minutos e deixa de se repetir.
O que é encoding, sem jargão
Um arquivo de texto é só uma sequência de números (bytes). Para mostrar letras, o programa consulta uma tabela que diz "o byte tal é a letra tal". Essa tabela é o encoding.
O problema é que existem várias tabelas, e o CSV não diz qual foi usada. O programa tenta adivinhar. Quando adivinha errado, as letras comuns (A a Z, números) saem certas, porque são iguais em quase todas as tabelas. As acentuadas saem trocadas.
Os dois encodings que você vai encontrar no Brasil:
| Encoding | Também chamado de | Onde aparece | Bytes por letra acentuada |
|---|---|---|---|
| UTF-8 | Unicode | Web, sistemas atuais, Google Planilhas, exportações modernas | 2 |
| Windows-1252 | ANSI, Latin-1, ISO-8859-1 (parecido) | Excel antigo, ERPs e sistemas contábeis mais velhos | 1 |
Segundo a explicação do W3C sobre codificação de caracteres, o UTF-8 foi pensado para representar os caracteres de todos os idiomas. Por isso virou o padrão da web: levantamentos como os da W3Techs indicam que ele é usado por mais de 95% dos sites. A MDN também traz uma definição curta e útil.
Os três sintomas e o que cada um significa
"ç", "ã", "é" no lugar das letras
O arquivo está em UTF-8 e foi aberto como ANSI. Cada letra acentuada tem 2 bytes em UTF-8, e o programa mostra cada byte como uma letra separada. É o caso mais comum ao abrir com dois cliques no Excel um CSV exportado de sistema web, loja virtual ou Google Planilhas.
A boa notícia: o arquivo está certo. Basta abrir do jeito certo ou acrescentar o BOM.
"�" ou "?" no lugar dos acentos
O arquivo está em ANSI e foi lido como UTF-8. O byte da letra acentuada não forma uma sequência válida em UTF-8, e o programa coloca o símbolo de substituição. Acontece muito ao importar no sistema da loja um CSV salvo pelo Excel no formato "CSV (separado por vírgulas)".
Aqui é preciso converter o arquivo para UTF-8 antes de importar.
"ç" gravado de vez nos dados
Alguém abriu o CSV com o encoding errado e salvou por cima. Agora o "ç" virou dado de verdade. Converter o encoding não resolve, porque o arquivo está "certo" com o texto errado dentro. O caminho é recuperar o original exportado pelo sistema ou corrigir com localizar e substituir.
Pasta Mágica
Converta seus CSVs para UTF-8 de uma vez
Solte os arquivos: o encoding é detectado, o delimitador também, e a saída sai sempre em UTF-8, com BOM para o Excel reconhecer os acentos.
Como corrigir CSV com acentos errados passo a passo
O roteiro abaixo cobre os dois primeiros sintomas, que respondem pela grande maioria dos casos:
- Não salve por cima do arquivo com acentos estranhos. Feche sem salvar.
- Identifique o sintoma: "ç" (UTF-8 lido como ANSI) ou "�" (ANSI lido como UTF-8).
- Para só visualizar no Excel, use Dados > Obter dados > De Texto/CSV e escolha a origem 65001: Unicode (UTF-8).
- Para padronizar o arquivo, converta para UTF-8 com BOM.
- Confira o delimitador: CSV brasileiro costuma usar ponto e vírgula; o de sistemas estrangeiros, vírgula.
- Abra o resultado com dois cliques e confira algumas linhas com ç, ã, é e õ.
- Importe no sistema de destino e confira os mesmos registros lá.
- Registre o padrão (UTF-8, delimitador escolhido) para a equipe usar sempre.
O papel do BOM
O BOM (byte order mark) é uma marca de 3 bytes no início do arquivo que avisa "este texto está em UTF-8". O Excel para Windows usa essa marca para escolher a tabela certa ao abrir com dois cliques. A maioria dos sistemas modernos ignora o BOM sem problema. Alguns importadores antigos, porém, leem a marca como parte do nome da primeira coluna. Se o sistema de destino reclamar do cabeçalho, gere o arquivo sem BOM.
E o delimitador?
Encoding e delimitador costumam aparecer juntos. O Excel em português usa ponto e vírgula porque a vírgula é o separador decimal. Um CSV com vírgulas abre "tudo numa coluna só". O guia de CSV com ponto e vírgula trata desse outro lado do problema.
Resumo prático para o caso de CSV acentos errados: se aparece "Ã", o arquivo provavelmente está bom e a leitura é que falhou; se aparece "�", o arquivo precisa ser convertido.
Quando a solução é sair do CSV
Se o arquivo vai ser aberto por pessoas, e não importado por sistemas, considere entregar em XLSX. A planilha do Excel guarda o texto em Unicode internamente, então o problema de encoding simplesmente não existe ali. É o caminho mais simples para relatórios que circulam por e-mail entre setores. Veja como converter CSV para Excel.
Antes e depois na rotina de um e-commerce
Uma loja exporta pedidos da plataforma toda segunda-feira e manda para o financeiro, que abre no Excel. Toda semana, alguém perde entre 15 minutos e 20 minutos corrigindo nomes de clientes e cidades à mão, com risco de errar um CPF ou endereço no caminho.
Padronizando a exportação para UTF-8 com BOM, ou entregando direto em XLSX, a correção manual desaparece. Em um ano, são algo como 15 horas devolvidas, cerca de 2 dias úteis de trabalho, e nenhum "São Paulo" na nota fiscal.
Checklist de prevenção
- Combine um encoding padrão com a equipe: UTF-8.
- Prefira importar a abrir com dois cliques quando o arquivo vier de fora.
- Nunca salve por cima de um CSV que abriu com acentos estranhos.
- Mantenha uma cópia do arquivo original exportado pelo sistema.
- Para circular entre pessoas, entregue em XLSX.
Perguntas frequentes
Porque o arquivo está em UTF-8 e o Excel o abriu como se fosse ANSI (Windows-1252). Cada letra acentuada, que em UTF-8 ocupa 2 bytes, é lida como dois caracteres separados. O arquivo costuma estar íntegro; o problema está na leitura.
São duas tabelas diferentes para transformar bytes em letras. UTF-8 cobre todos os idiomas e é o padrão da web e da maioria dos sistemas. ANSI, no Windows em português, quase sempre significa Windows-1252, uma tabela antiga que cobre só idiomas ocidentais.
Use a importação de dados (Dados > Obter dados > De Texto/CSV) e escolha a origem 65001: Unicode (UTF-8). Outra saída é salvar o CSV em UTF-8 com BOM, uma marca no início do arquivo que o Excel reconhece ao abrir com dois cliques.
Fica mais difícil. Depois de salvo, o ç passa a fazer parte dos dados, e a conversão de encoding não desfaz isso sozinha. Volte ao arquivo original exportado pelo sistema, se ainda existir, ou corrija com localizar e substituir.
Na dúvida, UTF-8. É o padrão da maioria das plataformas atuais. Alguns sistemas mais antigos, como certos ERPs e programas contábeis, ainda pedem ANSI; nesse caso, siga o que a documentação do sistema exige.
Como automatizar isso com a Pasta Mágica
Na Pasta Mágica, a padronização de CSV usa bibliotecas tradicionais de leitura e escrita de planilhas — sem IA alterando os seus dados.
- Crie sua conta em pastamagica.com.br/cadastrar e teste com um CSV real que dá problema.
- Escolha Padronizar CSV. A etapa detecta se o arquivo está em UTF-8 ou em ANSI/Latin-1, converte para UTF-8 e avisa quando houve conversão.
- Ajuste as opções: delimitador de entrada (automático ou fixo), delimitador de saída (vírgula, ponto e vírgula, tabulação ou barra vertical), BOM ligado ou desligado, remoção de espaços sobrando, de linhas vazias e de linhas duplicadas.
- Se o destino for uma pessoa, encadeie CSV para Excel e entregue em XLSX.
- Solte os arquivos e baixe os prontos, um a um ou em ZIP. Cada arquivo é conferido pelo conteúdo, não pela extensão.
A etapa corrige o encoding do arquivo, mas não desfaz um "ç" que já foi salvo como texto. O custo em créditos aparece antes de rodar e, se uma etapa falhar, a reserva volta sozinha. Os limites de cada plano estão na tabela de preços.
Pasta Mágica
CSVs em UTF-8, com acento certo, sempre
Monte o fluxo de padronização uma vez e use em cada exportação: encoding, delimitador, espaços e duplicados resolvidos de uma vez.