Remover Acentos

Remove acentos e caracteres especiais do texto.

O resultado aparece aqui...

Para que serve remover acentos?

A remoção de acentos (processo técnico chamado de "transliteração" ou "normalização Unicode") é necessária em diversas situações onde caracteres acentuados causam problemas técnicos ou são indesejados por questões de compatibilidade.

Casos de uso

URLs e slugs: URLs de páginas web não devem conter acentos — "são-paulo" deveria ser "sao-paulo" no endereço. A remoção de acentos é o primeiro passo para criar URLs amigáveis a partir de títulos em português.

Nomes de arquivos: sistemas operacionais e servidores podem ter problemas com arquivos cujo nome contém acentos, especialmente ao transferir entre Windows, macOS e Linux com diferentes encodings.

Banco de dados e buscas: sistemas legados em encodings antigos (ASCII, Latin-1) não suportam caracteres acentuados. Para buscas case-insensitive e accent-insensitive em MySQL, normalizar o texto é mais simples que configurar collations complexas.

Integração com APIs externas: algumas APIs americanas ou europeias aceitam apenas ASCII e rejeitam ou corrompem caracteres Unicode acentuados.

SMS e sistemas legados: SMS padrão GSM 7-bit não suporta acentos. Mensagens com caracteres acentuados são enviadas em encoding UCS-2, que reduz o número de caracteres por mensagem de 160 para 70, aumentando o custo.

Quais acentos são removidos

Nossa ferramenta remove os acentos mais comuns do português: agudo (á é í ó ú), grave (à), circunflexo (â ê ô), til (ã õ), cedilha (ç → c), trema (ü → u). As letras base são preservadas — "ação" vira "acao", "coração" vira "coracao".

O que acontece por baixo: normalização Unicode

A remoção de acentos não é uma tabela de substituição, e sim um processo em dois passos. Primeiro o texto é decomposto na forma NFD do Unicode, em que "á" deixa de ser um caractere único e passa a ser "a" seguido de um acento combinante independente. Depois, todos os caracteres da categoria de marca diacrítica são descartados, sobrando apenas as letras base.

Essa abordagem é o padrão porque funciona para qualquer idioma sem precisar de lista: trata acentos do português, do francês, do alemão, do espanhol e de dezenas de outros com o mesmo código. O "ç" merece nota: ele não é um "c" com acento no sentido técnico, mas a decomposição Unicode o trata como "c" mais cedilha, e por isso ele também é convertido corretamente para "c".

Onde remover acentos é a decisão certa

URLs e slugs: endereços com acento funcionam, mas viram códigos ilegíveis quando copiados (%C3%A1 no lugar de "á") e quebram em sistemas antigos. Slugs sem acento são a prática padrão da web.

Nomes de arquivo: acentos causam problema em transferências entre sistemas operacionais diferentes, em FTP e em arquivos ZIP, onde a codificação nem sempre é preservada.

Busca tolerante: normalizar tanto o termo buscado quanto o conteúdo indexado faz com que "Sao Paulo" encontre "São Paulo" — comportamento que o usuário espera de qualquer campo de busca.

Identificadores em código: nomes de variáveis, colunas de banco e chaves de API devem ser ASCII puro por compatibilidade.

Sistemas legados e integrações: mainframes, arquivos de remessa bancária (CNAB) e integrações antigas frequentemente aceitam apenas ASCII.

Onde não remover

Em texto que será lido por pessoas, jamais. Retirar acentos de conteúdo publicado prejudica a leitura, muda o significado ("e" e "é", "pais" e "país", "por" e "pôr", "avo" e "avô") e passa impressão de descuido. A remoção é uma operação de normalização técnica, não de edição de texto: use no identificador, mantenha no conteúdo.

Continue por aqui

Perguntas frequentes

Como a remoção de acentos funciona tecnicamente?

Em dois passos: o texto é decomposto na forma NFD do Unicode, em que "á" vira "a" mais um acento combinante independente, e depois todos os caracteres da categoria de marca diacrítica são descartados. Funciona para qualquer idioma, sem precisar de tabela.

O ç também é convertido?

Sim, vira "c". Tecnicamente a cedilha não é um acento, mas a decomposição Unicode a trata como marca diacrítica sobre o "c", e por isso o processo a remove corretamente.

Quando devo remover acentos?

Em URLs e slugs, nomes de arquivo, identificadores de código, chaves de API, integrações com sistemas legados e arquivos de remessa bancária, e para normalizar buscas — fazendo com que "Sao Paulo" encontre "São Paulo".

Quando não devo remover?

Em texto que será lido por pessoas. Remover acentos de conteúdo publicado prejudica a leitura e muda significados: "e" e "é", "pais" e "país", "por" e "pôr", "avo" e "avô". É uma normalização técnica, não uma edição de texto.

Ferramentas relacionadas