Informações de Caractere
Descubra o código Unicode, ASCII, HTML e outras informações de qualquer caractere. Ferramenta técnica para desenvolvedores.
Sobre Informações de Caracter
Esta ferramenta retorna informações detalhadas sobre qualquer caractere Unicode: nome oficial (LATIN CAPITAL LETTER A, BLACK STAR, GRINNING FACE...), código decimal e hexadecimal, categoria (letra, número, pontuação, símbolo, emoji), bloco Unicode ao qual pertence (Basic Latin, Greek, Cyrillic, Emoticons, etc.) e a entidade HTML equivalente quando existe. Útil para desenvolvedores que precisam saber o code point de um caractere para usar em CSS (`content: '\f005'`), JSON (`\u00e9`) ou códigos-fonte; designers identificando símbolos copiados de outros lugares; estudantes de tipografia e linguística; e qualquer pessoa curiosa sobre o caractere que está vendo. Cole ou digite um caractere e veja toda a anatomia técnica dele.
Como usar o Informações de Caracter
Digite ou cole o caractere no campo e clique em 'Analisar'. As informações exibidas incluem código Unicode, decimal, hexadecimal, HTML entity e descrição.
Para que serve?
Para identificar caracteres especiais em strings, depurar problemas de encoding, encontrar entidades HTML corretas e trabalhar com internacionalização.
Unicode por dentro: code points, planos, categorias e a anatomia de um caractere
O padrão Unicode organiza mais de 149.000 caracteres em 17 planos de 65.536 posições cada. O Plano 0 (BMP, Basic Multilingual Plane) cobre a maioria dos idiomas modernos; os planos 1 e 2 incluem símbolos históricos, emojis e caracteres CJK unificados raramente usados. Cada posição é um 'code point', escrito em hexadecimal com o prefixo U+ (ex: U+0041 = 'A'). Além do code point, cada caractere tem uma categoria geral (Letra maiúscula = Lu, Letra minúscula = Ll, Número decimal = Nd, Pontuação = P*, Símbolo = S*), um nome oficial e propriedades binárias como 'é diacrítico', 'é alfanumérico', 'é bidirecional'. Saber a categoria de um caractere é fundamental para escrever expressões regulares corretas: `\p{L}` corresponde a qualquer letra de qualquer idioma, enquanto `[a-zA-Z]` só cobre o alfabeto latino básico.
Debugging de encoding, fontes faltantes e compatibilidade de banco de dados
Quando um caractere aparece como '□' (tofu) ou '?' na tela, saber seu code point permite investigar: é um caractere da fonte instalada? Está no charset do banco de dados? O MySQL com charset `latin1` não armazena caracteres acima de U+00FF — inserir '€' (U+20AC) resulta em '?' silencioso. Verificar os bytes UTF-8 de um caractere também é útil para calcular o tamanho real de strings antes de enviar para APIs com limite de bytes. Em desenvolvimento de fontes e tipografia, designers precisam saber o code point exato para mapear glifos corretamente no arquivo .ttf/.otf. Em segurança, conhecer as propriedades de um caractere ajuda a detectar ataques de homoglyph — onde 'а' cirílico (U+0430) substitui 'a' latino (U+0061) em URLs de phishing, parecendo idêntico visualmente mas sendo um caractere completamente diferente.
Perguntas Frequentes
O que é Unicode?
Unicode é o padrão universal de codificação de caracteres, com mais de 149.000 caracteres representando virtualmente todos os sistemas de escrita do mundo. Cada caractere tem um 'code point' único (ex: 'A' = U+0041, '😀' = U+1F600).
Diferença entre ASCII e Unicode?
ASCII (1963) tem apenas 128 caracteres — inglês básico, números, símbolos comuns. Unicode (1991) é o padrão moderno, contempla todos os idiomas, emojis, símbolos matemáticos, etc. Unicode é superconjunto de ASCII para os 128 primeiros caracteres.
O que é uma HTML entity?
É a forma de escrever um caractere especial em HTML usando seu código. Ex: '©' ou '©' = ©. Usada quando o caractere não existe no encoding da página ou tem significado especial no HTML (<, >, &).
Para que serve ver o código do caractere?
Para desenvolvedores: converter entre sistemas, depurar problemas de encoding, trabalhar com internacionalização (i18n), identificar caracteres invisíveis (como espaços Zero-Width Space U+200B) que causam bugs em strings.
👍 99% dos usuários acham este conteúdo útil
(25 avaliações nos últimos 12 meses)
Os dados gerados por esta ferramenta são fictícios e destinados exclusivamente a testes de software e estudos. A má utilização é de total responsabilidade do usuário.