Pesquisa ASCII / Unicode
Caracteres para pontos de código.
Os nomes aproximados abrangem o índice integrado de ASCII, símbolos e emoji comuns.
Consultar pontos de código de caracteres
Analise o texto em quatro camadas distintas: clusters de grapheme, pontos de código, unidades de código UTF-16 e bytes UTF-8. Converta a notação U+ em caracteres, faça uma busca aproximada por nomes Unicode comuns e consulte os rótulos exatos dos blocos Unicode 16.0.
Perguntas frequentes
O que ele conta?
Ela conta separadamente os grupos de grafemas percebidos pelo usuário, os pontos de código Unicode, as unidades de código UTF-16 e os bytes UTF-8. Essas são camadas diferentes e podem ter totais distintos.
Lida com emojis?
Sim. O Intl.Segmenter identifica agrupamentos de grafemas enquanto a tabela lista todos os pontos de código subjacentes, incluindo ZWJ e seletores de variação.
Como posso pesquisar?
Cole caracteres, insira um ponto de código como U+1F600 ou faça uma busca aproximada no índice de nomes comuns integrado. Os resultados de nomes podem ser inseridos novamente no analisador.
Quais blocos Unicode são utilizados?
As etiquetas de bloco vêm das faixas exatas do arquivo Unicode Blocks-16.0.0.txt. Os pontos de código não listados são relatados como No_Block em vez de serem incluídos em uma categoria genérica inventada.
Os caracteres invisíveis são identificados?
Sim. Controles, separadores, conectores de largura zero, seletores de variação e marcas de combinação são rotulados explicitamente.
O meu texto é carregado?
Não. Tudo é executado no seu navegador.
Última atualização: