Разработчик

Поиск ASCII/Unicode

Символы в кодовые точки.

Обзор:

Приблизительный поиск имен охватывает встроенный индекс распространенных ASCII, символов и emoji.

Найти кодовые точки символа

Анализируйте текст на четырех отдельных уровнях: кластеры grapheme, code point, code unit UTF-16 и bytes UTF-8. Преобразуйте запись U+ обратно в символы, выполняйте приблизительный поиск по распространенным именам Unicode и просматривайте точные метки блоков Unicode 16.0.

Вопросы и ответы

Что он подсчитывает?

Инструмент отдельно подсчитывает группы графем, воспринимаемые пользователем, кодовые точки Юникода, кодовые единицы UTF-16 и байты UTF-8. Это разные уровни представления данных, и их итоговые значения могут отличаться.

Обрабатывает ли эмодзи?

Да. Intl.Segmenter определяет кластеры графем, а в таблице перечислены все базовые кодовые точки, включая ZWJ и селекторы вариаций.

Как мне осуществить поиск?

Вставьте символы, введите кодовую точку, например U+1F600, или выполните нечёткий поиск во встроенном индексе общих названий. Результаты поиска по названиям можно вставить обратно в анализатор.

Какие блоки Юникода используются?

Метки блоков берутся из точных диапазонов в файле Unicode Blocks-16.0.0.txt. Незарегистрированные кодовые точки отображаются как No_Block, а не относятся к широкой вымышленной категории.

Определяются ли невидимые символы?

Да. Элементы управления, разделители, соединители нулевой ширины, селекторы вариаций и комбинирующие знаки помечены явно.

Загружается ли мой текст?

Нет. Всё работает в вашем браузере.

Последнее обновление: