Поиск ASCII/Unicode
Символы в кодовые точки.
Приблизительный поиск имен охватывает встроенный индекс распространенных ASCII, символов и emoji.
Найти кодовые точки символа
Анализируйте текст на четырех отдельных уровнях: кластеры grapheme, code point, code unit UTF-16 и bytes UTF-8. Преобразуйте запись U+ обратно в символы, выполняйте приблизительный поиск по распространенным именам Unicode и просматривайте точные метки блоков Unicode 16.0.
Вопросы и ответы
Что он подсчитывает?
Инструмент отдельно подсчитывает группы графем, воспринимаемые пользователем, кодовые точки Юникода, кодовые единицы UTF-16 и байты UTF-8. Это разные уровни представления данных, и их итоговые значения могут отличаться.
Обрабатывает ли эмодзи?
Да. Intl.Segmenter определяет кластеры графем, а в таблице перечислены все базовые кодовые точки, включая ZWJ и селекторы вариаций.
Как мне осуществить поиск?
Вставьте символы, введите кодовую точку, например U+1F600, или выполните нечёткий поиск во встроенном индексе общих названий. Результаты поиска по названиям можно вставить обратно в анализатор.
Какие блоки Юникода используются?
Метки блоков берутся из точных диапазонов в файле Unicode Blocks-16.0.0.txt. Незарегистрированные кодовые точки отображаются как No_Block, а не относятся к широкой вымышленной категории.
Определяются ли невидимые символы?
Да. Элементы управления, разделители, соединители нулевой ширины, селекторы вариаций и комбинирующие знаки помечены явно.
Загружается ли мой текст?
Нет. Всё работает в вашем браузере.
Последнее обновление: