Пошук ASCII / Unicode
Символи у кодові точки.
Приблизний пошук імен охоплює вбудований індекс поширених ASCII, символів та emoji.
Знайти кодові точки символів
Аналізуйте текст на чотирьох окремих рівнях: кластери grapheme, code point, code unit UTF-16 і bytes UTF-8. Перетворюйте запис U+ назад на символи, виконуйте приблизний пошук за поширеними іменами Unicode та переглядайте точні мітки блоків Unicode 16.0.
Поширені запитання
Що він підраховує?
Він окремо підраховує групи графем, які сприймає користувач, кодові точки Юнікоду, кодові одиниці UTF-16 та байти UTF-8. Це різні рівні, і їхні суми можуть відрізнятися.
Чи обробляє він емодзі?
Так. Intl.Segmenter визначає кластери графем, а таблиця перераховує всі базові кодові точки, включаючи ZWJ та селектори варіацій.
Як мені здійснити пошук?
Вставте символи, введіть точку коду, наприклад U+1F600, або здійсніть нечіткий пошук у вбудованому індексі загальноприйнятих назв. Результати пошуку за назвою можна вставити назад у аналізатор.
Які блоки Юнікоду використовуються?
Назви блоків взяті з точних діапазонів у файлі Unicode Blocks-16.0.0.txt. Невказані кодові точки позначаються як No_Block, а не відносяться до вигаданої широкої категорії.
Чи виявлено невидимі символи?
Так. Елементи керування, роздільники, з’єднувачі нульової ширини, селектори варіацій та комбіновані позначки мають чіткі підписи.
Чи завантажується мій текст?
Ні. Все працює у вашому браузері.
Останнє оновлення: