開発者

ASCII / Unicode検索

文字をコードポイントに変換

閲覧:

名前のあいまい検索は、内蔵の一般的な ASCII、記号、emoji の索引を対象にします。

文字コードポイントを検索

テキストを grapheme クラスター、コードポイント、UTF-16 コードユニット、UTF-8 bytes の四つの層で分析します。U+ 表記を文字に戻し、一般的な Unicode 名をあいまい検索し、正確な Unicode 16.0 ブロックラベルを確認できます。

よくある質問

何をカウントする?

ユーザーが認識する字素クラスター、Unicodeコードポイント、UTF-16コードユニット、UTF-8バイトをそれぞれ別個にカウントします。これらは異なるレイヤーであり、合計値が一致しない場合があります。

絵文字に対応していますか?

はい。Intl.Segmenterが字素クラスターを識別し、表にはZWJやバリエーションセレクターを含むすべての下位コードポイントが記載されます。

どのように検索すればよいですか?

文字を貼り付けるか、U+1F600のようなコードポイントを入力するか、組み込みの通称インデックスであいまい検索を行ってください。名称の結果は解析ツールに再挿入できます。

どのUnicodeブロックが使用されていますか?

ブロックラベルはUnicode Blocks-16.0.0.txtに記載されている正確な範囲から取得されます。リストにないコードポイントは、広範な架空カテゴリに分類されるのではなくNo_Blockとして報告されます。

不可視文字が識別されますか?

はい。コントロール文字、区切り文字、ゼロ幅結合子、表記バリエーション選択子、および結合マークには明確にラベルが付けられています。

テキストはアップロードされますか?

いいえ、すべてブラウザ上で動作します。

最終更新日: