確認ガイド
見えない文字を見つける:空白・ゼロ幅文字・BOMの確認方法
コピーした文字列が一致しない、検索できない、CSVの列がずれるときに、空白やゼロ幅文字などの位置と役割を確認する手順です。
Unicode 17.0 · ブラウザ内処理
文字列が一致しない、文字数が合わない、コピー後に空白や記号が変わる。そんなとき、まず入力の中身をコードポイント単位で確認できます。入力内容はこの端末のブラウザ内だけで処理し、サイトへ送信しません。
STEP 1
入力内容はURL、ブラウザ保存領域、アクセス解析、外部API、エラー監視へ送信・保存しません。再読み込みやタブ終了後にも保持しません。「結果をTXTで保存」を選んだ場合だけ、この端末へファイルを作成します。
STEP 2
一つに見える文字が、複数のコードポイントやUTF-16単位から成ることがあります。「見える字形数」はフォントやOSにも依存するため、確定値にはしません。
STEP 3
位置は入力のUTF-16コード単位です。制御文字や書式文字は、表示への影響を避けるため実文字ではなくラベルを表示します。
| 位置 | 表示 / エスケープ | 値 | 種別 | Unicode名・分類 | Script / Bidi |
|---|
NFC・NFDはcanonicalな等価性、NFKC・NFKDは互換分解も扱います。互換正規化は情報上の区別を変える場合があるため、用途を確認してから利用してください。
UTF-16・UTF-32のエンディアンとBOMを分けて表示します。貼り付け後の文字列だけでは、元ファイルのencodingは断定できません。
日本語ではHan・Hiragana・Katakana・Commonの共存が通常です。Script数だけで異常や危険を断定しません。UTS #39の完全な類似文字判定とUAX #9の完全なBidi解析は、この版の提供範囲外です。
結果の次に読む
確認ガイド
コピーした文字列が一致しない、検索できない、CSVの列がずれるときに、空白やゼロ幅文字などの位置と役割を確認する手順です。
確認ガイド
NFC・NFD・NFKC・NFKDの違いを、検索、ID、表示テキストの実務に分けて判断するためのガイドです。
確認ガイド
絵文字や結合文字で「1文字」の数が変わる理由と、入力制限・DB・UIで採用すべき数え方を整理します。
確認ガイド
文字、コードポイント、UTFのコード単位、バイト列、BOMを混同せず、どの層を確認すべきか判断するガイドです。
確認ガイド
全角英数字や半角カナを、表示・検索・IDのどこで揃えるべきか、NFKCの影響とともに判断します。
確認ガイド
似て見えるU+301CとU+FF5Eを値・正規化・外部変換に分け、安全に照合・置換するためのガイドです。
Unicode 17.0.0の固定データを同梱し、正規化は公式NormalizationTest 20,034件、書記素分割はGraphemeBreakTest 766件で検証しています。字形そのもの、元ファイルのencoding、用途上の安全性を、この結果だけで断定するものではありません。