Unicode 17.0 · ブラウザ内処理

貼り付けた文字列の「見えない違い」を調べる

文字列が一致しない、文字数が合わない、コピー後に空白や記号が変わる。そんなとき、まず入力の中身をコードポイント単位で確認できます。入力内容はこの端末のブラウザ内だけで処理し、サイトへ送信しません。

入力を送信しないUnicode 17.0固定公式テストで検証結果をTXT保存

STEP 1

調べる文字列を貼り付ける

症状からガイドを選ぶ

入力内容はURL、ブラウザ保存領域、アクセス解析、外部API、エラー監視へ送信・保存しません。再読み込みやタブ終了後にも保持しません。「結果をTXTで保存」を選んだ場合だけ、この端末へファイルを作成します。

STEP 2

数え方を分けて確認する

一つに見える文字が、複数のコードポイントやUTF-16単位から成ることがあります。「見える字形数」はフォントやOSにも依存するため、確定値にはしません。

STEP 3

先に確認したい点

参考表示と安全なエスケープ表示

このブラウザでの参考表示

コードポイントを確認できる表示

文字ごとの確認

位置は入力のUTF-16コード単位です。制御文字や書式文字は、表示への影響を避けるため実文字ではなくラベルを表示します。

入力に含まれるコードポイントと分類
位置表示 / エスケープ種別Unicode名・分類Script / Bidi

Unicode 17.0での正規化比較

NFC・NFDはcanonicalな等価性、NFKC・NFKDは互換分解も扱います。互換正規化は情報上の区別を変える場合があるため、用途を確認してから利用してください。

エンコードの参考バイト列

UTF-16・UTF-32のエンディアンとBOMを分けて表示します。貼り付け後の文字列だけでは、元ファイルのencodingは断定できません。

Scriptの混在を確認する

日本語ではHan・Hiragana・Katakana・Commonの共存が通常です。Script数だけで異常や危険を断定しません。UTS #39の完全な類似文字判定とUAX #9の完全なBidi解析は、この版の提供範囲外です。

結果の次に読む

よくある原因をガイドで確認する

全ガイドを見る

データと確認範囲

Unicode 17.0.0の固定データを同梱し、正規化は公式NormalizationTest 20,034件、書記素分割はGraphemeBreakTest 766件で検証しています。字形そのもの、元ファイルのencoding、用途上の安全性を、この結果だけで断定するものではありません。

Unicode Character Database 17.0.0 · Unicodeデータ利用表示

PR