文字コード診断
テキスト・Unicode · ファイル・OS
診断と変換はこのbrowser内だけで実行します。選択したファイルは送信せず、元のファイルも書き換えません。
16 MiBまでのファイルをdropするか選択します。読み込むとすぐに候補を並べます。
表のpreviewを見て、意図した文章として読める候補を選びます。自動では確定しません。
結果
ファイルを読み込むとここに結果が出ます。
使い方
ファイルを読み込む
テキストファイルをdropします。BOM・16進ダンプと、7つの文字コードでの読み方が並びます。
previewを見比べる
置換文字と制御文字の数を手掛かりに、意図した文章として自然に読める候補を探します。
UTF-8で保存する
元の文字コードを選び、必要ならBOMを付けて保存します。欠落する変換は既定で止まります。
判定範囲
入力は16 MiBまで、previewは先頭2,000文字、16進ダンプは先頭256バイトです。出力はUTF-8のみで、BOMの有無だけ選べます。UTF-32はBOMの検出だけ行い、変換は拒否します。文字コードの自動確定、すでに置換された文字の復元、改行やUnicode正規化の自動変更は行いません。Shift_JISなどの対応可否と互換マッピングはbrowserのTextDecoderの実装に従います。
よくある質問
- 文字コードを自動で確定してくれますか。
- 確定しません。同じバイト列が複数の文字コードで有効なことがあります。BOMとpreviewを見比べて選んでください。
- 「置換なしで読める」なら正しい文字コードですか。
- いいえ。バイト列として有効でも意図した文章とは限りません。語句や記号が自然に読めるかも確かめてください。
- 文字化けした文章を元に戻せますか。
- 元のバイト列が残っていて正しい文字コードを選べれば読み直せます。すでに置換文字になった情報は復元できません。
- UTF-8以外へ保存できますか。
- 出力はUTF-8だけです。UTF-8 BOMを付けるかどうかは選べます。