🔧 文字化け復元ツール
化けたテキスト
サンプル文字化けで試す
手元に化けたテキストが無いときは、次のどれかを押すと入力欄に入ります。
UTF-8 の文を Shift_JIS として開いてしまった例
本来は「こんにちは」
EUC-JP の文を Shift_JIS として開いてしまった例
本来は「よろしくお願いします」
EUC-JP の文を Shift_JIS として開いてしまった例(短文)
本来は「ありがとう」
UTF-8 の文を Shift_JIS として開き、一部が「?」に潰れた例
本来は「プリンターの用紙を補充してください」。「?」になった1文字は戻らないが、残りは戻る
EUC-JP の文を Shift_JIS として開き、外字が混ざった例
本来は「鯖と鰯の煮付けを注文した」。難しい漢字が □ や空白に見える外字になる
UTF-8 の文を Latin-1 として開いてしまった例
本来は「文字化け」。海外製ツールやメール配信を経由すると起きる
URLエンコードされたまま貼られた例
本来は「文字化け」。ログやURLからコピーすると起きる
メールの件名がMIMEのままの例
本来は「文字化け」。メールヘッダーを直接見ると起きる
HTMLの実体参照のまま貼られた例
本来は「文字化け」。HTMLのソースからコピーすると起きる
いただいた報告から直したこと
復元できなかったときに表示される報告フォームから、実際に戻せなかった化け方を送っていただいています。 そこから、次の化け方に対応しました。
- 2026年10月: UTF-8 の文章を Shift_JIS として開いたときに、一部の文字が「?」に潰れている形 (例:繝励Μ繝ウ繧ソ繝シ縺ョ逕ィ邏吶r陬懷?縺励※縺上□縺輔>)。 以前は「?」が1つ混ざるだけで候補ごと崩れていましたが、潰れた文字を「�」で示し、周りの文字を戻すようにしました。2件の報告から。
- 2026年10月: EUC-JP の文章を Shift_JIS として開いたときに、画数の多い漢字が外字(□ や空白に見える文字)になる形 (例:サェ、ネーホシムノユ、ア、桄ク、キ、ソ)。 外字の部分だけバイト列に戻せず、文章全体の復元に失敗していました。1件の報告から。
- 同時に: 末尾の1文字だけが欠けている文章と、「ー」や「、」「。」、全角の数字が多い文章で、正しく戻っているのに候補から外れていた問題を直しました。
このページに載せている例文は、上の例を含めてすべて弊社が作ったものです。 報告でいただいた文章そのものや、その一部を、そのまま載せることは一切ありません。 いただいた文章は化け方の種類を確かめる目的にだけ使っています。
わざと文字化けさせる
正常な文章を入れると、よくある化け方を並べて作ります。 テストデータを用意したいとき、手元の化け方がどの取り違えなのかを見比べたいときにどうぞ。
UTF-8 を Shift_JIS として開く
大半は戻せます(一部の文字は失われます)UTF-8のCSVをWindowsのExcelで開いたときの化け方。もっともよく見る形
縺薙s縺ォ縺。縺ッ縲よ枚蟄怜喧縺代?繝?せ繝医〒縺吶?
UTF-8 を Latin-1 として開く
元どおりに戻せます海外製のツールやメール配信サービスを経由したときの化け方
ã“ã‚“ã«ã¡ã¯ã€‚æ–‡å—化ã‘ã®ãƒ†ã‚¹ãƒˆã§ã™ã€‚
UTF-8 を EUC-JP として開く
戻せません古いUNIX系のサーバーやCGIに取り込んだときの化け方
???????????????????鴻??с???
Shift_JIS を UTF-8 として開く
戻せませんWindowsで作ったファイルをMacやLinuxで開いたときの化け方
����ɂ��́B���������̃e�X�g�ł��B
EUC-JP を Shift_JIS として開く
戻せません古い掲示板やCGIの出力をWindowsで開いたときの化け方
、ウ、ヒ、チ、マ。」ハクサ?ス、ア、ホ・ニ・ケ・ネ、ヌ、ケ。」
UTF-8 を Shift_JIS として開く(二重)
戻せません化けたまま保存して、もう一度同じ取り違えをしたときの化け方
邵コ阮呻ス鍋クコ?ォ邵コ?。邵コ?ッ邵イ繧域椢陝??蝟ァ邵コ莉」?郢?縺帷ケ晏現縲堤クコ蜷カ?
URLエンコードされた形
元どおりに戻せますメールやチャットにURLを貼ったとき、日本語部分がこの形で表示されることがある
%E3%81%93%E3%82%93%E3%81%AB%E3%81%A1%E3%81%AF%E3%80%82%E6%96%87%E5%AD%97%E5%8C%96%E3%81%91%E3%81%AE%E3%83%86%E3%82%B9%E3%83%88%E3%81%A7%E3%81%99%E3%80%82
HTMLの数値文字参照
元どおりに戻せますCMSやフォームが日本語をこの形で保存し、そのまま表示されてしまう場合
こんにちは。文字化けのテストです。
濁点・半濁点の分離
元どおりに戻せますmacOSで作ったZIPやファイル名で起きる。見た目はほぼ同じだが別の文字列になる
こんにちは。文字化けのテストです。
各行の札は、作った化け文字を上の欄に貼り直して実際に復元をかけた結果です。 「戻せません」のものは、変換の途中でバイト列が「?」や「�」に置き換わったか、 別の文字に移ってしまい、元の文章を復元する手がかりが残っていません。 実際の文字化けでもこの形になったものは、このツールに限らず戻せません。 手元の化けたテキストがどれに似ているかを見れば、戻せる見込みがあるかの目安になります。
化け方から原因を見分ける
化けた文字の並びを見れば、何がどう読み違えられたのかはある程度分かります。 下の表の「復元」が「できます」になっているものは、化けた文字列をそのまま上の欄に貼れば戻ります。 一方で「�」や「?」が並んでいる場合は元のバイト列そのものが失われているため、 このツールに限らず復元できません。
| 化け方の例 | 原因 | 復元 | 補足 |
|---|---|---|---|
| 縺薙s縺ォ縺。縺ッ | UTF-8 の文字列を Shift_JIS として開いた | できます | 日本語の文字化けで最も多い形。「縺」「繧」「蜃」が目立つのが目印です |
| 譁�蟄怜喧縺 | UTF-8 の文字列を Shift_JIS として開いた(末尾に半端なバイトが残った形) | できます | 末尾が欠けていても、読める部分までは復元できます |
| 、「、熙ャ、ネ、ヲ | EUC-JP の文字列を Shift_JIS として開いた | できます | 半角カナと「、」が並ぶのが目印。古いサーバーからの出力に多い形です |
| 繧オ繝シ繝舌?縺ョ繝。繝ウ繝?リ | UTF-8 の文字列を Shift_JIS として開いた(一部が「?」に潰れた形) | できます | 「縺」「繧」の間に「?」が点在する形。「?」になった文字そのものは戻りませんが、周りの文字は戻せます(2026年10月に対応) |
| ヒ釥ホサノソネ、ネーウ、ホアニ、ュ | EUC-JP の文字列を Shift_JIS として開いた(外字が混ざった形) | できます | 半角カナの中に □ や空白に見える文字(外字)が混ざる形。画数の多い漢字がそこに落ちます(2026年10月に対応) |
| æ–‡å—化㑠| UTF-8 の文字列を Latin-1 / Windows-1252 として開いた | できます | 海外製のツールやメール配信を経由すると起きます。日本語の文字コードだけを見ていると見逃す形です |
| %E6%96%87%E5%AD%97 | URLエンコードされたまま貼られた | できます | 厳密には文字化けではありませんが、ログやブラウザのURL欄からコピーするとこの形になります |
| 文字 | HTMLの実体参照のまま貼られた | できます | HTMLのソースやCMSの出力からコピーしたときに起きます |
| =?UTF-8?B?5paH5a2X?= | メールの件名がMIMEエンコードのまま | できます | メールヘッダーを直接見たときの形です。Base64・quoted-printable のどちらも戻せます |
| がい | 濁点が本体から分離している(Unicode正規化の違い) | できます | macOSで作ったZIPをWindowsで開くとよく起きます。見た目はほぼ同じですが検索に引っかかりません |
| ��� | 変換のときに読めなかったバイトが置換文字に潰された | できません | 元のバイト列が消えているため、どのツールを使っても復元できません。化けていないファイルを入手し直す必要があります |
| ????? | 変換先の文字コードに無い文字が「?」に置き換えられた | できません | 全部が「?」なら同じく情報が失われています。丸数字や「髙」のような環境依存文字で起きやすい化け方です。「縺」「繧」のような化け文字の間に点々と混ざるだけなら、その文字以外は戻せます |
なぜ文字化けするのか
コンピューターは文字を「バイト列」として保存・送信しており、そのバイト列をどの文字コード(UTF-8・Shift_JIS・EUC-JPなど)のルールで文字に戻すかは、別途どこかで伝える必要があります。
例えば「UTF-8」で保存されたファイルを、文字コードの指定が誤っていて「Shift_JIS」のルールで開いてしまうと、まったく違う文字の並びとして解釈されてしまいます。これが文字化けの正体です。
このツールは、化けた文字列を「誤ったルールでエンコードし直してバイト列に戻し」「別の文字コードのルールで読み直す」ことで、元の文章を逆算して復元しています。
化けた文字列そのものを「化け文字」、そこから元の文章を割り出すことを「解読」「復元」「修復」「修正」と呼ぶことがありますが、どれも同じ作業を指しています。「文字化けの翻訳」という言い方をされることもありますが、外国語を訳しているわけではなく、読み違えられた文字コードを正しい読み方に戻しているだけです。英語圏でも文字化けはそのまま mojibake と呼ばれます。
ファイルの文字コード変換
テキストファイルをアップロードすると、文字コードを自動判定してUTF-8として表示します。ファイルサイズ上限は5MBです。
入力内容の復元・変換はすべてブラウザ内で処理しています。 復元できなかったときに出る報告フォームで送信ボタンを押した場合にのみ、 化けたテキストの先頭200文字が弊社に送られます。 それ以外に、入力内容が弊社サーバーへ送信・保存されることはありません。
化けてしまったテキストを貼り付けると、「どの文字コードとして書かれたものを、どの文字コードとして誤って開いてしまったのか」を総当たりで調べ、もっとも日本語らしい復元候補を表示します。ファイルの文字コード変換にも対応しています。