← ガイド

TOOLDAM GUIDE

CSVを開いたとき日本語・韓国語が文字化けする理由

CSVを作った側と開く側で文字エンコーディングの想定が違うと、文字化けが起こります。UTF-8やBOMの有無が代表的な確認点です。

まず知っておきたいこと

CSVでは文字エンコーディングが明確に伝わらない場合があり、プログラム間の想定が違うと文字化けします。

表の構造と文字コードは別問題

カンマ区切りが正しくても、バイトをどの文字として読むかは別です。UTF-8を別の文字セットとして読むと文字が意味のない記号になることがあります。

UTF-8でも結果が違う理由

BOMの有無やOSの既定文字セットを使って推測するプログラムがあります。同じCSVでもブラウザ、エディタ、表計算ソフトで結果が異なることがあります。

文字化けした原本を上書きしない

文字化けした状態で保存すると元のバイト情報まで変わり、復旧が難しくなることがあります。コピーで文字コードを変えて試しましょう。

受け渡し先の環境を考える

WebではUTF-8が一般的ですが、業務ソフトが別の文字コードを要求する場合があります。取り込み仕様があるならその仕様を優先します。