テストファイル

混在(UTF-8 + SJIS + EUC-JP) の CSV

1 ファイル内で行ごとに文字コードが違う地獄。パーサ泣かせ。 内容はどのファイルも同じ(顧客名簿風の 3 行)。文字コードだけが違います。

ダウンロードsample-mixed.csv / 161 バイト
ファイル名sample-mixed.csv
文字コード混在(UTF-8 + SJIS + EUC-JP)
BOMなし
容量161 バイト
MD56f3cbd7ce9bd6a8c604900d36619415d
SHA-256acd1ae6ee304d339d6e344f104f3d4d0a1f33d934eff9313d161061bf3a83b99

コマンドで取得

curl
curl -o sample-mixed.csv https://naqto.com/api/dl/encoding/csv/mixed/

試してみる

この CSV を、あえて違う文字コードだと思って開いてみてください。たとえば UTF-8 のファイルを Shift_JIS だと思って開くと化けます。 これが文字化けの正体です——中身は壊れていません。読み方を間違えているだけ

化けたテキストは 文字化け修復ツールで元に戻せることがあります。 CSV の文字コードは、読む側が正しく指定するか、UTF-8(できれば BOM 付き)に統一するのが確実です。

← 他の文字コードの CSV を見る