CSVファイルを開く
ファイルに実際に入っている内容を確認できます。先頭のゼロは消えず、勝手に日付になることもなく、区切り文字と文字コードは自動で判定します。何も保存されません。
- 保存しません
- 順番待ちなし
- 登録不要・透かしなし
使い方
ファイルをドロップ
CSV、TSV、またはセミコロンや縦棒で区切ったファイルに対応。区切り文字は自動で判定します。
表として確認
並べ替えと検索ができ、行番号と列番号も表示されます。すべての値を保存されているとおりに表示します。
必要な情報を探す
行を絞り込んだり、列に移動したり、空のセルや列数のそろわない行を確認したりできます。
Excelに触らせずにCSVを読む
ExcelではなくここでCSVを見る理由は、Excelが開く時点でCSVを書き換えてしまうからです。 郵便番号や口座番号の先頭のゼロは、列が数値に見えるという理由で消されます。15桁を超える識別番号は丸められます。日付に見えるものは地域の書式に変換されるので、03/05の意味は国によって変わります。SEPT1のような遺伝子名は日付になってしまい、この問題があまりに根深いため、遺伝学者は遺伝子の名前を変えました。ここではそうしたことは一切起こらず、値はファイル内のバイトが示すとおりに表示されます。
CSVには実質的な標準がないため、まずはファイルがどういうものかを見極める必要があります。区切り文字 はカンマ、セミコロン、タブのいずれかの可能性があります。ヨーロッパの地域設定ではカンマが小数点に使われるため、セミコロンでエクスポートされます。文字コード はUTF-8か古いコードページのどちらかで、判定を誤るとアクセント付きの名前が文字化けします。どちらも決め打ちせず自動判定するので、現実のエクスポートのほぼすべてに対応でき、判定が外れたときも手詰まりにならずに手動で変更できます。
単純なビューアーがつまずくのは引用符の扱いです。引用符で囲まれたフィールドにはカンマ、改行、二重にした引用符を正式に含められるので、住所を持つ行はファイル内で物理的に複数行にまたがっていても、1件のレコードのままです。カンマで区切るだけの処理は、まさにそうした行を壊します。テキストエディタでは問題なく見えるのにビューアーではおかしく見える、またはその逆になるのはこのためです。
列数がそろっていないファイル、つまりヘッダーよりフィールドが多い・少ない行があるファイルは、黙って補ったり切り詰めたりせず、そのまま表示します。フィールド数の合わない行は、たいていそれより上にある引用符の問題の症状で、それを隠すとバグも隠れてしまうからです。ファイル全体をページ内で解析するため、メモリ使用量はファイルサイズに比例します。
ほかの目的には
コマンドラインでは、csvkit がまさにこの用途のために作られています。csvlook は整列した表を表示し、csvstat はすべての列を要約し、csvclean は列数のそろわない行を報告して修正します。Miller(mlr --icsv --opprint cat data.csv)は同じことを高速に行い、メモリより大きなファイルも扱えます。対話的に探索するなら VisiData を知っておくとよいでしょう。数GBのファイルもターミナルで瞬時に開き、並べ替え、絞り込み、出現回数の集計ができます。
どうしてもExcelでCSVを開くなら、ダブルクリックではなく [データ]→[テキストまたはCSVから] を使ってください。インポート画面では、解析の前に各列のデータ型を指定できます。上で挙げた変換を防ぐ確実な方法はこれだけです。ダブルクリックはExcelに推測を任せることになり、Excelは自信たっぷりに推測します。
よくある質問
ファイルはどこかに保存されますか?
いいえ。何も保存されず、何も残りません。ページを読み込んだ後はWi-Fiを切っても動作します。CSVはたいてい顧客リスト、エクスポートデータ、財務レポートで、まさに見知らぬ相手のサーバーに渡すべきではない種類のファイルです。
ExcelでCSVが崩れるのはなぜですか?
Excelは開くときに、確認なしで変換してしまうからです。00123という商品コードは数値の123になり、ゼロは二度と戻りません。5-3のような部品番号は5月3日になります。長い注文番号は1.23457E+14になります。セミコロンで区切られたドイツのCSVは、すべてA列に入ってしまいます。どれもファイルの中身ではなく、Excelが読み込む途中で行ったことです。このビューアーはすべての値を保存されているとおりのテキストとして表示するので、実際に受け取った内容を確認できます。
どの区切り文字と文字コードに対応していますか?
カンマ、セミコロン、タブ、縦棒に対応し、拡張子ではなくファイルの中身を見て判定します。ドイツのシステムがエクスポートした「CSV」は、たいていセミコロン区切りです。文字コードも判定します。BOMの有無を問わずUTF-8、UTF-16、そして古いシステムが出力するWindows-1252/Latin-1のファイルに対応しています。文字コードが違っていると「é」のはずの箇所が「é」になりますが、ページ上で変更できます。
カンマを含む、引用符で囲まれたフィールドも扱えますか?
はい。RFC 4180に沿って正しく扱います。引用符で囲まれたフィールドにはカンマ、改行、エスケープした引用符を含めることができ、そのすべてに対応しています。引用符を考慮せずにカンマで分割するのはCSVの典型的なバグで、問題のフィールド以降のすべての列が黙ってずれてしまいます。
どのくらい大きなファイルを開けますか?
決まったサイズの上限ではなく、使用可能なメモリ次第です。何MBもあり数十万行に及ぶファイルでも問題ありません。画面に表示されている行だけを描画するので、大きなファイルでもスクロールはなめらかです。
編集や変換はできますか?
このページは閲覧用です。変換するなら、[CSV Excel変換](csv-to-excel)と[CSV JSON変換](csv-to-json)がまさにそのためのツールで、先頭のゼロを表計算ソフトに消させずにテキストとして保持します。
ご注意: ファイル全体をページ内で解析するため、非常に大きなエクスポートではサイズに比例してメモリを使います。区切り文字、引用符、文字コードは決め打ちせず自動判定するので、現実のエクスポートのほぼすべてに対応します。判定が外れた場合も、手詰まりにならずに手動で変更できます。
このツールをあなたのサイトに設置
ブログ、授業のページ、ヘルプ記事などに無料で設置できます。コードを1つ貼り付けるだけで、訪問者がそのページ上でツールを使えるようになります。