web-dev-qa-db-ja.com

CSVデータを解析するためのJavaScriptコード

CSVデータを解析するためのJavaScriptコードをどこで見つけることができるかについて、誰かが考えを持っていますか?

このブログエントリに記載されている CSVToArray() 関数を使用できます。

<script type="text/javascript">
    // ref: http://stackoverflow.com/a/1293163/2343
    // This will parse a delimited string into an array of
    // arrays. The default delimiter is the comma, but this
    // can be overriden in the second argument.
    function CSVToArray( strData, strDelimiter ){
        // Check to see if the delimiter is defined. If not,
        // then default to comma.
        strDelimiter = (strDelimiter || ",");

        // Create a regular expression to parse the CSV values.
        var objPattern = new RegExp(
            (
                // Delimiters.
                "(\\" + strDelimiter + "|\\r?\\n|\\r|^)" +

                // Quoted fields.
                "(?:\"([^\"]*(?:\"\"[^\"]*)*)\"|" +

                // Standard fields.
                "([^\"\\" + strDelimiter + "\\r\\n]*))"
            ),
            "gi"
            );


        // Create an array to hold our data. Give the array
        // a default empty first row.
        var arrData = [[]];

        // Create an array to hold our individual pattern
        // matching groups.
        var arrMatches = null;


        // Keep looping over the regular expression matches
        // until we can no longer find a match.
        while (arrMatches = objPattern.exec( strData )){

            // Get the delimiter that was found.
            var strMatchedDelimiter = arrMatches[ 1 ];

            // Check to see if the given delimiter has a length
            // (is not the start of string) and if it matches
            // field delimiter. If id does not, then we know
            // that this delimiter is a row delimiter.
            if (
                strMatchedDelimiter.length &&
                strMatchedDelimiter !== strDelimiter
                ){

                // Since we have reached a new row of data,
                // add an empty row to our data array.
                arrData.Push( [] );

            }

            var strMatchedValue;

            // Now that we have our delimiter out of the way,
            // let's check to see which kind of value we
            // captured (quoted or unquoted).
            if (arrMatches[ 2 ]){

                // We found a quoted value. When we capture
                // this value, unescape any double quotes.
                strMatchedValue = arrMatches[ 2 ].replace(
                    new RegExp( "\"\"", "g" ),
                    "\""
                    );

            } else {

                // We found a non-quoted value.
                strMatchedValue = arrMatches[ 3 ];

            }


            // Now that we have our value string, let's add
            // it to the data array.
            arrData[ arrData.length - 1 ].Push( strMatchedValue );
        }

        // Return the parsed data.
        return( arrData );
    }

</script>
243
Kirtan

私は十分に勝てると思います Kirtan's answer

jQuery-CSVと入力します。

これは、CSVをJavascriptデータに解析するためのエンドツーエンドのソリューションとして機能するように設計されたjqueryプラグインです。それは RFC 418 で提示されたすべての単一のEdgeケース、および仕様が欠けているというエクセル/グーグルSpreadsheedエクスポートのためにポップアップするもの(すなわち大部分がnull値を含む)を処理します。

例:

トラック、アーティスト、アルバム、年

危険、 'Busta Rhymes'、 '災害が発生したとき'、1997

// calling this
music = $.csv.toArrays(csv)

// outputs...
[
  ["track","artist","album","year"],
  ["Dangerous","Busta Rhymes","When Disaster Strikes","1997"]
]

console.log(music[1][2]) // outputs: 'When Disaster Strikes'

更新:

そうそう、私はおそらくそれが完全に設定可能であることにも言及するべきです。

music = $.csv.toArrays(csv, {
  delimiter:"'", // sets a custom value delimiter character
  separator:';', // sets a custom field separator character
});

アップデート2:

Node.js上のjQueryでも動作します。そのため、同じlibを使ってクライアントサイドまたはサーバサイドのどちらの解析も行うことができます。

アップデート3:

Google Codeのシャットダウン以降、 jquery-csvはGitHubに移行されました

免責事項:私はjQuery-CSVの作者でもあります。

144
Evan Plaice

スプレッドシートプロジェクトの一部として 実装 があります。

このコードはまだ徹底的にテストされていません、しかし誰でもそれを使うことを歓迎します。

ただし、いくつかの回答で述べたように、実際に DSV または TSV ファイルがある場合は、レコードの使用が許可されず値のフィールド区切り文字。一方、CSVでは、フィールド内に実際にカンマと改行が含まれる可能性があります。これは、ほとんどの正規表現および分割ベースのアプローチを破ります。

var CSV = {
parse: function(csv, reviver) {
    reviver = reviver || function(r, c, v) { return v; };
    var chars = csv.split(''), c = 0, cc = chars.length, start, end, table = [], row;
    while (c < cc) {
        table.Push(row = []);
        while (c < cc && '\r' !== chars[c] && '\n' !== chars[c]) {
            start = end = c;
            if ('"' === chars[c]){
                start = end = ++c;
                while (c < cc) {
                    if ('"' === chars[c]) {
                        if ('"' !== chars[c+1]) { break; }
                        else { chars[++c] = ''; } // unescape ""
                    }
                    end = ++c;
                }
                if ('"' === chars[c]) { ++c; }
                while (c < cc && '\r' !== chars[c] && '\n' !== chars[c] && ',' !== chars[c]) { ++c; }
            } else {
                while (c < cc && '\r' !== chars[c] && '\n' !== chars[c] && ',' !== chars[c]) { end = ++c; }
            }
            row.Push(reviver(table.length-1, row.length, chars.slice(start, end).join('')));
            if (',' === chars[c]) { ++c; }
        }
        if ('\r' === chars[c]) { ++c; }
        if ('\n' === chars[c]) { ++c; }
    }
    return table;
},

stringify: function(table, replacer) {
    replacer = replacer || function(r, c, v) { return v; };
    var csv = '', c, cc, r, rr = table.length, cell;
    for (r = 0; r < rr; ++r) {
        if (r) { csv += '\r\n'; }
        for (c = 0, cc = table[r].length; c < cc; ++c) {
            if (c) { csv += ','; }
            cell = replacer(r, c, table[r][c]);
            if (/[,\r\n"]/.test(cell)) { cell = '"' + cell.replace(/"/g, '""') + '"'; }
            csv += (cell || 0 === cell) ? cell : '';
        }
    }
    return csv;
}
};
38
Andy VanWagoner

これは、カンマ、改行、およびエスケープされた二重引用符を使用して引用符付きのフィールドを処理する、非常に単純なCSVパーサーです。分割や正規表現はありません。入力文字列を1〜2文字ずつスキャンして配列を作成します。

http://jsfiddle.net/vHKYH/ でテストしてください。

function parseCSV(str) {
    var arr = [];
    var quote = false;  // true means we're inside a quoted field

    // iterate over each character, keep track of current row and column (of the returned array)
    for (var row = 0, col = 0, c = 0; c < str.length; c++) {
        var cc = str[c], nc = str[c+1];        // current character, next character
        arr[row] = arr[row] || [];             // create a new row if necessary
        arr[row][col] = arr[row][col] || '';   // create a new column (start with empty string) if necessary

        // If the current character is a quotation mark, and we're inside a
        // quoted field, and the next character is also a quotation mark,
        // add a quotation mark to the current column and skip the next character
        if (cc == '"' && quote && nc == '"') { arr[row][col] += cc; ++c; continue; }  

        // If it's just one quotation mark, begin/end quoted field
        if (cc == '"') { quote = !quote; continue; }

        // If it's a comma and we're not in a quoted field, move on to the next column
        if (cc == ',' && !quote) { ++col; continue; }

        // If it's a newline (CRLF) and we're not in a quoted field, skip the next character
        // and move on to the next row and move to column 0 of that new row
        if (cc == '\r' && nc == '\n' && !quote) { ++row; col = 0; ++c; continue; }

        // If it's a newline (LF or CR) and we're not in a quoted field,
        // move on to the next row and move to column 0 of that new row
        if (cc == '\n' && !quote) { ++row; col = 0; continue; }
        if (cc == '\r' && !quote) { ++row; col = 0; continue; }

        // Otherwise, append the current character to the current column
        arr[row][col] += cc;
    }
    return arr;
}
24
Trevor Dixon

csvToArray v1.3

RFC 4180規格に準拠した、CSV文字列を2D配列に変換する、コンパクト(645バイト)だが準拠した機能.

https://code.google.com/archive/p/csv-to-array/downloads

一般的な使い方:jQuery

 $.ajax({
        url: "test.csv",
        dataType: 'text',
        cache: false
 }).done(function(csvAsString){
        csvAsArray=csvAsString.csvToArray();
 });

一般的な使い方:Javascript

csvAsArray = csvAsString.csvToArray();

フィールド区切り文字をオーバーライドする

csvAsArray = csvAsString.csvToArray("|");

レコード区切り文字をオーバーライドする

csvAsArray = csvAsString.csvToArray("", "#");

スキップヘッダーを上書き

csvAsArray = csvAsString.csvToArray("", "", 1);

すべてを上書き

csvAsArray = csvAsString.csvToArray("|", "#", 1);
14
dt192

これが私のPEG(.js)文法です。これはRFC 4180で問題ないようです(例: http://en.wikipedia.org/wiki/Comma-separated_values )。

start
  = [\n\r]* first:line rest:([\n\r]+ data:line { return data; })* [\n\r]* { rest.unshift(first); return rest; }

line
  = first:field rest:("," text:field { return text; })*
    & { return !!first || rest.length; } // ignore blank lines
    { rest.unshift(first); return rest; }

field
  = '"' text:char* '"' { return text.join(''); }
  / text:[^\n\r,]* { return text.join(''); }

char
  = '"' '"' { return '"'; }
  / [^"]

http://jsfiddle.net/knvzk/1 または http://pegjs.majda.cz/online で試してみてください。生成されたパーサーを https://Gist.github.com/33628 からダウンロードしてください。

14
Trevor Dixon

なぜ私がexをキルタンできなかったのかわからない。私のために働きます。空のフィールドや末尾のカンマを含むフィールドで失敗しているようです...

これは両方を扱うようです。

私はパーサーコードを書かなかった、ファイルのためにこれを働かせるためにパーサー関数のまわりのラッパー。帰属を参照

    var Strings = {
        /**
         * Wrapped csv line parser
         * @param s string delimited csv string
         * @param sep separator override
         * @attribution : http://www.greywyvern.com/?post=258 (comments closed on blog :( )
         */
        parseCSV : function(s,sep) {
            // http://stackoverflow.com/questions/1155678/javascript-string-newline-character
            var universalNewline = /\r\n|\r|\n/g;
            var a = s.split(universalNewline);
            for(var i in a){
                for (var f = a[i].split(sep = sep || ","), x = f.length - 1, tl; x >= 0; x--) {
                    if (f[x].replace(/"\s+$/, '"').charAt(f[x].length - 1) == '"') {
                        if ((tl = f[x].replace(/^\s+"/, '"')).length > 1 && tl.charAt(0) == '"') {
                            f[x] = f[x].replace(/^\s*"|"\s*$/g, '').replace(/""/g, '"');
                          } else if (x) {
                        f.splice(x - 1, 2, [f[x - 1], f[x]].join(sep));
                      } else f = f.shift().split(sep).concat(f);
                    } else f[x].replace(/""/g, '"');
                  } a[i] = f;
        }
        return a;
        }
    }
3
Shanimal