कैसे एक CS Datable में एक CSV फ़ाइल पढ़ने के लिए


170

CSV फ़ाइल के System.Data.DataTableआधार पर मैं CSV फ़ाइल को कैसे लोड कर सकता हूँ , जिससे डेटाटेबल बनाया जा सकता है?

क्या नियमित ADO.net कार्यक्षमता इसकी अनुमति देती है?


21
यह संभवतः 'ऑफ टॉपिक' कैसे है? यह एक विशिष्ट प्रश्न है और 100 लोगों को यह उपयोगी लगता है
रयान

10
@ रयान: वास्तव में मैं तुमसे कहता हूं ... स्टैकऑवरफ्लो मॉडरेटर्स वाइपर का एक समूह हैं। मेरे पीछे जाओ, StackOverflow मध्यस्थों!
रोनी ओवरबी

जवाबों:


89

यहाँ एक उत्कृष्ट वर्ग है जो डेटाटेबल बनाने के लिए डेटा की संरचना का उपयोग करके CSV डेटा को डेटाटेबल में कॉपी करेगा:

फ्लैट फ़ाइलों के लिए एक पोर्टेबल और कुशल सामान्य पार्सर

यह कॉन्फ़िगर करना आसान है और उपयोग में आसान है। मैं आपसे एक नज़र डालने का आग्रह करता हूं।


बहुत बढ़िया। यह मेरे लिए बॉक्स से पूरी तरह से काम करता था, यहां तक ​​कि दस्तावेज को पढ़े बिना।
स्मिरकिंगमैन

क्या यह CSV फ़ाइलों पर काम करेगा जहाँ प्रत्येक पंक्ति एक अलग संरचना की हो सकती है? मेरे पास विभिन्न प्रकार के लॉग इवेंट के साथ एक लॉग फ़ाइल है जिसे कई तालिकाओं में अलग करने की आवश्यकता होगी।
गोंजोब्रैन्स

2
@ गगनज़ोब्रिन्स - शायद नहीं; CSV फ़ाइल की मूल धारणा पहली पंक्ति में निर्दिष्ट कॉलम हेडर के एकल सेट के आधार पर एक आयताकार डेटा संरचना है। जो आपने अधिक जेनेरिक कॉमा-सीमांकित, विभेदित डेटा प्रतीत किया है, उसे फ़ाइल से पार्स करने के लिए और अधिक परिष्कृत "ईटीएल" की आवश्यकता होती है, जो अलग-अलग प्रकारों के ऑब्जेक्ट इंस्टेंसेस में भिन्न हो (जिसमें विभिन्न डेटाटेबल्स के डेटारोज़ शामिल हो सकते हैं)।
कीथ्स

93

मैं OleDbप्रदाता का उपयोग कर रहा हूं । हालाँकि, यह समस्या है अगर आप उन पंक्तियों में पढ़ रहे हैं जिनमें संख्यात्मक मान हैं लेकिन आप उन्हें पाठ के रूप में मानते हैं। हालाँकि, आप schema.iniफ़ाइल बनाकर उस समस्या को हल कर सकते हैं । यहाँ मेरा तरीका है जो मैंने प्रयोग किया है:

// using System.Data;
// using System.Data.OleDb;
// using System.Globalization;
// using System.IO;

static DataTable GetDataTableFromCsv(string path, bool isFirstRowHeader)
{
    string header = isFirstRowHeader ? "Yes" : "No";

    string pathOnly = Path.GetDirectoryName(path);
    string fileName = Path.GetFileName(path);

    string sql = @"SELECT * FROM [" + fileName + "]";

    using(OleDbConnection connection = new OleDbConnection(
              @"Provider=Microsoft.Jet.OLEDB.4.0;Data Source=" + pathOnly + 
              ";Extended Properties=\"Text;HDR=" + header + "\""))
    using(OleDbCommand command = new OleDbCommand(sql, connection))
    using(OleDbDataAdapter adapter = new OleDbDataAdapter(command))
    {
        DataTable dataTable = new DataTable();
        dataTable.Locale = CultureInfo.CurrentCulture;
        adapter.Fill(dataTable);
        return dataTable;
    }
}

धन्यवाद दोस्त। इससे मुझे मदद मिली। मेरे पास एक CSV फ़ाइल थी जिसमें अल्पविराम न केवल विभाजक थे, वे कई कॉलम मानों के अंदर हर जगह थे, इसलिए एक regex के साथ आ रहा था जो लाइन को विभाजित करेगा यह थोड़े चुनौतीपूर्ण था। OleDbProvider ने स्कीमा को सही ढंग से समझा।
गैलीलियो

कार्यान्वयन समझ में आता है लेकिन हम कैसे मिश्रित डेटा प्रकार वाले कोशिकाओं से निपटते हैं। उदाहरण के लिए, 40C और आदि?
2:15 बजे

GKED, यदि आप हमेशा जिस डेटा को पढ़ रहे हैं, उसमें स्तंभों का एक अपेक्षित सेट होता है और प्रकार आप उसी फ़ोल्डर में जगह कर सकते हैं एक shema.ini फ़ाइल जो कॉलम के बारे में ओलेडब प्रदाता जानकारी बताती है। यहाँ एक Microsoft आलेख का लिंक दिया गया है, जो फ़ाइल को संरचना करने के तरीके का विवरण प्रदान करता है। msdn.microsoft.com/en-us/library/…
जिम स्कॉट

4
हालांकि यह जवाब काम करेगा, मैं इसके खिलाफ दृढ़ता से सलाह दूंगा। आप एक बाहरी निर्भरता का परिचय देते हैं जो एक ही मशीन पर कार्यालय की अन्य स्थापनाओं के साथ संघर्ष कर सकता है (स्थापित अपने स्थानीय देव वातावरण पर एक्सेल का उपयोग करें?), जो स्थापित संस्करणों पर निर्भर है। वहाँ NuGet पैकेज हैं (ExcelDataReader, CsvHelper) जो इसे अधिक कुशल, अधिक पोर्टेबल तरीकों से करते हैं।
ए। मुर्रे

1
@ A.Murray - वास्तव में आपका क्या मतलब है? यह SystemData.dll में अंतर्निहित OleDb प्रदाता का उपयोग करता है। आपको किसी भी अतिरिक्त "ड्राइवर" को स्थापित करने की आवश्यकता नहीं है। और मुझे इस दिन और उम्र में झटका लगेगा अगर किसी भी विंडोज़ इंस्टॉलेशन में बेसिक जेट ड्राइवर नहीं लगा है। यह 1990 का सीएसवी है ....
पॉल ईस्टर

40

मैंने सेबस्टियन लोरियन के सीएसवी रीडर का उपयोग करने का निर्णय लिया है ।

Jay Riggs सुझाव भी एक महान समाधान है, लेकिन मुझे अभी उन सभी विशेषताओं की आवश्यकता नहीं है जो एंड्रयू Rissing के सामान्य पार्सर प्रदान करता है।

UPDATE 10/25/2010

लगभग डेढ़ साल के लिए मेरी परियोजना में सेबस्टियन लोरियन के सीएसवी रीडर का उपयोग करने के बाद , मैंने पाया है कि यह कुछ सीएसवी फ़ाइलों को पार्स करते समय अपवादों को फेंकता है जो मुझे लगता है कि अच्छी तरह से बनता है।

इसलिए, मैंने एंड्रयू रिस्सिंग के जेनेरिक पार्सर पर स्विच किया और यह बहुत बेहतर कर रहा है।

UPDATE 9/22/2014

इन दिनों, मैं ज्यादातर सीमांकित पाठ को पढ़ने के लिए इस विस्तार विधि का उपयोग करता हूं:

https://github.com/Core-Techs/Common/blob/master/CoreTechs.Common/Text/DelimitedTextExtensions.cs#L22

https://www.nuget.org/packages/CoreTechs.Common/

UPDATE 2/20/2015

उदाहरण:

var csv = @"Name, Age
Ronnie, 30
Mark, 40
Ace, 50";

TextReader reader = new StringReader(csv);
var table = new DataTable();
using(var it = reader.ReadCsvWithHeader().GetEnumerator())
{

    if (!it.MoveNext()) return;

    foreach (var k in it.Current.Keys)
        table.Columns.Add(k);

    do
    {
        var row = table.NewRow();
        foreach (var k in it.Current.Keys)
            row[k] = it.Current[k];
    
        table.Rows.Add(row);
    
    } while (it.MoveNext());
}

मैं सहमत हूं कि सेबेस्टियन लोरियन का CSV पाठक महान है। मैं इसका उपयोग भारी सीएसवी प्रसंस्करण के लिए करता हूं, लेकिन मैंने एंड्रयू की रीसिंग का उपयोग छोटी नौकरियों के लिए भी किया है और यह मुझे अच्छी तरह से परोसा गया है। मज़े करो!
जय रिग्स

CSV को DATATABLE में लोड करने के लिए मैं इन वर्गों का उपयोग कैसे कर सकता हूं?
मुफ्लिक्स

मैंने यह कोशिश की थी, लेकिन स्तंभ के नाम के बजाय "System.Linq.Enumerable + WhereSelectListIterator`2 [System.Int32, System.Char]" के साथ it.Current.Keys संग्रह रिटर्न। किसी भी विचार क्यों?
user3658298

क्या आप मल्टी कैरेक्टर सीमांकक का उपयोग कर सकते हैं?
रोल

नहीं, लेकिन मैंने इसे सक्षम करने के बारे में सोचा।
रॉनी ओवरबी

32

अरे इसके 100% काम

  public static DataTable ConvertCSVtoDataTable(string strFilePath)
  {
    DataTable dt = new DataTable();
    using (StreamReader sr = new StreamReader(strFilePath))
    {
        string[] headers = sr.ReadLine().Split(',');
        foreach (string header in headers)
        {
            dt.Columns.Add(header);
        }
        while (!sr.EndOfStream)
        {
            string[] rows = sr.ReadLine().Split(',');
            DataRow dr = dt.NewRow();
            for (int i = 0; i < headers.Length; i++)
            {
                dr[i] = rows[i];
            }
            dt.Rows.Add(dr);
        }

    }


    return dt;
   }

सीएसवी छवि यहां छवि विवरण दर्ज करें

डेटा तालिका आयात की गई यहां छवि विवरण दर्ज करें


7
केवल जब 100% इनपुट CSV फ़ाइलों में से सबसे सरल हैं (जो आपके मामले में सही हो सकते हैं)।
रॉनी ओवरबी

तुम सही हो। आपको codeproject.com/Articles/9258/A-Fast-CSV-Reader (Lorion dll) का उपयोग करना चाहिए ।
शिवम श्रीवास्तव

1
2009 से मेरा जवाब देखें।
रॉनी ओवरबी

1
@ शिवम श्रीवास्तव मुझे अंतिम पंक्ति में त्रुटि हो रही है आप वहाँ हैं तो आपको अन्य संपर्क जानकारी देते हैं
सुनील आचार्य

हालाँकि मैंने इस संस्करण का बिल्कुल उपयोग नहीं किया था, यह इस पर आधारित था कि मैंने अपना मुद्दा हल किया। धन्यवाद। बहुत अच्छा काम करता है।
nrod

13

हम हमेशा Jet.OLEDB ड्राइवर का उपयोग करते थे, जब तक कि हम 64 बिट अनुप्रयोगों पर नहीं जाने लगे। Microsoft ने 64 बिट जेट ड्राइवर को जारी नहीं किया है और न ही करेगा। यहां एक सरल समाधान है जो हम उस फ़ाइल के साथ आया था। CSV फ़ाइल को पढ़ने और पार्स करने के लिए File.ReadAllLines और String.Split का उपयोग करता है और मैन्युअल रूप से एक DataTable को लोड करता है। जैसा कि ऊपर उल्लेख किया गया है, यह उस स्थिति को नहीं संभालता है जहां एक स्तंभ मान में अल्पविराम होता है। हम इसका उपयोग ज्यादातर कस्टम कॉन्फ़िगरेशन फ़ाइलों को पढ़ने के लिए करते हैं - CSV फ़ाइलों का उपयोग करने के बारे में अच्छा हिस्सा यह है कि हम उन्हें एक्सेल में संपादित कर सकते हैं।

string CSVFilePathName = @"C:\test.csv";
string[] Lines = File.ReadAllLines(CSVFilePathName);
string[] Fields;
Fields = Lines[0].Split(new char[] { ',' });
int Cols = Fields.GetLength(0);
DataTable dt = new DataTable();
//1st row must be column names; force lower case to ensure matching later on.
for (int i = 0; i < Cols; i++)
    dt.Columns.Add(Fields[i].ToLower(), typeof(string));
DataRow Row;
for (int i = 1; i < Lines.GetLength(0); i++)
{
    Fields = Lines[i].Split(new char[] { ',' });
    Row = dt.NewRow();
    for (int f = 0; f < Cols; f++)
        Row[f] = Fields[f];
    dt.Rows.Add(Row);
}

8

यह वह कोड है जिसका मैं इसका उपयोग करता हूं लेकिन आपके ऐप्स को नेट वर्जन 3.5 के साथ चलना चाहिए

private void txtRead_Click(object sender, EventArgs e)
        {
           // var filename = @"d:\shiptest.txt";

            openFileDialog1.InitialDirectory = "d:\\";
            openFileDialog1.Filter = "txt files (*.txt)|*.txt|All files (*.*)|*.*";
            DialogResult result = openFileDialog1.ShowDialog();
            if (result == DialogResult.OK)
            {
                if (openFileDialog1.FileName != "")
                {
                    var reader = ReadAsLines(openFileDialog1.FileName);

                    var data = new DataTable();

                    //this assume the first record is filled with the column names
                    var headers = reader.First().Split(',');
                    foreach (var header in headers)
                    {
                        data.Columns.Add(header);
                    }

                    var records = reader.Skip(1);
                    foreach (var record in records)
                    {
                        data.Rows.Add(record.Split(','));
                    }

                    dgList.DataSource = data;
                }
            }
        }

        static IEnumerable<string> ReadAsLines(string filename)
        {
            using (StreamReader reader = new StreamReader(filename))
                while (!reader.EndOfStream)
                    yield return reader.ReadLine();
        }

यह वह चीज है जो मैं पेश करना चाहता था।
कप्तान केनपाची

8

आप इसे C. # में Microsoft.VisualBasic.FileIO.TextFieldParser dll का उपयोग करके प्राप्त कर सकते हैं

static void Main()
        {
            string csv_file_path=@"C:\Users\Administrator\Desktop\test.csv";

            DataTable csvData = GetDataTabletFromCSVFile(csv_file_path);

            Console.WriteLine("Rows count:" + csvData.Rows.Count);

            Console.ReadLine();
        }


private static DataTable GetDataTabletFromCSVFile(string csv_file_path)
        {
            DataTable csvData = new DataTable();

            try
            {

            using(TextFieldParser csvReader = new TextFieldParser(csv_file_path))
                {
                    csvReader.SetDelimiters(new string[] { "," });
                    csvReader.HasFieldsEnclosedInQuotes = true;
                    string[] colFields = csvReader.ReadFields();
                    foreach (string column in colFields)
                    {
                        DataColumn datecolumn = new DataColumn(column);
                        datecolumn.AllowDBNull = true;
                        csvData.Columns.Add(datecolumn);
                    }

                    while (!csvReader.EndOfData)
                    {
                        string[] fieldData = csvReader.ReadFields();
                        //Making empty value as null
                        for (int i = 0; i < fieldData.Length; i++)
                        {
                            if (fieldData[i] == "")
                            {
                                fieldData[i] = null;
                            }
                        }
                        csvData.Rows.Add(fieldData);
                    }
                }
            }
            catch (Exception ex)
            {
            }
            return csvData;
        }

कृपया सीएसवी प्रसंस्करण के साथ पहिया को फिर से आविष्कार करने का प्रयास न करें। वहाँ बहुत सारे महान खुला स्रोत विकल्प हैं जो बहुत मजबूत हैं।
माइक कोल

1
धन्यवाद ब्रैड, एम्बेडेड उद्धरण से निपटने के लिए TextFieldParser के संबंध में उपयोगी टिप।
मैटलम

3
public class Csv
{
    public static DataTable DataSetGet(string filename, string separatorChar, out List<string> errors)
    {
        errors = new List<string>();
        var table = new DataTable("StringLocalization");
        using (var sr = new StreamReader(filename, Encoding.Default))
        {
            string line;
            var i = 0;
            while (sr.Peek() >= 0)
            {
                try
                {
                    line = sr.ReadLine();
                    if (string.IsNullOrEmpty(line)) continue;
                    var values = line.Split(new[] {separatorChar}, StringSplitOptions.None);
                    var row = table.NewRow();
                    for (var colNum = 0; colNum < values.Length; colNum++)
                    {
                        var value = values[colNum];
                        if (i == 0)
                        {
                            table.Columns.Add(value, typeof (String));
                        }
                        else
                        {
                            row[table.Columns[colNum]] = value;
                        }
                    }
                    if (i != 0) table.Rows.Add(row);
                }
                catch(Exception ex)
                {
                    errors.Add(ex.Message);
                }
                i++;
            }
        }
        return table;
    }
}

3

मैं कोड के इस टुकड़े में आया था जो CSV फ़ाइल को पार्स करने के लिए Linq और regex का उपयोग करता है। संदर्भ लेख अब डेढ़ साल से अधिक पुराना है, लेकिन इसके मुकाबले लिनक (और रेगेक्स) का उपयोग करके सीएसवी को पार्स करने के लिए एक शून्य तरीका नहीं आया है। कैविएट यहां लागू रेगेक्स है जो अल्पविराम सीमांकित फ़ाइलों के लिए है (उद्धरणों के अंदर अल्पविराम का पता लगाएगा!) और यह कि हेडर पर अच्छी तरह से नहीं लग सकता है, लेकिन इन पर काबू पाने का एक तरीका है)। चोटी रखना:

Dim lines As String() = System.IO.File.ReadAllLines(strCustomerFile)
Dim pattern As String = ",(?=(?:[^""]*""[^""]*"")*(?![^""]*""))"
Dim r As System.Text.RegularExpressions.Regex = New System.Text.RegularExpressions.Regex(pattern)
Dim custs = From line In lines _
            Let data = r.Split(line) _
                Select New With {.custnmbr = data(0), _
                                 .custname = data(1)}
For Each cust In custs
    strCUSTNMBR = Replace(cust.custnmbr, Chr(34), "")
    strCUSTNAME = Replace(cust.custname, Chr(34), "")
Next

3

सबसे अच्छा विकल्प मैं पाया है, और यह के कार्यालय स्थापित आप विभिन्न संस्करणों हो सकता है जहां, और यह भी 32 की तरह / 64-बिट मुद्दों के मुद्दों को हल चक Bevitt उल्लेख किया , है FileHelpers

यह NuGet का उपयोग करके आपके प्रोजेक्ट संदर्भों में जोड़ा जा सकता है और यह एक-लाइनर समाधान प्रदान करता है:

CommonEngine.CsvToDataTable(path, "ImportRecord", ',', true);

क्या आप बता सकते हैं कि CommonEngine क्या है? NuGet.Core के साथ NuGet समान है। मैंने केवल NuGet.Core को संदर्भों में पाया
sindhu jampani

यह आप की जरूरत है FileHelpers है। यदि आपके पास NuGet है, तो इसे NuGet के साथ जोड़ें। अन्यथा, बस इसे अपनी परियोजना में एक विधानसभा के रूप में जोड़ें। CommonEngine FileHelpers का हिस्सा है।
नव

3

आप में से जो बाहरी पुस्तकालय का उपयोग नहीं करना चाहते हैं, और ओलेडीबी का उपयोग नहीं करना पसंद करते हैं, नीचे दिए गए उदाहरण को देखें। मुझे जो कुछ भी मिला वह ओलेबीडी, बाहरी पुस्तकालय, या बस एक अल्पविराम पर आधारित विभाजन था! मेरे मामले के लिए ओलेबीडी काम नहीं कर रहा था इसलिए मैं कुछ अलग करना चाहता था।

मुझे MarkJ द्वारा एक लेख मिला जिसमें Microsoft.VisualBasic.FileIO.TextFieldParser मेथड को देखा गया था । लेख VB में लिखा गया है और एक वापस लाने योग्य नहीं है, इसलिए नीचे मेरा उदाहरण देखें।

public static DataTable LoadCSV(string path, bool hasHeader)
    {
        DataTable dt = new DataTable();

        using (var MyReader = new Microsoft.VisualBasic.FileIO.TextFieldParser(path))
        {
            MyReader.TextFieldType = Microsoft.VisualBasic.FileIO.FieldType.Delimited;
            MyReader.Delimiters = new String[] { "," };

            string[] currentRow;

            //'Loop through all of the fields in the file.  
            //'If any lines are corrupt, report an error and continue parsing.  
            bool firstRow = true;
            while (!MyReader.EndOfData)
            {
                try
                {
                    currentRow = MyReader.ReadFields();

                    //Add the header columns
                    if (hasHeader && firstRow)
                    {
                        foreach (string c in currentRow)
                        {
                            dt.Columns.Add(c, typeof(string));
                        }

                        firstRow = false;
                        continue;
                    }

                    //Create a new row
                    DataRow dr = dt.NewRow();
                    dt.Rows.Add(dr);

                    //Loop thru the current line and fill the data out
                    for(int c = 0; c < currentRow.Count(); c++)
                    {
                        dr[c] = currentRow[c];
                    }
                }
                catch (Microsoft.VisualBasic.FileIO.MalformedLineException ex)
                {
                    //Handle the exception here
                }
            }
        }

        return dt;
    }

3

बहुत मूल उत्तर: यदि आपके पास एक जटिल सीएसवी नहीं है जो एक साधारण विभाजन फ़ंक्शन का उपयोग कर सकता है तो यह आयात करने के लिए अच्छी तरह से काम करेगा (इस आयात को स्ट्रिंग्स के रूप में नोट करें, मैं बाद में डेटाटाइप रूपांतरण करता हूं यदि मुझे आवश्यकता है)

 private DataTable csvToDataTable(string fileName, char splitCharacter)
    {                
        StreamReader sr = new StreamReader(fileName);
        string myStringRow = sr.ReadLine();
        var rows = myStringRow.Split(splitCharacter);
        DataTable CsvData = new DataTable();
        foreach (string column in rows)
        {
            //creates the columns of new datatable based on first row of csv
            CsvData.Columns.Add(column);
        }
        myStringRow = sr.ReadLine();
        while (myStringRow != null)
        {
            //runs until string reader returns null and adds rows to dt 
            rows = myStringRow.Split(splitCharacter);
            CsvData.Rows.Add(rows);
            myStringRow = sr.ReadLine();
        }
        sr.Close();
        sr.Dispose();
        return CsvData;
    }

मेरी विधि अगर मैं एक स्ट्रिंग के साथ एक तालिका आयात कर रहा हूं [] सेपरेटर और उस मुद्दे को संभालता हूं जहां मैं पढ़ रहा हूं वर्तमान लाइन सीएसवी या पाठ फ़ाइल में अगली पंक्ति पर जा सकती है <- मैं जिस स्थिति में लूप करना चाहता हूं, जब तक मुझे नहीं मिलता पहली पंक्ति में कुल पंक्तियों की संख्या (कॉलम)

public static DataTable ImportCSV(string fullPath, string[] sepString)
    {
        DataTable dt = new DataTable();
        using (StreamReader sr = new StreamReader(fullPath))
        {
           //stream uses using statement because it implements iDisposable
            string firstLine = sr.ReadLine();
            var headers = firstLine.Split(sepString, StringSplitOptions.None);
            foreach (var header in headers)
            {
               //create column headers
                dt.Columns.Add(header);
            }
            int columnInterval = headers.Count();
            string newLine = sr.ReadLine();
            while (newLine != null)
            {
                //loop adds each row to the datatable
                var fields = newLine.Split(sepString, StringSplitOptions.None); // csv delimiter    
                var currentLength = fields.Count();
                if (currentLength < columnInterval)
                {
                    while (currentLength < columnInterval)
                    {
                       //if the count of items in the row is less than the column row go to next line until count matches column number total
                        newLine += sr.ReadLine();
                        currentLength = newLine.Split(sepString, StringSplitOptions.None).Count();
                    }
                    fields = newLine.Split(sepString, StringSplitOptions.None);
                }
                if (currentLength > columnInterval)
                {  
                    //ideally never executes - but if csv row has too many separators, line is skipped
                    newLine = sr.ReadLine();
                    continue;
                }
                dt.Rows.Add(fields);
                newLine = sr.ReadLine();
            }
            sr.Close();
        }

        return dt;
    }

अच्छा है कि आपने अभी तक पंक्तियों को स्ट्रिंग [] के रूप में घोषित नहीं किया है।
पशु शैली

@AnimalStyle आप सही हैं - अधिक मजबूत विधि और घोषित पंक्तियों के साथ अपडेट किया गया
मैट फार्गसन

3

श्री ChuckBevitt से संशोधित

काम कर समाधान:

string CSVFilePathName = APP_PATH + "Facilities.csv";
string[] Lines = File.ReadAllLines(CSVFilePathName);
string[] Fields;
Fields = Lines[0].Split(new char[] { ',' });
int Cols = Fields.GetLength(0);
DataTable dt = new DataTable();
//1st row must be column names; force lower case to ensure matching later on.
for (int i = 0; i < Cols-1; i++)
        dt.Columns.Add(Fields[i].ToLower(), typeof(string));
DataRow Row;
for (int i = 0; i < Lines.GetLength(0)-1; i++)
{
        Fields = Lines[i].Split(new char[] { ',' });
        Row = dt.NewRow();
        for (int f = 0; f < Cols-1; f++)
                Row[f] = Fields[f];
        dt.Rows.Add(Row);
}

तो यह एक स्मृति समस्या को हल करती है? यह लाइन प्रोसेसिंग द्वारा लाइन है और मेमोरी में निरंतर नहीं है इसलिए कोई अपवाद नहीं होना चाहिए? मुझे यह पसंद है कि यह संसाधित है लेकिन File.ReadAllLines () सभी मेमोरी में सेव नहीं करता है? मुझे लगता है कि आप विशाल मेमोरी बफर से बचने के लिए File.ReadLines () का उपयोग करने वाले हैं? यह सवाल का एक अच्छा जवाब है कि मैं सिर्फ स्मृति चिंताओं के बारे में जानना चाहता हूं।
22

2

यहाँ एक समाधान है जो ADO.Net के ODBC पाठ ड्राइवर का उपयोग करता है:

Dim csvFileFolder As String = "C:\YourFileFolder"
Dim csvFileName As String = "YourFile.csv"

'Note that the folder is specified in the connection string,
'not the file. That's specified in the SELECT query, later.
Dim connString As String = "Driver={Microsoft Text Driver (*.txt; *.csv)};Dbq=" _
    & csvFileFolder & ";Extended Properties=""Text;HDR=No;FMT=Delimited"""
Dim conn As New Odbc.OdbcConnection(connString)

'Open a data adapter, specifying the file name to load
Dim da As New Odbc.OdbcDataAdapter("SELECT * FROM [" & csvFileName & "]", conn)
'Then fill a data table, which can be bound to a grid
Dim dt As New DataTableda.Fill(dt)

grdCSVData.DataSource = dt

एक बार भरे जाने के बाद, आप ADO.Net डेटा ऑब्जेक्ट्स की सभी शक्तियों का उपयोग करने के लिए, ColumnName जैसे डेटाटेबल के गुणों को महत्व दे सकते हैं।

VS2008 में आप एक ही प्रभाव को प्राप्त करने के लिए Linq का उपयोग कर सकते हैं।

नोट: यह इस SO प्रश्न का डुप्लिकेट हो सकता है ।


2

इसमें अपनी खुद की स्पिन जोड़ने का विरोध नहीं कर सकते। यह अतीत में मेरे द्वारा उपयोग किए जाने की तुलना में बहुत बेहतर और अधिक कॉम्पैक्ट है।

यह समाधान:

  • डेटाबेस ड्राइवर या तृतीय पक्ष लाइब्रेरी पर निर्भर नहीं करता है।
  • डुप्लिकेट कॉलम नामों पर विफल नहीं होगा
  • डेटा में कॉमा को संभालता है
  • किसी भी सीमांकक को संभालता है, न कि केवल अल्पविराम (हालांकि यह डिफ़ॉल्ट है)

यहाँ मैं क्या लेकर आया हूँ:

  Public Function ToDataTable(FileName As String, Optional Delimiter As String = ",") As DataTable
    ToDataTable = New DataTable
    Using TextFieldParser As New Microsoft.VisualBasic.FileIO.TextFieldParser(FileName) With
      {.HasFieldsEnclosedInQuotes = True, .TextFieldType = Microsoft.VisualBasic.FileIO.FieldType.Delimited, .TrimWhiteSpace = True}
      With TextFieldParser
        .SetDelimiters({Delimiter})
        .ReadFields.ToList.Unique.ForEach(Sub(x) ToDataTable.Columns.Add(x))
        ToDataTable.Columns.Cast(Of DataColumn).ToList.ForEach(Sub(x) x.AllowDBNull = True)
        Do Until .EndOfData
          ToDataTable.Rows.Add(.ReadFields.Select(Function(x) Text.BlankToNothing(x)).ToArray)
        Loop
      End With
    End Using
  End Function

यह एक विस्तार विधि ( Unique) पर निर्भर करता है ताकि मेरे जवाब के रूप में पाया जाने वाले डुप्लिकेट कॉलम नामों को संभाल सके कैसे स्ट्रिंग्स की सूची में अद्वितीय संख्याओं को जोड़ा जाए।

और यहाँ BlankToNothingसहायक समारोह है:

  Public Function BlankToNothing(ByVal Value As String) As Object 
    If String.IsNullOrEmpty(Value) Then Return Nothing
    Return Value
  End Function

2

साथ Cinchoo ईटीएल - एक खुला स्रोत पुस्तकालय, आप आसानी से CSV फ़ाइल DataTable करने के लिए कोड की कुछ लाइनों के साथ बदल सकते हैं।

using (var p = new ChoCSVReader(** YOUR CSV FILE **)
     .WithFirstLineHeader()
    )
{
    var dt = p.AsDataTable();
}

अधिक जानकारी के लिए, कृपया कोडप्रोजेक्ट लेख देखें।

आशा करता हूँ की ये काम करेगा।


2
    private static DataTable LoadCsvData(string refPath)
    {
        var cfg = new Configuration() { Delimiter = ",", HasHeaderRecord = true };
        var result = new DataTable();
        using (var sr = new StreamReader(refPath, Encoding.UTF8, false, 16384 * 2))
        {
            using (var rdr = new CsvReader(sr, cfg))
            using (var dataRdr = new CsvDataReader(rdr))
            {
                result.Load(dataRdr);
            }
        }
        return result;
    }

का उपयोग कर: https://joshclose.github.io/CsvHelper/


ध्यान दें कि रिलीज में 13 Configuration का नाम बदल दिया गया थाCsvConfiguration नेमस्पेस संघर्ष से बचने के किया । काम करने वाले इस उत्तर का डेमो: dotnetfiddle.net/sdwc6i
dbc

2

मैं ExcelDataReader नामक एक पुस्तकालय का उपयोग करता हूं, आप इसे NuGet पर पा सकते हैं। ExcelDataReader और ExcelDataReader.DataSet एक्सटेंशन दोनों को स्थापित करना सुनिश्चित करें (उत्तरार्द्ध नीचे संदर्भित आवश्यक AsDataSet विधि प्रदान करता है)।

मैंने एक फ़ंक्शन में सब कुछ समझाया, आप इसे सीधे अपने कोड में कॉपी कर सकते हैं। इसे CSV फ़ाइल को पथ दें, यह आपको एक तालिका के साथ डेटासेट देता है।

public static DataSet GetDataSet(string filepath)
{
   var stream = File.OpenRead(filepath);

   try
   {
       var reader = ExcelReaderFactory.CreateCsvReader(stream, new ExcelReaderConfiguration()
       {
           LeaveOpen = false
       });

       var result = reader.AsDataSet(new ExcelDataSetConfiguration()
       {
           // Gets or sets a value indicating whether to set the DataColumn.DataType 
           // property in a second pass.
           UseColumnDataType = true,

           // Gets or sets a callback to determine whether to include the current sheet
           // in the DataSet. Called once per sheet before ConfigureDataTable.
           FilterSheet = (tableReader, sheetIndex) => true,

           // Gets or sets a callback to obtain configuration options for a DataTable. 
           ConfigureDataTable = (tableReader) => new ExcelDataTableConfiguration()
           {
               // Gets or sets a value indicating the prefix of generated column names.
               EmptyColumnNamePrefix = "Column",

               // Gets or sets a value indicating whether to use a row from the 
               // data as column names.
               UseHeaderRow = true,

               // Gets or sets a callback to determine which row is the header row. 
               // Only called when UseHeaderRow = true.
               ReadHeaderRow = (rowReader) =>
               {
                   // F.ex skip the first row and use the 2nd row as column headers:
                   //rowReader.Read();
               },

               // Gets or sets a callback to determine whether to include the 
               // current row in the DataTable.
               FilterRow = (rowReader) =>
               {
                   return true;
               },

               // Gets or sets a callback to determine whether to include the specific
               // column in the DataTable. Called once per column after reading the 
               // headers.
               FilterColumn = (rowReader, columnIndex) =>
               {
                   return true;
               }
           }
       });

       return result;
   }
   catch (Exception ex)
   {
       return null;
   }
   finally
   {
       stream.Close();
       stream.Dispose();
   }
}

यह २०२० है और यह यहाँ के कुछ पुराने उत्तरों की तुलना में एक बढ़िया समाधान है। यह अच्छी तरह से पैक है और NuGet से एक लोकप्रिय और हल्के पुस्तकालय का उपयोग करता है। और यह लचीला है - यदि आपका सीएसवी मेमोरी में है, तो बस MemoryStreamएक फ़ाइल पथ के बजाय इसे पास करें । ओपीटी ने जो डेटाटेबल मांगा, वह डेटासेट से इस तरह आसानी से निकाला जा सकता है:result.Tables[0]
तवाब वाकिल

1

इस विस्तार के तरीकों को साझा करते हुए, मुझे उम्मीद है कि यह किसी की मदद कर सकता है।

public static List<string> ToCSV(this DataSet ds, char separator = '|')
{
    List<string> lResult = new List<string>();

    foreach (DataTable dt in ds.Tables)
    {
        StringBuilder sb = new StringBuilder();
        IEnumerable<string> columnNames = dt.Columns.Cast<DataColumn>().
                                          Select(column => column.ColumnName);
        sb.AppendLine(string.Join(separator.ToString(), columnNames));

        foreach (DataRow row in dt.Rows)
        {
            IEnumerable<string> fields = row.ItemArray.Select(field =>
              string.Concat("\"", field.ToString().Replace("\"", "\"\""), "\""));
            sb.AppendLine(string.Join(separator.ToString(), fields));
        }

        lResult.Add(sb.ToString());
    }
    return lResult;
}

public static DataSet CSVtoDataSet(this List<string> collectionCSV, char separator = '|')
{
    var ds = new DataSet();

    foreach (var csv in collectionCSV)
    {
        var dt = new DataTable();

        var readHeader = false;
        foreach (var line in csv.Split(new[] { Environment.NewLine }, StringSplitOptions.None))
        {
            if (!readHeader)
            {
                foreach (var c in line.Split(separator))
                    dt.Columns.Add(c);
            }
            else
            {
                dt.Rows.Add(line.Split(separator));
            }
        }

        ds.Tables.Add(dt);
    }

    return ds;
}

0

इसका उपयोग करें, एक फ़ंक्शन अल्पविराम और उद्धरण की सभी समस्याओं को हल करता है:

public static DataTable CsvToDataTable(string strFilePath)
    {

        if (File.Exists(strFilePath))
        {

            string[] Lines;
            string CSVFilePathName = strFilePath;

            Lines = File.ReadAllLines(CSVFilePathName);
            while (Lines[0].EndsWith(","))
            {
                Lines[0] = Lines[0].Remove(Lines[0].Length - 1);
            }
            string[] Fields;
            Fields = Lines[0].Split(new char[] { ',' });
            int Cols = Fields.GetLength(0);
            DataTable dt = new DataTable();
            //1st row must be column names; force lower case to ensure matching later on.
            for (int i = 0; i < Cols; i++)
                dt.Columns.Add(Fields[i], typeof(string));
            DataRow Row;
            int rowcount = 0;
            try
            {
                string[] ToBeContinued = new string[]{};
                bool lineToBeContinued = false;
                for (int i = 1; i < Lines.GetLength(0); i++)
                {
                    if (!Lines[i].Equals(""))
                    {
                        Fields = Lines[i].Split(new char[] { ',' });
                        string temp0 = string.Join("", Fields).Replace("\"\"", "");
                        int quaotCount0 = temp0.Count(c => c == '"');
                        if (Fields.GetLength(0) < Cols || lineToBeContinued || quaotCount0 % 2 != 0)
                        {
                            if (ToBeContinued.GetLength(0) > 0)
                            {
                                ToBeContinued[ToBeContinued.Length - 1] += "\n" + Fields[0];
                                Fields = Fields.Skip(1).ToArray();
                            }
                            string[] newArray = new string[ToBeContinued.Length + Fields.Length];
                            Array.Copy(ToBeContinued, newArray, ToBeContinued.Length);
                            Array.Copy(Fields, 0, newArray, ToBeContinued.Length, Fields.Length);
                            ToBeContinued = newArray;
                            string temp = string.Join("", ToBeContinued).Replace("\"\"", "");
                            int quaotCount = temp.Count(c => c == '"');
                            if (ToBeContinued.GetLength(0) >= Cols && quaotCount % 2 == 0 )
                            {
                                Fields = ToBeContinued;
                                ToBeContinued = new string[] { };
                                lineToBeContinued = false;
                            }
                            else
                            {
                                lineToBeContinued = true;
                                continue;
                            }
                        }

                        //modified by Teemo @2016 09 13
                        //handle ',' and '"'
                        //Deserialize CSV following Excel's rule:
                        // 1: If there is commas in a field, quote the field.
                        // 2: Two consecutive quotes indicate a user's quote.

                        List<int> singleLeftquota = new List<int>();
                        List<int> singleRightquota = new List<int>();

                        //combine fileds if number of commas match
                        if (Fields.GetLength(0) > Cols) 
                        {
                            bool lastSingleQuoteIsLeft = true;
                            for (int j = 0; j < Fields.GetLength(0); j++)
                            {
                                bool leftOddquota = false;
                                bool rightOddquota = false;
                                if (Fields[j].StartsWith("\"")) 
                                {
                                    int numberOfConsecutiveQuotes = 0;
                                    foreach (char c in Fields[j]) //start with how many "
                                    {
                                        if (c == '"')
                                        {
                                            numberOfConsecutiveQuotes++;
                                        }
                                        else
                                        {
                                            break;
                                        }
                                    }
                                    if (numberOfConsecutiveQuotes % 2 == 1)//start with odd number of quotes indicate system quote
                                    {
                                        leftOddquota = true;
                                    }
                                }

                                if (Fields[j].EndsWith("\""))
                                {
                                    int numberOfConsecutiveQuotes = 0;
                                    for (int jj = Fields[j].Length - 1; jj >= 0; jj--)
                                    {
                                        if (Fields[j].Substring(jj,1) == "\"") // end with how many "
                                        {
                                            numberOfConsecutiveQuotes++;
                                        }
                                        else
                                        {
                                            break;
                                        }
                                    }

                                    if (numberOfConsecutiveQuotes % 2 == 1)//end with odd number of quotes indicate system quote
                                    {
                                        rightOddquota = true;
                                    }
                                }
                                if (leftOddquota && !rightOddquota)
                                {
                                    singleLeftquota.Add(j);
                                    lastSingleQuoteIsLeft = true;
                                }
                                else if (!leftOddquota && rightOddquota)
                                {
                                    singleRightquota.Add(j);
                                    lastSingleQuoteIsLeft = false;
                                }
                                else if (Fields[j] == "\"") //only one quota in a field
                                {
                                    if (lastSingleQuoteIsLeft)
                                    {
                                        singleRightquota.Add(j);
                                    }
                                    else
                                    {
                                        singleLeftquota.Add(j);
                                    }
                                }
                            }
                            if (singleLeftquota.Count == singleRightquota.Count)
                            {
                                int insideCommas = 0;
                                for (int indexN = 0; indexN < singleLeftquota.Count; indexN++)
                                {
                                    insideCommas += singleRightquota[indexN] - singleLeftquota[indexN];
                                }
                                if (Fields.GetLength(0) - Cols >= insideCommas) //probabaly matched
                                {
                                    int validFildsCount = insideCommas + Cols; //(Fields.GetLength(0) - insideCommas) may be exceed the Cols
                                    String[] temp = new String[validFildsCount];
                                    int totalOffSet = 0;
                                    for (int iii = 0; iii < validFildsCount - totalOffSet; iii++)
                                    {
                                        bool combine = false;
                                        int storedIndex = 0;
                                        for (int iInLeft = 0; iInLeft < singleLeftquota.Count; iInLeft++)
                                        {
                                            if (iii + totalOffSet == singleLeftquota[iInLeft])
                                            {
                                                combine = true;
                                                storedIndex = iInLeft;
                                                break;
                                            }
                                        }
                                        if (combine)
                                        {
                                            int offset = singleRightquota[storedIndex] - singleLeftquota[storedIndex];
                                            for (int combineI = 0; combineI <= offset; combineI++)
                                            {
                                                temp[iii] += Fields[iii + totalOffSet + combineI] + ",";
                                            }
                                            temp[iii] = temp[iii].Remove(temp[iii].Length - 1, 1);
                                            totalOffSet += offset;
                                        }
                                        else
                                        {
                                            temp[iii] = Fields[iii + totalOffSet];
                                        }
                                    }
                                    Fields = temp;
                                }
                            }
                        }
                        Row = dt.NewRow();
                        for (int f = 0; f < Cols; f++)
                        {
                            Fields[f] = Fields[f].Replace("\"\"", "\""); //Two consecutive quotes indicate a user's quote
                            if (Fields[f].StartsWith("\""))
                            {
                                if (Fields[f].EndsWith("\""))
                                {
                                    Fields[f] = Fields[f].Remove(0, 1);
                                    if (Fields[f].Length > 0)
                                    {
                                        Fields[f] = Fields[f].Remove(Fields[f].Length - 1, 1);
                                    }
                                }
                            }
                            Row[f] = Fields[f];
                        }
                        dt.Rows.Add(Row);
                        rowcount++;
                    }
                }
            }
            catch (Exception ex)
            {
                throw new Exception( "row: " + (rowcount+2) + ", " + ex.Message);
            }
            //OleDbConnection connection = new OleDbConnection(string.Format(@"Provider=Microsoft.Jet.OLEDB.4.0;Data Source={0}; Extended Properties=""text;HDR=Yes;FMT=Delimited"";", FilePath + FileName));
            //OleDbCommand command = new OleDbCommand("SELECT * FROM " + FileName, connection);
            //OleDbDataAdapter adapter = new OleDbDataAdapter(command);
            //DataTable dt = new DataTable();
            //adapter.Fill(dt);
            //adapter.Dispose();
            return dt;
        }
        else
            return null;

        //OleDbConnection connection = new OleDbConnection(string.Format(@"Provider=Microsoft.Jet.OLEDB.4.0;Data Source={0}; Extended Properties=""text;HDR=Yes;FMT=Delimited"";", strFilePath));
        //OleDbCommand command = new OleDbCommand("SELECT * FROM " + strFileName, connection);
        //OleDbDataAdapter adapter = new OleDbDataAdapter(command);
        //DataTable dt = new DataTable();
        //adapter.Fill(dt);
        //return dt;
    }

0
 Public Function ReadCsvFileToDataTable(strFilePath As String) As DataTable
    Dim dtCsv As DataTable = New DataTable()
    Dim Fulltext As String
    Using sr As StreamReader = New StreamReader(strFilePath)
        While Not sr.EndOfStream
            Fulltext = sr.ReadToEnd().ToString()
            Dim rows As String() = Fulltext.Split(vbLf)
            For i As Integer = 0 To rows.Count() - 1 - 1
                Dim rowValues As String() = rows(i).Split(","c)
                If True Then
                    If i = 0 Then
                        For j As Integer = 0 To rowValues.Count() - 1
                            dtCsv.Columns.Add(rowValues(j))
                        Next
                    Else
                        Dim dr As DataRow = dtCsv.NewRow()
                        For k As Integer = 0 To rowValues.Count() - 1
                            dr(k) = rowValues(k).ToString()
                        Next
                        dtCsv.Rows.Add(dr)
                    End If
                End If
            Next
        End While
    End Using
    Return dtCsv
End Function

0

मैंने हाल ही में .NET के लिए एक CSV पार्सर लिखा है जो मैं दावा कर रहा हूं कि वर्तमान में सबसे तेज उपलब्ध है एक nuget पैकेज के रूप में: Sylvan.Data.Csv

लोड करने के लिए इस लाइब्रेरी का उपयोग करना DataTableबेहद आसान है।

using var tr = File.OpenText("data.csv");
using var dr = CsvDataReader.Create(tr);
var dt = new DataTable();
dt.Load(dr);

अपनी फ़ाइल को मान लेना हेडर के साथ एक मानक अल्पविराम से अलग की गई फ़ाइल है, बस आपको इसकी आवश्यकता है। हेडर के बिना फ़ाइलों को पढ़ने और वैकल्पिक सीमांकक आदि का उपयोग करने की अनुमति देने के लिए भी विकल्प हैं।

CSV फ़ाइल के लिए एक कस्टम स्कीमा प्रदान करना भी संभव है ताकि कॉलम को stringमानों के अलावा किसी अन्य चीज़ के रूप में माना जा सके । यह DataTableउन स्तंभों को उन मानों से लोड करने की अनुमति देगा, जिनके साथ काम करना आसान हो सकता है, क्योंकि जब आप उन्हें एक्सेस करते हैं तो आपको उनके साथ ज़बरदस्ती नहीं करनी होगी।

var schema = new TypedCsvSchema();
schema.Add(0, typeof(int));
schema.Add(1, typeof(string));
schema.Add(2, typeof(double?));
schema.Add(3, typeof(DateTime));
schema.Add(4, typeof(DateTime?));

var options = new CsvDataReaderOptions { 
    Schema = schema 
};

using var tr = GetData();
using var dr = CsvDataReader.Create(tr, options);

TypedCsvSchemaइसका कार्यान्वयन ICsvSchemaProviderस्तंभों के प्रकारों को परिभाषित करने का एक सरल तरीका प्रदान करता है। हालाँकि, ICsvSchemaProviderजब आप अधिक मेटाडेटा प्रदान करना चाहते हैं, तो एक कस्टम प्रदान करना संभव है , जैसे कि विशिष्टता या विवश आकार, आदि।

हमारी साइट का प्रयोग करके, आप स्वीकार करते हैं कि आपने हमारी Cookie Policy और निजता नीति को पढ़ और समझा लिया है।
Licensed under cc by-sa 3.0 with attribution required.