标记数据错误

我试图使用熊猫操作.csv文件，但我得到这个错误:

pandas.parser.CParserError:标记数据错误。C错误:第3行有2个字段，见12

我试着读过熊猫的文件，但一无所获。

我的代码很简单:

path = 'GOOG Key Ratios.csv'
#print(open(path).read())
data = pd.read_csv(path)

我该如何解决这个问题?我应该使用csv模块还是其他语言?

文件来自晨星公司

当前回答

对于这个问题，我遇到了多种解决方案。很多人也给出了最好的解释。但对于初学者来说，我认为以下两种方法就足够了:

import pandas as pd

#Method 1

data = pd.read_csv('file1.csv', error_bad_lines=False)
#Note that this will cause the offending lines to be skipped.

#Method 2 using sep

data = pd.read_csv('file1.csv', sep='\t')

2021-12-14 06:25:23

其他回答

解决方法简单:在excel中打开csv文件，并保存为csv格式的不同名称文件。再次尝试导入它spyder，你的问题将得到解决!

2019-09-07 01:53:53

你也可以试试;

data = pd.read_csv('file1.csv', on_bad_lines='skip')

请注意，这将导致有问题的行被跳过。

Edit

对于熊猫< 1.3.0尝试

data = pd.read_csv("file1.csv", error_bad_lines=False)

根据熊猫API参考。

2013-08-08 14:47:15

这肯定是分隔符的问题，因为大多数csv csv都是使用sep='/t'创建的，所以尝试使用分隔符/t的制表符(\t)来读取csv。所以，尝试使用下面的代码行打开。

data=pd.read_csv("File_path", sep='\t')

2015-04-01 05:42:48

对于那些在linux操作系统上使用Python 3有类似问题的人。

pandas.errors.ParserError: Error tokenizing data. C error: Calling
read(nbytes) on source failed. Try engine='python'.

试一试:

df.read_csv('file.csv', encoding='utf8', engine='python')

2019-10-14 14:54:07

有时候问题不在于如何使用python，而在于如何处理原始数据。我得到了这个错误信息

Error tokenizing data. C error: Expected 18 fields in line 72, saw 19.

结果发现，在列描述中有时会有逗号。这意味着需要清理CSV文件或使用另一个分隔符。

2017-11-15 10:59:33

标记数据错误

推荐文章

最新文章

标签