标记数据错误

我试图使用熊猫操作.csv文件，但我得到这个错误:

pandas.parser.CParserError:标记数据错误。C错误:第3行有2个字段，见12

我试着读过熊猫的文件，但一无所获。

我的代码很简单:

path = 'GOOG Key Ratios.csv'
#print(open(path).read())
data = pd.read_csv(path)

我该如何解决这个问题?我应该使用csv模块还是其他语言?

文件来自晨星公司

当前回答

解决方法简单:在excel中打开csv文件，并保存为csv格式的不同名称文件。再次尝试导入它spyder，你的问题将得到解决!

2019-09-07 01:53:53

其他回答

我有同样的问题，当read_csv: ParserError:错误标记数据。我只是把旧的csv文件保存为一个新的csv文件。问题解决了!

2018-11-26 13:32:41

你也可以试试;

data = pd.read_csv('file1.csv', on_bad_lines='skip')

请注意，这将导致有问题的行被跳过。

Edit

对于熊猫< 1.3.0尝试

data = pd.read_csv("file1.csv", error_bad_lines=False)

根据熊猫API参考。

2013-08-08 14:47:15

我相信解决方案，

,engine='python'
, error_bad_lines = False

如果它是虚拟列并且你想要删除它，这将是很好的。在我的例子中，第二行确实有更多的列，我希望这些列被积分，并且有列数= MAX(列)。

请参考下面我无法阅读的解决方案:

try:
    df_data = pd.read_csv(PATH, header = bl_header, sep = str_sep)
except pd.errors.ParserError as err:
    str_find = 'saw '
    int_position = int(str(err).find(str_find)) + len(str_find)
    str_nbCol = str(err)[int_position:]
    l_col = range(int(str_nbCol))
    df_data = pd.read_csv(PATH, header = bl_header, sep = str_sep, names = l_col)

2020-05-13 06:41:07

你可以试试;

data = pd.read_csv('file1.csv', sep='\t')

2020-09-08 15:58:01

在处理类似的解析错误时，我发现另一种方法很有用，它使用CSV模块将数据重新路由到pandas df。例如:

import csv
import pandas as pd
path = 'C:/FileLocation/'
file = 'filename.csv'
f = open(path+file,'rt')
reader = csv.reader(f)

#once contents are available, I then put them in a list
csv_list = []
for l in reader:
    csv_list.append(l)
f.close()
#now pandas has no problem getting into a df
df = pd.DataFrame(csv_list)

我发现CSV模块对于格式不佳的逗号分隔的文件更加健壮，因此已经成功地用这种方法解决了诸如此类的问题。

2018-01-26 20:54:38

标记数据错误

推荐文章

最新文章

标签