iis服务器助手广告广告
返回顶部
首页 > 资讯 > 后端开发 > Python >python编码格式导致csv读取错误怎么解决
  • 658
分享到

python编码格式导致csv读取错误怎么解决

2023-06-30 12:06:25 658人浏览 薄情痞子

Python 官方文档:入门教程 => 点击学习

摘要

这篇文章主要讲解了“python编码格式导致csv读取错误怎么解决”,文中的讲解内容简单清晰,易于学习与理解,下面请大家跟着小编的思路慢慢深入,一起来研究和学习“Python编码格式导致csv读取错误怎么解决”吧!python编码格式导致c

这篇文章主要讲解了“python编码格式导致csv读取错误怎么解决”,文中的讲解内容简单清晰,易于学习与理解,下面请大家跟着小编的思路慢慢深入,一起来研究和学习“Python编码格式导致csv读取错误怎么解决”吧!

python编码格式导致csv读取错误

本文记录python小白我今天遇到的这两个问题(csv.reader和pandas.csv_read):

pandas模块“CParserError: Error tokenizing data. C error: Expected 1 fields in line 4, saw 2”错误

csv模块“line contains NULL byte”错误

今天处理数据时疏忽了,而且还偷懒把数据复制到xlsx保存后,直接修改文件后缀成.csv准备用来读取。之后运行算法要读数据的时候果然问题来了。

import pandas as pdpath = 'water30.csv'df=pd.read_csv(path)

注:后两行可写作df=pd.read_csv('water30.csv')。

但由于read_csv本身有好多参数(虽然这里不用), 故写成path习惯好些。

这样会报错CParserError: Error tokenizing data. C error: Expected 1 fields in line 4, saw 2

我在网上查了好多种解决办法,由于read_csv的参数很多,所以各有其词,我这里遇到的应该也只是其中一种,久寻无果。直到我看到这里说看了模块_csv.c的代码后,发现文件里不能有 “\0”, 所以csv文件不可以是unicode编码的,可以是ANSI。

针对我直接改后缀名的结果是,点击那个.csv打开时就已经提示我:


python编码格式导致csv读取错误怎么解决

也就是这里改后缀并没有把文件格式弄好。所以我选择“另存为”改选了文件格式为

python编码格式导致csv读取错误怎么解决

之后,读取就不会报错了。

注:有个疑问没有解决,就是那个我“直接改后缀得到的那个.csv”我用记事本打开查看了一下,编码就是ANSI啊。那我就不知道为什么报错了……不过问题倒是暂时解决了。

现在读取到的格式为

python编码格式导致csv读取错误怎么解决

是个结构体。

另外,对于:csv模块“line contains NULL byte”错误。和上面出现问题原因和解决方案是一样的,比如

import csvcsvfile=file('water30.csv','rb')reader = csv.reader(csvfile)for line in reader:     print linecsvfile.close()

报错:Error: line contains NULL byte

修正后,读入的数据格式为list,如下

[‘1’, ‘2’, ‘2’, ‘1’, ‘2’]
[‘1’, ‘1’, ‘1’, ‘2’, ‘2’]
[‘1’, ‘2’, ‘1’, ‘1’, ‘1’]
[‘1’, ‘1’, ‘1’, ‘1’, ‘2’]
[‘1’, ‘1’, ‘1’, ‘2’, ‘2’]
[‘1’, ‘1’, ‘1’, ‘2’, ‘2’]
[‘0.697’, ‘0.744’, ‘0.634’, ‘0.403’, ‘0.481’]
[‘0.46’, ‘0.376’, ‘0.264’, ‘0.237’, ‘0.149’]
[‘1’, ‘1’, ‘1’, ‘1’, ‘1’]

pandas读取csv常见错误及解决

1)第一种错误

错误提示:

pandas.errors.ParserError: Error tokenizing data. C error: Expected 1 fields in line 121, saw 2

解决方法:

import pandas as pddata = pd.read_csv(inputfile, encoding='utf-8',header=None,sep = '\t')

2)第二种错误

错误提示:

pandas.errors.ParserError: Error tokenizing data. C error: EOF inside string starting at line 15945

解决方法:

import pandas as pdimport csvdf = pd.read_csv(csvfile, quoting=csv.QUOTE_NONE, encoding='utf-8')

感谢各位的阅读,以上就是“python编码格式导致csv读取错误怎么解决”的内容了,经过本文的学习后,相信大家对python编码格式导致csv读取错误怎么解决这一问题有了更深刻的体会,具体使用情况还需要大家实践验证。这里是编程网,小编将为大家推送更多相关知识点的文章,欢迎关注!

--结束END--

本文标题: python编码格式导致csv读取错误怎么解决

本文链接: https://www.lsjlt.com/news/328705.html(转载时请注明来源链接)

有问题或投稿请发送至: 邮箱/279061341@qq.com    QQ/279061341

本篇文章演示代码以及资料文档资料下载

下载Word文档到电脑,方便收藏和打印~

下载Word文档
软考高级职称资格查询
编程网,编程工程师的家园,是目前国内优秀的开源技术社区之一,形成了由开源软件库、代码分享、资讯、协作翻译、讨论区和博客等几大频道内容,为IT开发者提供了一个发现、使用、并交流开源技术的平台。
  • 官方手机版

  • 微信公众号

  • 商务合作