在Python中从gzip格式的CSV删除BOM

首先，您需要解码文件内容，而不是对其进行编码。

其次，该csv模块不喜欢Python 2.7中的unicode字符串，因此在对数据进行解码之后，您需要将其转换回utf-8。

最后，csv.reader在文件的各行上传递迭代，而不是其中包含换行符的大字符串。

所以：

csv.reader(f.read().decode('utf-8-sig').encode('utf-8').splitlines())

但是，您可能认为仅手动删除BOM会更简单/更有效：

def remove_bom(line):
    return line[3:] if line.startswith(codecs.BOM_UTF8) else line

csv.reader((remove_bom(line) for line in f), dialect = 'excel', delimiter = ';')

这有一点不同，因为它从任何以“ 1”开头的行中删除了BOM，而不仅仅是第一行。如果您不需要保留其他BOM，那么可以使用以下方法进行修复：

def remove_bom_from_first(iterable):
    f = iter(iterable)
    firstline = next(f, None)
    if firstline is not None:
        yield remove_bom(firstline)
        for line in f:
            yield f

python 2022/1/1 18:45:08 有301人围观

撰写回答

你尚未登录，登录后可以

和开发者交流问题的细节

关注并接收问题和回答的更新提醒

参与内容的编辑和改进，让解决方法与时俱进

请先登录

推荐问题

如何在PHP变量中去除空格？

如何在PHP变量中去除空格？

php 2022-01-01 1182
我可以在php中的SESSION数组上使用array_push吗？

我可以在php中的SESSION数组上使用array_push吗？

php 2022-01-01 1175
如何使用bcrypt在PHP中对密码进行哈希处理？

如何使用bcrypt在PHP中对密码进行哈希处理？

php 2022-01-01 928
如何在PHP中使用XMLReader？

如何在PHP中使用XMLReader？

php 2022-01-01 1067
PDOException“找不到驱动程序”在PHP

PDOException“找不到驱动程序”在PHP

php 2022-01-01 1050
为什么在pom.xml的第1行中出现Unknown错误？

为什么在pom.xml的第1行中出现Unknown错误？

其他 2022-01-01 1231
__construct（）与SameAsClassName（）在PHP中的构造函数

__construct（）与SameAsClassName（）在PHP中的构造函数

php 2022-01-01 855
使用Retrofit2在POST请求中发送JSON

使用Retrofit2在POST请求中发送JSON

其他 2022-01-01 959
用单引号在PHP中打印换行符

用单引号在PHP中打印换行符

php 2022-01-01 873
可以嵌套在P元素内的HTML5元素列表？

可以嵌套在P元素内的HTML5元素列表？

其他 2022-01-01 900
为什么在PHP中通过标头（'Location ..'）重定向后必须调用'exit'？

为什么在PHP中通过标头（'Location ..'）重定向后必须调用'exit'？

php 2022-01-01 844
如何在PHP中发出异步GET请求？

如何在PHP中发出异步GET请求？

php 2022-01-01 858
如何在php中为其他所有函数调用自动调用函数

如何在php中为其他所有函数调用自动调用函数

php 2022-01-01 917
当软键盘出现在phonegap中时，输入字段隐藏

当软键盘出现在phonegap中时，输入字段隐藏

其他 2022-01-01 879
在PHP中连接n个数组的值

在PHP中连接n个数组的值

php 2022-01-01 877
在PHP中“ =>”是什么意思？

在PHP中“ =>”是什么意思？

php 2022-01-01 898
在PHP中写入新行到文件（换行）

在PHP中写入新行到文件（换行）

php 2022-01-01 832
文件上传可以在PHP中超时吗？

文件上传可以在PHP中超时吗？

php 2022-01-01 874
如何在Python中使用Selenium滚动到页面的末尾？

如何在Python中使用Selenium滚动到页面的末尾？

python 2022-01-01 870
在PHP中对关联数组进行排序

在PHP中对关联数组进行排序

php 2022-01-01 835

在Python中从gzip格式的CSV删除BOM

撰写回答

推荐问题

如何在PHP变量中去除空格？

我可以在php中的SESSION数组上使用array_push吗？

如何使用bcrypt在PHP中对密码进行哈希处理？

如何在PHP中使用XMLReader？

PDOException“找不到驱动程序”在PHP

为什么在pom.xml的第1行中出现Unknown错误？

__construct（）与SameAsClassName（）在PHP中的构造函数

使用Retrofit2在POST请求中发送JSON

用单引号在PHP中打印换行符

可以嵌套在P元素内的HTML5元素列表？

为什么在PHP中通过标头（'Location ..'）重定向后必须调用'exit'？

如何在PHP中发出异步GET请求？

如何在php中为其他所有函数调用自动调用函数

当软键盘出现在phonegap中时，输入字段隐藏

在PHP中连接n个数组的值

在PHP中“ =>”是什么意思？

在PHP中写入新行到文件（换行）

文件上传可以在PHP中超时吗？

如何在Python中使用Selenium滚动到页面的末尾？

在PHP中对关联数组进行排序

分类汇总

您的鼓励是对我最大的支持