Python - 使用utf-8编码读写csv文件-6ren

Python - 使用utf-8编码读写csv文件

转载作者：太空狗更新时间：2023-10-30 01:11:46

24

4

我正在尝试读取一个 csv 文件，它的标题包含外来字符，我遇到了很多问题。

首先，我正在使用一个简单的 csv.reader 读取文件

filename = 'C:\\Users\\yuval\\Desktop\\בית ספר\\עבודג\\new\\resources\\mk'+ str(mkNum) + 'Data.csv'
raw_data = open(filename, 'rt', encoding="utf8")
reader = csv.reader(raw_data, delimiter=',', quoting=csv.QUOTE_NONE)
x = list(reader)
header = x[0]
data = np.array(x[1:]).astype('float')

var header应该是一个包含文件头的数组，但是它返回给我的数组是

['\ufeff"dayPart"', '"length"', '"ifPhoto"', '"ifVideo"', '"ifAlbum"', '"לא"', '"הוא"', '"בכל"', '"אותם"', '"זה"', '"הם"', '"כדי"', '"את"', '"יש"', '"לי"', '"היא"', '"אני"', '"רק"', '"להם"', '"על"', '"עם"', '"של"', '"המדינה"', '"כל"', '"גם"', '"הזה"', '"אם"', '"ישראל"', '"לכל"', '"מי"', '"ל"', '"אמסלם"', '"לנו"', '"אבל"', '"זו"', '"אין"', '"שבת"', '"שלום"', '"כ"', '"שלנו"', '"היום"', '"ומבורך"', '"ח"', '"דודי"', '"ר"', '"הפנים"', '"מה"', '"כי"', '"ה"', '"אחד"', '"ולא"', '"יותר"']

而且我不知道为什么它会在第一个对象和双引号中添加\ufeff。

之后，我需要写入另一个 csv 文件并在标题中使用外来字符。我试图那样做，但它把字符写成奇怪的符号。

with open('C:\\Users\\yuval\\Desktop\\בית ספר\\עבודג\\new\\variance reduction 1\\mk'+ str(mkNum) + 'Data.csv', 'w', newline='', encoding='utf8') as csvFile:
    csvWriter = csv.writer(csvFile, delimiter=',')
    csvWriter.writerow(newHeader)

有谁知道如何解决这个问题并在 csv 文件的 header 中使用 utf8 编码？

最佳答案

您报告了三个不同的问题。由于没有足够的信息可以确定，所以这有点猜测，但您应该尝试以下操作:

输入编码:按照评论中的建议，尝试“utf-8-sig”。这将从您的输入中删除 Byte Order Mark (BOM)。
双引号:在 csv 参数中，您指定 quoting=csv.QUOTE_NONE。这告诉 csv 库 CSV 表是在没有使用引号的情况下编写的(用于转义可能被误认为字段或行分隔符的字符)。然而，这显然不是真的，因为输入在每个字段周围都有 引号。请尝试使用 csv.QUOTE_MINIMAL(默认值)或 csv.QUOTE_ALL。
输出编码:你说输出包含“奇怪的符号”。我怀疑输出实际上没问题，但您使用的工具默认情况下无法正确显示 UTF-8 文本:许多 Windows 应用程序(例如 Excel)仍然更喜欢 UTF-16 和本地化的 8 位编码，例如 CP-1255 。与问题 1 一样，您应该尝试编解码器“utf-8-sig”:BOM 被许多查看者/编辑者理解为编码提示。

关于Python - 使用utf-8编码读写csv文件，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/48085319/

24

4

0

文章推荐： python - Windows - Pycharm - 安装python打包工具失败

文章推荐： c# - 如何在 ASP.NET 中获取 session 状态对象的集合？

文章推荐：加载表单时 C# WaitCursor

文章推荐： python - Apache Flask 错误 13，权限被拒绝

MongoDB Catalina 读写
我用 chown 不行。 Bilals-MBP:~ $ sudo mkdir -p /data/db Password: mkdir: /data/db: Read-only file system
c++ - Qt和Arduino串行通信(读写)
我陷入了一个非常简单的问题。我正在尝试制作一个Qt GUI应用程序以从GUI控制我的Arduino(而不是从Arduino IDE的串行监视器控制它)。我能够使用QSerialPort write(
C++ COM口的打开、读写
我正在尝试使用 Win32 的 CreateFile 函数打开一个 COM 端口。我已经在 MSDN 以及几个论坛上阅读了有关如何执行此操作的文档，但无论我做什么，我仍然收到错误代码 #2(端口不存在
c++ - 用c++读写
我正在尝试使用系统调用 read() 和 write()。以下程序创建一个文件并将一些数据写入其中。这是代码.. int main() { int fd; open("stud
ios - Xcode中如何使用已有的数据库文件，读写？
我对 Xcode 和 sqlite 有点陌生。现在我有一个名为“mydb.db”的数据库文件，它已经有一些表和数据。我把它放在我的 mac 文件夹中，然后将它拖到“支持文件”下的 Xcode 项目中。
Python 读写 tty
背景:如果需要，请跳至问题部分我正在研究测试设备的前端。前端的目的是为了更容易编写长测试脚本。几乎只是让它们更易读和可写。设备将使用 Prologix GPIB-USB Controller 进行
Python文件常见操作实例分析【读写、遍历】
本文实例讲述了python文件常见操作。分享给大家供大家参考，具体如下： 1.文件是什么？文件是存储在外部介质上的数据或信息集合，程序中源程序、数据中保存的数据、图像中的像素数据等等；文件
multithreading - 原子交换(读写)操作的用例是什么？
C++0x 指定 std::atomic线程安全原子访问变量的模板。这个模板有一个成员函数 std::atomic::exchange原子地在“this”中存储一个新值并检索“this”的现有值。 W
vba - 读写 .ini 文件的推荐方式
VBA 中是否有任何方法可以读取和写入 INI 文件？我知道我可以使用； Open "C:\test.ini" For Input As #1 ...并解析数据。相反，我试图查看已有哪些工具可用。我
architecture - 读写 API，它们是独立的服务吗？
我最近在 GitHub 存储库 system-design-primer 上看到了系统设计示例，它显示了读/写 API。我正在尝试实现 this one 以进行练习。大纲是这样的。它分离了读写API
delphi - 读写 DEVMODE.dmColor
我在使用 DEVMODE 结构的 dmColor 字段时遇到问题。我的默认打印机是彩色打印机，如果我通过控制面板将打印机属性的颜色默认输出为黑白，则 DEVMODE.dmColor 字段始终返回 D
java - 读写 COM 端口？
我知道套接字等如何与 java/android 配合使用，但是如何使用 java 或 python 连接到桌面上的 COM 端口？您想使用地址吗？或者查找您想要的端口是否可用或者什么？我不知道该怎么
amazon-dynamodb - DynamoDB 读写
什么构成 DynamoDB 中的实际读取？它是读取表格中的每一行还是返回什么数据？这就是扫描如此昂贵的原因 - 您读取整个表格并为读取的每一行表格付费吗？能否将 ElasticCache (Me
java - 文件(读写)无法正确检测到换行符
我想用Java编写一个程序来检查src是否存在（如果不抛出FileNoot的话）并将src.txt的内容复制到des.txt 并在开头和结尾处打印两个文件的大小输出为： src.txt is in
c++ - 读写 float 组到文件
我在 C++ 中有一个 float 数组，我想将它保存到一个二进制文件中(以节省空间)，以便以后能够再次读取它。为此，我编写了以下代码来编写数组: float *zbuffer = new float
javascript - websocket javascript 读写
我试图为 websocket 创建一个 Read\Write 函数，但我遇到了一个问题...... var inarrivo = 0; var risposta = ""; function RDW_
c++ - 读写 QGraphicsScene 到二进制文件
在我的应用程序中是用 Qt 编写的，我有一个 QGraphicsScene。在这个 QgraphicsScene 中有一个图像和一些由用户绘制的项目。我想保存这个包含所有内容的 QgraphicsSc
c - 使用命名管道 C 读写
我正在编写一个程序，该程序应该无限期运行并保持变量的值。其他两个程序可以更改变量的值。我使用命名管道接收变量值并将其发送到外部程序。这是我的变量管理器代码。 manager.c: #includ
c - 读写 C 系统调用是否使用缓冲区？
我和一位老师谈过，他告诉我读写系统调用使用缓冲区，因为在你的系统规范中有一个变量控制你可以访问你想要读/写的设备的次数on，系统在他等待写入设备时使用buffer来存储数据。我在另一篇 Stack
C# 读写 TextFile 在中间结束
我运行一个方法，有三个部分，第 1 部分和第 3 部分都是“读取文本文件”，第二部分是将字符串保存到文本文件， // The Save Path is the text file's Path, u

首页

博学

6Ren·AI

商城

Python - 使用utf-8编码读写csv文件