首页·报错信息

python · Python

报错原文

UnicodeDecodeError: 'utf-8' codec can't decode byte 0xff in position 0: invalid start byte

这是什么意思

你把一个文件或字节串按 UTF-8 读,却碰到了 UTF-8 不允许的字节;消息里同时给出了位置和那个字节。多半是文件其实是 Windows 那边的 cp1252 或别的旧编码,或者根本不是文本——是图片、zip,或者忘了解压的 gzip 数据。正确做法是查出真实编码并用 encoding= 传进去;errors="replace" 能让读取走完,但会把那些字节换成问号,数据从此就悄悄坏掉了。

怎么修

这个没有一行命令能解决。说明里写了该看哪里。

来自
python
Python
18

Python 的 traceback 把答案劈成两半——最后一行说「错了什么」,上面的帧说「错在哪里」——所以只读最后一行,你会拿到名字却丢掉位置;而 NoneType、KeyError 这类「值不存在」的错误,原因几乎总在崩溃那一帧的上面。

怎么读报错

  • 从第一行往下读。越往下越是工具内部的事,起因通常写在最上面。
  • 有文件名和行号就从那里查——不是栈顶那一帧,而是最上面那条提到你自己写的文件的行。
  • 把报错原文照样去搜,但先去掉你自己的路径和变量名,正是那些让搜索匹配不上。
  • 同一种情况在不同版本里措辞不同。结果不对头,就把版本号一起加进查询。
  • 粘贴修法之前,先确认它会丢掉什么。这里面有些是不能撤回的。

常见问题

Q. “UnicodeDecodeError: 'utf-8' codec can't decode byte 0xff in position 0: invalid start byte” 是什么意思?

你把一个文件或字节串按 UTF-8 读,却碰到了 UTF-8 不允许的字节;消息里同时给出了位置和那个字节。多半是文件其实是 Windows 那边的 cp1252 或别的旧编码,或者根本不是文本——是图片、zip,或者忘了解压的 gzip 数据。正确做法是查出真实编码并用 encoding= 传进去;errors="replace" 能让读取走完,但会把那些字节换成问号,数据从此就悄悄坏掉了。

Q. 怎么修?

没有一行命令能解决。上面的说明写了该看哪里。

Q. 这是哪个工具报的?

python。它属于Python,报错原文有 13 个词。

相关报错