python · Python
报错原文
UnicodeDecodeError: 'utf-8' codec can't decode byte 0xff in position 0: invalid start byte
这是什么意思
你把一个文件或字节串按 UTF-8 读,却碰到了 UTF-8 不允许的字节;消息里同时给出了位置和那个字节。多半是文件其实是 Windows 那边的 cp1252 或别的旧编码,或者根本不是文本——是图片、zip,或者忘了解压的 gzip 数据。正确做法是查出真实编码并用 encoding= 传进去;errors="replace" 能让读取走完,但会把那些字节换成问号,数据从此就悄悄坏掉了。
怎么修
这个没有一行命令能解决。说明里写了该看哪里。
- 来自
- python
- Python
- 18
Python 的 traceback 把答案劈成两半——最后一行说「错了什么」,上面的帧说「错在哪里」——所以只读最后一行,你会拿到名字却丢掉位置;而 NoneType、KeyError 这类「值不存在」的错误,原因几乎总在崩溃那一帧的上面。
怎么读报错
- 从第一行往下读。越往下越是工具内部的事,起因通常写在最上面。
- 有文件名和行号就从那里查——不是栈顶那一帧,而是最上面那条提到你自己写的文件的行。
- 把报错原文照样去搜,但先去掉你自己的路径和变量名,正是那些让搜索匹配不上。
- 同一种情况在不同版本里措辞不同。结果不对头,就把版本号一起加进查询。
- 粘贴修法之前,先确认它会丢掉什么。这里面有些是不能撤回的。
常见问题
Q. “UnicodeDecodeError: 'utf-8' codec can't decode byte 0xff in position 0: invalid start byte” 是什么意思?
你把一个文件或字节串按 UTF-8 读,却碰到了 UTF-8 不允许的字节;消息里同时给出了位置和那个字节。多半是文件其实是 Windows 那边的 cp1252 或别的旧编码,或者根本不是文本——是图片、zip,或者忘了解压的 gzip 数据。正确做法是查出真实编码并用 encoding= 传进去;errors="replace" 能让读取走完,但会把那些字节换成问号,数据从此就悄悄坏掉了。
Q. 怎么修?
没有一行命令能解决。上面的说明写了该看哪里。
Q. 这是哪个工具报的?
python。它属于Python,报错原文有 13 个词。
相关报错
ValueError: invalid literal for int() with base 10: '3.5'pythonModuleNotFoundError: No module named 'requests'pythonZeroDivisionError: division by zeropythonRecursionError: maximum recursion depth exceededpythonUnboundLocalError: cannot access local variable 'count' where it is not associated with a valuepython 3.11+TypeError: greet() takes 1 positional argument but 2 were givenpythonPermissionError: [Errno 13] Permission deniedpythonOSError: [Errno 98] Address already in usepython