首頁·報錯訊息

python · Python

報錯原文

UnicodeDecodeError: 'utf-8' codec can't decode byte 0xff in position 0: invalid start byte

這是什麼意思

你把一個檔案或位元組串按 UTF-8 讀,卻碰到了 UTF-8 不允許的位元組;訊息裡同時給出了位置和那個位元組。多半是檔案其實是 Windows 那邊的 cp1252 或別的舊編碼,或者根本不是文字——是圖片、zip,或者忘了解壓縮的 gzip 資料。正確做法是查出真實編碼並用 encoding= 傳進去;errors="replace" 能讓讀取走完,但會把那些位元組換成問號,資料從此就悄悄壞掉了。

怎麼修

這個沒有一行命令能解決。說明裡寫了該看哪裡。

來自
python
Python
18

Python 的 traceback 把答案劈成兩半——最後一行說「錯了什麼」,上面的框說「錯在哪裡」——所以只讀最後一行,你會拿到名字卻丟掉位置;而 NoneType、KeyError 這類「值不存在」的錯誤,原因幾乎總在崩潰那一框的上面。

怎麼讀報錯

  • 從第一行往下讀。越往下越是工具內部的事,起因通常寫在最上面。
  • 有檔名和行號就從那裡查——不是堆疊最上面那一格,而是最上面那條提到你自己寫的檔案的行。
  • 把報錯原文照樣去搜,但先去掉你自己的路徑和變數名,正是那些讓搜尋比對不上。
  • 同一種情況在不同版本裡措辭不同。結果不對頭,就把版本號一起加進查詢。
  • 貼上修法之前,先確認它會丟掉什麼。這裡面有些是不能收回的。

常見問題

Q. “UnicodeDecodeError: 'utf-8' codec can't decode byte 0xff in position 0: invalid start byte” 是什麼意思?

你把一個檔案或位元組串按 UTF-8 讀,卻碰到了 UTF-8 不允許的位元組;訊息裡同時給出了位置和那個位元組。多半是檔案其實是 Windows 那邊的 cp1252 或別的舊編碼,或者根本不是文字——是圖片、zip,或者忘了解壓縮的 gzip 資料。正確做法是查出真實編碼並用 encoding= 傳進去;errors="replace" 能讓讀取走完,但會把那些位元組換成問號,資料從此就悄悄壞掉了。

Q. 怎麼修?

沒有一行命令能解決。上面的說明寫了該看哪裡。

Q. 這是哪個工具報的?

python。它屬於Python,報錯原文有 13 個詞。

相關報錯