Inicio·Mensajes de error

python · Python

El mensaje

UnicodeDecodeError: 'utf-8' codec can't decode byte 0xff in position 0: invalid start byte

Qué significa

Leíste un archivo o una secuencia de bytes como UTF-8 y apareció un byte que UTF-8 no permite; el mensaje indica la posición y el byte. Lo normal es que el archivo sea cp1252 u otra codificación heredada de Windows, o que no sea texto en absoluto: una imagen, un zip o datos gzip sin descomprimir. Lo correcto es averiguar la codificación real y pasarla en encoding=; errors="replace" permite terminar la lectura pero convierte esos bytes en signos de interrogación, y los datos quedan dañados en silencio.

El arreglo

No hay un comando de una línea. La explicación dice qué revisar.

Lo imprime
python
Python
18

Un traceback de Python divide la respuesta en dos: la última línea dice qué falló y los marcos de arriba dicen dónde, así que leer solo la última línea te da el nombre y te quita el lugar; y en los errores por valor ausente, como NoneType y KeyError, la causa casi siempre está en un marco superior al que se rompió.

Cómo leer un mensaje de error

  • Lee desde la primera línea. Cuanto más abajo, más son las tripas de la herramienta; la causa suele estar arriba.
  • Si hay un archivo y un número de línea, empieza ahí: no el marco superior de la pila, sino la línea más alta que nombre un archivo tuyo.
  • Busca el mensaje literal, pero quita antes tus rutas y nombres de variables: eso es lo que impide que la búsqueda coincida.
  • La misma condición se redacta distinto según la versión. Si los resultados no cuadran, añade el número de versión.
  • Antes de pegar un arreglo, comprueba qué descarta. Algunos no se pueden deshacer.

Preguntas frecuentes

Q. ¿Qué significa «UnicodeDecodeError: 'utf-8' codec can't decode byte 0xff in position 0: invalid start byte»?

Leíste un archivo o una secuencia de bytes como UTF-8 y apareció un byte que UTF-8 no permite; el mensaje indica la posición y el byte. Lo normal es que el archivo sea cp1252 u otra codificación heredada de Windows, o que no sea texto en absoluto: una imagen, un zip o datos gzip sin descomprimir. Lo correcto es averiguar la codificación real y pasarla en encoding=; errors="replace" permite terminar la lectura pero convierte esos bytes en signos de interrogación, y los datos quedan dañados en silencio.

Q. ¿Cómo se arregla?

No hay comando de una línea. La explicación de arriba dice qué revisar.

Q. ¿Qué herramienta lo imprime?

python. Está en Python y el mensaje tiene 13 palabras.

Errores cercanos