Django执行loaddata时遭遇UnicodeDecodeError错误求助
Django loaddata 报 UnicodeDecodeError: 'utf-8' codec can't decode byte 0xff 错误的解决方法
问题重现
执行python manage.py dumpdata > seed_data.json导出数据后,删除数据库并完成迁移,再执行python manage.py loaddata seed_data.json时触发错误:
UnicodeDecodeError: 'utf-8' codec can't decode byte 0xff in position 0: invalid start byte
错误原因
直接使用>重定向输出时,Windows命令提示符默认会用系统编码(如UTF-16或GBK)保存文件,而非Django loaddata要求的UTF-8编码。文件开头的0xff字节是UTF-16编码的BOM(字节顺序标记),导致UTF-8解码失败。
解决方案
方法1:指定dumpdata输出为UTF-8编码
放弃重定向,改用dumpdata自带的参数直接生成UTF-8编码的文件:
python manage.py dumpdata --output seed_data.json --encoding=utf-8
重新导出后,再执行migrate和loaddata即可正常导入。
方法2:转换现有文件为无BOM的UTF-8编码
如果不想重新导出,可手动转换文件编码:
- 用记事本打开
seed_data.json,点击「文件」→「另存为」,编码选择「UTF-8」(不要选带BOM的选项),覆盖原文件。 - 用VS Code打开文件,右下角点击当前编码(如显示「UTF-16 LE」),选择「通过编码保存」→「UTF-8」。
方法3:loaddata时指定对应编码
若文件确实是UTF-16编码,可直接在导入时指定编码:
python manage.py loaddata seed_data.json --encoding=utf-16
推荐优先使用方法1或2,确保文件为标准UTF-8格式,避免后续其他兼容性问题。
额外建议
导出数据时建议排除临时的session数据(你的JSON中包含sessions.session条目),这类数据导入后通常无效,可通过--exclude参数过滤:
python manage.py dumpdata --exclude sessions --output seed_data.json --encoding=utf-8
内容的提问来源于stack exchange,提问作者Chai Yon Xing
相关产品推荐
相关产品推荐

