Cassandra 4.0导入UTF-8-BOM编码CSV时出现解析错误求助
解决Cassandra导入UTF-8-BOM CSV的解析错误
你遇到的invalid literal for int() with base 10: '\ufeff1'错误,是因为CSV文件开头带有UTF-8 BOM(字节顺序标记),这个标记被Cassandra当成了第一个字段airplane_id的一部分,导致无法解析为整数类型。
解决方法如下:
用Notepad++重新保存无BOM的UTF-8文件
打开你的CSV文件,点击顶部菜单栏的「编码」,选择「UTF-8」(不要选带BOM的选项),保存后重新执行COPY命令即可。命令行工具批量去除BOM
如果是批量处理或者不想用图形工具:- Linux/macOS:
sed -i '1s/^\xef\xbb\xbf//' airplane.csv - Windows PowerShell:
Get-Content airplane.csv -Encoding UTF8 | Set-Content airplane.csv -Encoding UTF8NoBOM
- Linux/macOS:
额外注意
你的错误日志里显示正在导入airportdb.airport表,但提供的CQL代码是创建airplane表,确认导入命令中的表名是否和目标表一致,避免出现其他问题。
内容的提问来源于stack exchange,提问作者kunicki
相关产品推荐
相关产品推荐

