Python文件流中f.tell()返回异常值及换行符索引异常原因咨询
Python文件流tell()异常值与索引跳变问题解答
问题描述
测试Python文件流机制时编写如下代码:
with open('test2.txt') as f: while r := f.read(1): print(repr(r), f.tell(), sep='\tindex:', end='\n***************\n')
test2.txt内容为:
012345 6789
运行后输出:
'0' index:1 *************** '1' index:2 *************** '2' index:3 *************** '3' index:4 *************** '4' index:5 *************** '5' index:18446744073709551623 *************** '\n' index:8 *************** '\n' index:10 *************** '6' index:11 *************** '7' index:12 *************** '8' index:13 *************** '9' index:14 ***************
疑问:
- 为何
f.tell()会返回18446744073709551623? - 若假设'5'的索引为6,为何'\n'的索引是8而非7?
解答
1. 关于f.tell()返回的特殊值
18446744073709551623是2^64 - 1,即无符号64位整数的最大值,本质是文本模式下文件对象的特殊位置标记。
在文本模式中,Python会自动处理换行符(比如Windows系统下将\r\n转换为单个\n),此时f.tell()返回的不是精确的字节偏移,而是一个抽象的“文件位置标记”,用于内部定位。当读取操作导致字节指针位置无法与抽象的字符位置准确对应时(比如读取到\r即将和后续\n合并的节点),tell()就会返回这个特殊值——它实际是C语言中-1的无符号64位整数表示,用来标记“无法精确表示的位置”。
在你的案例中,读取完'5'后,文件的字节指针指向\r(对应Windows换行的第一个字节),此时调用read(1)会将\r\n合并成一个\n返回,但这个过程中字节位置和字符位置的映射关系断裂,因此tell()返回了该特殊值。
2. 关于索引跳变的原因
这是文本模式下换行符自动转换导致的:
- 你的文件是Windows系统创建的,换行符实际是
\r\n(占2个字节)。 - Python以默认的文本模式打开文件时,会把
\r\n转换为单个\n字符。 - '5'的字节位置是5(从0开始计数),读取完'5'后字节位置跳到6;接下来的
\r(字节6)和\n(字节7)被合并成一个\n字符,读取完成后字节位置直接跳到8,因此tell()返回8。 - 同理,第二个换行也是
\r\n(字节8和9),读取后字节位置跳到10,所以第二个\n对应的tell()值是10。
内容的提问来源于stack exchange,提问作者Shrehan Raj Singh
相关产品推荐
相关产品推荐

