Go语言使用strings.Split按\n分割文件内容为何多出额外空行
问题原因
该现象是两个规则共同作用的必然结果:
- 符合POSIX规范的文本文件默认在最后一行末尾带有换行符
\n,你使用的numbers.txt对应的完整字符串实际为"1\n2\n3\n4\n5\n",而非没有末尾换行的"1\n2\n3\n4\n5"。 - Go标准库的
strings.Split会对字符串中所有匹配分隔符的位置做全量切割:如果字符串以分隔符结尾,分隔符右侧没有有效内容,就会生成一个空字符串作为最后一个元素。例如strings.Split("a,b,", ",")的返回值为["a", "b", ""],和你用\n分割文件内容的逻辑完全一致。
解决方法
以下三种方案都可以解决该问题:
- 方案1:分割前移除末尾换行符
调用strings.TrimSuffix去掉末尾的\n后再分割,适配确认是Unix换行符的场景:// Go 1.16及以上推荐使用os.ReadFile替代已弃用的ioutil.ReadFile data, _ := os.ReadFile("numbers.txt") content := strings.TrimSuffix(string(data), "\n") input := strings.Split(content, "\n") - 方案2:使用
bufio.Scanner逐行读取(最推荐)
该方法是Go标准库专门设计的行读取方案,会自动适配Unix\n、Windows\r\n等不同格式的换行符,同时自动处理末尾换行带来的空元素,兼容性和鲁棒性最好:func main() { file, err := os.Open("numbers.txt") if err != nil { panic(err) } defer file.Close() var input []string scanner := bufio.NewScanner(file) for scanner.Scan() { input = append(input, scanner.Text()) } if err := scanner.Err(); err != nil { panic(err) } fmt.Println("Len: ", len(input)) for i, v := range input { fmt.Println(i, v) } } - 方案3:分割后过滤末尾空元素
不确定文件末尾是否有换行的场景下,可以在分割后主动判断并截断末尾空元素:data, _ := os.ReadFile("numbers.txt") input := strings.Split(string(data), "\n") if len(input) > 0 && input[len(input)-1] == "" { input = input[:len(input)-1] }
内容的提问来源于stack exchange,提问作者N. J
相关产品推荐
相关产品推荐

