PHP解析文本文件时如何清除字符串中的随机无效字符?
解决PHP中字符串含隐藏无效字符的方案
从你的调试结果来看,这个隐藏字符是UTF-8 BOM头——它是部分编辑器保存UTF-8文件时自动添加的三个隐藏字节(对应十六进制EF BB BF,十进制239、187、191),加上数字"1"后才让字符串长度变成了4。下面给你几个实用的PHP处理方案:
方案1:精准移除UTF-8 BOM头
如果确定问题是BOM导致的,可以直接检测并移除字符串开头的BOM:
function removeUtf8Bom($str) { $bom = pack('H*','EFBBBF'); return preg_replace("/^$bom/", '', $str); } // 使用示例 $cleanLine = removeUtf8Bom($line); var_dump($cleanLine); // 输出 string(1) "1"
方案2:过滤出纯数字字符
如果不确定还有其他什么无效字符,直接提取字符串里的所有数字是最稳妥的方式:
$cleanLine = preg_replace('/[^0-9]/', '', $line); var_dump($cleanLine); // 只保留字符串中的数字部分
方案3:处理多字节无效字符
如果涉及其他多字节类型的无效字符,可以用多字节正则函数清理:
$cleanLine = mb_ereg_replace('[^0-9]', '', $line);
内容的提问来源于stack exchange,提问作者Denis
相关产品推荐
相关产品推荐

