如何解决CSV中含分隔符的JSON字段转Ruby Hash解析失败问题?
碰到这种情况太头疼了——CSV解析器误把JSON里的分号当成列分隔符,直接把完整的JSON拆成了两段,导致JSON解析失败。我给你几个实用的解决办法,按优先级排序:
规范CSV格式(最推荐)
标准CSV协议里,如果字段包含分隔符,必须用引号包裹。所以如果能控制CSV的生成逻辑,把JSON字段用双引号括起来(注意引号转义),解析时就能正常识别了:require 'csv' require 'json' # 生成时给JSON字段加引号,内部双引号转义为两个双引号 line = 'data1;data2;"{""key1"":""val;ue1"",""key2"":""value2""}"' csv = CSV.parse_line(line, col_sep: ";") # => ["data1", "data2", "{\"key1\":\"val;ue1\",\"key2\":\"value2\"}"] JSON.parse(csv[2]) # 顺利解析出Hash这是最符合规范的做法,能避免各种 edge case。
手动限制拆分次数
如果没法修改CSV的生成方式,那可以利用Ruby的String#split方法指定拆分次数——因为你明确知道前两列是普通数据,第三列及之后的所有内容都是JSON,所以只拆分前两个分号:require 'json' line = 'data1;data2;{"key1":"val;ue1","key2":"value2"}' parts = line.split(';', 3) # 只拆分前两个分号,剩下的内容作为第三项 # => ["data1", "data2", "{\"key1\":\"val;ue1\",\"key2\":\"value2\"}"] JSON.parse(parts[2]) # 完美解析这个方法简单粗暴,只要前两列本身不包含分号就绝对靠谱,完全适配你的场景。
用正则匹配完整JSON(适合复杂场景)
如果前两列也可能包含分号(虽然你的例子里没有),可以用正则表达式精准匹配从{开始到}结束的JSON部分:require 'json' line = 'data1;data2;{"key1":"val;ue1","key2":"value2"}' # 匹配前两个分号后的完整JSON(简单版,支持单层{},复杂嵌套需要调整正则) match_result = line.match(/^(.*?);(.*?);({.*})$/) if match_result data1 = match_result[1] data2 = match_result[2] json_str = match_result[3] puts JSON.parse(json_str) # 正常解析 end注意:如果JSON里有嵌套的大括号,这个正则会失效,这时可能需要用JSON解析器来定位正确的结束位置,但一般简单场景下这个方法足够用。
内容的提问来源于stack exchange,提问作者Florent L.
相关产品推荐
相关产品推荐

