如何从SQL导出文件的INTO .db. VALUES段提取指定加粗项?
提取SQL VALUES元组中的第二个字符串值
假设你的SQL导出文件里的目标片段格式类似如下(单引号包裹字符串):
INSERT INTO `mydb`.`tablename` VALUES (1, 'blog', 'content1'), (2, 'blog1', 'content2'); -- 或者多行形式 INSERT INTO `mydb`.`tablename` VALUES (3, 'blog2', 'content3'), (4, 'blog3', 'content4');
以下是几种可以批量提取所有目标值的命令行方法:
方法1:使用sed全局匹配提取
这个方法先剥离VALUES之前的内容,再逐个匹配每个元组的第二个字符串:
sed -E 's/.*VALUES//; s/,?\([^,]+,'\''([^'\'']+)'\''.*/\1\n/g' your_sql_file.sql | grep -v "^$"
解释:
s/.*VALUES//:删除VALUES关键字之前的所有内容,只保留需要处理的元组部分s/,?\([^,]+,'\''([^'\'']+)'\''.*/\1\n/g:全局匹配每个元组(开头可能带逗号),提取单引号包裹的第二个值,替换为该值加换行grep -v "^$":过滤处理后产生的空行
如果你的SQL用双引号包裹字符串,把命令里的'\''替换为\"即可:
sed -E 's/.*VALUES//; s/,?\([^,]+,"([^"]+)".*/\1\n/g' your_sql_file.sql | grep -v "^$"
方法2:使用awk按分隔符处理
awk可以灵活分割SQL结构,适配多行或单行的VALUES片段:
awk -F"[(),']" '/VALUES/ {for(i=1;i<=NF;i++){if($i ~ /^[0-9]+$/ && $(i+2) != "") print $(i+2)}}' your_sql_file.sql
解释:
-F"[(),']":将括号、逗号、单引号设为字段分隔符/VALUES/:仅处理包含VALUES关键字的行- 循环遍历所有字段,当遇到数字类型的第一个字段(通常是ID),则输出它后面第2个非空字段(即目标字符串)
如果第一个字段不是数字,可修改判断条件,比如匹配字符串类型的第一个值:
awk -F"[(),']" '/VALUES/ {for(i=1;i<=NF;i++){if($i != "" && $(i+2) != "") print $(i+2); i=i+4}}' your_sql_file.sql
方法3:结合grep和sed处理跨多行的VALUES
如果VALUES片段分布在多行,先锁定目标行范围再提取:
grep -A 20 -B 0 "VALUES" your_sql_file.sql | sed -E "s/.*\([^,]+,'([^']+)'.*/\1/g" | grep -v "^$"
解释:
grep -A 20 -B 0 "VALUES":提取包含VALUES的行及后续20行(根据实际行数调整-A的数值)- sed提取每个元组的第二个字符串,最后过滤空行
内容的提问来源于stack exchange,提问作者lukederbyshire
相关产品推荐
相关产品推荐

