如何在Azure Data Factory(ADF)中将第2行设为表头并跳过第3、4行导入CSV数据
在Azure Data Factory中实现CSV导入SQL:指定第2行为表头并跳过第3、4行
核心配置步骤
配置CSV数据集
打开你的CSV数据集,进入「连接」标签页,在「文件格式设置」区域:- 将「表头行」设置为
2(ADF行号从1开始计数,对应样本文件的第2行) - 确认文件分隔符、编码等参数与实际CSV文件匹配,避免表头解析错误
- 将「表头行」设置为
复制活动源端设置跳过行
进入复制活动的「源」标签页,选择已配置的CSV数据集后展开「高级」设置:- 将「跳过行计数」设置为
2
逻辑说明:表头占用第2行,ADF默认从第3行开始读取数据,设置跳过2行后,将直接从第5行开始加载有效数据,正好跳过不需要的第3、4行
- 将「跳过行计数」设置为
验证字段映射
切换到复制活动的「映射」标签页,确认CSV表头(第2行字段)与SQL目标表的字段已正确匹配,如有差异可手动调整映射关系测试与验证
触发流水线运行,检查SQL目标表中的数据是否符合预期输出,确认第3、4行数据未被导入,表头与目标表字段一致
额外注意事项
- 如果CSV文件存在动态行数的情况(而非固定跳过第3、4行),可配合「筛选行」活动,使用表达式
@greater(rowIndex(),4)过滤掉前4行(含表头)之后再进行复制 - 若遇到表头解析异常,可先在数据集预览功能中确认表头是否正确识别,再调整配置参数
内容的提问来源于stack exchange,提问作者APRIL
相关产品推荐
相关产品推荐

