如何在Azure Data Factory中处理自定义分隔符文本文件并导入Azure SQL
ADF 处理自定义^分隔符文本文件的正确配置方案
核心配置修正
针对你预览无数据的问题,优先检查源数据集的以下配置项:
- 列分隔符选择「自定义」选项,直接输入
^即可,不要额外添加引号、转义字符或前后空格,ADF 对单字符自定义分隔符无需额外转义处理 - 行分隔符保持默认「自动检测」即可,若你的文件有特殊行尾标记再手动指定对应值
- 匹配「首行作为标题」选项与源文件实际结构:若源文件第一行是字段名则勾选,否则取消勾选,勾选不符合实际会导致首行被过滤、甚至识别为空
- 编码格式必须与源txt文件完全一致:默认配置为UTF-8,若你的文件为GBK、UTF-16等编码,需手动切换到对应编码,编码不匹配是读取无数据的高频原因
- 若源文件没有特殊转义、引号包裹规则,「转义字符」「引号字符」两项均选择「无」,错误配置这两项会导致分隔符识别失效
无数据问题排查
按上述规则修正配置后如果仍预览为空,按以下顺序排查:
- 确认源文件大小不为0,且你配置的集成运行时对源存储路径有可读权限
- 检查源文件是否存在不可见前置字符(如UTF-8 BOM头),如果有则编码选择「UTF-8」而非「UTF-8 without BOM」
- 跳过数据集预览,直接在复制活动的源配置页点击「预览数据」,部分数据集缓存问题会导致数据集页面预览异常
完整导入配置
源配置验证正常后,目标选择对应Azure SQL Server数据集,在复制活动的「映射」标签页点击「导入架构」,系统会自动匹配源文件列与SQL表列,若字段名不一致手动调整映射关系后,运行调试即可完成导入。
内容的提问来源于stack exchange,提问作者trx
相关产品推荐
相关产品推荐

