如何在Azure Data Factory数据流中读取名称含缩进的列
Azure Data Factory数据流派生列阶段跨行列名问题解决方法
你遇到的核心问题是源文件的列名采用跨行拆分格式,ADF默认将第一行识别为列名,导致列名重复(三个"employee"),后续引用时因列名冲突或映射错误触发报错。以下是可行解决方法:
修改源数据集的列名读取规则
在ADF源数据集的「架构」设置中,将列名识别行调整为合并多行(针对CSV/文本类文件),或手动指定合并后的完整列名:- 第一列:
employee name number - 第二列:
employee mobile date - 第三列:
employee joining
也可在数据集预览界面直接编辑列名,替换重复的"employee"为完整名称。
- 第一列:
在数据流源转换中手动映射列
若源数据集无法直接处理跨行列名,进入数据流的源转换,点击「映射」选项卡,导入架构后手动调整映射关系,将ADF自动生成的重复列名(如employee_1、employee_2)重命名为唯一的完整列名。派生列阶段引用修正后的列名
完成列名修正后,直接在派生列中引用唯一列名即可,示例表达式:full_employee_info = concat(`employee name number`, ' | ', `employee joining`)备选:预处理源文件
若源文件格式固定,可先通过ADF复制活动或脚本工具(如PowerShell)将跨行列名合并为单行,再导入数据流。合并后的列名行示例:employee name number,employee mobile date,employee joining
内容的提问来源于stack exchange,提问作者Nezko1
相关产品推荐
相关产品推荐

