关于在Azure Data Flow数据集中添加动态内容以读取特定模式CSV文件的问询
实现仅读取特定模式文件的方法
当然可以!完全可以通过在分隔文本数据集里配置通配符模式来实现只读取predicted_file_*.csv这类文件的需求,不需要额外的数据流转换步骤。具体操作步骤如下:
- 打开你的分隔文本数据集编辑界面,切换到连接选项卡。
- 确认你的基础文件夹路径已经指向
folder2(示例格式:你的存储账户名/容器名/folder2)。 - 找到文件名设置项(默认通常为“所有文件”),点击旁边的添加动态内容按钮(小闪电图标)。
- 在动态内容编辑器中,直接输入通配符表达式:
predicted_file_*.csv,完成后保存数据集配置。 - 另一种快捷方式是直接将匹配模式追加到文件夹路径后,写成
你的存储账户名/容器名/folder2/predicted_file_*.csv,数据集会自动识别并加载符合该模式的所有文件。
验证配置是否生效
完成配置后,点击数据集的预览数据按钮,即可确认是否仅加载了predicted_file_1.csv、predicted_file_2.csv、predicted_file_99.csv这三个目标文件。
更灵活的参数化方案(可选)
如果后续需要频繁修改文件匹配规则,可以通过数据集参数实现:
- 在数据集的参数选项卡中,创建一个字符串类型的参数(比如命名为
fileNamePattern),默认值设置为predicted_file_*.csv。 - 返回连接选项卡,在文件名字段中引用该参数,写法为:
@dataset().fileNamePattern。后续只需修改参数值,就能快速切换文件匹配模式。
内容的提问来源于stack exchange,提问作者Obiii
相关产品推荐
相关产品推荐

