You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在ADF中按文件名将Data Lake Gen2文件分流至多文件夹

在ADF中按文件名分流Data Lake Gen2文件的解决方案

不用IF/Switch条件,推荐用Get Metadata + For Each + 动态表达式的组合方案,能高效处理任意数量的文件分流,步骤如下:

1. 获取源文件夹的文件列表

  • 添加Get Metadata活动,数据源配置为Data Lake Gen2的目标源文件夹。
  • 在活动的"字段"选项中勾选Child Items,获取该文件夹下所有文件的详细信息(包括文件名、大小等)。

2. 遍历每个文件

  • 添加For Each活动,将迭代项设置为:
    @activity('Get Metadata').output.childItems
    
  • 根据需求选择是否勾选Sequential(无需顺序处理时可保持并行以提升效率)。

3. 循环内配置Copy Activity实现分流

在For Each活动内部添加Copy Activity,分别配置源和目标:

源数据集配置

  • 数据源选择Data Lake Gen2,文件路径使用动态内容指定当前遍历的文件:
    @item().name
    

目标数据集配置

  • 数据源同样选择Data Lake Gen2,文件夹路径使用动态表达式根据文件名生成目标文件夹,常见规则示例:
    • 按文件名前缀(取前5个字符)创建文件夹:
      @substring(item().name, 0, 5)
      
    • 按文件名中的分隔符(如下划线)拆分出分类作为文件夹名:
      @split(item().name, '_')[0]
      
    • 用文件名(不含扩展名)作为文件夹名:
      @split(item().name, '.')[0]
      
  • 目标文件名保持与源文件一致,设置为:
    @item().name
    

方案优势

相比IF/Switch条件分支,该方案无需为每个文件名规则单独写判断逻辑,能自动适配新增的文件,维护成本低,且支持批量处理大量文件,效率更高。

内容的提问来源于stack exchange,提问作者Raja Pandi G R

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.20 19:37:06