编写PowerShell脚本移除CSV文件中‘Enrolled User’列的唯一值
处理CSV文件保留重复用户记录的PowerShell方案
没问题,我来帮你搞定这个需求!核心思路就是先统计Enrolled User列每个值的出现次数,然后只保留那些出现次数≥2的记录。下面是具体的脚本和细节说明:
完整PowerShell脚本
# 替换为你的CSV文件路径 $inputCsvPath = "C:\path\to\your\input.csv" # 替换为你想要输出的新CSV文件路径 $outputCsvPath = "C:\path\to\your\output.csv" # 导入CSV,分组统计,筛选重复记录,导出结果 Import-Csv -Path $inputCsvPath | Group-Object -Property 'Enrolled User' | Where-Object { $_.Count -gt 1 } | Select-Object -ExpandProperty Group | Export-Csv -Path $outputCsvPath -NoTypeInformation -Encoding UTF8
脚本细节解释
Import-Csv:把CSV文件加载成PowerShell对象集合,每一行对应一个对象,列名就是对象的属性。Group-Object -Property 'Enrolled User':按照Enrolled User列的值分组,每个分组会包含该用户的所有记录,同时自带Count属性记录出现次数。Where-Object { $_.Count -gt 1 }:过滤掉那些只出现一次的分组,只保留重复出现的用户组。Select-Object -ExpandProperty Group:把每个分组里的记录展开,变回原来的行对象集合。Export-Csv:把处理后的结果导出到新的CSV文件,-NoTypeInformation避免PowerShell添加多余的类型信息行,-Encoding UTF8确保导出的文件编码正确,避免乱码。
注意事项
- 请确保替换脚本中的
$inputCsvPath和$outputCsvPath为实际的文件路径,路径里有空格的话要用引号括起来。 - 如果你的CSV文件使用了非默认的分隔符(比如分号
;),可以在Import-Csv里加上-Delimiter ';'参数。 - 建议先备份原CSV文件,避免处理过程中意外丢失数据。
- 如果
Enrolled User列存在大小写差异(比如JohnDoe和johndoe),而你希望把它们视为同一个用户,可以用下面的适配脚本:
$inputCsvPath = "C:\path\to\your\input.csv" $outputCsvPath = "C:\path\to\your\output.csv" # 处理大小写不敏感的重复判断 $records = Import-Csv -Path $inputCsvPath $userGroups = $records | Group-Object -Property { $_.['Enrolled User'].ToLower() } | Where-Object { $_.Count -gt 1 } # 收集符合条件的原始记录 $filteredRecords = $userGroups | ForEach-Object { $lowerUsername = $_.Name $records | Where-Object { $_.['Enrolled User'].ToLower() -eq $lowerUsername } } $filteredRecords | Export-Csv -Path $outputCsvPath -NoTypeInformation -Encoding UTF8
内容的提问来源于stack exchange,提问作者Arnaud Pain
相关产品推荐
相关产品推荐

