You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何在PowerShell中移除从Excel复制的HTML格式文本元数据?

解决Excel复制HTML包含冗余元数据的问题

从Excel复制数据后,剪贴板中的HTML格式会自带Version、StartHTML、EndHTML等冗余元数据,直接通过Get-Clipboard获取无法自动剔除这些内容。你可以通过正则提取有效片段来解决:

# 获取剪贴板中的原始HTML内容
$rawHtml = Get-Clipboard -TextFormatType Html

# 正则匹配并提取StartFragment与EndFragment之间的有效HTML部分
$cleanHtml = [regex]::Match($rawHtml, '(?s)(?<=StartFragment:\d+\s)(.*?)(?=\sEndFragment:)').Value.Trim()

# 输出清理后的纯HTML
$cleanHtml

说明:

  • (?s) 让正则表达式中的.匹配换行符,确保跨多行提取内容
  • 正则表达式精准定位StartFragment:数字之后、EndFragment:之前的内容,直接剥离冗余的元数据头部
  • Trim() 移除提取内容前后的空白字符,保证HTML格式整洁

内容的提问来源于stack exchange,提问作者Kasi Raman

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.26 01:12:02