You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

求助:如何通过Python-docx提取Word中ContentControl的文本?

如何用python-docx获取ContentControl内的文本

嘿,我之前也踩过这个坑!Python-docx默认的段落text属性确实没法直接读取ContentControl里的内容,因为这些控件是文档里的特殊元素,不属于普通段落文本的范畴,直接打印段落自然会报错。

别担心,咱们直接操作ContentControl对象就行,方法很简单:

  • 首先,你可以通过document.content_controls获取文档里所有的ContentControl集合
  • 每个ContentControl对象都有一个text属性,直接调用就能拿到里面的文本内容

给你个示例代码:

from docx import Document

# 加载你的docx文档
doc = Document("你的文档路径.docx")

# 遍历所有ContentControl并输出文本
for content_control in doc.content_controls:
    print(f"控件内文本:{content_control.text}")

如果需要定位到某个特定的ContentControl,还可以通过它的title(标题)或者tag(标签)来精准查找,比如:

# 根据标题查找目标控件
target_cc = next(cc for cc in doc.content_controls if cc.title == "你要找的控件标题")
print(target_cc.text)

# 或者根据标签查找
target_cc = next(cc for cc in doc.content_controls if cc.tag == "你的控件标签")
print(target_cc.text)

这样就能轻松拿到你需要的文本啦,再也不用纠结段落报错的问题~

内容的提问来源于stack exchange,提问作者You Yangyang

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.20 07:54:20