You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

如何修复Confluence表格解析时换行内容无空格拼接问题

解决Confluence表格解析中换行内容无空格拼接的问题

你的问题出在get_text()默认会直接移除所有换行符和多余空白,导致多行内容直接拼接在一起。可以通过提取标签下的所有纯文本片段并手动用空格连接来解决:

修正后的代码:

x = confluence.get_page_by_id(p_id, expand="body.storage")

soup = BeautifulSoup(x["body"]["storage"]["value"], 'html.parser')

for row in soup.select("table tr"):
    # 提取每个td下的所有非空白文本片段,用空格连接
    data = [' '.join(cell.stripped_strings) for cell in row.select("td")]
    print(data)

关键改动说明

  • 使用stripped_strings替代直接调用get_text():这个方法会遍历单元格内所有文本节点,自动去除每个片段前后的空白字符(包括换行、制表符等)
  • 用' '.join()把这些文本片段用空格连接,确保原本换行分隔的内容变成空格分隔的格式

这样处理后,你就能得到期望的输出:['Karnataka','Bangalore','Bangalore Mysore Tumkur']

内容的提问来源于stack exchange,提问作者apurva

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.08.01 18:01:25