You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

编写递归函数按指定统计条件过滤树结构节点文档中的单词

嘿,我来帮你把这个树状节点文档的单词筛选逻辑整理得明明白白,用标准Markdown格式呈现:

树状节点文档单词筛选方案

核心筛选规则

我们只保留每个节点中满足以下任一条件的单词:

  • 条件1:在本节点占多数文档出现,且在其他节点(尤其是兄弟节点)仅占少数文档出现的单词
  • 条件2:在本节点60%及以上文档中出现,同时在其兄弟节点不足40%文档中出现的单词

示例场景拆解

拿你提到的例子来说:父节点A下有子节点B、C,各自附带5份文档。比如B的文档列表是:

[['a','b','c','d','m'],['b','d','m','n'],['c','d','e','m'],['a','d','f','m'],['b','d','g','m']]

假设我们完成统计后:

  • 单词m在B的5份文档里全出现了(占100%),而在C节点的5份文档里仅1份有它(占20%),完美符合条件2,所以m会被保留
  • 单词b在B节点的3份文档中出现(刚好60%),在C节点的文档里仅1份出现(20%),也满足条件2,同样会被保留
  • 如果有个单词x,在B节点的3份及以上文档里出现(占多数),但在C节点的2份及以下文档里才出现(占少数),那它符合条件1,也会被留下

实操步骤梳理

要完成这个筛选,你可以按下面的步骤来:

  1. 逐个节点统计:对每个节点,计算每个单词在该节点文档中的出现文档占比,同时统计该单词在所有兄弟节点中的单个节点出现文档占比
  2. 条件匹配校验:给每个单词逐一核对两个筛选条件,满足其中任意一个就留下
  3. 输出结果:整理每个节点最终保留的单词列表

内容的提问来源于stack exchange,提问作者Ankita Patnaik

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.27 03:50:23