如何在Watson Knowledge Studio中停用句子边界检测?
解决Watson Knowledge Studio中简历分句失效的问题
我正好对Watson Knowledge Studio的文档处理配置很熟悉,针对你遇到的简历标点少导致自动分句失效、自己已有分句模型却无法停用默认检测的问题,给你几个靠谱的解决方案:
修改项目级文档处理设置
进入你的WKS项目后,点击顶部的「Settings」(设置)选项卡,找到「Document processing」(文档处理)板块。在这里你能找到「Sentence boundary detection」(句子边界检测)的勾选框,直接取消勾选即可。这个设置会作用于整个项目,之后上传的所有文档都不会再触发自动分句,完全使用你自己定义的句子边界。用自定义标记明确句子边界
如果你不想全局关闭,或者需要更精准地指定分句位置,可以在你自己模型预测的分句处插入WKS识别的句子标记:用<s>作为每个句子的开头,</s>作为结尾。比如简历里的「张三 软件工程师 5年经验」如果是一个完整句子,就标记成<s>张三 软件工程师 5年经验</s>。上传文档时,WKS会优先识别这些标记来划分句子,不会再自动添加错误的分句。编辑自定义处理流水线
要是你的项目用了自定义文档处理流水线,你可以直接移除分句步骤:进入项目的「Pipeline」(流水线)设置页面,找到当前使用的流水线,删除其中的「Sentence boundary detection」组件,保存修改后再上传文档,自动分句就不会运行了。
注意事项
- 修改设置后,之前已经上传的文档可能需要重新处理才能应用新的分句规则;
- 确保你有项目的编辑权限,不然可能无法修改这些配置;
- 用标记的时候要避免和简历本身的内容重复,比如如果简历里有类似
<s>的字符,记得调整或者转义。
内容的提问来源于stack exchange,提问作者matrop
相关产品推荐
相关产品推荐

