Azure AI Search Text Split技能调试与文本拆分异常问题咨询
Azure AI Search Text Split技能问题排查方案
问题1:文本未按设置拆分
- 检查字段映射是否正确:确保Text Split技能的输出(比如拆分后的
pages数组)被映射到索引的新字段,而非直接使用原始的Content字段。例如,若技能输出为/document/pages,需在索引器的字段映射中添加路径/document/pages/*/content,将拆分后的文本片段存入索引的目标字段(如splitContent),而非沿用未处理的原始Content。 - 确认参数配置有效性:
maximumPageLength按Unicode字符数计算(中文每个字、英文每个字母均算1个字符),而非词数。- 若文本无自然分隔符(如句子标点),需显式设置
splitMode: "pages"强制按长度拆分,避免因无法拆分长句导致片段长度超标。
- 验证技能上下文范围:确保Text Split技能的
context设置为正确的文档路径(如/document),而非子节点,否则可能仅处理部分文本。
问题2:调试会话创建报错
报错Unexpected properties found on Skill. Parameters: Debug.Skillset的核心原因是Text Split技能配置中存在调试会话不兼容的额外属性,排查步骤:
- 清理技能配置中的冗余参数:检查技能的JSON定义,确保仅包含官方允许的字段:
@odata.type、name、description、context、inputs、outputs,删除任何自定义的Debug相关属性或其他非标准参数。 - 参考正确的Text Split技能配置示例:
{ "@odata.type": "#Microsoft.Skills.Text.SplitSkill", "name": "TextSplitSkill", "context": "/document", "inputs": [ { "name": "text", "source": "/document/content" }, { "name": "maximumPageLength", "source": "1000" }, { "name": "pageOverlapLength", "source": "100" }, { "name": "splitMode", "source": "pages" } ], "outputs": [ { "name": "pages", "targetName": "pages" } ] }
- 确认调试会话配置未引用错误的技能集:确保调试会话关联的技能集是清理后的版本,无多余参数。
内容的提问来源于stack exchange,提问作者user823486
相关产品推荐
相关产品推荐

