You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Azure AI Search Text Split技能调试与文本拆分异常问题咨询

Azure AI Search Text Split技能问题排查方案

问题1:文本未按设置拆分

  • 检查字段映射是否正确:确保Text Split技能的输出(比如拆分后的pages数组)被映射到索引的新字段,而非直接使用原始的Content字段。例如,若技能输出为/document/pages,需在索引器的字段映射中添加路径/document/pages/*/content,将拆分后的文本片段存入索引的目标字段(如splitContent),而非沿用未处理的原始Content。
  • 确认参数配置有效性:
    • maximumPageLength按Unicode字符数计算(中文每个字、英文每个字母均算1个字符),而非词数。
    • 若文本无自然分隔符(如句子标点),需显式设置splitMode: "pages"强制按长度拆分,避免因无法拆分长句导致片段长度超标。
  • 验证技能上下文范围:确保Text Split技能的context设置为正确的文档路径(如/document),而非子节点,否则可能仅处理部分文本。

问题2:调试会话创建报错

报错Unexpected properties found on Skill. Parameters: Debug.Skillset的核心原因是Text Split技能配置中存在调试会话不兼容的额外属性,排查步骤:

  • 清理技能配置中的冗余参数:检查技能的JSON定义,确保仅包含官方允许的字段:@odata.type、name、description、context、inputs、outputs,删除任何自定义的Debug相关属性或其他非标准参数。
  • 参考正确的Text Split技能配置示例:
{
  "@odata.type": "#Microsoft.Skills.Text.SplitSkill",
  "name": "TextSplitSkill",
  "context": "/document",
  "inputs": [
    {
      "name": "text",
      "source": "/document/content"
    },
    {
      "name": "maximumPageLength",
      "source": "1000"
    },
    {
      "name": "pageOverlapLength",
      "source": "100"
    },
    {
      "name": "splitMode",
      "source": "pages"
    }
  ],
  "outputs": [
    {
      "name": "pages",
      "targetName": "pages"
    }
  ]
}
  • 确认调试会话配置未引用错误的技能集:确保调试会话关联的技能集是清理后的版本,无多余参数。

内容的提问来源于stack exchange,提问作者user823486

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.05 15:19:58