You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

使用Postman API调用认知服务时Display Text为空问题求助

解决认知服务音视频转文本无法获取Display Text的问题
  • 移除重复授权方式:你同时在请求头里设置了Ocp-Apim-Subscription-Key和Bearer Token,这两种认证方式只需保留一种。建议删除其中一个请求头,避免认证冲突导致响应不完整。
  • 确认API端点与版本:如果使用实时语音转文本API,确保端点为https://<region>.stt.speech.microsoft.com/speech/recognition/conversation/cognitiveservices/v1(v3.1版本);如果是批量转录API,上传文件后仅返回转录任务ID,需单独发起GET请求查询任务结果,才能拿到DisplayText,无法直接从上传请求的响应中获取。
  • 校验音频文件参数:即使是WAV格式,也要确保符合认知服务要求:采样率16kHz、16位深度、单声道(PCM编码)。可借助音频工具(如Audacity)检查并转换参数,不符合要求的音频可能导致识别结果缺失关键字段。
  • 补充必要请求参数:在请求参数中添加outputFormat=detailed,确保API返回包含DisplayText的完整响应结构;同时确认language参数设置正确(当前en-US没问题,但要保证音频内容确实为英语)。
  • 检查响应解析方式:在Postman中查看完整JSON响应,确认DisplayText是否存在于响应的某个层级下(比如实时转文本响应中,DisplayText是顶级字段;批量转录结果可能在results->transcripts->displayText路径下),不要仅看表面返回内容。

内容的提问来源于stack exchange,提问作者Krishna Rai

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.24 10:53:09