使用Postman API调用认知服务时Display Text为空问题求助
解决认知服务音视频转文本无法获取Display Text的问题
- 移除重复授权方式:你同时在请求头里设置了
Ocp-Apim-Subscription-Key和Bearer Token,这两种认证方式只需保留一种。建议删除其中一个请求头,避免认证冲突导致响应不完整。 - 确认API端点与版本:如果使用实时语音转文本API,确保端点为
https://<region>.stt.speech.microsoft.com/speech/recognition/conversation/cognitiveservices/v1(v3.1版本);如果是批量转录API,上传文件后仅返回转录任务ID,需单独发起GET请求查询任务结果,才能拿到DisplayText,无法直接从上传请求的响应中获取。 - 校验音频文件参数:即使是WAV格式,也要确保符合认知服务要求:采样率16kHz、16位深度、单声道(PCM编码)。可借助音频工具(如Audacity)检查并转换参数,不符合要求的音频可能导致识别结果缺失关键字段。
- 补充必要请求参数:在请求参数中添加
outputFormat=detailed,确保API返回包含DisplayText的完整响应结构;同时确认language参数设置正确(当前en-US没问题,但要保证音频内容确实为英语)。 - 检查响应解析方式:在Postman中查看完整JSON响应,确认
DisplayText是否存在于响应的某个层级下(比如实时转文本响应中,DisplayText是顶级字段;批量转录结果可能在results->transcripts->displayText路径下),不要仅看表面返回内容。
内容的提问来源于stack exchange,提问作者Krishna Rai
相关产品推荐
相关产品推荐

