You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Azure OpenAI API中文内容过滤过严问题求助

Azure OpenAI API中文内容过滤误判问题及解决方案

问题概述

使用Azure OpenAI API时,所有正常中文业务语句均被内容过滤拦截(判定为sexual类别违规),但相同语义的英文语句可正常通过,导致基础业务操作无法开展。

测试代码

msg = [
     {'content': '我叫李梅,要1个鼠标,请送去205室','role': 'user'},
     {'content': '我叫李梅,要1个键盘,请送去205室','role': 'user'},
     {'content': '我叫李梅,要1个,请送去205室','role': 'user'},
     {'content': '我叫李梅,要1个','role': 'user'},
     {'content': '要1个鼠标','role': 'user'},
     {'content': 'my name is li mei,i need one mouse,pls deliver to room 205','role': 'user'}
]

for m in msg:
    try:
        print(m)
        res = response = openai.ChatCompletion.create(
            model="gpt-35-turbo-16k",
            messages=[m]
        )
        #print(res)
        print('\n内容通过!')
    except InvalidRequestError as e:
        if e.error.code == "content_filter" and e.error.innererror:
            content_filter_result = e.error.innererror.content_filter_result
            # or access the individual categories and details
            print('\n内容不通过!')
            for category, details in content_filter_result.items():
                print(f"{category}:\n filtered={details['filtered']}\n severity={details['severity']}")
            continue

测试结果

{'content': '我叫李梅,要1个鼠标,请送去205室', 'role': 'user'}

内容不通过!
hate:
 filtered=False
 severity=safe
self_harm:
 filtered=False
 severity=safe
sexual:
 filtered=True
 severity=high
violence:
 filtered=False
 severity=safe
{'content': '我叫李梅,要1个键盘,请送去205室', 'role': 'user'}

内容不通过!
hate:
 filtered=False
 severity=safe
self_harm:
 filtered=False
 severity=safe
sexual:
 filtered=True
 severity=medium
violence:
 filtered=False
 severity=safe
{'content': '我叫李梅,要1个,请送去205室', 'role': 'user'}

内容不通过!
hate:
 filtered=False
 severity=safe
self_harm:
 filtered=False
 severity=safe
sexual:
 filtered=True
 severity=high
violence:
 filtered=False
 severity=safe
{'content': '我叫李梅,要1个', 'role': 'user'}

内容不通过!
hate:
 filtered=False
 severity=safe
self_harm:
 filtered=False
 severity=safe
sexual:
 filtered=True
 severity=medium
violence:
 filtered=False
 severity=safe
{'content': '要1个鼠标', 'role': 'user'}

内容不通过!
hate:
 filtered=False
 severity=safe
self_harm:
 filtered=False
 severity=safe
sexual:
 filtered=True
 severity=medium
violence:
 filtered=False
 severity=safe
{'content': 'my name is li mei,i need one mouse,pls deliver to room 205', 'role': 'user'}

内容通过!

可行解决方案

  • 调整内容过滤策略:在Azure OpenAI资源的内容安全设置中,针对中文场景降低sexual类别的过滤阈值,或自定义允许的内容规则,平衡安全合规与业务需求。
  • 提交误判反馈:通过Azure门户支持渠道提交内容过滤误判案例,附带测试语句和结果,请求官方优化中文内容识别模型。
  • 切换模型版本:测试不同版本的GPT-3.5 Turbo模型(如基础版gpt-35-turbo),新版本可能已修复中文过滤的误判问题。
  • 内容预处理:对中文语句做轻微调整,比如将“要1个”改为“要一个”,避免触发敏感词识别的误判逻辑。
  • 独立预检测:先用Azure Content Safety API对内容进行预检测,针对误判内容手动放行后,再传入OpenAI API处理。

内容的提问来源于stack exchange,提问作者bumcatxian

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.07.07 01:11:33