在LangSmith追踪运行中能否获取OpenAI音频及TTS模型的令牌与成本信息?
LangSmith中OpenAI Audio/TTS模型的Token与成本追踪问题
目前LangSmith默认不支持自动追踪OpenAI Audio(如Whisper)和TTS模型的Token用量及成本信息,这和你遇到的情况一致——仅会记录调用轨迹,但不会展示这类模型的token与成本详情。
原因
这类音频模型的计费逻辑和ChatCompletion系列文本模型差异很大:
- Whisper是按音频时长计费,而非文本token数
- TTS则按生成语音对应的字符数(或专属令牌)、语音类型等维度计费
LangSmith当前的内置成本追踪模块主要适配了文本生成类模型的规则,暂时没有针对音频类模型做兼容。
可行的手动解决方案
自行计算并上报自定义数据:
- 调用OpenAI音频API后,从响应或请求参数中提取关键计费维度(比如Whisper的音频时长、TTS的输入字符数)
- 结合OpenAI官方定价计算成本,若需要统计token(如TTS的专属令牌),可通过OpenAI提供的工具自行转换计算
- 在LangSmith的追踪流程中,通过自定义元数据(
metadata)或者自定义指标(custom metrics)将这些信息手动上报,比如在链的步骤中添加记录逻辑
等待官方功能更新:LangSmith的功能一直在迭代,后续大概率会新增对音频类模型的成本与token追踪支持,可留意官方的更新动态。
内容的提问来源于stack exchange,提问作者Talal Khan
相关产品推荐
相关产品推荐

