You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

Swift SDK调用Gemini API处理音频时遭遇500内部错误排查

问题分析与解决

Gemini是否支持音频功能

Gemini 1.5 Flash完全支持音频输入,功能层面不存在限制。

可能的问题点及解决方法

  • MIME类型错误:你使用的"m4a"不是标准MIME类型,正确的M4A音频格式MIME类型应为"audio/m4a"。API无法识别错误的MIME类型会触发内部错误。
  • 音频数据超限:检查音频文件的时长或大小是否超出Gemini 1.5 Flash的输入限制(单音频最长支持约1小时)。
  • SDK版本过旧:确保GoogleGenerativeAI Swift SDK为最新版本,旧版本可能存在音频处理的兼容性bug。
  • 文件读取异常:确认fileUrl指向的文件存在且未损坏,避免读取到无效的音频数据。

修正后的代码示例

let fileData = try Data(contentsOf: fileUrl)
let model = GenerativeModel(name: "gemini-1.5-flash", apiKey: apiKey)
let response = try await model.generateContent([
    ModelContent.Part.data(mimetype: "audio/m4a", fileData),
    ModelContent.Part.text("Say something")
])
let text = response.text ?? "no response"
print(text)

内容的提问来源于stack exchange,提问作者someone

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.19 12:17:09