You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

使用Google Multimodal Live API时遭遇Resource_Exhausted错误

解决Gemini-2.0-flash-exp Multimodal Live API的RESOURCE_EXHAUSTED连接错误

作为Google AI推理产品新手,我尝试用Python 3.11.9调用基于gemini-2.0-flash-exp的Multimodal Live API,先实现简单文本生成功能,但首次建立WebSocket连接就触发以下错误:

ConnectionClosedError: received 1011 (internal error) Request trace id: 2f02bfds67892de45, [ORIGINAL ERROR] generic::resource_exhausted: RESOURCE_EXHAUSTED: Maximum concurrent se; then sent 1011 (internal error) Request trace id: 2f02bfds67892de45, [ORIGINAL ERROR] generic::resource_exhausted: RESOURCE_EXHAUSTED: Maximum concurrent se

已确认API密钥正确、环境变量配置无误,求可行的解决建议。

我的代码如下:

client = genai.Client()

MODEL = "gemini-2.0-flash-exp"

config={
    "generation_config": {"response_modalities": ["TEXT"]}}

async with client.aio.live.connect(model=MODEL, config=config) as session:
  message = "Hello? Gemini are you there?"
  print("> ", message, "\n")
  await session.send(message, end_of_turn=True)

  turn = session.receive()
  async for chunk in turn:
    if chunk.text is not None:
      print(f'- {chunk.text}')

解决建议

  • 核查并发会话配额:错误信息里的Maximum concurrent se(完整应为Maximum concurrent sessions)明确指向并发连接数超限。即使是首次连接,也可能是你的API密钥对应项目的Gemini Live API并发配额本身较低,或是该实验性模型的配额限制严格。去Google Cloud控制台的API配额页面,查看该API的并发会话配额是否已达上限。
  • 确认模型访问权限:gemini-2.0-flash-exp属于实验性模型,可能仅对特定白名单用户开放Live API访问权限。如果你的账号不在权限范围内,也会触发这类资源耗尽的错误提示。
  • 简化配置参数:尝试移除config中的response_modalities设置,用默认参数建立连接,避免不必要的配置导致服务侧异常可以改成config={}再测试。
  • 升级客户端库版本:确保使用的google-generativeai库是最新版,旧版本可能存在WebSocket连接的兼容性问题。执行pip install --upgrade google-generativeai升级后再重试。
  • 添加重试逻辑:如果是服务侧临时限流导致的错误,可以给连接代码加指数退避重试机制,比如用tenacity库实现,避免单次请求失败就终止。

内容的提问来源于stack exchange,提问作者Michael Pariaszevski

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.15 10:27:40