使用Google Multimodal Live API时遭遇Resource_Exhausted错误
解决Gemini-2.0-flash-exp Multimodal Live API的RESOURCE_EXHAUSTED连接错误
作为Google AI推理产品新手,我尝试用Python 3.11.9调用基于gemini-2.0-flash-exp的Multimodal Live API,先实现简单文本生成功能,但首次建立WebSocket连接就触发以下错误:
ConnectionClosedError: received 1011 (internal error) Request trace id: 2f02bfds67892de45, [ORIGINAL ERROR] generic::resource_exhausted: RESOURCE_EXHAUSTED: Maximum concurrent se; then sent 1011 (internal error) Request trace id: 2f02bfds67892de45, [ORIGINAL ERROR] generic::resource_exhausted: RESOURCE_EXHAUSTED: Maximum concurrent se
已确认API密钥正确、环境变量配置无误,求可行的解决建议。
我的代码如下:
client = genai.Client() MODEL = "gemini-2.0-flash-exp" config={ "generation_config": {"response_modalities": ["TEXT"]}} async with client.aio.live.connect(model=MODEL, config=config) as session: message = "Hello? Gemini are you there?" print("> ", message, "\n") await session.send(message, end_of_turn=True) turn = session.receive() async for chunk in turn: if chunk.text is not None: print(f'- {chunk.text}')
解决建议
- 核查并发会话配额:错误信息里的
Maximum concurrent se(完整应为Maximum concurrent sessions)明确指向并发连接数超限。即使是首次连接,也可能是你的API密钥对应项目的Gemini Live API并发配额本身较低,或是该实验性模型的配额限制严格。去Google Cloud控制台的API配额页面,查看该API的并发会话配额是否已达上限。 - 确认模型访问权限:
gemini-2.0-flash-exp属于实验性模型,可能仅对特定白名单用户开放Live API访问权限。如果你的账号不在权限范围内,也会触发这类资源耗尽的错误提示。 - 简化配置参数:尝试移除
config中的response_modalities设置,用默认参数建立连接,避免不必要的配置导致服务侧异常可以改成config={}再测试。 - 升级客户端库版本:确保使用的
google-generativeai库是最新版,旧版本可能存在WebSocket连接的兼容性问题。执行pip install --upgrade google-generativeai升级后再重试。 - 添加重试逻辑:如果是服务侧临时限流导致的错误,可以给连接代码加指数退避重试机制,比如用
tenacity库实现,避免单次请求失败就终止。
内容的提问来源于stack exchange,提问作者Michael Pariaszevski
相关产品推荐
相关产品推荐

