You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

调用HuggingFaceLLM遇TypeError:hf_token参数不被支持

解决HuggingFaceLLM初始化时hf_token参数报错问题

报错原因很明确:HuggingFaceLLM的初始化方法不接受hf_token这个参数,需要把HF认证token传递给底层的模型加载逻辑,以下是两种可行的解决方法:

方法一:将token放入model_kwargs中

把hf_token的值以token键的形式加入model_kwargs字典,这个字典会被传递给transformers库的模型加载方法,那里支持token参数用于认证:

LLM = HuggingFaceLLM(
    context_window=4096,
    max_new_tokens=256,
    generate_kwargs={"temperature": 0.0, "do_sample": False},
    system_prompt=system_prompt,
    query_wrapper_prompt=query_wrapper_prompt,
    tokenizer_name="meta-llama/Llama-2-7b-chat-hf",
    model_name="meta-llama/Llama-2-7b-chat-hf",
    device_map="auto",
    model_kwargs={
        "torch_dtype": torch.float16, 
        "load_in_8bit": True,
        "token": os.getenv("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")
    }
)

方法二:提前完成Hugging Face登录认证

在初始化HuggingFaceLLM之前,调用huggingface_hub的login方法完成认证,后续加载模型时会自动使用已认证的token:

from huggingface_hub import login

# 完成登录认证
login(token=os.getenv("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"))

LLM = HuggingFaceLLM(
    context_window=4096,
    max_new_tokens=256,
    generate_kwargs={"temperature": 0.0, "do_sample": False},
    system_prompt=system_prompt,
    query_wrapper_prompt=query_wrapper_prompt,
    tokenizer_name="meta-llama/Llama-2-7b-chat-hf",
    model_name="meta-llama/Llama-2-7b-chat-hf",
    device_map="auto",
    model_kwargs={"torch_dtype": torch.float16 , "load_in_8bit":True}
)

内容的提问来源于stack exchange,提问作者Rithika Ashok

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.06.23 00:05:56