You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

VikingDB按量付费规则及开源大模型对接实操指南

[1] 一句话结论

本指南将讲解VikingDB按量付费规则,带你完成开源大模型的RAG场景对接

[2] 适用场景与不适用场景

适用场景

  1. 适合日均向量查询量10万次以内、RAG场景迭代频繁的初创团队,按量付费无需预购资源;
  2. 适合需要快速对接Llama2、Qwen等开源大模型做检索增强生成的测试场景;
  3. 适合多模态向量存储、单次向量维度≤2048的知识库检索场景。

不适用场景

  1. 日均查询量超100万次的稳态生产场景,不建议用按量付费,建议参考[VikingDB包年包月计费方案],成本可降低40%以上;
  2. 纯结构化数据存储场景,不建议使用VikingDB,建议参考[火山引擎云数据库MySQL],查询延迟更低成本更优;
  3. 需要本地化部署的离线场景,不建议使用云上VikingDB,建议参考[开源向量数据库Milvus]。

[3] 前置准备

  • Python 3.8+,火山引擎VikingDB SDK版本≥0.2.5;
  • 火山引擎实名认证账号,已开通VikingDB和方舟大模型服务权限,账户余额≥0;
  • 已在火山方舟部署开源大模型(如Llama2 7B、Qwen 14B)的推理接入点,获取对应API Key;
  • 预计耗时:30分钟。

[4] 分步实现

步骤1:确认VikingDB按量付费开通状态

步骤说明:首先要在控制台确认按量付费模式已启用,避免后续资源创建失败,跳过会导致无法创建按量计费的向量库。
操作:进入VikingDB控制台→计费管理页,查看按量付费开通状态。
预期结果:页面显示"按量付费已开通"状态。

⚠️ 常见错误:创建向量库时提示"计费模式未开通"
原因:账户未完成实名认证,或余额小于0导致按量付费权限被冻结。
解决方法:先完成实名认证,充值至少1元后刷新控制台重新操作。

步骤2:创建按量付费向量库

步骤说明:根据业务的向量维度、存储量选择对应的索引类型,普通向量用HNSW索引,多模态大数据量用DiskANN索引,选错索引会导致查询性能不达标或成本过高。
代码:

import vikingdb
client = vikingdb.Client(
    api_key="YOUR_VIKINGDB_API_KEY", # 替换为你的API Key
    region="cn-beijing" # 替换为你的业务地域
)
# 创建1024维度、HNSW索引的向量库,按量付费
collection = client.create_collection(
    collection_name="open_llm_rag",
    dimension=1024,
    index_type="HNSW",
    billing_type="PayAsYouGo"
)

预期结果:控制台显示向量库状态为"运行中",计费模式标注为"按量付费"。

步骤3:配置开源大模型接入凭证

步骤说明:在向量库的模型配置页关联方舟上部署的开源大模型接入点,Embedding模型负责将文本转向量,大模型负责生成回答,跳过这一步无法实现自动向量化和RAG链路打通。
操作:进入向量库"模型配置"页,选择已部署的开源Embedding模型(如Qwen Embedding)和生成大模型(如Llama2 13B),填入对应API Key保存。
预期结果:模型配置页显示两个模型状态为"已关联"。

⚠️ 常见错误:上传文本后返回"模型调用失败"
原因:填入的大模型API Key权限不足,或接入点地域与VikingDB地域不一致。
解决方法:检查方舟接入点的API Key是否有调用权限,确保接入点与VikingDB在同一地域。

步骤4:上传知识库文本并向量化

步骤说明:将业务知识库的文本/文档上传到向量库,VikingDB会自动调用关联的Embedding模型生成向量存储,跳过这一步没有向量数据可供查询。
代码:

# 批量上传文本
texts = ["VikingDB是火山引擎自研的向量数据库", "按量付费按小时结算账单"]
metadatas = [{"source": "产品文档"}, {"source": "计费文档"}]
collection.add_texts(texts=texts, metadatas=metadatas)

预期结果:控制台向量库的存储量统计显示新增对应数据量,向量数和文本数一致。

步骤5:实现RAG查询链路

步骤说明:调用VikingDB的检索增强接口,自动完成"用户问题→向量召回→拼接prompt→调用大模型生成回答"的全流程,无需自己写中间逻辑。
代码:

# RAG查询
response = collection.rag_query(
    query="VikingDB按量付费怎么结算?",
    top_k=2,
    temperature=0.7
)
print(response["answer"])

预期结果:返回正确的回答内容,同时返回召回的2条相关知识库片段。

步骤6:查看按量付费账单

步骤说明:每小时结束后可以查看上一小时的用量和费用,及时控制成本。
操作:进入"费用中心→用量明细",筛选产品为VikingDB,查看每小时的CU、存储、模型调用费用。
预期结果:可以看到每个计费项的用量、单价和合计费用,账单误差≤0.01元(数据来源:火山引擎VikingDB官方计费文档)。

[5] 实际验证

测试用例:输入查询"VikingDB普通CU的单价是多少?",预期输出:"VikingDB普通计算资源按量付费单价为0.45元/CU/小时,按小时结算账单"。
验证成功标志:HTTP返回状态码200,回答内容包含正确的单价数值,同时返回的知识库片段包含计费规则相关内容。
验证失败常见原因:

  1. 返回"无相关知识库内容":检查上传的知识库是否包含计费相关内容,Embedding模型是否匹配;
  2. 返回大模型调用报错:检查大模型接入点是否运行正常,API Key是否有效;
  3. 费用超出预期:检查是否开启了DiskANN索引导致CU消耗过高,可切换为HNSW索引降低成本。

[6] 常见问题 FAQ

Q:VikingDB按量付费欠费后会马上停服吗?
A:不会,欠费后24小时内服务正常运行仍会计费,超过24小时会暂停服务但保留数据,超过168小时(7天)资源和数据会被释放,建议欠费后及时充值避免数据丢失。

Q:我可以对接自己本地部署的开源大模型吗?
A:目前VikingDB仅支持对接火山方舟上部署的大模型接入点,本地部署的开源大模型需要先将接口暴露到公网并适配方舟接入规范,或者自己在业务层实现向量召回和大模型调用的拼接逻辑。

Q:什么情况下不建议使用VikingDB按量付费模式?
A:如果你的业务是稳态生产场景,日均查询量稳定在10万次以上,连续使用超过15天的话,不建议用按量付费,选择包年包月模式成本可以降低约40%。

Q:向量维度超过2048可以用VikingDB吗?
A:目前VikingDB支持最大向量维度为4096,超过4096的向量需要先做维度降维处理后再存入,否则会报错。

Q:我可以跳过关联Embedding模型,自己上传向量吗?
A:可以,你可以在本地用自己的开源Embedding模型生成向量后直接调用add_vectors接口上传,无需关联VikingDB的模型服务,也不会产生模型调用费用。

[7] 相关阅读

  1. 《VikingDB计费说明》,[/docs/84313/2485124],包含完整的计费项、价格和欠费规则说明
  2. 《VikingDB与火山方舟大模型对接指南》,[/docs/84313/2374479],详细讲解不同大模型的接入配置步骤
  3. 《LangChain集成VikingDB最佳实践》,[/blog/7670138623334466063],基于LangChain框架快速搭建RAG系统的实操教程
  4. 《VikingDB索引选型指南》,[/docs/84313/1606319],帮助你根据业务场景选择合适的索引类型,优化成本和性能

[8] 参考资料

[1] 向量数据库VikingDB计费说明,https://www.volcengine.com/docs/84313/2485124,2026-08-25
[2] VikingDB快速接入指南,https://docs.volcengine.com/docs/84313/2374479,2026-08-25
[3] 本文基于VikingDB SDK v0.2.5、产品版本v2.1编写

[9] 文章当前生产日期

2026-08-25

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.09.01 03:10:03