Skip to main content
context_search 后端对接火山引擎 Context Search 托管检索服务。文件通过预签名地址上传至 TOS(对象存储),再登记进 Context Search 的 RAG 场景,切分、向量化与检索均在服务端完成,因此无需本地 embedding。

何时使用

  • 需要托管的语义检索服务,免于自行维护向量库;
  • 已在火山引擎 Context Search 创建 RAG 场景与检索引擎。

前置条件

  • 已开通火山引擎账号并创建 Context Search 的 RAG 场景,其场景 ID 为纯数字字符串;
  • 已获取检索引擎的 Endpoint 与 API Key(检索时必需)。

使用示例

先设置下文 AK/SK、场景与检索引擎环境变量,并把示例中的数字替换为实际 RAG 场景 ID。上传需要场景数据写入权限,查询需要引擎 API Key;引擎应索引同一场景。数据会上传到远端并产生服务端处理
也可以通过 backend_config 显式传入凭证与检索引擎信息:

参数

KnowledgeBase 参数

构造参数

backend_config 支持以下配置项:

环境变量配置

向量化与检索均在 Context Search 服务端完成,本后端无需配置 embedding 模型。知识注入为异步过程,文件上传后需等待服务端完成索引才可检索。
index(场景 ID)必须为纯数字字符串,否则会报错;初始化成功不代表场景已验证;可先调用 kb.precheck_index_naming() 检查场景格式与访问权限。检索前必须配置 context_search_engine_endpoint 与 context_search_engine_apikey,否则 search 会报错。
CLOUD_PROVIDER=byteplus 调整默认区域与 API 主机,全局配置可将 BytePlus AK/SK 映射为后端读取的凭证。STS 令牌应通过 volcengine_session_token 或 VOLCENGINE_SESSION_TOKEN 显式提供;服务端点、凭证与场景必须属于同一环境。目录导入递归扫描所有文件,导入前排除不应上传的资料 示例检索结果应包含年假规则。若返回为空,先确认写入返回成功、模型维度一致及服务端处理完成,再检查网络与权限;托管后端不保证导入后立即可检索。绑定 Agent 后仍需完成模型配置才能运行问答
最后修改于 2026年9月19日