context_search 后端对接火山引擎 Context Search 托管检索服务。文件通过预签名地址上传至 TOS(对象存储),再登记进 Context Search 的 RAG 场景,切分、向量化与检索均在服务端完成,因此无需本地 embedding。
何时使用
- 需要托管的语义检索服务,免于自行维护向量库;
- 已在火山引擎 Context Search 创建 RAG 场景与检索引擎。
前置条件
- 已开通火山引擎账号并创建 Context Search 的 RAG 场景,其场景 ID 为纯数字字符串;
- 已获取检索引擎的 Endpoint 与 API Key(检索时必需)。
使用示例
先设置下文 AK/SK、场景与检索引擎环境变量,并把示例中的数字替换为实际 RAG 场景 ID。上传需要场景数据写入权限,查询需要引擎 API Key;引擎应索引同一场景。数据会上传到远端并产生服务端处理backend_config 显式传入凭证与检索引擎信息:
参数
KnowledgeBase 参数
构造参数
backend_config 支持以下配置项:
环境变量配置
向量化与检索均在 Context Search 服务端完成,本后端无需配置 embedding 模型。知识注入为异步过程,文件上传后需等待服务端完成索引才可检索。
CLOUD_PROVIDER=byteplus 调整默认区域与 API 主机,全局配置可将 BytePlus AK/SK 映射为后端读取的凭证。STS 令牌应通过 volcengine_session_token 或 VOLCENGINE_SESSION_TOKEN 显式提供;服务端点、凭证与场景必须属于同一环境。目录导入递归扫描所有文件,导入前排除不应上传的资料
示例检索结果应包含年假规则。若返回为空,先确认写入返回成功、模型维度一致及服务端处理完成,再检查网络与权限;托管后端不保证导入后立即可检索。绑定 Agent 后仍需完成模型配置才能运行问答