config.yaml 设置的模型(参见快速开始)。也可以在创建智能体时为其单独指定模型。
在火山引擎环境中,1.0.1 的默认模型为 doubao-seed-1-8-251228,provider 为 openai,接口地址为 https://ark.cn-beijing.volces.com/api/v3/。当 CLOUD_PROVIDER=byteplus 时,默认模型为 seed-1-6-250915,接口地址为 https://ark.ap-southeast.bytepluses.com/api/v3。
为单个智能体指定模型
通过model_name 与 model_provider 覆盖全局默认模型:
model_provider、model_api_base、model_api_key 均沿用全局配置。
配置回退模型
model_name 也接受一个列表:第一个为主模型,其余作为回退模型;当主模型不可用时,依次尝试后续模型。
VeADK 1.0.1 的回退模型仅适用于默认模型接口。启用 Responses API 时,
model_name 必须传入单个字符串。Responses API
Responses API 是火山方舟推出的接口,原生支持高效的上下文管理,输入输出格式更简洁,并具备更强的工具调用与多模态能力。在 VeADK 中启用后,智能体的每一轮对话都会经由该接口,从而获得原生的上下文缓存与图片、视频、文档理解能力。启用
在创建智能体时设置enable_responses=True:
google-adk>=1.21.0,且所用模型需支持该接口(豆包系列 0615 版本之后默认支持)。
多模态理解
除文本外,Responses API 还支持图片、视频与文档理解。通过google.genai.types.FileData 传入多模态数据,file_uri 支持三种来源:
- 本地文件路径:
file://{本地路径},底层自动经 Files API 上传。 - Files API 资源:
file_id://{file_id},用于已上传的文件。 - 网络地址:直接传入
https://链接,按mime_type识别类型。
FileData 中附带 video_metadata,用 fps 控制抽帧频率(默认 1,可在 0.2–5 之间调整)。
上下文缓存
Responses API 模式下默认开启会话缓存:系统自动存储初始上下文,并在每轮对话中动态更新,后续请求会将缓存内容与新输入合并后再送入模型。这对多轮对话、复杂工具调用等长上下文场景可显著降低重复 token 的开销。 缓存命中情况可通过返回事件的usage_metadata 查看,其中 cached_content_token_count 为命中缓存的 token 数,prompt_token_count 为输入总 token 数,缓存命中率即两者之比。