app_name、user_id 和 session_id 共同标识;只有存储后端和这三个标识一致,后续运行才会继续已有会话
系统提示词由智能体配置提供,发送给模型的历史范围还受上下文压缩、过滤和智能体设置影响。持久化会话不等于每轮都将全部历史原样发送给模型
短期记忆基于 Google ADK 的 Session 机制,更多背景见 Google ADK Session。
统一入口:ShortTermMemory
无论使用哪种后端,均通过统一的veadk.memory.short_term_memory.ShortTermMemory 接入。它根据 backend(或 db_url)选择存储方式,并提供统一的会话管理能力。
参数
后端行为
所有后端提供相同的会话管理能力,区别在于数据保存位置和连接方式:local只在当前进程内保存会话;sqlite把会话写入本地文件;mysql与postgresql把会话写入外部数据库,适合多实例共享。
选择后端
与 Runner 协作
短期记忆通常传给Runner,由 Runner 自动创建或恢复会话。运行前完成模型配置,然后复用相同的应用、用户和会话标识以延续上下文
若既没给
Runner 传 short_term_memory 也没传 session_service,Runner 会自动创建一个 local(内存)短期记忆兜底。会话管理接口
你通常无需直接创建或管理Session,而是通过 session_service 管理整个会话生命周期:
- 启动新会话
create_session():用户发起交互时创建新的Session。 - 恢复已有会话
get_session():通过session_id检索特定Session,接续之前的进度。 - 保存进度
append_event():把新的交互(Event)追加到会话历史。 - 列出会话
list_sessions():查询某用户与应用下的活跃会话。 - 清理会话
delete_session():删除Session及其关联数据。
after_create_session_callback:
async def)。如果回调抛出异常,异常会传递给调用方,智能体不会继续执行。
所有后端下,
ShortTermMemory.create_session() 会先检查并复用同 app_name、user_id 和 session_id 的已有会话,避免重复创建。回调仅在首次创建时运行。上下文压缩
随着会话进行,历史会不断增长,导致模型处理的数据变多、响应变慢。上下文压缩用滑动窗口汇总历史:当会话历史超过设定阈值时,自动压缩较早的事件。配置上下文压缩
将下列App 配置交给支持它的 Google ADK Runner 或应用加载器后,会按调用间隔触发压缩。仅构建 App 不会执行压缩
自定义压缩器
用LlmEventSummarizer 指定压缩使用的模型和提示词模板。模型的 API Key 与 API Base 通过环境变量提供,这里从 os.environ 读取,不要硬编码:
{conversation_history},否则摘要请求不包含待压缩历史。上述 app 是应用配置,需要交给支持 App 的 Google ADK Runner 或应用加载器才能生效;仅创建配置不会执行对话或压缩。压缩涉及额外模型请求,摘要可能省略细节,不能作为原始会话的备份
after_load_memory_callback 必须是同步函数,可在查询未命中时收到 None,并应接受查询关键字参数。after_create_session_callback 仅覆盖通过 ShortTermMemory.create_session() 创建会话的路径;直接调用 session_service.create_session() 不触发此回调。回调失败不会自动删除已经创建的会话