如何让qwen-audio-agent记住你:长期记忆与个性化机制全解析

发布时间:2026/10/1 8:46:11
如何让qwen-audio-agent记住你:长期记忆与个性化机制全解析 如何让qwen-audio-agent记住你长期记忆与个性化机制全解析【免费下载链接】qwen-audio-agentA realtime voice runtime that keeps Agents talking, working, and present. Real-time Voice Runtime for AI Agents项目地址: https://gitcode.com/gh_mirrors/qw/qwen-audio-agentqwen-audio-agent是一个实时语音 AI 助手运行时它不仅能听懂你说话还能通过长期记忆真正记住你——记住你的称呼、住址、偏好并在下次对话中自然调用。本文将带你完整搞懂它的记忆与个性化机制从一句记住我住在杭州开始到自动整理、偏好学习再到可替换的记忆 Provider新手也能一看就会。一句话让助手记住你最简单的用法就是直接开口说不需要写任何代码记住我现在住在杭州。你记住了我哪些信息把我的住址改成苏州。忘掉那条住址记录。助手内部会调用统一的memory工具完成读取、追加、精确替换三种原子操作。写入前会重新读取最新文档原文匹配不到时安全失败不会误改内容。这套逻辑可以在 server/src/memory/tools.mjs 中查看。记忆存在哪三个关键文件qwen-audio-agent 的记忆由三个 Markdown 文件承载全部保存在你的主机上无需部署数据库内容默认文件记什么助手默认画像config-dir/ASSISTANT.md助手的名称、人格、表达风格用户长期偏好data-dir/USER.md以后叫我船长、回答简洁点长期事实与决定data-dir/MEMORY.md我住在杭州、我们决定用方案B三者有清晰的优先级核心规则 → 用户当前明确要求 → 用户偏好 → 助手画像。对话中说以后回答短一点会写入你的USER.md而不会改动实例级的ASSISTANT.md本轮的临时要求这次简短一点则只在本轮生效。这套分工的设计文档见 docs/reference/personalization.zh.md。新建对话不会清空这些文件对话中修改立即生效。自动整理聊完自动补记手动说记住不是唯一路径。默认 Markdown Provider 支持会话后自动整理每次会话结束系统会用文本模型默认 DashScopeqwen-flash复用DASHSCOPE_API_KEY回顾刚才的对话把明确的交互偏好写入USER.md、稳定事实写入MEMORY.md。几个值得了解的细节没有可用的 API Key 时自动整理自动关闭但你明确要求的记忆操作不受影响它只学习新对话不会重复学习重连恢复的历史你手动改过记忆后过期的自动学习结果不会把旧内容写回来用QWEN_AUDIO_MEMORY_AUTOoff可以一键关闭。自动整理仍可能记错建议定期查看并纠正。处理过程的诊断信息会写入state-dir/memory-audit.jsonl方便事后排查。可选的偏好学习让助手观察出你的习惯这是最有意思也最克制的功能默认关闭。开启后设置QWEN_AUDIO_PREFERENCE_LEARNINGon助手会在每场会话结束时观察你的画像攒够跨会话确认才写进USER.md的观察推断段。它只观察四个字段取值空间刻意收窄字段说明occupation职业special_skills擅长的技术或领域最多 6 项response_length回答长短brief / normal / detailedresponse_style回答风格为什么写得这么谨慎因为推断和你说过的话风险不同。系统做了四道防护物理隔离推断内容写在观察推断段与你明说的用户明确要求段分开冲突时你的话恒优先你能一眼看出哪些是系统猜的直接删掉即可晋升门槛一条推断要满足确认次数 ≥ 2 且来自 ≥ 2 个不同会话才落盘90 天没有新确认自动归零四道结构性校验引用必须逐字来自你的发言、结论必须在引用里有落点、禁止复读、交互偏好引用必须指向助手行为——专挡编造证据和自我强化全程可审计每条被拒的观察都会记入memory-audit.jsonl你可以查到它为什么没被收下。实现细节可参考 server/src/memory/learning/preference-promoter.mjs 和机制文档 docs/reference/preference-learning.zh.md。会话回溯聊过的还能找回来默认关闭的另一个实用功能是会话摘要回溯开启QWEN_AUDIO_SESSION_DIGESTon后每次会话结束会生成话题摘要默认保留 90 天。开启后你可以直接问前几天我们聊过的那个项目是什么 注意它是有界的摘要检索不是完整录音或逐字记录已派发任务的最新进展以任务台账为准摘要只负责回顾聊过、做过什么。进阶替换记忆后端 VoiceMem如果 Markdown 文件不够用可以接入可选的 VoiceMem 记忆后端接管记忆、召回与会话学习设置QWEN_AUDIO_MEMORY_PROVIDERvoicemem再指定 Python 与 Sidecar 脚本路径即可支持text复用已有转写和audio按轮次截取用户音频交给 VoiceMem两种输入模式切换 Provider 不会自动迁移或删除旧记忆请先备份。面向二次开发者qwen-audio-agent 还暴露了版本化的MemoryProvider接口list提供有界快照、apply处理明确修改、query做语义召回、observe接收会话观察。声明了会话观察能力的 Provider 会自动停用内置整理器与偏好学习器同一段对话不会被两套系统重复学习。完整协议见 docs/reference/memory-provider.zh.md。隐私与数据安全最后说说边界。记忆文件保存在 Gateway 主机上但使用云端模型时相关画像、偏好和记忆会作为上下文发送给模型——本地保存不等于全程离线。系统也内置了护栏memory工具会直接拒绝保存密码、API Key、验证码、令牌等敏感内容客户端可以通过GET /api/memory与PATCH /api/memory查看和精确编辑同一份记忆写入带版本号过期修改返回 409 而不是覆盖并发内容。更多细节见 docs/reference/memory.zh.md。写在最后qwen-audio-agent 的记忆设计可以总结为一条主线你说的比猜的优先级高你能看到的和系统写入的是同一份数据。新手路径直接说记住……几分钟上手进阶路径开启自动整理让助手聊完自动补记深度路径开启偏好学习观察你的习惯或接入 VoiceMem 获得更强召回。所有记忆都是透明的 Markdown 文件随时可以打开查看、编辑或删除——这或许就是让 AI 记住你这件事最该有的样子。【免费下载链接】qwen-audio-agentA realtime voice runtime that keeps Agents talking, working, and present. Real-time Voice Runtime for AI Agents项目地址: https://gitcode.com/gh_mirrors/qw/qwen-audio-agent创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考