AI 智能体应该活多久?
英文标题:How Long Should an AI Agent Live?
设计 AI 智能体时,最佳架构是每天重置的协调器,它把任务委派给临时专家,并将状态保存到本地文件中。
为什么值得关注
随着 AI 智能体越来越多地参与我们的工作和生活,它们的生命周期设计直接影响效率、安全性和用户体验。如果智能体记忆无限增长,可能会遗忘重要规则或积累错误信息;如果权限长期有效,可能被恶意利用。理解如何设计智能体的生命周期,有助于我们构建更可靠、更安全的 AI 助手。
核心要点
- 永久会话会遭受上下文腐化和安全风险。
- 临时指令可能变成永久的幽灵,影响智能体行为。
- 最佳架构是每天重置的协调器,委派任务给临时专家。
- 系统提示词可以定义智能体的生命周期和工作流程。
- 离线整合过程保存持久偏好,丢弃日常对话。
简单来说:在设计一个智能体时,它的会话应该持续你整个五年的公司任期,还是每天重置?永久会话会遭受上下文腐化和安全风险。最佳架构是一个每天重置的协调器,它把任务委派给临时专家,并将状态保存到本地文件中。
玛丽,玛丽,真倔强,你的智能体能活多久?
像 Grok Bot 和其他元控制框架这样的新产品,让我们去创建智能体。它们应该活多久?
当你设计一个日历智能体时,它的会话应该运行多久?它应该在你公司五年的整个任期内保持活跃,还是每天重置?
越来越强大的模型诱惑我们构建永不关闭的永久会话。但长时间运行的会话会从内部开始腐化。
随着对话轮次堆积,注意力会下降。现代模型很容易在长文档中找到一个事实。但研究表明,即使是前沿模型,智能体的记忆也像人类记忆一样:随着增长而退化。1
临时指令会变成永久的幽灵。三月份告诉你的机器人:“我这周感冒了,取消早上的会议”,到十一月它还在避开早上的时间段。
长时间会话也会破坏安全性。一个对你的收件箱和日历拥有多年读写权限的智能体,就像一扇敞开的大门。一封恶意邮件或日历邀请就能污染对话,悄悄劫持你未来几个月的日程。2
最佳模式很简单:给你的日常助手一个24小时的生命周期,并把具体任务委派给专门的窄范围专家。
每日重置符合人类实际的工作方式。白天,你的助手记住即时上下文:“我迟到了十五分钟”或“留两到三个空闲时段做准备”。午夜时分,活跃对话被清空,让明天重新开始。
当有工作需要完成时,日常协调器把任务交给单一用途的助手:一个日历智能体来安排日程,一个邮件智能体来起草回复,或一个新闻智能体来搜索网络。每个助手只活三十秒,只拥有它需要的特定工具,完成任务后消失。3
对于日常协调器,系统提示词充当调度员:
你是 Tomasz 的日常协调器。
你的会话持续24小时。
工作流程:
- 早上:从 `preferences.md` 加载偏好设置
和今天的日历。
- 白天:不要直接执行。委派
给子智能体(`calendar_bot`、`email_bot`)。
- 晚上:午夜时,将持久的学习成果保存
到 `preferences.md` 并终止。
对于日历助手,系统提示词是一个无状态执行器:
你是一个临时的日历专家。
处理这个单一请求,调用工具,
报告结果,然后终止。
规则:
- 时区:America/Los_Angeles。
- 时长:30分钟。
- 工作时间:上午9:00 – 下午6:00。
- 始终先检查可用性。
绝不重复预订。
- 如果已满,提议2个最近的空档并停止。
输出:返回事件标题、时间和参与者,
然后退出。
在一天的会话于午夜清空之前,会运行一个快速的整合过程。一个离线摘要器回顾当天,将持久的偏好(“Tomasz 更喜欢三十分钟的会议”)保存到磁盘上的永久笔记中,并丢弃其余日常对话。4
Grok Bot 或你的聊天助手会自动执行这种睡眠周期吗?
今天还不行。大多数机器人让线程永远保持打开,直到你点击“+ 新建聊天”,或者上下文压缩悄悄抹掉你的规则。
这首童谣问的是一个花园:银铃和贝壳花,排成一行。那些持久存在的东西,按某人选择的顺序排列。对智能体来说,答案是一样的:扔掉对话;把规则保存在文件中,让你的智能体和它的花园保持健康。
-
Amirali Ebrahimzadeh 和 Seyyed Muhammad Salili,“并非所有针都能找到:事实分布和提示如何影响长上下文LLM中的推理,” arXiv:2601.02023,2026年1月;Kelly Hong 等人,“上下文腐化:增加输入令牌如何影响LLM性能,” Chroma Research,2025年。↩︎
-
“LLM智能体中的睡眠者记忆投毒,” arXiv:2605.15338,2026年5月。展示了有状态AI助手中持久的跨会话记忆投毒攻击。↩︎
-
Shiyang Chen,“治理退化:上下文压缩如何静默抹除长视野LLM智能体中的安全约束,” arXiv:2606.22528,2026年6月。展示了压缩在30–59%的会话中丢弃了常驻规则。↩︎
-
Anthropic,“梦境:记忆整合,” 研究预览 dreaming-2026-04-21,2026年4月;以及 Letta v2 有状态智能体框架(2026年)。↩︎
术语表
- 智能体(Agent)
- 指能够自主执行任务的人工智能系统,如日历助手、邮件助手等。
- 上下文腐化(Context Rot)
- 随着对话轮次增加,模型对早期信息的注意力下降,导致性能退化。
- 元控制框架(Meta-Control Framework)
- 一种管理 AI 智能体行为的框架,类似于操作系统,控制智能体的权限和任务分配。
- 系统提示词(System Prompt)
- 给 AI 模型的初始指令,用于设定其角色、行为规则和工作流程。
- 无状态执行器(Stateless Executor)
- 不保留历史状态的智能体,每次执行任务时只根据当前输入和规则操作。
生产区
使用这篇文章
复制包含 frontmatter、中文正文和英文来源的 Markdown。
我的研究区
记录自己的判断,不会写回原文或公开页面。
一句话说清这篇材料能支撑什么角度。
每行一个,最多 20 个。
支持 Markdown。要核对的数据、可复用的方法、反方观点或补充来源。