AI智能体正在突破单次对话的限制。开源项目browser-use直接把网站变成了智能体的游乐场,自动化操作网页变得轻而易举。当上下文爆满时,大模型还能通过跨会话的上下文学习状态交接,把任务无缝转移到新会话继续干。这意味着智能体不再健忘,而是能持续干活。
记忆是智能体成长的核心。MobileMem框架基于一年的移动端交互数据,给设备端AI智能体打造了长期记忆基准。它不只考检索死知识,更看重多跳推理、时间推理和隐式偏好推断。智能体得记住过去、理解现在,才能陪你打怪升级。这正是hermes-agent“与你共同成长”的理念落地。
光有记忆还不够,智能体得学会把经验变成自己的能力。LOPD(潜在在线策略自蒸馏)方法让AI智能体直接把经验融入策略,端到端学习上下文,靠自教师模型搞密集的token级监督。在工具调用和代码生成上,这招完爆RLVR等主流方法,学习效率极高,连别人30%的rollout预算都用不到。虽然离完全自主进化还有距离,但自我改进的闭环已经跑通。