前阵子有个创业者砸了10万美元让AI帮忙开店,结果4个月亏了1.3万,更搞笑的是自己还被AI“老板”给炒了。说白了,这事儿直接戳中了现在智能体的软肋。AI真不是干不了活,而是太被动。你拨一下它动一下,从来不主动找问题,更别提优化流程。这就告诉我们,光给AI塞技能没用,它得有自驱力才行。
但技术确实在往前跑。阿里刚弄出个开源的真机多模态基座模型Qwen-UI-Agent,能在手机电脑这些真实设备上直接上手操作。MobileWorld测试里它拿了82.1%的高分,好几个主流模型都被它按在地上摩擦。不过实际上,光会动手还不行。AI得学会自己琢磨下一步干嘛。要是没点主动性,它撑死也就是个高级遥控器罢了。
学术界这边也在憋大招。那个叫AI4AI-Bench的项目挺有意思,专门测智能体能不能“左右互搏”,也就是自己改进生成自己的算法。这就要求AI有元认知,能从自己吃过的数据里反刍出经验。另外大家也看明白了,Token Maxing退潮,靠蛮力狂堆数据的粗放打法早就行不通。以前那是贪大求全,现在不行了,智能体得学会精打细算地干活。
还有个叫hermes-agent的项目走的是另一条路子,主打智能体得跟着用户一起长。说白了,它不该是一锤子买卖的死工具,得看人下菜碟,根据你的使用习惯不断调教自己。这才是真正的个人助手嘛。那种训完就不管了的模型早晚得停在原地,要长远用下去,持续学习才是正道。
这么盘下来,智能体的进化路子就很清晰了。告别唯Token论,转头奔向真刀真枪的任务。从虚拟沙盒跳进真实物理世界,从机械执行变成主动想问题。谁能把主动性和自我改进这块骨头啃下来,谁就能卡住下一代AI的C位。以后的智能体肯定不再是死板的参数包,而是能自己野蛮生长的动态系统。