AI技术

AI智能体新纪元:自造世界、真机实操、持续进化

智能体要进化,靠人工喂数据调参这老路走不通了。说白了,SPADE现在的思路是让智能体自己给自己出题——在能交互的环境里搞自我对弈,任务变着法儿地来,底子自然就练扎实了。再看闭源的RSI圈子,18个Agent居然自己组队搞科研,Kimi K3拿Harness硬是逼近了Opus 5的水平。你看,AI自己搞自我改进这套剧本,真不是PPT了。

但让AI自己“捏世界”,难的根本不是搭个场景,而是第二步:这世界能不能懂你的动作?能不能记住状态?带不带得动持续学习?一张静态画布没用。环境得是活的、能跑的,你点一下它得有个回声。实际上,就卡在这一步,不少团队直接歇菜。

阿里Qwen-UI-Agent干脆把仗拉回真机来打。这回他们一口气上了100多台手机、150多个应用,攒了400多个真机任务,干脆自己建了个MobileWorld-Real基准。图啥?打通从模拟到现实的最后一公里呗。天天在虚拟环境里搞表演没意思,得让模型在真实的屏幕上实打实地学会点、滑、看反馈。

另一头的hermes-agent选了条岔路。它不贪大求全去当什么全能神,主打一个“陪你长跑”。看你的习惯,调它的路子,越用越顺手。智能体凭什么就得是出厂定死的一把扳手?它本该是个能在摸爬滚打里自我迭代的活搭档。

往后看,智能体这摊子事的下半场,真不是比谁家模型参数更大。拼的是什么?是更硬核的真实环境,是更野的自主目标,是更顺滑的成长闭环。这三板斧,现在正被几拨人各干各的。可谁能先把这些东西揉碎了捏一块儿,谁也就攥住了下个时代的入场券。