大模型落地最近确实挺热闹。一汽-大众纯电新车ID. AURA T6敲定接入火山引擎豆包大模型,直接把智能座舱的竞争拉到了纯电赛道,双方合作全面升级。手机端同样在憋大招,荣耀YOYO Claw刚接上了智谱最新发布的GLM-5.3大模型。说白了,车机和手机现在都在疯狂卷AI,端侧体验眼看着就上了一个台阶。
荣耀这次用的GLM-5.3挺值得琢磨的。实际上,实测下来你会发现它像个“偏科生”,在“安全”这一项直接拿了高分,甚至同一个模型会表现出像两个AI一样的不同反馈。智谱这次下足了狠功夫。他们靠更大规模、更长周期、更多样任务环境的后训练,硬生生把模型能力上限又拉高了一截。安全和高性能两手抓,确实有点东西。
模型能力到底是怎么练出来的?学术界也在找新解法。最近有篇论文提出,用“受控知识暴露”的方法去研究大模型怎么学知识和技能。以前网上的语料实在太多太杂,你根本搞不清模型究竟学到了啥。现在这思路算是直接解决了痛点,让研究语言模型的知识获取过程变得更清晰可控。
大厂内部同样暗流涌动。腾讯混元大模型团队的重要成员徐灿,前不久转岗去了微信WeLM团队。这波人事调动释放的信号很明确:微信AI要踩油门了。大模型在国民级社交生态里到底能玩出什么花?接下来估计有大动作。