AI行业

AI模型加速落地:苹果中国定制大模型,京东开无人咖啡店

AI真不是只在实验室里跑跑分了,它早就开始往实际落地了。苹果这次拉上阿里,专门给中国市场搞了个大语言模型。据说通义千问的技术大概率会用来支撑中国版Apple Intelligence。这意味着啥?苹果算是放弃了以前在国内随便找第三方模型凑合的套路,开始认真搞深度定制了。再看开源圈,Ollama和HuggingFace Transformers这些底层设施也是越来越成熟。前者现在能在本地跑Kimi、DeepSeek、Qwen这些模型,后者更直接,文本、视觉、音频多模态的训练推理全给你打包成一套框架。开发者上手用这套东西,门槛是真降了不少。

搞研究的也没闲着,都在拼命拓宽模型的能力边界。比如那个专门给机器人操作用的DreamX-Phi 1.0,这玩意是个动作条件视频世界模型。你给它一句话和一串动作,它就能预测未来的观测结果。它通过SE(3)几何变换把注意力机制塞进去,还能保留每个机械臂的身份信息。这不,刚在WorldArena 2.0挑战赛拿了Track 1的第一名。还有个叫OmniScientist的项目,想弄个全能AI科学家,从提出假设到写论文全包了。不过作者也很清醒,说现在的系统还是拿不到科学发现里必须的空间、时序这些关键证据。AutoDesign框架那边就提出了个元测试优化的思路,让智能体能自己递归改进自己,不用再像以前那样停在静态范式里死磕。

落地这块现在也是越来越接地气了。8月16日那天,京东七鲜咖啡在北京银河SOHO开了家24小时AI无人咖啡店。从萃取到出杯,机器人全包了。它甚至还能看顾客的身体状况来推荐咖啡因摄入量,开业当天还去挑战了吉尼斯世界纪录。另外,深蓝G318这车装了华为乾崑智驾ADS 5 Pro和鸿蒙座舱HarmonySpace 5,本周末开始陆续到店能试驾了。豆包输入法iOS版1.5.0更新也很有意思,加了账号登录和词库云端同步。实际上,它用了和豆包同款的语音大模型,连方言和中英混合输入都能搞定了。你看,连最底层的输入工具都被大模型给改了。

说白了,AI模型到底有多大用,真不看参数堆得多大或者跑分多好看。能真正解决问题才是硬道理。苹果专门给中国训练模型,京东找机器人做咖啡,深蓝把智驾塞进不到19万的车里,这都是大家在找真实的落地切口。现在开源工具链越来越全,部署成本一直在降,加上研究框架在进化,智能体的本事也越来越大。等模型真从论文里走出来,进到了工厂、店铺还有咱们手机键盘里,AI这就算是真正开始改变生产方式了。