AI大模型

大模型新局:字节重组、讯飞上新、推理加速3倍

字节跳动的Seed部门,最近搞出了不少动静。预训练、强化学习、Agent研发,整个体系都拆了重塑,新设了四个一级部门。说白了,就是把文本、编程、视觉、语音这些预训练数据团队全拧成一股绳,由李成刚统一负责,去支撑新Omni模型。B端和C端的产品模型能力则分开布局,研发资源更聚焦。

科大讯飞这边也有新消息。他们准备在1024开发者节上,发布基于全国产算力的主力通用大模型。8月底会先放一个阶段性版本出来,让市场和开发者提前尝尝鲜。节奏定得很清楚,没有那么多弯弯绕。

新模型层面同样不缺戏。一个叫“Ox Alpha”的神秘模型突然出现在OpenRouter上,据说性能超了Fable 5,而且输入输出都免费,纯白嫖。圈里人都在猜它到底是谁家的,智谱和小米是热门候选。另一边,Liquid AI和Hugging Face联手发布了LFM2.5 DSpark草稿模型系列,一共三个版本:1.2B、2.6B、8B-A1B。他们走了一条新的投机解码路径,输出质量不打折,GPU端推理速度最高能提3.18倍,端侧设备也明显加速。实际上,这种“以小带大”的思路,正在成为加速推理的热门玩法。

模型路由技术也在往前拱。一篇论文提出Pandora's AI Model Routing Box,通过成本价值估计,在异构AI系统里智能分派查询,让不同模型各司其职,整体效率往上涨。这些事放一起看,大模型竞争已经从单打独斗的模型能力,转向了组织、数据、推理、路由这些系统级优化,家底盘得顺不顺,越来越关键。