AI行业

AI大模型暗战升级:字节重组、讯飞亮剑、推理飙速3倍

实际上,字节跳动大模型部门Seed刚完成一轮大调整。新设了四个一级部门,预训练数据、强化学习和后训练资源全部整合到一起,B端和C端模型能力分开布局。李成刚统一接管了文本、编程、视觉、语音等预训练数据团队,全力撑住新Omni模型。说白了,架构理顺了,接下来拼的就是落地速度。

科大讯飞也亮牌了。实际上,1024开发者节他们将拿出基于全国产算力的全新主力通用大模型,8月底先放个阶段性版本给开发者尝尝鲜,节奏卡得挺紧。另一边,匿名"牛来"大模型被社区扒出和智谱有血缘关系,Tokenizer、视频编码、API报错全对上了,有人怀疑是Cursor拿开源GLM训的。套壳还是微调?争议还在发酵。

推理效率这块也有新动作。Liquid AI和Hugging Face联合放出了LFM2.5系列DSpark草稿模型,覆盖1.2B到8B-A1B三款,说白了就是靠全新投机解码路径把吞吐量拉满,GPU端最高提速3.18倍,端侧也明显加速。学术圈那边同时在研究模型路由——异构系统把查询分配给最擅长的模型,质量和效率两头赚。大模型竞争已经从"谁更大"变成"谁更快、谁更省、谁更会分工"。