大模型圈子最近是真热闹。字节跳动把Seed部门拆了重组,押注预训练和强化学习;科大讯飞憋着要出国产算力的大模型;Liquid AI搞了个投机解码提速的模型;OpenAI那边也坐不住了,直接给旗舰模型降价。说白了,从组织到技术再到价格,这一轮全在加速。
字节Seed调整完之后,设了四个一级部门,吴永辉统一带队。李成刚那边把文本、编程、视觉、语音的预训练数据团队合到一块儿,目的很明确,就是在为新的Omni模型铺路。B端和C端的产品模型能力分开搞,预训练、强化学习还有后训练的资源都集中管起来,研发效率确实提上来了。
国产这边,科大讯飞打算在1024开发者节上发布一款基于全国产算力的主力通用大模型,8月底就会先放出来一个版本给大家试。Liquid AI跟Hugging Face联合推了LFM2.5 DSpark草稿模型,分1.2B、2.6B、8B-A1B三档,靠投机解码做到不损失质量的前提下,GPU端推理速度最高能拉3.18倍,端侧加速也挺明显。另外,多模型异构系统现在也成了热门方向,像Pandora's AI Model Routing Box这种东西,靠代价估计把查询请求智能分发到最合适的专家模型上,效率和质量两头都顾上了。
OpenAI也插了一脚,宣布接下来三个月内,GPT-5.6 Sol的API和Credit价格都降超过20%,变相拉低了企业和开发者的门槛。组织调优、技术落地、价格战一起上,大模型这场仗已经打到深水区了。