国产大模型圈子最近挺热闹,动作一个接一个。字节跳动的大模型团队Seed刚搞完一场大重组,一口气设了四个一级部门。说白了,就是要把手里的预训练、强化学习还有后训练资源全捏合到一块儿。B端和C端拆开单干,文本、代码、视觉、语音这些预训练数据团队,现在全归李成刚统一管。干嘛呢?全力撑起新的Omni模型。这手笔确实大,但接下来的1024开发者节,大家眼睛估计还得盯着科大讯飞。
科大讯飞在2026年半年度业绩说明会上透了底。今年1024,他们要正式掏出基于全国产算力的全新主力通用大模型。8月底先放个过渡版,让市场和开发者提前尝尝鲜。实际上,技术落地节奏早就敲定了,国产大模型这局棋,竞争维度早就换赛道了。
另一头,OpenRouter偷偷上线了个匿名模型Ox Alpha,直接免费开放一周。这模型在DeepSWE跑分上把Claude Fable 5按在地上摩擦,各种线索扒下来都指向智谱。官方还没盖章认领,但这实力已经够让人侧目了。新面孔登场,老选手也没闲着。Liquid AI拉着Hugging Face发了LFM2.5系列DSpark草稿模型,分了1.2B、2.6B、8B-A1B三个尺寸。用了条全新的投机解码路子,质量不缩水的情况下,GPU推理速度最高飙了3.18倍,端侧设备也跟着吃肉喝汤。
大模型这仗打到今天,早就是多线作战了。数据整合、架构翻新、推理提效,哪一步脚软,可能就真掉队了。