大模型的打法彻底变了。arXiv刚发了一篇新研究,搞出个叫Pandora的模型路由框架。说白了,就是把不同模型和架构捏合成一个异构系统,谁来回答全看查询内容,自动派发给最擅长的那一个。单模型包打天下的老路子走不通了,分工协作才是新风口。
国产大厂这边也没闲着。阿里云千问平台刚把智谱GLM-5.3和DeepSeek-V4-Pro接了进来,死磕编程与智能体。一个主攻长程任务和网络安全,另一个在多步骤复杂交互上做了升级。腾讯的下一代大模型Hy4也快发了,从内部界面看,它要当WorkBuddy的核心引擎,跟Hy3、DeepSeek凑成三档选项。实际上,模型搞矩阵化、梯队化早就成了标配。
垂直赛道同样在突进。拉萨市纳金数智研究院刚揭牌,直接甩出了"阳光清言"通用藏语大模型。参数破千亿,还过了中央网信办的备案。藏语通用大模型总算有了千亿级选手,区域和语种的空白正在被填补。
在背后撑着这些动作的数据产业,更是直接炸了。就拿标注公司Micro1来说,过去8个月年化营收从1亿美元狂飙到5亿美元,净收入大概落在一亿五到两亿美元。这数据虽然还干不过Mercor的20亿和Handshake的10亿,但看这增长曲线就知道,大模型对训练数据的胃口还大着没边。
从路由调度到平台扩容,再到藏语模型和数据标注,大模型的仗早就不是单纯堆参数了。现在的较量全在场景、匹配和基础设施上。拼单点真不如拼体系,这信号再明确不过。谁能把对的模型塞进对的位置,下一轮的主动权就归谁。