AI大模型

大模型混战升级:腾讯Hy4将至,藏语模型突破千亿参数

腾讯Hy4还没发布,藏语大模型先破千亿参数了

大模型赛道最近动作密集,腾讯新一代大模型Hy4的内部测试界面已经曝光,估计离发布不远了。界面上看,腾讯还是沿用了自研+开源的打法,给用户三个选择:专家级大模型Hy4、升级版Hy3,还有专注推理的DeepSeek。Hy4是绝对的重头戏,说白了,它也会成为WorkBuddy的核心引擎。

阿里云这边也没闲着。GLM-5.3和DeepSeek-V4-Pro两款旗舰模型已经接入千问AI平台,主攻编程和智能体方向。开发者直接用API就能调,文本、代码、语音、图像、视频生成全都覆盖。头部厂商的思路其实挺清楚:与其死磕自研,不如把主流模型全收进来,让用户自己挑顺手的用。

边缘场景同样在发力。拉萨市纳金数智研究院揭牌了,"阳光清言"藏语大模型正式发布。这个模型去年11月首次亮相,已经过了中央网信办备案,参数规模破了千亿,是首个通用藏语大模型。对藏语用户来说,这算是从0到1的突破。

训练数据的需求也在爆发。AI数据标注公司Micro1过去8个月年化营收从1亿美元涨到5亿美元,净收入大约1.5到2亿美元。虽然跟Mercor的20亿、Handshake的10亿年化总收入比还有差距,但这说明整个大模型产业链都在同步膨胀,上下游都忙得不亦乐乎。

模型越出越多,怎么调度就成了新问题。有研究提出了Pandora's AI Model Routing Box,通过成本价值估算来把查询高效分配给最合适的模型。在异构AI系统里,多模型协作会越来越常见,路由机制很可能就是下一波基建的重点。这个想法挺有意思,值得持续关注。