最近开源模型圈又热闹起来了。商汤开源了个8B参数的多模态大模型SenseNova U1.5 Lite,视觉任务表现很猛,原生支持3-4K上下文,能同时处理主体、空间、文字等多重约束。阿里这边呢,发布了Qwen-UI-Agent,一个真机多模态基座模型,覆盖移动端、电脑端和网页端,在MobileWorld测试里拿下了82.1%的高分。
Liquid AI和Hugging Face联手,推出了LFM2.5 DSpark草稿模型系列,有1.2B、2.6B和8B-A1B三款。这玩意儿用了投机解码技术,输出质量不变,但推理速度最高能飙到3.18倍,GPU和端侧都有明显加速。说白了,直接缓解了大模型部署的算力压力。
最戏剧性的是美国法律科技公司Harvey。它们放弃美国本土模型,转用中国月之暗面的Kimi K3开放权重,训练出了Harvey Tenet模型。新模型在法律场景中性能超越了一堆美国前沿AI系统,包括GPT-5.6 Sol,成本还大幅降低。实际上,中国开源模型的技术和成本优势开始被全球认可了。
说白了,从商汤的视觉多模态,到阿里的智能体基座,再到Liquid的推理加速,以及Harvey的跨洋应用,开源模型在技术、效率和商业落地多个维度都在全面开花。对开发者来说,选择越来越多,门槛也越来越低。