大模型速递:Mistral万亿参数开源,OpenAI提速8倍
AI大模型

大模型速递:Mistral万亿参数开源,OpenAI提速8倍

Mistral AI放出Mistral Large 4,1万亿参数、490亿活跃参数,是目前体量最大的开源模型。它同时支持多模态,在网络安全、金融、法律等垂直领域跑到SOTA。开源阵营追参数规模追了很久,这次算是把差距压到了肉眼可见的程度。

OpenAI走的是另一条路。GPT-6.1 Sol Ultrafast已在API、Codex和ChatGPT Work全面上线,速度最高是标准版的8倍,价格也涨到6倍:每百万tokens输入12美元(约80.5元),输出60美元(约402.7元)。Codex和ChatGPT里已经能直接调用。快是真快,贵也是真贵,适合对延迟敏感又不差钱的场景。

学术圈在算另一笔账:怎么让强化学习更划算。arXiv上一篇新论文提出,把RLVR里的"探索"和"优化"拆开。现有做法把两件事混在一起训,模型容易在已知推理路径上打转,挖不出新解法。拆开之后探索归探索、优化归优化,理论上更容易撞见新的推理策略。

三条消息拼起来看:开源拼参数,闭源拼速度,研究拼效率。大模型的竞争已经从"能不能做出来"变成"谁更快、更便宜、更聪明"。开发者选项变多了,账单也更难算了。