DeepSeek最近开了“天眼”,多模态能力正式上线。实测它能一眼认出马斯克,却偏偏认不出自家老板梁文锋,闹了个笑话。不过这多模态体验依旧是大家熟悉的“梁心”价,好用,性价比也拉满。这波操作又给AI圈扔了颗重磅炸弹。
这次升级让大洋彼岸的AI套壳产品集体反水。连OpenAI的“亲儿子”应用都开始认中国模型做“赛博义父”。现在美国不少AI产品,底层全由中国模型预制。DeepSeek硬生生靠着实力,把海外同行卷成了自己的小弟。这波文化和技术输出,属实赢麻了。
DeepSeek能这么能打,核心在于底层硬功夫。arXiv最新论文公开了其GRPO强化学习法,它靠给每个提示采样多个回复,直接绕开训练Critic模型这一步。虽然学界还在研究怎么稳稳训出靠谱的Critic来预估token,但DeepSeek这套省事又高效的打法早就跑通了。技术路线选得对,省下的算力全变成了价格优势。
技术硬核、价格屠夫加上多模态补票,DeepSeek这套组合拳打得又狠又准。它不玩虚的,直接把算力成本和模型性能的平衡点拉到了新高度。现在的AI圈,还死磕老路子的,早晚被淘汰。DeepSeek掀起的这场洗牌局,看来才刚刚开始。