说白了,DeepSeek工具链刚更新到0.1.1-rc.1版,就甩出个重磅功能——视觉模型V4 Flash Vision-Exp体验版上线了。在V4 Flash和V4 Pro基础上,这次终于把"眼睛"给补上了。实际上,v0.1.0-rc.8那会儿就已经打通了多模态能力,支持原生图片请求,/goal、/plan这些指令也能同时输图和文字了。
多模态Agent能力据说已经接近Opus 4.8的水平,这迭代速度有点猛。以前只能读文字,现在直接看图理解内容,应用场景一下子拓宽了不少。说白了,从纯文本到图文混合,DeepSeek这波补齐了最关键的一块拼图。
价格方面依然很能打。一张图最高只要0.001元,1000张图才1块钱,这成本压得够低。对比其他多模态模型的定价,DeepSeek说白了就是在用白菜价卖能力。
挺有意思的是,DeepSeek一边涨价一边开源,这操作让人又爱又恨。有人调侃"你是梁文锋还是梁文谷",但开源策略确实给社区带来了实打实的价值。实际上,涨价是商业化必经之路,开源是技术普惠的坚持,两者并行算是DeepSeek的独特打法。