DeepSeek开源3050亿多模态AI模型,专供Agent干活
AI大模型

DeepSeek开源3050亿多模态AI模型,专供Agent干活

DeepSeek刚开源了V4系列首个实验性多模态模型DeepSeek-V4-Flash-Vision-Exp,总参数量达3050亿。模型基于V4-Flash-0731底座构建,接入视觉编码器与Aligner,经持续训练获得图像理解能力。采用MIT协议,已上线Hugging Face,开发者可直接上手用。

这款模型不走传统视觉问答的老路,不做简单"看图说话"。它聚焦的是多模态Agent能力,相当于给AI智能体装上一双"眼睛"。视觉与文本架构有机结合,能精准解读图像并实现多模态融合,让Agent真正能干活,而不是只会描述图片。

与此同时,微信支付AI专属卡也上新了。继WorkBuddy、QClaw之后,现已支持接入DeepSeek Harness和OpenClaw。开发者调用DeepSeek能力更方便了,支付与AI之间的链路进一步打通。

从开源多模态模型到支付场景接入,DeepSeek正在快速铺生态。模型开源降低使用门槛,支付通道提供商业化抓手,两手一起抓。接下来就看开发者能在这套组合上玩出什么花了。