AI大模型

AI五连炸:机器人GPT-3时刻降临,多模态推理全面提速

AI圈这周炸了五连响。Mistral放了个Agentic Search,专治长文档检索的老毛病。传统RAG那套,一次性抓固定文本块,碰上金融申报、法律合同这种又长又绕的文件,基本歇菜。Mistral这回加了多步迭代推理,复杂文档准确率直接干到86%,跨源对比也顺手搞定。

推理速度这块,Liquid AI跟Hugging Face搭伙发布了LFM2.5 DSpark草稿模型,1.2B到8B三档全覆盖。核心是条全新的投机解码路径,说白了就是输出质量不变,但GPU端推理速度最高飙了3.18倍。端侧设备也明显提速,落地又近了一步。

多模态赛道更热闹。商汤开源了8B轻量模型SenseNova U1.5Lite,原生支持3-4K上下文,视觉任务表现压过同级,某些复杂排版和文字渲染甚至能跟大规模商业模型掰手腕。另一边,DeepSeek V4-Flash也"长眼"了,1000张图只要1块钱,多模态能力彻底白菜价。

最炸的还是机器人领域。一个叫"机器人GPT-3时刻"的项目震动了硅谷——0行代码,看一遍就会操作。黄仁勋、李飞飞都投了,大佬们集体沸腾。从文档检索到推理提速,从多模态到机器人,这周AI的信息密度直接拉满。