今天的AI圈简直像炸了锅。科大讯飞放出风声,要在1024开发者节甩出基于全国产算力的全新通用大模型,8月底先放个体验版让大家尝鲜。韩国的Kakao下手更狠,直接把公司拆了。新成立个“Kakao AI”死磕KakaoTalk和AI落地,剩下的金融、出行这些老本行全打包塞进“Kakao X”。说白了,大厂现在都把AI当成了未来的命根子,搞独立运营无非是为了抢个快字。
模型能力也在一路狂飙。商汤干脆开源了8B轻量级多模态大模型SenseNova U1.5Lite。这玩意原生支持3-4K上下文输出,连复杂排版和文字渲染这种细活儿都能拿捏,直逼商业大模型。另一边Mistral盯上了让人头疼的复杂长文档,推出Agentic Search。以前传统RAG碰到跨源对比或者长合同就抓瞎,现在它靠多步检索迭代推理,硬是把准确率拽到了86%。
光脑子好使不行,跑得快才是硬道理。Liquid AI拉上Hugging Face,弄出了LFM2.5 DSpark草稿模型。靠一条全新的投机解码路径,GPU端推理速度最高飙了3.18倍,连端侧设备都跟着沾光变快了。实际上,最让人踏实的还是它没搞垮质量,速度上去了,输出水平一点没掉链子。