AI行业

大模型风云再起:字节重组、降价潮、神秘模型现身

国内大模型这周挺热闹。字节跳动Seed部门刚搞完一轮大调整,新设了四个一级部门,把预训练数据、强化学习还有后训练资源全捏一块儿了,B端和C端也彻底分开干。说白了,就是想理顺内部资源打架的问题。Pretrain Data团队现在由李成刚一人掌管,文本、编程、视觉、语音全收编,专门去撑新Omni模型。科大讯飞这边也没闲着。他们把1024开发者节的日子定死了,到时候要发一个纯全国产算力的通用大模型。8月底先放个阶段性版本给开发者尝鲜,这节奏掐得死死的。

另一边,OpenAI干脆掀桌子直接降价抢人。未来三个月内,GPT-5.6 Sol的API和Credit调用成本砍掉两成多,摆明了是要把门槛踩碎,圈进更多用户。实际上,学术圈也在死磕“效率”这回事。arXiv上刚挂出来的Pandora论文就探讨了异构AI系统怎么把查询,精准派给最擅长的专家模型。他们搞了个路由盒子,想实现质量与效率双赢,不过代价是评估这套东西本身也烧钱。你看,降价也好,路由优化也罢,本质上都在解同一道题:怎么让大模型真正用得起、跑得快。

最逗的是OpenRouter上突然冒出个匿名模型Ox Alpha。8月20日上线,直接白送大家免费用一周。DeepSWE跑分一出直接碾压Claude Fable 5,网友顺着线索扒来扒去,发现矛头全指向智谱公司。匿名发布、限免测试、跑分吊打头部大厂,这套组合拳在AI圈算是玩出花来了。你看看,字节重整架构,讯飞押注国产算力,OpenAI带头降价,智谱疑似放出神秘黑马。大模型这赛道从来不缺戏剧性,光这一周的剧情密度,拿去拍一季电视剧都嫌挤。