京东开源视听世界模型,豆包AI助手上线,OpenAI谈监管
AI技术

京东开源视听世界模型,豆包AI助手上线,OpenAI谈监管

京东在JDD大会上发布了两个产品。音视频生成模型JoyAI-Echo升级到1.5版本,用音视频Memory Bank架构,能持续生成超过10分钟的长视频,支持多镜头切换。同时开源了可交互视听世界模型EchoWM,融合了原生视听生成和用户控制,AI内容可以直接进去探索了。

豆包手机助手消费者版正式发布。相比之前的预览版,这版主打稳定和日常可用。它支持语音、AI键等多种唤醒方式。专属AI键带指纹鉴权,验证后直接执行,不用二次解锁。语音唤醒专门针对远场和嘈杂环境优化过,实际体验会好不少。另外它推出GUI协议,三方App可以自主拒绝AI自动操作,隐私安全这点做得比较好。

OpenAI联合创始人布罗克曼最近发声。他觉得放缓AI研发的措施应该只针对前沿大模型,不能一刀切限制开源和个人项目。他提到Hugging Face事件后OpenAI已经完善了安全机制,并呼吁国际协同监管。大厂的前沿模型需要审慎对待,但开源生态不该被牵连。

京东和字节这些国内大厂一直在做产品,从视频生成到手机助手,交互体验提升得很快。OpenAI这样的头部公司在考虑怎么平衡技术进步和安全监管。产品往前跑,规则也得跟上。