京东在JDD大会上发布JoyAI-Echo两项进展:音视频生成模型升级至1.5,持续生成超10分钟;开源可交互视听世界模型EchoWM,融合原生视听生成与用户控制,让AI内容从“能看”走向“能进、能探索”。长视频采用音视频Memory Bank架构,支持多镜头生成。