阿里巴巴Qwen团队发布原生全模态模型Qwen3.8-Omni-Flash,支持文本、图像、音频、视频四类输入,上下文窗口达100万Token,29项基准较上代平均提升超25%。其最大变化在于处理方式:不再简单拼接语音、图像识别,而是从模型层原生融合多模态理解与AI智能体能力。