Qwen 团队发布 Qwen3.8-Omni-Flash 报告:面向原生全模态智能体
中文摘要
Qwen发布Qwen3.8-Omni-Flash,采用MoE架构的原生全模态模型,支持百万token上下文,适用于音视频长程智能体任务。
English Summary
Qwen released Qwen3.8-Omni-Flash, a native multimodal MoE model with 1M token context for long-range agent tasks.
Original Excerpt
Qwen 团队发布报告,介绍 Qwen3.8-Omni-Flash,一个原生多模态模型,面向跨文本、音频和视频的长程智能体任务,如视频编辑和长音频视频翻译。模型采用 Qwen3.8-Next 的稀疏 MoE 架构,上下文窗口达一百万 token,并通过协同训练策略在保持文本性能的同时将智能体能力迁移到音频和视频任务。