阿里发布 Qwen3.8-Omni-Flash 全模态模型:音视频能力提升,百万 Token 图文音视频输入 0.8 元

IT之家 9 月 18 日消息,阿里千问今日正式上线新一代原生全模态模型 Qwen3.8-Omni-Flash,并已在千问 AI 平台提供。该模型可同时处理文本、图像、音频和视频输入,支持 1M 上下文。 全模态模型指可同时处理文本、图像、音频、视频等多种输入形式。官方称,该模型在保持同尺寸文本模型能力的同时,全模态能力较上一代明显提升。 在累计 30 项评测上,Qwen3.8-Omni-Flash 相比上一代 Qwen3.5-Omni-Plus 平均得分提升超过 26%。在音视频 Agent、Coding 和长程任务方面,WildClawBench-MM 提升 36.5 分,AgenticV…
以上为资讯摘要,完整内容请访问原文网站。
阅读原文 →