快讯详情
阿里发布全模态模型Qwen3.8-Omni-Flash,能听会说还能剪,输入价格骤降九成
速途网| 2026-09-18 16:01:25

速途网讯 9月18日,阿里发布新一代全模态大模型Qwen3.8-Omni-Flash。新模型能统一处理文本、图像、音频和视频输入,在多项音视频权威评测中可媲美最新的Gemini3.8-Flash,还拥有极强的Agentic能力,能自主规划任务、调用工具并交付结果,是国内首个全模态Agentic模型。用户提供歌曲、影视剧或会议视频并描述需求,模型即可配合Agent完成MV制作、影视剪辑、多人会议整理等任务。同时,相较上代模型,Qwen3.8-Omni-Flash输入价格骤降九成。

Qwen3.8-Omni-Flash采用全新架构,实现了全模态能力的显著提升。在累计30项评测上,相比上一代Qwen3.5-Omni-Plus,新模型平均得分提升超过26%。其中,长音频理解LongAudioSpan提升8.3分,音视频理解OmniVideoBench提升9.6分,覆盖音视频Agent、Coding和长程任务的WildClawBench-MM、AgenticVBench分别大幅提升36.5分和22.3分。通过扩展数据、上下文与Agentic环境,Qwen3.8-Omni-Flash的音频能力整体超过最新的 Gemini3.8-Flash。 同时,新模型支持113种语言及方言识别、36种语言及方言生成和百万上下文,可处理时间更长、人员角色更复杂的音视频内容。

转载之前请先阅读转载说明,违规转载法律必究
寻求报道或合作,请点击这里
如果您加入壹览的讨论群,请联系我们的工作人员(微信号:star_3979)