8月27日消息,阿里千问正式发布Qwen3.8-Flash,这是一个多模态MoE模型,主模型参数量为125B,额外配备51B的N-gram Embedding,每token激活6B参数。 它原生支持262,144 token上下文,并可通过YaRN扩展至1M token。
24小时热榜