8月27日,阿里千问正式发布Qwen3.8-Flash多模态混合专家(MoE)大模型。该模型主参数量125B,配备51B N-gram Embedding,每token激活约6B参数。其原生支持262,144 token上下文,借助YaRN技术可扩展至100万token。此举旨在提升长文本理解、多模态推理及电商场景下的实时响应能力,适用于搜索、推荐与智能客服等高并发低延迟应用。