阿里千问发布多模态MoE大模型Qwen3.8-Flash

8月27日,阿里千问正式发布Qwen3.8-Flash多模态混合专家(MoE)大模型。该模型主参数量125B,配备51B N-gram Embedding,每token激活约6B参数。其原生支持262,144 token上下文,借助YaRN技术可扩展至100万token。此举旨在提升长文本理解、多模态推理及电商场景下的实时响应能力,适用于搜索、推荐与智能客服等高并发低延迟应用。

免责声明:本文内容由开放的智能模型自动生成,仅供参考。

上一篇:

下一篇: