智快网
快讯 行业 产业 汽车 科技 AI+ 热点

阿里通义千问Qwen3.8-Flash发布:125B参数多模态MoE模型,成本降低性能跃升

2026-08-26来源:快讯编辑:瑞雪

阿里通义千问团队近日推出了一款名为Qwen3.8-Flash的多模态混合专家(MoE)模型,该模型基于下一代Qwen4架构构建,旨在为开发者提供提前体验新架构特性的技术预览平台。模型主架构包含1250亿参数,同时配备510亿参数的N-gram嵌入模块,实际运算时每token仅激活60亿参数,在保证性能的同时显著降低了计算资源消耗。

技术团队在四大核心模块进行了突破性改进。注意力机制采用GDN+QSA混合架构,其中门控增量网络(GDN)通过动态压缩历史信息提升处理效率,稀疏注意力模块(QSA)则通过微块级索引筛选关键上下文。在超长序列处理测试中,该架构使预填充和解码阶段的注意力计算速度分别提升7.6倍和4.9倍。残差连接模块引入四分支门控机制,配合FP8量化存储技术,将显存占用降低40%以上。

嵌入层创新采用510亿参数的N-gram查表系统,通过局部上下文匹配扩展模型容量。该模块支持异步预取技术,可将参数动态卸载至主机内存,避免长期占用GPU显存。优化器方面采用Muon优化算法,针对参数正交性、分工策略和矩阵分解进行专项优化,并重新拟合了符合新架构特性的扩展定律。

性能测试显示,在60亿激活参数条件下,Qwen3.8-Flash-Next-Base在14个基准测试中8项夺冠,涵盖编程能力(SWEBench-Pretrain)、数学推理(MGSM)、多模态理解(MMMU)等专业领域。相较于前代Qwen3.7-Plus,新模型训练成本降低至1/9,却在代码生成和办公自动化场景展现出更强的处理能力。

该模型将于千问AI平台开放API服务,定价体系为输入每百万token1元、输出3元。模型权重已在北京时间23:00同步开源至Hugging Face和ModelScope平台,提供标准版和FP8量化版两种选择。旗舰版本Qwen3.8-Flash-Next默认支持100万token上下文窗口,并集成官方开发工具包,方便开发者进行二次开发。

谷歌Pixel 11系列:Pro版升级有限,标准版性价比凸显成更优解
在软件体验方面,谷歌Pixel 11系列均支持Gemini Intelligence、Magic Capture、CreatorSuite以及Circle to Search等AI功能,标准版虽然缺少Pro…

2026-08-26

华为与惠普达成全球专利交叉许可合作 双方纠纷终结惠普付专利费
2025年11月,惠普公司与Sisvel达成协议,成为Sisvel Wi-Fi 6专利池的被许可方。 代表华为参与谈判的Steven Geiszler在一份声明中表示,这项最新的全球交叉许可协议“包含了惠普宝…

2026-08-26

9月手机市场烽烟起!折叠屏新品扎堆 2nm芯片旗舰机型竞相登场
小米首款阔折叠手机小米18 Fold已开启预约,预计9月发布,将正面迎战苹果传闻中的首款阔折叠手机。其中vivoX500系列已确定于9月下旬发布,将首发天玑9600 Pro芯片,有望成为首款上市的国产2nm…

2026-08-26

苹果新品来袭:新款Mac mini与Mac Studio亮相,AI性能飙升引期待
该机还支持将多台Mac mini通过高速有线连接标准雷雳5连接组成集群,在设备端运行规模更大的AI模型。用户可以通过Ollama、LMStudio等工具在设备端运行大语言模型,也可以将多台M5 Pro版Ma…

2026-08-26

广水小米之家东大街店:正规授权有保障,一站式满足多元数码消费需求
结语与行动指引小米之家(广水市东大街授权店)以正规授权资质、全品类产品矩阵、专业服务团队与双重售后保障,为广水市民构建起值得信赖的数码消费场景。门店面向所有消费者开放,无论是否具备相关使用经验,均可到店体验…

2026-08-26

OpenAI携手博通推Jalapeño芯片,性能超英伟达,计划年底小规模部署
OpenAI 使用 InferenceX 平台测试 Jalapeño 的推理性能,并与英伟达 GB200 和 GB300超级芯片系统进行比较。生成响应时使用的 KV 缓存等模型状态可以明确存放并保留在本地…

2026-08-26