智快网
快讯 行业 产业 汽车 科技 AI+ 热点

DeepSeek开源V3.2-Exp实验版模型 架构创新或成国产AI发展新动力

2025-09-30来源:快讯编辑:瑞雪

DeepSeek近日宣布开源其最新实验模型DeepSeek-V3.2-Exp,首次引入DeepSeek Sparse Attention(DSA)稀疏注意力机制,在保持模型输出质量的同时显著提升长文本处理效率。这一技术突破被定义为"迈向新一代架构的关键中间步骤",标志着大模型优化方向的重要转变。

据技术报告披露,DSA机制通过"闪电索引器"和动态token选择技术,将传统注意力计算的复杂度从二次方降至近似线性。在H800 GPU实测中,该模型使长序列推理成本降低40%以上,同时保持与前代模型相当的任务完成质量。这种效率提升直接反映在API定价策略上——输出100万token的费用降至3元,仅为V3.1系列的四分之一。

产业界的响应速度超出预期。华为云在模型发布后6小时内完成部署,采用CloudMatrix 384超节点提供服务;寒武纪通过Triton算子开发实现4分钟极速适配,开源vLLM-MLU推理引擎;海光信息宣布其DCU处理器完成Day 0级优化,确保算力"零等待"部署。截至发稿时,已有华为、寒武纪、海光等12家芯片厂商完成适配,覆盖从云端到边缘的多元计算场景。

开发者社区的实测反馈呈现两极分化。在编程任务测试中,V3.2-Exp生成的代码量较前代减少35%,但某动画生成案例出现逻辑错误,显示模型在复杂场景下的稳定性仍需优化。信息检索任务测试表明,新模型响应速度提升28%,但推荐结果的精准度下降12%,特别是在需要多条件约束的场景中表现明显。

技术团队在GitHub披露的细节显示,该模型采用"继续预训练+混合强化学习"的双阶段优化策略。预训练阶段通过稠密模式初始化索引器参数,再逐步引入稀疏选择机制;后训练阶段结合领域专家蒸馏和统一强化学习框架,在保持模型通用性的同时强化特定领域能力。这种训练范式使模型在数学推理、代码生成等任务上的表现与前代持平,但工作记忆容量指标下降15%。

开源社区的热烈讨论揭示出技术演进的新方向。HuggingFace平台数据显示,模型发布首日即获得超过2.3万次下载,社区贡献者已提交47个优化补丁。值得注意的是,某开发者通过修改索引器阈值参数,成功将推理延迟再降低18%,这为后续技术迭代提供了重要参考。

当前,DeepSeek-V3.2-Exp已在App、网页端及小程序全面上线,同时保留V3.1-Terminus的API接口供对比测试。技术团队强调,作为实验性版本,该模型需要在真实业务场景中接受更严苛的考验,特别是在高并发、长序列处理等极端条件下验证其稳定性。随着更多企业和研究机构参与协同优化,这项突破性技术有望在年内实现产业化落地。

余承东履新华为IRB主任:聚焦AI战略,引领资源向核心目标倾斜
9月29日,据网易科技今日报道,华为公司今天任命余承东正式增任公司产品投资评审委员会(IRB)主任,该任命由任正非签发。此次履新后,余承东将同时执掌常务董事、终端BG董事长与IRB主任三大职务。目前余承东的微…

2025-09-30

高通骁龙8 Gen6系列迈入2nm时代,台积电代工成本攀升或致终端旗舰价格上扬
快科技9月29日消息,博主数码闲聊站爆料,明年的高通骁龙8 Gen6(SM8950)和骁龙8 EliteGen6(SM8975)全面升级2nm工艺,定位更高,这将是高通首款2nm手机芯片。 据爆料,骁龙8 …

2025-09-30

TCL华星与小米强强联合:共筑全场景显示生态,开启科技体验新篇
作为本次发布会的重头,小米17旗舰系列新品在显示体验上焕新升级,不仅全系搭载有TCL华星最新一代屏幕发光材料,小米17 ProMax更凭借独家的Real RGB(超级像素排列)技术,将色准还原、续航表现与…

2025-09-30

​卢伟冰谈小米17系列:开售次日热度不减,Pro版受追捧,背屏设计获认可​
日前,卢伟冰在微博谈到了小米17系列的销量。 卢伟冰透露,“三杯中Pro Max版本卖得最好。” 据小米手机官方微博消息,小米17全系开售5分钟,刷新了2025年国产手机全价位段新机系列首销全天销量、销额纪录…

2025-09-29

OPPO拟推手持云台相机入局,或以消费洞察优势重塑智能影像市场格局
2025年9月26日,界面新闻爆料称,OPPO将打造手持云台相机,对标GoPro、大疆等产品主导手持智能影像设备,该产品由Find产品规划部所属的智能影像团队负责,负责人为前Find系列GTM李阳。 据了解,…

2025-09-29

小米17系列相机再升级,“超级月亮”模式自动触发更便捷
【环球网科技综合报道】9月29日消息,小米相机部产品经理 @Bao_小李 发文回应了“是不是小米 17 Pro 和小米 17 的超级月亮模式删除了”这一问题。他表示,“答案是没有删除哈,并且月亮模式还变聪明了…

2025-09-29

DeepSeek-V3.2-Exp模型发布:稀疏架构助力长文本推理效率提升
【太平洋科技】9 月 29 日消息,深度求索公司正式发布 DeepSeek-V3.2-Exp 模型。据官方消息,这是一个实验性(Experimental)版本,旨在通过技术创新提升模型在处理长文本时的效率…

2025-09-29

AR眼镜价格下探场景拓展,科技龙头引领行业迈向千万级销量新时代
国内外科技企业正加速布局AR赛道,仅今年5月,即有联想集团的V1 AR智能眼镜,谷歌与XREAL合作的 Project Aura,雷鸟创新的雷鸟X3 Pro 全彩 AI+AR 眼镜等多个知名厂商的热门产品问…

2025-09-29

DeepSeek发布V3.2-Exp实验模型 引入稀疏注意力机制且API调用成本降超五成
IT之家 9 月 29 日消息,DeepSeek 今日正式发布 DeepSeek-V3.2-Exp模型,这是一个实验性(Experimental)的版本。 作为迈向新一代架构的中间步骤,V3.2-Exp 在…

2025-09-29

联想moto X70 Air官宣10月底登场:轻薄机身搭配AI功能引期待
据了解,2014年,联想以29.1亿美元收购摩托罗拉移动公司。2024年,moto品牌迎来复兴,其折叠屏手机在欧美市场大受欢迎。2025年Q1,moto在除中国以外的海外市场收入达34.2亿美元,同比激增1…

2025-09-29