智快网
快讯 行业 产业 汽车 科技 AI+ 热点

苹果杜克联手,新“交错推理”法让大语言模型更聪明更快!

2025-05-31来源:ITBEAR编辑:瑞雪

近期,一项由苹果公司与杜克大学携手推出的创新强化学习方法“交错推理”,在人工智能领域掀起了波澜。该方法旨在显著增强大语言模型的推理能力,为复杂问题的解决提供了新的视角。

在探讨这一突破之前,我们不得不提及当前大语言模型在处理多步骤复杂问题时所面临的挑战。它们往往遵循一种线性的“思考-回答”模式,虽然逻辑清晰,但响应速度较慢,且在推理链的任一环节出错都可能影响最终答案的准确性。这种模式与人类的交流方式大相径庭,人类倾向于在思考过程中逐步表达想法,而模型则倾向于在完成整个推理后才给出答案,这在一定程度上限制了其效率和互动性。

为了打破这一僵局,“交错推理”应运而生。该方法的核心在于,在模型的推理过程中,巧妙地交替进行内部计算和输出中间答案的操作,从而大幅提升响应速度和实用性。为了实现这一目标,研究团队设计了一个基于强化学习的训练框架,其中嵌入了特定的指示标签,这些标签能够引导模型在达到关键推理节点时输出阶段性成果。

为了确保模型在追求局部输出效率的同时,不牺牲整体推理的准确性,研究团队精心构建了一套基于规则的奖励机制。该机制综合考虑了格式合规性、最终准确率以及条件性中间准确率等多个维度,以确保模型在推理过程中的每一步都能得到恰当的激励。

实验数据表明,“交错推理”在Qwen2.5模型(包括1.5B和7B参数版本)上取得了显著成效。与传统方法相比,该方法的响应速度提升了超过80%,推理准确率也提高了近19.3%。更令人振奋的是,尽管模型仅在问答类和逻辑类数据集上进行了训练,但它在MATH、GPQA和MMLU等更具挑战性的任务中也展现出了强大的泛化能力。

研究团队还尝试了多种奖励机制,包括全或无奖励、部分积分奖励及时间折扣奖励等。结果显示,条件性奖励和时间折扣奖励的效果最为突出,远远超越了传统训练方式。

“交错推理”的提出,不仅为提升大语言模型在复杂推理任务中的表现提供了一条切实可行的技术路径,也为未来模型的设计与优化提供了新的思路。这一创新成果无疑将推动人工智能领域向更加高效、智能的方向发展。

小米再拓欧洲版图:巴黎首家直营门店即将开业 开启法国市场新篇章
近日,小米法国副国家经理“产品逸飞”发文官宣,小米将在巴黎开设首家直营门店。针对网友提问“之前不是在香街有一个吗?”,他进一步回应称,该店为客户运营的授权店,后因疫情因素暂时退出市场。 此前,小米集团总裁卢…

2025-11-15

iPhone 17系列中国市场激活量破千万 性能升级受消费者青睐
【环球网科技综合报道】11月14日消息,据科技博主@数码闲聊站披露,苹果 iPhone 17 系列本周在中国市场的激活量已突破1000万台,创下该系列上市以来的阶段性销量新高,印证了中国消费者对其产品升级的认…

2025-11-15

荣耀500 Pro配置揭秘:骁龙8至尊版加持 8000mAh大电池续航无忧
8000mAh的大电池相较于上一代的7200mAh也是大升级,这个容量在同档位的机型中也是相当领先的。在这波大电池普及浪潮当中,荣耀后续还有望在其他机型上使用10000mAh电池,对续航要求高的用户需要密切关…

2025-11-14

百度文库网盘GenFlow3.0焕新升级,推出两大智能体,助力用户成“超级个体”且加速出海
基于GenFlow3.0,文库网盘在多产品矩阵中升级AI能力,帮助用户在工作、生活、学习上成为“超级个体”。基于百度文库全新能力,Oreate采用多智能体架构,能够端到端完成全场景、全模态创作,涵盖文档、P…

2025-11-14

GPT-5.1正式登场:从参数跑分到懂你交互,AI助手开启新未来
GPT-5.1 在风格化的另一大改进是,自定义指令现在能更可靠地,在多轮对话中坚持住,ChatGPT可以更稳定地,按照我们定义的个性来完成各项任务。 OpenAI 这次提供了后悔药,付费用户在 3 个月内…

2025-11-13

高通“一体双生”双旗舰战略持续推进 本月骁龙8 Gen5将亮相搭档8 Elite Gen5
【CNMO科技消息】11月12日,有数码博主爆料称,高通将长期保持“一体双生”双旗舰战略,即在同一代推出两款定位不同的旗舰级SoC。该博主表示,骁龙8 Gen5移动平台的安兔兔跑分高于骁龙8至尊版。 据CN…

2025-11-13

苹果携手三宅一生推iPhone Pocket,以独特设计诠释佩戴新乐趣
11月12日消息,据business insider报道称,苹果公司将与奢侈时尚品牌三宅一生(IsseyMiyake)联合推出一款特别版iPhone配件——iPhone Pocket。 三宅设计工作室总监宫…

2025-11-12

京东11.11手机销售成绩亮眼 鸿蒙以旧换新新品AI手机全线飘红
11月11日24点,京东11.11迎来圆满收官。超级供应链上的京东11.11,为消费者带来了“又好又便宜”的商品和服务,手机产品销量增长显著。数据显示,10月9日20点至11月11日24点,成交额破亿的手机单…

2025-11-12

“AI才女”罗福莉官宣加入小米,携手团队共筑AGI美好未来
罗福莉的职业生涯始于阿里巴巴达摩院,主导开发了多语言预训练模型VECO,并推动了AliceMind的开源工作。 此外,罗福莉在朋友圈提到的“XiaomiMiMo”是小米公司于2025年4月开源的首个推理大模型…

2025-11-12