棋牌百家乐,覆盖全网最新内容,实时更新不间断,精彩一手掌握

首页 >新闻 >社会新闻

华为新开源！扩散语言模型突破32K上下文，还解锁了「慢思考」

2025-12-23 06:50:52

来源：

猫眼电影

作者：

潘桂兰

手机查看

　　猫眼电影记者金紫胡报道首次登录送91元红包

机器之心发布

机器之心编辑部

今年，文本生成领域迎来了从自回归（Auto-Regressive）向扩散语言模型（Diffusion LM）的重要范式转变。然而，长序列训练的不稳定性一直是制约扩散模型发展的核心痛点。上下文窗口限制使得模型在处理复杂的数学推理、编程任务，尤其是需要深度推理的「慢思考」场景时，显得捉襟见肘。

华为近日正式发布 openPangu-R-7B-Diffusion，基于openPangu-Embedded-7B 进行少量数据（800B tokens）续训练，成功将扩散语言模型的上下文长度扩展至 32K

在「慢思考」能力的加持下，该模型在多个权威基准中创下了 7B 参数量级的全新 SOTA 纪录：

多学科知识（MMLU-Pro）：超越 16B 参数量的 LLaDA 2.0-mini-preview22%数学推理（MATH）：得分，大幅领先同类模型。代码生成（MBPP）：得分，展现出卓越的逻辑泛化能力。

Base模型链接：https://ai.gitcode.com/ascend-tribe/openPangu-7B-Diffusion-Base慢思考模型链接：https://ai.gitcode.com/ascend-tribe/openPangu-R-7B-Diffusion

接下来，我们将深入解析这款模型背后的技术革新。

1. 架构创新：

前文因果注意力掩码，自回归到 BlockDiffusion 的无缝迁移

openPangu-R-7B-Diffusion 在注意力机制上并未沿用传统扩散模型（如 LLaDA）的全注意力（Full Attention），也未采用 SDAR 或 Fast-dLLMv2 的分块掩码（Block Attention），而是创新性地融合了自回归的前文因果注意力掩码（Causal Attention Mask）。

这一设计从根本上解决了架构适配难题：

消除适配壁垒：以往将自回归模型适配至扩散模型，往往需要 Attention Mask Annealing 或 Shift Operation 等复杂操作来弥合差异。而 openPangu-R-7B-Diffusion 通过保留前文的因果注意力特性，使得模型仅需从「预测 Next Token」转变为「预测 Next Block 中的 Mask Token」，极大地降低了适配成本。兼容性最大化：该设计让模型能够自然继承自回归模型的预训练知识，为长窗口训练打下坚实基础。

2. 训练与推理：双模式解码与效率倍增

在训练策略上，openPangu-R-7B-Diffusion 延续了 BlockDiffusion 的思路（拼接带掩码的 Block 与无掩码的 Context），但进行了关键优化：

Context 利用率 100%：传统方法往往忽略无掩码 Context 部分的 Loss 计算，导致一半的数据被浪费。openPangu-R-7B-Diffusion 则将这部分数据用于标准的自回归 Next Token Prediction 训练。双模式解码：这种训练方式赋予了模型「自回归 + 扩散」的双重解码能力。用户可以通过不同的采样设置，灵活权衡生成质量与速度。极致性能：模型完整保留了变长推理与 KV-Cache 特性。在并行解码模式下，其速度最高可达自回归解码的2.5 倍

可视化实测：亲眼见证「慢思考」与扩散生成的融合

为了更直观地展示 openPangu-R-7B-Diffusion 的工作机制，我们对模型的推理过程进行了可视化处理。

在输入一道经典的数学逻辑推理题（Claire 的煎蛋问题）后，我们可以清晰地观察到扩散语言模型的独特生成方式：模型并非像传统自回归模型那样「逐词蹦出」，而是在 4 个生成步数（Generation Steps）内，并行地将多个 [MASK] 噪声逐步去噪还原为

、Claire、makes 等清晰的语义 Token。

图中首位的Token 尤为关键，它标志着模型正在启动我们前文提到的「慢思考」模式。这种结合了扩散并行生成与深度思维链（Chain-of-Thought）的能力，正是 openPangu-R-7B-Diffusion 能够在数学和编程基准上大幅超越同类模型的核心原因。

结语：开启扩散语言模型的新篇章

openPangu-R-7B-Diffusion 的发布，不仅仅是一个新模型的开源，更是对「扩散模型能否处理复杂长文本」这一难题的有力回应。凭借其创新的因果注意力掩码架构，它成功证明了扩散模型不仅可以「快」（并行解码），更可以「深」（32K 长文与慢思考）。

值得一提的是，openPangu-R-7B-Diffusion 的训练、推理及评测全流程均在昇腾 NPU集群上完成，有力证明了国产算力在以前沿扩散语言模型领域的强劲实力。

时事1：和记娱乐可靠吗

12月23日,日本本州东部附近海域发生7.5级地震：地震致33人受伤青森县14栋建筑受损,8月28日上午，中国煤矿文工团召开干部大会，宣布文工团领导任命决定。经文化和旅游部研究决定，任命靳东为中国煤矿文工团（中国安全生产艺术团）团长。,澳门永利贵宾厅。

12月23日,此行间·“不打领带”的友好交流，习近平向马克龙这样介绍中国“治”慧,今年36岁的李樟煜，已经在残疾人自行车项目征战多年。2012年伦敦残奥会，他第一次实现了残奥冠军梦。接下来，从里约到东京，再到巴黎，他带着梦想破风前行，每届残奥会都有金牌入账。据介绍，李樟煜获得的各类国际赛事奖牌已有50多枚。,cbin仲博v2登录入口,下分游戏厅,888真人体育APP。

时事2：英利在线赌博

12月23日,郁达夫之女忆父亲：“日本投降了，他却惨遭毒手！”,适度超前也有面向未来的考量。李瀚明表示，最近几年，国内长途旅行取代了一部分出国游的需求。西北是国内长途旅行的主要目的地之一，新疆、青甘大环线等热度居高不下。西北遥远，高铁也不发达，更依赖民航运输。此外，西安和乌鲁木齐还有建设国际航空枢纽的需要。,现金扎金花,亿博体育官方入口,澳门星际博彩招聘日。

12月23日,校准政绩考核“定盘星”,“有些地区出现了多个国际航空枢纽的格局。比如华南的广州、深圳，西南的成都、重庆、昆明，西北的西安、乌鲁木齐。但与成渝不同的是，西北地域辽阔，西安与乌鲁木齐距离非常远，两个枢纽生态位截然不同。”,凯发ag旗舰厅下载,365bet中文安卓客户端,易博平台。

时事3：贝博体育官网入口网址是多少

12月23日,北京市中学生与AI展开 “人机辩论”实战,[环球时报综合报道]“一段时间以来，比亚迪、吉利等中国自主品牌的崛起给不少外国汽车品牌带来压力。”美国CNBC网站18日报道称，美银证券汽车产业分析师约翰·墨菲当天在美国汽车媒体协会有关活动中表示，美国底特律三巨头（即通用汽车、福特汽车和斯特兰蒂斯）应“尽快”退出中国市场。他同时警告说，美国三大车企需要采取更严厉的措施削减开支，尤其是在内燃机业务方面，因为这是目前利润的主要来源。,365bet体育投注网址,环球外围官网,群友斗地主。

12月23日,票友荟萃“曲艺窝子” 同台展非遗曲艺画卷,在西宁之前，西安咸阳国际机场、兰州中川国际机场、乌鲁木齐天山国际机场的扩建工程，分别于今年2月、3月、4月投入正式运营。,金门电玩娱乐,在哪里下注世界杯,AG平台游戏。

时事4：澳门十三第娱乐场网址首页

12月23日,陈芋汐当选世界泳联2025年度最佳女子跳水运动员,进一步改进工作作风，严格要求自己，求真务实，真抓实干，坚持以人民为中心的创作导向，强化“国家队”意识，努力以优秀作品向着艺术“高峰”不断攀登。,天博官方平台,金沙官网登录,博狗体育官方平台。

12月23日,中越边城东兴塑新貌：烟火气中添“啡”凡滋味,当地时间8月29日，巴黎残奥会首个比赛日。在伊夫林省圣康坦自行车馆，中国队选手李樟煜上演了一场“速度与激情”。男子C1级3000米个人追逐赛资格赛，他以3：31.338的成绩刷新该项目世界纪录。决赛中，李樟煜状态火热，夺得金牌，这也是中国体育代表团在本届残奥会上获得的首枚金牌。另一位中国队选手梁伟聪摘得银牌，恭喜中国队包揽该项目金银牌！,极跃体育官方网站,威尼斯人线路一,2019年欧洲杯赛程直播。

【从一片树叶、一杯咖啡到美妆小瓶罐看小产品如何撬动大市场】

【网传“大个草莓是用了膨大剂”？真相是这样→】

责编：荣睿

审核：姚旅

责编：郑宗华