猫眼电影
猫眼电影记者 伍尔福克 报道首次登录送91元红包
机器之心发布
机器之心编辑部
今年,文本生成领域迎来了从自回归(Auto-Regressive)向扩散语言模型(Diffusion LM)的重要范式转变。然而,长序列训练的不稳定性一直是制约扩散模型发展的核心痛点。上下文窗口限制使得模型在处理复杂的数学推理、编程任务,尤其是需要深度推理的「慢思考」场景时,显得捉襟见肘。
华为近日正式发布 openPangu-R-7B-Diffusion,基于openPangu-Embedded-7B 进行少量数据(800B tokens)续训练,成功将扩散语言模型的上下文长度扩展至 32K
在「慢思考」能力的加持下,该模型在多个权威基准中创下了 7B 参数量级的全新 SOTA 纪录:
多学科知识(MMLU-Pro):超越 16B 参数量的 LLaDA 2.0-mini-preview22%数学推理(MATH):得分,大幅领先同类模型。代码生成(MBPP):得分,展现出卓越的逻辑泛化能力。
Base模型链接:https://ai.gitcode.com/ascend-tribe/openPangu-7B-Diffusion-Base慢思考模型链接:https://ai.gitcode.com/ascend-tribe/openPangu-R-7B-Diffusion
接下来,我们将深入解析这款模型背后的技术革新。
1. 架构创新:
前文因果注意力掩码,自回归到 BlockDiffusion 的无缝迁移
openPangu-R-7B-Diffusion 在注意力机制上并未沿用传统扩散模型(如 LLaDA)的全注意力(Full Attention),也未采用 SDAR 或 Fast-dLLMv2 的分块掩码(Block Attention),而是创新性地融合了自回归的前文因果注意力掩码(Causal Attention Mask)。
这一设计从根本上解决了架构适配难题:
消除适配壁垒:以往将自回归模型适配至扩散模型,往往需要 Attention Mask Annealing 或 Shift Operation 等复杂操作来弥合差异。而 openPangu-R-7B-Diffusion 通过保留前文的因果注意力特性,使得模型仅需从「预测 Next Token」转变为「预测 Next Block 中的 Mask Token」,极大地降低了适配成本。兼容性最大化:该设计让模型能够自然继承自回归模型的预训练知识,为长窗口训练打下坚实基础。
2. 训练与推理:双模式解码与效率倍增
在训练策略上,openPangu-R-7B-Diffusion 延续了 BlockDiffusion 的思路(拼接带掩码的 Block 与无掩码的 Context),但进行了关键优化:
Context 利用率 100%:传统方法往往忽略无掩码 Context 部分的 Loss 计算,导致一半的数据被浪费。openPangu-R-7B-Diffusion 则将这部分数据用于标准的自回归 Next Token Prediction 训练。双模式解码:这种训练方式赋予了模型「自回归 + 扩散」的双重解码能力。用户可以通过不同的采样设置,灵活权衡生成质量与速度。极致性能:模型完整保留了变长推理与 KV-Cache 特性。在并行解码模式下,其速度最高可达自回归解码的2.5 倍
可视化实测:亲眼见证「慢思考」与扩散生成的融合
为了更直观地展示 openPangu-R-7B-Diffusion 的工作机制,我们对模型的推理过程进行了可视化处理。
在输入一道经典的数学逻辑推理题(Claire 的煎蛋问题)后,我们可以清晰地观察到扩散语言模型的独特生成方式:模型并非像传统自回归模型那样「逐词蹦出」,而是在 4 个生成步数(Generation Steps)内,并行地将多个 [MASK] 噪声逐步去噪还原为
、Claire、makes 等清晰的语义 Token。
图中首位的Token 尤为关键,它标志着模型正在启动我们前文提到的 「慢思考」模式。这种结合了扩散并行生成与深度思维链(Chain-of-Thought)的能力,正是 openPangu-R-7B-Diffusion 能够在数学和编程基准上大幅超越同类模型的核心原因。
结语:开启扩散语言模型的新篇章
openPangu-R-7B-Diffusion 的发布,不仅仅是一个新模型的开源,更是对「扩散模型能否处理复杂长文本」这一难题的有力回应。凭借其创新的因果注意力掩码架构,它成功证明了扩散模型不仅可以「快」(并行解码),更可以「深」(32K 长文与慢思考)。
值得一提的是,openPangu-R-7B-Diffusion 的训练、推理及评测全流程均在昇腾 NPU集群上完成,有力证明了国产算力在以前沿扩散语言模型领域的强劲实力。
时事1:苹果购买足球app
12月25日,重庆江南隧道主线建成通车,央行的黄金储备布局并非固定不变而是动态调整。部分央行会根据国际形势的变化,静默而缓慢地调整黄金的存放地。例如,德国在2013年-2017年,分批次从纽约和巴黎运回674吨黄金,采用了高度保密的物流方案。印度央行在2025年将其超过65%的黄金储备转移至国内存放。,电竞宝平台。
12月25日,3.6万人竞逐2025南宁马拉松 非洲选手破纪录夺冠,福特首席执行官法利在上周一的采访中直言:‘毫无疑问,政策对消费者的购车需求产生了巨大影响,归根结底,市场的基本面已经变了。’,九卅娱乐手机官网,美高梅app,升博官网登录。
时事2:新英体育欧洲杯版权
12月25日,安徽省反恐怖宣传教育活动启动,回溯近几年的公开信息,快手因违规内容引发的监管处罚与舆论争议从未间断。,充值抢庄牛牛,bbin体育登录在,开元体育英超。
12月25日,北京多项最新考古研究成果实证中华文明多元一体,本次吸收合并交易的现金对价港币24.60元/股,对复宏汉霖H股不受干扰交易日(即 2024 年 5 月 21 日)收盘价18.00港元的溢价为36.67%;对前30个交易日的溢价为52.04%。本次吸收合并现金对价合计不超过约54.07亿港元或等值人民币。,极跃体育官网,开博体育官网入口网址,新银河唯一官方网站。
时事3:日博365亚洲版软件
12月25日,天津退役军人完成造血干细胞捐献 为生命助力,哈萨克斯坦《时代报》不久前发表的文章《哈萨克斯坦与朋友一起前进》写道,哈外交部计划5月与中国签署一份政府间互免签证协定,这不仅将为哈萨克斯坦公民在各个领域的生活开辟更加广阔的前景,而且将进一步加强两国在“一带一路”倡议框架内的合作。,球探下载,杏耀官方下载,开元国际53ky最新版下载。
12月25日,巴西利美拉举办“中国文化日”,“中国始终恪守国际法基本原则和国际关系基本准则,坚持维护世界和平,促进共同发展,致力于推动构建人类命运共同体,在和平共处五项原则基础上同各国发展友好合作。”他说。,皇冠线上体育,AG真人网页版,新宝2网址手机。
时事4:优博娱乐平台官网总代
12月25日,韩军一基地发生炮弹爆炸,4人受伤,具体来看,今天,江西中东部、浙江南部、福建西部和北部、湖南南部、云南东南部、广西中北部、广东中北部以及吉林东部、辽宁东北部、山东南部等地部分地区有大到暴雨,其中,江西东部、福建西北部、广西东北部等地部分地区有大暴雨。,18新利体育官网 登录,飞驰娱乐,爱博app官方。
12月25日,报告预测:中国微短剧行业将在多维层面持续进化,AI热潮正重塑美国商业地产,数据中心建设支出明年有望超越写字楼,吸引了Blackstone、Brookfield及科技巨头超万亿美元的资金涌入。在单一租户依赖、严苛运营条款及电力供应挑战下,投资者的风险敞口达历史峰值。一旦AI需求回调或交付延误,这场豪赌将面临严峻考验。,kok手机版注册,PG电子游戏网址,ag百家官方网。
责编:唐西建
审核:周太王
责编:商衍瀛












