搜索 猫眼电影 融媒体矩阵
  • 山东手机报

  • 猫眼电影

  • 大众网官方微信

  • 大众网官方微博

  • 抖音

  • 人民号

  • 全国党媒平台

  • 央视频

  • 百家号

  • 快手

  • 头条号

  • 哔哩哔哩

首页 >新闻 >社会新闻

对标美国行业巨头,“所有群聊都炸锅了”

2025-12-28 10:46:44
来源:

猫眼电影

作者:

张文举

手机查看

  猫眼电影记者 阳安江 报道首次登录送91元红包

【文/观察者网 阮佳琪】

深度求索(DeepSeek)新品重磅发布,再度引爆AI圈。12月1日,中国人工智能(AI)初创企业DeepSeek推出两款正式版模型:DeepSeek-V3.2和DeepSeek-V3.2-Speciale。

据介绍,DeepSeek-V3.2定位“平衡实用”,其在主流推理基准测试中达到美国OpenAI的GPT-5水平;而在推理能力上大幅增强的DeepSeek-V3.2-Speciale,则在推理基准测试中取得了媲美谷歌深度思维11月下旬刚推出的新一代AI模型“双子座3专业版”(Gemini 3.0 Pro)。

DeepSeek还透露,其V3.2-Speciale版本在国际数学奥林匹克竞赛(IMO 2025)、国际信息学奥林匹克竞赛(IOI 2025)等均斩获金牌级表现。这一成绩直接对标行业巨头,此前仅有OpenAI和谷歌深度思维未对外公开的内部测试模型达成过这一成就。

香港《南华早报》2日报道指出,这一来自开源实验室的技术突破再次引发AI研究领域的广泛热议,尤其DeepSeek此次上新恰逢“AI界的奥斯卡”——2025年神经信息处理系统大会(NeurIPS)召开前夕。

作为当前全球最负盛名的机器学习和AI研究领域顶尖学术会议之一,NeurIPS大会每年举办一次,被中国计算机学会列为A类会议,在谷歌学术发布的全球学术期刊和会议影响力排名中位列第7,与国际机器学习会议(ICML)、国际学习表征会议(ICLR)并称为AI领域难度最大、水平最高、影响力最强的三大会议,代表着当今机器学习与AI领域的最高水平。

尽管向来行事低调的DeepSeek尚未公布是否会派员参会,但正在圣地亚哥参加NeurIPS大会的弗洛里安·布兰德(Florian Brand)已难掩兴奋。

这位专门研究中国开源AI生态系统的专家告诉港媒,如果DeepSeek的研究人员现身会场,大概率会引发高度关注。

他还透露:“DeepSeek发布新模型的消息一出,今天所有相关交流群都炸开了锅。(All the group chats today were full after DeepSeek’s announcement)”

港媒还提到,本届NeurIPS大会首次采用双会场形式,在美国加州圣地亚哥和墨西哥首府墨西哥城同步举办。这一安排主要源于主办方对国际研究人员获取美国签证可能遇阻的担忧,目前已有许多中国参会者选择前往墨西哥城会场参会。

DeepSeek-V3.2及其同类产品的基准测试。截图自DeepSeek技术报告

据官方介绍,DeepSeek-V3.2定位平衡推理能力与输出长度,适合日常使用,例如问答场景和通用智能体任务场景。在公开的推理类基准测试(Benchmark)中,V3.2达到了GPT-5的水平,仅略低于Gemini-3.0-Pro;相比Kimi-K2-Thinking,V3.2的输出长度大幅降低,显著减少了计算开销与用户等待时间。

DeepSeek评价称,V3.2“在智能体评测中达到当前开源模型最高水平”,大幅缩小了开源模型与闭源模型的差距,且未针对测试工具进行特殊训练。此外,该模型还是DeepSeek推出的首个将思考融入工具使用的模型,并且同时支持思考模式与非思考模式的工具调用。

DeepSeek-V3.2-Speciale则为“极致推理”而生,是V3.2的长思考增强版,同时结合了DeepSeek-Math-V2 的定理证明能力,以探索模型能力的边界。该模型具备出色的指令跟随、严谨的数学证明与逻辑验证能力,在主流推理基准测试上的性能表现媲美Gemini-3.0-Pro。

更令人瞩目的是,V3.2-Speciale成功斩获国际数学奥林匹克(IMO 2025)、中国数学奥林匹克(CMO 2025)、国际大学生程序设计竞赛全球总决赛(ICPC World Finals 2025)及国际信息学奥林匹克(IOI 2025)金牌。其中,ICPC与IOI成绩分别达到了人类选手第二名与第十名的水平。

目前,DeepSeek官方网页端、App和API均已更新为正式版V3.2。Speciale版本目前仅以临时API服务形式开放,以供社区评测与研究。相关模型已开源。

截图自DeepSeek技术报告

与两款新模型同步发布的,还有配套的技术报告。谷歌深度思维的首席研究工程师苏珊·张(Susan Zhang)在社交媒体上对此给予好评,称赞报告内容详尽,同时肯定了这家初创企业在模型训练后稳定性优化及智能体能力提升方面的努力。

彭博社指出,这一成果已清晰表明,中国开源AI系统至少在部分核心指标上,已经与硅谷顶尖专有模型具备同等竞争力。

美媒进一步解读称,此次新品发布也释放出一个重要信号:继今年1月推出突破性模型颠覆AI领域后,这家颇具影响力的AI实验室正持续加大研发力度,致力于提升AI运算的速度与效率,力求巩固其在中国AI赛道中的领先优势。

就在上周,DeepSeek刚发布了开源模型DeepSeek-Math-V2,该模型展现出强大的数学定理证明能力。

开源AI初创公司Hugging Face的联合创始人兼首席执行官克莱门特·德朗格(Clement Delangue)在社交平台X上盛赞道,“想象一下,你可以免费拥有世界上最优秀数学家之一的大脑。”

他强调,用户可以不受限制地探索、微调、优化这款中国AI模型,并在自有硬件上运行,“没有任何公司或政府可以收回它。这正是AI和知识民主化的最佳体现。”

“据我所知,此前没有任何聊天机器人或API能让你接触到一个IMO 2025金牌水平的模型。”德朗格补充说。

另据英国《金融时报》上周报道,美国麻省理工学院(MIT)和Hugging Face的一项研究发现,过去一年,中国团队开发的开源AI模型下载量占比上升至17%,超过了美国开发团队的15.8%。这是中国团队首次在这一指标上超越美国同行,取得AI技术全球应用中的关键优势。

在席卷全球科技行业的AI热潮之中,美国OpenAI、谷歌和Anthropic等科技巨头倾向于“封闭”策略,保持对先进AI技术的完全掌控,通过用户订阅和企业合作等方式获利。与之相比,中国科技公司倾向于更加开放的策略,发布了一系列开源模型。

德国智库墨卡托中国研究中心的高级分析师温迪·张(Wendy Chang)指出,“比起美国,开源在中国更像是一种主流趋势。美国公司不愿这样做,它们依靠这些高估值赚钱,不想公开自己的商业机密。”

根据MIT和Hugging Face的数据,DeepSeek和阿里云的Qwen是下载量最多的中国开源模型。《金融时报》称,DeepSeek-R1模型震惊了硅谷,该模型使用的成本和算力很低,但性能足以与美国顶尖模型比肩,引发各界对于美国AI实验室是否还能保持竞争优势的质疑。

MIT研究员谢恩·隆普雷(Shayne Longpre)表示,中国科技公司正在改变AI模型发布的范式,许多中国公司每周或每两周发布一次模型,并提供多种版本供用户选择。相比之下,美国科技公司往往每六个月或一年才发布一系列模型。

业内人士告诉《金融时报》,尽管美国出台了芯片出口管制等一系列打压措施,但中国拥有大量优秀人才,他们在开发开源模型的过程中展现出极强的创造力。

“当美国AI实验室押注于通过推动智能突破来获取巨额利益的同时,中国的开源模型竞争者更专注于推动AI的广泛应用,”《经济学人》总结道,“如果他们成功,DeepSeek的冲击可能仅仅只是一个开始。”

本文系观察者网独家稿件,未经授权,不得转载。

 时事1:天博综合体育官方app下载

  12月28日,香港民众哀悼遇难者:“千言万语也道不尽心中感受”,适度超前也有面向未来的考量。李瀚明表示,最近几年,国内长途旅行取代了一部分出国游的需求。西北是国内长途旅行的主要目的地之一,新疆、青甘大环线等热度居高不下。西北遥远,高铁也不发达,更依赖民航运输。此外,西安和乌鲁木齐还有建设国际航空枢纽的需要。,极速彩网址。

  12月28日,日本群马县多车相撞致2人死亡26人受伤,其三,大多数央行实际上采用混合策略,平衡便利性和安全性。例如,尽管中国绝大部分黄金储备放在国内,但也会因国际交易需要,在国际清算银行等机构托管少量黄金。,金沙网址,AG旗舰厅,电竞比赛在哪里押注。

 时事2:永乐国际AG旗舰厅手机客户端

  12月28日,残特奥会游泳比赛收官 四十余项全国纪录被刷新,靳东在基层奋斗了11年后,33岁开始担任县级领导干部,40岁时成了县政府“一把手”,是大家谈论和羡慕的对象。,电竞游戏竞猜平台,ManBetX万博官方下载,微信可以投注世界杯吗。

  12月28日,中央港澳办协调应急管理部等中央有关部门继续为香港救灾工作提供协助和支援,在伦敦市场,大量的黄金交易是以“非实物移动”的方式完成。因为当一家央行从对手方买到黄金时,这些金条可能并不发生物理位置的转移,而只是在清算系统内部发生了所有权转移。,188排球比分网,he乐8,千赢在线平台下载。

 时事3:金沙手机电子游戏app

  12月28日,河南三门峡发现45座古墓葬,“哪怕是批发生意,当地人进货时都有一个习惯,就是一旦认准某位店员,就会反复从他那里拿货,一位店员销售业绩主要取决于他积累的客户资源。每个柜台都会有一位本地员工,他可能还会带一位徒弟,往往是这位店员的亲戚。”彭昌国坦言,凡是新员工都需要一段时间积累客源。,世界杯官网下注,怎样在手机上买足球,国内最大的棋牌游戏平台。

  12月28日,【好评中国】“老砖瓦”里,何以澎湃“新消费”?,随着住房交易进入存量市场和买房市场,多地政府和开发商开始主动做出改变。近年来,为了提振购房者信心,减少买房顾虑,合肥等地提出“积极探索按套内面积计价”,山东等地则提出“公摊面积需在合同中明确标准”。另有受访的业界人士表示,目前,已有多地开发商开始主动选择“按套内面积”的计价模式,进行住房销售。,bet娱乐平台,雷速体育数据怎么分析,百老汇体育首页。

 时事4:真人炸金花软件

  12月28日,从童话鹿苑到冬捕盛宴 伊春冰雪季开启“冰火”新玩法,这是2022年2月航天员叶光富在中国空间站演奏《月光下的凤尾竹》的“名场面”。时隔2年多,叶光富再次飞天,这次他将会带另外一种乐器前往空间站。,BBIN体育直播安卓版,世界杯买球拟c77。tv,天博游戏账号注册。

  12月28日,中央宣传部、退役军人事务部、中央军委政治工作部联合发布“最美退役军人”,周觉担任过外交部部长助理、国务院新闻办公室副主任等职,曾是中国驻土耳其大使、驻法国大使。,九五至尊网投手机下载,世界杯竞猜投注玩法,开云外围官网。

责编:郑钺

审核:耿标

责编:吴卫

相关推荐 换一换