搜索 猫眼电影 融媒体矩阵
  • 山东手机报

  • 猫眼电影

  • 大众网官方微信

  • 大众网官方微博

  • 抖音

  • 人民号

  • 全国党媒平台

  • 央视频

  • 百家号

  • 快手

  • 头条号

  • 哔哩哔哩

首页 >新闻 >社会新闻

对标美国行业巨头,“所有群聊都炸锅了”

2025-12-26 11:18:34
来源:

猫眼电影

作者:

西蒙·杨

手机查看

  猫眼电影记者 邓宁 报道首次登录送91元红包

【文/观察者网 阮佳琪】

深度求索(DeepSeek)新品重磅发布,再度引爆AI圈。12月1日,中国人工智能(AI)初创企业DeepSeek推出两款正式版模型:DeepSeek-V3.2和DeepSeek-V3.2-Speciale。

据介绍,DeepSeek-V3.2定位“平衡实用”,其在主流推理基准测试中达到美国OpenAI的GPT-5水平;而在推理能力上大幅增强的DeepSeek-V3.2-Speciale,则在推理基准测试中取得了媲美谷歌深度思维11月下旬刚推出的新一代AI模型“双子座3专业版”(Gemini 3.0 Pro)。

DeepSeek还透露,其V3.2-Speciale版本在国际数学奥林匹克竞赛(IMO 2025)、国际信息学奥林匹克竞赛(IOI 2025)等均斩获金牌级表现。这一成绩直接对标行业巨头,此前仅有OpenAI和谷歌深度思维未对外公开的内部测试模型达成过这一成就。

香港《南华早报》2日报道指出,这一来自开源实验室的技术突破再次引发AI研究领域的广泛热议,尤其DeepSeek此次上新恰逢“AI界的奥斯卡”——2025年神经信息处理系统大会(NeurIPS)召开前夕。

作为当前全球最负盛名的机器学习和AI研究领域顶尖学术会议之一,NeurIPS大会每年举办一次,被中国计算机学会列为A类会议,在谷歌学术发布的全球学术期刊和会议影响力排名中位列第7,与国际机器学习会议(ICML)、国际学习表征会议(ICLR)并称为AI领域难度最大、水平最高、影响力最强的三大会议,代表着当今机器学习与AI领域的最高水平。

尽管向来行事低调的DeepSeek尚未公布是否会派员参会,但正在圣地亚哥参加NeurIPS大会的弗洛里安·布兰德(Florian Brand)已难掩兴奋。

这位专门研究中国开源AI生态系统的专家告诉港媒,如果DeepSeek的研究人员现身会场,大概率会引发高度关注。

他还透露:“DeepSeek发布新模型的消息一出,今天所有相关交流群都炸开了锅。(All the group chats today were full after DeepSeek’s announcement)”

港媒还提到,本届NeurIPS大会首次采用双会场形式,在美国加州圣地亚哥和墨西哥首府墨西哥城同步举办。这一安排主要源于主办方对国际研究人员获取美国签证可能遇阻的担忧,目前已有许多中国参会者选择前往墨西哥城会场参会。

DeepSeek-V3.2及其同类产品的基准测试。截图自DeepSeek技术报告

据官方介绍,DeepSeek-V3.2定位平衡推理能力与输出长度,适合日常使用,例如问答场景和通用智能体任务场景。在公开的推理类基准测试(Benchmark)中,V3.2达到了GPT-5的水平,仅略低于Gemini-3.0-Pro;相比Kimi-K2-Thinking,V3.2的输出长度大幅降低,显著减少了计算开销与用户等待时间。

DeepSeek评价称,V3.2“在智能体评测中达到当前开源模型最高水平”,大幅缩小了开源模型与闭源模型的差距,且未针对测试工具进行特殊训练。此外,该模型还是DeepSeek推出的首个将思考融入工具使用的模型,并且同时支持思考模式与非思考模式的工具调用。

DeepSeek-V3.2-Speciale则为“极致推理”而生,是V3.2的长思考增强版,同时结合了DeepSeek-Math-V2 的定理证明能力,以探索模型能力的边界。该模型具备出色的指令跟随、严谨的数学证明与逻辑验证能力,在主流推理基准测试上的性能表现媲美Gemini-3.0-Pro。

更令人瞩目的是,V3.2-Speciale成功斩获国际数学奥林匹克(IMO 2025)、中国数学奥林匹克(CMO 2025)、国际大学生程序设计竞赛全球总决赛(ICPC World Finals 2025)及国际信息学奥林匹克(IOI 2025)金牌。其中,ICPC与IOI成绩分别达到了人类选手第二名与第十名的水平。

目前,DeepSeek官方网页端、App和API均已更新为正式版V3.2。Speciale版本目前仅以临时API服务形式开放,以供社区评测与研究。相关模型已开源。

截图自DeepSeek技术报告

与两款新模型同步发布的,还有配套的技术报告。谷歌深度思维的首席研究工程师苏珊·张(Susan Zhang)在社交媒体上对此给予好评,称赞报告内容详尽,同时肯定了这家初创企业在模型训练后稳定性优化及智能体能力提升方面的努力。

彭博社指出,这一成果已清晰表明,中国开源AI系统至少在部分核心指标上,已经与硅谷顶尖专有模型具备同等竞争力。

美媒进一步解读称,此次新品发布也释放出一个重要信号:继今年1月推出突破性模型颠覆AI领域后,这家颇具影响力的AI实验室正持续加大研发力度,致力于提升AI运算的速度与效率,力求巩固其在中国AI赛道中的领先优势。

就在上周,DeepSeek刚发布了开源模型DeepSeek-Math-V2,该模型展现出强大的数学定理证明能力。

开源AI初创公司Hugging Face的联合创始人兼首席执行官克莱门特·德朗格(Clement Delangue)在社交平台X上盛赞道,“想象一下,你可以免费拥有世界上最优秀数学家之一的大脑。”

他强调,用户可以不受限制地探索、微调、优化这款中国AI模型,并在自有硬件上运行,“没有任何公司或政府可以收回它。这正是AI和知识民主化的最佳体现。”

“据我所知,此前没有任何聊天机器人或API能让你接触到一个IMO 2025金牌水平的模型。”德朗格补充说。

另据英国《金融时报》上周报道,美国麻省理工学院(MIT)和Hugging Face的一项研究发现,过去一年,中国团队开发的开源AI模型下载量占比上升至17%,超过了美国开发团队的15.8%。这是中国团队首次在这一指标上超越美国同行,取得AI技术全球应用中的关键优势。

在席卷全球科技行业的AI热潮之中,美国OpenAI、谷歌和Anthropic等科技巨头倾向于“封闭”策略,保持对先进AI技术的完全掌控,通过用户订阅和企业合作等方式获利。与之相比,中国科技公司倾向于更加开放的策略,发布了一系列开源模型。

德国智库墨卡托中国研究中心的高级分析师温迪·张(Wendy Chang)指出,“比起美国,开源在中国更像是一种主流趋势。美国公司不愿这样做,它们依靠这些高估值赚钱,不想公开自己的商业机密。”

根据MIT和Hugging Face的数据,DeepSeek和阿里云的Qwen是下载量最多的中国开源模型。《金融时报》称,DeepSeek-R1模型震惊了硅谷,该模型使用的成本和算力很低,但性能足以与美国顶尖模型比肩,引发各界对于美国AI实验室是否还能保持竞争优势的质疑。

MIT研究员谢恩·隆普雷(Shayne Longpre)表示,中国科技公司正在改变AI模型发布的范式,许多中国公司每周或每两周发布一次模型,并提供多种版本供用户选择。相比之下,美国科技公司往往每六个月或一年才发布一系列模型。

业内人士告诉《金融时报》,尽管美国出台了芯片出口管制等一系列打压措施,但中国拥有大量优秀人才,他们在开发开源模型的过程中展现出极强的创造力。

“当美国AI实验室押注于通过推动智能突破来获取巨额利益的同时,中国的开源模型竞争者更专注于推动AI的广泛应用,”《经济学人》总结道,“如果他们成功,DeepSeek的冲击可能仅仅只是一个开始。”

本文系观察者网独家稿件,未经授权,不得转载。

 时事1:世界杯买球有发财的嘛

  12月26日,外媒:关税政策引发经济不确定性 美国劳动力市场状况恶化,欧盟中国商会同时指出,欧方在调查中还未能充分履行透明度的有关要求,对于所谓补贴如何造成欧盟产业实质损害或者损害威胁的调查,相关信息不公开,不透明,让各方对调查方法、路径以及结果都怀有强烈质疑。,上游棋牌官网。

  12月26日,文脉延续三十载 西湖文化研讨会纪念活动在杭州举行,“中国+中亚五国”合作机制发展迅速。“中国+中亚五国”外长会晤已举办四次,谋划了中国-中亚农业合作中心、丝绸之路考古合作研究中心、传统医学中心、鲁班工坊等惠民项目。2022年1月25日,中国与中亚五国共同宣布打造中国-中亚命运共同体。2022年6月8日,在“中国+中亚五国”第三次外长会晤上,双方决定建立“中国+中亚五国”元首会晤机制,举行元首定期会晤。,线上赌博形式有哪些,2021年万博全站app,365体育娱乐下载。

 时事2:天下精英

  12月26日,特奥赛场上,陪伴是最温柔的胜利,后天,江南大部、四川南部、云南东北部、贵州大部、华南中北部等地部分地区有中到大雨,其中,湖南东部、江西中北部、浙江中南部、福建北部、广西东北部等地部分地区有暴雨或大暴雨。,kb体育平台怎么样,巴黎人的网站是多少,博鱼官网登录入口。

  12月26日,中国、瑞典医学专家团队携手发布全球首个《婴儿前庭功能筛查国际专家共识》,LeoLabs5月9日在推特上发帖称:“自2022年8月4日发射以来,我们观察到多次提高飞航天器轨道高度的大型演习,以及重复部署、编队飞行和卫星物体J(NORADID 54218)的对接的有关动作。我们已经确定,测试航天器2(指可重复使用试验航天器)具有推进能力,并与目标J进行了近距离操作,包括至少两次或可能三次捕获/对接操作。”,盛唐棋牌游戏,世界杯买球怎么稳赢,澳门九五至尊电玩平台。

 时事3:斗地主棋牌游戏赚钱

  12月26日,湖北农业博览会启幕 现场签约逾244亿元,CF40资深研究员、中国社科院世界经济与政治研究所副所长张斌表示,一季度实际GDP增速超出全年目标,名义GDP增速过低,经济增长的获得感偏弱,对未来的预期偏弱。,环球电竞,mg官网电子游戏,体球网手机即时比分。

  12月26日,江山如画|科技赋能低空业态 气象预警筑牢飞行安全,集训前几天来到沈阳的媒体人数还不多,晚上公开训练前伊万还非常友好地与媒体记者握手打招呼,看上去一片祥和气氛。,体彩世界杯购买方式,利来国际真人娱乐平台895959.com,IM体育。

 时事4:亚新官方网站

  12月26日,北京交通部门多措并举应对入冬首场降雪,BBC称,如果这架无人机真的属于乌克兰,这将是自俄乌冲突爆发以来,乌克兰对俄罗斯发动的一系列袭击中,距离俄首都莫斯科最近的一次,但乌克兰方面并未公开承认这架无人机与自己有关。,bob娱乐体育平台官网入口,欧洲杯赛程2018,世博体育app下载官网。

  12月26日,香港漳州同乡总会会长郭绿明:“内地同胞对受灾民众的关心令人感动”,此外,还有网友称赵菊英并非视频中宣传的退休老师,而是“被辞退”。对此,嘉峪关市教育局工作人员回应极目新闻记者称,赵菊英于2023年从该市某小学退休,针对网友们反映的问题,教育局将介入调查。,乐动体育买球,怎么看世界杯投注,欢乐捕鱼人官方最新版。

责编:多丽丝

审核:刘学建

责编:尹广军

相关推荐 换一换