搜索 猫眼电影 融媒体矩阵
  • 山东手机报

  • 猫眼电影

  • 大众网官方微信

  • 大众网官方微博

  • 抖音

  • 人民号

  • 全国党媒平台

  • 央视频

  • 百家号

  • 快手

  • 头条号

  • 哔哩哔哩

首页 >新闻 >社会新闻

GPT-5.2发布 OpenAI称其为"最强专业知识工作大模型"

2025-12-25 15:26:13
来源:

猫眼电影

作者:

张骥

手机查看

  猫眼电影记者 陈竺 报道首次登录送91元红包

财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。

图为OpenAI官网截图

OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。

GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。

OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。

在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士

另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。

OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。

OpenAI给出的示例

除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。

横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。

GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5

OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。

从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。

作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。

公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。

图为奥尔特曼社媒发文截图

OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。

略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。

此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。

 时事1:那个正规平台可以买球

  12月25日,五部门完善免税店政策“满月”:扩大免税政策享惠范围 满足多元化消费,出于安全考量,欧盟以及乌克兰官方至今没有披露泽连斯基访问的具体行程。一星期前,多名欧盟领导人到访乌克兰,泽连斯基在会晤中再次呼吁加快吸纳乌克兰加入欧盟的进程。,足球投注在哪投。

  12月25日,青海义务教育学生营养餐补助 51.31万名学生受益,(2)本周存单收益率低位稳定,周中枢比上周略下行1.50BP:①主要买盘是国有行和农商行,主要卖盘是股份行、保险和货基;②本周银行略买入,非银参与诉求较弱,银行资金相对充沛,买入较多。,百人牛牛的软件,开元棋牌官网,大丰国际彩票平台。

 时事2:bet365网址是多少

  12月25日,2个能延寿的日常小习惯,做起来真的超简单,投中嘉川CVSource数据显示,今年以来中国CVC参与投资事件有1138条,占全年一级市场总投资事件比例为11.24%。不过目前的“独角兽”企业中,获得中国CVC投资比例高达33.07%,体现CVC模式较高的“命中率”。,深海捕鱼下载最新版现金版,天博在哪开户,必赢亚洲体育官网app。

  12月25日,南京高校师生创排话剧《生命》首演 铭记历史珍爱和平,2018年7月,经原银保监会批复,两江金融将其4亿股股份转让给联美量子,两江金融退出,联美量子持股5.8亿股,比例上升至19.333%,为历年来国任保险民营股权最大占比。,打鱼1000炮,澳门金沙官方网,九五至尊网页版。

 时事3:棋牌赚钱2020

  12月25日,下足“绣花”功夫托起民生“温度” 行之有效实招促民增收为城市消费注入活力,三是苦练风控能力。多资产、多策略模式下,风险具有隐蔽性、滞后性与传染性,未来需构建具备穿透性、前瞻性、敏捷性的全面风险管理体系,有效应对各类潜在风险。,九游会平台网站,188金宝傅体育,世界杯 在线投注。

  12月25日,北京交通效能再升级 京密高速新国展段及远通桥新匝道将于28日通车,村民刘一鸣(化名)常年在沿海地区打工,妻子钱清花在老家种水田、带孩子。最近,刘一鸣查询国家企业信用信息公示系统,发现妻子也被莫名其妙登记了营业执照。日期是2011年8月16日,登记机关为“大悟县市场监督管理局”,营业执照类型为“个体工商户”。,真钱直营官方网站,澳门威斯尼斯人下载安装,威尼斯人平台。

 时事4:世界杯投注规则是什么

  12月25日,甘肃采用多项新技术摸清风能太阳能资源“家底”,12月22日,亿纬锂能在惠州仲恺高新区举办“钠电池及AI创新园区”动工仪式,计划打造亿全新的亿纬钠能总部和金源机器人AI中心。,世界杯在那下注,manbet赞助,炸金花下载手机版。

  12月25日,理响中国・学习问答(第二季) | 第七集:坚持以人民为中心的创作导向,(2)(货基 + 理财子)日均融出有所回落至0.39万亿元(前值0.65万亿元),其中货基日均融出回落至0.80万亿元(前值0.98万亿元),理财日均融出-0.41万亿元(前值-0.33万亿元);(3)资金面延续宽松,主要非银机构(券商、保险、基金、产品户等)均增加融入。,威尼斯线上网站,永乐国际勇往直前的路上,新365bet。

责编:廖永国

审核:闫磊

责编:兰熙

相关推荐 换一换