搜索 猫眼电影 融媒体矩阵
  • 山东手机报

  • 猫眼电影

  • 大众网官方微信

  • 大众网官方微博

  • 抖音

  • 人民号

  • 全国党媒平台

  • 央视频

  • 百家号

  • 快手

  • 头条号

  • 哔哩哔哩

首页 >新闻 >社会新闻

GPT-5.2发布 OpenAI称其为"最强专业知识工作大模型"

2025-12-29 10:12:34
来源:

猫眼电影

作者:

王志鸿

手机查看

  猫眼电影记者 陈怡萱 报道首次登录送91元红包

财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。

图为OpenAI官网截图

OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。

GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。

OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。

在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士

另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。

OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。

OpenAI给出的示例

除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。

横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。

GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5

OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。

从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。

作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。

公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。

图为奥尔特曼社媒发文截图

OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。

略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。

此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。

 时事1:尊来国际人生就是博app

  12月29日,专家:脑机接口技术将最终实现碳基生物智能与硅基算力的融合,“产业结构转型升级是佛山的当务之急,但我认为它的难点在于如何把自身与广州的关系处理好,如果甩开广州独立发展,也很困难。”宋丁提醒:“一季度增速1.1%,对佛山是一种深深的刺激,但是刺激之后能不能警醒起来?如果不认真考量背后的原因,找出根源,然后赶紧去弥补的话,可能对未来发展都是非常不利的。”,鸭脖www。

  12月29日,美团骑手化解燃气泄漏风险 平台速发“好人好事奖”和现金奖励,不过,同处珠三角的核心城市广州境遇却大不相同。一季度,广州经济增速在GDP十强城市中垫底,身后的重庆则凭借6.2%的经济增速再次实现反超。从规上工业增加值增速来看,广州、重庆分别为0.1%、8.6%,工业增长的动能迥异。,掌上棋牌官网版旧版本,pg电子注册就送,2019可以买球的app。

 时事2:365bet在线体育

  12月29日,借“黔货出海”通道, 内蒙古谋划农畜产品出口东南亚,展望2026年,深圳楼市仍有大量项目待入市。据深圳中原研究中心统计,2026年深圳潜在入市住宅项目达156个,多集中在龙华、宝安、龙岗、南山等区域。其中不少位于核心区域,如南山中心区的金桃园大厦二期、前海的湾涛世纪公馆等。部分项目已是现房/准现房状态,为市场提供了更多选择。,凯时kb88手机客户端下载,GD电子钻石狂热,2026世界杯正规买球。

  12月29日,平遥古城2025年接待游客超千万人次,韩国国务调整室曾于4月16日发布政府部门联合新闻稿,重申日本福岛核污染水排海计划需从科学、客观层面确保安全性,并符合国际标准的既有立场。,海洋之神快速入口,赢钱游戏软件下载,鸿博体育官方下载。

 时事3:炸金花APP下载

  12月29日,商业航天,从发射场到“三链协同”,据《星岛》了解,亿纬锂能AI机器人项目运营主体为全资子公司惠州金源智能机器人有限公司(曾用名:惠州金源智能机器人有限公司)。该公司长期为亿纬锂能各大产业园打造智能设备、智能装备及智能体,积累了深厚的AI技术储备与丰富的工业场景落地经验。,环亚下载,排球世界杯怎么投注,有黑客能进私彩修改数据吗。

  12月29日,深市重大资产重组年内超百单 “产业并购+新质生产力”特征明显,李东明:男,1971年1月出生。2017年7月加入国任保险,任执行董事、党委副书记、工会主席、董事会秘书。2024年10月任董事会秘书。曾任深圳市建业股份有限公司工业发展部投资管理科科长,深圳市建设投资控股公司经济师、资产管理部副部长,深圳市国资委产权管理处助理研究员、领导人员管理处副处长,深圳市投资控股有限公司人力资源部部长、董事会秘书、董事会办公室主任。,必赢亚洲客户端下载,环亚国际真人娱乐官网,bet365在线官网。

 时事4:什么样的牌型可以抢牛牛庄

  12月29日,户外探索纪实节目《探索新境》第二季开播,还有人写道,“我不相信白宫说的任何话,不过他们一旦否认,那就是另一回事了,往往后来它们都能100%得到证实。”,OD娱乐官网,滚球体育平台官网,牛牛抢庄模式规则。

  12月29日,彭博报告:人工智能战略将推动中国生产力提升,2018年11月,房文斌担任国任保险党委书记,彼时根据公开信息徐兴建职位仍为董事长。2019年4月,房文斌董事长任职资格获批,徐兴建卸任。,588平博,欧陆娱乐官网网站,伟德体育app。

责编:陈钰以

审核:林家佑

责编:李宁原

相关推荐 换一换