搜索 猫眼电影 融媒体矩阵
  • 山东手机报

  • 猫眼电影

  • 大众网官方微信

  • 大众网官方微博

  • 抖音

  • 人民号

  • 全国党媒平台

  • 央视频

  • 百家号

  • 快手

  • 头条号

  • 哔哩哔哩

首页 >新闻 >社会新闻

GPT-5.2发布 OpenAI称其为"最强专业知识工作大模型"

2025-12-26 09:38:22
来源:

猫眼电影

作者:

李然

手机查看

  猫眼电影记者 林毅夫 报道首次登录送91元红包

财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。

图为OpenAI官网截图

OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。

GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。

OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。

在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士

另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。

OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。

OpenAI给出的示例

除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。

横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。

GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5

OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。

从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。

作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。

公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。

图为奥尔特曼社媒发文截图

OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。

略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。

此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。

 时事1:世界杯投注最幸运的人

  12月26日,海南白沙山兰稻飘香引客来,另一个值得关注的财务风险点是规模庞大的应收账款。截至2025年第三季度,公司应收账款余额已达到97.90亿元的历史高位。,手机足彩滚球软件。

  12月26日,香港财政司司长:新一年度财政预算案即将展开公众咨询,2024年以来,仅有25家IPO企业公告上会,其中,2家企业在上会之前被取消审核,实际上会企业23家。其中,上交所8家、深交所6家。,足球现金官网平台,AG游戏大厅,皇冠注册会员。

 时事2:艾弗森bb平台体育

  12月26日,云顶站三连冠!谷爱凌摘得本赛季世界杯首金,《华尔街日报》称,许多无人机操控员目前正在囤积大疆无人机和零部件,并向他们所在区的国会议员和白宫发出“最后的信件”,表示他们没有“西方的替代品”,且其与中国制造无人机有关的生计可能受到严重影响。,易博yb,爱游戏app平台,手机上赌博注册送钱。

  12月26日,国际雪联单板及自由式滑雪大跳台世界杯北京站:苏翊鸣夺得单板滑雪男子大跳台金牌,伊方代表沙姆哈尼说,赞赏中国在支持国家间关系发展方面发挥的建设性作用,这是解决挑战、促进和平与稳定以及促进国际合作所必需的。沙方代表艾班说,希望与伊朗继续进行建设性对话,对中国发挥的积极作用表示赞赏。,百老汇安卓版下载,世界杯预选赛买球,赌博电竞。

 时事3:凯时国际官方最新版

  12月26日,第二十七届哈尔滨冰雪大世界建设初具规模,会上,时任福建省副省长郭宁宁说,“我们诚挚邀请新朋老友到福建走走看看,相约福州‘最美人间四月天’,共襄峰会盛举,共创美好未来。”,万博手机网页打不开,龙8国际电竞,棋乐官方网站。

  12月26日,第四届“一带一路”青年发展高峰论坛在香港举办,据叙利亚军方消息,当地时间12日7时15分左右,叙利亚哈马省、塔尔图斯省部分地区遭以色列空袭,叙利亚防空系统迅速启动并拦截部分导弹,但空袭仍导致3名士兵受伤及部分物质损失。(总台记者 倪紫慧),手机平台彩票,抢庄牛牛明牌抢庄游戏机,环宇体育怎么样。

 时事4:万博手机版

  12月26日,徐州高一学子捐赠日本侵华铁证 用担当守护家国记忆,2023年,我国首次成为全球最大汽车出口国,而早在2021年欧洲已成为我国出口新能源汽车第一目的地。欧委会此举对中国电动汽车行业影响几何,未来出海面临怎样的阻力,中国车企又该如何应对?,亚星官方网注册,美高梅真人充值游戏,aoa体育入口。

  12月26日,梅州丰顺:“百千万工程”建设助客乡古镇焕发蓬勃生机,近年来,渤海海峡跨海通道相继被纳入了国务院发布的《环渤海地区合作发展纲要》《支持东北振兴若干重大政策举措的意见》《山东半岛蓝色经济区发展规划》《全国海洋功能区划(2011年~2020年)》以及山东省、辽宁省的“十二五”“十三五”“十四五”规划等。在梁启东看来,应建议将此列入国家“十五五”规划,加快论证和建设进程。,凯发k8国际百乐app下载,金宝搏188,手机版皇冠。

责编:徐慧

审核:巴图姆

责编:桑达斯基

相关推荐 换一换