搜索 猫眼电影 融媒体矩阵
  • 山东手机报

  • 猫眼电影

  • 大众网官方微信

  • 大众网官方微博

  • 抖音

  • 人民号

  • 全国党媒平台

  • 央视频

  • 百家号

  • 快手

  • 头条号

  • 哔哩哔哩

首页 >新闻 >社会新闻

GPT-5.2发布 OpenAI称其为"最强专业知识工作大模型"

2025-12-24 05:59:26
来源:

猫眼电影

作者:

杨根生

手机查看

  猫眼电影记者 严跃进 报道首次登录送91元红包

财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。

图为OpenAI官网截图

OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。

GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。

OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。

在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士

另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。

OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。

OpenAI给出的示例

除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。

横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。

GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5

OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。

从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。

作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。

公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。

图为奥尔特曼社媒发文截图

OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。

略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。

此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。

 时事1:真钱现场视讯

  12月24日,第二十二届全国催化学术会议在厦门召开 聚焦“守正与创新”,11月22日,黄埔轮胎(内蒙古)技术有限公司“航空胎产业基地项目”,进行环评公示。,聚力体育。

  12月24日,重庆多地12月16日起启动重污染天气黄色预警,“停止那些琐碎的胡扯。她只是在跟朋友打个招呼。那些觉得这个有问题的人才有问题。”,ibet365官网,OPE体育电竞,国际真人在线直播。

 时事2:m6网址

  12月24日,中国医保商保“双目录”发布,在核心项目与潜力项目路演环节,四个聚焦重大未满足临床需求的创新项目依次亮相。包括了眼科、肿瘤、代谢性疾病等行业热门治疗领域和技术路线。现场,来自泰格医药、和泽医药的临床与药学专家及多家基金代表,从临床价值、差异化竞争格局、关键数据里程碑与可行性评估等多维度进行提问与点评,为项目团队提供了具有可操作性的优化建议。,哪里可以玩pg电子,银河玖乐app,银河官网下载。

  12月24日,2025-2026赛季中国冰壶联赛总决赛开赛,报道称,有类似想法的还有杰森·科利普,他与大约300名房地产经纪人合作,负责拍摄房屋的航拍照片和视频。“我,一个在南部密西西比州操控无人机飞越松树林和房屋的小人物,为什么要限制这类活动呢?”科利普表示,“作为一名小企业主,我们还有什么其他选择?目前我们真的没有答案。”,澳门金沙电子官网,365bet足球真人,什么是mg游戏平台。

 时事3:美高梅平台网址手机版官网

  12月24日,习言道|中华民族伟大复兴的中国梦一定能够实现,此次二审稿充实完善了原产地制度规则的规定:完全在一个国家或者地区获得的货物,以该国家或者地区为原产地;两个以上国家或者地区参与生产的货物,以最后完成实质性改变的国家或者地区为原产地。国务院根据中华人民共和国缔结或者共同参加的国际条约、协定对原产地的确定另有规定的,依照其规定。,千赢游戏大厅官网入口,大游bg视讯厅是不是假的,威尼斯人线路一。

  12月24日,商务部新闻发言人就美针对无人机领域增列“不可信供应商清单”事答记者问,自2022年所罗门群岛与北京签署双边安全合作框架协议以来,美国及其地区盟友澳大利亚和新西兰一直对所谓中国在该地区“建立海军基地的野心”表示所谓“关心”。中国外交部就此事曾表示,中所安全合作不针对任何第三方。,最新送彩金导航,沙巴体育游戏登录,365app是什么。

 时事4:同乐城下载

  12月24日,拉萨火车站聚焦旅客出行 用心服务暖旅途,在业绩高增长的背景下,若市场化激励不足,可能引发核心管理团队与股东利益之间的激励不相容问题。一方面,公司需要具有竞争力的薪酬吸引和留住专业人才以驾驭复杂的投资与保险业务;另一方面,受限于国资股东背景和行业监管导向,其薪酬上限可能被压低。如何在此框架下建立有效的长期激励机制,避免因激励不足导致人才流失或追求短期风险行为,是北京人寿治理层面一个隐性却关键的挑战。,bwin世界杯玩法,国产牛牛,火狐体育官方网在线。

  12月24日,浙江杭州银龄教育更普惠,普华永道美国汽车行业负责人 C.J. 芬恩在接受采访时表示:‘多家美国车企均已宣布计提相关减值支出。此前,车企的布局不仅超前于消费者的真实需求,也远超美国当下的充电基础设施配套水平。’,凯发手机app下载,现金网站皇冠,聚星app下载。

责编:巴纳比杰克

审核:陈启祥

责编:刘道平

相关推荐 换一换