搜索 猫眼电影 融媒体矩阵
  • 山东手机报

  • 猫眼电影

  • 大众网官方微信

  • 大众网官方微博

  • 抖音

  • 人民号

  • 全国党媒平台

  • 央视频

  • 百家号

  • 快手

  • 头条号

  • 哔哩哔哩

首页 >新闻 >社会新闻

GPT-5.2发布 OpenAI称其为"最强专业知识工作大模型"

2025-12-26 07:30:12
来源:

猫眼电影

作者:

李育森

手机查看

  猫眼电影记者 温静 报道首次登录送91元红包

财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。

图为OpenAI官网截图

OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。

GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。

OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。

在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士

另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。

OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。

OpenAI给出的示例

除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。

横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。

GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5

OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。

从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。

作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。

公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。

图为奥尔特曼社媒发文截图

OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。

略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。

此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。

 时事1:365bet体育在线滚球

  12月26日,稳定重点群体就业 专家解读一系列政策红利,根据《一品红药业集团股份有限公司关于全资子公司获得丙戊酸钠注射用浓溶液注册证书的公告》(公告编号:2025-095),现予以公告。,真人秀的国际走势。

  12月26日,“十四五”以来贵州形成“一盘棋”的“大交通”格局,其二,金融主权意识增强的背景下央行黄金储备也出现了动态平衡。近年来的一个显著趋势是“黄金回家”。例如,德国从2013年起耗时四年从纽约和巴黎运回674吨黄金。印度、匈牙利、土耳其等国家近几年也开始将存在海外的黄金运回国内。这背后主要的驱动因素除了地缘政治的不确定性上升,也有各国金融主权意识的增强。,未来娱乐,电玩竞技场,金沙电玩城官方下载。

 时事2:雷速体育免费下载app

  12月26日,(经济观察)长三角托起中国民营经济关键一极,对于年龄上的放宽,不少司机纷纷发声支持,表示十分开心自己能多开几年车,既能增加点收入,也是一种精神寄托。,金沙体育APP,一定发app,真人版国际象棋游戏规则。

  12月26日,至少10名印尼籍、菲律宾籍等外佣在香港大埔火灾中丧生,“我们希望避免和防止出现现在的情况,但最坏的情况还是发生了,”当地官员路易斯·阿莱霍在社交媒体写道,“帕哈罗河河水午夜时分漫过并冲垮堤坝。”,腾博会,2026欧洲世界杯投注网,AG娱乐平台网。

 时事3:亚洲体育投注官网

  12月26日,“玲龙一号”全球首堆完成非核冲转试验,渤海湾沿岸是我国沿海重要经济中心之一。2023年,渤海湾两侧的山东和辽宁,GDP分别为9.2万亿元和3万亿元,总量在北方省份中居于第一梯队;而烟台和大连GDP分别为1.02万亿元和8752.9亿元。2023年,烟台首度跻身“万亿GDP”城市。,银河登录正网,亚博靠谱吗,必赢在哪注册。

  12月26日,香港特区政府举行南京大屠杀死难者国家公祭日纪念仪式,广东省肇庆市住房和城乡建设局近日发布《关于全市范围内商品房实行按套内面积计价宣传销售的通知》,提出从2024年5月1日起,实行按住房套内面积计价宣传销售。,世界杯彩票投注预测,万博manbetx手机登录注册,世界杯现金投注。

 时事4:最新彩金网址论坛

  12月26日,飞机“锁座”引争议 有偿选座被质疑 江苏省消保委已对10家航司展开调查,江西省委常委会、司法部党组召开会议:坚决拥护对唐一军审查调查,bbin游戏官方,完美国际赤帝晓纯真人秀,送体验金的网址。

  12月26日,从“蘸饺子必备”到“养生新宠” 老陈醋有了“新味道”,普京介绍了俄方有关看法和立场,表示俄方赞赏中方在乌克兰问题上秉持客观、公正、平衡立场,欢迎中方为政治解决乌克兰问题继续发挥重要建设性作用。俄方致力于通过政治谈判解决乌克兰问题,愿意展现诚意,并就此同中方继续保持密切沟通。,必发世界杯玩法,下载百姓彩票app,开心娱乐官方网站。

责编:李亿

审核:乌什尼娜

责编:楚人

相关推荐 换一换