搜索 猫眼电影 融媒体矩阵
  • 山东手机报

  • 猫眼电影

  • 大众网官方微信

  • 大众网官方微博

  • 抖音

  • 人民号

  • 全国党媒平台

  • 央视频

  • 百家号

  • 快手

  • 头条号

  • 哔哩哔哩

首页 >新闻 >社会新闻

GPT-5.2发布 OpenAI称其为"最强专业知识工作大模型"

2025-12-23 02:05:53
来源:

猫眼电影

作者:

屈林

手机查看

  猫眼电影记者 曹国永 报道首次登录送91元红包

财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。

图为OpenAI官网截图

OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。

GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。

OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。

在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士

另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。

OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。

OpenAI给出的示例

除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。

横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。

GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5

OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。

从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。

作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。

公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。

图为奥尔特曼社媒发文截图

OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。

略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。

此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。

 时事1:必威手机官网版

  12月23日,至少10名印尼籍、菲律宾籍等外佣在香港大埔火灾中丧生,[环球时报报道 记者 倪浩]8月3日,郑钦文夺得2024巴黎奥运会网球女单冠军,实现中国选手在该项目上的历史性突破,也点燃了民众参与网球运动的热情,网球热度随之大涨。接受《环球时报》记者采访的专家认为,体育明星与体育经济会形成正向反馈:体育明星的示范效应会提振相关体育产业、吸引更多人参与到运动中来,大众的广泛参与则会成为“未来明星运动员”诞生的基石。,百老汇网上注册。

  12月23日,吉林中部城市引松供水工程正式投运,截至目前,全国GDP三十强城市一季度经济数据已全部出炉,其中包括26座“万亿俱乐部”城市,以及唐山、徐州、大连、温州等4座“准万亿”城市。,捷报足球网,必威网页登录页面,体育在线365手机版。

 时事2:新宝5手机版登陆

  12月23日,单板滑雪平行项目世界杯美林站意大利、日本获男女冠军,(1)几千年来,古老的经典常读常新,杰出的思想常用常新,中华民族的伟大精神亘古常新……很多事物,在时间的淬炼中,愈显活力和价值。,亚赢体育官网下载,ayx在线注册,老版捕鱼达人1。

  12月23日,中国美术家协会青年设计人才培养计划“设计100”在穗启动,这些翻新机多来自深圳华强北,并非一般意义上的“山寨机”,更多是将小米、OPPO、vivo、三星等品牌的二手手机翻新。“从外观来看,翻新机也是新的,和新机差别不大。翻新机在非洲更受欢迎的主要原因还是低价,在华强北拿货只要两三百元人民币。而一部三四千元的国产新机换算成美元也要五六百美元,当地人还难以承受。”,电子游艺官网,华体育会app下载官网,ag娱乐平台娱乐官网。

 时事3:世界杯指定网站

  12月23日,哈尔滨采冰节启幕 千人唱号子“采头冰”,值得注意的是,两种模式并非截然对立,而是呈现出相互融合的趋势。香港正在打造的“国际黄金交易中心”正是这种融合思维的体现。,bbin官方版app,日博体育线上平台,球探网比分直播。

  12月23日,昆明各界人士纪念“一二·一”运动80周年,据中科曙光2023年报披露,李国杰作为董事长,2023年税前报酬总额为24万元,以此推算,80万元接近李国杰三年多的报酬。,实况2020欧洲杯,365bet体育分析预测,新甫京娱乐场游戏下载。

 时事4:财神棋牌 官方网站

  12月23日,龙舟队众桨托举救下落水小猫,4、存单利率的上限更加确定,下限需要视降息情况而定。边际来看,1月份资金和银行负债端表现可能对存单的快速下行形成一部分扰动,但考虑到央行可能的降准呵护,以及当前中长期流动性工具投放的价格,以及银行季节性配置存单资产等因素,CD利率至少不会显著上行。,沙巴体育网址是多少,买nba球赛用什么app,百老汇在线官网。

  12月23日,王毅:台湾地位已被“七重锁定”|一图看懂,经济学家指出,造成这两项数据下滑的原因多样,关税政策便是其中之一。,金沙网上网站,凯发娱乐网页版登录,大发开户网址。

责编:邓文良

审核:孙超美

责编:周卫健

相关推荐 换一换