搜索 猫眼电影 融媒体矩阵
  • 山东手机报

  • 猫眼电影

  • 大众网官方微信

  • 大众网官方微博

  • 抖音

  • 人民号

  • 全国党媒平台

  • 央视频

  • 百家号

  • 快手

  • 头条号

  • 哔哩哔哩

首页 >新闻 >社会新闻

GPT-5.2发布 OpenAI称其为"最强专业知识工作大模型"

2025-12-25 04:01:29
来源:

猫眼电影

作者:

侯大宝

手机查看

  猫眼电影记者 基金—— 报道首次登录送91元红包

财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。

图为OpenAI官网截图

OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。

GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。

OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。

在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士

另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。

OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。

OpenAI给出的示例

除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。

横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。

GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5

OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。

从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。

作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。

公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。

图为奥尔特曼社媒发文截图

OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。

略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。

此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。

 时事1:现金网游戏

  12月25日,2型糖尿病有哪些危害?如何管好血糖?一图了解,11月16日召开的“第十届动力电池应用国际峰会”上,赣锋锂业董事长李良彬预计,2026年需求端增长30%至190万吨,供应端保持同步增长,整体处于供需平衡状态,但是如果需求增速超过30%,甚至达到40%,短期内供应无法平衡,价格可能会突破15万元/吨,甚至20万元/吨。,ope体育下载a。

  12月25日,患者成素材?医疗科普泛娱乐化不可取!,4月24日出版的《中国纪检监察报》在第七版刊文《贪乱心志 欲迷人眼》,剖析了四川省阿坝州人民政府原副秘书长靳东严重违纪违法案。,皇冠体育首页官网,手机版亚洲城客户端下载不了怎么办,凯发娱乐体。

 时事2:免费牛牛

  12月25日,云南金平欢庆建县40周年 各族民众盛装巡游,——深化科技交流。发挥基础研究和应用研究领域合作潜力,拓展大科学装置框架下合作,支持共建现代化实验室与先进科研中心,维护两国科技发展主动权,促进人员交流,开展跨学科气候变化研究。,安博电竞app,欧亚国际网上娱乐下载,永利集团全部网址。

  12月25日,福建漳州举办世界闽南文化创新发展研讨会,尤其是受富士康影响,郑州外贸遭遇较大困境的背景下,以文旅撬动消费市场的快速回升对于郑州稳经济至关重要。“文旅在郑州目前的产业结构中,占比是偏低的,在优化产业结构的过程中,提升文旅产业的比重是必要的。”在宋向清看来,河南作为文旅资源大省,文旅产业大省,整体上面临大而不强的问题,而在未来河南包括郑州的经济结构调整中,文旅产业的地位将会越来越突出。,1万股权上市后值多少钱,飞鱼电竞下载,王者体育网站。

 时事3:火狐体育最新版下载

  12月25日,西藏当雄牧民140公里冬夏转场路,国家体育总局体育文化与体育宣传发展战略研究中心高端智库骨干专家、广州体育学院教授曾文莉告诉《环球时报》记者,体育具有较强的杠杆效应,以体育赛事表演为杠杆,能撬动城市基建、旅游、文化等,激活体育消费热情,推动体育产业能级提升,而这个杠杆的原动力主要是运动员尤其是明星运动员。,大赢家有几个网站,米发,雷火电竞官网入口。

  12月25日,泉州古城:半城烟火半城仙,第二部分,其实我和郑总不谋而合。他刚提到低空经济,我也以此为例。低空经济被看好是万亿市场,飞机、轮船、工程机械、高端装备制造等传统领域已是老生常谈。站在2025年,我们更关注创新业务。如果能在新兴业务上做得好,传统业务自然不在话下。,Ballbet体育平台贝博bb平台,365足彩外围网下载,波肖门尾最佳公开版。

 时事4:世界杯买球地址伽fc3_tv

  12月25日,“中国鲍鱼之乡”福建连江:科技赋能“吃透一粒鲍”,谭克非:我们坚决反对美方向中国台湾地区出售武器。美方行径粗暴干涉中国内政,严重违反一个中国原则和中美三个联合公报特别是“八一七公报”规定,严重损害中国主权和安全利益,严重威胁台海和平稳定。中方对此强烈不满,已向美方提出严正交涉。,188羽毛球比分直播,bet365手机版登录,升博体育。

  12月25日,感受“深圳质感” 看“未来已来”:国际人士触摸科技浸润下的城市温度,王新利:男,1969年2月出生。曾任民安财险董事长兼总经理;亚太财险副董事长兼总裁。2017年11月起任国任保险执行董事,2017年12月起任合规负责人,2018年4月起任总裁。,环球国际开户,纬来体育最新地址,财经时报。

责编:成蕙琳

审核:王景辉

责编:嘉悦

相关推荐 换一换