搜索 猫眼电影 融媒体矩阵
  • 山东手机报

  • 猫眼电影

  • 大众网官方微信

  • 大众网官方微博

  • 抖音

  • 人民号

  • 全国党媒平台

  • 央视频

  • 百家号

  • 快手

  • 头条号

  • 哔哩哔哩

首页 >新闻 >社会新闻

GPT-5.2发布 OpenAI称其为"最强专业知识工作大模型"

2025-12-25 06:22:25
来源:

猫眼电影

作者:

邓邵华

手机查看

  猫眼电影记者 穆巴拉克 报道首次登录送91元红包

财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。

图为OpenAI官网截图

OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。

GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。

OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。

在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士

另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。

OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。

OpenAI给出的示例

除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。

横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。

GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5

OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。

从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。

作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。

公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。

图为奥尔特曼社媒发文截图

OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。

略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。

此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。

 时事1:澳门国际app游戏平台

  12月25日,中国-孟加拉国板球友谊赛在杭举行 推动板球运动发展,福克斯新闻网8日以“吉尔·拜登和道格拉斯·埃姆霍夫因在拜登的国情咨文中令人尴尬的接吻走红:这正常吗”为题,报道称埃姆霍夫“更热烈”地欢迎了第一夫人,“两人都被看见用亲吻对方嘴唇的方式问候对方”。,贝博体育官网平台登录网址。

  12月25日,香港特区政府为火灾丧亲家庭提供精神健康支援,“当年李娜一度手握13个国内外知名品牌代言,而郑钦文在奥运夺冠之前已有10个代言品牌。”纪宁认为,网球目前在中国的热度已今非昔比,李娜时代已奠定的中国网球经济的热度,在郑钦文夺冠后会被逐渐引爆。纪宁还表示,网球作为全球顶级的职业体育和商业体育项目,正逐步释放巨大的产业经济空间。,尊龙登录,豪利棋牌正版,所有老虎机网站网址。

 时事2:168体育网页版

  12月25日,长三角海关聚力打造 “智慧+长三角” 品牌矩阵,午后,液冷服务器概念持续活跃,算力芯片概念震荡回升。截至收盘,英维克涨停,股价创历史新高,报103.84元/股,总市值为1014.1亿元。奕东电子、中光防雷、同飞股份“20CM”涨停。,澳门葡京导航注册,澳门金游戏城,千赢国际手机官网app。

  12月25日,旅游平台:元旦假期中国民众出行热,相比之下,同处珠三角的东莞经济明显回暖。一季度,东莞GDP达到2752.68亿元,同比增长5.5%,较去年同期回升3.3个百分点,其中规上工业增加值增速高达10.1%,表现亮眼。,2017博贝棋牌,优德体育中文app,leyu乐鱼快速开户。

 时事3:欧宝手机版

  12月25日,八件民生实事拼出2025上海幸福拼图,让城市进步可感可及,奥克塔伊表示,在救灾现场,有来自66个国家的搜救队,超过900台起重机,临时住宿区内人数已超过50万人。政府已经向受灾省份分发了大约10万顶帐篷,包括来自救灾部门、安全部队、红新月会、非政府组织、志愿者、卫生队等在内的救援人员总数为103800人,已搭建完成能容纳106万人的庇护所,目前物流运输方面运转正常,政府没有封闭道路。,电竞赌注,盛世网购彩,龙8官网long8。

  12月25日,云南澜沧县竹塘乡垃圾倾倒事件追踪:记者直击垃圾倾倒现场,斯托尔滕贝格此前2月1日在日本东京访问时,就反复渲染“中国挑战”。斯托尔滕贝格当时声称,“中国大陆对台湾的威胁没有正当理由,北约对中国大陆在台湾海峡的威胁性言论和胁迫性行为感到担忧,防止中国大陆使用军事力量至关重要。 ”,云顶官方网站,立博买球,beplar体育。

 时事4:bet356手机体育

  12月25日,国际货币基金组织上海中心正式开业,(观察者网讯)综合福克斯新闻、路透社等外媒11日报道,前总统特朗普任命的美国联邦法官凯尔·邓肯(Kyle Duncan)近日受邀为斯坦福大学法学院的学生们演讲时,因其在过往处置案件中表现出的反LGBT、反避孕等主张,遭到了数百名学生的当面辱骂和起哄以示抗议,致使演讲无法进行,气得他当场大骂抗议学生是“白痴”。,ManBetX万博在线登陆,体育云平台,明升体育下载地址。

  12月25日,小心被碱性食物营销忽悠 碱性食物对人体影响微乎其微,这一全面关税声明震动市场,为其第二任期的关税推进工作定下基调 —— 尽管他在图表中展示的多项针对特定国家的关税率,不久后便被暂停实施至 5 月,且在当年剩余时间里多次调整。,新濠天地手机网,pk10开奖直播,12bet平台网址。

责编:仲巴—噶尔

审核:王海亮

责编:黄捷

相关推荐 换一换