猫眼电影
猫眼电影记者 张富铭 报道首次登录送91元红包
财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。
图为OpenAI官网截图
OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。
GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。
OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。
在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士
另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。
OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。
OpenAI给出的示例
除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。
横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。
GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5
OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。
从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。
作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。
公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。
图为奥尔特曼社媒发文截图
OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。
略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。
此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。
时事1:必威首页登陆
12月24日,中国北方开启冰雪季 “冷资源经济”初现,眼下,新一波高校利好集中到来,谁是大赢家?在近年“疯狂”建大学的浪潮下,那些努力多年的高教弱省,谁又能率先摘掉“洼地”标签?,凯发app怎么下载。
12月24日,改革者 正青春|这条“黄金通道”凭啥让人流口水?,5月10日,中新(西兰)两军在西安举行第11次战略对话。双方围绕共同关心的国际和地区问题坦诚交换意见,表达了共同致力于推动两军交流合作的积极意愿,增进了相互了解和信任。,正规买球平台有哪些,天博tb,pg电子网-官网。
时事2:有什么赌博的网站
12月24日,国家铁路局:采取切实有力措施 维护岁末年初铁路安全稳定,新京报讯 6月14日,据国务院国有资产监督管理委员会新闻中心官微“国资小新”消息,8户中央企业外部董事职务变动。,开云网页登陆,双赢棋牌官网版,博宝论坛。
12月24日,北京发改委主任杨秀玲谈2026年经济工作:加速布局6G、脑机接口等新赛道,靳东在“围猎”中丧失了应有的原则和底线,党的十八大后仍然“顶风作案”,情节严重、性质恶劣。,太阳娱APP,my188bet体育,澳门线上电子。
时事3:永利体育注册
12月24日,内塔尼亚胡与特朗普通话,【导读】因内幕交易等行为,昊海生科实际控制人之一蒋伟遭罚没约1934万元,线上赌博官网排名,澳门没有网投网站吗,沙巴体育线上怎么开户。
12月24日,宁夏2030年建成中国西部“低空经济特色应用示范区”,赵秀池表示,公摊面积是确实存在的,不管以什么形式计量,都是回避不了公摊面积的。而且楼层越高,公摊面积越大;住房质量越高,公摊面积越大。,开云网站是什么,永盛国际欧博真人,MG免费游戏试玩平台。
时事4:金宝博网站
12月24日,宁台青年福建霞浦以歌会友 用旋律续写“山海情缘”,这些消息自然也在日本社会掀起了相当程度的讨论,如日本知名国防记者小笠原理惠就在社交媒体上发帖表示“招募文身者、外国人等措施,看起来简直就是为在自卫队进行暴动或者政变(原文:クーデター)做准备,反倒是如果能够将整个自卫队成员的年收入统一提高100万日元的话,搞不好(应募员额)倒是能马上凑齐”。,12betAPP安卓,手机足彩滚球软件,太阳2体育。
12月24日,专家学者北京共话6G创新与应用:预计2030年商用,盛典之外,有无数开发者虽未站在聚光等下,但他们与鸿蒙始终站在一起。在《盛典之外》栏目中,来自多个领域的开发者向新浪财经讲述了他们的心路历程。这背后既有对国产操作系统情怀层面的支持,更有基于用户与市场的理性判断。,千亿app官网下载,深海捕鱼下载最新版现金版,yabo网站是多少。
责编:李谷建
审核:林平之
责编:董丽家












