猫眼电影
猫眼电影记者 李佳玲 报道首次登录送91元红包
财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。
图为OpenAI官网截图
OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。
GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。
OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。
在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士
另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。
OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。
OpenAI给出的示例
除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。
横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。
GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5
OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。
从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。
作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。
公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。
图为奥尔特曼社媒发文截图
OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。
略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。
此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。
时事1:亿博体育正规吗
12月27日,辽宁:“老民俗”碰上“新消费” 激活冬季“热动能”,全球储能需求持续高增长下,电池巨头亿纬锂能(维权)(300014.SZ)再启扩产新动作。,皇冠官网app下载。
12月27日,大学生在广泛的社会实践中求真知:社会课堂,考卷没有标准答案,每经AI快讯,12月23日,居然智家公告,公司于2025年12月22日召开第十二届董事会第一次会议,选举王宁先生为董事长,任期三年,自本次董事会审议通过之日起至第十二届董事会任期届满之日止。,鲨鱼机游戏,大嬴家比分网,哪里能赌欧洲杯的钱。
时事2:365游戏大厅安卓版
12月27日,2025出版品牌影响力大会揭示“子品牌”爆发式增长新趋势,个险渠道受行业“清虚”和“报行合一”冲击,渠道成本控制和产能提升压力大。,换三张斗地主,买球网平台注册,火狐体育APP。
12月27日,青藏高原隆升何以造就烟雨江南?中国团队最新研究揭晓答案,比如,根据珠海市自然资源局3月初印发的《关于印发优化规划管理助力高质量发展若干措施的通知》,优化完善房屋计容建筑面积计算规定。增加多种不计容建筑面积情形,包括公共开放空间的交通附属设施;既有房屋增设必要的消防楼梯、连廊、无障碍设施、电梯等。支持商业服务业建筑按层集中设置不超过该层水平投影面积5%的公共半开敞空间,按其水平投影面积一半计算计容建筑面积。,乐鱼网址,pg电子麻将胡了网页版,火狐体育网。
时事3:im体育和沙巴体育区别
12月27日,《疯狂动物城2》成为中国内地影史进口片单日票房冠军,鸿蒙的快速成长与发展,不只是一家企业的成果,更是中国科技产业在关键领域自主创新、自力更生的一个缩影。此次盛典,让我们看到了国产操作系统发展背后,那股源自千行百业、万千开发者的的磅礴力量。无数个“我”汇聚,便成了“我们”,“聚是一团火,散是满天星”是无数鸿蒙合伙人最真实的写照。,怎样在手机上买足球,官方手机赌钱官网,K8凯发官网登录。
12月27日,“对不起,人工座席目前全忙……”转人工客服,为何这么难?,郭宁宁曾长期在中国银行工作,历任中国银行金融市场总部总经理,香港分行行长,新加坡分行行长等职。,老手换新账号网赌,888真人足球,深度揭秘AG杀猪真相。
时事4:至尊捕鱼电玩
12月27日,2025“黄土亲·草原情”联欢晚会在悉尼举行,大家中午好,我们是一家科技公司,我今天发言的主题是“融资租赁业务系统,赋能租赁业务转型发展”。其实今天上午几位嘉宾也说过了,所有的想法、所有落地的方案,事实上现在都需要科技赋能。所以我们现在就做这么一件事情。我今天从三个方面和大家做一个分享。,365bet体育足球注册,365足球体育app下载,捕鱼达人单机版。
12月27日,陕西首趟“长安·天路”进藏班列亮相,外交部副部长孙卫东就中国东盟关系、美国在菲律宾部署中导等答记者问,美高梅客户端,ysb体育平台,世界杯免费网站。
责编:程颜鑫
审核:艾买提·吐尔迪
责编:王玮伟












