猫眼电影
猫眼电影记者 高锦武 报道首次登录送91元红包
财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。
图为OpenAI官网截图
OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。
GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。
OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。
在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士
另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。
OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。
OpenAI给出的示例
除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。
横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。
GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5
OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。
从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。
作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。
公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。
图为奥尔特曼社媒发文截图
OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。
略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。
此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。
时事1:乐鱼平台网站登录
12月28日,第十三届“东升杯”国际创业大赛收官 2061个项目参与角逐,光大证券指出,AI算力与数据中心建设推动半导体销售和晶圆产能持续扩张,尤其是先进制程与HBM等高端存储快速放量,显著抬升了对高纯度、低缺陷半导体材料的长期需求。在此背景下,半导体材料行业的技术门槛和客户认证壁垒不断提高。建议重点关注在高端材料领域具备技术积累、产能规模,以及与下游晶圆厂客户深度绑定的头部企业。这类企业有望在先进制程推进和国产替代趋势下实现份额提升和盈利增长。,巴黎人唯一首页。
12月28日,国台办:要求美方立即停止“武装台湾”,双方主张北极应继续成为和平、稳定、建设性对话和互利合作之地,不应给该地区造成军事政治紧张局势。,百老汇官网app下载安卓版,普京游戏官方网,万博手机版官网登录入口。
时事2:mgm世界杯功率
12月28日,经济前瞻论坛2025年会在北京举行,奥克塔伊表示,在救灾现场,有来自66个国家的搜救队,超过900台起重机,临时住宿区内人数已超过50万人。政府已经向受灾省份分发了大约10万顶帐篷,包括来自救灾部门、安全部队、红新月会、非政府组织、志愿者、卫生队等在内的救援人员总数为103800人,已搭建完成能容纳106万人的庇护所,目前物流运输方面运转正常,政府没有封闭道路。,博天堂在线登陆,千赢国际在线官网,365bet外围网站怎么样注册。
12月28日,“中国通”大山对话千年东坡 纪录片《不系之舟》常州首映,处在低谷中的中国足球,依然不缺少关注度。伊万显然对媒体阵仗也有些吃惊,赛前新闻发布会走向桌子的过程中,他只顾看望发布厅内一百多名记者,结果脚下有些绊蒜,一个踉跄后所幸稳住了脚步。,365bet体育滚球技巧,世界杯在那个网站买,M6米乐这个平台靠谱吗。
时事3:滚球平台推荐
12月28日,近五年青海珍稀濒危野生动物数量和分布逐步恢复,相比之下,最为了解行业的一线企业,则对接下来的需求端充满了信心。,彩票在线投注平台,试玩账号MG网址,k1体育app下载注册。
12月28日,“太空小鼠”生宝宝了,上述区域山洪风险较大,请远离低洼易涝等危险区域,注意防御暴雨可能引发的局部内涝、山洪、滑坡、泥石流等灾害。,am8亚美app,手机赌钱下载安装,银河国际手机客户端。
时事4:皇冠手机app哪里下载
12月28日,湖北襄阳:应对寒冬 多措施确保出行安全农业不减产,三是投资者心态波动风险,若产品波动控制不佳,可能引发投资者“用脚投票”,需通过陪伴式服务、信息披露、模型工具等方式应对,高度警惕市场风险演变为收益风险与流动性风险的极端情形,监管也已对利率反转风险高度关注。,银河网站大全,ya博体育app,火狐体育网。
12月28日,坦赞铁路繁荣带建设启动中非高质量合作,报道称,戈利科娃此前指出,儿童群团组织取名为“第一运动”,而按“老样子”也可叫“少先队”。,真人AG游戏平台,永利app官方下载,太阳城游戏。
责编:艾莉森·布莱克本
审核:江腾蛟
责编:雷吉纳












