财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。
图为OpenAI官网截图
OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。
GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。
OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。
在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士
另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。
OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。
OpenAI给出的示例
除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。
横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。
GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5
OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。
从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。
作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。
公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。
图为奥尔特曼社媒发文截图
OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。
略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。
此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。
《bwinapp链接》,《首次登录送91元红包》opebet体育官方z
“188体育平台线上注册”
扫雷游戏下载
……
{!! riqi() !!}
“凯发娱乐电竞网”{!! reci() !!}
↓↓↓
{!! riqi() !!},广东清远庆祝盘王节 八方来客共享瑶族盛会,立丰国际真人密室,网上牛牛娱乐,亚冠2020赛程,世界杯威廉希尔投注网
{!! riqi() !!},好评中国丨中央经济工作会议首提“内外贸一体化”,广东如何接招,365BET,澳门百老汇app,百老汇网址是多少,ag在线官网开户
{!! riqi() !!},全国劳模李晶:用15载青春“托起”老人幸福“夕阳”,雷速体育旧版,龙8体育开户,2020欧洲杯开幕式时间,网上游戏厅官网
{!! riqi() !!}|共探金融支持科技创新路径 科创金融研究中心在沪成立|全民开心捕鱼最新版下载|云顶娱乐平台网页版官网|ob欧宝最新地址|赌搏网址
{!! riqi() !!}|海南自由贸易港封关在即 海警开展全天候执法演练|沙巴SB体育app|ayx赌场网站|天博网页版登录不了|博狗体育平台
{!! riqi() !!}|国家级非遗代表性传承人孙婉容:传拳法更要传文化之魂|凯发K8旗舰厅App下载|葡京app平台|乐鱼可靠吗|扑克王haobc……
{!! riqi() !!},中国氢动力多旋翼无人机创飞行最长吉尼斯纪录,2020中超球队名单,真人梦幻国际棋牌,365bet现金信誉,可打现金的麻将平台
{!! riqi() !!},香港特区政府总部下半旗向大埔宏福苑火灾罹难者志哀,bbin新体育开户,体球比分网即时比分,美高梅集团网站是多少,下载凯时AG首页
{!! riqi() !!}|农工党十七届四中全会在京开幕|在线美高梅下注|AG亚洲登陆|ope电竞体育|打牌软件炸金花
{!! riqi() !!},以 “小托育” 暖 “大民生” 广西力推普惠托育服务扩容提质,网赌app苹果版,体育官网app,赢博体育官网入口,中欧官网入口vip登陆
{!! riqi() !!},中国西南地区青铜文明特展在广西南宁启幕,欢乐斗牛牛,看世界杯的网站大全,10bet注册,彩票站有世界杯投注
{!! riqi() !!},中国大学地球系统科学联盟在北京启动 院士专家共商发展大计,抢庄斗牛5块可玩的,赌博手机app下载,娱乐一卡通充值,365bet体育滚球外围
{!! riqi() !!}|首届文明互鉴国际论坛发出“澳门倡议”|体育网站投注|百佬汇娱乐城|ca88官网|360速发app
{!! riqi() !!}|江苏东海:车辆起火 环卫车变“消防车”紧急灭火|金顶棋牌|ag真人靠谱网站|博弈娱乐登录地址|和记娱乐世界杯买球
{!! riqi() !!}|患者成素材?医疗科普泛娱乐化不可取!|最好比分网|bepla体育官网|365bet官网平台网址|火狐体育官网|平台
{!! reci() !!},{!! reci() !!}|湖南人均预期寿命提升至79岁 个人卫生支出占比降至27.38%|18luck新利官网app|金莎网网址|云顶娱乐官网下载app|国际音标 高考真人发言
监制:邓金木
策划:赖晗
主创:唐征宇 林箴贺 陈佛烘 颜亦阳 陈林韵
编辑:王家菁、段圣祺