猫眼电影
猫眼电影记者 张小舟 报道首次登录送91元红包
财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。
图为OpenAI官网截图
OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。
GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。
OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。
在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士
另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。
OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。
OpenAI给出的示例
除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。
横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。
GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5
OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。
从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。
作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。
公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。
图为奥尔特曼社媒发文截图
OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。
略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。
此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。
时事1:贝博app官方下载
12月25日,宁波通报患儿手术后离世 多人被处理,报道继续称,亚利桑那州一家无人机操控员协会的联合创始人格雷格·雷维迪奥近期就大疆无人机禁令对8000名无人机操控员进行了调查。调查结果显示,约43%的受访者认为禁令将对其公司造成“极其负面”或“可能导致公司倒闭”的影响;约85%的受访者表示,他们的公司可能只能维持两年或更短时间。,二八杠上活门下活门。
12月25日,“中国冷极”:万树“梨花”一夜绽,郭宁宁是第二十届中央候补委员,她此前担任福建省委常委、常务副省长、省政府党组副书记、省委金融工委书记。,足球比分大赢家,ayx爱游戏官网登录,新利188体育。
时事2:永利体育在线网
12月25日,高原“小北京”交通蜕变记:从“行路难”到“路路通”,要求:①自选角度,自拟标题; ②文体不限(诗歌除外),文体特征明显;,365足球直播官方网站,江南game体育,如何辨真假皇冠足球。
12月25日,宁波舟山港年集装箱吞吐量首次突破4000万标准箱,早在1992年,国家有关机构专门成立“渤海海峡跨海通道研究”课题组,开启桥梁、隧道比较论证。此后,国家有关部门,山东和辽宁有关部门,特别是有关高校科研院所的专家学者,不懈研究,各方面的研究成果不断涌现。,BV伟德安卓app下载,皇冠信用平台,凯时K66地址。
时事3:乐鱼全站官网下载
12月25日,经典对当下有什么样的传承意义和价值?,相关数据显示,包括Pilbara、ALB在内的主流矿企,资本开支峰值多数在2023年下半年触顶后持续回落。,网球比分,世界杯买球网站-知道,开云官方网站。
12月25日,【践行新发展理念 中国经济行稳致远】创新引领 新质生产力蓬勃生长,纪宁说,目前中国青少年网球尤其是女子青少年网球,已经成为体育职业化和商业化领域一个风口。郑钦文夺冠能促进更多中国青少年加入网球运动。与此同时,中国网球训练场地和比赛场地硬件条件以及软件设施也在发生巨大变化,网球经济蕴含的巨大空间也随之逐步释放出来。,90分钟足球网官网,manbetx网页版手机版登陆,bo体育官网登入。
时事4:澳门葡京导航
12月25日,重复使用运载火箭长征十二号甲发射入轨,在彼时新任董事长房文斌及其团队的领导下,聚焦于公司治理、市场化机制、战略转型和科技赋能等核心领域,成功使该公司实现了从连续亏损到持续盈利、从业务单一到多元发展的转变。2021年,国任保险保费规模突破100亿元,同比大增67.41%。,英国威廉希尔中文网站,金沙最新登录首页,开元官方网站。
12月25日,雄忻高铁阜平隧道顺利贯通,8月28日上午,中国煤矿文工团召开干部大会,宣布文工团领导任命决定。经文化和旅游部研究决定,任命靳东为中国煤矿文工团(中国安全生产艺术团)团长。,富易堂app下载,皇冠体育去哪里下载,篮球世界杯投注。
责编:徐明清
审核:叶文波
责编:耿辉












