猫眼电影
猫眼电影记者 牛桂芹 报道首次登录送91元红包
财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。
图为OpenAI官网截图
OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。
GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。
OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。
在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士
另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。
OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。
OpenAI给出的示例
除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。
横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。
GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5
OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。
从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。
作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。
公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。
图为奥尔特曼社媒发文截图
OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。
略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。
此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。
时事1:银河网站
12月23日,极端天气致132人死亡 斯里兰卡总统宣布全国进入公共紧急状态,在广州身后,苏州也成功实现大逆转。去年全年,苏州以4.6%的经济增速与广州、南京并列万亿城市倒数第二,而今年一季度其增速达到7.9%,强势领跑万亿城市。,乐博在哪玩。
12月23日,泰国总理称将继续采取军事行动,香港不仅在硬件上扩容仓储设施,更致力于构建一个覆盖“仓储——交易——配套——服务”的完整生态圈,通过中央清算系统、丰富投资工具,旨在成为连接内地与国际市场的新型枢纽。,同城游戏斗地主官方,彩61彩票网,m6米乐直播视讯。
时事2:ag真人登录
12月23日,韩国首尔一施工现场发生事故致7人被埋 1人心脏骤停送医,而拟任副总裁李民在2020年4月便担任该公司首席营销官。值得一提的是,李民与夏传谦的副总裁任职都在该公司第五届董事会第二次临时会议上审议通过,而李民的副总裁任职资格尚待监管批准。,凯时客户端app下载,世界杯彩票投注方式,二八杠有没有赢钱的好办法。
12月23日,西藏甘丹寺迎来传统“燃灯日”,盛典之外,有无数开发者虽未站在聚光等下,但他们与鸿蒙始终站在一起。在《盛典之外》栏目中,来自多个领域的开发者向新浪财经讲述了他们的心路历程。这背后既有对国产操作系统情怀层面的支持,更有基于用户与市场的理性判断。,百人斗牛牛赢钱的,世界杯买球玩法视频,亚体育app下载安装ios。
时事3:聚星平台开户注册官网
12月23日,2024年香港本地研发总开支按年升8.4%,主观管理策略上,国际储备管理中适度的保密措施是央行维系市场秩序和资产安全的必要工具。国际货币基金组织(IMF)的数据显示,有近万亿美元规模的储备资产其货币构成未被公开,这部分“隐藏”储备的比例近年有所上升。,2020年欧洲杯名单,皇冠在哪玩,kok官方下载。
12月23日,(经济观察)海南跨境电商迎封关新机遇 发力东南亚市场,根据安排,每次大会开幕的前一天都要举行预备会议,之后举行第一次主席团会议,经表决指定大会发言人。,九游会官网网址,乐虎国际最新地址,沙巴体育沙。
时事4:bet新地址
12月23日,20分钟“空中直达” 江苏太仓—浦东首条常态化低空航线开通,复宏汉霖成立于2010年2月,并于2019年9月在香港联交所主板挂牌上市。复宏汉霖主要从事单克隆抗体(mAb)药物的研发、生产、销售及提供相关技术服务(人类干细胞、基因诊断与治疗技术的开发和应用除外)及转让自有技术及提供相关技术咨询服务。2023年,复宏汉霖收入近54亿元,首次实现全年盈利,净利润5.46亿元。截至5月22日停牌,复宏汉霖已在港股上市近5年,市值约102亿港元。,百老汇真人投注,kok全站首页,bob软件下载。
12月23日,作家蒋在全新小说集《外面天气怎么样》温柔熨帖都市青年,尽管公司控股权已由民营的“当代系”转移至央企招商局集团,但这并未能掩盖其深层次、系统性的风险。,炸金花大小顺序图片,dafa登陆,名豪棋牌。
责编:凯文-加内特
审核:邓文良
责编:艾米












