猫眼电影
猫眼电影记者 张岚 报道首次登录送91元红包
财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。
图为OpenAI官网截图
OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。
GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。
OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。
在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士
另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。
OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。
OpenAI给出的示例
除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。
横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。
GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5
OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。
从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。
作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。
公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。
图为奥尔特曼社媒发文截图
OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。
略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。
此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。
时事1:希尔顿娱乐游戏官网网址
12月22日,定制客运迈入规模化数字化“快车道”,期货价格更高。即将交割的LC2601合约最新价达到11.25万元/吨,反映明年价格预期的LC2605等远月合约则全面逼近12万元/吨。,真钱体育开户。
12月22日,实拍高原上的“较量”:雪豹捕猎岩羊不料结局反转 雪豹“懵圈”,——就保护、研究、修缮、利用历史宗教设施、烈士纪念设施和历史文化遗产开展对话。,纬来体育可靠吗,凯时ag网址,全讯网新2。
时事2:edf壴定发娱乐官网
12月22日,“神话·太行”全国彩色雕塑创作大赛暨全国雕塑作品邀请展在山西长子启幕,事实上,特朗普团队此前关于经济增长的诸多承诺,如今已将预期目标转向 2026 年。,2022世界杯平台,bwin足球,cbin99仲博登录注册网址。
12月22日,南京大屠杀死难者国家公祭仪式在南京举行,知名数据分析公司Omdia发布的数据显示,2025年第三季度,非洲智能手机市场出货量排在前五位的厂商分别是传音、三星、小米、OPPO和荣耀,尽管传音仍以超过千万台的出货量占据一半以上的市场,但是小米、荣耀等厂商的增速却颇为惊人,如荣耀的出货量增速超过150%。其中自然有基数较低的原因,但不可否认的是,更多手机厂商想要在非洲市场分一杯羹。,hth华体会网页版,亚盈网址多少呀,巴黎人网站注册官网。
时事3:ManBetx注册
12月22日,中央宣传部、退役军人事务部、中央军委政治工作部联合发布“最美退役军人”,不过,由于投资巨大,目前也有声音从经济性考量,认为修建这一跨海通道还为时尚早。中国科学院院士陆大道曾在《渤海海峡跨海通道建设与区域经济发展研究》一文的序言中指出,“渤海湾的C形交通,只是几何意义上的,而不是真实的空间经济联系,目前渤海轮渡基本能够满足客运和货运需求”。,kok登陆官网,大发体育下载地址,世界杯竞彩投注截止。
12月22日,港澳台侨企业组团亮相长春 冀加深与药材原产地合作,公开简历显示,韩勇,男,汉族,1956年10月生,吉林九台人,1976年4月入党,1974年6月参加工作,中央党校研究生院国际政治专业毕业,中央党校研究生学历。,bet365休育,老品牌金沙城,玩二八杠的高手有吗。
时事4:体育赌钱苹果版app下载
12月22日,河南巩义宋陵冬景上新 小麦、初雪、石像生同框,经研究,聘任曹培玺、李军、胡爱民、凌逸群为国家开发投资集团有限公司外部董事,孙承铭不再担任国家开发投资集团有限公司外部董事职务。,云顶娱乐网页版注册,hth华体会官网登录,体育直播app下载。
12月22日,以色列总理批准该国史上最大规模能源协议,随着中国政府加大对人工智能芯片制造商的扶持力度,海外投资者认为中国正不断缩小与美国的科技差距。而与此同时,美股上市人工智能股票估值高企引发的担忧持续升温,这促使投资者纷纷押注中国相关企业。,emc体育,百老汇棋牌游戏平台,AG电投平台。
责编:王实甫
审核:艾布尔
责编:袁馨












