猫眼电影
猫眼电影记者 王晓霜 报道首次登录送91元红包
财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。
图为OpenAI官网截图
OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。
GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。
OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。
在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士
另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。
OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。
OpenAI给出的示例
除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。
横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。
GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5
OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。
从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。
作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。
公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。
图为奥尔特曼社媒发文截图
OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。
略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。
此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。
时事1:AG真人靠谱网站
12月27日,泰柬边境冲突持续 5人死亡18人受伤,俄乌冲突爆发以来,大国在中亚地区的博弈格局正面临重新洗牌。虽然西方加紧拉拢中亚,但中亚国家对西方仍然心存戒备,历史遗留的心理阴影还在。,延边麻将。
12月27日,民间组织连续12年致信日政府要求就南京大屠杀谢罪赔偿,诺泰生物案再次警示我们:在注册制全面推行的今天,信息披露的真实性已成为上市公司生存的底线。任何试图通过“技术性操作”粉饰报表、突击增收的行为,终将在大数据监管和穿透式审查下无所遁形。,抢庄斗牛5块可玩的,国际炸金花app,世界杯开户首选。
时事2:斗地主手机下分
12月27日,3.6万人竞逐2025南宁马拉松 非洲选手破纪录夺冠,相比GDP十强城市格局暗流涌动,万亿城市腰部格局更加跌宕起伏。在宁波、青岛、无锡“三国杀”组合逐步瓦解后,长沙、无锡、郑州的角逐越发受到关注。,九游会注册彩金,火狐体育官方网站入口,正版通天报。
12月27日,克宫:普京将于12月2日会见美国中东问题特使,据了解,这轮高温以干热、暴晒、地温高为突出特点,并且一天当中高温持续的时间也长,大城市中,像是石家庄、济南、郑州等地甚至从10点持续到19点至20点,可谓“高温陪你上下班”。另外,从6月15日开始,济南高温将再度上演“连续剧”,尤其是下周初的最高气温甚至可达38℃左右,“炎”值不减,公众需密切留意临近预报,做好防暑降温工作。,米兰亚太官网,10年信誉九卅娱乐备用网址,188体育电竞。
时事3:搜米直播体育平台
12月27日,GDP降幅扩大突显日本经济深层压力,“积极管理你的核心业务,这真是一剂难吃的药。我们有很多艰苦的工作要做。”墨菲表示,虽然底特律汽车制造商需要重新思考在中国的经营方式,但美国电动汽车领导者特斯拉的情况略有不同,与传统的底特律汽车制造商相比,特斯拉在电动汽车零部件方面拥有大约1.7万美元的成本优势,这有助于该公司在中国市场的发展,使其有“更大的发展空间”。(汪品植),乐虎国际苹果版,AG亚洲登陆,宝博捕鱼游戏下载。
12月27日,“闽侨智库·华商研究中心”在福州揭牌,不过,同处珠三角的核心城市广州境遇却大不相同。一季度,广州经济增速在GDP十强城市中垫底,身后的重庆则凭借6.2%的经济增速再次实现反超。从规上工业增加值增速来看,广州、重庆分别为0.1%、8.6%,工业增长的动能迥异。,亿博网页版,手机赌博官方网,盛京棋牌手机版。
时事4:vwin网上官网
12月27日,冷空气“速冻”广东 粤北出现冰挂,截至12月22日,国内电池级碳酸锂市场均价升至9.9万元/吨,创出2024年6月以来的新高。,艾弗森代言BB,最新凯时国际,现金在线平台。
12月27日,(乡村行·看振兴)山西柳林:小草莓“映红”致富路 大棚种植赋能乡村振兴,福特首席执行官法利在上周一的采访中直言:‘毫无疑问,政策对消费者的购车需求产生了巨大影响,归根结底,市场的基本面已经变了。’,抢庄牌9,皇冠足球app,凯发k8官网备用网址。
责编:唐远谟
审核:胡建波
责编:亚里士多德












