搜索 猫眼电影 融媒体矩阵
  • 山东手机报

  • 猫眼电影

  • 大众网官方微信

  • 大众网官方微博

  • 抖音

  • 人民号

  • 全国党媒平台

  • 央视频

  • 百家号

  • 快手

  • 头条号

  • 哔哩哔哩

首页 >新闻 >社会新闻

重磅!DeepSeek V3.2 特别版发布:性能超越GPT-5,硬刚Gemini 3.0「IOI/IMO金牌」

2025-12-23 15:44:42
来源:

猫眼电影

作者:

理查德·佩普

手机查看

  猫眼电影记者 初潘颖 报道首次登录送91元红包

↑阅读之前记得关注+星标⭐️,,每天才能第一时间接收到更新

DeepSeek-V3.2系列模型正式上线

作为“为Agent构建的推理优先模型”,DeepSeek-V3.2包含两个版本:

DeepSeek-V3.2:V3.2-Exp的官方继任者,平衡了推理能力与生成长度,性能对标GPT-5,现已上线App、Web端及API

DeepSeek-V3.2-Speciale:专攻深度推理能力的极限版本,性能超越GPT-5,比肩Gemini-3.0-Pro,目前仅通过API提供

技术报告显示,DeepSeek-V3.2-Speciale在2025年国际数学奥林匹克(IMO)、国际信息学奥林匹克(IOI)、ICPC世界总决赛及CMO中均取得了金牌级成绩

官方已公开上述竞赛的最终提交结果,社区可通过assets/olympiad_cases进行二次验证

技术报告:

https://huggingface.co/deepseek-ai/DeepSeek-V3.2/blob/main/assets/paper.pdf

以下是详细信息

核心能力与技术突破

DeepSeek-V3.2基于三大技术突破,实现了高计算效率与卓越推理、Agent性能的统一:

1.DeepSeek Sparse Attention (DSA):引入高效注意力机制,大幅降低计算复杂度,并针对长上下文场景进行了优化

2.可扩展强化学习框架:通过稳健的RL协议与后训练(post-training)算力扩展,实现了高性能表现

3.大规模Agent任务合成管线:涵盖1800+环境及8.5万+复杂指令

这一合成管线不仅提升了模型在复杂交互环境中的遵循度和泛化能力,更让DeepSeek-V3.2将“思考”直接整合进工具使用(Tool-Use)的模型,同时支持在思考和非思考模式下使用工具

API更新与Speciale版限制

DeepSeek-V3.2:

API使用模式与V3.2-Exp保持一致,作为日常主力模型(Daily Driver),提供GPT-5级别的性能

DeepSeek-V3.2-Speciale:

该版本专为解决复杂任务设计,消耗更多Token,目前仅作为API提供,具体限制如下:

临时端点:需使用

base_url="https://api.deepseek.com/v3.2_speciale_expires_on_20251215"

服务期限:该端点服务至2025年12月15日 15:59 (UTC) 截止

功能限制:不支持工具调用(Tool Calls),仅用于支持社区评估与研究。

定价:与DeepSeek-V3.2保持一致

聊天模板重大调整

DeepSeek-V3.2不再提供Jinja格式模板,并引入了“带工具思考”及新角色设定。

Python脚本编码:官方提供了encoding文件夹,包含Python脚本(encoding_dsv32.py),用于将OpenAI兼容格式消息编码为模型输入字符串及解析输出

Developer角色:模板新增developer角色,专门用于搜索Agent场景,官方API不接受分配给该角色的消息

输出解析注意:提供的解析函数仅处理格式良好的字符串,生产环境需自行增加稳健的错误处理机制。

代码示例如下:

import transformersfrom encoding_dsv32 import encode_messagestokenizer = transformers.AutoTokenizer.from_pretrained("deepseek-ai/DeepSeek-V3.2")messages = [ {"role": "user", "content": "hello"}, {"role": "assistant", "content": "Hello! I am DeepSeek.", "reasoning_content": "thinking..."}, {"role": "user", "content": "1+1=?"}]# 思考模式配置encode_config = dict(thinking_mode="thinking", drop_thinking=True, add_default_bos_token=True)prompt = encode_messages(messages, **encode_config)tokens = tokenizer.encode(prompt)本地部署建议

模型结构与DeepSeek-V3.2-Exp相同。

采样参数:建议设置 temperature = 1.0,top_p = 0.95。

Speciale版提示:本地部署Speciale版本时,同样不支持工具调用功能

开源与协议

仓库及模型权重均采用 MIT License 授权。

最后记得⭐️我,这对我非常重要,每天都在更新:

欢迎点赞转发推荐评论,别忘了关注我

 时事1:mg官方游戏中心

  12月23日,美国青年赴广西南宁交流:传承飞虎队精神 体验中国文化,CNN在报道日本突然多出7000多个小岛时,特别列出了日本跟俄罗斯、中国、韩国的诸多岛屿主权争议。有日本网友戏称,“萨哈林岛(库页岛)是不是也包括在内?”“竹岛(韩国称独岛)有被计算进去吗?那也是日本的岛屿啊。”,bet36体育平台台。

  12月23日,关注俄乌冲突:专家分析 红军城战略意义显著 俄谈判优势将加大,无论黄金是存储在海外金库还是运抵国内,最终都需要进入央行的官方储备体系。运抵的黄金在进入央行金库前,必须经过严格的检测和称重,以确保其符合约定的重量和纯度标准,之后才正式计入国家的黄金储备。,AG真人吧,彩票快三正规app,澳博体育官网。

 时事2:斗牛棋牌在线试玩

  12月23日,从“集中攻坚”到“长治长效” 陕西公检法合力打击“老赖”,西部证券发布研报称,据液冷产业链最前沿数据,2026年谷歌TPUv7及以上等级芯片预计出货约220万颗—230万颗,测算2026年谷歌机柜液冷市场规模为24亿美元—29亿美元。展望2026年,国产芯片出货有望保持高增,叠加AI超节点整机出货形式采用率的快速提升,将给国内液冷市场带来高增机遇。,优德体育官网入口,二八杠棋牌娱乐,大发88。

  12月23日,农工党十七届四中全会在京开幕,在多边层面,长期以来,中国与中亚五国的合作平台主要是上合组织。除土库曼斯坦为中立国之外,其他四个中亚国家均为上合组织创始成员国。在上合组织框架内,中国与中亚国家开展的安全合作卓有成效,在打击”三股势力”、推动阿富汗和平进程等方面取得的成就有目共睹。,龙8游戏网址,澳门百老汇大厅,888真人官网APP。

 时事3:2022世界杯注册

  12月23日,北京平谷连续监测到白尾海雕 “神奇动物”频现催生观鸟经济,根据第一财经4日报道,目前,肇庆市只是要求“按套内面积计价宣传和销售”,这并不代表公摊面积不需要付费。换言之,肇庆市并未实质性取消住房公摊面积。,365体育官方中文版ios,斗牛百人牛牛app,银河娱乐地址。

  12月23日,邮储力量,注入海南 南海潮涌,开放扬帆,虽然今年明星企业接连上市,带火了二级市场上的“影子股”,但在过去几年二级市场低迷的背景下,A股上市公司参与设立产业基金的数量处于低位。在2020年至2024年期间,这一数据分别为390项、579项、476项、449项、338项。,雷火电竞网站是多少,二八杠扑克牌规则,澳门金沙线上娱乐网站。

 时事4:棋牌游戏斗牛赢的机率

  12月23日,北京交通效能再升级 京密高速新国展段及远通桥新匝道将于28日通车,厦门证监局经查确认,圣元环保子公司认购的私募产品出现重大损失,公司知悉后未及时予以披露,直至12月26日才对外披露,违反了《上市公司信息披露管理办法》相关规定。,抢庄牛牛体验,九游会网址多少,菲律宾亚星娱乐网址。

  12月23日,中国自主研发循环流化床生物质气化技术 首个示范项目正式投产,4月20日,记者从海南海警局获悉,海南三沙海警局永兴工作站近日查获一起非法捕捞水产品案,现场查扣渔获物320000余斤。此案系三沙海警局成立以来查获涉案渔获物数值最大的一宗非法捕捞案。,梭哈扑克牌游戏,澳门金龙游戏,皇冠官方登录app。

责编:甘国田

审核:谢宗睿

责编:谢小渝

相关推荐 换一换