搜索 猫眼电影 融媒体矩阵
  • 山东手机报

  • 猫眼电影

  • 大众网官方微信

  • 大众网官方微博

  • 抖音

  • 人民号

  • 全国党媒平台

  • 央视频

  • 百家号

  • 快手

  • 头条号

  • 哔哩哔哩

首页 >新闻 >社会新闻

重磅!DeepSeek V3.2 特别版发布:性能超越GPT-5,硬刚Gemini 3.0「IOI/IMO金牌」

2025-12-28 05:55:30
来源:

猫眼电影

作者:

张泉灵

手机查看

  猫眼电影记者 郝渊晓 报道首次登录送91元红包

↑阅读之前记得关注+星标⭐️,,每天才能第一时间接收到更新

DeepSeek-V3.2系列模型正式上线

作为“为Agent构建的推理优先模型”,DeepSeek-V3.2包含两个版本:

DeepSeek-V3.2:V3.2-Exp的官方继任者,平衡了推理能力与生成长度,性能对标GPT-5,现已上线App、Web端及API

DeepSeek-V3.2-Speciale:专攻深度推理能力的极限版本,性能超越GPT-5,比肩Gemini-3.0-Pro,目前仅通过API提供

技术报告显示,DeepSeek-V3.2-Speciale在2025年国际数学奥林匹克(IMO)、国际信息学奥林匹克(IOI)、ICPC世界总决赛及CMO中均取得了金牌级成绩

官方已公开上述竞赛的最终提交结果,社区可通过assets/olympiad_cases进行二次验证

技术报告:

https://huggingface.co/deepseek-ai/DeepSeek-V3.2/blob/main/assets/paper.pdf

以下是详细信息

核心能力与技术突破

DeepSeek-V3.2基于三大技术突破,实现了高计算效率与卓越推理、Agent性能的统一:

1.DeepSeek Sparse Attention (DSA):引入高效注意力机制,大幅降低计算复杂度,并针对长上下文场景进行了优化

2.可扩展强化学习框架:通过稳健的RL协议与后训练(post-training)算力扩展,实现了高性能表现

3.大规模Agent任务合成管线:涵盖1800+环境及8.5万+复杂指令

这一合成管线不仅提升了模型在复杂交互环境中的遵循度和泛化能力,更让DeepSeek-V3.2将“思考”直接整合进工具使用(Tool-Use)的模型,同时支持在思考和非思考模式下使用工具

API更新与Speciale版限制

DeepSeek-V3.2:

API使用模式与V3.2-Exp保持一致,作为日常主力模型(Daily Driver),提供GPT-5级别的性能

DeepSeek-V3.2-Speciale:

该版本专为解决复杂任务设计,消耗更多Token,目前仅作为API提供,具体限制如下:

临时端点:需使用

base_url="https://api.deepseek.com/v3.2_speciale_expires_on_20251215"

服务期限:该端点服务至2025年12月15日 15:59 (UTC) 截止

功能限制:不支持工具调用(Tool Calls),仅用于支持社区评估与研究。

定价:与DeepSeek-V3.2保持一致

聊天模板重大调整

DeepSeek-V3.2不再提供Jinja格式模板,并引入了“带工具思考”及新角色设定。

Python脚本编码:官方提供了encoding文件夹,包含Python脚本(encoding_dsv32.py),用于将OpenAI兼容格式消息编码为模型输入字符串及解析输出

Developer角色:模板新增developer角色,专门用于搜索Agent场景,官方API不接受分配给该角色的消息

输出解析注意:提供的解析函数仅处理格式良好的字符串,生产环境需自行增加稳健的错误处理机制。

代码示例如下:

import transformersfrom encoding_dsv32 import encode_messagestokenizer = transformers.AutoTokenizer.from_pretrained("deepseek-ai/DeepSeek-V3.2")messages = [ {"role": "user", "content": "hello"}, {"role": "assistant", "content": "Hello! I am DeepSeek.", "reasoning_content": "thinking..."}, {"role": "user", "content": "1+1=?"}]# 思考模式配置encode_config = dict(thinking_mode="thinking", drop_thinking=True, add_default_bos_token=True)prompt = encode_messages(messages, **encode_config)tokens = tokenizer.encode(prompt)本地部署建议

模型结构与DeepSeek-V3.2-Exp相同。

采样参数:建议设置 temperature = 1.0,top_p = 0.95。

Speciale版提示:本地部署Speciale版本时,同样不支持工具调用功能

开源与协议

仓库及模型权重均采用 MIT License 授权。

最后记得⭐️我,这对我非常重要,每天都在更新:

欢迎点赞转发推荐评论,别忘了关注我

 时事1:森林舞会视频教程

  12月28日,中国官方:平台要求商家“全网最低价”或构成垄断,从GDP总量上看,2024年一季度,经济大省广东、江苏、山东继续霸榜前三;浙江、河南、四川、湖北、福建、湖南、安徽紧随其后,在全国排在第四至十名。,fun88平台。

  12月28日,俄罗斯驻朝大使逝世 金正恩向普京致唁电,在核心项目与潜力项目路演环节,四个聚焦重大未满足临床需求的创新项目依次亮相。包括了眼科、肿瘤、代谢性疾病等行业热门治疗领域和技术路线。现场,来自泰格医药、和泽医药的临床与药学专家及多家基金代表,从临床价值、差异化竞争格局、关键数据里程碑与可行性评估等多维度进行提问与点评,为项目团队提供了具有可操作性的优化建议。,百老汇电子游戏网址,澳门ag棋牌厅,ManBetX万博官网地址最新。

 时事2:全球最准确的足球预测软件

  12月28日,第四届“一带一路”青年发展高峰论坛在香港举办,在无人机业务中,我们做了很多赋能。比如电池电量监控、飞行路线规划、空域管制政策等,都需要输入大模型。再以小例子说明,为轮船接入全息网后,可监测航线是否有海盗出没——这些都是重大风险点,靠人力难以解决,必须通过系统内外部数据对接来实现。这是我们系统设计的亮点。,AG8亚洲游官网,新濠天地官网注册,亿博app链接。

  12月28日,山西:多地迎雨雪天气 部分高速封闭,第一财经记者从多家餐饮企业了解到,今年一季度不少餐饮企业的客流量或营收同比去年都有所上升。,金沙赌玚网站,博狗网址,千赢国际游戏登录。

 时事3:网上电玩娱乐

  12月28日,中国科大制备出一种高品质量子光源,11月,河南天基轮胎“扩建绿色高性能轮胎项目”环境影响报告书,对外公示。,世界杯买球比分怎么算,现金在线官网登录,AG游戏试玩。

  12月28日,2030年我国天然气产量将达3000亿立方米,据宁波晚报报道,相关工作人员介绍,此次政策调整结合了驾驶员的呼声与行业实际,将男女驾驶员的从业年龄从原有的男性60周岁、女性55周岁,一并放宽至65周岁。政策旨在缓解当前出租车行业驾驶员用工短缺的问题,为更多有经验的驾驶员提供就业机会,同时也为市民提供更加便捷、安全的出行服务。,韩国赌场网站登录,网投领导者导航,摇钱树打鱼机。

 时事4:银河注册App

  12月28日,送别中国四大名著“全满贯”演员何晴,不过,港交所业绩仍胜于市场预期,24日股价大涨3.55%,报239港元。,乐动体育足球,完美体育官网app,历年世界杯投注。

  12月28日,解锁银川幸福密码:让民生温暖直达人心,相比之下,日本国土地理院对岛屿的定义,就没强调“能维持人类居住”这一条。中国中日关系史学会副会长刘江永3日对《环球时报》记者说,日本现在采用卫星技术或是其他高科技测量技术,这就使得对岛屿的测量结果会更为精确一些。但是日方声称的这些新增加“岛屿”是否符合《联合国海洋法公约》对于岛屿的界定,是否能够要求专属经济区或者大陆架还值得商榷。,优博电子网投,澳门365bet网,im电竞官方下载。

责编:罗恩·谢波德

审核:李思安

责编:张云鹭

相关推荐 换一换