0
2025 年 12 月 1 日,DeepSeek 同时发布了DeepSeek - V3.2和DeepSeek - V3.2 - Speciale两个正式版模型,两者定位不同且各有核心优势,具体信息如下:
1. DeepSeek - V3.2 ◦
适用场景:该模型主打推理能力与输出长度的平衡,适配问答、通用智能体任务等日常使用场景。目前官方网页端、App 和 API 均已更新为这个正式版。
核心亮点:在公开推理类 Benchmark 测试中达到 GPT - 5 水平,仅略逊于 Gemini - 3.0 - Pro;对比 Kimi - K2 - Thinking,其输出长度大幅缩短,能显著减少计算开销和用户等待时间。同时它也是 DeepSeek 首个将思考融入工具使用的模型,支持思考模式与非思考模式的工具调用。另外,通过大规模 Agent 训练数据合成方法,该模型在智能体评测中达到当前开源模型的最高水平,且未针对测试集工具做特殊训练,在真实应用场景泛化性较强。
2. DeepSeek - V3.2 - Speciale
适用场景:作为 DeepSeek - V3.2 的长思考增强版,还融合了 DeepSeek - Math - V2 的定理证明能力,更适配复杂推理、数学证明等高阶任务。目前该版本仅以临时 API 服务形式开放,仅供社区评测与研究。
核心亮点:在主流推理基准测试上性能媲美 Gemini - 3.0 - Pro,还斩获了 IMO 2025、CMO 2025、ICPC World Finals 2025 及 IOI 2025 四项赛事的金牌,其中 ICPC 成绩达到人类选手第二名水平,IOI 成绩达到人类选手第十名水平。不过该模型在高度复杂任务上虽优于标准版,但消耗的 Tokens 更多,对应的成本也更高,且暂不支持工具调用,未针对日常对话与写作任务专项优化。
0
金字火腿:中晟微专注于400G/800G/1.6T高速光模块芯片
0
威领股份:山南锑金将成为第一大股东 股票将于明日复牌
0
据塔斯社12月1日报道,俄罗斯总统普京签署法令明确,中国公民在2026年9月14日之前,可免签赴俄停留最长30天。
0
大摩大幅上调谷歌TPU产量预测:2027年达500万块 每50万块“外销”或增收130亿美元
0
最高补贴2000万!上海全力打造全球
脑机接口产业高地
0
0
0
日本与菲律宾就出口导弹展开非正式磋商