模型介绍

12月1日晚,DeepSeek又开源了两款新模型,DeepSeek-V3.2 和 DeepSeek-V3.2-Speciale,在推理能力上全球领先。

两款模型有着不同的定位。DeepSeek-V3.2的目标是平衡推理能力与输出长度,适合日常使用,例如问答场景和通用智能体任务场景。9月底DeepSeek发布了实验版V3.2-Exp,此次是正式版更新。在公开推理测试中,V3.2达到了GPT-5的水平,仅略低于谷歌的Gemini3 Pro。

DeepSeek-V3.2-Speciale的目标则是“将开源模型的推理能力推向极致,探索模型能力的边界”。据介绍,Speciale是V3.2的长思考增强版,同时结合了DeepSeek-Math-V2的定理证明能力,该模型具备出色的指令跟随、严谨的数学证明与逻辑验证能力。据DeepSeek公布的数据,Speciale在多个推理基准测试中超越谷歌最先进的Gemini3 Pro。

由于 DeepSeek-V3.2 模型的参数量高达 671B,本地难以直接部署模型,云端部署成为企业用户和开发者们部署的优先选择。

阿里云 PAI-Model Gallery 已第一时间接入 DeepSeek-V3.2、DeepSeek-V3.2-Speciale 模型,提供企业级部署方案。

PAI-Model Gallery 简介

PAI-Model Gallery 是阿里云人工智能平台 PAI 的产品组件,它集成了国内外 AI 开源社区中优质的预训练模型,涵盖了 LLM、AIGC、CV、NLP 等各个领域。通过 PAI 对这些模型的适配,用户可以以零代码方式实现从训练到部署再到推理的全过程,简化了模型的开发流程,为开发者和企业用户带来了更快、更高效、更便捷的 AI 开发和应用体验。

PAI-Model Gallery 访问地址:https://pai.console.aliyun.com/#/quick-start/models

  • 零代码一键部署

  • 自动适配云资源

  • 部署后开箱即用API

  • 全流程运维托管

  • 企业级安全 数据不出域

一键部署 DeepSeek-V3.2 模型

1. 在 PAI-Model Gallery 模型广场找到 DeepSeek-V3.2 模型,或通过链接直达该模型:https://pai.console.aliyun.com/#/quick-start/models/DeepSeek-V3.2/intro

2. 在模型详情页右上角点击「部署」,平台支持SGLang、vLLM部署框架。平台提供多种部署模板,包括单机、分布式、EP+PD分离部署方案,内置默认配置,只需选择模板和计算资源,即可一键完成模型的云上部署,操作十分简便。

3. 部署成功后,在服务页面可以点击“查看调用信息”获取调用的 Endpoint 和 Token,想了解服务调用方式可以点击预训练模型链接,返回模型介绍页查看调用方式说明。

4. 使用推理服务:您可以在本地或使用各类客户端直接调用模型服务,也可以使用 PAI 平台提供的在线调试功能,此外您还可以使用 PAI 平台提供的 WebUI 界面与模型进行交互。可以参考使用文档:https://help.aliyun.com/zh/pai/getting-started/model-gallery-quick-start#091a6b66e9v4x

更多模型支持

PAI-Model Gallery 持续提供开源社区热门模型的快速部署、微调、蒸馏、评测实践,模型覆盖通义千问、通义万相、DeepSeek、Kimi、MiniMax、GLM等优秀开源模型,同时还提供 Qwen3-235B-A22B-PAI-optimized、Qwen3-Next-80B-A3B-Instruct-FP8-PAI-optimized、DeepSeek-R1-0528-PAI-optimized 等PAI优化版本模型,内置了PAI优化版的EP+PD分离部署等模板,性能更优。

Logo

有“AI”的1024 = 2048,欢迎大家加入2048 AI社区

更多推荐