模型简介
2025年12月1日,DeepSeek开源了两款模型:DeepSeek-V3.2和DeepSeek-V3.2-Speciale,在推理能力上全球领先。
两款模型定位不同。DeepSeek-V3.2的目标是平衡推理能力与输出长度,适合日常使用,例如问答场景和通用智能体任务场景。9月底DeepSeek发布了实验版V3.2-Exp,此次是正式版更新。在公开推理测试中,V3.2达到了GPT-5的水平,仅略低于谷歌的Gemini3 Pro。
DeepSeek-V3.2-Speciale的目标则是“将开源模型的推理能力推向极致,探索模型能力的边界”。据介绍,Speciale是V3.2的长思考增强版,同时结合了DeepSeek-Math-V2的定理证明能力,该模型具备出色的指令跟随、严谨的数学证明与逻辑验证能力。据DeepSeek公布,Speciale在多个推理基准测试中超越谷歌最先进的Gemini3 Pro。
DeepSeek-V3.2参数量高达671B,本地难以部署,云端部署成为企业用户和开发者的首选。
阿里云PAI-Model Gallery已接入DeepSeek-V3.2、DeepSeek-V3.2-Speciale模型,提供企业级部署方案。
部署步骤
在PAI-Model Gallery模型广场找到DeepSeek-V3.2模型,或通过链接直达该模型:https://pai.console.aliyun.com/#/quick-start/models/DeepSeek-V3.2/intro在PAI控制台进入Model Gallery页面,选择模型广场Tab页,找到目标模型(如DeepSeek-V3.2或DeepSeek-V3.2-Speciale),单击模型卡片进入模型详情页。
在模型详情页右上角单击部署,平台支持SGLang、vLLM部署框架。平台提供多种部署模板,内置默认配置,只需选择模板和计算资源,即可一键完成云上部署。
说明部署资源要求如下:
公共资源部署
使用公共资源时仅支持资源列表中的规格部署。在灵骏分布式部署场景下,服务会使用相同资源部署多个节点。EAS资源组、资源配额部署
服务在非分布式部署时需要8*141G显存计算资源。灵骏分布式部署场景,部署所需节点数已经预先加载,每个节点需要配置8*GPU资源。
选择推理引擎为SGLang,部署模板为单机。保持开启动态调度关闭、开启PD分离选择不开启,确认资源费用后单击部署。
部署成功后,在服务页面单击查看调用信息获取Endpoint和Token。如需了解调用方式,可返回模型介绍页查看说明。
使用推理服务:可在本地或通过各类客户端调用模型服务,也可使用PAI提供的在线调试功能或WebUI与模型交互。参考文档:3.2 调用模型
更多模型支持
PAI-Model Gallery持续提供热门开源模型的快速部署、微调、蒸馏、评测实践,覆盖千问、万相、DeepSeek、Kimi、MiniMax、GLM等开源模型,还提供Qwen3-235B-A22B-PAI-optimized、Qwen3-Next-80B-A3B-Instruct-FP8-PAI-optimized、DeepSeek-R1-0528-PAI-optimized等PAI优化版本模型,内置EP+PD分离部署等模板,性能更优。