DeepSeek-V3.1-Terminus 是由深度求索(DeepSeek)发布的 V3.1 模型的更新版本,定位为混合智能体大语言模型。此次更新在保持模型原有能力的基础上,专注于修复用户反馈的问题并提升稳定性。它显著改善了语言一致性,减少了中英文混用和异常字符的出现。模型集成了“思考模式”(Thinking Mode)和“非思考模式”(Non-thinking Mode),用户可通过聊天模板灵活切换以适应不同任务。作为一个重要的优化,V3.1-Terminus 增强了代码智能体(Code Agent)和搜索智能体(Search Agent)的性能,使其在工具调用和执行多步复杂任务方面更加可靠
模型能力
| 能力项 | 支持情况 | 能力项 | 支持情况 |
|---|---|---|---|
输入模态 |
Text |
输出模态 |
Text |
模型体验 |
Function Calling |
||
结构化输出 |
联网搜索 |
||
前缀续写 |
上下文缓存 |
||
批量推理 |
模型调优 |
上下文限制
| 参数 | 值 | 参数 | 值 |
|---|---|---|---|
最大输入长度 |
163840 |
最大输出长度 |
65536 |
上下文长度 |
163840 |
最大输入长度(思考模式下) |
163840 |
最大输出长度(思考模式下) |
65536 |
最大思维链长度 |
65536 |
模型价格
本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。
华北2(北京)
| 计费项 | 价格(元) | 单位 |
|---|---|---|
输入 |
4 |
每百万tokens |
输出 |
12 |
每百万tokens |
限流
华北2(北京)
| 参数 | 值 |
|---|---|
RPM(每分钟请求数) |
500 |
TPM(每分钟tokens) |
500,000 |
vanchin/deepseek-v3.1-terminus
DeepSeek-V3.1-Terminus 是 DeepSeek-V3.1 的更新版本,旨在保持模型原有核心能力的同时,针对用户反馈的问题进行了修复和优化。该版本的模型结构与 DeepSeek-V3 保持一致,并在特定领域进行了显著增强。
模型能力
| 能力项 | 支持情况 | 能力项 | 支持情况 |
|---|---|---|---|
输入模态 |
Text |
输出模态 |
Text |
模型体验 |
Function Calling |
||
结构化输出 |
联网搜索 |
||
前缀续写 |
上下文缓存 |
||
批量推理 |
模型调优 |
上下文限制
| 参数 | 值 | 参数 | 值 |
|---|---|---|---|
最大输入长度 |
32768 |
最大输出长度 |
65536 |
上下文长度 |
131072 |
最大输入长度(思考模式下) |
32768 |
最大输出长度(思考模式下) |
65536 |
模型价格
本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。
华北2(北京)
| 计费项 | 价格(元) | 单位 |
|---|---|---|
输入 |
4 |
每百万tokens |
输出 |
12 |
每百万tokens |
输入(缓存命中) |
1.6 |
每百万tokens |
限流
华北2(北京)
| 参数 | 值 |
|---|---|
RPM(每分钟请求数) |
500 |
TPM(每分钟tokens) |
1,000,000 |