vanchin/deepseek-r1

更新时间:
复制 MD 格式

DeepSeek-R1 是深度求索于 2025 年 1 月开源的 6710 亿参数混合专家(MoE)推理模型,推理时仅激活 370 亿参数。作为首个通过纯强化学习(无监督微调)训练的千亿级模型,实现了链式思维(CoT)的自然涌现。模型在 RL 前加入冷启动数据解决了 R1-Zero 的重复和混语问题,在数学、代码、推理任务上达到 OpenAI o1 水平。

推理服务供应商

vanchin/deepseek-r1模型的推理服务供应商为快手万擎。

模型能力

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

不支持

Function Calling

支持

结构化输出

不支持

联网搜索

不支持

前缀续写

支持

上下文缓存

支持

批量推理

不支持

模型调优

不支持

上下文限制

参数 参数

最大输入长度

98304

最大输出长度

32768

上下文长度

131072

最大输入长度(思考模式下)

98304

最大输出长度(思考模式下)

32768

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

计费项 价格(元) 单位

输入

4

每百万tokens

输出

16

每百万tokens

输入(缓存命中)

1.6

每百万tokens

限流

华北2(北京)

参数

RPM(每分钟请求数)

500

TPM(每分钟tokens)

1,000,000