DeepSeek-V3 · 开源 671B MoE

探索 未至之境

DeepSeek 致力于通过开源大语言模型推进通用人工智能的边界. 我们相信开放的研究和共享的权重将让 AI 更安全, 更值得信赖, 也更接近真正服务人类的形态.

671B总参数量
128K上下文长度
MIT开源协议
DeepSeek-R1 · 深度思考 推理中
用 Python 写一个判断质数的函数, 要求处理 n < 2 的边界情况.
DS
Thinking 首先考虑边界: n < 2 时不是质数. 然后判断 2 是质数. 对于其他数, 只需检查到 √n 即可, 因为如果 n = a × b, 那么 a 或 b 至少有一个 ≤ √n.
这里是一个高效的质数判断实现:
def is_prime(n: int) -> bool: # 边界: 小于 2 的数不是质数 if n < 2: return False if n == 2: return True if n % 2 == 0: return False for i in range(3, int(n**0.5)+1, 2): if n % i == 0: return False return True
向 DeepSeek 提问任何问题
能力矩阵

基础模型 · 推理增强 · 全栈开源

从基础语言模型到深度推理引擎, DeepSeek 系列覆盖通用对话, 代码生成, 数学推理, API 服务等核心场景. 所有模型权重和技术报告完整公开.

DeepSeek-V3

671B 参数 MoE 架构基础模型, 在通用对话和写作任务上达到业界领先水平, 推理成本仅为同级模型的十分之一.

查看技术报告 →

DeepSeek-R1

深度推理模型, 通过纯强化学习激发模型的链式思考能力, 在 MATH, AIME, Codeforces 上达到 OpenAI o1 同等水平.

阅读论文 →

DeepSeek-Coder

面向代码场景的专家模型, 覆盖 87 种编程语言, 在 HumanEval, MBPP, LiveCodeBench 上持续领先, 支持仓库级别理解.

下载权重 →

DeepSeek-Math

数学专精模型, 在 GSM8K, MATH 基准上超越多数闭源大模型, 提出 GRPO 强化学习算法, 改变推理训练范式.

技术细节 →

API 平台

OpenAI 兼容接口, 低延迟低单价, 国内直连无需翻墙. 支持函数调用, JSON 模式, 缓存命中折扣等企业级特性.

查看文档 →

完全开源

所有主力模型权重以 MIT 协议公开, 商用免费且无需申请. 训练框架, 数据配比, 评测脚本同步开放给研究社区.

GitHub 仓库 →
性能基准

领先的推理表现, 极致的训练效率

在公开学术基准上保持顶尖水准的同时, 单次训练成本控制在 600 万美元以内, 重新定义大模型经济学.

MATH-500
97.3
R1 在数学竞赛级题目上超越多数闭源模型
Codeforces Elo
2029
竞赛编程评级达到人类专家级别 Top 4%
MMLU
88.5
综合知识测评, V3 与最强闭源模型并驾齐驱
训练成本
$5.6M
完整 V3 训练所需 GPU 小时折算的总成本
API 价格

透明计费 · 缓存命中折扣 · 学术友好

按 token 计费, 命中缓存的输入费用降至十分之一. 学术研究, 开源项目可申请免费配额.

DeepSeek-V3
通用对话模型
¥2/ 百万 tokens (输入)
适合通用对话, 写作, 摘要, 函数调用等场景.
  • 128K 上下文窗口
  • 缓存命中价 ¥0.5 / M tokens
  • OpenAI 兼容 SDK
  • 函数调用 / JSON 模式
查看 API 文档
开源权重
本地部署
免费MIT 协议商用
下载完整权重, 自托管或基于开源框架二次开发.
  • HuggingFace / ModelScope 镜像
  • vLLM / SGLang 推理优化
  • 蒸馏 1.5B 至 70B 全系列
  • 完整训练代码公开
访问 GitHub

开放的研究, 共享的智能

我们相信知识不应被围墙阻隔. 从今天开始, 用 DeepSeek 构建属于你的 AI 应用.

Design System Reference

极简至上 · 学术克制 · 蓝鲸唯一

DeepSeek 的视觉语言拒绝花哨. 白底, 黑字, 一抹蓝鲸蓝. 没有渐变, 没有阴影堆叠, 没有多余的装饰. 它的克制本身就是表达 — 让内容和推理过程成为唯一的主角.

View DESIGN.md ↗

Color

白底主导, 蓝鲸蓝作为唯一功能性色彩. 灰阶承担信息层级, 黑字承担正文. 拒绝多余的色相, 让信息密度成为页面的主旋律.

主色 Primary
蓝鲸蓝
#4D6BFE
悬停蓝
#3A57E8
蓝软光
#EEF1FF
极黑
#000000
墨黑
#1A1A1A
文字 Text
正文
#1A1A1A
次级
#333333
辅助
#666666
弱化
#999999
禁用
#D4D4D4
面板与边框 Surface
画布白
#FFFFFF
浅灰底
#FAFAFA
分组底
#F5F5F5
分割线
#E5E5E5
软分割
#F0F0F0

Typography

Inter + Noto Sans SC 双字族. 400-700 权重区间, 不使用展示字体. 数据和代码部分使用 JetBrains Mono. 中文字号与英文字号严格对齐, 行距保持 1.6 的阅读舒适度.

TokenSampleSizeWeight用途
--display探索未至之境64 / 4rem600Hero 主标题
--title-section基础模型与推理引擎40 / 2.5rem600章节标题
--title-cardDeepSeek-V318 / 1.13rem600卡片标题
--body通过开源大模型推进通用 AI16 / 1rem400正文
--body-sm查看技术报告14 / 0.88rem400辅助文本
--button开始对话14 / 0.88rem500按钮
--codeis_prime(n)12 / 0.75rem400-500代码片段
--labelPRIMARY11 / 0.69rem600标签 / 小标题

Radius

小圆角是 DeepSeek 的几何语言. 按钮 6px, 卡片 8-12px, 标签 4px. 没有 pill 形, 没有圆形按钮, 一切方正而克制.

最小
2px
标签
4px
按钮
6px
卡片
8px
容器
12px
徽章
999px

Spacing

基于 4px 基线的间距系统. 模块间使用大间距营造呼吸感, 模块内使用小间距保持紧凑. 学术克制的设计语言在间距上表现为留白克制, 信息密度适中.

2xs
4px
xs
8px
sm
16px
md
24px
lg
40px
xl
96px

Voice & Tone

DeepSeek 的文字气质是学术克制的中国研究者. 不堆砌, 不夸张, 不卖弄技术词汇. 信息为先, 表达直接, 让模型本身的能力成为最大的说服力.

克制
用 "探索未至之境" 而非 "颠覆式革命".
用 "开源权重" 而非 "震撼业界突破".
用 "MIT 协议商用" 而非 "无限商业可能".
精确
"671B 参数 MoE 架构" 优于 "超大规模模型".
"训练成本 ¥5.6M" 优于 "成本极低".
"Codeforces 2029 分" 优于 "代码能力强".
开放
承认局限. 公开方法. 邀请验证.
论文优先, 演示其次.
把模型权重交给社区, 让 benchmark 自己说话.

Components

按钮极简, 输入框只有底边色变化, 标签使用浅蓝底. 没有装饰性元素, 一切组件都为承载信息和操作而存在.

Inputs & Tags
深度思考 通用 开源
Cards
DEEPSEEK-V3
671B MoE 模型
开源权重 · MIT 协议
CACHE HIT
¥0.5 / M tokens
View source ↗