DeepSeek
来自 DeepSeek · www.deepseek.com ↗
来自杭州 DeepSeek 的开放权重大模型系列与聊天助手,以强大的推理模型著称。正式版 DeepSeek-V4-Flash-0731 API 通过后训练实现 Agent 能力大幅升级,原生支持 Responses API 并适配 Codex。
llm open-weights chatbot
- 分类
- 开放模型
- 商业模式
- 开放(开放权重/源码)
- 可用性
- 全球
- 发布
- 2023-11
- 记录更新
- 2026-08-01
- 模型系列
- DeepSeek
- 许可证
- MIT
- 成立时间
- 2023
- 总部所在地
- CN
概述
DeepSeek(深度求索)是一家位于杭州的 AI 公司,以低训练与推理成本实现强推理能力的开放权重语言模型而闻名。其免费聊天助手和开发者 API 提供 DeepSeek-V 通用模型与 R 系列推理模型。开放权重版本也可下载并自行部署。
主要功能
- 开放权重的 DeepSeek-V 与 DeepSeek-R 模型家族
- 专注逐步推理的 R 系列模型
- 免费的网页版与移动端聊天助手
- 低成本的开发者 API
- 正式版 DeepSeek-V4-Flash-0731 API——MoE 架构不变(总参 284B / 激活 13B),但 Agent 能力大幅提升:Terminal Bench 82.7、DSBench-FullStack 68.7、DeepSWE 从 7.3 跃升至 54.4
适用场景
- 需要显式推理的数学、编程与分析任务
- 为隐私或成本考虑自行部署开放权重模型
- 成本敏感的 API 集成
定价
聊天助手免费;开发者 API 按用量计费,开放权重模型可免许可费自行部署。
常见问题
DeepSeek 的模型开源吗?
DeepSeek 发布可下载、自部署和微调的开放权重模型;聊天助手和 API 则是托管服务。
DeepSeek 由谁开发?
DeepSeek 由一家 2023 年成立、总部位于杭州的 AI 公司开发。
DeepSeek 的推理模型是什么?
DeepSeek R 系列经过训练,会在回答前逐步推理,主要面向数学、编程与分析任务。
DeepSeek-V4-Flash-0731 更新了什么?
2026 年 7 月 31 日上线的 V4-Flash-0731 正式版 API 保持与预览版相同的 284B 参数 MoE 架构,仅通过重新后训练大幅提升 Agent 能力(Terminal Bench 82.7、DSBench-FullStack 68.7、DeepSWE 从 7.3 跃升至 54.4),并原生支持 Responses API、针对 Codex 做了适配,支持 100 万 token 上下文。想零配置直接体验?DeepSeek-V4-Flash-0731 已在 MonkeyCode 上线,每天 30M 免费 Token:https://ly.cyberserval.tech/iIETXiF
同类产品
- Baichuan — 来自北京百川智能的开放权重中英双语大模型系列,现已聚焦医疗 AI,推出 Baichuan-M 系列推理模型。
- Command R — Cohere 面向检索增强生成(RAG)与工具调用优化的开放权重大模型系列;旗舰位置已由 Command A 接替。
- DBRX — Databricks 于 2024 年发布的开放权重混合专家(MoE)大模型;2025 年已从 Databricks 服务中退役,但权重仍可获取。
- Falcon — 由技术创新研究院(TII)开发的开放权重大语言模型系列。
- Gemma — 谷歌推出的轻量级开放权重模型系列,源自与 Gemini 相同的研究。
- GLM — 智谱 AI 推出的开放权重大语言模型系列,涵盖通用、推理与编程方向的多个版本。
来源
本记录最近复核于 2026-08-01。
机器可读记录:/api/products/deepseek.json · 发现错误?提交纠错