是什么
DeepSeek 是一家来自中国的人工智能公司,专注于大语言模型的研发,并以发布开源或开放权重的模型而受到关注(中文语境里常被拆写成「deep seek」,指的是同一家公司)。它由梁文锋创办,脱胎于量化投资机构幻方量化,早年为量化交易自建的算力集群,成为其后来训练大模型的底子。它的多款模型在公开评测中展现出有竞争力的能力,同时强调在训练与推理上的成本效率,常被视为「在有限算力下做强模型」路线的代表。
公司官网为 www.deepseek.com,个人用户的对话入口在 chat.deepseek.com,开发者调用 API 与查阅文档则在开放平台 platform.deepseek.com。
为什么重要
DeepSeek 引发广泛讨论的关键,在于它推动了关于「训练顶尖模型究竟需要多少算力」的重新审视。其相对高效的做法,提示模型能力不只取决于堆叠算力,也取决于数据、架构与工程优化。开放权重的策略也让更多开发者能够在其基础上构建应用,影响了开源与闭源路线的竞争格局。
在 AI 产业链中的位置
DeepSeek 位于 AI 产业链的模型层:向下依赖基础设施与芯片层提供算力,但其效率导向的路线,正是在探讨这层对下层算力的依赖能压缩到何种程度。向上,它通过开放模型为应用层提供可自由调用与微调的基础,丰富了模型层的供给生态。
API 价格
DeepSeek 各代模型以高性价比著称。其 API 价格(收费标准)、上下文窗口与历次调价记录,可在本站大模型库逐一查看——如 DeepSeek R1、DeepSeek V4 Pro。
官网入口
官网地址、免费用法与网页版/App 全部入口的整理,见本站DeepSeek 网页版入口。