是什麼

DeepSeek 是一家來自中國的人工智慧公司,專注於大語言模型的研發,並以釋出開源或開放權重的模型而受到關注(中文語境裡常被拆寫成「deep seek」,指的是同一家公司)。它由梁文鋒創辦,脫胎於量化投資機構幻方量化,早年為量化交易自建的算力叢集,成為其後來訓練大模型的底子。它的多款模型在公開評測中展現出有競爭力的能力,同時強調在訓練與推理上的成本效率,常被視為「在有限算力下做強模型」路線的代表。

公司官網為 www.deepseek.com,個人使用者的對話入口在 chat.deepseek.com,開發者呼叫 API 與查閱文件則在開放平台 platform.deepseek.com。

為什麼重要

DeepSeek 引發廣泛討論的關鍵,在於它推動了關於「訓練頂尖模型究竟需要多少算力」的重新審視。其相對高效的做法,提示模型能力不只取決於堆疊算力,也取決於資料、架構與工程最佳化。開放權重的策略也讓更多開發者能夠在其基礎上構建應用,影響了開源與閉源路線的競爭格局。

在 AI 產業鏈中的位置

DeepSeek 位於 AI 產業鏈的模型層:向下依賴基礎設施與晶片層提供算力,但其效率導向的路線,正是在探討這層對下層算力的依賴能壓縮到何種程度。向上,它通過開放模型為應用層提供可自由呼叫與微調的基礎,豐富了模型層的供給生態。

API 價格

DeepSeek 各代模型以高性價比著稱。其 API 價格(收費標準)、上下文視窗與歷次調價記錄,可在本站大模型庫逐一檢視——如 DeepSeek R1DeepSeek V4 Pro

官網入口

官網地址、免費用法與網頁版/App 全部入口的整理,見本站DeepSeek 網頁版入口