是什么
开源大模型通常指把训练好的模型权重(weights)公开发布、允许任何人下载并在自己的硬件上运行、微调的大模型,如 Llama、通义千问(Qwen)、DeepSeek、Mistral、Gemma 等系列。这里要区分两个概念:「开源权重」(open weight)只公开权重文件,未必提供训练数据与完整训练代码;「完全开源」(open source)则连数据、代码、训练方法一并公开。多数所谓「开源模型」其实是前者。
为什么重要
开源权重打破了只能通过厂商 API 调用闭源模型的格局:企业可私有化部署以满足数据合规、可深度微调出垂直模型、也不必为每次调用付费给某一家厂商。它还把模型能力的价格不断打到地板——开源模型的免费或低价供给,持续压低整个 token 市场的价格。但「开源」也有边界:不少许可证(如 Llama 社区许可)对商用规模、再训练设有附加限制,并非完全自由。
在 AI 产业链中的位置
开源大模型处在 AI 产业链的「模型」层,却深刻影响上下层。向下,私有化部署把算力需求从厂商云端分散到自建「基础设施」;向上,它给「应用」层提供了可自由改造、不被单一厂商锁定的能力底座,是混合路由、垂直微调等玩法的基础。
2026 年的最新进展
2026 年开源权重这一侧的看点,是参数规模与许可证宽松度同时往上走。DeepSeek 于 2026 年 4 月 24 日发布 V4 双档——V4-Pro(总参数 1.6 万亿、激活 490 亿)与 V4-Flash(总参数 2840 亿、激活 130 亿),两者都提供 100 万 token 上下文并采用宽松的 MIT 许可证。阿里一侧同样激进:2026 年 8 月 12 日开源了总参数 2.4 万亿、每次前向激活约 950 亿参数的 Qwen3.8-2.4T-A95B,8 月 14 日又以 Apache 2.0 许可证发布了体量友好得多的 Qwen3.8-27B,Hugging Face 上基于 Qwen 的衍生模型已超过 20 万个。但开源不等于处处可用:2026 财年美国国防授权法案要求把 DeepSeek 从国防部与情报体系的系统中移除,仅保留研究与反恐反谍等例外。
在大模型库查
本站大模型库收录了主流厂商的可调用模型;其中开源/开源权重系列见开源大模型切片,国产开源模型(多数提供人民币计价)见国产大模型。