Groq(不是马斯克的 Grok)
免费额度 Groq 更新于 2026-07自研 LPU 推理芯片的云服务,以极高的大模型推理速度著称。
📰 最近动态
- 元川微完成Pre-A轮数亿元融资,华为老兵押注LPU推理芯片2026-07-24
- Reddit分析称英伟达134亿美元浮盈虚增利润,真实PE或达60倍2026-07-20
- 灵汐科技发布类脑超节点LynAInfra,推理能效比提升3-10倍2026-07-19
- 英伟达Vera Rubin转向系统级Token工厂,重构AI基础设施评价标准2026-07-17
- 英伟达AI芯片竞争加剧,但挑战者各有所图2026-07-12
免费额度与收费
有免费档:在 console.groq.com/keys 直接申请免费 API Key 即可调用,官方文档列有 Free Plan 限额表,按模型分别限制 RPM(每分钟请求)、RPD(每天请求)、TPM(每分钟 token)、TPD(每天 token)四个维度,任一维度先触顶就限流,缓存 token 不计入限额。文档举例 llama-3.1-8b-instant 免费档为每分钟 30 次请求、每天 14400 次请求、每分钟 6000 token、每天 50 万 token。付费的 Developer 档可拿更高限额并解锁 Batch 与 Flex 处理。付费按 token 计,价格页列出 Llama 3.1 8B 每百万 token 输入 0.05 / 输出 0.08 美元、Llama 3.3 70B 输入 0.59 / 输出 0.79 美元、GPT OSS 120B 输入 0.15 / 输出 0.60 美元、GPT OSS 20B 输入 0.075 / 输出 0.30 美元;Batch API 打五折。均为美元、按量付费,不是月费订阅。各档具体限额与在售模型官方会调整,以控制台展示为准。
完整入口
- 官网
- groq.com ↗
- 控制台/免费 API Key
- console.groq.com/keys ↗
- API base_url
- https://api.groq.com/openai/v1 兼容 OpenAI SDK
- 你要找的可能是 Grok
- 马斯克 xAI 的聊天机器人 = Grok,拼写带 k,与本页的 Groq 无关
背后的模型
Groq 卖的是自研 LPU 芯片上的推理速度,托管别人的开放权重模型;而 Grok 是 xAI 自研的模型,在本站的厂商页是 x-ai。
怎么用
要极快推理速度时选它——自研 LPU 芯片。同样的开源模型在它上面响应快得多;适合对延迟敏感的实时对话、语音应用。
🔴 先把最容易搞混的说清楚:Groq 不是 Grok。本页说的 Groq 拼写带 q,是一家 2016 年成立的美国推理芯片公司,自研名为 LPU(Language Processing Unit)的推理专用芯片,并把芯片做成云服务 GroqCloud 卖 API,官网 groq.com。而 Grok 拼写带 k,是马斯克旗下 xAI 在 2023 年推出的聊天机器人和大模型,跟 X(推特)绑定。两者成立时间差 7 年,一个卖硬件算力、一个卖聊天对话,不是同一家公司,没有任何股权或合作关系。
这场重名不是巧合导致的小误会,而是真打了官司的商标纠纷。Groq 早在 2016 年就注册了 GROQ 商标,xAI 的 Grok 面世后,Groq 公开发出过律师函(cease-and-desist),主张商标侵权。此后 xAI 的 GROK 商标申请在美国专利商标局(USPTO)多次被中止或驳回,理由之一正是与 Groq 已注册的在先商标近似——截至目前 xAI 仍未把 GROK 的美国商标拿稳。所以搜索时拼错一个字母,结果会完全跑偏:想找马斯克那个聊天机器人,请认准带 k 的 Grok。
回到 Groq 本身:它的卖点是快。LPU 是专为推理设计的芯片,不像 GPU 那样兼顾训练,官方文档标注的吞吐能到每秒数百甚至上千 token(如 GPT OSS 20B 标 1000 T/s)。接口兼容 OpenAI,base_url 换成 https://api.groq.com/openai/v1 即可。它托管的是 Llama、GPT-OSS 这类开放权重模型,自己不训模型——这跟 xAI 自研 Grok 模型的路子又是相反的。