Groq(不是馬斯克的 Grok)
免費額度Groq更新於 2026-07自研 LPU 推理晶片的雲服務,以極高的大模型推理速度著稱。
📰 最近動態
免費額度與收費
有免費檔:在 console.groq.com/keys 直接申請免費 API Key 即可呼叫,官方文件列有 Free Plan 限額表,按模型分別限制 RPM(每分鐘請求)、RPD(每天請求)、TPM(每分鐘 token)、TPD(每天 token)四個維度,任一維度先觸頂就限流,快取 token 不計入限額。文件舉例 llama-3.1-8b-instant 免費檔為每分鐘 30 次請求、每天 14400 次請求、每分鐘 6000 token、每天 50 萬 token。付費的 Developer 檔可拿更高限額並解鎖 Batch 與 Flex 處理。付費按 token 計,價格頁列出 Llama 3.1 8B 每百萬 token 輸入 0.05 / 輸出 0.08 美元、Llama 3.3 70B 輸入 0.59 / 輸出 0.79 美元、GPT OSS 120B 輸入 0.15 / 輸出 0.60 美元、GPT OSS 20B 輸入 0.075 / 輸出 0.30 美元;Batch API 打五折。均為美元、按量付費,不是月費訂閱。各檔具體限額與在售模型官方會調整,以控制台展示為準。
完整入口
- 控制台/免費 API Key
- console.groq.com/keys ↗
- API base_url
- https://api.groq.com/openai/v1相容 OpenAI SDK
- 你要找的可能是 Grok
- 馬斯克 xAI 的聊天機器人 = Grok,拼寫帶 k,與本頁的 Groq 無關
背後的模型
Groq 賣的是自研 LPU 晶片上的推理速度,託管別人的開放權重模型;而 Grok 是 xAI 自研的模型,在本站的廠商頁是 x-ai。
怎麼用
要極快推理速度時選它——自研 LPU 晶片。同樣的開源模型在它上面響應快得多;適合對延遲敏感的即時對話、語音應用。
⚠️ 先說公司層面的大事(2026-09-02 複核補入):2025 年 12 月 Groq 與輝達達成非獨家推理技術許可協議(CNBC 報道涉及金額約 200 億美元),創始人兼 CEO Jonathan Ross、總裁 Sunny Madra 等核心成員隨之加入輝達;GroqCloud 雲服務不在該交易範圍內、留在公司繼續獨立運營,由 Simon Edwards 接任 CEO。2026 年 8 月 17 日公司完成 3.5 億美元新一輪,估值約 35 億美元、較 2025 年 9 月的約 69 億近乎腰斬。本頁講的 API 與免費檔仍以 console.groq.com 當前展示為準。
🔴 先把最容易搞混的說清楚:Groq 不是 Grok。本頁說的 Groq 拼寫帶 q,是一家 2016 年成立的美國推理晶片公司,自研名為 LPU(Language Processing Unit)的推理專用晶片,並把晶片做成雲服務 GroqCloud 賣 API,官網 groq.com。而 Grok 拼寫帶 k,是馬斯克旗下 xAI 在 2023 年推出的聊天機器人和大模型,跟 X(推特)繫結。兩者成立時間差 7 年,一個賣硬體算力、一個賣聊天對話,不是同一家公司,沒有任何股權或合作關係。
這場重名不是巧合導致的小誤會,而是真打了官司的商標糾紛。Groq 早在 2016 年就註冊了 GROQ 商標,xAI 的 Grok 面世後,Groq 公開發出過律師函(cease-and-desist),主張商標侵權。此後 xAI 的 GROK 商標申請在美國專利商標局(USPTO)多次被中止或駁回,理由之一正是與 Groq 已註冊的在先商標近似——截至目前 xAI 仍未把 GROK 的美國商標拿穩。所以搜尋時拼錯一個字母,結果會完全跑偏:想找馬斯克那個聊天機器人,請認準帶 k 的 Grok。
回到 Groq 本身:它的賣點是快。LPU 是專為推理設計的晶片,不像 GPU 那樣兼顧訓練,官方文件標註的吞吐能到每秒數百甚至上千 token(如 GPT OSS 20B 標 1000 T/s)。介面相容 OpenAI,base_url 換成 https://api.groq.com/openai/v1 即可。它託管的是 Llama、GPT-OSS 這類開放權重模型,自己不訓模型——這跟 xAI 自研 Grok 模型的路子又是相反的。