Groq(不是馬斯克的 Grok)
免費額度 Groq 更新於 2026-07自研 LPU 推理晶片的雲服務,以極高的大模型推理速度著稱。
📰 最近動態
- 元川微完成Pre-A輪數億元融資,華為老兵押注LPU推理晶片2026-07-24
- Reddit分析稱輝達134億美元浮盈虛增利潤,真實PE或達60倍2026-07-20
- 靈汐科技釋出類腦超節點LynAInfra,推理能效比提升3-10倍2026-07-19
- 輝達Vera Rubin轉向系統級Token工廠,重構AI基礎設施評價標準2026-07-17
- 輝達AI晶片競爭加劇,但挑戰者各有所圖2026-07-12
免費額度與收費
有免費檔:在 console.groq.com/keys 直接申請免費 API Key 即可呼叫,官方文件列有 Free Plan 限額表,按模型分別限制 RPM(每分鐘請求)、RPD(每天請求)、TPM(每分鐘 token)、TPD(每天 token)四個維度,任一維度先觸頂就限流,快取 token 不計入限額。文件舉例 llama-3.1-8b-instant 免費檔為每分鐘 30 次請求、每天 14400 次請求、每分鐘 6000 token、每天 50 萬 token。付費的 Developer 檔可拿更高限額並解鎖 Batch 與 Flex 處理。付費按 token 計,價格頁列出 Llama 3.1 8B 每百萬 token 輸入 0.05 / 輸出 0.08 美元、Llama 3.3 70B 輸入 0.59 / 輸出 0.79 美元、GPT OSS 120B 輸入 0.15 / 輸出 0.60 美元、GPT OSS 20B 輸入 0.075 / 輸出 0.30 美元;Batch API 打五折。均為美元、按量付費,不是月費訂閱。各檔具體限額與在售模型官方會調整,以控制台展示為準。
完整入口
- 官網
- groq.com ↗
- 控制台/免費 API Key
- console.groq.com/keys ↗
- API base_url
- https://api.groq.com/openai/v1 相容 OpenAI SDK
- 你要找的可能是 Grok
- 馬斯克 xAI 的聊天機器人 = Grok,拼寫帶 k,與本頁的 Groq 無關
背後的模型
Groq 賣的是自研 LPU 晶片上的推理速度,託管別人的開放權重模型;而 Grok 是 xAI 自研的模型,在本站的廠商頁是 x-ai。
怎麼用
要極快推理速度時選它——自研 LPU 晶片。同樣的開源模型在它上面響應快得多;適合對延遲敏感的即時對話、語音應用。
🔴 先把最容易搞混的說清楚:Groq 不是 Grok。本頁說的 Groq 拼寫帶 q,是一家 2016 年成立的美國推理晶片公司,自研名為 LPU(Language Processing Unit)的推理專用晶片,並把晶片做成雲服務 GroqCloud 賣 API,官網 groq.com。而 Grok 拼寫帶 k,是馬斯克旗下 xAI 在 2023 年推出的聊天機器人和大模型,跟 X(推特)繫結。兩者成立時間差 7 年,一個賣硬體算力、一個賣聊天對話,不是同一家公司,沒有任何股權或合作關係。
這場重名不是巧合導致的小誤會,而是真打了官司的商標糾紛。Groq 早在 2016 年就註冊了 GROQ 商標,xAI 的 Grok 面世後,Groq 公開發出過律師函(cease-and-desist),主張商標侵權。此後 xAI 的 GROK 商標申請在美國專利商標局(USPTO)多次被中止或駁回,理由之一正是與 Groq 已註冊的在先商標近似——截至目前 xAI 仍未把 GROK 的美國商標拿穩。所以搜尋時拼錯一個字母,結果會完全跑偏:想找馬斯克那個聊天機器人,請認準帶 k 的 Grok。
回到 Groq 本身:它的賣點是快。LPU 是專為推理設計的晶片,不像 GPU 那樣兼顧訓練,官方文件標註的吞吐能到每秒數百甚至上千 token(如 GPT OSS 20B 標 1000 T/s)。介面相容 OpenAI,base_url 換成 https://api.groq.com/openai/v1 即可。它託管的是 Llama、GPT-OSS 這類開放權重模型,自己不訓模型——這跟 xAI 自研 Grok 模型的路子又是相反的。