Groq

Groq

InferenceFREE TIER

LPU inference — fastest tokens per second on the market

Operational

All systems responding normally

Last checked 30/08/2026, 3:08:19 am

339ms response

Uptime History100.00% uptime
2026-08-26Today

Uptime

100.00%

Avg Latency

351ms

P95 Latency

459ms

Fastest

184ms

Checks

150

Response Time

Last 60 checks
184ms min351ms avg1357ms max

💰 Pricing

llama-3.3-70bFREE
Input: $0.59/1MOutput: $0.79/1M

Fastest inference. mixtral-8x7b: $0.24/$0.24

14,400 req/day free

⚡ Rate Limits

free
RPM: 30TPM: 6,000RPD: 14,400TPD: 500,000

Per-model limits. llama-3.3-70b: 6k TPM free.

dev
RPM: 100TPM: 15,000

$0 plan with credit card.

🤖 Models (2)

ModelTaskContextVisionToolsJSON
Llama 3.3 70B

LPU inference — extremely fast

llm128k
Mixtral 8x7B

Cheapest on Groq: $0.24/$0.24

llm33k

Recent Checks

Showing last 15
Operational
339ms30 Aug, 03:08 am
Operational
1357ms30 Aug, 02:52 am
Operational
375ms30 Aug, 02:42 am
Operational
237ms30 Aug, 02:35 am
Operational
396ms30 Aug, 02:25 am
Operational
345ms30 Aug, 02:10 am
Operational
417ms30 Aug, 01:52 am
Operational
363ms30 Aug, 01:45 am
Operational
299ms30 Aug, 01:37 am
Operational
325ms30 Aug, 01:27 am
Operational
356ms30 Aug, 01:19 am
Operational
322ms30 Aug, 01:09 am
Operational
311ms30 Aug, 12:52 am
Operational
331ms30 Aug, 12:42 am
Operational
362ms30 Aug, 12:34 am