Together AI

Together AI

InferenceFREE TIER

Open-source model inference — Llama, Mixtral, FLUX

Operational

All systems responding normally

Last checked 05/08/2026, 7:37:56 am

1327ms response

Uptime History100.00% uptime
2026-07-31Today

Uptime

100.00%

Avg Latency

907ms

P95 Latency

1220ms

Fastest

603ms

Checks

150

Response Time

Last 60 checks
603ms min907ms avg1349ms max

💰 Pricing

llama-3.3-70b-turbo
Input: $0.88/1MOutput: $0.88/1M

Free $1 credit on signup

⚡ Rate Limits

standard
RPM: 60

Limits vary by model and account tier.

🤖 Models (1)

ModelTaskContextVisionToolsJSON
Llama 3.3 70B Turbo

Open-source model inference. Fast and reliable.

llm128k

Recent Checks

Showing last 15
Operational
1327ms5 Aug, 07:37 am
Operational
603ms5 Aug, 07:04 am
Operational
724ms5 Aug, 06:36 am
Operational
1141ms5 Aug, 05:58 am
Operational
1220ms5 Aug, 05:19 am
Operational
1008ms5 Aug, 04:45 am
Operational
767ms5 Aug, 04:06 am
Operational
1005ms5 Aug, 03:24 am
Operational
691ms5 Aug, 02:47 am
Operational
824ms5 Aug, 02:04 am
Operational
1179ms5 Aug, 01:10 am
Operational
1240ms5 Aug, 12:16 am
Operational
782ms4 Aug, 11:24 pm
Operational
808ms4 Aug, 10:41 pm
Operational
874ms4 Aug, 09:51 pm