Baseten

Baseten

Inference

Production ML model deployment — custom + open models

Operational

All systems responding normally

Last checked 19/09/2026, 2:52:58 pm

397ms response

Uptime History100.00% uptime
2026-09-17Today

Uptime

100.00%

Avg Latency

390ms

P95 Latency

529ms

Fastest

218ms

Checks

150

Response Time

Last 60 checks
218ms min390ms avg679ms max

💰 Pricing

custom

A10G: $0.31/hr. A100: $2.87/hr. Dedicated deployment.

⚡ Rate Limits

free
RPM: 10TPM: 1,000

Free plan: 10 RPM, 1K TPM. Paid: up to 1000 RPM.

🤖 Models (1)

ModelTaskContextVisionToolsJSON
Custom Deployment

Deploy any model. A10G/A100 GPUs.

llm

Recent Checks

Showing last 15
Operational
397ms19 Sept, 02:52 pm
Operational
384ms19 Sept, 02:45 pm
Operational
631ms19 Sept, 02:31 pm
Operational
369ms19 Sept, 02:13 pm
Operational
545ms19 Sept, 01:53 pm
Operational
366ms19 Sept, 01:45 pm
Operational
381ms19 Sept, 01:32 pm
Operational
437ms19 Sept, 01:13 pm
Operational
324ms19 Sept, 12:54 pm
Operational
372ms19 Sept, 12:47 pm
Operational
386ms19 Sept, 12:36 pm
Operational
218ms19 Sept, 12:15 pm
Operational
328ms19 Sept, 11:51 am
Operational
408ms19 Sept, 11:30 am
Operational
350ms19 Sept, 11:07 am