Console

MiniMax M3

reasoningtools
Context
1.05M
Max output
512K
Input → output
text → text
Weights
Open
Providers
13
01

Providers

13 providers · list price, latency and uptime
ProviderInput /1MOutput /1MTTFB p50Uptime · hourly, 24hRetention
AtlasCloud
fp8
$0.30$1.20–
98.90%
may retain
Context
524K
Max output
524K
Cache read /1M
$0.06
Precision
fp8
Regions
default
Headquarters
US
Data retention
May retain prompts
Supported parameters
include_reasoningmax_tokensreasoningtemperaturetoolstop_p
Uptime · last 3 days10-05 04:00 – 10-08 03:35 UTC
MonTueWedNow
CoreWeavecheapest
fp4
$0.23$0.96–
99.38%
none
Context
262K
Max output
236K
Cache read /1M
$0.05
Precision
fp4
Regions
default
Headquarters
US
Data retention
Zero retention
Supported parameters
frequency_penaltyinclude_reasoninglogprobsmax_tokenspresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Uptime · last 3 days10-05 04:00 – 10-08 03:35 UTC
MonTueWedNow
DeepInfra
fp8
$0.28$1.10–
99.58%
none
Context
524K
Max output
512K
Cache read /1M
$0.056
Precision
fp8
Regions
default
Headquarters
US
Data retention
Zero retention
Supported parameters
frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstoptemperaturetool_choicetoolstop_ktop_p
Uptime · last 3 days10-05 04:00 – 10-08 03:35 UTC
MonTueWedNow
GMI Cloud
fp8
$0.24$0.96–
99.51%
may retain
Context
1.05M
Max output
524K
Cache read /1M
$0.048
Precision
fp8
Regions
default
Headquarters
US
Data retention
May retain prompts
Supported parameters
include_reasoningmax_tokensreasoningresponse_formatseedtemperaturetool_choicetoolstop_p
Uptime · last 3 days10-05 04:00 – 10-08 03:35 UTC
MonTueWedNow
Mara
$0.60$2.40–
95.57%
none
Context
1.05M
Max output
944K
Cache read /1M
–
Precision
–
Regions
default
Headquarters
US
Data retention
Zero retention
Supported parameters
include_reasoninglogprobsmax_tokensreasoningresponse_formatstoptemperaturetool_choicetoolstop_ktop_logprobstop_p
Uptime · last 3 days10-05 04:00 – 10-08 03:35 UTC
MonTueWedNow
MiniMax
fp8
$0.30$1.20–
99.83%
may retain
Context
524K
Max output
512K
Cache read /1M
$0.06
Precision
fp8
Regions
default
Headquarters
SG
Data retention
May retain prompts
Supported parameters
include_reasoningmax_tokensreasoningresponse_formattemperaturetool_choicetoolstop_p
Uptime · last 3 days10-05 04:00 – 10-08 03:35 UTC
MonTueWedNow
ModelRun
fp4
$0.75$3.00–
99.72%
none
Context
1.05M
Max output
944K
Cache read /1M
$0.15
Precision
fp4
Regions
default
Headquarters
US
Data retention
Zero retention
Supported parameters
frequency_penaltyinclude_reasoningmax_tokenspresence_penaltyreasoningrepetition_penaltyresponse_formatstopstructured_outputstemperaturetool_choicetoolstop_ktop_p
Uptime · last 3 days10-05 04:00 – 10-08 03:35 UTC
MonTueWedNow
Novita
fp8
$0.30$1.20–
99.50%
none
Context
1M
Max output
131K
Cache read /1M
$0.06
Precision
fp8
Regions
default
Headquarters
US
Data retention
Zero retention
Supported parameters
frequency_penaltyinclude_reasoningmax_tokenspresence_penaltyreasoningrepetition_penaltyseedstoptemperaturetool_choicetoolstop_ktop_p
Uptime · last 3 days10-05 04:00 – 10-08 03:35 UTC
MonTueWedNow
Parasail
fp8
$0.30$1.20–
99.75%
none
Context
1.05M
Max output
524K
Cache read /1M
$0.06
Precision
fp8
Regions
default
Headquarters
US
Data retention
Zero retention
Supported parameters
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokenspresence_penaltyreasoningrepetition_penaltyseedstoptemperaturetool_choicetoolstop_ktop_logprobstop_p
Uptime · last 3 days10-05 04:00 – 10-08 03:35 UTC
MonTueWedNow
SambaNova
$0.60$2.40–
80.45%
none
Context
1.05M
Max output
944K
Cache read /1M
–
Precision
–
Regions
default
Headquarters
US
Data retention
Zero retention
Supported parameters
include_reasoninglogprobsmax_tokensreasoningresponse_formatstoptemperaturetool_choicetoolstop_ktop_logprobstop_p
Uptime · last 3 days10-05 04:00 – 10-08 03:35 UTC
MonTueWedNow
StreamLake
fp8
$0.30$1.20–
97.55%
may retain
Context
1M
Max output
512K
Cache read /1M
$0.06
Precision
fp8
Regions
default
Headquarters
CN
Data retention
May retain prompts
Supported parameters
include_reasoningmax_tokensreasoningresponse_formatstoptemperaturetop_p
Uptime · last 3 days10-05 04:00 – 10-08 03:35 UTC
MonTueWedNow
Together
$0.30$1.20–
99.65%
none
Context
524K
Max output
472K
Cache read /1M
$0.06
Precision
–
Regions
default
Headquarters
US
Data retention
Zero retention
Supported parameters
frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatstopstructured_outputstemperaturetool_choicetoolstop_ktop_p
Uptime · last 3 days10-05 04:00 – 10-08 03:35 UTC
MonTueWedNow
Venice
fp8
$0.30$1.20–
96.73%
none
Context
524K
Max output
66K
Cache read /1M
$0.06
Precision
fp8
Regions
default
Headquarters
US
Data retention
Zero retention
Supported parameters
frequency_penaltyinclude_reasoningmax_tokenspresence_penaltyreasoningstoptemperaturetool_choicetoolstop_ktop_p
Uptime · last 3 days10-05 04:00 – 10-08 03:35 UTC
MonTueWedNow

By default the router tries our listings in routing order and fails over before the first byte — never mid-answer. Pin, exclude or order providers with a routing policy. Prices are each provider's own list price; you pay $0.30 in / $1.20 out per 1M, whichever runs the request. Uptime is our own measurement where we call a provider directly, else the 24h figure published for it; an hour stays grey until it has a sample. Open a row for its specs, parameters and policies.

02

Quickstart

any SDK — only the base URL changes
curl -N https://api.routerplus.com/v1/chat/completions \
  -H "Authorization: Bearer $TM_API_KEY" -H "content-type: application/json" \
  -d '{"model":"minimax/minimax-m3","stream":true,"max_tokens":256,
       "messages":[{"role":"user","content":"hi"}]}'
03

Pricing

per 1M tokens
prompt$0.30
cached prompt$0.06
completion$1.20

Every billed response carries usage.cost — recompute your bill from the wire.

04

Uptime

10-05 04:00 – 10-08 03:35 UTC
Last 3 days99.98%last 24h · TTFB p50 – · uptime n<100
MonTueWedNow

An hour counts at the best provider's uptime: a request goes to another provider when one fails. Grey hours have no sample yet.