Skip to main content
POST
Chat Completion

Authorizations

Authorization
string
header
required

Bearer authentication header of the form Bearer <token>, where <token> is your auth token.

Body

application/json
model
enum<string>
required

Model ID.

Available options:
MiniMax-M3
Example:

"MiniMax-M3"

messages
object[]
required

Conversation history. Message content can be text, image, video, or tool-call content.

Minimum array length: 1
Example:
service_tier
enum<string>
default:standard

Request admission tier. Priority access must be enabled for the account.

Available options:
standard,
priority
thinking
object

Controls MiniMax-M3 thinking. Omit to use adaptive thinking by default.

reasoning_split
boolean

Separates reasoning into reasoning_content and reasoning_details. This does not enable or disable thinking.

stream
boolean
default:false

If true, returns partial message deltas using Server-Sent Events.

stream_options
object

Options for streaming responses.

max_completion_tokens
integer<int64>

Maximum generated tokens. For MiniMax-M3, 131072 is recommended and 524288 is the maximum.

Required range: 1 <= x <= 524288
Example:

2048

max_tokens
integer<int64>
deprecated

Deprecated legacy generation limit. Use max_completion_tokens instead.

Required range: x >= 1
temperature
number<double>
default:1

Sampling temperature.

Required range: 0 <= x <= 2
top_p
number<double>
default:0.95

Nucleus sampling parameter. MiniMax-M3 defaults to 0.95.

Required range: 0 <= x <= 1
tools
object[]

Function tool definitions for agentic workflows.

Response

Completion generated successfully.

id
string
required
Example:

"066a33a7d290378f8a9e57a055812afa"

choices
object[]
required
created
integer<int64>
required

Unix timestamp in seconds.

model
string
required
Example:

"MiniMax-M3"

object
enum<string>
required
Available options:
chat.completion
usage
object
input_sensitive
boolean

Whether the input triggered sensitive-content detection.

input_sensitive_type
integer

Sensitive-content category returned when input_sensitive is true.

output_sensitive
boolean

Whether the output triggered sensitive-content detection.

output_sensitive_type
integer

Sensitive-content category returned when output_sensitive is true.

base_resp
object