Skip to main content
POST
Chat completion

Authorizations

Authorization
string
header
required

Bearer authentication header of the form Bearer <token>, where <token> is your auth token.

Body

application/json
model
enum<string>
required

model ID

Available options:
qwen3.6-flash
Example:

"qwen3.6-flash"

messages
object[]
required

Array of conversation messages. content can be a string or an array of content parts for multimodal input.

Minimum array length: 1
Examples:
max_completion_tokens
integer
default:65536

Maximum number of tokens to generate.

Required range: 1 <= x <= 65536
temperature
number
default:1

Sampling temperature. Higher values make the output more random.

Required range: 0 <= x <= 2
Example:

1

top_p
number

Nucleus sampling threshold.

Required range: 0 <= x <= 1
frequency_penalty
number
default:0

Penalize tokens based on how often they already appear in the text.

Required range: -2 <= x <= 2
presence_penalty
number
default:0

Penalize tokens that have already appeared.

Required range: -2 <= x <= 2
stream
boolean
default:false

When enabled, partial message deltas are streamed via SSE.

enable_thinking
boolean
default:false

Enable reasoning. When on, reasoning_content is returned together with content.

stop
string[]

Sequences that stop generation of further tokens. Must be an array, e.g. [".", "?"].

Response

Completion generated successfully

id
string
required
Example:

"chatcmpl-abc123"

object
string
required
Example:

"chat.completion"

created
integer
required

Unix timestamp

model
string
required
Example:

"qwen3.6-flash"

choices
object[]
required
usage
object