Skip to main content
POST
Messages API
以 Anthropic Messages API 兼容的格式调用 Kimi 模型。已经在使用 Anthropic SDK、Claude Code 等工具的开发者,只需把 base URL 指向 https://api.moonshot.cn/anthropic,即可直接调用 Kimi 模型。

授权

Authorization
string
header
必填

Authorization 请求头需要一个 Bearer 令牌。使用 MOONSHOT_API_KEY 作为令牌。这是一个服务端密钥,请在 API 密钥页面 生成。

请求体

application/json
model
enum<string>
默认值:kimi-k3
必填

模型 ID

可用选项:
kimi-k3
messages
object[]
必填

对话消息列表。若最后一条为 assistant 消息,模型会从该消息内容之后继续生成(Partial Mode)。

max_tokens
integer
必填

本次生成的最大 Token 数,必填。达到上限而未结束时 stop_reasonmax_tokens

必填范围: x >= 1
system

系统提示,可为字符串或 text 块数组

stream
boolean
默认值:false

是否以 Server-Sent Events 流式返回,默认 false

stop_sequences
string[]

停用词,完全匹配时停止输出,匹配到的词本身不会被输出。最多 5 个,每个不超过 32 字节。

Maximum array length: 5
tools
object[]

模型可调用的工具列表

tool_choice
object

控制模型是否调用工具。auto(默认):模型自行决定;any:强制调用任意工具;none:不调用工具。

metadata
object
output_config
object

输出配置:推理强度与结构化输出

响应

消息响应

id
string

本次响应的唯一标识符

type
enum<string>
可用选项:
message
示例:

"message"

role
enum<string>
可用选项:
assistant
model
string

请求中指定的模型

content
(thinking · object | text · object | tool_use · object)[]

内容块列表,顺序为 thinking → text → tool_use

stop_reason
enum<string> | null

停止原因。end_turn:自然结束(含命中 stop_sequences);max_tokens:达到 max_tokens 上限;tool_use:模型发起工具调用;refusal:触发内容安全审查。

可用选项:
end_turn,
max_tokens,
tool_use,
refusal,
null
stop_sequence
string | null

匹配到的停用词

usage
object

Token 用量