# Grok Messages API

通过 Messages API 和 OpenAI 兼容的 Responses API 生成文本：请求格式、参数、响应、token 用量与对话历史。

如需在生成过程中显示回答，请参阅 [Streaming API](https://grok-api.dev/zh/docs/streaming).

## 请求示例

```bash
curl https://api.llm-gate.tech/v1/responses \
  -H "Authorization: Bearer $GROK_API_DEV_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.5",
    "input": "用两句话解释二分查找。"
  }'
```

## 请求参数

| 字段 | 类型 | 必填 | 说明 |
| --- | --- | --- | --- |
| model | string | 是 | 模型 ID。 |
| input | string 或 array | 是 | prompt 或有序消息列表。 |
| instructions | string | 否 | 当前响应的高级指令。 |
| max_output_tokens | integer | 否 | 生成 token 的最大数量。 |
| temperature | number | 否 | 采样随机性。 |
| stream | boolean | 否 | 为 true 时返回增量 SSE 事件。 |
| store | boolean | 否 | 控制能否通过 ID 引用响应。 |
| previous_response_id | string | 否 | 用于继续对话的上一条响应 ID。 |

## 消息角色

| role | description |
| --- | --- |
| system | 应用规则与上下文。 |
| user | 当前用户请求。 |
| assistant | 本地历史中的上一条模型回复。 |

## 响应格式

| status | meaning |
| --- | --- |
| completed | 响应已就绪。 |
| in_progress | 仍在生成。 |
| incomplete | 响应在完成前停止。 |

`usage.input_tokens` 是处理的上下文，`usage.output_tokens` 是生成内容，`usage.total_tokens` 是两者之和。输入和输出分别计费。

## Stateful 与 stateless 对话

stateless 模式由应用保存消息历史，并在每次请求中发送所需上下文。stateful 模式通过 `previous_response_id` 继续先前响应。
