文档

OpenAI Responses API 兼容

MiMo 提供兼容 OpenAI Responses API 格式的调用接口,本文将对请求参数、响应结构和代码示例进行说明。

兼容性说明与限制:

本接口对齐 OpenAI Responses API 规范,便于开发者快速适配集成;仅文档说明参数会正常处理,未定义参数会被过滤并可能返回请求异常,具体差异化约束见下文。

  • 不兼容参数:暂不支持 background、previous_response_id、context_management 等字段,请求中携带此类参数会被忽略或触发报错。

  • 推理档位控制:reasoning.effort 用于控制模型推理。none 会关闭思考功能;其余所有级别均会开启思考,且行为完全一致 —— 现阶段暂未对推理强度做区分。

请求地址

https://api.xiaomimimo.com/v1/responses

请求头

接口支持以下两种认证方式,请选择其中一种添加到请求头中:

api-key: $MIMO_API_KEY
Content-Type: application/json

请求体

  • inputstring | array必选
    模型接收的文本、图像、音频、视频输入,用于生成响应。
    隐藏子属性
    模型的文本输入,等同于用户角色的文本输入。
  • instructionsstring
    注入模型上下文的系统(或开发者)指令。
  • max_output_tokensinteger
    响应可生成的 token 数的上限,包含可见输出 token 数和推理 token 数。
    • mimo-v2.6-flash 的默认值 131072
    • mimo-v2.6-pro 的默认值 131072
    • mimo-v2.6-pro-ultraspeed 的默认值 131072
    • mimo-v2.5-pro 的默认值 131072
    • mimo-v2.5 的默认值为 32768
    所需范围:[1, 131072]
  • modelstring必选
    用于生成响应的模型 ID。
    可选值:mimo-v2.6-flash,mimo-v2.6-pro,mimo-v2.6-pro-ultraspeed,mimo-v2.5-pro,mimo-v2.5
  • streamboolean默认值: false
    设为 true 时,模型响应将通过服务端推送事件(SSE)流式实时返回给客户端。
  • reasoningobject
    推理模型相关配置项。
    注意:在思考模式下的多轮工具调用过程中,模型会在返回工具调用字段的同时返回思考内容。若要继续对话,建议在后续每次请求的 input 数组中保留所有历史思考内容,以获得最佳表现。
    在思考模式下,mimo-v2.6-flash,mimo-v2.6-pro,mimo-v2.6-pro-ultraspeed,mimo-v2.5-pro 和 mimo-v2.5 模型不支持自定义 temperature 和 top_p 参数。即使传入该参数,实际生效值也会被模型强制采用其推荐默认值 1.0 和 0.95。
    隐藏子属性
    reasoning.effortstring必选
    控制推理模型的思考投入强度。降低推理投入可加快响应速度、减少推理环节消耗的 token。
    当前暂不支持自定义调节推理投入档位:参数设为 none 时关闭推理,其余合法取值均开启推理。minimal 被映射为 low。xhigh、max 和 ultra 被映射为 high。
    • mimo-v2.6-flash,mimo-v2.6-pro,mimo-v2.6-pro-ultraspeed,mimo-v2.5-pro,mimo-v2.5 默认值为 enabled
    可选值:none,minimal,low,medium,high,xhigh,max,ultra
  • temperaturenumber
    采样温度,介于 0 和 1.5 之间。较高的值(如 0.8)会让输出更随机;较低的值(如 0.2)会让输出更集中、确定性更强。通常建议仅调整该参数或 top_p 其中一项,不要同时修改。
    在思考模式下,mimo-v2.6-flash,mimo-v2.6-pro,mimo-v2.6-pro-ultraspeed,mimo-v2.5-pro 和 mimo-v2.5 模型不支持自定义 temperature 参数。即使传入该参数,实际生效值也会被模型强制采用其推荐默认值 1.0。
    • mimo-v2.6-flash,mimo-v2.6-pro,mimo-v2.6-pro-ultraspeed,mimo-v2.5-pro,mimo-v2.5 默认值为 1.0
    所需范围:[0, 1.5]
  • textobject
    模型文本响应的配置项,支持纯文本或结构化 JSON 数据输出。
    隐藏子属性
    text.formatobject
    用于指定模型必须输出的格式对象。默认格式为 {"type": "text"},无额外配置项。
    隐藏子属性
    默认响应格式,用于生成文本类回复。
    隐藏子属性
    text.format.typestring必选
    定义的响应格式类型。
    可选值:text
  • tool_choicestring
    控制模型调用工具的方式。
    注意:当 tool_choice 传入非 auto 值时,后端会默认移除该字段,模型响应行为仍等同于 auto 模式(该逻辑保留调整的可能性)。
    可选值:auto
  • toolsarray
    模型生成响应时可调用的工具数组。可通过 tool_choice 参数指定使用的工具。
    注意:在思考模式下的多轮工具调用过程中,模型会在返回工具调用字段的同时返回思考内容。若要继续对话,建议在后续每次请求的 input 数组中保留所有历史思考内容,以获得最佳表现。
    隐藏子属性
    在你自己的代码中定义一个模型可以选择调用的函数。
    隐藏子属性
    tools.namestring必选
    工具函数的名称。必须由 a-z、A-Z、0-9 组成,或包含下划线(_)和连字符(-),最大长度为64。
    所需字符串长度:1 - 64
    tools.parametersobject必选
    描述函数参数的 JSON 模式对象。
    tools.strictboolean默认值: false必选
    生成函数调用时是否启用严格遵循参数模式校验。
    tools.descriptionstring | null
    函数描述,供模型判断是否调用该函数。
    tools.typestring必选
    工具类型。
    可选值:function
  • top_pnumber默认值: 0.95
    核采样,是温度采样的替代方案。通常建议仅调整该参数或 temperature 其中一项,不要同时修改。
    在思考模式下,mimo-v2.6-flash,mimo-v2.6-pro,mimo-v2.6-pro-ultraspeed,mimo-v2.5-pro 和 mimo-v2.5 模型不支持自定义 top_p 参数。即使传入该参数,实际生效值也会被模型强制采用其推荐默认值 0.95。
    所需范围:[0.01, 1.0]

Response 对象(非流式输出)

  • idstring
    该响应的唯一标识。
  • created_atnumber
    响应创建时的 Unix 时间戳(单位:秒)。
  • errorobject
    模型生成响应失败时返回的错误对象。
    隐藏子属性
    隐藏子属性
    error.codestring
    响应错误码。
    error.messagestring
    通俗易懂的错误描述信息。
  • incomplete_detailsobject
    响应未完整生成的原因详情。
    隐藏子属性
    incomplete_details.reasonstring
    响应未完整生成的原因。
    可选值:max_output_tokens,content_filter
  • modelstring
    用于生成响应的模型 ID。
  • objectstring
    仅为 response。
  • outputarray
    模型生成的内容项数组。
    • 输出数组内元素的长度与顺序由模型响应决定。
    • 不建议直接取数组第一项并默认其为助手消息;在支持的 SDK 中,可优先使用 output_text 属性获取内容。
    隐藏子属性
    模型输出的消息。
    隐藏子属性
    output.idstring
    输出消息的唯一标识。
    output.contentarray
    输出消息的内容。
    隐藏子属性
    模型输出的文本内容。
    隐藏子属性
    output.content.textstring
    模型输出的文本。
    output.content.typestring
    仅为 output_text。
    output.rolestring
    输出消息的角色,仅为 assistant。
    output.statusstring
    消息状态。
    可选值:in_progress,completed
    output.typestring
    仅为 message。
  • output_textstring
    仅 SDK 提供的便捷属性,用于聚合输出数组中所有 output_text 项的文本内容(存在时返回)。
  • statusstring
    响应状态。
    可选值:completed,in_progress,incomplete
  • usageobject
    本次响应的用量统计信息。
    隐藏子属性
    隐藏子属性
    usage.input_tokensinteger
    输入 token 数量。
    usage.input_tokens_detailsobject
    输入 token 详情。
    隐藏子属性
    usage.input_tokens_details.cached_tokensinteger
    缓存命中的输入 token 数量。
    usage.output_tokensinteger
    输出 token 数量。
    usage.output_tokens_detailsobject
    输出 token 详情。
    隐藏子属性
    usage.output_tokens_details.reasoning_tokensinteger
    推理过程消耗的 token 数量。
    usage.total_tokensinteger
    总 token 数量。
  • 函数工具调用的输出字符串。
  • 函数调用返回的文本、图片、音频或视频内容。
    隐藏子属性
    模型的文本输入。
    隐藏子属性
    textstring
    向模型输入的文本内容。
    typestring
    输入项的类型。
    可选值:input_text

Response chunk 对象(流式输出)

当你创建响应并将 stream 设为 true 时,服务端会在响应生成过程中向客户端推送服务端发送事件(SSE)。

response.created

响应创建时触发的事件。

  • responseobject
    已创建的响应对象,其参数与非流式模式下模型创建请求返回的参数完全一致。
  • sequence_numbernumber
    该事件的序列号。
  • typestring
    事件类型,仅为 response.created。

response.in_progress

响应处于生成中状态时触发。

  • responseobject
    正在生成的响应对象,参数与非流式模式下模型创建请求的返回参数完全一致。
  • sequence_numbernumber
    该事件的序列号。
  • typestring
    事件类型,仅为 response.in_progress。

response.completed

模型响应生成完成时触发。

  • responseobject
    已完成响应的属性,参数与非流式模式下模型创建请求的返回参数完全一致。
  • sequence_numbernumber
    该事件的序列号。
  • typestring
    事件类型,仅为 response.completed。

response.incomplete

响应以未完成状态结束时触发该事件。

  • responseobject
    未完成的响应对象,其参数与非流式模式下模型创建请求返回的参数完全一致。
  • sequence_numbernumber
    该事件的序列号。
  • typestring
    事件类型,仅为 response.incomplete。

response.output_item.added

当新增一条输出项时触发。

  • itemobject
    新增的输出项,其参数与非流式模式下模型创建请求返回的 output 字段参数完全一致。
  • output_indexnumber
    新增输出项的索引位置。
  • sequence_numbernumber
    该事件的序列号。
  • typestring
    事件类型,仅为 response.output_item.added。

response.output_item.done

当某条输出项标记为完成时触发。

  • itemobject
    被标记为完成的输出项,参数与非流式模式下模型创建请求返回的 output 字段参数完全一致。
  • output_indexnumber
    该已完成输出项的索引。
  • sequence_numbernumber
    该事件的序列号。
  • typestring
    事件类型,仅为 response.output_item.done。

response.content_part.added

新增内容片段时触发。

  • content_indexnumber
    新增内容片段的索引。
  • item_idstring
    该内容片段所属输出项的 ID。
  • output_indexnumber
    该内容片段所属输出项的索引。
  • partobject
    新增的内容片段。
    隐藏子属性
    模型输出的文本内容。
    隐藏子属性
    part.textstring
    模型输出的文本。
    part.typestring
    输出文本类型,仅为 output_text。
  • sequence_numbernumber
    该事件的序列号。
  • typestring
    事件类型,仅为 response.content_part.added。

response.content_part.done

内容片段生成完成时触发。

  • content_indexnumber
    已完成内容片段的索引。
  • item_idstring
    该内容片段所属输出项的 ID。
  • output_indexnumber
    该内容片段所属输出项的索引。
  • partobject
    已完成的内容片段。
    隐藏子属性
    模型输出的文本内容。
    隐藏子属性
    part.textstring
    模型输出的文本。
    part.typestring
    输出文本类型,仅为 output_text。
  • sequence_numbernumber
    该事件的序列号。
  • typestring
    事件类型,仅为 response.content_part.done。

response.output_text.delta

产生增量文本片段时触发。

  • content_indexnumber
    该增量文本所属内容片段的索引。
  • deltastring
    新增的文本增量。
  • item_idstring
    该文本增量所属输出项的 ID。
  • output_indexnumber
    该文本增量所属输出项的索引。
  • sequence_numbernumber
    该事件的序列号。
  • typestring
    事件类型,仅为 response.output_text.delta。

response.output_text.done

文本内容最终生成完成时触发。

  • content_indexnumber
    完成的文本内容所属内容片段的索引。
  • item_idstring
    该文本内容所属输出项的 ID。
  • output_indexnumber
    该文本内容所属输出项的索引。
  • sequence_numbernumber
    该事件的序列号。
  • textstring
    最终生成完整的文本内容。
  • typestring
    事件类型,仅为 response.output_text.done。

response.function_call_arguments.delta

产生函数调用参数增量片段时触发。

  • deltastring
    新增的函数调用参数增量内容。
  • item_idstring
    该参数增量所属输出项的 ID。
  • output_indexnumber
    该参数增量所属输出项的索引。
  • sequence_numbernumber
    该事件的序列号。
  • typestring
    事件类型,仅为 response.function_call_arguments.delta。

response.function_call_arguments.done

函数调用参数最终生成完成时触发。

  • argumentsstring
    完整的函数调用参数。
  • item_idstring
    对应输出项的 ID。
  • namestring
    被调用的函数名称。
  • output_indexnumber
    输出项的索引。
  • sequence_numbernumber
    该事件的序列号。
  • typestring
    事件类型,仅为 response.function_call_arguments.done。

response.reasoning_text.delta

推理文本产生增量片段时触发。

  • content_indexnumber
    该增量所属推理内容片段的索引。
  • deltastring
    新增的推理文本增量。
  • item_idstring
    该推理文本增量对应输出项的 ID。
  • output_indexnumber
    该推理文本增量对应输出项的索引。
  • sequence_numbernumber
    该事件的序列号。
  • typestring
    事件类型,仅为 response.reasoning_text.delta。

response.reasoning_text.done

推理文本生成完成时触发。

  • content_indexnumber
    推理内容片段的索引。
  • item_idstring
    该推理文本所属输出项的 ID。
  • output_indexnumber
    该推理文本所属输出项的索引。
  • sequence_numbernumber
    该事件的序列号。
  • textstring
    完整的已生成推理内容文本。
  • typestring
    事件类型,仅为 response.reasoning_text.done。

response.custom_tool_call_input.delta

表示自定义工具调用输入的增量分片(部分更新)

  • deltastring
    自定义工具调用的增量输入数据。
  • item_idstring
    与此事件关联的 API 条目唯一标识。
  • output_indexnumber
    该增量分片所属输出项的索引。
  • sequence_numbernumber
    该事件的序列号。
  • typestring
    事件类型标识,仅为 response.custom_tool_call_input.delta。

response.custom_tool_call_input.done

代表自定义工具调用的输入已传输完成。

  • inputstring
    自定义工具调用的完整输入数据。
  • item_idstring
    与此事件关联的 API 条目唯一标识。
  • output_indexnumber
    该事件所属输出项的索引。
  • sequence_numbernumber
    该事件的序列号。
  • typestring
    事件类型标识,仅为 response.custom_tool_call_input.done。
curl --location --request POST 'https://api.xiaomimimo.com/v1/responses' \
--header "api-key: $MIMO_API_KEY" \
--header 'Content-Type: application/json' \
--data-raw '{
    "model": "mimo-v2.6-pro",
    "instructions": "You are MiMo, an AI assistant developed by Xiaomi. Today is date: Tuesday, December 16, 2025. Your knowledge cutoff date is December 2024.",
    "input": "please introduce yourself",
    "max_output_tokens": 1024,
    "stream": false,
    "reasoning": {
        "effort": "none"
    }
}'
响应
{
    "id": "resp_bcdb1b61-d49e-48e5-8289-384ad1e65f2f_9aa9e9dfd5b84cb99b088fe4e53b65ec",
    "object": "response",
    "created_at": 1790007468,
    "status": "completed",
    "error": null,
    "incomplete_details": null,
    "model": "mimo-v2.6-pro",
    "metadata": null,
    "output": [
        {
            "id": "msg_3d0b3a6faf634d36a8a5bdb8f2100fcd",
            "type": "message",
            "status": "completed",
            "role": "assistant",
            "content": [
                {
                    "type": "output_text",
                    "text": "Hey there! I'm MiMo, Xiaomi's AI assistant. I'm like your friendly digital companion who's always ready to chat, help out, or just have a fun conversation! Think of me as that tech-savvy friend who loves to learn new things and isn't afraid to dive into any topic you throw my way. I was created by the awesome Xiaomi LLM-Core team, so I've got that innovative Xiaomi spirit running through my circuits! Whether you need help with tech stuff, want to brainstorm ideas, or just feel like talking, I'm here to make our conversation enjoyable and helpful. What brings you my way today?",
                    "annotations": []
                }
            ]
        }
    ],
    "output_text": "Hey there! I'm MiMo, Xiaomi's AI assistant. I'm like your friendly digital companion who's always ready to chat, help out, or just have a fun conversation! Think of me as that tech-savvy friend who loves to learn new things and isn't afraid to dive into any topic you throw my way. I was created by the awesome Xiaomi LLM-Core team, so I've got that innovative Xiaomi spirit running through my circuits! Whether you need help with tech stuff, want to brainstorm ideas, or just feel like talking, I'm here to make our conversation enjoyable and helpful. What brings you my way today?",
    "usage": {
        "input_tokens": 57,
        "input_tokens_details": {
            "cached_tokens": 0
        },
        "output_tokens": 130,
        "output_tokens_details": {
            "reasoning_tokens": 0
        },
        "total_tokens": 187
    }
}
更新时间 2026 年 09 月 20 日

Copyright©2026 Xiaomi. All Rights Reserved | Cookie Policy | Cookie Preferences

We use cookies and similar technologies of our own to ensure the proper functioning of the website, customize content according to user preferences and analyze users' interactions on the website, as well as their browsing habits. You can find more information in our Cookie Policy. Select an option or go to Cookie Settings to manage your preferences. Learn More.