/v1/responsesResponses API
Compatible with the OpenAI Responses API format. Compared with Chat Completions, it offers built-in tools (web search, code interpreter, etc.), a more flexible input format, and simplified multi-turn context management. Call it via the OpenAI SDK's client.responses.create().
Unsupported model error; use /v1/chat/completions or /v1/messages instead.qwen3.7-max, qwen3.7-plus, qwen3.6-plus, qwen3.5-plus, qwen3.5-flash, qwen3.6-flash, qwen-plus, qwen-flash, qwen3-coder-plus, qwen3-coder-flash, and more.Request Endpoint
https://nexusflow.hk/v1/responsesRequest Parameters
Code Examples
Built-in Tools
Enabling web_search, web_extractor, and code_interpreter together is recommended for best results.
Response Format
Non-streaming requests return a complete JSON object whose object field is "response". Streaming requests return an SSE event stream that ends with the response.completed event.
Auxiliary Endpoints
Supported Models
The Responses API only supports the Qwen series. Calling models like GLM, DeepSeek, Kimi, or MiniMax returns an Unsupported model error. Use /v1/chat/completions or /v1/messages instead.
The Responses API currently supports the Qwen series: qwen3.7-max, qwen3.7-plus, qwen3.6-plus, qwen3.5-plus, qwen3.5-flash, qwen3.6-flash, qwen-plus, qwen-flash, qwen3-coder-plus, qwen3-coder-flash, and more.
- The response linked by
previous_response_idis valid for 7 days. - Enabling the built-in tools together (web_search + web_extractor + code_interpreter) is recommended for best results.
- When
store: falseis set, the response is not stored and cannot be referenced later. - The final
response.completedevent in streaming output contains the complete usage information.