Model overview
Qwen3.7Text generationDeep thinkingVision understandingQwen3.7-Plus is the cost-effective model in the Qwen3.7 series. It combines strong text capabilities with upgraded vision-language ability, and keeps full agentic capability for coding, tool use, productivity workflows, GUI understanding, visual-reference code generation, and mobile app navigation.
Company: AlibabaProvider: Alibaba Cloud
Model capabilities
Input modalityT
Output modalityT
Model experience✓
Function calling✓
Structured output✓
Web search✓
Prefix completion✓
Context cache✓
Batch inference✓
Fine-tuning×
Model pricing
Input$0.2985/1M tokens
Input (cache hit)$0.0597/1M tokens
Input (Batch File)$0.1493/1M tokens
Explicit cache write$0.3731/1M tokens
Explicit cache hit$0.02985/1M tokens
Input (Batch Chat)$0.2985/1M tokens
Output$1.19/1M tokens
Output (Batch File)$0.597/1M tokens
Output (Batch Chat)$1.19/1M tokens
Tool call pricing
code_interpreter Responses APIFree
i2i_search Responses API$7.16/1K calls
t2i_search Responses API$3.58/1K calls
web_extractor Responses APIFree
web_search Responses API$0.597/1K calls
Rate limits and context
Maximum input length991K
Maximum input length (thinking mode)983K
Context length1M
Maximum output length64K
Maximum output length (thinking mode)64K
Maximum reasoning length256K
RPM30000
TPM5000000
API reference
EndpointPOST /v1/chat/completions
SDKOpenAI-compatible
API code examples
from openai import OpenAI client = OpenAI( api_key="$WLROUTER_API_KEY", base_url="https://api.wlrouter.com/v1" ) response = client.chat.completions.create( model="qwen3.7-plus", messages=[ {"role": "user", "content": "Reply with one short sentence."} ], max_tokens=32 ) print(response.choices[0].message.content)