Models/qwen3.7-plus
Model Code
qwen3.7-plus
Try now

Model overview

Qwen3.7Text generationDeep thinkingVision understanding

Qwen3.7-Plus is the cost-effective model in the Qwen3.7 series. It combines strong text capabilities with upgraded vision-language ability, and keeps full agentic capability for coding, tool use, productivity workflows, GUI understanding, visual-reference code generation, and mobile app navigation.

Company: AlibabaProvider: Alibaba Cloud

Model capabilities

Input modalityT
Output modalityT
Model experience
Function calling
Structured output
Web search
Prefix completion
Context cache
Batch inference
Fine-tuning×

Model pricing

Input$0.2985/1M tokens
Input (cache hit)$0.0597/1M tokens
Input (Batch File)$0.1493/1M tokens
Explicit cache write$0.3731/1M tokens
Explicit cache hit$0.02985/1M tokens
Input (Batch Chat)$0.2985/1M tokens
Output$1.19/1M tokens
Output (Batch File)$0.597/1M tokens
Output (Batch Chat)$1.19/1M tokens

Tool call pricing

code_interpreter Responses APIFree
i2i_search Responses API$7.16/1K calls
t2i_search Responses API$3.58/1K calls
web_extractor Responses APIFree
web_search Responses API$0.597/1K calls

Rate limits and context

Maximum input length991K
Maximum input length (thinking mode)983K
Context length1M
Maximum output length64K
Maximum output length (thinking mode)64K
Maximum reasoning length256K
RPM30000
TPM5000000

API reference

EndpointPOST /v1/chat/completions
SDKOpenAI-compatible

API code examples

Get API Key
from openai import OpenAI

client = OpenAI(
    api_key="$WLROUTER_API_KEY",
    base_url="https://api.wlrouter.com/v1"
)

response = client.chat.completions.create(
    model="qwen3.7-plus",
    messages=[
        {"role": "user", "content": "Reply with one short sentence."}
    ],
    max_tokens=32
)

print(response.choices[0].message.content)