PRICING

Pricing

Transparent pricing, pay-as-you-go. All models enjoy unified API, unified billing, no hidden fees.

ByteDance

ByteDance AI Model Advanced language understanding, content generation, and complex reasoning capabilities.

Model Name Billing Type Context Input Price(/kt) Output Price(/kt) Action
Doubao-Seed-1.8 Default 256000 $0.0008 / 1000 tokens $0.002 / 1000 tokens Documentation

Qwen

Qwen AI Model Advanced language understanding, content generation, and complex reasoning capabilities.

Model Name Billing Type Context Input Price(/kt) Output Price(/kt) Action
qwen3.5-plus 0<Token<=128K 10000000 $0.000805 / 1000 tokens $0.004816 / 1000 tokens Documentation
256K<Token<=1M 10000000 $0.004011 / 1000 tokens $0.02408 / 1000 tokens
128K<Token<=256K 10000000 $0.002009 / 1000 tokens $0.01204 / 1000 tokens
qwen3-max 0<Token<=32K 256000 $0.002513 / 1000 tokens $0.010038 / 1000 tokens Documentation
32K<Token<=128K 256000 $0.004018 / 1000 tokens $0.016058 / 1000 tokens
128K<Token<=256K 256000 $0.007028 / 1000 tokens $0.028098 / 1000 tokens
qwen3-235b-a22b Default 256000 $0.002009 / 1000 tokens $0.020076 / 1000 tokens Documentation
qwen3.5-flash 0<Token<=128K 1000000 $0.000203 / 1000 tokens $0.002009 / 1000 tokens Documentation
128K<Token<=256K 1000000 $0.000805 / 1000 tokens $0.008029 / 1000 tokens
256K<Token<=1M 1000000 $0.001204 / 1000 tokens $0.01204 / 1000 tokens
qwen-flash 0<Token<=128K 1000000 $0.000154 / 1000 tokens $0.001512 / 1000 tokens Documentation
256K<Token<=1M 1000000 $0.001211 / 1000 tokens $0.012047 / 1000 tokens
128K<Token<=256K 1000000 $0.000609 / 1000 tokens $0.006027 / 1000 tokens
qwen3.5-27b 0<Token<=128K 256000 $0.000602 / 1000 tokens $0.004816 / 1000 tokens Documentation
128K <Token<=256K 256000 $0.001806 / 1000 tokens $0.014448 / 1000 tokens
qwen3.5-35b-a3b 0<Token<=128K 256000 $0.000399 / 1000 tokens $0.003213 / 1000 tokens Documentation
128K <Token<=256K 256000 $0.001603 / 1000 tokens $0.012845 / 1000 tokens
qwen3.6-plus 0<Token<=256K 1000000 $0.001932 / 1000 tokens $0.011557 / 1000 tokens Documentation
256K<Token<=1M 1000000 $0.007707 / 1000 tokens $0.046214 / 1000 tokens
qwen3-max-preview 0<Token<=32K 256000 $0.006027 / 1000 tokens $0.024087 / 1000 tokens Documentation
32K<Token<=128K 256000 $0.010038 / 1000 tokens $0.040145 / 1000 tokens
128K<Token<=256K 256000 $0.015057 / 1000 tokens $0.060214 / 1000 tokens
qwen-plus 0<Token<=128K 1000000 $0.000805 / 1000 tokens $0.002009 / 1000 tokens Documentation
256K<Token<=1M 1000000 $0.004823 / 1000 tokens $0.048167 / 1000 tokens
128K<Token<=256K 1000000 $0.002415 / 1000 tokens $0.020076 / 1000 tokens
qwen-plus-latest 0<Token<=128K 1000000 $0.000805 / 1000 tokens $0.002009 / 1000 tokens Documentation
256K<Token<=1M 1000000 $0.004823 / 1000 tokens $0.048167 / 1000 tokens
128K<Token<=256K 1000000 $0.002415 / 1000 tokens $0.020076 / 1000 tokens
qwen3-coder-plus 0<Token<=32K 1000000 $0.004018 / 1000 tokens $0.016058 / 1000 tokens Documentation
32K<Token<=128K 1000000 $0.006027 / 1000 tokens $0.024087 / 1000 tokens
128K<Token<=256K 1000000 $0.010038 / 1000 tokens $0.040145 / 1000 tokens
256K<Token<=1M 1000000 $0.020076 / 1000 tokens $0.200697 / 1000 tokens
qwen-plus-character Default 32000 $0.000805 / 1000 tokens $0.002009 / 1000 tokens Documentation
qwen3-coder-next 0<Token<=32K 256000 $0.00100345 / 1000 tokens $0.00401387 / 1000 tokens Documentation
32K<Token<=128K 256000 $0.00150521 / 1000 tokens $0.00602077 / 1000 tokens
128K<Token<=256K 256000 $0.00250866 / 1000 tokens $0.01003464 / 1000 tokens
qwen3-vl-32b-instruct Default 128000 $0.002009 / 1000 tokens $0.008029 / 1000 tokens Documentation
qwen3-vl-32b-thinking Default 128000 $0.002009 / 1000 tokens $0.020076 / 1000 tokens Documentation
qwen3-vl-30b-a3b-instruct Default 128000 $0.000756 / 1000 tokens $0.00301 / 1000 tokens Documentation
qwen3-vl-30b-a3b-thinking Default 128000 $0.000756 / 1000 tokens $0.007525 / 1000 tokens Documentation
qwen3.6-flash 0<Token<=256K 1000000 $0.001155 / 1000 tokens $0.00693 / 1000 tokens Documentation
256K<Token<=1M 1000000 $0.00462 / 1000 tokens $0.027727 / 1000 tokens
qwen3.6-35b-a3b Default 256000 $0.001736 / 1000 tokens $0.010395 / 1000 tokens Documentation
qwen3.5-122b-a10b 0<Token<=128K 256000 $0.000805 / 1000 tokens $0.006419 / 1000 tokens Documentation
128K <Token<=256K 256000 $0.002009 / 1000 tokens $0.016058 / 1000 tokens
qwen3.5-397b-a17b 0<Token<=128K 256000 $0.001204 / 1000 tokens $0.007224 / 1000 tokens Documentation
128K <Token<=256K 256000 $0.00301 / 1000 tokens $0.01806 / 1000 tokens
qwen3-coder-flash 0<Token<32K 1000000 $0.001008 / 1000 tokens $0.004018 / 1000 tokens Documentation
32K<Token<128K 1000000 $0.004018 / 1000 tokens $0.006027 / 1000 tokens
128K<Token<256K 1000000 $0.002513 / 1000 tokens $0.010038 / 1000 tokens
256K<Token<1M 1000000 $0.005019 / 1000 tokens $0.025088 / 1000 tokens
kimi-k2.6 Default 256000 $0.0062573 / 1000 tokens $0.0259917 / 1000 tokens Documentation
Cache Hitin 256000 $0.0012516 / 1000 tokens -
Explicit Cache Creation 256000 $0.0078218 / 1000 tokens -
Explicit Cache Hitin 256000 $0.0006258 / 1000 tokens -
kimi-k2.5 Default 256000 $0.004018 / 1000 tokens $0.021077 / 1000 tokens Documentation
Cache Hitin 256000 $0.000805 / 1000 tokens -
Explicit Cache Creation 256000 $0.005026 / 1000 tokens -
Explicit Cache Hitin 256000 $0.000399 / 1000 tokens -
qwen-flash-character Default 8000 $0.000238 / 1000 tokens $0.001421 / 1000 tokens Documentation
Cache Hitin 8000 $4.9E-5 / 1000 tokens -
qwen3.7-max 0<Token≤1M 1000000 $0.005775 / 1000 tokens $0.0173285 / 1000 tokens Documentation
Input Cache Hitin 1000000 $0.00231 / 1000 tokens -
Explicit Cache Creation 1000000 $0.014441 / 1000 tokens -
Explicit Cache Hitin 1000000 $0.001155 / 1000 tokens -
code_interpreter 1000000 - $0 / 次
web_extractor 1000000 - $0 / 次
web_search 1000000 - $4.013877 / 次
qwen3.7-plus Token≤256k 1000000 $0.001932 / 1000 tokens $0.007707 / 1000 tokens Documentation
256k<Token<1M 1000000 $0.005782 / 1000 tokens $0.023107 / 1000 tokens
Token≤256k Cache Hitin 1000000 $0.000392 / 1000 tokens -
256k<Token<1M Cache Hitin 1000000 $0.001162 / 1000 tokens -
Token≤256k Explicit Cache Creation 1000000 $0.000392 / 1000 tokens -
256k<Token<1M Explicit Cache Creation 1000000 $0.007224 / 1000 tokens -
Token≤256k Explicit Cache Hitin 1000000 $0.000196 / 1000 tokens -
256k<Token<1M Explicit Cache Hitin 1000000 $0.000581 / 1000 tokens -
code_interpreter 1000000 - $0 / 次
i2i_search 1000000 - $48.167 / 次
t2i_search 1000000 - $24.08 / 次
web_search 1000000 - $4.013877 / 次

Deepseek

Deepseek AI Model Advanced language understanding, content generation, and complex reasoning capabilities.

Model Name Billing Type Context Input Price(/kt) Output Price(/kt) Action
deepseek-v3.2 Default 128000 $0.00050225 / 1000 tokens $0.00075425 / 1000 tokens Documentation
deepseek-v4-flash Default 1000000 $0.001 / 1000 tokens $0.002 / 1000 tokens Documentation
Cache Hitin 1000000 $2.0E-5 / 1000 tokens -
deepseek-v4-pro Default 1000000 $0.003 / 1000 tokens $0.006 / 1000 tokens Documentation
Cache Hitin 1000000 $2.5E-5 / 1000 tokens -

Zhipu

Zhipu AI Model Advanced language understanding, content generation, and complex reasoning capabilities.

Model Name Billing Type Context Input Price(/kt) Output Price(/kt) Action
glm-4.7 0<Token<=32K 198000 $0.003017 / 1000 tokens $0.014049 / 1000 tokens Documentation
32K<Token<=200K 198000 $0.004018 / 1000 tokens $0.016058 / 1000 tokens
0<Token<=32K Cache Hitin 198000 $0.000602 / 1000 tokens -
32K<Token<=200K Cache Hitin 198000 $0.000805 / 1000 tokens -
glm-5 0<Token<=32K 198000 $0.004011 / 1000 tokens $0.01806 / 1000 tokens Documentation
32K<Token<=200K 198000 $0.00602 / 1000 tokens $0.022078 / 1000 tokens
0<Token<=32K Cache Hitin 198000 $0.000805 / 1000 tokens -
32K<Token<=200K Cache Hitin 198000 $0.001204 / 1000 tokens -
glm-5.1 0<Token<=32K 202000 $0.005775 / 1000 tokens $0.023107 / 1000 tokens Documentation
32K<Token<=200K 202000 $0.0077 / 1000 tokens $0.026957 / 1000 tokens
0<Token<=32K Cache Hitin 202000 $0.001155 / 1000 tokens -
0<Token<=32K Explicit Cache Creation 202000 $0.007217 / 1000 tokens -
0<Token<=32K Explicit Cache Hitin 202000 $0.000581 / 1000 tokens -
32K<Token<=200K Cache Hitin 202000 $0.00154 / 1000 tokens -
32K<Token<=200K Explicit Cache Creation 202000 $0.009625 / 1000 tokens -
32K<Token<=200K Explicit Cache Hitin 202000 $0.00077 / 1000 tokens -
glm-5.2 Default 1000000 $0.008 / 1000 tokens $0.028 / 1000 tokens Documentation
Cache Hitin 1000000 $0.002 / 1000 tokens -

Tencent Cloud

Tencent Cloud AI Model Advanced language understanding, content generation, and complex reasoning capabilities.

Model Name Billing Type Context Input Price(/kt) Output Price(/kt) Action
Hy3 preview Token<16k 256000 $0.0012 / 1000 tokens $0.004 / 1000 tokens Documentation
Token<16k Cache Hitin 256000 $0.0004 / 1000 tokens -
16k<=Token<32k 256000 $0.0016 / 1000 tokens $0.0064 / 1000 tokens
Token>=32k 256000 $0.002 / 1000 tokens $0.008 / 1000 tokens
16k<=Token<32k Cache Hitin 256000 $0.0006 / 1000 tokens -
Token>=32k Cache Hitin 256000 $0.0008 / 1000 tokens -

MiniMax

MiniMax focuses on general AI with outstanding text processing capabilities.

Model Name Billing Type Context Input Price(/kt) Output Price(/kt) Action
MiniMax-M2.5 Default 200000 $0.002128 / 1000 tokens $0.008491 / 1000 tokens Documentation
Cache Hitin 200000 $0.000427 / 1000 tokens -