qwen3.7-flash

模型信息

Qwen3.7-Flash 通义千问多模态轻量模型,百万上下文,支持图文视频输入,思考可开关,面向多模态 Agent 与视觉代码场景,高性价比。

厂商Qwen
模型名称qwen3.7-flash
多模态不支持

上下文与限流

上下文长度
1M
应用 TPM
5,000,000
应用 RPM
500

价格信息

官方价与套餐折后价均按元/百万 Token 展示

计费项 官方价
标准输入Token(未命中缓存读写,且输入≤32K)¥ 0.2
标准输出Token(输入≤32K)¥ 0.8
显式缓存写Token(输入≤32K,最小创建阈值≥1024Token)¥ 0.25
显式缓存读Token(输入≤32K)¥ 0.02
隐式缓存读Token(输入≤32K,最小创建阈值≥256Token)¥ 0.04
标准输入Token(未命中缓存读写,且32K<输入≤256K)¥ 0.6
标准输出Token(32K<输入≤256K)¥ 2.4
显式缓存写Token(32K<输入≤256K,最小创建阈值≥1024Token)¥ 0.75
显式缓存读Token(32K<输入≤256K)¥ 0.06
隐式缓存读Token(32K<输入≤256K,最小创建阈值≥256Token)¥ 0.12
标准输入Token(未命中缓存读写,且256K<输入≤1M)¥ 1.2
标准输出Token(256K<输入≤1M)¥ 4.8
显式缓存写Token(256K<输入≤1M,最小创建阈值≥1024Token)¥ 1.5
显式缓存读Token(256K<输入≤1M)¥ 0.12
隐式缓存读Token(256K<输入≤1M,最小创建阈值≥256Token)¥ 0.24

服务信息

模型调用名(model 参数)
qwen3.7-flash
OpenAI base_url(Chat / Response)
https://openapi.youdao.com/llmgateway/api/v1
Anthropic base_url(Messages)
https://openapi.youdao.com/llmgateway/anthropic
兼容协议
  • OpenAI Chat
  • OpenAI Response
  • Anthropic messages
流式输出
支持
工具调用
支持
Auto 调度支持
未纳入 auto 范围
服务公开状态
公开