qwen3.7-flash
模型信息
Qwen3.7-Flash 通义千问多模态轻量模型,百万上下文,支持图文视频输入,思考可开关,面向多模态 Agent 与视觉代码场景,高性价比。
厂商Qwen
模型名称qwen3.7-flash
多模态不支持
上下文与限流
- 上下文长度
- 1M
- 应用 TPM
- 5,000,000
- 应用 RPM
- 500
价格信息
官方价与套餐折后价均按元/百万 Token 展示
| 计费项 | 官方价 |
|---|---|
| 标准输入Token(未命中缓存读写,且输入≤32K) | ¥ 0.2 |
| 标准输出Token(输入≤32K) | ¥ 0.8 |
| 显式缓存写Token(输入≤32K,最小创建阈值≥1024Token) | ¥ 0.25 |
| 显式缓存读Token(输入≤32K) | ¥ 0.02 |
| 隐式缓存读Token(输入≤32K,最小创建阈值≥256Token) | ¥ 0.04 |
| 标准输入Token(未命中缓存读写,且32K<输入≤256K) | ¥ 0.6 |
| 标准输出Token(32K<输入≤256K) | ¥ 2.4 |
| 显式缓存写Token(32K<输入≤256K,最小创建阈值≥1024Token) | ¥ 0.75 |
| 显式缓存读Token(32K<输入≤256K) | ¥ 0.06 |
| 隐式缓存读Token(32K<输入≤256K,最小创建阈值≥256Token) | ¥ 0.12 |
| 标准输入Token(未命中缓存读写,且256K<输入≤1M) | ¥ 1.2 |
| 标准输出Token(256K<输入≤1M) | ¥ 4.8 |
| 显式缓存写Token(256K<输入≤1M,最小创建阈值≥1024Token) | ¥ 1.5 |
| 显式缓存读Token(256K<输入≤1M) | ¥ 0.12 |
| 隐式缓存读Token(256K<输入≤1M,最小创建阈值≥256Token) | ¥ 0.24 |
服务信息
- 模型调用名(model 参数)
- qwen3.7-flash
- OpenAI base_url(Chat / Response)
- https://openapi.youdao.com/llmgateway/api/v1
- Anthropic base_url(Messages)
- https://openapi.youdao.com/llmgateway/anthropic
- 兼容协议
- OpenAI Chat
- OpenAI Response
- Anthropic messages
- 流式输出
- 支持
- 工具调用
- 支持
- Auto 调度支持
- 未纳入 auto 范围
- 服务公开状态
- 公开
