qwen3.8-flash
模型信息
Qwen3.8-Flash 通义千问新一代高效 MoE 多模态模型,百万上下文,图文视频输入,适合Agentic编程与长周期办公,主打高性价比。
厂商Qwen
模型名称qwen3.8-flash
多模态不支持
上下文与限流
- 上下文长度
- 1M
- 应用 TPM
- 5,000,000
- 应用 RPM
- 5,000
价格信息
官方价与套餐折后价均按元/百万 Token 展示
| 计费项 | 官方价 |
|---|---|
| Qwen3.8-Flash,输入token | ¥ 0.8 |
| Qwen3.8-Flash,输出token | ¥ 2.7 |
| Qwen3.8-Flash,显式缓存创建 | ¥ 1.25 |
| Qwen3.8-Flash,隐式缓存命中(默认) | ¥ 0.1 |
| Qwen3.8-Flash,显式缓存命中 | ¥ 0.1 |
服务信息
- 模型调用名(model 参数)
- qwen3.8-flash
- OpenAI base_url(Chat / Response)
- https://openapi.youdao.com/llmgateway/api/v1
- Anthropic base_url(Messages)
- https://openapi.youdao.com/llmgateway/anthropic
- 兼容协议
- OpenAI Chat
- OpenAI Response
- Anthropic messages
- 流式输出
- 支持
- 工具调用
- 支持
- Auto 调度支持
- 未纳入 auto 范围
- 服务公开状态
- 公开
