qwen3.8-flash

模型信息

Qwen3.8-Flash 通义千问新一代高效 MoE 多模态模型,百万上下文,图文视频输入,适合Agentic编程与长周期办公,主打高性价比。

厂商Qwen
模型名称qwen3.8-flash
多模态不支持

上下文与限流

上下文长度
1M
应用 TPM
5,000,000
应用 RPM
5,000

价格信息

官方价与套餐折后价均按元/百万 Token 展示

计费项 官方价
Qwen3.8-Flash,输入token¥ 0.8
Qwen3.8-Flash,输出token¥ 2.7
Qwen3.8-Flash,显式缓存创建¥ 1.25
Qwen3.8-Flash,隐式缓存命中(默认)¥ 0.1
Qwen3.8-Flash,显式缓存命中¥ 0.1

服务信息

模型调用名(model 参数)
qwen3.8-flash
OpenAI base_url(Chat / Response)
https://openapi.youdao.com/llmgateway/api/v1
Anthropic base_url(Messages)
https://openapi.youdao.com/llmgateway/anthropic
兼容协议
  • OpenAI Chat
  • OpenAI Response
  • Anthropic messages
流式输出
支持
工具调用
支持
Auto 调度支持
未纳入 auto 范围
服务公开状态
公开