deepseek-flash
模型信息
deepseek-flash【v4.1 flash】是深度求索推出的原生多模态 MoE 模型,支持 1M 上下文,依靠稀疏注意力与 CED 架构大幅降低显存与推理成本,具备工具调用、可配置思考强度,是面向 Agent 场景的高性价比大模型。
厂商DeepSeek
模型名称deepseek-flash
多模态不支持
上下文与限流
- 上下文长度
- 1M
- 应用 TPM
- 5,000,000
- 应用 RPM
- 5,000
价格信息
官方价与套餐折后价均按元/百万 Token 展示
| 计费项 | 官方价 |
|---|---|
| 标准输入Token(未命中缓存) | ¥ 1 |
| 标准输入Token(命中缓存) | ¥ 0.02 |
| 标准输出Token | ¥ 4 |
| 【高峰】标准输入Token(未命中缓存)高峰 | ¥ 2 |
| 【高峰】标准输入Token(命中缓存)高峰 | ¥ 0.04 |
| 【高峰】标准输出Token高峰 | ¥ 8 |
(高峰时间段:工作日 09:00–12:00、14:00–18:00)
服务信息
- 模型调用名(model 参数)
- deepseek-flash
- OpenAI base_url(Chat / Response)
- https://openapi.youdao.com/llmgateway/api/v1
- Anthropic base_url(Messages)
- https://openapi.youdao.com/llmgateway/anthropic
- 兼容协议
- OpenAI Chat
- OpenAI Response
- Anthropic messages
- 流式输出
- 支持
- 工具调用
- 支持
- Auto 调度支持
- 未纳入 auto 范围
- 服务公开状态
- 公开
