模型列表
查看 TokenPlan 已接入的模型、模型 ID 与计费说明。
一个 API Key 即可访问 TokenPlan 接入的 20+模型,覆盖主流模型厂商。
可用模型
以下模型 ID、厂商和说明均来自模型列表接口。
| 模型 ID | 厂商 | 说明 |
|---|---|---|
deepseek-flash | DeepSeek | deepseek-flash【v4.1 flash】是深度求索推出的原生多模态 MoE 模型,支持 1M 上下文,依靠稀疏注意力与 CED 架构大幅降低显存与推理成本,具备工具调用、可配置思考强度,是面向 Agent 场景的高性价比大模型。 |
deepseek-v4-flash | DeepSeek | deepseek-v4-flash后台已指向deepseek-flash,请参考deepseek-flash。 |
deepseek-v4-flash-vision-exp | DeepSeek | deepseek-v4-flash-vision-exp后台已指向deepseek-flash,请参考deepseek-flash。 |
deepseek-v4-pro | DeepSeek | deepseek-v4-pro 是深度求索 V4 系列旗舰 MoE 文本大模型,总参 1.6T、激活 49B,支持 1M 上下文,混合注意力架构,支持可调思考强度,在数学、竞赛代码、Agent 智能体任务上达到开源顶尖水平,性能对标顶级闭源模型。 |
glm-5 | Z.ai | 即将下线! |
glm-5.1 | Z.ai | 即将下线! |
glm-5.2 | Z.ai | GLM-5.2 是智谱长程任务旗舰MoE 模型,百万稳定上下文,主打 Agentic 代码工程。 |
glm-5.3 | Z.ai | GLM-5.3是智谱旗舰MoE 模型,百万上下文,主打长周期 Agent、工程代码与安全审计,强制推理思考。 |
glm-5.3-flash | Z.ai | GLM-5.3-Flash是智谱原生多模态 MIT 开源 MoE 模型,百万上下文,混合注意力架构,主打图文 Agent 与代码,具备高性价比。 |
kimi-k2.5 | MoonshotAI | 即将下线! |
kimi-k2.6 | MoonshotAI | Moonshot Kimi-K2.6 大语言模型,2026年4月21日上线,配备 262K 超长上下文与自动压缩功能,原生支持多模态理解,适合复杂工程任务与企业级智能体开发。 |
kimi-k2.7-code | MoonshotAI | Kimi-K2.7-Code是月之暗面开源多模态 MoE 代码专用模型,256K 上下文,强制思考,主打仓库级长周期软件工程 Agent。 |
kimi-k3 | MoonshotAI | Kimi-K3 是月之暗面推出的 2.8T 总参开源 MoE 旗舰多模态模型,基于 KDA 混合线性注意力,支持 1M 上下文,原生图文理解,主打长周期编程、复杂推理与 Agent 集群任务。 |
mimo-v2.5 | Xiaomi | mimo-v2.5是小米开源全模态 MoE模型,百万上下文,图文音视频一体,多模态 Agent,高性价比模型。 |
mimo-v2.5-pro | Xiaomi | mimo-v2.5-pro:小米开源文本旗舰 MoE,百万上下文,长链路 Agent 与仓库级代码能力较强,高性价比。 |
minimax-m2.5 | MiniMax | 即将下线 |
minimax-m3 | MiniMax | MiniMax-M3 高性能大语言模型,2026年6月1日上线,支持百万级超长上下文与图像 / 视频原生理解,适合复杂工程、长文档分析、多模态交互与智能体开发。 |
qwen3.5-plus | Qwen | 即将下线! |
qwen3.6-plus | Qwen | 即将下线! |
qwen3.7-flash | Qwen | Qwen3.7-Flash 通义千问多模态轻量模型,百万上下文,支持图文视频输入,思考可开关,面向多模态 Agent 与视觉代码场景,高性价比。 |
qwen3.7-max | Qwen | Qwen3.7-Max 通义千问闭源文本旗舰,百万上下文,思考可开关,主打超长链路自主 Agent 与工程代码任务。 |
qwen3.7-plus | Qwen | Qwen3.7-Plus 通义千问均衡型多模态模型,百万上下文,支持 GUI 交互,主打多模态混合 Agent 与视觉代码,性价比介于 Flash 与 Max 之间。 |
qwen3.8-27b | Qwen | Qwen3.8-27B 通义千问开源 27B 稠密多模态模型,支持图文视频,百万扩展上下文,思考可开关,主打本地部署的 Agentic 代码与办公任务。 |
qwen3.8-flash | Qwen | Qwen3.8-Flash 通义千问新一代高效 MoE 多模态模型,百万上下文,图文视频输入,适合Agentic编程与长周期办公,主打高性价比。 |
qwen3.8-max | Qwen | Qwen3.8-Max 通义千问旗舰多模态 MoE 模型,百万上下文,图文视频一体,主打长周期自主 Agent、全栈工程开发与专业领域复杂任务。 |
Auto 智能路由
将 model 设为 auto,平台会根据任务难度和成本自动选择“够用又更省”的模型,无需手动切换。
不同套餐的 Auto 覆盖模型范围可能不同,具体以套餐页面为准。完整说明见 Auto 智能路由 。
