模型广场

在架 25 个模型 · 单价 T+1 同步官方 · 订阅后按套餐折扣自动结算

DeepSeek

deepseek-flash

deepseek-flash【v4.1 flash】是深度求索推出的原生多模态 MoE 模型,支持 1M 上下文,依靠稀疏注意力与 CED 架构大幅降低显存与推理成本,具备工具调用、可配置思考强度,是面向 Agent 场景的高性价比大模型。

上下文长度
1M
多模态
不支持
DeepSeek

deepseek-v4-flash

deepseek-v4-flash后台已指向deepseek-flash,请参考deepseek-flash。

上下文长度
1M
多模态
不支持
文本生成代码生成长上下文推理对话翻译摘要
DeepSeek

deepseek-v4-flash-vision-exp

deepseek-v4-flash-vision-exp后台已指向deepseek-flash,请参考deepseek-flash。

上下文长度
1M
多模态
支持
多模态
DeepSeek

deepseek-v4-pro

deepseek-v4-pro 是深度求索 V4 系列旗舰 MoE 文本大模型,总参 1.6T、激活 49B,支持 1M 上下文,混合注意力架构,支持可调思考强度,在数学、竞赛代码、Agent 智能体任务上达到开源顶尖水平,性能对标顶级闭源模型。

上下文长度
1M
多模态
不支持
文本生成代码生成长上下文推理对话翻译摘要
Z.ai

glm-5

即将下线!

上下文长度
200K
多模态
不支持
文本生成代码生成长上下文推理对话翻译摘要
Z.ai

glm-5.1

即将下线!

上下文长度
200K
多模态
不支持
文本生成代码生成长上下文推理对话翻译摘要
Z.ai

glm-5.2

GLM-5.2 是智谱长程任务旗舰MoE 模型,百万稳定上下文,主打 Agentic 代码工程。

上下文长度
1M
多模态
不支持
文本生成代码生成长上下文推理对话翻译摘要
Z.ai

glm-5.3

GLM-5.3是智谱旗舰MoE 模型,百万上下文,主打长周期 Agent、工程代码与安全审计,强制推理思考。

上下文长度
1M
多模态
不支持
Z.ai

glm-5.3-flash

GLM-5.3-Flash是智谱原生多模态 MIT 开源 MoE 模型,百万上下文,混合注意力架构,主打图文 Agent 与代码,具备高性价比。

上下文长度
1M
多模态
不支持
MoonshotAI

kimi-k2.5

即将下线!

上下文长度
256K
多模态
支持
文本生成代码生成长上下文推理对话翻译摘要多模态
MoonshotAI

kimi-k2.6

Moonshot Kimi-K2.6 大语言模型,2026年4月21日上线,配备 262K 超长上下文与自动压缩功能,原生支持多模态理解,适合复杂工程任务与企业级智能体开发。

上下文长度
262K
多模态
支持
文本生成代码生成长上下文推理对话翻译摘要多模态
MoonshotAI

kimi-k2.7-code

Kimi-K2.7-Code是月之暗面开源多模态 MoE 代码专用模型,256K 上下文,强制思考,主打仓库级长周期软件工程 Agent。

上下文长度
262K
多模态
支持
文本生成代码生成长上下文推理对话翻译摘要多模态
MoonshotAI

kimi-k3

Kimi-K3 是月之暗面推出的 2.8T 总参开源 MoE 旗舰多模态模型,基于 KDA 混合线性注意力,支持 1M 上下文,原生图文理解,主打长周期编程、复杂推理与 Agent 集群任务。

上下文长度
1M
多模态
支持
文本生成代码生成长上下文推理对话翻译摘要多模态
Xiaomi

mimo-v2.5

mimo-v2.5是小米开源全模态 MoE模型,百万上下文,图文音视频一体,多模态 Agent,高性价比模型。

上下文长度
1M
多模态
支持
文本生成代码生成长上下文推理对话翻译摘要多模态
Xiaomi

mimo-v2.5-pro

mimo-v2.5-pro:小米开源文本旗舰 MoE,百万上下文,长链路 Agent 与仓库级代码能力较强,高性价比。

上下文长度
1M
多模态
不支持
文本生成代码生成长上下文推理对话翻译摘要
MiniMax

minimax-m2.5

即将下线

上下文长度
1M
多模态
支持
文本生成代码生成长上下文推理对话翻译摘要多模态
MiniMax

minimax-m3

MiniMax-M3 高性能大语言模型,2026年6月1日上线,支持百万级超长上下文与图像 / 视频原生理解,适合复杂工程、长文档分析、多模态交互与智能体开发。

上下文长度
1M
多模态
支持
文本生成代码生成长上下文推理对话翻译摘要多模态
Qwen

qwen3.5-plus

即将下线!

上下文长度
1M
多模态
支持
文本生成代码生成长上下文推理对话翻译摘要多模态
Qwen

qwen3.6-plus

即将下线!

上下文长度
1M
多模态
支持
文本生成代码生成多模态长上下文推理对话翻译摘要
Qwen

qwen3.7-flash

Qwen3.7-Flash 通义千问多模态轻量模型,百万上下文,支持图文视频输入,思考可开关,面向多模态 Agent 与视觉代码场景,高性价比。

上下文长度
1M
多模态
不支持
Qwen

qwen3.7-max

Qwen3.7-Max 通义千问闭源文本旗舰,百万上下文,思考可开关,主打超长链路自主 Agent 与工程代码任务。

上下文长度
1M
多模态
不支持
文本生成代码生成长上下文推理对话翻译摘要
Qwen

qwen3.7-plus

Qwen3.7-Plus 通义千问均衡型多模态模型,百万上下文,支持 GUI 交互,主打多模态混合 Agent 与视觉代码,性价比介于 Flash 与 Max 之间。

上下文长度
1M
多模态
支持
文本生成代码生成长上下文推理对话翻译摘要多模态
Qwen

qwen3.8-27b

Qwen3.8-27B 通义千问开源 27B 稠密多模态模型,支持图文视频,百万扩展上下文,思考可开关,主打本地部署的 Agentic 代码与办公任务。

上下文长度
1M
多模态
不支持
文本生成代码生成长上下文推理对话翻译摘要
Qwen

qwen3.8-flash

Qwen3.8-Flash 通义千问新一代高效 MoE 多模态模型,百万上下文,图文视频输入,适合Agentic编程与长周期办公,主打高性价比。

上下文长度
1M
多模态
不支持
Qwen

qwen3.8-max

Qwen3.8-Max 通义千问旗舰多模态 MoE 模型,百万上下文,图文视频一体,主打长周期自主 Agent、全栈工程开发与专业领域复杂任务。

上下文长度
1M
多模态
支持
对话代码生成文本生成长上下文推理翻译摘要多模态