模型

共 32 款在线模型,折扣对比官方牌价实时换算,牌价变动同步生效。

32 / 32 款
glm-5.2主推
Zhipu旗舰推理

智谱旗舰推理模型,长链路规划与复杂任务的第一选择。

输入3.4 折
输出3.0 折
缓存2.5 折
128K 上下文96K 输出6 渠道
deepseek-v4-pro主推
DeepSeek深度推理

深度思考模式完整体,数学、代码与科研推理的天花板。

输入6.6 折
输出6.9 折
缓存9.3 折
256K 上下文64K 输出4 渠道
deepseek-v4-flash主推
DeepSeek极速高并发

极致吞吐与首字延迟,高并发生产负载的默认路由。

输入2.7 折
输出2.7 折
缓存2.9 折
128K 上下文32K 输出6 渠道
kimi-k2.7-code主推
Moonshot代码特化

代码特化版本,大仓库理解与跨文件编辑是强项。

输入2.8 折
输出2.8 折
缓存2.8 折
256K 上下文64K 输出4 渠道
minimax-m3主推
MiniMax新一代

新一代主力模型,通用能力与推理全面升级。

输入2.8 折
输出2.8 折
缓存2.8 折
256K 上下文64K 输出4 渠道
qwen3.7-plus主推
Alibaba最新 Plus

主力 Plus 档,能力、速度与价格的黄金比例。

输入3.9 折
输出3.9 折
缓存
256K 上下文32K 输出5 渠道
glm-5.1
Zhipu稳定供应

上一代旗舰,产线验证充分,供应稳定量大管饱。

输入3.4 折
输出3.0 折
缓存2.5 折
128K 上下文64K 输出5 渠道
glm-5v
Zhipu视觉理解

视觉理解特化,截图、图表与文档解析开箱即用。

输入3.6 折
输出3.2 折
缓存2.8 折
128K 上下文32K 输出3 渠道
glm-5-air
Zhipu轻量高速

轻量高速档,日常对话与批量任务的性价比之选。

输入2.9 折
输出2.9 折
缓存2.6 折
128K 上下文32K 输出4 渠道
deepseek-v4
DeepSeek通用旗舰

旗舰主线版本,推理深度与调用成本之间的均衡点。

输入4.9 折
输出5.2 折
缓存6.8 折
256K 上下文64K 输出4 渠道
deepseek-coder-v4
DeepSeek工程代码

面向工程场景的代码模型,补全与重构手感扎实。

输入3.1 折
输出3.1 折
缓存3.3 折
128K 上下文64K 输出3 渠道
kimi-k2.7
Moonshot新旗舰

月之暗面新旗舰,Agent 场景下的长程任务表现突出。

输入3.0 折
输出3.0 折
缓存3.0 折
256K 上下文64K 输出4 渠道
kimi-k2.6
Moonshot检索增强

内建检索增强,联网问答与资料汇总即开即用。

输入2.8 折
输出2.8 折
缓存2.8 折
256K 上下文32K 输出3 渠道
kimi-k2.6-vl
Moonshot视觉理解

多模态版本,图文混排输入与界面截图理解。

输入3.2 折
输出3.2 折
缓存3.0 折
128K 上下文32K 输出2 渠道
kimi-k2.5
Moonshot长文本

长文本处理老将,超长合同与整本论文一次吃下。

输入2.8 折
输出2.8 折
缓存2.8 折
256K 上下文32K 输出3 渠道
minimax-m2.7
MiniMax通用对话

成熟稳定的通用对话模型,人设与角色扮演见长。

输入2.8 折
输出2.8 折
缓存2.8 折
128K 上下文32K 输出3 渠道
minimax-m3-lite
MiniMax轻量

轻量档位,客服、摘要等高频轻任务的成本担当。

输入2.5 折
输出2.5 折
缓存2.5 折
128K 上下文32K 输出3 渠道
qwen3.7-max
Alibaba旗舰

通义旗舰,百万上下文与深度推理同时在线。

输入5.2 折
输出5.5 折
缓存
1M 上下文64K 输出3 渠道
qwen3.7-turbo
Alibaba高速

高速档位,海量简单任务批处理的性价比答案。

输入2.6 折
输出2.6 折
缓存
128K 上下文16K 输出5 渠道
qwen3.7-coder
Alibaba代码生成

代码生成特化,Agentic Coding 场景适配良好。

输入3.4 折
输出3.4 折
缓存
256K 上下文64K 输出3 渠道
qwen3.5-vl
Alibaba视觉语言

视觉语言模型,OCR、表格与视频帧理解均衡。

输入3.8 折
输出3.8 折
缓存
128K 上下文32K 输出3 渠道
qwen3.6-plus
Alibaba均衡

上一代 Plus,兼容存量业务的稳定选择。

输入4.8 折
输出4.8 折
缓存
128K 上下文32K 输出4 渠道
doubao-2.2-pro
ByteDance旗舰

豆包旗舰档,中文理解与工具调用表现均衡。

输入3.3 折
输出3.5 折
缓存2.9 折
256K 上下文64K 输出4 渠道
doubao-2.2-vl
ByteDance视觉理解

视觉理解版本,短视频与电商图文场景积累深厚。

输入3.5 折
输出3.5 折
缓存3.1 折
128K 上下文32K 输出3 渠道
doubao-2.2-lite
ByteDance轻量高速

轻量高速档,超低单价扛住海量并发。

输入2.4 折
输出2.4 折
缓存2.2 折
128K 上下文16K 输出5 渠道
ernie-5.5
Baidu旗舰

文心旗舰,中文知识底座扎实,检索融合成熟。

输入4.2 折
输出4.5 折
缓存
256K 上下文64K 输出3 渠道
ernie-5.5-turbo
Baidu高速

高速档文心,搜索问答与内容生成的量产选择。

输入2.9 折
输出2.9 折
缓存
128K 上下文32K 输出3 渠道
hunyuan-t2
Tencent深度思考

混元深度思考模型,慢思考模式适合复杂决策。

输入3.7 折
输出3.9 折
缓存
256K 上下文64K 输出3 渠道
hunyuan-2.5
Tencent通用

混元通用档,生态内接入顺滑,中文创作稳定。

输入3.0 折
输出3.0 折
缓存
128K 上下文32K 输出3 渠道
step-3.5
StepFun多模态推理

阶跃多模态推理模型,图文混合推理是招牌。

输入4.1 折
输出4.3 折
缓存
128K 上下文32K 输出2 渠道
spark-5.5
iFlytek通用

星火通用大模型,教育与办公场景语料深耕。

输入3.6 折
输出3.6 折
缓存
128K 上下文32K 输出2 渠道
yi-2.5-large
01.AI通用

零一万物主力模型,双语能力均衡,输出风格干净。

输入3.5 折
输出3.5 折
缓存
128K 上下文32K 输出2 渠道