模型
共 32 款在线模型,折扣对比官方牌价实时换算,牌价变动同步生效。
glm-5.2主推
Zhipu — 旗舰推理智谱旗舰推理模型,长链路规划与复杂任务的第一选择。
输入3.4 折
输出3.0 折
缓存2.5 折
deepseek-v4-pro主推
DeepSeek — 深度推理深度思考模式完整体,数学、代码与科研推理的天花板。
输入6.6 折
输出6.9 折
缓存9.3 折
deepseek-v4-flash主推
DeepSeek — 极速高并发极致吞吐与首字延迟,高并发生产负载的默认路由。
输入2.7 折
输出2.7 折
缓存2.9 折
kimi-k2.7-code主推
Moonshot — 代码特化代码特化版本,大仓库理解与跨文件编辑是强项。
输入2.8 折
输出2.8 折
缓存2.8 折
minimax-m3主推
MiniMax — 新一代新一代主力模型,通用能力与推理全面升级。
输入2.8 折
输出2.8 折
缓存2.8 折
qwen3.7-plus主推
Alibaba — 最新 Plus主力 Plus 档,能力、速度与价格的黄金比例。
输入3.9 折
输出3.9 折
缓存—
glm-5.1
Zhipu — 稳定供应上一代旗舰,产线验证充分,供应稳定量大管饱。
输入3.4 折
输出3.0 折
缓存2.5 折
glm-5v
Zhipu — 视觉理解视觉理解特化,截图、图表与文档解析开箱即用。
输入3.6 折
输出3.2 折
缓存2.8 折
glm-5-air
Zhipu — 轻量高速轻量高速档,日常对话与批量任务的性价比之选。
输入2.9 折
输出2.9 折
缓存2.6 折
deepseek-v4
DeepSeek — 通用旗舰旗舰主线版本,推理深度与调用成本之间的均衡点。
输入4.9 折
输出5.2 折
缓存6.8 折
deepseek-coder-v4
DeepSeek — 工程代码面向工程场景的代码模型,补全与重构手感扎实。
输入3.1 折
输出3.1 折
缓存3.3 折
kimi-k2.7
Moonshot — 新旗舰月之暗面新旗舰,Agent 场景下的长程任务表现突出。
输入3.0 折
输出3.0 折
缓存3.0 折
kimi-k2.6
Moonshot — 检索增强内建检索增强,联网问答与资料汇总即开即用。
输入2.8 折
输出2.8 折
缓存2.8 折
kimi-k2.6-vl
Moonshot — 视觉理解多模态版本,图文混排输入与界面截图理解。
输入3.2 折
输出3.2 折
缓存3.0 折
kimi-k2.5
Moonshot — 长文本长文本处理老将,超长合同与整本论文一次吃下。
输入2.8 折
输出2.8 折
缓存2.8 折
minimax-m2.7
MiniMax — 通用对话成熟稳定的通用对话模型,人设与角色扮演见长。
输入2.8 折
输出2.8 折
缓存2.8 折
minimax-m3-lite
MiniMax — 轻量轻量档位,客服、摘要等高频轻任务的成本担当。
输入2.5 折
输出2.5 折
缓存2.5 折
qwen3.7-max
Alibaba — 旗舰通义旗舰,百万上下文与深度推理同时在线。
输入5.2 折
输出5.5 折
缓存—
qwen3.7-turbo
Alibaba — 高速高速档位,海量简单任务批处理的性价比答案。
输入2.6 折
输出2.6 折
缓存—
qwen3.7-coder
Alibaba — 代码生成代码生成特化,Agentic Coding 场景适配良好。
输入3.4 折
输出3.4 折
缓存—
qwen3.5-vl
Alibaba — 视觉语言视觉语言模型,OCR、表格与视频帧理解均衡。
输入3.8 折
输出3.8 折
缓存—
qwen3.6-plus
Alibaba — 均衡上一代 Plus,兼容存量业务的稳定选择。
输入4.8 折
输出4.8 折
缓存—
doubao-2.2-pro
ByteDance — 旗舰豆包旗舰档,中文理解与工具调用表现均衡。
输入3.3 折
输出3.5 折
缓存2.9 折
doubao-2.2-vl
ByteDance — 视觉理解视觉理解版本,短视频与电商图文场景积累深厚。
输入3.5 折
输出3.5 折
缓存3.1 折
doubao-2.2-lite
ByteDance — 轻量高速轻量高速档,超低单价扛住海量并发。
输入2.4 折
输出2.4 折
缓存2.2 折
ernie-5.5
Baidu — 旗舰文心旗舰,中文知识底座扎实,检索融合成熟。
输入4.2 折
输出4.5 折
缓存—
ernie-5.5-turbo
Baidu — 高速高速档文心,搜索问答与内容生成的量产选择。
输入2.9 折
输出2.9 折
缓存—
hunyuan-t2
Tencent — 深度思考混元深度思考模型,慢思考模式适合复杂决策。
输入3.7 折
输出3.9 折
缓存—
hunyuan-2.5
Tencent — 通用混元通用档,生态内接入顺滑,中文创作稳定。
输入3.0 折
输出3.0 折
缓存—
step-3.5
StepFun — 多模态推理阶跃多模态推理模型,图文混合推理是招牌。
输入4.1 折
输出4.3 折
缓存—
spark-5.5
iFlytek — 通用星火通用大模型,教育与办公场景语料深耕。
输入3.6 折
输出3.6 折
缓存—
yi-2.5-large
01.AI — 通用零一万物主力模型,双语能力均衡,输出风格干净。
输入3.5 折
输出3.5 折
缓存—