MODEL PLAZA

模型广场

汇聚智谱 GLM、Kimi、MiniMax、通义千问、阶跃星辰等 20+ 国产主流大模型,统一以 Token 计量付费。下表为各模型目录原价,阶梯量价多消费多优惠。

价格单位:元 / 百万 Tokens · 仅展示目录原价

全部模型

点击厂商可快速筛选,价格均为目录原价

智谱 智谱

glm-4-9b-chat

智谱 AI 面向智能体工程的开源模型,90 亿参数,优化上下文对话体验,适合本地化轻量部署与日常客服问答。

输入¥1.00
输出¥1.20
缓存¥1.00
元 / 百万 Tokens
低延迟
智谱 智谱

glm-4.7-flash

智谱 AI 面向智能体工程的开源模型,超低延迟、极致推理速度与高并发支持,适合实时流式交互和大规模高频调用。

输入¥0.40
输出¥3.20
缓存¥0.40
元 / 百万 Tokens
旗舰
智谱 智谱

glm-5.2

智谱 AI 最新旗舰模型,具备稳定处理长程工作的 100 万 token 上下文,更强的编码能力,支持多种推理投入级别以平衡性能与延迟。

输入¥8.00
输出¥28.00
缓存¥2.00
元 / 百万 Tokens
旗舰
Kimi Kimi

kimi-k3

Moonshot AI 旗舰模型,参数量达 2.8T,具备原生视觉能力,支持百万 token 上下文,专为长周期编码、知识工作和复杂推理等前沿智能任务而设计。

输入¥20.00
输出¥100.00
缓存¥2.00
元 / 百万 Tokens
Kimi Kimi

kimi-k2.6

Moonshot AI 研发的原生多模态智能体模型,在长周期编码、主动自主执行等实际能力方面表现突出。

输入¥6.50
输出¥27.00
缓存¥1.10
元 / 百万 Tokens
MiniMax MiniMax

minimax-m2.5

MiniMax 研发的通用大语言模型,具备出色的自然语言理解与生成能力,在复杂商业逻辑和创意写作场景下表现卓越。

输入¥2.10
输出¥8.40
缓存¥0.21
元 / 百万 Tokens
量化版
MiniMax MiniMax

minimax-m2.5-NVFP4

MiniMax-M2.5 的 NVFP4 量化版本,在保持模型能力的前提下大幅降低显存占用与推理成本,适合对成本敏感的高并发场景。

输入¥1.00
输出¥4.00
缓存¥1.00
元 / 百万 Tokens
通义千问 通义千问

qwen3.6-27b

阿里云通义千问团队研发,融合多模态学习、架构效率、强化学习规模等突破,为开发者和企业带来更强能力与效率。

输入¥3.00
输出¥18.00
缓存—
元 / 百万 Tokens
通义千问 通义千问

qwen3.6-35b-a3b

通义千问开源大模型家族成员,能以更高的流畅度和精确度处理前端工作流和仓库级推理。

输入¥1.80
输出¥10.80
缓存—
元 / 百万 Tokens
通义千问 通义千问

qwen3.5-122b-a10b

通义千问开源大模型家族成员,优先考虑稳定性和实际应用价值,为开发者提供更直观、响应更快的高效编码体验。

输入¥0.80
输出¥6.40
缓存—
元 / 百万 Tokens
通义千问 通义千问

qwen3.5-27b

通义千问开源大模型家族成员,270 亿黄金参数配比,拥有较高能效比和泛化性,适合作为通用任务中枢。

输入¥0.60
输出¥4.80
缓存—
元 / 百万 Tokens
视觉
通义千问 通义千问

qwen3-vl-30b-a3b-instruct

新一代视觉架构,强化动态视觉理解能力,适合视频流解析与高级多模态任务。

输入¥0.75
输出¥3.00
缓存—
元 / 百万 Tokens
重排序
通义千问 通义千问

qwen3-reranker-8b

通义千问重排序模型,对检索结果进行精细化重排,显著提升 RAG 与搜索场景的语义相关性。

输入¥0.28
输出—
缓存—
元 / 百万 Tokens
视觉
通义千问 通义千问

qwen2.5-vl-32b-instruct

视觉—语言双模态模型,具备精准的图像与文本对齐能力,适合 OCR 识别、复杂图表分析等场景。

输入¥1.89
输出¥1.89
缓存—
元 / 百万 Tokens
通义千问 通义千问

qwen2.5-32b-instruct

320 亿参数,具备优秀的代码与指令遵循能力,可应对复杂逻辑推理与企业级文本生成任务。

输入¥2.67
输出¥2.67
缓存—
元 / 百万 Tokens
推理
通义千问 通义千问

QwQ-32B

通义千问推理模型,擅长数学、代码与复杂逻辑推理,以思维链方式逐步求解高难度问题。

输入¥1.00
输出¥4.00
缓存—
元 / 百万 Tokens
图像生成
通义千问 通义千问

qwen-image-2521

通义千问图像生成模型,依据文本描述生成高质量图像,适合创意设计与素材生成等视觉创作场景。按张计费。

输入¥0
输出¥0.25/张
缓存—
按张计费
阶跃星辰 阶跃星辰

step-3.7-flash

阶跃星辰(step)推出的高效推理模型,兼顾速度与能力,适合对话、摘要与通用文本处理等高频场景。

输入¥1.35
输出¥8.10
缓存¥0.27
元 / 百万 Tokens
该厂商暂无模型
立即登录 问题反馈