模型广场
浏览所有可用模型,查看定价与使用说明
Qwen3.6-27B
推理Qwen3.6-27B 是 Qwen3.6 系列首个开源的中小尺寸稠密模型,针对代码生成、Agent 工作流与真实开发场景进行了重点增强。相比 Qwen3.5-27B,该模型在前端开发、仓库级推理、工具调用与复杂问题求解等任务上均有明显提升,并新增历史推理上下文保留能力,可减少多轮交互中的重复推理,提升稳定性与执行效率。模型同时支持视觉理解,原生上下文长度为 262,144 tokens。
输入价格
¥1.2
输出价格
¥9.6
命中价格
¥0.3
上下文
256K
GLM-5.2
旗舰GLM-5.2 是 Z.ai 最新的旗舰模型,面向长程任务场景,相比 GLM-5.1 在长程任务能力上有显著提升。该 753B 模型支持稳定的 1M-token 上下文,具备更强的编程能力,并支持多种 thinking effort levels,以在性能和延迟之间进行灵活平衡。GLM-5.2 引入 IndexShare 架构优化,在 1M 上下文长度下将 per-token FLOPs 降低 2.9 倍,同时改进 MTP layer 以支持 speculative decoding,使 acceptance length 最高提升 20%
输入价格
¥8
输出价格
¥28
命中价格
¥2
上下文
1024K
DeepSeek-V4-Flash
首选DeepSeek-V4-Flash 是 DeepSeek-V4 系列中的预览版 MoE 语言模型,总参数量为 284B,激活参数量为 13B,支持 1M tokens 超长上下文。该模型采用结合 CSA 与 HCA 的混合注意力架构,并引入 mHC 与 Muon Optimizer,以提升长上下文推理效率、训练稳定性与整体性能。
输入价格
¥1
输出价格
¥2
命中价格
¥0.02
上下文
1024K