定价
知令平台模型价格同步各模型供应商公开定价。
大模型 API 定价
知令平台模型价格参考大模型官方定价或方案提供商定价制定。以下为各模型在知令平台上的按量计价信息,价格可能随上游定价调整而更新。
以下价格为知令平台价格(人民币 / 每 1M(1,000,000)tokens,列含义见表头),参考各厂商公开文档定价制定,价格可能随上游定价调整而更新。 「等效价」为近30天实际使用统计的每百万token平均费用(总费用÷总token×100万),标记(估)的为无使用记录模型的保守估算值。
| 模型 | 输入(缓存命中)/ 1M tokens | 输入(缓存未命中)/ 1M tokens | 输出 / 1M tokens | 等效价 / 1M tokens | 时段与说明 |
|---|---|---|---|---|---|
MiMo-V2.5mimo-v2.5
小米 MiMo 团队开源原生全模态 MoE 模型,总参数 310B、激活 15B,原生视觉与音频理解,支持 1M 上下文,SWE-bench Verified 78.0%、Video-MME 83.5%,推理成本约为 Pro 版一半。
供应商 Xiaomi
数据安全:中
|
¥0.02 | ¥1.00 | ¥2.00 | ≈¥0.12 | - |
MiMo-V2.5-Promimo-v2.5-pro
小米 MiMo 团队旗舰开源 MoE 模型,总参数 1.02T、激活 42B,混合注意力架构,支持 1M 上下文,SWE-bench Verified 78.9%、SWE-bench Pro 57.2%,面向复杂 Agent 与软件工程场景。
供应商 Xiaomi
数据安全:中
|
¥0.03 | ¥3.00 | ¥6.00 | ≈¥0.22 | - |
GLM-5.3-Flashz-ai/glm-5.3-flash
2026 年 8 月上线 OpenRouter 的匿名 stealth 推理模型,免费开放,支持 1M 上下文、最大输出 131K,可处理文本、图像与视频输入,面向编码与长周期 Agent 工作流;开发商身份与参数量未公开。
供应商 Z.ai
数据安全:中
|
¥0.12 | ¥0.60 | ¥2.00 | ≈¥0.30 | - |
Deepseek-V4-Flash(reka/fp4)deepseek/deepseek-v4-flash-0731
由Reka AI提供的FP4精度的 Deepseek-V4-Flash 0731
供应商 Reka AI
数据安全:高
|
¥0.06 | ¥1.80 | ¥5.30 | ≈¥0.35 | - |
Deepseek-V4-Flashdeepseek-v4-flash
深度求索 V4 系列轻量高效版,MoE 总参数 284B、激活 13B,支持 1M 上下文、最大输出 384K,推理速度快、API 成本低,编码与 Agent 能力接近一线闭源模型,主打高性价比场景。
供应商 DeepSeek
数据安全:低
|
¥0.05
峰时·高峰时段
¥0.10
|
¥1.50
峰时·高峰时段
¥3.00
|
¥4.50
峰时·高峰时段
¥9.00
|
≈¥0.35 |
高峰时段
· 工作日
(09:00-12:00、14:00-18:00)
|
Deepseek-V4-Flash-Vision-Expdeepseek-v4-flash-vision-exp
深度求索 V4 Flash 实验视觉版:284B 总参数、13B 激活 MoE,支持 1M 上下文,新增图像理解能力,可识别截图、UI 稿、图表与扫描件;单张图片最高仅消耗 384 token,按 Flash 同档价格计费、视觉成本极低。官方多模态 Agent 基准与 Claude Opus 4.8 互有胜负,文本与编码能力保持 V4 Flash 水平,主打高性价比多模态 Agent 场景。
供应商 DeepSeek
数据安全:低
|
¥0.05
峰时·高峰时段
¥0.10
|
¥1.50
峰时·高峰时段
¥3.00
|
¥4.50
峰时·高峰时段
¥9.00
|
≈¥0.43 |
高峰时段
· 工作日
(09:00-12:00、14:00-18:00)
|
Deepseek-V4-Prodeepseek-v4-pro
深度求索旗舰开源 MoE 模型,总参数 1.6T、激活 49B,支持 1M 上下文,采用 CSA+HCA 混合注意力,SWE-bench Verified 80.6%、LiveCodeBench 93.5%,编程与 Agent 能力对标国际一线闭源模型。
供应商 DeepSeek
数据安全:低
|
¥0.15
峰时·高峰时段
¥0.30
|
¥4.50
峰时·高峰时段
¥9.00
|
¥13.50
峰时·高峰时段
¥27.00
|
≈¥0.59 |
高峰时段
· 工作日
(09:00-12:00、14:00-18:00)
|
GPT-5.6-Luna-Proazure/gpt-5.6-luna-pro
GPT-5.6 性价比档 Luna 的 Pro 高推理档版本,与 Luna 同源(reasoning.mode=pro),1M 上下文,价格与 Luna 一致。以约旗舰 1/25 的成本获得扩展推理配置,复杂任务输出质量更佳,是成本与质量兼顾的高性价比选择。
供应商 Azure
数据安全:高
|
¥0.16≤256K
¥0.32>256K
|
¥1.60≤256K
¥3.20>256K
|
¥9.60≤256K
¥14.40>256K
|
≈¥1.02 | 阶梯定价(价格随上下文长度分档,见价格列区间) |
GPT-5.6-Lunaopenai/gpt-5.6-luna
OpenAI 2026 年 7 月发布的 GPT-5.6 系列性价比档,参数未公开,1M 上下文、128K 输出,调价后约 Sol 的 1/25 成本。官方称智能体任务表现优于 Claude Opus 4.8,主打分类、抽取、批量摘要等高吞吐轻量任务。
供应商 Azure
数据安全:高
|
¥0.16≤256K
¥0.32>256K
|
¥1.60≤256K
¥3.20>256K
|
¥9.60≤256K
¥14.40>256K
|
≈¥1.94 | 阶梯定价(价格随上下文长度分档,见价格列区间) |
GPT-5.6-Solazure/gpt-5.6-sol
OpenAI 2026 年 7 月发布的 GPT-5.6 旗舰,参数未公开,105 万 Token 上下文、128K 输出。Agents' Last Exam 53.6 分、Terminal-Bench 2.1 88.8% 创 SOTA,AA 编程智能体指数 80 分登顶,擅长复杂推理、代码生成与长程智能体工作流。
供应商 OpenAI
数据安全:中
|
¥1.60≤256K
¥3.20>256K
|
¥16.00≤256K
¥32.00>256K
|
¥80.00≤256K
¥160.00>256K
|
≈¥2.87 | 阶梯定价(价格随上下文长度分档,见价格列区间) |
Kimi-K2.7-Codekimi-k2.7-code
月之暗面 2026 年 6 月发布并开源的编程专用模型,1.1 万亿总参数、32B 激活的 MoE 架构,256K 上下文,支持多模态与思考模式;较前代 K2.6 代码能力提升 21.8%、推理 token 消耗降低 30%。
供应商 Moonshot AI
数据安全:低
|
¥1.30 | ¥6.50 | ¥27.00 | ≈¥3.02 | - |
Gemini-3.7-Flashgoogle/gemini-3.7-flash
Google DeepMind 2026 年 8 月发布的 Gemini 3 系列主力推理模型,1M 上下文、64K 输出,原生多模态。FrontierCode 43.6%、Terminal-Bench 2.1 85.8%、Code Arena Elo 1588,编程与 Agent 能力大幅领先上代,综合智能对标中型旗舰但价格约一半,主打编码与 Agent 工作负载。
供应商 Google Vertex
数据安全:高
|
¥0.30 | ¥3.00 | ¥15.00 | ≈¥3.15 | - |
MiMo-V2.5-Pro-UltraSpeedmimo-v2.5-pro-ultraspeed
小米与 TileRT 联合推出的 MiMo-V2.5-Pro 高速推理模式,沿用 1.02T/42B MoE 架构与 1M 上下文,通过模型与系统协同优化在通用 GPU 上实现超 1000 tokens/s 生成速度,输出速度约为原版 10 倍、定价约 3 倍。
供应商 Xiaomi
数据安全:中
|
¥0.07 | ¥9.00 | ¥18.00 | ≈¥4.54(估) | - |
GLM-5.3(并行科技)GLM-5.3(PT)
智谱 2026 年 8 月发布的编程旗舰 GLM-5.3,沿用约 750B MoE 基座,1M 上下文、128K 最大输出;纯后训练 Scaling 实现编程开源 SOTA,Terminal-Bench 3.0 达 28.3 分,并涌现网络安全能力。[推断]
供应商 并行科技
数据安全:中
|
¥2.00 | ¥8.00 | ¥28.00 | ≈¥5.00(估) | - |
GLM-5.2(并行科技)GLM-5.2(PT)
智谱 2026 年 6 月发布的旗舰模型 GLM-5.2,约 750B 参数 MoE,1M 上下文,主打长程任务与编程,Code Arena 全球可用模型第一;PT 为知令平台版本标识,能力参数与 GLM-5.2 一致。[推断]
供应商 Zhipu AI
数据安全:中
|
¥2.00 | ¥8.00 | ¥28.00 | ≈¥5.41 | - |
Kimi-K3kimi-k3
月之暗面 2026 年 7 月发布并开源的旗舰模型,2.8 万亿参数 MoE(896 专家激活 16 个),100 万 token 上下文,原生多模态;全球最大开源模型,Arena.ai 编程榜全球第一,综合实力位居全球前列。
供应商 Moonshot AI
数据安全:低
|
¥2.00 | ¥20.00 | ¥100.00 | ≈¥5.65 | - |
Deepseek-V4-Pro(coreweave/fp8)deepseek/deepseek-v4-pro-0813
由CoreWeave提供的FP8精度的 Deepseek-V4-Pro
供应商 CoreWeave
数据安全:高
|
¥0.35 | ¥10.50 | ¥32.00 | ≈¥7.19 | - |
Grok-4.6Grok-4.6
xAI(SpaceXAI)2026 年 7 月发布的旗舰编码与 Agent 模型,1.5T 参数 MoE(V9 底座),最高 500K 上下文。与 Cursor 联合训练,SWE-bench Pro 64.7%、Terminal-Bench 2.1 83.3%,定价约为同级一半、输出 80 TPS,主打编程性价比。
供应商 SpaceXAI
数据安全:高
|
¥4.00≤200K
¥8.00>200K
|
¥16.00≤128K
¥32.00>128K
|
¥48.00≤128K
¥96.00>128K
|
≈¥10.70 | 阶梯定价(价格随上下文长度分档,见价格列区间) |
Claude-Sonnet-5anthropic/claude-sonnet-5
Anthropic 2026 年 6 月发布的 Sonnet 档旗舰,参数未披露,1M 上下文、128K 输出,以 Sonnet 价格提供接近 Opus 的智能。SWE-bench Verified 85.2%、Terminal-Bench 2.1 80.4%,是 claude.ai 免费与 Pro 版默认模型,擅长智能体编码与长上下文工作流,性价比突出。
供应商 Google Vertex、Amazon Bedrock
数据安全:高
|
¥1.60 | ¥16.00 | ¥80.00 | ≈¥16.94 | - |
GPT-5.6-Sol-Pro (Azure)azure/gpt-5.6-sol-pro
OpenAI 2026 年 7 月发布的 GPT-5.6 旗舰,参数未公开,105 万 Token 上下文、128K 输出。Agents' Last Exam 53.6 分、Terminal-Bench 2.1 88.8% 创 SOTA,AA 编程智能体指数 80 分登顶,擅长复杂推理、代码生成与长程智能体工作流。
供应商 Azure
数据安全:高
|
¥4.00≤256K
¥8.00>256K
|
¥40.00≤256K
¥80.00>256K
|
¥240.00≤256K
¥360.00>256K
|
≈¥17.60 | 阶梯定价(价格随上下文长度分档,见价格列区间) |
GPT-5.6-Terraazure/gpt-5.6-terra
OpenAI 2026 年 7 月发布的 GPT-5.6 系列均衡档,参数未公开,105 万 Token 上下文、128K 输出。性能接近 GPT-5.5 而成本约其一半,Terminal-Bench 2.1 约 84%,性价比突出,主打日常开发、知识工作与企业 Agent 任务。
供应商 Azure
数据安全:高
|
¥1.60≤256K
¥3.20>256K
|
¥16.00≤256K
¥32.00>256K
|
¥96.00≤256K
¥144.00>256K
|
≈¥17.60(估) | 阶梯定价(价格随上下文长度分档,见价格列区间) |
GPT-5.6-Terra-Proazure/gpt-5.6-terra-pro
GPT-5.6 均衡档 Terra 的 Pro 高推理档版本,与 Terra 同源(reasoning.mode=pro),参数未公开,1M 上下文、128K 输出,价格与 Terra 一致。在均衡能力之上提升推理深度,适合对输出质量要求更高的日常生产与业务分析任务。
供应商 Azure
数据安全:高
|
¥1.60≤256K
¥3.20>256K
|
¥16.00≤256K
¥32.00>256K
|
¥96.00≤256K
¥144.00>256K
|
≈¥17.60(估) | 阶梯定价(价格随上下文长度分档,见价格列区间) |
GPT-5.6-Sol-Proazure/gpt-5.6-sol-pro
GPT-5.6 旗舰 Sol 的 Pro 高推理档版本,与 Sol 同源(reasoning.mode=pro),参数未公开,1M 上下文,价格与 Sol 一致。面向最困难问题与长时间工作流,ChatGPT Pro 档位同款,适合长篇研究、复杂代码架构重构等高价值任务。
供应商 OpenAI
数据安全:中
|
¥1.60≤256K
¥3.20>256K
|
¥16.00≤256K
¥32.00>256K
|
¥80.00≤256K
¥120.00>256K
|
≈¥19.38 | 阶梯定价(价格随上下文长度分档,见价格列区间) |
Claude-Fable-5anthropic/claude-fable-5
Anthropic 2026 年 6 月发布的首个公开 Mythos 级旗舰,参数未披露,1M 上下文。SWE-Bench Pro 80.3% 刷新纪录、CursorBench v3.1 72.9% 居首,空间推理较上代提升近 3 倍,定价 $10/$50,定位最高难度的编程、科研与长周期自主 Agent 任务。
供应商 Azure、Google Vertex
数据安全:中
|
¥8.00 | ¥80.00 | ¥160.00 | ≈¥44.00(估) | - |
Claude-Opus-5anthropic/claude-opus-5
Anthropic 2026 年 7 月发布的 Opus 系旗舰,参数未披露,1M 上下文、128K 输出。SWE-bench Verified 96.0% 登顶,HLE 64.7%、ARC-AGI-2 90.4%,综合智能接近自家最强模型 Fable 5,定价与上代持平,主打复杂 Agent 编码与企业级长程推理。
供应商 Google Vertex
数据安全:高
|
¥4.00 | ¥40.00 | ¥200.00 | ≈¥45.42 | - |
定价说明: 以上价格为知令平台价格(人民币 / 每 1M(1,000,000)tokens),参考各大模型官方定价制定。部分模型采用阶梯定价,价格随上下文长度分档计费:价格列中显示各价格区间(相邻同价区间已合并展示),例如「≤200K」表示上下文不超过 200K tokens 时适用该价格,「>200K」表示上下文超过 200K tokens 时适用该价格;输入缓存命中价格同样按与输入一致的档位阶梯计费。部分模型在高峰时段采用独立价格,峰时价格以「峰时」标识直接展示在对应价格列中基础价格下方,「时段与说明」列列出高峰时段名称与时间段;同一模型价格相同的多个高峰时段将合并展示,时间段并列显示;标注 * 的项目表示该时段未单独配置、沿用基础价格。高峰时段价格会覆盖基础价格。计费时间以服务器时区(Asia/Shanghai)为准。
数据安全等级说明
知令参考各模型供应商的数据政策,为每个模型标注数据安全等级(见上表「模型」列徽章),等级越高数据安全性越好,请结合业务数据敏感度选择合适的模型。
-
高
零数据保留 供应商不保留 prompt,也不会将数据用于模型训练,适合处理敏感数据。
-
中
保留日志,不用于训练 供应商保留日志用于合规等用途,不会将数据用于模型训练。
-
低
可能用于训练 上游供应商可能保留 prompt 并将其用于模型训练,请谨慎处理敏感数据。