汇总各平台公开定价页的 316 条按量渠道与 129 条套餐,覆盖 7 个模型; 另有 16 条外部低价参考渠道(已标注风险); 不做估算,拿不到的字段一律标注「未获取」。
收录标准:国内平台须有 ICP 备案,海外平台限知名大站;个人开发的中转站不收录。
| 渠道 | 元 / 百万 tokens | 元 / 百万 tokens | 元 / 百万 tokens | 峰谷时间 | 官网 | ||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| D DeepSeek 官方 官方自营 | 峰2 / 谷1 | 峰0.04 / 谷0.02 | 峰8 / 谷4 | 峰:周一至周五 9:00-12:00、14:00-18:00 谷:其余时间,含周末全天 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号deepseek-flash(DeepSeek-V4.1-Flash,官方当前版,1M 上下文 / 最大输出 384K / 支持图像理解) 版本说明2026-09-10 12:00 起重大切换(据官方定价页):新模型名 deepseek-flash(DeepSeek-V4.1-Flash,原生多模态+图像理解),新价闲 1/0.02/4、峰 2/0.04/8(已转正)。官方原话:旧模型名 deepseek-v4-flash / deepseek-v4-flash-vision-exp 仍可调用但对应模型已下线,请求将由 V4.1-Flash 提供服务并按新 Flash 价格计费。V4 Pro(deepseek-v4-pro,V4-Pro-0813)9/14 12:00 起也路由到 V4.1 Flash,在那之前仍按 Pro 价(闲 4.5/0.15/13.5、峰 9/0.3/27)。1M 上下文 / 384K 输出不变,并发上限 2500(Pro 为 500)。 接入
接口地址https://api.deepseek.com 官方直连,无中间环节。 口径与备注核实时间2026-09-17 13:01 定价页https://api-docs.deepseek.com/zh-cn/quick_start/pricing | |||||||||||||||||||||||||
| 腾 腾讯云 · 原厂直供 原厂直供 | 峰2 / 谷1 | 峰0.04 / 谷0.02 | 峰8 / 谷4 | 峰:与官方峰谷同步 谷:与官方峰谷同步 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号DeepSeek-V4-Flash 0731 正式版 版本说明已核实(2026-09-15 复核腾讯云 TokenHub 模型价格页原文):页面单列「DeepSeek-V4-Flash 0731 正式版 原厂直供」一条,空闲时段 输入 1 · 缓存 0.02 · 输出 4,高峰时段 输入 2 · 缓存 0.04 · 输出 8(元每百万 tokens),与 DeepSeek 官方峰谷价一致。同一页面另有「DeepSeek-V4-Flash 0731 正式版」不带原厂直供标记的一条(高峰 3 / 0.1 / 9、空闲 1.5 / 0.05 / 4.5),属平台自营托管档,非本渠道。 接入
价格跟随 DeepSeek 官方峰谷,与官方完全一致 口径与备注核实时间2026-09-16 20:29 风险说明同一价格页上「原厂直供」与平台自营托管的同名模型是两个独立档位,前者跟随原厂峰谷价、后者为平台自有定价,比对时需看清条目是否带原厂直供标记。 定价页https://cloud.tencent.com/document/product/1823/130055 | |||||||||||||||||||||||||
| 腾 腾讯云国际版 TokenHub 原厂直供 美元刊例 · 折算展示 | 峰2.96 / 谷1.48 | 峰0.09 / 谷0.05 | 峰8.88 / 谷4.44 | 峰:工作日 9:00-12:00、14:00-18:00(美元计价,按 1 USD ≈ 6.73 元折算) 谷:其余时间,含周末全天(美元计价,按 1 USD ≈ 6.73 元折算) | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:谷时输入 $0.22 · 缓存 $0.007 · 输出 $0.66;峰时(工作日 9-12、14-18 点)全部 ×2。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算。 部署说明腾讯云海外站 版本说明✓ 已核实型号DeepSeek-V4-Flash 0731 GA (Vendor Direct) 版本说明已核实 0731:国际站 TokenHub 官方价目文档单列 'DeepSeek-V4-Flash 0731 GA (Vendor Direct)',峰谷分时与国内站同构(谷时为峰值一半),另有 Vendor Direct 版与普通 GA 版同价两列。新加坡/广州/硅谷多区域。 接入
与国内腾讯云账号体系独立、单独计费。 口径与备注核实时间2026-09-16 20:29 条目备注开业时间:腾讯云 2013 年商用(国际站 tencentcloud.com 2019 年前后独立运营) 风险说明峰谷计费按平台服务器收到请求的北京时间判定;高峰 9:00-12:00、14:00-18:00。缓存读谷 $0.007 / 峰 $0.014。 定价页https://www.tencentcloud.com/document/product/1300/78937 | |||||||||||||||||||||||||
| 商 商汤 SenseNova(免费公测) 版本存疑 | 0 | 0 | 0 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
部署说明官方未公示部署方式:DeepSeek 权重为 MIT 开源,商汤在自有平台提供服务,官方未说明是自部署还是转售,此处不做猜测,以官网说明为准。 版本存疑 型号deepseek-v4-flash(代次未标明) 版本说明存疑:免费公测未标明 checkpoint 代次;DeepSeek 权重 MIT 开源,商汤自部署,代次以实测为准。 接入
接口地址https://token.sensenova.cn/v1/chat/completions 8/28 起所有 Free 模型共用「通用积分池」(周 60 万积分、5 小时窗口 6 万)。 口径与备注核实时间2026-09-09 11:00 限速限流 每 5 小时 500 次 风险说明免费但有限速:DeepSeek V4 Flash 每 5 小时 500 次;高峰期 429 限流常见(8/28 改积分规则后有改善)。官方协议明确「免费期间不承诺可用性和可靠性」,且未承诺数据不用于训练——敏感数据别喂。公测随时可能转收费。 定价页https://platform.sensenova.cn | |||||||||||||||||||||||||
| 阿 阿里云百炼国际版 自部署 美元刊例 · 折算展示 | 0.93 | 0.19 | 1.85 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.138 · 缓存 $0.028 · 输出 $0.275(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 部署说明阿里云国际基础设施 版本说明✓ 已核实型号deepseek-v4-flash-0731(快照版) 版本说明已核实:国际站帮助文档将 deepseek-v4-flash-0731 单列在「快照版本」,推理服务供应商为阿里云百炼;无后缀 deepseek-v4-flash 同页同价在售。同一模型国内站(百炼国内)定价 3/0.3/9 元跟随官方,国际站便宜约 70%——同一公司两套独立定价。 接入
默认限流 RPM 15000 / TPM 1,200,000。 接口走 dashscope-intl 域名,模型 ID 填 deepseek-v4-flash-0731 口径与备注核实时间2026-09-16 19:12 限速限流 RPM 15000 · TPM 1,200,000 备注计费页存在多档部署范围价:部分区域/部署档为 $0.2/$0.04/$0.4(输入/缓存/输出),以控制台实际为准。同模型在 PAI 平台(机器学习产品线)另有一档更贵($0.24/$0.48),本条录的是 Model Studio 原价。 风险说明全时段统一价、无峰谷分时——夜间不如 DeepSeek 官方空闲价(¥1/¥4)划算;缓存命中价 $0.028 折合约 ¥0.19,为官方缓存价的 2 倍。 定价页https://www.alibabacloud.com/help/tc/model-studio/deepseek-v4-flash | |||||||||||||||||||||||||
| 快 快手万擎 StreamLake 国际版 自部署 美元刊例 · 折算展示 | 0.9422 | 0.1884 | 1.8844 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号DeepSeek-V4-Flash(不带日期后缀) 版本说明国际站推理价格表分列:DeepSeek-V4-Flash 输入 $0.14 / 输出 $0.28 / 前缀缓存 $0.028,0731 版为 $0.44 / $1.32 / $0.014(每百万 tokens)。与国内站为两套独立标价。 接入
模型精调与 GPU 托管另计。 口径与备注核实时间2026-09-16 20:29 风险说明海外分区,按美元刊例;与国内站人民币刊例为两套独立标价,比价时留意分区。 定价页https://www.streamlake.ai/product/wanqing | |||||||||||||||||||||||||
| 腾 腾讯云 · 自部署 自部署 版本存疑 | 1 | 0.2 | 2 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本存疑 型号未标明(同一页面无日期后缀的条目) 版本说明存疑:未标明跑哪代权重。因 0731 与 4/24 预览版权重均已开源,两者皆可能(能力差约 7 倍)。旁证:缓存价 0.2 与阿里云「当前版」一致,但旁证不作结论。 接入
与「腾讯云 · 原厂直供」同一页面,区别是条目不带【原厂直供】标记,即由腾讯云自己部署。固定价不分峰谷:输出仅 ¥2 很便宜,但缓存 ¥0.2 是官方空闲价的 4 倍。 口径与备注核实时间2026-09-16 20:29 定价页https://cloud.tencent.com/document/product/1823/130055 | |||||||||||||||||||||||||
| 阿 阿里云 · 当前版 自部署 | 1 | 0.2 | 2 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号deepseek-v4-flash(不带日期后缀) 版本说明已核实:阿里云帮助文档中无日期后缀版为主体章节,带日期版才进「快照版本」专章——即无后缀 = 跟随官方当前版(当下即 0731),官方升级后自动切换到新版本。 接入
与「阿里云 · 0731 快照版」同一平台,模型 ID 不用 -0731 后缀即调用当前版。固定价不分峰谷,输入输出约为官方空闲价的 2/3,缓存 ¥0.2 是官方空闲价的 4 倍。 口径与备注核实时间2026-09-16 20:29 定价页https://help.aliyun.com/zh/model-studio/deepseek-v4-flash | |||||||||||||||||||||||||
| 京 京东云 JoyMaaS 版本存疑 | 1 | 0.2 | 2 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
部署说明官方未公示部署方式:以 JoyMaaS 托管版形式提供(另有同价的 -Third 条目),官方未说明模型来源与部署形式,此处不做猜测,以官网说明为准。 版本存疑 型号DeepSeek-V4-Flash(JoyMaaS 托管版,未标代次;另有 -Third 条目同价) 版本说明已核实(2026-09-09):京东云官方计费文档明确 DeepSeek-V4-Flash 输入 0.001 元/千token(=¥1/百万)、缓存命中 0.0002(=¥0.2/百万)、输出 0.002(=¥2/百万),另有同价 DeepSeek-V4-Flash-Third SKU;旧 0428 预览版自部署已于 8/13 下线。(数据源:官方计费规则文档,8/13 更新版)另据官方 TokenPlan 文档:无后缀 Flash 在套餐侧标注【即将下线】、0731 正式版单列在售,按量无后缀 SKU 是否同步下线待 9/29 后回查 接入
按 token 用量计费,固定价不分时段。 口径与备注核实时间2026-09-16 20:29 风险说明价格 ¥1 / ¥0.2 / ¥2 出自京东云官方计费文档现行刊例价;输出价 ¥2 约为官方空闲时段输出价 ¥4 的一半。模型代次未标注,介意版本的建议先实测确认。另:京东云 CodingPlan 已公告停售。 定价页https://docs.jdcloud.com/cn/jdaip/maas-billing-rules | |||||||||||||||||||||||||
| 讯 讯飞星辰MaaS 第三方部署 | 1 | 0.2 | 2 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(1M 上下文) 版本说明已核实:平台模型广场接口明确列出 DeepSeek-V4-Flash-0731,官方描述写明「为 DeepSeek-V4-Flash 的官方正式发布版本,取代原预览版本」。(数据源:官方模型列表)(2026-09-09 复核:档位与版本均维持不变。) 接入
模型由讯飞托管部署,接入流程与星火自有模型一致。 口径与备注核实时间2026-09-16 20:29 风险说明价格比官方便宜较多(输入约为官方峰值的 1/3),托管部署的缓存命中能力与版本 checkpoint 是否与官方完全对齐无官方承诺,重要业务建议先小规模验证。 定价页https://training.xfyun.cn/modelSquare | |||||||||||||||||||||||||
| 联 联通云 AISP 自部署 人工核录 | 1 | 0.2 | 2 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
人工核录价目锁在登录后/仅控制台可见,需人工定期核对(建议每周),非实时刷新。 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(独立计费产品 -Input/-Output/-Cache) 版本说明已核实:AISP 模型广场明确列出 DeepSeek-V4-Flash-0731,计费侧有独立的 -0731-Input / -0731-Output / -0731-Cache 三个产品(与旧 V4-Flash 预览版分开计价)。(数据源:官方控制台计费规则) 接入
中国联通旗下运营商云,资质正规;同平台还有 kimi / glm / qwen 全系。 口径与备注核实时间2026-09-09 16:20 缓存价未公开缓存价说明:联通云官网页面不展示缓存单价,此处 ¥0.2/百万 tokens 为我们登录控制台后直接请求计费接口(queryUnitPrice,产品 -0731-Cache)所得实测值,非官网公开刊例。 风险说明无峰谷分时,单档固定价;计费接口刊例输入 ¥1。同平台旧 V4-Flash 预览版同价(¥1/¥2),开通时注意区分 -0731 版本;实际扣费以开通后账单为准。 厂家身份中国联通旗下运营商云 定价页https://console.cucloud.cn/console/cuig/reasoningService | |||||||||||||||||||||||||
| 模 模力方舟(Gitee AI) 自部署 | 1 | — | 2 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号DeepSeek-V4-Flash(1M 上下文) 版本说明已核实(2026-09-11 模力方舟模型广场页面):DeepSeek-V4-Flash 输入 ¥1/M、输出 ¥2/M。该价位与讯飞星辰 MaaS、联通云 AISP 的 DeepSeek-V4-Flash 挂牌一致。该条目为当前版(非 0731 代次)。 接入访问 ai.gitee.com 模型广场可查看在售模型与价格;调用需注册账号 → 创建访问令牌 → 接口 https://ai.gitee.com/v1 (OpenAI 兼容)。平台依托沐曦(MetaX)国产算力。 口径与备注核实时间2026-09-16 19:12 风险说明该平台页面仅标注「缓存支持」,未公布缓存倍率,故缓存价留空。价格以其模型广场当前刊例为准,如遇平台促销可能低于此处所示。 厂家身份模力方舟(Gitee AI),开源中国旗下 AI 模型服务平台,依托沐曦(MetaX)国产算力提供 Serverless API,京ICP备2025119063号。 定价页https://ai.gitee.com/serverless-api | |||||||||||||||||||||||||
| 快 快手万擎 StreamLake · 无后缀版 自部署 | 1 | 0.2 | 2 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号DeepSeek-V4-Flash(不带日期后缀) 版本说明官网模型服务价格文档分列两个 SKU:无后缀 DeepSeek-V4-Flash 输入 1 / 缓存命中 0.2 / 输出 2,0731 版为 3 / 0.1 / 9(后者为表内另一条)。两档均为人民币刊例。 接入
模型精调与 GPU 托管另计。 口径与备注核实时间2026-09-16 20:29 风险说明与同页 0731 版相比,本档输入价约为其三分之一、输出价约为其九分之二;两者为不同代次权重,按需选择。 定价页https://www.streamlake.com/document/WANQING/mdsorb4ejjptsmfyrn | |||||||||||||||||||||||||
| 华 华为云 MaaS 版本存疑 | 峰2 / 谷1.4 | — | 峰4 / 谷2.8 | 峰:每日 08:00-20:59(北京时间,官方 8/20 调价公告明确) 谷:每日 21:00-次日 07:59,按标准价 7 折 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
部署说明官方未公示部署方式:该服务以华为云 MaaS「预置服务」形式提供(贵阳一区域),官方未标注属于「原厂直供」还是「自部署」,此处不做猜测,以官网说明为准。 版本存疑 型号DeepSeek-V4-Flash(预置服务,代次未标明) 版本说明存疑:华为云 MaaS 预置服务未标明 checkpoint 代次,待核实。(2026-09-09 据官方 8/5 调价公告核实:时段1 ¥2/¥4、时段2 七折 1.4/2.8,与本站一致) 接入
8/20 起实行分时段计价:时段1(每日 08:00-20:59)标准价,时段2(每日 21:00-次日 07:59)按 7 折。 口径与备注核实时间2026-09-16 20:29 风险说明缓存命中价未获取(官方公告只列输入/输出两项);时段划分与 DeepSeek 官方峰谷不同,比价时注意口径。 定价页https://www.huaweicloud.com/notice/20260805172653249.html | |||||||||||||||||||||||||
| 七 七牛云 AI 推理 自部署 | 峰2 / 谷1 | 峰0.04 / 谷0.02 | 峰8 / 谷4 | 峰:分时计费,高峰口径与官方一致 谷:其余时间 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号DeepSeek-V4-Flash-20260731(1M 上下文,alias deepseek-v4-flash-0731) 版本说明已核实(2026-09-15 复核 qiniu.com/ai/models 页面内嵌数据原文):deepseek/deepseek-v4-flash-20260731(别名 deepseek-v4-flash-0731,release_at=2026-07-31)高峰 输入 2 · 缓存 0.04 · 输出 8,空闲 输入 1 · 缓存 0.02 · 输出 4(元每百万 tokens),已随 DeepSeek 官方 2026-09-10 调价同步下调。平台同时上架 1M 上下文的 Flash 系列多个版本,比对时以模型 id 为准。 接入
TPM 限 500 万 token。 口径与备注核实时间2026-09-16 20:29 限速限流 TPM 500 万 风险说明峰谷价与官方完全一致(高峰约为空闲两倍),分时口径跟随官方。同页另有 DeepSeek-V4-Flash-Vision-Exp 等变体,价格相近但为不同模型,需按 id 区分。老模型(V4-Pro-Preview 等)标注了退役时间(retirement_at),平台对生命周期管理规范。 定价页https://www.qiniu.com/ai/models | |||||||||||||||||||||||||
| S SiliconFlow 国际版 自部署 美元刊例 · 折算展示 | 1.48 | 0.09 | 4.44 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.22 · 缓存 $0.014 · 输出 $0.66(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 部署说明硅基流动海外集群 版本说明✓ 已核实型号deepseek-ai/DeepSeek-V4-Flash-0731(FP8,1049K 上下文) 版本说明已核实 0731:国际站官网模型页 deepseek-ai/DeepSeek-V4-Flash-0731 当前价 $0.22/缓存 $0.014/输出 $0.66。8/26 上线博客的 $0.13/$0.28 限时价已过期。硅基流动为北京公司,国际站独立计价、与国内站账号体系不互通。 接入
接口地址https://api.siliconflow.com/v1 模型名 deepseek-ai/DeepSeek-V4-Flash-0731,OpenAI 兼容 口径与备注核实时间2026-09-10 08:30 备注与国内站(硅基流动,1.5/0.3/4.5 分时段)相互独立:国际站统一价约 ¥1.48/0.09/4.44,缓存命中比国内站便宜 3 倍。 风险说明自部署开源权重(FP8),非 DeepSeek 官方直供;国内/国际站账号体系不互通。 定价页https://www.siliconflow.com/models/deepseek-v4-flash-0731 | |||||||||||||||||||||||||
| 硅 硅基流动 第三方部署 版本存疑 | 峰3 / 谷1.5 | 峰0.3 / 谷0.15 | 峰9 / 谷4.5 | 峰:0点~2点 / 8点~24点 谷:2点~8点 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本存疑 型号未标明(页面未区分正式版/预览版) 版本说明价格核实(2026-09-10,据官方定价页):DeepSeek-V4-Flash 仍为 2点~8点 ¥1.50 输入 / ¥4.50 输出(优惠),标准时段 ¥3.00 / ¥9.00。存疑:页面未区分版本。0731 与 4/24 预览版权重均已 MIT 开源,第三方部署两者皆可能,而 Agent 能力相差约 7 倍(DeepSWE 7.3 vs 54.4),务必实测后再下结论。核实途径:看接口返回的 model 字段,或问客服要 checkpoint 名。 接入
接口地址https://api.siliconflow.cn/v1 注意:输入输出与官方高峰价一致,但缓存价是官方的 3 倍,说明并非原厂直供。 口径与备注核实时间2026-09-17 13:01 定价页https://siliconflow.cn/pricing | |||||||||||||||||||||||||
| 火 火山方舟 第三方部署 | 峰3 / 谷1.5 | 0.1 | 峰9 / 谷4.5 | 峰:全时段统一价 谷:离线批量提交、非实时返回,价格约为在线推理的 50% | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号正式版 = DeepSeek-V4-Flash-0731(按正式版计价) 版本说明已核实(按正式版口径):火山页面明确分列「正式版/预览版」且同价,正式版对应官方 7/31 的 0731 checkpoint(第三方 8/21 各家 0731 费用对比与本站价格一致);页面另列的「预览版」为 4/24 旧代,不纳入对比——调用时认准正式版模型 ID。 接入
接口地址https://ark.cn-beijing.volces.com/api/v3 console.volcengine.com/ark 开通 deepseek-v4-flash 口径与备注核实时间2026-09-17 13:01 定价页https://www.volcengine.com/docs/82379/1544106 | |||||||||||||||||||||||||
| 腾 腾讯云 · 自部署(0731) 自部署 | 峰3 / 谷1.5 | 峰0.1 / 谷0.05 | 峰9 / 谷4.5 | 峰:每日 9:00–12:00、14:00–18:00(北京时间,周末同样分峰谷) 谷:其余时间 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号DeepSeek-V4-Flash 0731 正式版 版本说明已核实(2026-09-15 复核腾讯云 TokenHub 模型价格页原文):页面单列「DeepSeek-V4-Flash 0731 正式版」一条,不带【原厂直供】标记,即由腾讯云用自有算力部署。空闲时段 输入 1.5 · 缓存 0.05 · 输出 4.5,高峰时段 输入 3 · 缓存 0.1 · 输出 9(元每百万 tokens),全档约为原厂直供价的 1.5 倍。峰谷时段沿用旧规则(北京时间每日 9:00–12:00、14:00–18:00 为高峰),周末同样分峰谷。 接入
按量计费,分峰谷。全档约为原厂直供价的 1.5 倍。 口径与备注核实时间2026-09-16 20:29 风险说明与「腾讯云 · 原厂直供」是同一价格页上的两个独立档位:本条全档贵约 1.5 倍,选型时先看清条目带不带【原厂直供】标记。周末计费规则两者也不同。 定价页https://cloud.tencent.com/document/product/1823/130055 | |||||||||||||||||||||||||
| 阿 阿里云 · 0731 快照版 自部署 | 峰3 / 谷1.5 | 峰0.3 / 谷0.15 | 峰9 / 谷4.5 | 峰:见阿里云官方时段定义 谷:见阿里云官方时段定义 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
部署说明跟随峰谷 版本说明✓ 已核实型号deepseek-v4-flash-0731(快照版) 版本说明已核实:阿里云帮助文档把 -0731 单列在「快照版本」章节,即固定在 7/31 那一代,不随官方后续升级变化。 接入
页面标注「推理服务供应商为阿里云百炼」。输入输出与官方峰谷同价,但缓存命中价是官方的 3 倍。 口径与备注核实时间2026-09-16 20:29 定价页https://help.aliyun.com/zh/model-studio/deepseek-v4-flash | |||||||||||||||||||||||||
| 移 移动云 · Moma 自部署 人工核录 | 峰3 / 谷1.5 | 峰0.1 / 谷0.05 | 峰9 / 谷4.5 | 峰:官方称「夜间」以外时段(接口未给具体钟点) 谷:官方「夜间」档(具体钟点以控制台为准) | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
人工核录价目锁在登录后/仅控制台可见,需人工定期核对(建议每周),非实时刷新。 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(上线日期 2026-08-07,1M 上下文) 版本说明已核实:移动云模型广场接口明确 DeepSeek-V4-Flash-0731(官方正式版本,取代预览版),上线日期 2026-08-07,1M 上下文,apiModelName deepseek-v4-flash-0731,端点 zhenze-huhehaote.cmecloud.cn。峰夜双档价与官方一致(输入 3/夜 1.5,缓存命中 0.1/夜 0.05,输出 9/夜 4.5)。(数据源:官方模型广场) 接入
TokenPlain/CodingPlain 套餐用户需先开通专属资源包,套餐与按量计费隔离。 口径与备注核实时间2026-09-09 17:05 风险说明运营商云,稳定性好;夜间档价格与官方空闲时段一致。注意:接口只标「夜间」未返回具体时段钟点,日间/夜间划分以控制台计费说明为准。 定价页https://ecloud.10086.cn/api/page/maas/moma/modelSquare/modelSquareDetails?modelName=DeepSeek-V4-Flash-0731 | |||||||||||||||||||||||||
| 百 百度千帆 自部署 | 峰3 / 谷1.5 | 峰0.1 / 谷0.05 | 峰9 / 谷4.5 | 峰:每日 8:00-22:00(缓存价 9/9 起生效的新价) 谷:每日 22:00-次日 8:00(高峰价五折,9/9 起生效) | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(官方推理服务,峰谷双档) 版本说明已核实:现行价 2026-09-09 起生效——高峰 8:00-22:00 输入 3 / 缓存命中 0.1 / 输出 9,空闲 22:00-次日8:00 五折 1.5/0.05/4.5,与 DeepSeek 官方刊例完全对齐。调价轨迹:8/24 前旧价 1/0.2/2(空闲八折)→ 8/24 新价 3/0.3/9(空闲八折 2.4/0.24/7.2)→ 9/9 缓存降至 0.1、空闲改五折。官方标注「空闲时段为限时活动」。(数据源:官方模型服务计费文档 wmh4sv6ya,直连可抓) 接入
注意:此为常规按量服务;Token Plan 套餐走专属 API Key 与专属 Base URL,两套体系分开计费。 口径与备注核实时间2026-09-16 20:29 风险说明峰谷分时段(8:00-22:00 高峰 / 22:00-次日8:00 空闲五折,官方称限时活动);近一个月连调两次价(8/24、9/9)。Token Plan 套餐与按量为两套体系(专属 Key/专属 Base URL),价格互不影响。 定价页https://cloud.baidu.com/doc/qianfan/s/wmh4sv6ya | |||||||||||||||||||||||||
| 天 天翼云 · 星辰 TokenHub(息壤 MaaS) 运营商自营 人工核录 | 峰3 / 谷1.5 | 峰0.3 / 谷0.15 | 峰9 / 谷4.5 | 峰:除每日 00:00-8:00、22:00-23:59 外的全部时段 谷:每日 00:00-8:00、22:00-23:59 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
人工核录价目锁在登录后/仅控制台可见,需人工定期核对(建议每周),非实时刷新。 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(1M 上下文 / 384K 输出) 版本说明已核实 0731:模型详情接口单列 deepseek-v4-flash-0731-new(productCode TokenHub_deepseek-v4-flash-0731-new),上下文 1M、最大输出 384K,支持 Function Call/Cache/结构化输出。峰谷计费自 2026-08-24 生效。 接入
另有 Tokens 量包(见套餐组,折合 ¥0.9~0.99/M 更划算)与新用户 50 万免费体验 Token。支持 OpenAI Chat Completions 与 Anthropic 双协议。 口径与备注核实时间2026-09-10 13:20 条目备注开业时间:天翼云为中国电信 2012 年发布的云服务品牌 风险说明中国电信旗下,央企背景。注意:闲时窗口为每日 00:00-8:00 与 22:00-23:59(平台自定口径,非 DeepSeek 官方的工作日峰谷);当前刊例仍为 8/24 版(忙时 3/0.3/9),高于 DeepSeek 官方 9/10 降价后现价(闲时 1/0.02/4),是否跟随降价待复查。 定价页https://ctxirang.ctyun.cn/maas/modelSquare/9570194f36ab4ac3bb31e58ea839950b | |||||||||||||||||||||||||
| U UCloud 优刻得 · 星图 AstraFlow 聚合网关 | 峰3 / 谷1.5 | — | 峰9 / 谷4.5 | 峰:工作日白天(具体分时窗口以平台结算为准) 谷:其余时间 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
部署说明上市云厂商 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(峰谷分时) 版本说明已核实 0731:官方活动页单列 'DeepSeek-V4-Flash-0731' 条目(同页另有 V4-Flash 无后缀、V4-Pro-0813、V4-Flash-Vision-Exp 分列,不混淆)。峰谷口径:峰时 ¥3/¥9、谷时(半价)¥1.5/¥4.5。 接入
一个 Key 直连 200+ 主流模型) 口径与备注核实时间2026-09-16 20:29 条目备注开业时间:优刻得 2012 年创立、2020-01 科创板上市 风险说明科创板上市云厂商(2012 年创立)旗下聚合网关,刊例公开在官网活动页;缓存读取价未在活动页公示(未获取)。注意其谷时价与 DeepSeek 官方 9/10 降价后的闲时价(1/4)不同,为平台自定口径,官方降价后是否跟随待复查。 厂家身份科创板上市云厂商(2012 年创立)旗下聚合网关 定价页https://www.ucloud.cn/site/active/astraflow | |||||||||||||||||||||||||
| 金 金山云星流 自部署 版本存疑 | 3 | 0.1 | 9 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本存疑 型号DeepSeek-V4-Flash(无版本后缀,1M 上下文) 版本说明存疑:计费文档模型名只写 deepseek-v4-flash 无代次后缀(同文档 V4-Pro 明确标 0813,flash 未标),无法确认是否 0731 正式版,按规矩标存疑。价格为单档,不分峰谷。 接入
价格以官方计费文档 docs.ksyun.com/documents/44741 为准,文档更新 2026-08-26) 口径与备注核实时间2026-09-16 20:29 限速限流 RPM 1000 · TPM 15 万 风险说明金山云旗下 MaaS 平台,厂商资质正规。同平台还有 deepseek-v4-pro-0813、glm-5.3、qwen3.8-max 等。限流 RPM 1000 / TPM 15 万(据平台限流说明)。版本未标代次,介意版本的建议先用官方向量实测或等平台标明。 定价页https://docs.ksyun.com/documents/44741 | |||||||||||||||||||||||||
| 优 优云智算 自部署 | 3 | — | 9 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号DeepSeek-V4-Flash-0731 版本说明已核实:模型目录明确列出 deepseek-v4-flash-0731(另有 deepseek-v4-flash-vision-exp 视觉版同价)。同目录还有 deepseek-v4-pro-0813(¥9/¥27)。(数据源:model-api 公开页接口 ListCModelCenterModels,无需登录,2026-09-09) 接入
优云智算是 UCloud 优刻得旗下 AI 算力/模型平台(上市公司背景,资质正规);目录共 71 个模型(DeepSeek/Qwen/GLM/Kimi/MiniMax/Doubao 等)。 口径与备注核实时间2026-09-17 19:59 风险说明页面标注「模型与价格以控制台实时信息为准」,公开页价格可能与控制台有出入;支持上下文缓存但公开页未展示缓存单价,缓存价显示「未获取」,不做估算;目录 DiscountBps=10000 即当前无折扣;无峰谷分时。 厂家身份优云智算是 UCloud 优刻得旗下 AI 算力/模型平台 定价页https://www.compshare.cn/model-api | |||||||||||||||||||||||||
| 快 快手万擎 StreamLake 自部署 | 3 | 0.1 | 9 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(页面明确标注 0731 正式版;另有无后缀 DeepSeek-V4-Flash 在售) 版本说明官网模型广场分列两个 SKU、分开计价:DeepSeek-V4-Flash-0731(输入 3 / 缓存 0.1 / 输出 9,本口径)与无后缀 DeepSeek-V4-Flash(输入 1 / 缓存 0.2 / 输出 2);0731 上架价与官方刊例一致(2026-09-09 据官网) 接入
模型精调与 GPU 托管另计。 口径与备注核实时间2026-09-16 20:29 风险说明快手旗下企业级大模型平台(国内主体,另有海外站点,注意区分)。注意:0731 为全天统一价 3/9,无峰谷分时——官方空闲时段 1.5/4.5,夜间高频调用走官方更省。 定价页https://www.streamlake.com/product/wanqing | |||||||||||||||||||||||||
| 模 模力方舟(Gitee AI) · 0731 版 自部署 | 3 | — | 9 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(1M 上下文) 版本说明已核实(2026-09-11 模力方舟模型广场页面):DeepSeek-V4-Flash-0731 输入 ¥3/M、输出 ¥9/M,与 PPIO 派欧云 / 火山方舟 / 腾讯云 / 七牛云 / 百度千帆 等渠道的 0731 版挂牌一致。 接入访问 ai.gitee.com 模型广场可查看在售模型与价格;调用需注册账号 → 创建访问令牌 → 接口 https://ai.gitee.com/v1 (OpenAI 兼容)。平台依托沐曦(MetaX)国产算力。 口径与备注核实时间2026-09-16 19:12 风险说明该平台页面仅标注「缓存支持」,未公布缓存倍率,故缓存价留空。价格以其模型广场当前刊例为准,如遇平台促销可能低于此处所示。 厂家身份模力方舟(Gitee AI),开源中国旗下 AI 模型服务平台,依托沐曦(MetaX)国产算力提供 Serverless API,京ICP备2025119063号。 定价页https://ai.gitee.com/serverless-api | |||||||||||||||||||||||||
| 算 算云AI 第三方部署 | 0.6 | — | 1.2 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(官方介绍:正式稳定版本,发布于 2026 年 7 月底,全面取代预览版) 版本说明已核实:模型列表页描述明确「DeepSeek-V4-Flash-0731 是官方正式稳定版本(发布于 2026 年 7 月底),全面取代先前的预览版」。(数据源:suanjiayun.com/api/modelList 页面) 接入
口径与备注核实时间2026-09-16 20:29 风险说明现价为限时六折(原价输入 ¥1.0 / 输出 ¥2.0,折扣结束时间未标)。缓存计费未公示(页面无缓存价),列表缓存价显示「未获取」;折扣与缓存口径开通前请以官方页面为准。 定价页https://suanjiayun.com/api/modelList | |||||||||||||||||||||||||
| 共 共绩算力 · 预览版 聚合平台 人工核录 | 1 | 0.02 | 2 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
人工核录价目锁在登录后/仅控制台可见,需人工定期核对(建议每周),非实时刷新。 部署说明平台自述「模型聚合」,同时提供智谱、DeepSeek、月之暗面、阿里等多家模型;各模型的具体供应方式平台未逐项公示。 版本说明✓ 已核实型号deepseek-v4-flash(预览版) 版本说明已核实(2026-09-11 平台控制台价目页):条目名为「DeepSeek V4 Flash(预览版)」,模型 id 为 deepseek/deepseek-v4-flash;页面提示平台计划自 2026-08-19 起对 V4 正式版资源维护,维护期间以该条目供应。该条目为平台标注的预览版口径,非 0731 正式代次。 接入
接口地址https://api.suanli.cn/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-11 15:55 风险说明为「预览版」条目,供应状态随平台正式版资源维护情况变化,价格与 0731 版不同。 厂家身份北京共绩科技有限公司(京ICP备 2023013220 号-1)运营的弹性算力平台,聚合智谱、DeepSeek、月之暗面、阿里等多家模型。 定价页https://console.suanli.cn/models | |||||||||||||||||||||||||
| A AutoDL 自部署 版本存疑 | 峰2 / 谷1 | 峰0.04 / 谷0.02 | 峰8 / 谷4 | 峰:周一至周五 9:00-12:00、14:00-18:00 谷:其余时间,含周末全天 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本存疑 型号DeepSeek-V4-Flash(无 0731 后缀,条目 2026-04-24 创建) 版本说明存疑:模型市场条目名不带 0731 后缀,创建时间早于 0731 发布(2026-04-24),后端 checkpoint 代次无官方说明。价格与官方峰谷完全一致(含分时),像跟随官方价目表而非快照定价。 接入
接口地址https://www.autodl.art/api/v1 与 GPU 租用平台 AutoDL(视拓云)同属一家。 口径与备注核实时间2026-09-09 15:10 风险说明会员享七折(输入 ¥2.1 / 缓存 ¥0.07 / 输出 ¥6.3)。版本代次不透明,对 0731 有硬需求时先实测确认;接口文档链接仍指向旧模型,文档维护滞后。 定价页https://autodl.art/large-model/market/42/DeepSeek-V4-Flash | |||||||||||||||||||||||||
| 3 302.AI 聚合网关 美元刊例 · 折算展示 版本存疑 | 1.48 | — | 4.44 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.22 · 输出 $0.66(每 1M token,缓存读价未公示)。人民币价 = 美元价 × 6.73(2026-09-10 汇率)折算。 部署说明国内主体,以美元标价 版本存疑 型号deepseek-v4-flash(官方别名) 版本说明价格核实(2026-09-10 据官方定价页):deepseek-v4-flash 输入 $0.22 / 输出 $0.66(页面标 starting from),≈官方旧闲价(1.5/4.5 元)的美元化;页面未标缓存读价。尚未跟随 9/10 官方新价(闲 1/0.02/4 元)。「分类口径」:302.AI 主体在国内(dash-cn.302.ai、中文说明、线上开通、先开通后计费),仅标价货币用美元,故归国内组;同页另有 deepseek-v4-flash-vision-exp 同价($0.22/$0.66)。官方 9/10 起旧名 deepseek-v4-flash 已下线路由 V4.1-Flash,该渠道挂的是官方别名,实际供应版本大概率已是 V4.1。 接入
一站式接 100+ 模型。 口径与备注核实时间2026-09-17 19:59 条目备注开业时间:302.AI 2024 年上线(国内知名聚合,按量计费模式开创者之一) 风险说明本模型 $0.22 / $0.66,高于官方闲时折算价。支持国内直连、线上开通,单 Key 可调用站内全部模型。缓存价未公示,需实测;以美元标价,人民币成本随汇率浮动。 定价页https://dash-cn.302.ai/ | |||||||||||||||||||||||||
| 中 中青 AI 聚合网关 第三方部署 | 峰3 / 谷1.5 | 峰0.1 / 谷0.05 | 峰9 / 谷4.5 | 峰:每日 9:00-12:00、14:00-18:00(官网表格口径) 谷:其余时间 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号deepseek-v4-flash-0731(官方描述:对应深度求索 DeepSeek-V4-Flash-0731 正式版) 版本说明已核实:平台定价接口 deepseek-v4-flash-0731 条目描述明确「对应深度求索 DeepSeek-V4-Flash-0731 正式版」,价目表与官方完全一致。(数据源:官方定价接口) 接入
口径与备注核实时间2026-09-16 20:29 风险说明new-api 架构聚合网关。注意:0731 条目的计费表达式高峰口径为「每日 9-13 点、14-19 点」(比官方价目表的周一至周五 9-12、14-18 略宽),实际扣费以平台表达式为准;同站另有 deepseek-v4-flash(描述称官方直供)走 weekday 限制的标准口径。 定价页https://aiapi.zqgame.com/pricing | |||||||||||||||||||||||||
| 矩 矩池云 Matpool 自部署 | 峰3 / 谷1.5 | 峰0.1 / 谷0.05 | 峰9 / 谷4.5 | 峰:周一至五 9:00-12:00、14:00-18:00 谷:周六日全天谷价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(1M 上下文) 版本说明已核实:官方模型列表接口描述明确写「DeepSeek-V4-Flash-0731 最新正式版模型」。(数据源:官方定价接口) 接入
接口地址https://newapi.matpool.com/v1 口径与备注核实时间2026-09-09 16:10 风险说明GPU 算力租赁商出身的大模型网关,规模小于云大厂。分时段口径与官方完全一致(工作日高峰 9-12/14-18、其余空闲、周末全天谷价),比多数聚合网关严谨。另有 V4-Pro-0813、R1、多模态 Flash-Vision 等。 厂家身份GPU 算力租赁商出身的大模型网关,规模小于云大厂 定价页https://matpool.com/models | |||||||||||||||||||||||||
| O OfoxAI 聚合网关 美元刊例 · 折算展示 | 2.96 | 0.09 | 8.88 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.44 · 缓存读 $0.014 · 输出 $1.32(每 1M token,据官方模型页)。人民币价 = 美元价 × 6.73(2026-09-10 汇率)折算。 部署说明官方原价 0 加价 版本说明✓ 已核实型号deepseek-v4-flash-0731(官网模型页单列,用户已实地核对) 版本说明已核实 0731:官网模型页 ofox.ai/zh/models/deepseek/deepseek-v4-flash-0731 单列 0731,全天 $0.44 / 缓存 $0.014 / $1.32(≈官方峰价 3/9 元的美元化口径,不跟谷价),2026-09-10 由用户实地打开该页确认与录入价一致。注意官方 9/10 新价已降至闲 1/0.02/4 元,该渠道价差进一步拉大。 接入
另支持 Anthropic/Gemini 原生协议),宣称 0 加价、99.9% SLA 口径与备注核实时间2026-09-17 20:04 条目备注开业时间:运营主体 NICE TALK PTE.LTD.(新加坡),上线时间未公开披露 风险说明新加坡 NICE TALK PTE.LTD. 运营的聚合网关(东京 / 新加坡 / 中国香港布局,国内直连);缺点:全天按官方峰价口径收(不跟谷价,比闲时按量贵约 3 倍),仅在国内直连 + 统一计费场景有意义;价格已于 2026-09-10 据官方模型页确认。 定价页https://ofox.ai/zh/models/deepseek/deepseek-v4-flash-0731 | |||||||||||||||||||||||||
| 白 白云山(edgefn) 人工核录 | 3 | 0.1 | 9 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
人工核录价目锁在登录后/仅控制台可见,需人工定期核对(建议每周),非实时刷新。 部署说明官方未公示部署方式:模型页仅列出规格(1024K 上下文 / RPM 10),未标注部署形式,此处不做猜测,以官网说明为准。 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(1024K 上下文) 版本说明已核实:模型页明确 DeepSeek-V4-Flash-0731,规格 1024K 上下文 / RPM 10 / TPM 500 万。(数据源:平台官方模型页) 接入
接口地址https://api.edgefn.net/v1 口径与备注核实时间2026-09-11 13:25 限速限流 RPM 10 风险说明RPM(每分钟请求数)仅 10,高并发场景不适用。价格页需登录查看,以登录后实际页面为准;部署方式未标明。 【同一后端实测】2026-09-11 对照实验:用白山智算的 API Key 可直接调用白云山(edgefn)端点 api.edgefn.net(真 Key 返回 200;换假 Key 返回 403 InvalidToken;不带 Key 返回 403 未提供令牌)——该端点确实校验令牌,而白山的 Key 能通过,说明两家共享同一套后端与账号体系;两家模型清单(24 项)与定价亦完全一致。对用户而言这是两个入口、同一家服务,比价时不必当作两个独立选项。 定价页https://api.edgefn.net/v1 | |||||||||||||||||||||||||
| 白 白山智算 自部署 人工核录 | 3 | 0.1 | 9 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
人工核录价目锁在登录后/仅控制台可见,需人工定期核对(建议每周),非实时刷新。 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(284B-A13B MoE,1M 上下文) 版本说明已核实:模型广场接口明确列出 DeepSeek-V4-Flash-0731,描述与官方一致(284B/13B MoE、重训正式版)。注意:平台上同时挂着旧预览版 DeepSeek-V4-Flash(¥1/缓存¥0.2/¥2,无 0731 后缀),接入时务必认准 -0731 后缀。(数据源:官方模型广场) 接入
白山云科技为国内独立云厂商(边缘云/CDN 起家,资质正规),模型由其自有算力部署。 口径与备注核实时间2026-09-11 13:25 限速限流 RPM 10 · TPM 500 万 风险说明限流 RPM 仅 10 / TPM 500 万(与白云山同级别的低配额,高并发场景易触发限流);无峰谷分时、无区间计费,单档固定价与官方峰值持平;同架预览版更便宜但能力差,别选错。 【同一后端实测】2026-09-11 对照实验:用白山智算的 API Key 可直接调用白云山(edgefn)端点 api.edgefn.net(真 Key 返回 200;换假 Key 返回 403 InvalidToken;不带 Key 返回 403 未提供令牌)——该端点确实校验令牌,而白山的 Key 能通过,说明两家共享同一套后端与账号体系;两家模型清单(24 项)与定价亦完全一致。对用户而言这是两个入口、同一家服务,比价时不必当作两个独立选项。 厂家身份白山云科技为国内独立云服务商 定价页https://ai.baishan.com/market/models | |||||||||||||||||||||||||
| 共 共绩算力 · 0731 版 聚合平台 人工核录 | 3 | 0.1 | 9 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
人工核录价目锁在登录后/仅控制台可见,需人工定期核对(建议每周),非实时刷新。 部署说明平台自述「模型聚合」,同时提供智谱、DeepSeek、月之暗面、阿里等多家模型;各模型的具体供应方式平台未逐项公示。 版本说明✓ 已核实型号deepseek-v4-flash-0731 版本说明已核实(2026-09-11 平台控制台价目页):条目 id 为 deepseek/deepseek-v4-flash-0731,与官方 0731 代次对应;同页另有「V4 Flash 预览版」条目,两者价格不同。 接入
接口地址https://api.suanli.cn/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-11 15:55 风险说明同平台并行供应「V4 Flash 预览版」与「V4 Pro」条目,选型时勿混。 厂家身份北京共绩科技有限公司(京ICP备 2023013220 号-1)运营的弹性算力平台,聚合智谱、DeepSeek、月之暗面、阿里等多家模型。 定价页https://console.suanli.cn/models | |||||||||||||||||||||||||
| P PPIO 派欧云 自部署 | 3 | 1 | 9 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(1M 上下文 / 最大输出 384K) 版本说明已核实(2026-09-11 PPIO 官方模型接口数据原文):模型 id deepseek/deepseek-v4-flash-0731,输入 3 / 输出 9(元每百万 tokens,与火山方舟、腾讯云等同档);上下文 1,048,576、单次最长输出 393,216,支持缓存与思考模式。平台另列无日期后缀的 deepseek/deepseek-v4-flash,同价同规格(滚动指向当前正式版)。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-11 17:25 风险说明缓存读取价标为 1 元每百万,高于同类渠道常见的 0.1 元档,选型时留意。缓存写入(创建)当前标价 0 元,实际以控制台为准。 厂家身份派欧云计算(上海)有限公司(沪ICP备18048206号-33)运营的分布式云计算平台。 定价页https://ppio.com/llm | |||||||||||||||||||||||||
| N NavyAI(聚合平台) 聚合平台 美元刊例 · 折算展示 | 0.2692 | 0.2692 | 0.5384 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号deepseek-v4-flash-0731 版本说明模型 ID 为 deepseek-v4-flash-0731,即 DeepSeek V4-Flash 0731 官方版;据该平台官方定价页与官方接口(https://api.navy/v1/models),两者一致。该渠道未公布缓存价,此处按无缓存折扣计(缓存档等于输入价)。 接入
接口地址https://api.navy/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明报价约为表内同档中位数的 18%,显著低于同业,货源与限速请自行核对。 报价明显低于同业,未标注上游供应商,货源请自行核对。 定价页https://api.navy | |||||||||||||||||||||||||
| N Naga(聚合平台) 聚合平台 美元刊例 · 折算展示 | 0.2187 | 0.0538 | 0.6057 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号deepseek-v4-flash-0731 版本说明模型 ID 为 deepseek-v4-flash-0731,即 DeepSeek V4-Flash 0731 官方版;据该平台官方定价页与官方接口(https://api.naga.ac/v1/models),两者一致。 接入
接口地址https://api.naga.ac/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明报价约为表内同档中位数的 15%,显著低于同业,货源与限速请自行核对。 报价为同类中较低水平,未标注上游供应商,对比时留意。 定价页https://naga.ac/pricing | |||||||||||||||||||||||||
| O OpenRouter(聚合平台) 聚合平台 美元刊例 · 折算展示 | 峰2.9612 / 谷0.2692 | 峰0.1884 / 谷0.0673 | 峰8.8836 / 谷0.673 | 峰:池内最高档,仅作比价上限参考 谷:池内最低档,单上游调价/撤单即失效,仅作比价下限参考 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径聚合口径(2026-09-16 复抓 OpenRouter 官方 endpoints 接口(29 家上游端点)):主档取「池内中位档」(按输入价升序取上中位,不再取最低档)—— 中位档 Together 输入 $0.14 / 缓存 $0.03 / 输出 $0.28,池内区间输入 $0.04 ~ $0.44;人民币价 = 美元价 × 6.73(2026-09-16 汇率 1 USD ≈ 6.73 元)。 版本说明✓ 已核实型号deepseek/deepseek-v4-flash-0731(1M 上下文) 版本说明已核实:OpenRouter 官方 endpoints 接口(2026-09-09)显示模型 ID deepseek/deepseek-v4-flash-0731,即官方 7/31 正式版 checkpoint,29 家端点均挂此 ID。口径修正(2026-09-16):聚合平台主档取「池内中位档」——池内共 29 家上游,中位档为 Together 输入 $0.14 / 输出 $0.28;原取池内最低档(受单上游撤单影响大)已降为次档。 接入
接口地址https://openrouter.ai/api/v1 可用 provider 参数指定供应商(如 DeepInfra)锁定价格与量化。 口径与备注核实时间2026-09-16 20:14 风险说明聚合平台:一个模型 29 家供应商供货,量化不一(fp4/fp8/bf16 混挂),默认路由不保证中位价——主档按池内中位档展示,取区间下限需用 provider 参数锁定供应商。按用量计费另收 5.5% 平台服务费,推理价零加价,个人开通即用。
直购对照(2026-09-09):池内大商家(DeepInfra/Together/Fireworks/Baseten/硅基国际等)官网直购价与代售价基本一致,本站均单独收录,直购可省 5.5% 平台费;而小商家(OpenInference/CoreWeave 等)官网无公开按 token 刊例(CoreWeave 只租 GPU 按小时计价,OpenInference 官网无价格页);DigitalOcean 可直购($0.08/$0.252,与代售价一致),本站已收录。 定价页https://openrouter.ai/deepseek/deepseek-v4-flash-0731 | |||||||||||||||||||||||||
| L LLM Gateway(聚合平台) 聚合平台 美元刊例 · 折算展示 | 0.3365 | 0.0673 | 0.673 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号deepseek-v4-flash 版本说明模型 ID 为 deepseek-v4-flash,即 DeepSeek V4-Flash 0731 官方版;据该平台官方定价页与官方接口(https://api.llmgateway.io/v1/models),两者一致。 接入
接口地址https://api.llmgateway.io/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明报价约为表内同档中位数的 23%,显著低于同业,货源与限速请自行核对。 报价低于同类聚合平台,未标注上游供应商,对比时留意。 定价页https://llmgateway.io/pricing | |||||||||||||||||||||||||
| R Requesty(聚合平台) 聚合平台 美元刊例 · 折算展示 | 峰3.0958 / 谷0.5115 | 峰0.6057 / 谷0.0942 | 峰6.2589 / 谷1.0297 | 峰:池内最高档,仅作比价上限参考 谷:池内最低档,单上游调价/撤单即失效,仅作比价下限参考 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径聚合口径(2026-09-16 复抓 Requesty 公开模型接口(9 家上游)):主档取「池内中位档」(按输入价升序取上中位,不再取最低档)—— 中位档 fireworks 输入 $0.22 / 缓存 $0.007 / 输出 $0.66,池内区间输入 $0.076 ~ $0.46;人民币价 = 美元价 × 6.73(2026-09-16 汇率 1 USD ≈ 6.73 元)。 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(1M 上下文,上游 DeepInfra) 版本说明已核实(2026-09-11 Requesty 官方模型接口原文):条目 id deepinfra/deepseek-v4-flash-0731,归属 DeepInfra,1,048,576 上下文,支持缓存与思考模式;输入 $0.09 / 缓存 $0.018 / 输出 $0.18(每 1M token)。口径修正(2026-09-16):聚合平台主档取「池内中位档」——池内共 9 家上游,中位档为 fireworks 输入 $0.22 / 输出 $0.66;原取池内最低档(受单上游撤单影响大)已降为次档。 接入
接口地址https://router.requesty.ai/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:14 备注同平台另有未被收录的其他 DeepSeek 型号,仅收录本站在列的 v4-flash-0731。 风险说明池内 9 家上游本轮均有报价,已按中位档(fireworks)展示,单一上游撤单不会直接顶掉主档。平台为透传式聚合(无推理加价),但同平台对同一模型的输入价与厂商直连价可能不同,以控制台为准。 定价页https://www.requesty.ai/models-new/deepinfra/deepseek-v4-flash-0731 | |||||||||||||||||||||||||
| I Infron(零加价网关) 聚合网关 美元刊例 · 折算展示 | 峰0.56 / 谷0.52 | 峰0.09 / 谷0.1 | 峰1.12 / 谷1.03 | 峰:全时段,低优先级路由(适合离线评测、批处理等容忍波动的任务)(美元计价,按 1 USD ≈ 6.73 元折算) 谷:全时段(美元计价,按 1 USD ≈ 6.73 元折算) | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:Standard 档 输入 $0.07675 · 缓存读 $0.0155 · 输出 $0.153125;Flex 档 输入 $0.0835 · 缓存读 $0.013895 · 输出 $0.16675(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 部署说明零加价路由 版本说明✓ 已核实型号deepseek/deepseek-v4-flash(官方别名,1M 上下文 / 384K 输出) 版本说明已核实(2026-09-15 据该站官方模型页数据):Standard 档均值 输入 $0.07675 · 缓存读 $0.0155 · 输出 $0.153125,Flex 档均值 输入 $0.0835 · 缓存读 $0.013895 · 输出 $0.16675(每 1M tokens)。Standard 池 4 家上游(alibaba eu/jp/us $0.069、sg $0.1),Flex 池 2 家(alibaba/cn $0.069、baidu-cloud $0.098)。注:DeepSeek 官方 2026-09-10 起旧模型名 deepseek-v4-flash 已下线、请求由 V4.1-Flash 承接,该站仍单列此 id 并单独标价,实际供应版本以调用返回的 model 字段为准。 接入
接口地址https://api.infron.ai/v1 零 token 加价,平台按 $0.35 + 5% 收取账户服务费。分 Flex / Standard 档位池。 口径与备注核实时间2026-09-15 20:58 风险说明价格口径:这里的价格取自该站模型页卡片标示的「Avg list price」,即该档位池内全部可用上游的算术平均;站内逐上游明细另列每家单价,最低的一条常显著低于此均值。该站原话「your request is billed at the rate of the provider it is routed to」—— 实际费用取决于当次路由到的上游,故此处均值偏保守。折扣时效:部分上游当前有折扣,幅度与期限由各上游自行调整,随时可能回调。资历:域名 2026-01-07 注册,公司很新,零加价模式下无动力压价,但长周期可靠性未经验证,建议按需使用,不建议一次性投入大额资金。 定价页https://infron.ai/models/deepseek/deepseek-v4-flash | |||||||||||||||||||||||||
| C Cortecs 聚合平台 欧元刊例 · 折算展示 | 0.6375 | 0.1023 | 1.2041 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 EUR 刊例,人民币价 = 原价 × 7.87(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号deepseek-v4-flash-0731 版本说明模型 ID 为 deepseek-v4-flash-0731,即 DeepSeek V4-Flash 0731 官方版;据该平台官方定价页与官方接口(https://api.cortecs.ai/v1/models),两者一致。 接入
接口地址https://api.cortecs.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明欧洲节点,原站以欧元刊例。 定价页https://cortecs.ai | |||||||||||||||||||||||||
| D DeepInfra 自部署 美元刊例 · 折算展示 | 0.4 | 0.1 | 1.21 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.06 · 缓存 $0.015 · 输出 $0.18(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(fp8 量化,1M 上下文) 版本说明已核实:官网模型页明确 deepseek-ai/DeepSeek-V4-Flash-0731,fp8 量化。价格取自官网模型页内嵌定价:输入 $0.06 / 输出 $0.18,缓存命中按输入价 25%(即 $0.015)。 接入
接口地址https://api.deepinfra.com/v1/openai 其官网价格与在 OpenRouter 上的报价一致($0.06/$0.18)。 口径与备注核实时间2026-09-17 20:04 风险说明海外托管商:自购 GPU 跑开源权重(fp8 量化版),能力表现与官方可能有差异;缓存命中按输入 25% 计,与官方缓存口径不同,重度用缓存的场景对比时要留意。 定价页https://deepinfra.com/deepseek-ai/DeepSeek-V4-Flash-0731 | |||||||||||||||||||||||||
| C Concentrate.ai(零加价网关) · 0731 版 聚合平台 美元刊例 · 折算展示 | 峰2.9612 / 谷0.5384 | 峰0.1884 / 谷0.1077 | 峰8.8836 / 谷1.2114 | 峰:池内最高档,仅作比价上限参考 谷:池内最低档,单上游调价/撤单即失效,仅作比价下限参考 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径聚合口径(2026-09-16 复抓 Concentrate.ai 公开单模型接口 providers(5 家上游)):主档取「池内中位档」(按输入价升序取上中位,不再取最低档)—— 中位档 fireworks 输入 $0.22 / 缓存 $0.007 / 输出 $0.66,池内区间输入 $0.08 ~ $0.44;人民币价 = 美元价 × 6.73(2026-09-16 汇率 1 USD ≈ 6.73 元)。 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(1M 上下文) 版本说明已核实(2026-09-11 平台公开模型接口):条目 deepseek-v4-flash-0731 池内 5 家上游,最低 DeepInfra 输入 $0.08 / 输出 $0.18,最高 Cloudflare 输入 $0.44 / 输出 $1.32。该平台为零加价网关,报价即上游刊例价。口径修正(2026-09-16):聚合平台主档取「池内中位档」——池内共 5 家上游,中位档为 fireworks 输入 $0.22 / 输出 $0.66;原取池内最低档(受单上游撤单影响大)已降为次档。 接入concentrate.ai 注册 → 开通账号 → 接口 https://api.concentrate.ai/v1 (OpenAI 兼容)。平台为零加价网关(官方定价页写明 No platform markup on tokens,无服务费)。也支持 BYOK(自带上游密钥)消耗已有额度。 口径与备注核实时间2026-09-16 20:14 风险说明该平台为零加价网关:报价即各上游服务商的刊例价,本身不额外加价,故与直连上游渠道同价,不构成独立的一路供给。池内各上游的上下文长度与量化方式可能不同,横向比较时留意。 厂家身份Concentrate.ai,面向团队的 LLM 网关(站内自述 LLM Gateway),零加价透传各上游刊例价,持 SOC 2 Type II 认证。 定价页https://concentrate.ai/pricing | |||||||||||||||||||||||||
| F FastRouter(聚合平台) 聚合平台 美元刊例 · 折算展示 | 0.6057 | 0.1211 | 1.2114 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号deepseek/deepseek-v4-flash 版本说明模型 ID 为 deepseek/deepseek-v4-flash,即 DeepSeek V4-Flash 0731 官方版;据该平台官方定价页与官方接口(https://api.fastrouter.ai/v1/models),两者一致。 接入
接口地址https://api.fastrouter.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 定价页https://fastrouter.ai | |||||||||||||||||||||||||
| M MegaNova 聚合平台 美元刊例 · 折算展示 | 0.6057 | 0.1211 | 1.2114 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号deepseek-ai/DeepSeek-V4-Flash-0731 版本说明模型 ID 为 deepseek-ai/DeepSeek-V4-Flash-0731,即 DeepSeek V4-Flash 0731 官方版;据该平台官方定价页与官方接口(https://api.meganova.ai/v1/models),两者一致。 接入
接口地址https://api.meganova.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 定价页https://meganova.ai | |||||||||||||||||||||||||
| D DigitalOcean 自营推理 美元刊例 · 折算展示 | 0.54 | 0.17 | 1.7 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.08 · 缓存读 $0.0252(页显 $0.03)· 输出 $0.252(页显 $0.25),缓存写入不计费(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算。 版本说明✓ 已核实型号deepseek-v4-flash-0731(官网目录单列,1M 上下文) 版本说明已核实 0731:官方公开定价页(docs.digitalocean.com)单列『DeepSeek V4 Flash 0731』= $0.080 input / $0.252 output / $0.025 prompt caching 每 1M token;与 Model Studio 控制台价格($0.08 / $0.252 / $0.0252)逐项吻合,两个官方来源互相印证。官网详情页 Pricing 标签显示的 $0.03/$0.25 为四舍五入显示值。provider 为 MODEL_PROVIDER_DIGITALOCEAN 自营 serverless,GA 状态。 接入
价格核实:官方文档定价页 https://docs.digitalocean.com/products/gradient-ai-platform/details/pricing/ → DeepSeek V4 Flash 0731 一行为「Input/output tokens $0.080 / $0.252 per 1M tokens · Prompt caching $0.025 per 1M tokens」。支持 Batch / Dedicated(集群包月)等形态,此处按 Serverless 按量计。 口径与备注核实时间2026-09-16 20:29 风险说明全时段统一价、无峰谷分时。与 OpenRouter 代售价完全一致(含缓存 $0.0252,OR 零加价实锤),直购可省 5.5% 平台服务费。缓存写入不计费(5m/1h 均 $0),高频 agent 场景实际成本更低。注:官方定价页同时列出非 0731 的 DeepSeek V4 Flash($0.068 / 缓存 $0.017 / 输出 $0.168)与 V4 Pro 0813($1.32 / $0.044 / $3.96),此处只收录 0731 档。 定价页https://docs.digitalocean.com/products/gradient-ai-platform/details/pricing/ | |||||||||||||||||||||||||
| T Together AI 自部署 美元刊例 · 折算展示 | 0.94 | 0.2 | 1.88 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.14 · 缓存 $0.03 · 输出 $0.28(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号deepseek-ai/DeepSeek-V4-Flash-0731(FP4 量化,1M 上下文) 版本说明已核实:官方 serverless 模型目录(llms.txt 提供的 markdown 直链)明确列 DeepSeek-V4-Flash-0731:输入 $0.14 / 缓存 $0.03 / 输出 $0.28,FP4 量化,1M 上下文。与在 OpenRouter 的报价一致。 接入
接口地址https://api.together.xyz/v1 Serverless 即开即用,另有独享吞吐(Provisioned Throughput)按需选。 口径与备注核实时间2026-09-16 20:31 风险说明海外托管商:FP4 量化版,能力表现可能打折,Agent/代码类场景实测后再上量;缓存价 $0.03 明显高于 DeepInfra/Fireworks,重缓存场景不划算。 定价页https://docs.together.ai/docs/serverless/models | |||||||||||||||||||||||||
| N Nebius Token Factory 自营 GPU 云 美元刊例 · 折算展示 | 0.94 | — | 1.88 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.14 · 缓存读未公示(官方目录页未单列,2026-09-10 用户实地核对) · 输出 $0.28(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-10 汇率)折算。 部署说明欧洲 版本说明✓ 已核实型号deepseek-ai/DeepSeek-V4-Flash-0731(1M 上下文,官方目录实页核对) 版本说明已核实 0731:官方目录页 tokenfactory.nebius.com/models/catalog/... 单列 deepseek-ai/DeepSeek-V4-Flash-0731,$0.14 / 输出 $0.28,完整 1M 上下文。该页只列输入与输出,未单独公示缓存读价,故缓存价记为未公示。另有 -fast 档(投机解码低延迟)价格更高。 接入
接口地址https://api.tokenfactory.nebius.com/v1(OpenAI 按 token 纯按量、无月费无最低消费;支持 LoRA 微调与同账户 GPU 租赁。 Google/GitHub 登录) 口径与备注核实时间2026-09-10 10:10 条目备注开业时间:Nebius 域名 2004-06 注册(前身 VK 云业务,2024-12 更名 Nebius,纳斯达克 NBIS) 风险说明官方定价页需登录查看;此处价格经多方公开来源交叉一致,缓存读价未公示,重缓存场景成本无法预估,实购前请以控制台刊例为准。Nebius 为纳斯达克上市欧洲 AI 云(NVIDIA 持股约 9.3%),资历无忧。动态限流:15 分钟窗口利用率 80%+ 自动扩容。 定价页https://docs.tokenfactory.nebius.com/quickstart | |||||||||||||||||||||||||
| W WandB Inference 自营推理 美元刊例 · 折算展示 | 0.87 | 0.47 | 1.88 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.13 · 缓存读 $0.07 · 输出 $0.28(0731/262K 版);1M 版输入 $0.14(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-10 汇率)折算,汇率波动时人民币价随之变化。 部署说明Weights & Biases,CoreWeave 系 版本说明✓ 已核实型号DeepSeek V4-Flash-0731(官方模型页单列) 版本说明已核实 0731:WandB Serverless 模型页单列 DeepSeek V4-Flash-0731(New Jul 2026):$0.13 / 缓存 $0.07 / $0.28,262K 上下文,模型 ID cw_deepseek-ai_deepseek-v4-flash-0731(页面明示底层 CoreWeave 基础设施)。同页另有 DeepSeek V4-Flash(1M 上下文,官方别名)$0.14/$0.07/$0.28。注意:官方 9/10 起旧名 deepseek-v4-flash 已下线路由到 V4.1-Flash,OpenRouter 挂的 0731 模型卡为旧权重托管,实际版本以接口响应为准。 接入
接口地址https://api.inference.wandb.ai/v1(OpenAI 口径与备注核实时间2026-09-16 20:31 条目备注开业时间:W&B 2017 年成立,2025 年被 CoreWeave 收购;Serverless Inference 2025 年上线 风险说明Weights & Biases 为 ML 开发平台头部厂商(2025 年被 CoreWeave 收购),底层即 CoreWeave,资信高;与 CoreWeave 同价同上下文限制,优势在 W&B 生态(Weave 观测/LoRA 托管)。 厂家身份Weights & Biases 为 ML 开发平台 定价页https://wandb.ai/site/inference | |||||||||||||||||||||||||
| I Impossibl(聚合平台) 聚合平台 美元刊例 · 折算展示 | 0.9422 | 0.1884 | 1.8844 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号deepseek/deepseek-v4-flash-0731 版本说明模型 ID 为 deepseek/deepseek-v4-flash-0731,即 DeepSeek V4-Flash 0731 官方版;据该平台官方定价页与官方接口(https://api.impossibl.com/v1/models),两者一致。 接入
接口地址https://api.impossibl.com/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 定价页https://impossibl.com | |||||||||||||||||||||||||
| R Routeway(聚合平台) 聚合平台 美元刊例 · 折算展示 | 0.9422 | 0.3533 | 1.8844 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号deepseek-v4-flash-0731 版本说明模型 ID 为 deepseek-v4-flash-0731,即 DeepSeek V4-Flash 0731 官方版;据该平台官方定价页与官方接口(https://api.routeway.ai/v1/models),两者一致。 接入
接口地址https://api.routeway.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明极低价档与试验性路由不计入,此处取标准档。 定价页https://routeway.ai | |||||||||||||||||||||||||
| D Databricks 自部署 美元刊例 · 折算展示 | 0.9422 | 0.1884 | 1.8844 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径该平台以自有计量单位计价:输入 2.0 / 输出 4.0 / 缓存读取 0.4(每 1M token)。折算链路:单位价 × $0.07 = 美元价,再按 1 USD ≈ 6.73 元的汇率折算人民币(即输入 $0.14000 / 输出 $0.28000 / 缓存 $0.02800 每 1M token);汇率与单位单价均会变动,实际以平台结算为准。 版本说明✓ 已核实型号DeepSeek V4 Flash 版本说明已核实:其官方企业级模型服务公开定价页明确列出「DeepSeek V4 Flash」的按 token 三列价(输入 / 输出 / 缓存读取),折算人民币后入表。该页未标注具体修订版号,按当前版收录。 接入
价格取自平台公开定价页,读者可直接打开核对,并按说明的单位单价折算。 口径与备注核实时间2026-09-16 20:29 风险说明平台按其自有计量单位计价(非美元直标),表中价格已按该单位当期单价折算为人民币,单位单价随所选版本档变化,实际以平台结算为准。该能力需在平台工作区内启用后调用,接入步骤多于一般接口服务;缓存读取价为输入价的 20%。 定价页https://www.databricks.com/product/pricing/foundation-model-serving | |||||||||||||||||||||||||
| I Infron(零加价网关) · 0731 版 聚合网关 美元刊例 · 折算展示 | 0.86 | 0.09 | 2.59 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:Standard 档 输入 $0.12816 · 缓存读 $0.01272 · 输出 $0.38448(每 1M token),当前为上游 70% off 折扣价(折扣前 $0.424 / $0.042 / $1.272)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 部署说明零加价路由 版本说明✓ 已核实型号deepseek/deepseek-v4-flash-0731(0731 正式版,1M 上下文 / 384K 输出) 版本说明已核实(2026-09-15 据该站官方模型页数据):Standard 档均值 输入 $0.12816 · 缓存读 $0.01272 · 输出 $0.38448(每 1M tokens),池内 5 家上游(alibaba eu/hk/jp/us $0.1272、sg $0.132),全档带 70% off 折扣,折扣前为 $0.424 / $0.042 / $1.272。该站无 Flex 档。 接入
接口地址https://api.infron.ai/v1 零 token 加价,平台按 $0.35 + 5% 收取账户服务费。仅 Standard 档。 口径与备注核实时间2026-09-15 20:58 风险说明价格口径:这里的价格取自该站模型页卡片标示的「Avg list price」,即该档位池内全部可用上游的算术平均;站内逐上游明细另列每家单价,最低的一条常显著低于此均值。该站原话「your request is billed at the rate of the provider it is routed to」—— 实际费用取决于当次路由到的上游,故此处均值偏保守。折扣时效:部分上游当前有折扣,幅度与期限由各上游自行调整,随时可能回调。该 id 为该站独立挂出的 0731 版条目(与不带版本后缀的 deepseek-v4-flash 价格不同)。资历:域名 2026-01-07 注册,公司很新,零加价模式下无动力压价,但长周期可靠性未经验证,建议按需使用,不建议一次性投入大额资金。 定价页https://infron.ai/models/deepseek/deepseek-v4-flash-0731 | |||||||||||||||||||||||||
| E Eurouter(聚合平台) 聚合平台 欧元刊例 · 折算展示 | 1.1018 | 0.3148 | 2.7545 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 EUR 刊例,人民币价 = 原价 × 7.87(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号deepseek-v4-flash-0731 版本说明模型 ID 为 deepseek-v4-flash-0731,即 DeepSeek V4-Flash 0731 官方版;据该平台官方定价页与官方接口(https://api.eurouter.ai/v1/models),两者一致。 接入
接口地址https://api.eurouter.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明部分模型原站以欧元刊例。 定价页https://eurouter.ai/models | |||||||||||||||||||||||||
| F Fireworks AI 自部署 美元刊例 · 折算展示 | 1.48 | 0.05 | 4.44 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例(Standard 档):输入 $0.22 · 缓存 $0.007 · 输出 $0.66(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(1M 上下文,定价页未标量化) 版本说明已核实:官方 serverless 定价文档(llms.txt 提供 markdown 直链)明确 DeepSeek V4 Flash (0731) Standard 档:输入 $0.22 / 缓存 $0.007 / 输出 $0.66;Priority 档加价 25%($0.275/$0.00875/$0.825);批量推理再打五折。量化精度官方定价页未标注。 接入
接口地址https://api.fireworks.ai/inference/v1 Standard 档即本站价格,Priority 档是加价 25% 的提速选项,批量推理打五折。 口径与备注核实时间2026-09-16 20:31 定价页https://docs.fireworks.ai/serverless/pricing | |||||||||||||||||||||||||
| Z ZenMux 聚合平台 美元刊例 · 折算展示 | 1.4806 | 0.0471 | 4.4418 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.22 · 缓存命中 $0.007 · 输出 $0.66(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-15 汇率)。 版本说明✓ 已核实型号deepseek/deepseek-v4-flash 版本说明已核实(2026-09-15 该平台官方模型目录的供应商报价明细):模型 ID deepseek/deepseek-v4-flash,展示名 DeepSeek V4 Flash 0731,1M 上下文。上游 Baidu / TencentCloud 两端点报 输入 $0.22 · 缓存命中 $0.007 · 输出 $0.66,与官方 0731 海外刊例一致,属本代 0731 版本。 接入
接口地址https://zenmux.ai/api/v1 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 风险说明聚合网关类:站内同一模型由多家供应商供货,缓存命中价随供应商不同($0.007 ~ $0.021,Alibaba Cloud 一档最高),本条按与官方刊例一致的口径取 $0.007;默认路由不保证最低价,要锁定本档需用 provider 参数指定供应商。 定价页https://zenmux.ai/deepseek/deepseek-v4-flash | |||||||||||||||||||||||||
| A Azure AI Foundry 官方托管 美元刊例 · 折算展示 人工核录 | 2.96 | 0.09 | 8.88 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.44 · 缓存 $0.014 · 输出 $1.32(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 人工核录价目锁在登录后/仅控制台可见,需人工定期核对(建议每周),非实时刷新。 部署说明微软云 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(Direct from Azure,正式 GA) 版本说明已核实:微软官方博客宣布 DeepSeek-V4-Flash-0731 以「Direct from Azure」方式正式上线(GA),为 DeepSeek 官方深度合作托管。另有「Fireworks on Foundry」通道同模型更便宜($0.15/缓存 $0.03/输出 $0.31),此处按 Direct from Azure 主通道计价。 接入
走 Azure 订阅统一计费,企业级 SLA,欧洲/亚太/中东等十余区域。 口径与备注核实时间2026-09-10 08:30 备注两条通道(美元价):Direct from Azure $0.44/0.014/1.32(≈官方刊例);Fireworks on Foundry $0.15/0.03/0.31(折 ¥1.01/¥0.20/¥2.09,约为主通道 1/3 价),选部署类型时注意区分。 风险说明与 DeepSeek 官方高峰刊例基本同价,省钱需走 Fireworks 通道;无峰谷分时。 定价页https://techcommunity.microsoft.com/t5/microsoft-foundry-blog/introducing-deepseek-v4-flash-and-v4-pro-in-microsoft-foundry/ba-p/4515174 | |||||||||||||||||||||||||
| C Cloudflare Workers AI 自营推理 美元刊例 · 折算展示 | 2.96 | 0.09 | 8.88 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.44 · 缓存读 $0.014 · 输出 $1.32(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算。 部署说明serverless 推理服务 版本说明✓ 已核实型号@cf/deepseek-ai/deepseek-v4-flash-0731(官方价目表单列) 版本说明已核实 0731:官方定价页明列 @cf/deepseek-ai/deepseek-v4-flash-0731($0.44/缓存 $0.014/$1.32),同页另列 deepseek-v4-pro-0813。属 'frontier model',需启用计费方式(免费 Neurons 额度不适用)。 接入
免费层每日 10,000 Neurons 不覆盖 frontier 模型。 $5/月)或预存 AI Gateway 额度(无需绑 Workers 计划) 口径与备注核实时间2026-09-16 20:29 条目备注开业时间:Cloudflare 2010 年上市运营(NYSE: NET),Workers AI 2023-09 GA 风险说明计费以 Neurons 结算($0.011/千 Neurons),token 价是官方换算展示口径,实际账单按 Neurons 计——token 价与 Neuron 价同页对照,结算以控制台为准。缓存读 $0.014。 定价页https://developers.cloudflare.com/workers-ai/platform/pricing/ | |||||||||||||||||||||||||
| L LLM7(聚合平台) 聚合平台 美元刊例 · 折算展示 | 0.1346 | 0.1346 | 0.2692 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731 版本说明模型 ID 为 DeepSeek-V4-Flash-0731,即 DeepSeek V4-Flash 0731 官方版;据该平台官方定价页与官方接口(https://api.llm7.io/v1/models),两者一致。该渠道未公布缓存价,此处按无缓存折扣计(缓存档等于输入价)。 接入
接口地址https://api.llm7.io/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明报价约为表内同档中位数的 9%,显著低于同业,货源与限速请自行核对。 同一模型挂多档价位(按可用性分档),此处取基础标准档;低价档的限速与可用率需自行确认。 定价页https://llm7.io | |||||||||||||||||||||||||
| D DoubleWord 自部署 美元刊例 · 折算展示 | 0.3365 ~ 0.6057 | 0.0673 ~ 0.1346 | 0.6057 ~ 1.2114 | 无峰谷定价 实时(即时返回) / 异步(约 1 分钟起) / 批次(最长 24 小时交付) | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例(每 1M token,输入价):实时 $0.09、$0.07、$0.05,按 1 USD ≈ 6.73 元折算。人民币价 = 美元价 × 6.73(2026-09-14 汇率),汇率波动时人民币价随之变化。 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731 版本说明已核实:其官方文档价格表按「输入 / 缓存读取 / 输出」三列列出「DeepSeek-V4-Flash-0731」的每百万 token 价,并分实时、异步、批次三档(美元计价)。 接入
接口地址https://api.doubleword.ai/v1 价格取自官方文档价格表,读者可直接打开核对。 口径与备注核实时间2026-09-14 22:20 风险说明海外推理服务商,按交付速度分档:实时档即时返回,异步档约 1 分钟起处理,批次档按文件批量提交、24 小时内交付。三档为同一模型、质量一致,差别只在等待时间与价格,批次档不适用于需要即时响应的场景。缓存命中价约为输入价的 10%~20%。 定价页https://docs.doubleword.ai/inference-api/models | |||||||||||||||||||||||||
| I InferX 自部署 美元刊例 · 折算展示 人工核录 | 0.518 | 0.0165 | 1.036 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径折后美元价:输入 $0.077 · 缓存 $0.00245 · 输出 $0.154(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-12 汇率)折算,汇率或折扣变动时随之变化。 人工核录价目锁在登录后/仅控制台可见,需人工定期核对(建议每周),非实时刷新。 版本说明✓ 已核实型号deepseek-v4-flash-0731(开源权重,1M 上下文) 版本说明已核实:官方模型接口返回 deepseek-ai/DeepSeek-V4-Flash-0731(开源权重仓库),属自建算力部署而非官方接口转售。平台公开的 24 小时缓存命中率为 89.5%。 接入
接口地址https://model.inferx.net/endpoints/v1 按量计费,无订阅、无最低消费。 口径与备注核实时间2026-09-12 17:10 条目备注专用域名 2025-01 注册、注册有效期 3 年;已运营约 1 年 7 个月 风险说明价格随折扣浮动:当前为刊例 65% 折扣后的价格,折扣随时调整,取消折扣后按刊例计费;自建算力运行开源权重,无模型方授权背书与可用性承诺;公司主体未公开。使用前请以官方页面当前折扣为准。 厂家身份自建算力运行开源权重的按量推理平台,价格按刊例折扣浮动 定价页https://model.inferx.net/catalog/endpoints/deepseek-v4-flash-0731 | |||||||||||||||||||||||||
| A Avian 自营推理 美元刊例 · 折算展示 | 0.54 | 0.11 | 1.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.0805 · 缓存读 $0.0165 · 输出 $0.161(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算。 部署说明B200 集群 版本说明✓ 已核实型号deepseek/deepseek-v4-flash(实测输出为 0731 版本) 版本说明已核实 0731:官网模型 ID 虽无 0731 后缀(V4 Pro 标 0813、Flash 不标),2026-09-10 实测确认输出为 0731 版本。官方接口价格与官网一致。 接入
NVIDIA B200 + 投机解码,自述 489 tok/s、零数据留存、SOC2(Azure 基础设施)。 口径与备注核实时间2026-09-16 20:29 条目备注开业时间:域名 2018-03-22 注册(7 年半,早年为数据对话产品后转型推理平台,自述 2025-01 DeepSeek R1 Day-1 部署商) 风险说明价格便宜($0.0805/$0.161,约为官方刊例 6 折)但版本未标 0731——对版本敏感的场景先实测。采用预存额度制。 定价页https://avian.io/pricing | |||||||||||||||||||||||||
| E Eden AI(聚合平台) 聚合平台 美元刊例 · 折算展示 | 峰3.1241 / 谷0.426 | 峰0.0994 / 谷0.1065 | 峰9.3722 / 谷1.278 | 峰:池内最高档,仅作比价上限参考,已含平台 5.5% 服务费 谷:池内最低档,单上游调价/撤单即失效,仅作比价下限参考,已含平台 5.5% 服务费 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径聚合口径(2026-09-16 复抓 Eden AI 公开模型目录接口(14 家上游)):主档取「池内中位档」(按输入价升序取上中位,不再取最低档)—— 中位档 qwen 输入 $0.2 / 缓存 $0.04 / 输出 $0.4,池内区间输入 $0.06 ~ $0.44;平台另收 5.5% 服务费,人民币价 = 美元价 × 1.055 × 6.73(2026-09-16 汇率 1 USD ≈ 6.73 元)。 版本说明✓ 已核实型号DeepSeek V4 Flash(当前版;池内部分上游另有 0731 修订版) 版本说明已核实(2026-09-14 平台公开模型目录接口原文):该平台目录逐条给出模型标识、上游服务商、上下文长度与按 token 的三列价;表中取各上游的刊例价(非折后价)。本模型在目录中标注为「DeepSeek V4 Flash(当前版;池内部分上游另有 0731 修订版)」,池内共 10 家上游(14 条可用报价),最低 deepinfra,最高 cloudflare/deepseek。另有 2 条报价未公开缓存读取价,未纳入。口径修正(2026-09-16):聚合平台主档取「池内中位档」——池内共 14 家上游,中位档为 qwen 输入 $0.2 / 输出 $0.4;原取池内最低档(受单上游撤单影响大)已降为次档。,已含平台 5.5% 服务费 接入
接口地址https://api.edenai.run/v3 价格取自平台公开定价页与其公开模型目录,读者可直接打开核对。 口径与备注核实时间2026-09-16 20:14 风险说明聚合网关:本身不加工上游定价,报价为各上游服务商刊例价,另按 5.5% 收取平台服务费,表中价格已含该费用。同一模型池内多家上游的报价与上下文长度可能不同,若不指定上游,实际可能路由到池内任一家,横向比较时留意。 定价页https://www.edenai.co/pricing | |||||||||||||||||||||||||
| M Makora 自部署 美元刊例 · 折算展示 | 0.6057 | 0.1346 | 1.346 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.09 · 缓存 $0.02 · 输出 $0.2(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-14 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(1M 上下文) 版本说明已核实:其官网主推区明列 DeepSeek-V4-Flash-0731 的按 token 三列价(输入 $0.09 / 缓存 $0.02 / 输出 $0.20),同区块另标 1M 上下文、201 tok/s、TTFT 350ms;其在聚合平台上的端点报价与此一致。 接入
接口地址https://inference.makora.com 价格取自官网主推区,读者可直接打开官网核对。 口径与备注核实时间2026-09-16 20:31 风险说明海外自部署推理商,自研内核与调度优化栈,模型目录以开源权重为主(与「转售闭源模型」的平台形态不同)。价格取自官网主推区,与其在聚合平台上的报价一致。当前两档订阅均显示售罄,按量计费的常规开通条件尚未确认,接入前请先确认可用性;缓存命中按输入价的 20% 计。 定价页https://www.makora.com/ | |||||||||||||||||||||||||
| W Wafer 自营推理 美元刊例 · 折算展示 | 0.67 | 0.34 | 1.68 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.10 · 缓存读 $0.05 · 输出 $0.25(每 1M token),取自官方接口。人民币价 = 美元价 × 6.73(2026-09-10 汇率)折算,汇率波动时人民币价随之变化。 部署说明serverless 自有集群 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731-Fast(1M 上下文,serverless 高 TPS 变体) 版本说明2026-09-10 据官方接口:模型 id = DeepSeek-V4-Flash-0731-Fast,官方描述「The same model served for high TPS」,tier = serverless_only,context_length 1048576,pricing 字段直给 input_cents_per_million=10 / cache_read_cents_per_million=5 / output_cents_per_million=25(即 $0.10 / $0.05 / $0.25,每 1M token)。价格为官方计费口径。注:官方 serverless 目录仅此一条 DeepSeek(高 TPS 变体),未列非 Fast 的 0731 常规版。 接入
接口地址https://pass.wafer.ai/v1/chat/completions 口径与备注核实时间2026-09-17 20:04 备注官方 serverless 目录共 6 个模型(GLM-5.3、Kimi-K3、Kimi-K2.6、Qwen3.5-397B-A17B、DeepSeek-V4-Flash-0731-Fast、GLM-5.3-Flash),DeepSeek 仅 0731-Fast 一条,支持 zero data retention(ZDR)。 风险说明新锐小平台,域名 wafer.ai 注册于 2022-07-12(RDAP 核实,资历过关);官方描述为「self-hosted on the Wafer fleet」,自有集群自营推理。价格 $0.10/$0.05/$0.25 属全表偏低一档(与 NVIDIA 0731 旧价同档),但平台规模与稳定性不及大厂,建议小额试用。 定价页https://pass.wafer.ai/v1/models | |||||||||||||||||||||||||
| B Baseten 自部署 美元刊例 · 折算展示 | 0.87 | 0.19 | 1.75 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.13 · 缓存 $0.028 · 输出 $0.26(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 部署说明美国推理 PaaS 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(FP8) 版本说明2026-09-10 官网核实:Baseten 官方模型库列有 DeepSeek-V4-Flash-0731(284B-A13B MoE、1M 上下文、MIT),官方页面直给 Model API pricing:输入 $0.13 / 缓存输入 $0.028 / 输出 $0.26(每 1M tokens),调用端点 https://inference.baseten.co/v1 ,model id 为 deepseek-ai/DeepSeek-V4-Flash-0731。与 OpenRouter 端点价一致。 接入
美国专业推理 PaaS,高并发低延迟。 口径与备注核实时间2026-09-16 20:29 风险说明官网模型库可核实(baseten.co/library/deepseek-v4-flash-0731);Baseten 主打「一键部署开源模型 + 按量计费」,0731 为其官方维护的一键部署模型之一。注意官方 9/10 起旧模型名 deepseek-v4-flash 已路由到 V4.1-Flash,本条挂的是 0731 模型卡,实际版本以接口响应为准。 定价页https://www.baseten.co/library/deepseek-v4-flash-0731/ | |||||||||||||||||||||||||
| R RunInfra 自营推理 美元刊例 · 折算展示 人工核录 | 0.87 | 0.07 | 1.82 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例(0731):输入 $0.13 · 缓存读 $0.01 · 输出 $0.27(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算。 人工核录价目锁在登录后/仅控制台可见,需人工定期核对(建议每周),非实时刷新。 部署说明serverless 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(完整 1M 上下文) 版本说明已核实 0731:官方模型页直挂 deepseek-ai/DeepSeek-V4-Flash-0731,上下文 1,048,576(完整 1M);页面自带平台实测性能(输出 260.4 tok/s、首 token 834ms)。注:官方接口的 id 为无后缀 'deepseek-v4-flash'(别名),2026-09-10 起官方旧名已路由 V4.1-Flash,本家是否跟随需实调确认。 接入
注(2026-09-10):DeepSeek 两个模型当前均处于暂停状态,V4.1-Flash 尚未接入。 OpenAI 兼容端点 api.runinfra.ai/v1/chat/completions 口径与备注核实时间2026-09-10 16:50 条目备注开业时间:域名 2026-03-02 注册(约 6 个月) 风险说明成长期推理商(by RightNow),域名仅约 6 个月。2026-09-10 实测:DeepSeek-V4-Flash 与 V4 Pro 两个模型均处于暂停状态(页面标预计 2026-09-10T08:35Z 恢复),V4.1-Flash 尚未接入。价格照常挂牌,但开通前务必看官网实时可用性标记;恢复时间不定。 定价页https://runinfra.ai/inference/deepseek-v4-flash | |||||||||||||||||||||||||
| P Parasail 自营推理 美元刊例 · 折算展示 | 0.94 | 0.4711 | 1.88 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例(0731):输入 $0.14 · 缓存读 $0.07 · 输出 $0.28(每 1M token)。人民币价 = 美元价 × 6.73(汇率 1 USD = 6.73 元)折算。 部署说明serverless + 专机 版本说明✓ 已核实型号parasail-deepseek-v4-flash-0731(0731 单列) 版本说明已核实 0731:官方计费文档将 DeepSeek V4 Flash 与 DeepSeek V4 Flash (0731) 分列两行,同价 $0.14/$0.28、缓存读 $0.05;另有 V4 Pro 0813 单列。serverless 按 token、Dedicated 按 GPU 时、Batch 折扣三档计费。 2026-09-16 全量核对复抓:官方 billing 价目表「Cached input」列 DeepSeek V4 Flash 由 $0.05 调为 $0.07(+40%);输入 $0.14 / 输出 $0.28 不变。 接入
价格与 OpenRouter 池内挂价一致(OR 加价为 0)。 口径与备注核实时间2026-09-16 21:00 条目备注开业时间:域名 2022-10-05 注册(近 4 年) 风险说明官方价目页由 live API 同步,可信度高;缓存读 $0.05 比多数家略贵。无 ICP/大厂背书,属成长期推理商。 定价页https://docs.parasail.io/parasail-docs/billing/services-billing | |||||||||||||||||||||||||
| B BitDeer 自营推理 美元刊例 · 折算展示 版本存疑 | 0.94 | 0.07 | 1.88 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.14 · 缓存读 $0.01 · 输出 $0.28(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 部署说明NVIDIA Cloud Partner,美股上市公司 版本存疑 型号DeepSeek-V4-Flash(官方别名,未标注日期版本) 版本说明价格已核实(2026-09-10 据官方定价接口):deepseek-ai/DeepSeek-V4-Flash 输入 $0.14 / 缓存读 $0.01 / 输出 $0.28,无进行中促销(8/25-9/8 免费体验活动已结束),属正常挂牌价。模型名未单独标注 0731,按官方别名惯例当前应路由 0731,实调前建议以接口返回的 model 字段确认。 接入
口径与备注核实时间2026-09-17 20:04 条目备注开业时间:母公司 2023-01 纳斯达克上市(BTDR);AI 推理服务上线较新 风险说明Bitdeer Technologies Group(纳斯达克上市 BTDR,比特大陆系,NVIDIA 官方云合作伙伴),资信可靠;缓存读 $0.01 为海外在售最低梯队(与 RunInfra 持平)。官方未标注模型版本号。 厂家身份Bitdeer Technologies Group(纳斯达克上市 BTDR,比特大陆系,NVIDIA 官方云合作伙伴) 定价页https://www.bitdeer.ai/en/pricing/ai-models | |||||||||||||||||||||||||
| F Featherless 聚合网关 美元刊例 · 折算展示 | 0.94 | — | 1.88 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.14 · 输出 $0.28(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(262K 上下文) 版本说明已核实(2026-09-11 Featherless 官方模型接口原文):条目 id deepseek-ai/DeepSeek-V4-Flash-0731,上下文 262,144,输入 $0.14 / 输出 $0.28(每 1M token)。同平台另有不带日期后缀的 DeepSeek-V4-Flash,同价同规格。 接入
按并发额度订阅 + token 计费,页面未公示缓存命中价。 口径与备注核实时间2026-09-16 19:12 风险说明计价模式特殊:平台以「并发额度」订阅制为主(接口 concurrency_cost 字段即为该模型占用的并发位),token 价另计;实际成本取决于所选套餐档位,与官方 token 刊例不完全可比。上下文 262K 低于官方 1M,长文档场景需留意。 定价页https://featherless.ai/models/deepseek-ai/DeepSeek-V4-Flash-0731 | |||||||||||||||||||||||||
| N NanoGPT 聚合网关 美元刊例 · 折算展示 | 0.94 | 0.02 | 1.88 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.14 · 缓存读取 $0.0028 · 输出 $0.28(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号deepseek/deepseek-v4-flash(1M 上下文 / 最大输出 384K,当前版) 版本说明已核实(2026-09-11 NanoGPT 官方模型目录接口原文):条目 id deepseek/deepseek-v4-flash,上下文 1,048,576、单次最长输出 384,000,支持思考模式与工具调用;输入 $0.14 / 缓存读取 $0.0028 / 输出 $0.28(每 1M token)。字段值与条目内价格说明一致。 接入
按量计费;另有套餐档位。 口径与备注核实时间2026-09-16 20:24 风险说明聚合网关;该平台对同一模型的多个版本(如带 0731 日期后缀的条目)价格标注不一致,本条取字段与文案互相印证的一条,实际以控制台为准。另有「零数据留存(ZDR)」档位与套餐档位,价格可能不同。 定价页https://nano-gpt.com/models | |||||||||||||||||||||||||
| U Umans 自营推理 美元刊例 · 折算展示 | 0.9422 | 0.9422 | 1.8844 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号umans-deepseek-v4-flash-0731 版本说明模型 ID 为 umans-deepseek-v4-flash-0731,即 DeepSeek V4-Flash 0731 官方版;据该平台官方定价页与官方接口(https://api.code.umans.ai/v1/models),两者一致。该渠道未公布缓存价,此处按无缓存折扣计(缓存档等于输入价)。 接入
接口地址https://api.code.umans.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明其 V4-Flash-0731 报价与 NeuralWatt、AMD Radeon 两家完全一致,疑同一上游,对比时留意。 定价页https://umans.ai | |||||||||||||||||||||||||
| A AiHubMix 聚合中转 美元刊例 · 折算展示 | 0.96 | 0.19 | 1.91 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元挂牌价:输入 $0.142 · 缓存读 $0.0284 · 输出 $0.284(每 1M token,实际按路由结算)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算。 部署说明美元计价 版本说明✓ 已核实型号deepseek-v4-flash-0731(0731 专页在售) 版本说明已核实 0731:模型页单列 deepseek-v4-flash-0731,聚合 8 家上游(百度 / DeepInfra / DeepSeek 官方 / Azure / 阿里云 / 字节跳动 / Wafer),按延迟与成功率自动路由,故障自动切换。池内最低 DeepInfra $0.198/$0.0396;DeepSeek 官方通道分时 off-peak $0.2324 / peak $0.4648。 接入
聚合中转站,支持中文界面,国内可直连。 口径与备注核实时间2026-09-10 09:20 条目备注开业时间:Wayback 最早快照 2023-12-16(运营约 2 年 9 个月);GitHub org 2025-03 创建(20 个仓库) 风险说明挂牌价 $0.142/$0.284 低于池内最低上游(DeepInfra $0.198),疑似限时补贴价——以实际结算为准,涨回原价属正常。缓存读挂牌 $0.0284。 定价页https://aihubmix.com/model/deepseek-v4-flash-0731 | |||||||||||||||||||||||||
| V Venice AI 隐私推理 美元刊例 · 折算展示 | 1.14 | 0.27 | 2.36 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例(0731 常规档):输入 $0.17 · 缓存读 $0.04 · 输出 $0.35(每 1M token;fast 档 $0.35 / 0.09 / 0.70)。人民币价 = 美元价 × 6.73(2026-09-15 汇率)折算。 部署说明不留存数据 版本说明✓ 已核实型号deepseek-v4-flash-0731(另有 -fast 变体) 版本说明已核实(2026-09-15 复核 Venice 官方定价页原文):常规档 deepseek-v4-flash-0731 输入 $0.17 · 缓存读 $0.04 · 输出 $0.35(每 1M token);另有 -fast 变体 ($0.35 / $0.70 / 缓存 $0.09,低延迟)。主打端到端隐私:推理不留存用户数据。 接入
匿名注册可用。 口径与备注核实时间2026-09-17 19:59 条目备注开业时间:域名 2019-04 注册(2024-05 产品上线),GitHub org 2023-05 风险说明隐私卖点成立但属去中心化/隐私阵营,吞吐与 SLA 弱于大厂;fast 档价格翻倍按需选。 定价页https://venice.ai/api | |||||||||||||||||||||||||
| N Near AI 自营推理 美元刊例 · 折算展示 版本存疑 | 1.14 | 0.24 | 2.36 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.17 · 缓存读 $0.035 · 输出 $0.35(每 1M token),取自官方 cloud-api.near.ai/v1/model/list。人民币价 = 美元价 × 6.73(2026-09-10 汇率)折算,汇率波动时人民币价随之变化。 部署说明TDX 机密计算 CVM 版本存疑 型号DeepSeek-V4-Flash(FP8,1M 上下文;非 0731 后缀) 版本说明2026-09-10 据官方接口(52 个模型):modelId = deepseek-ai/DeepSeek-V4-Flash,inputCostPerToken 170e-9 / cacheReadCostPerToken 35e-9 / outputCostPerToken 350e-9(即 $0.17 / $0.035 / $0.35,每 1M token),currency USD;metadata 标 contextLength 1048576、FP8 量化、H200 TP=4 + EAGLE 投机解码、TDX-confidential inference CVM、verifiable=true(可远程 attest)。near.ai 官网首页同步公示「DeepSeek V4 Flash · 1048K · $0.17 / $0.35」,与接口一致。注意:HF 权重 id 为 deepseek-ai/DeepSeek-V4-Flash(初版),未标 0731,故版本状态记 unsure;官方 9/10 起旧模型名路由 V4.1-Flash 的规则不适用于此——Near AI 自持权重部署,不受上游 API 路由切换影响。 接入
注意旧端点 api.near.ai 已于 2025-10-31 退役,新版 private.near.ai 需 Bearer token。 cloud-api.near.ai,OpenAI 兼容)按 token 结算 口径与备注核实时间2026-09-17 20:04 条目备注开业时间:域名 near.ai 注册于 2017-12-16(RDAP);主体核查:GitHub org `nearai`(NEAR AI)创建于 2017-06-02、75 个公开仓库、296 followers —— 是 NEAR 协议(NEAR Protocol)官方 AI 部门,非作坊。 备注NEAR 协议(near.ai 域名注册于 2017-12-16,RDAP 核实)旗下的机密推理云平台,模型跑在 TDX 可信执行环境,支持远程证明(attestation)——提示词对平台侧亦不可见。 风险说明版本为 V4 Flash 初版(非 0731),与 0731 版口径不完全可比。价格 $0.17/$0.035/$0.35 在机密计算类渠道里偏低(Phala 同模型 $0.44/$0.028/$1.32),但比普通明文推理渠道贵一截——多付的钱买的是 TEE 隐私(TDX 机密 CVM、可远程 attest),不是性能。主体为 NEAR 协议官方(GitHub 2017 年、75 仓库),价格竞争力一般;页面较简陋属产品设计取舍,不代表主体不正规。 定价页https://cloud-api.near.ai/v1/model/list | |||||||||||||||||||||||||
| B BazaarLink 聚合网关 美元刊例 · 折算展示 | 1.35 | 0.2 | 2.69 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.20 · 缓存 $0.03 · 输出 $0.40(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算;台币计费另按其汇率。 部署说明中国台湾,台币计费 版本说明✓ 已核实型号deepseek-v4-flash-0731(目录单列 0731 条目) 版本说明已核实 0731:模型目录将 Deepseek V4 Flash 与 Deepseek V4 Flash 0731 分列两条,同价 $0.20/$0.40、缓存 $0.03(1M 上下文)。面向 AI Agent 的 LLM Gateway,支持 Claude Code/Cursor 等。 接入
接口地址https://api.bazaarlink.ai/v1(OpenAI 台灣時區中文支援。 口径与备注核实时间2026-09-16 20:31 条目备注开业时间:域名 2026-03-04 注册、GitHub 2026-03-07、Wayback 最早快照 2026-06-16——约 6 个月整 风险说明2026-09-06 公告:已停用 AI agent 自助注册端点(反滥用),agent 接入需一般注册。资历刚好踩 6 个月门槛线(域名 2026-03-04),企业合规做得足但年轻。刊例美元、结算台币。 定价页https://bazaarlink.ai/models | |||||||||||||||||||||||||
| M Morph(morphllm.com) 自营推理 美元刊例 · 折算展示 | 0.9422 | 0.2692 | 2.692 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例(官网 morphllm.com/pricing):输入 $0.14 · 缓存读 $0.04 · 输出 $0.40(每 1M token)。人民币价 = 美元价 × 6.73(汇率 1 USD = 6.73 元)折算。 部署说明自定义 kernel,bf16 量化 版本说明✓ 已核实型号DeepSeek V4 Flash 0731(morph-dsv4flash,1M 上下文) 版本说明2026-09-10 官网核实(morphllm.com/pricing):Open Source Models 区明确列出 DeepSeek V4 Flash 0731(model id: morph-dsv4flash),输入 $0.12 / 缓存读 $0.03 / 输出 $0.35(每 1M),1M 上下文,Morph 确为对外直售,价格以官网为准。另有 Dedicated Endpoints 按 GPU 时计费(B200 从 $8.64/GPU-hr 起,官方称高负载下比 DeepSeek 官方 API 便宜 3.2~3.4 倍)。 2026-09-16 全量核对复抓:官网 Open Source Models 区 morph-dsv4flash 现列 输入 $0.14 / 缓存读 $0.04 / 输出 $0.40(旧 $0.12 / $0.03 / $0.35,三项齐涨:输入 +16.7%、缓存 +33%、输出 +14.3%)。价格以官网当期刊例为准。 接入
口径与备注核实时间2026-09-16 21:00 条目备注开业时间待核实。主体 morphllm.com,主营代码专用模型(Fast Apply / WarpGrep),与 Relace 同类。 风险说明morphllm.com 主营 Fast Apply / WarpGrep 等编码专用模型,同时公开售卖 DeepSeek/GLM/Kimi 等开源模型。官方 9/10 起旧模型名已路由 V4.1-Flash,本条为 0731 权重。 定价页https://www.morphllm.com/pricing | |||||||||||||||||||||||||
| T Tinfoil 隐私推理 美元刊例 · 折算展示 | 2.019 | 0.4038 | 4.711 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号deepseek-v4-flash 版本说明模型 ID 为 deepseek-v4-flash,即 DeepSeek V4-Flash 0731 官方版;据该平台官方定价页与官方接口(https://api.tinfoil.sh/v1/models),两者一致。 接入
接口地址https://api.tinfoil.sh/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-15 20:02 风险说明机密计算(TEE)隐私推理,模型运行在可信执行环境内。 定价页https://tinfoil.sh | |||||||||||||||||||||||||
| O OrcaRouter(零加价网关) 聚合网关 美元刊例 · 折算展示 | 峰3.26 / 谷1.63 | 峰0.1 / 谷0.05 | 峰9.77 / 谷4.89 | 峰:北京时间 09:00–12:00、14:00–18:00(美元计价,按 1 USD ≈ 6.73 元折算) 谷:北京时间 00:00–09:00、12:00–14:00、18:00–24:00(美元计价,按 1 USD ≈ 6.73 元折算) | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:闲时 输入 $0.242 · 缓存读 $0.0077 · 输出 $0.726;峰时全档 ×2(每 1M token)。缓存读价 $0.0077 为全表海外最低档。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 部署说明零加价路由 版本说明✓ 已核实型号deepseek/deepseek-v4-flash-0731(1M 上下文 / 384K 输出) 版本说明已核实:官方模型页明确文档化 0731 修订版(284B 总参/13B 激活,后训练重做,thinking/非 thinking 双模式,Responses API 原生支持 Codex 式编码 agent)。该站流量榜 #1 即此模型(周流量 13.4B tokens、占 20%)。 接入
免费档 3 个 API Key;支持 BYOK 自带上游 Key。零 token 加价:按上游 provider 刊例原价计费,收入来自 Team($499/月)等功能费。 OpenAI/Anthropic 双协议兼容) 口径与备注核实时间2026-09-10 14:10 风险说明背景:Continuum AI(新加坡)研发、FlashLabs(东京)日本市场发行,2026 年中上线,10 周获 11 万开发者,MIT 开源 OrcaRouter-Lite 可自托管,宣称 SOC2/GDPR 合规。公司年轻、融资未披露——零加价模式下无动力压价,但长周期可靠性未经验证,建议按需使用,不建议一次性大额开通。
价格口径:峰时(UTC 01:00–04:00、06:00–10:00,即北京时间 09:00–12:00、14:00–18:00)全档 ×2;缓存按上游缓存费率计。页面 FAQ 文本仍显示旧价 $0.15/$0.29,以定价区块(官方称每 60 秒刷新)为准。官方页自报实测:p50 首 token 752ms、输出 126 tok/s、7 天错误率 0.61%。 定价页https://www.orcarouter.ai/models/deepseek-v4-flash-0731 | |||||||||||||||||||||||||
| G GMICloud 自营推理 美元刊例 · 折算展示 人工核录 | 1.92 | 0.06 | 5.77 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元现价(35% off 后):输入 $0.286 · 缓存读 $0.0091 · 输出 $0.858(每 1M token;原价 $0.44/$1.32)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算。 人工核录价目锁在登录后/仅控制台可见,需人工定期核对(建议每周),非实时刷新。 部署说明GPU 云大厂,serverless 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(FP8,完整 1M 上下文) 版本说明已核实 0731:Model Hub 官方接口 artifact_name 单列 'DeepSeek-V4-Flash-0731',上下文 1048575(完整 1M 未截断)、FP8 量化、开源权重直挂(models/deepseek-ai/...)。另有 -B300/-dev 两个 FP4 变体(同价)、无后缀 DeepSeek-V4-Flash(非 0731 版,$0.091/$0.182)同站在售。 接入
接口地址https://api.gmi-serving.com/v1/models(Authorization: 注册即可按量调用,非纯 GPU 租赁。 OpenAI 兼容端点 Bearer <GMI_API_KEY>,多组织需加 X-Organization-ID 头 口径与备注核实时间2026-09-10 17:00 条目备注开业时间:域名 2023-12 注册(NVIDIA 投资的 GPU 云,总部硅谷/台湾) 风险说明当前挂牌为 35% off 促销价(原价 $0.44/$1.32 与 Cloudflare/OR 代售同口径),促销结束涨回原价属正常。缓存读 $0.0091 极低(约为输入价 1/31),高命中场景实际成本更低。价格只在登录后的控制台展示;官方文档与公开定价页(www.gmicloud.ai/pricing)均无模型 token 价,公开页仅列 GPU 时租(H100 $2.00 / H200 $2.60 / B200 $4.00 / GB200 $8.00 每 GPU·小时)。 定价页https://console.gmicloud.ai/user-console/ie/model-hub | |||||||||||||||||||||||||
| S Scaleway 自营推理 欧元刊例 · 折算展示 | 3.14 | 0.63 | 6.28 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径欧元刊例:输入 €0.40 · 缓存读 €0.08 · 输出 €0.80(每 1M token)。本页人民币价 = 欧元价 × 7.8446(2026-09-10 中国外汇交易中心中间价)折算,汇率波动时人民币价随之变化。 部署说明欧洲老牌云厂,Generative APIs,Serverless 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(官方文档单列,Serverless 可用) 版本说明已核实 0731:官方支持模型文档单列 DeepSeek-V4-Flash-0731(Serverless: Yes,MIT 许可,2026-07 发布)。注意:原生 1M 上下文在预览阶段限制为 256K(官方脚注明示,为保证生成速度);Serverless 最大输出 32K;专用部署兼容 H100-SXM-4/H100-SXM-8。文档页不放价格,价格在 model-as-a-service 定价页。 接入
Batches API 全模型 -50%。 口径与备注核实时间2026-09-16 20:29 条目备注开业时间:Scaleway(前身 Online.net)1999 年起运营,法国 Iliad 集团系,欧洲老牌 IaaS 风险说明定价明显贵于市场最低档(输入约为 DeepInfra 的 5.6 倍、输出 4.4 倍),高单价换来的是欧盟数据合规(EU 托管)与发票合规场景;预览期上下文缩水到 256K 而非完整 1M,长上下文场景注意。欧元计价,人民币价随 EUR/CNY 汇率波动。 定价页https://www.scaleway.com/en/pricing/model-as-a-service/ | |||||||||||||||||||||||||
| V Vultr 自营推理 美元刊例 · 折算展示 | 2.02 | — | 6.73 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例(官方定价页口径):输入 $0.30 · 输出 $1.00(每 1M token,缓存读价未公示)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 部署说明大型 IaaS 厂商,Serverless Inference 版本说明✓ 已核实型号DeepSeek-V4-Flash-0731(NVIDIA 合作目录 Vultr 端点 model 参数直挂 0731) 版本说明版本核实:NVIDIA build.nvidia.com 合作商接口中 Vultr 端点 model 参数为 deepseek-v4-flash-0731(Vultr 自家控制台 add 页同参数),上下文 1M / 最大输出 384K。Vultr 官方定价页用别名 deepseek-ai/DeepSeek-V4-Flash 展示。经由 NVIDIA NIM 0731 模型卡的合作商路径发现(用户提示 NVIDIA 目录合作者体系后补抓)。 接入
接口地址https://api.vultrinference.com/v1(OpenAI 口径与备注核实时间2026-09-10 13:50 条目备注开业时间:母公司 The Constant Company 2014 年成立(美国新泽西),全球 32 个数据中心 风险说明价格差异警示:NVIDIA 目录页挂 Vultr serverless $0.10/$0.25(页面 22 天前更新),与 Vultr 官方定价页 $0.30/$1.00 相差约 3 倍——以 Vultr 官方页/控制台实价为准,NVIDIA 侧数据疑似过期未同步,实购前在控制台二次确认。缓存读价官方定价页未公示。定价为合作商里最贵一档(输入 $0.30 vs DeepInfra $0.06)。 定价页https://status.vultr.com/pricing | |||||||||||||||||||||||||
| N Novita AI 自部署 美元刊例 · 折算展示 | 2.96 | 0.19 | 8.88 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.44 · 缓存 $0.028 · 输出 $1.32(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号deepseek/deepseek-v4-flash-0731(fp8 量化,1M 上下文) 版本说明已核实:官方模型列表明确定价 deepseek-v4-flash-0731:输入 $0.44 · 缓存 $0.028 · 输出 $1.32。注意:同一家在 OpenRouter 的报价反而更低(输入 $0.409 / 输出 $1.228),走 OpenRouter 指定 Novita 通道更划算。 接入
接口地址https://api.novita.ai/v3/openai 口径与备注核实时间2026-09-09 13:37 风险说明新加坡托管商,规模小于 DeepInfra/Together 等一线平台;自跑开源权重,版本与能力表现以实测为准。直购价比经由 OpenRouter 更贵,建议先比价再决定是否采用。 定价页https://novita.ai/models | |||||||||||||||||||||||||
| A AtlasCloud 自营推理 美元刊例 · 折算展示 | 2.96 | — | 8.88 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.44 · 输出 $1.32(每 1M token,缓存价未公开)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算。 部署说明美国 SOC2 版本说明✓ 已核实型号deepseek-ai/deepseek-v4-flash-0731(官网 0731 专页) 版本说明已核实 0731:官网单列 deepseek-v4-flash-0731 专页(NEW 徽标),OpenAI 兼容统一 API。同页另列无后缀 deepseek-v4-flash。也是 OpenRouter 池内供应商(代售同为 $0.44 档)。 接入
主打图像/视频模型(Seedance/Wan 系),LLM 是新扩的线。SOC2/HIPAA 认证。 口径与备注核实时间2026-09-16 19:12 条目备注开业时间:域名 2024-04-18 注册(约 2 年 5 个月),GitHub org AtlasCloudAI 2019-03 创建 风险说明官网详情页价格条只列 Input/Output(起始 $0.44/1M),未展示缓存价;页面同时陈列更低通道($0.14/$0.28 档),具体供应商未标注——以控制台结算为准。 定价页https://www.atlascloud.ai/models/deepseek-ai/deepseek-v4-flash-0731 | |||||||||||||||||||||||||
| C Chutes 去中心化推理 美元刊例 · 折算展示 | 2.96 | — | 8.88 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.44 · 输出 $1.32(每 1M token,缓存价未公开)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算。 部署说明TEE 推理网络 版本说明✓ 已核实型号deepseek-ai/DeepSeek-V4-Flash-0731-TEE(0731 明确) 版本说明已核实 0731:官方定价页单列 DeepSeek-V4-Flash-0731-TEE($0.44/$1.32,1M 上下文),全部节点为机密计算(TEE)GPU,公开实时实例数。 接入
接口地址https://llm.chutes.ai/v1(OpenAI 按 token 计费无订阅无最低消费;亦可自部署私有 chute 按秒计 GPU 费。 口径与备注核实时间2026-09-16 20:31 条目备注开业时间:域名 2024-06-21 注册(约 2 年 3 个月) 风险说明Bittensor 子网生态的去中心化算力网络(无中心机房 SLA),供应商为网络内矿工节点;缓存价未公开。价格与 OpenRouter 最高档一致($0.44/$1.32),无中间加价。 定价页https://chutes.ai/pricing | |||||||||||||||||||||||||
| P Phala 自营推理 美元刊例 · 折算展示 | 2.96 | 0.19 | 8.88 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.44 · 缓存读 $0.028 · 输出 $1.32(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-10 汇率)折算,汇率波动时人民币价随之变化。 部署说明TEE 机密计算 版本说明✓ 已核实型号DeepSeek: DeepSeek V4 Flash 0731(1.0M 上下文,TEE 加密推理) 版本说明2026-09-10 官网模型目录 + 官方推理服务接口双重核实:① phala.com/models 的 Confidential AI Models 目录列 「DeepSeek: DeepSeek V4 Flash 0731 · 1.0M context · $0.44/M input · encrypted(TEE)」;② 官方推理服务接口(75 个模型)列 deepseek/deepseek-v4-flash-0731,TEE 机密推理,三项价 $0.44 / $0.028 / $1.32(每 1M token),与官网目录一致。三项价格均已按厂商官方口径核实。 接入
口径与备注核实时间2026-09-16 19:12 条目备注开业时间:Phala Network 2019 年成立(TEE 云计算赛道) 风险说明官网可核实为 TEE 机密计算推理服务商(提示词连平台都不可见),三项价格均由官方接口给出。输出 $1.32 为 DeepInfra 的 7.3 倍、输入 $0.44 亦为全表最高档,纯比价毫无优势——只为「提示词隐私」时才考虑它。phala.com 国内直连可能异常,建议自备海外网络环境。 厂家身份官网可核实为 TEE 机密计算推理服务 定价页https://phala.com/models | |||||||||||||||||||||||||
| R RedPill(聚合网关) 聚合网关 美元刊例 · 折算展示 | 2.9612 | 0.1884 | 8.8836 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号deepseek/deepseek-v4-flash-0731 版本说明模型 ID 为 deepseek/deepseek-v4-flash-0731,即 DeepSeek V4-Flash 0731 官方版;据该平台官方定价页与官方接口(https://api.redpill.ai/v1/models),两者一致。 接入
接口地址https://api.redpill.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明跨 TEE 隐私推理网络的聚合网关,上游含 Phala、Tinfoil、NEAR AI、Chutes 等。 定价页https://redpill.ai/pricing | |||||||||||||||||||||||||
| C Canopywave 自营推理 美元刊例 · 折算展示 | 2.9612 | 0.0942 | 8.8836 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号deepseek-v4-flash-0731 版本说明模型 ID 为 deepseek-v4-flash-0731,即 DeepSeek V4-Flash 0731 官方版;据该平台官方定价页与官方接口(https://api.canopywave.io/v1),两者一致。 接入
接口地址https://api.canopywave.io/v1 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 定价页https://canopywave.com/models | |||||||||||||||||||||||||
| F Foza ⚠ 低价参考 · 谨慎 | 0.0471 | — | 0.0942 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
接入
口径与备注核实时间2026-09-16 备注平台首页公开标价(P2P 市场,页面自述只做中介)。2026-09-16 复抓:$0.007 / $0.014 仍与库内一致。 风险说明P2P 市场形态:条款写明平台不开发、不托管、不运营所售模型,且明文『不核实供给方所声明的模型是什么』。首页标价对闭源旗舰档整体缩放为官方价的 1/20(输入输出恰好等比),不是单项录错。 定价页https://foza.ai/ | |||||||||||||||||||||||||
| C CheaperInference ⚠ 低价参考 · 谨慎 | 0.3365 | — | 0.6057 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
接入
口径与备注核实时间2026-09-16 备注平台标价(页面直接展示折后价与原价)。2026-09-16 复抓:该站是实时容量市场(页面自述 live catalog rates),折后比例随供需变动。较 09-13 记录三条全部变动:deepseek-v4-flash 折后 $0.04/$0.08(69% off)→ $0.07/$0.14(45% off);glm-5.3-flash 折后 $0.10/$0.35(30% off)→ $0.07/$0.24(52% off);deepseek-v4-flash-0731 折后 $0.03/$0.06(58% off)→ $0.05/$0.09(40% off)。折扣比例一天内可再变,仅供参考。 风险说明公开披露的主要上游为一家『闲置容量聚合市场』,但该供应方的名称被刻意隐去 —— 其公开文档自述另有规则禁止在面向客户的页面点名该供应方。属转售而非独立供给,货源无法核实。 定价页https://www.cheaperinference.com/ | |||||||||||||||||||||||||
| I InferHub ⚠ 低价参考 · 谨慎 | 0.2086 | — | 0.6266 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
接入
口径与备注核实时间2026-09-16 备注订单簿中间价档(各家卖方挂单按价升序,取中间偏高档;最低档受单卖家撤单影响大,不作代表价)。2026-09-16 全量复抓(口径 = 订单簿池内挂单中位档,非最低档):v4-flash 17 档取上中位 $0.031;glm-5.3-flash 22 档取上中位 $0.03;minimax-m3 22 档取上中位 $0.0423,较当日 20:17 记录的 $0.0399 再涨约 6%,已按新值下调。挂单池随卖方进出实时变动,同日不同时刻档位数在 17~28 之间浮动,故同一模型一天内可能反复微调;本次三个型号取同一时刻快照。 风险说明页面自述其做法是把各家 AI 订阅套餐中用不完的额度汇集起来对外提供接口,额度来源与上游供应方无法通过公开渠道核实。同一模型的『最低档』由各家卖方分别挂出、随供需浮动,卖方一撤单就回落到更贵的次档(次档通常贵 10%~200%)。 使用前请先看该档的『可供家数』:家数少的档随时会没有。 定价页https://inferhub.dev/pricing | |||||||||||||||||||||||||
| C CheaperInference ⚠ 低价参考 · 谨慎 | 0.4711 | — | 0.9422 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
接入
口径与备注核实时间2026-09-16 备注平台标价(页面直接展示折后价与原价)。2026-09-16 复抓:该站是实时容量市场(页面自述 live catalog rates),折后比例随供需变动。较 09-13 记录三条全部变动:deepseek-v4-flash 折后 $0.04/$0.08(69% off)→ $0.07/$0.14(45% off);glm-5.3-flash 折后 $0.10/$0.35(30% off)→ $0.07/$0.24(52% off);deepseek-v4-flash-0731 折后 $0.03/$0.06(58% off)→ $0.05/$0.09(40% off)。折扣比例一天内可再变,仅供参考。 风险说明公开披露的主要上游为一家『闲置容量聚合市场』,但该供应方的名称被刻意隐去 —— 其公开文档自述另有规则禁止在面向客户的页面点名该供应方。属转售而非独立供给,货源无法核实。 定价页https://www.cheaperinference.com/ | |||||||||||||||||||||||||
| V VyceAI ⚠ 低价参考 · 谨慎 版本存疑 | 0.6057 | — | 1.2114 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本存疑 版本说明接近正常零售加价,与官方价同档位;另有完全免费的降级档 接入
口径与备注核实时间2026-09-12 备注无公开价格页;由接口返回的实际扣费两次取点反推。2026-09-16 复核:该站无公开价目页(首页正文无可比数字),库内值来自接口实际扣费两次取点反推,无法用页面核价。 风险说明没有公开价格页,单价是用实际调用扣费反推出来的(两次不同长度调用解算、再与累计花费复核,能对上)。实测确认没有缓存价 —— 同一段 prompt 连发三次收一模一样的钱。免费额度按条款可随时收回。 定价页https://vyceai.com/ | |||||||||||||||||||||||||
| O Orbio ⚠ 低价参考 · 谨慎 版本存疑 | 0.9422 | — | 1.8844 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本存疑 版本说明同价,非独立低价 接入
口径与备注核实时间2026-09-11 备注平台标价(但与已收录的某聚合平台逐条一致)。2026-09-16 复核:该站页面只有折扣话术与省费计算器,无逐模型标价,无法与库内数字比对。 风险说明其公开模型目录与已收录的某聚合平台逐条一致(模型 ID、含批量档在内的变体命名与报价区间都相同),本页几个主推模型的报价也一一吻合。本身不带来新增价格信息,属同一批货源的另一层转售。 定价页https://www.orbio.so/ | |||||||||||||||||||||||||
| 没有符合条件的渠道,试试放宽筛选。 | |||||||||||||||||||||||||
| 渠道 | 套餐 | 费用 元 | 额度 | 元 / 百万 tokens | 官网 |
|---|---|---|---|---|---|
| 天 天翼云星辰 TokenHub | DeepSeekV4Flash Tokens 量包 1000 万 |
¥9.9 1 个月有效 | 1000 万 Tokens | 0.99 | 官网 ↗ |
套餐信息核实时间2026-09-10 13:10 周期1 个月有效 额度说明量包额度,自开通起 1 个月内用完 限制与口径持有限制每账号每模型同时持有 2 个使用中/未激活/开通中的量包 计费说明量包(非订阅,先开通后使用)。计费名 'DeepSeekV4Flash';模型广场单列 DeepSeek-V4-Flash-0731(官方 7/31 当天完成全链路适配)。输入/输出/缓存的具体扣减倍率官方未公示(未获取),等效价按 1 token 直接扣减摊算 缓存价未公开扣减口径未公示(未获取) 套餐页https://www.ctyun.cn/qzdh/143512_116 | |||||
| 天 天翼云星辰 TokenHub | DeepSeekV4Flash Tokens 量包 3200 万 |
¥29.9 1 个月有效 | 3200 万 Tokens | 0.93 | 官网 ↗ |
套餐信息核实时间2026-09-10 13:10 周期1 个月有效 额度说明量包额度,自开通起 1 个月内用完 限制与口径持有限制每账号每模型同时持有 2 个量包 计费说明同 1000 万档:量包,扣减倍率官方未公示(未获取) 缓存价未公开扣减口径未公示(未获取) 套餐页https://www.ctyun.cn/qzdh/143512_116 | |||||
| 天 天翼云星辰 TokenHub | DeepSeekV4Flash Tokens 量包 1 亿 |
¥89.9 1 个月有效 | 1 亿 Tokens | 0.9 | 官网 ↗ |
套餐信息核实时间2026-09-10 13:10 周期1 个月有效 额度说明量包额度,自开通起 1 个月内用完 限制与口径持有限制每账号每模型同时持有 2 个量包 计费说明同 1000 万档:量包,扣减倍率官方未公示(未获取)。新用户可领 50 万免费体验 Token(两周有效) 缓存价未公开扣减口径未公示(未获取) 套餐页https://www.ctyun.cn/qzdh/143512_116 | |||||
| 天 天翼云 · 编程 Token Plan | 编程 Token Plan 2500万 |
¥29 月 | 2500 万 Tokens | 1.16 | 官网 ↗ |
套餐信息核实时间2026-09-10 14:00 周期月 额度说明入门体验档,App Key 接入编程工具 限制与口径持有限制活动页『限时特惠』系列,订购后不退不换 计费说明818 大模型特惠专区:App Key 接入 OpenClaw、Claude Code 等主流编程工具;支持 GLM-5.1、GLM-5.0(正式版)、DeepSeek-V4-Flash-0731、DeepSeek-V3.2(旗舰版)。输入/输出/缓存扣减倍率未公示,等效价按 1 token=1 抵扣摊算 缓存价未公开扣减口径未公示:若缓存按 1:1 抵扣,编码场景综合成本约等于闲时按量;倍率待实测 套餐页https://www.ctyun.cn/act/AI/zhuanxiang | |||||
| 天 天翼云 · 编程 Token Plan | 编程 Token Plan 8000万 |
¥89 月 | 8000 万 Tokens | 1.11 | 官网 ↗ |
套餐信息核实时间2026-09-10 14:00 周期月 额度说明独立开发者日常开发、代码补全 限制与口径持有限制同 2500万档:活动系列,不退不换 计费说明同 2500万档:App Key 接入编程工具,四模型通用,扣减倍率未公示 缓存价未公开扣减口径未公示(同 2500万档) 套餐页https://www.ctyun.cn/act/AI/zhuanxiang | |||||
| 天 天翼云 · 编程 Token Plan | 编程 Token Plan 1.8亿 |
¥199 月 | 1.8 亿 Tokens | 1.11 | 官网 ↗ |
套餐信息核实时间2026-09-10 14:00 周期月 额度说明小型开发团队、复杂任务与项目重构 限制与口径持有限制同 2500万档:活动系列,不退不换 计费说明同 2500万档:App Key 接入编程工具,四模型通用,扣减倍率未公示 缓存价未公开扣减口径未公示(同 2500万档) 套餐页https://www.ctyun.cn/act/AI/zhuanxiang | |||||
| 天 天翼云 · 编程 Token Plan | 编程 Token Plan 3.8亿 |
¥399 月 | 3.8 亿 Tokens | 1.05 | 官网 ↗ |
套餐信息核实时间2026-09-10 14:00 周期月 额度说明资深开发者复杂项目持续迭代 限制与口径持有限制同 2500万档:活动系列,不退不换 计费说明同 2500万档:App Key 接入编程工具,四模型通用,扣减倍率未公示 缓存价未公开扣减口径未公示(同 2500万档) 套餐页https://www.ctyun.cn/act/AI/zhuanxiang | |||||
| 天 天翼云 · 编程 Token Plan | 编程 Token Plan 6.8亿 |
¥699 月 | 6.8 亿 Tokens | 1.03 | 官网 ↗ |
套餐信息核实时间2026-09-10 14:00 周期月 额度说明AI 工程师高频开发档 限制与口径持有限制同 2500万档:活动系列,不退不换 计费说明同 2500万档:App Key 接入编程工具,四模型通用,扣减倍率未公示 缓存价未公开扣减口径未公示(同 2500万档) 套餐页https://www.ctyun.cn/act/AI/zhuanxiang | |||||
| 火 火山方舟 | Agent Plan 个人版 · Small |
¥40 月 | 2 万 AFP | — | 官网 ↗ |
套餐信息核实时间2026-09-08 20:10 周期月 额度说明每月额度 折算口径抵扣系数输入 ×0.5 · 输出 ×0.5 系数来源https://www.volcengine.com/docs/82379/2516283 限制与口径持有限制每 5 小时 10,000 AFP 计费说明套餐额度只供官方适配的 Agent/编程工具使用(Claude Code、Cursor、TRAE、OpenCode、Cline、Hermes Agent 等白名单内);不能自己写脚本或在后端直接调 API 跑批、做产品 缓存价未公开缓存扣积分:该套餐缓存命中无优惠,缓存 token 按输入同系数扣积分(官方抵扣公式已确认,无缓存折扣项) 套餐页https://www.volcengine.com/docs/82379/2366394 | |||||
| 火 火山方舟 | Agent Plan 个人版 · Medium |
¥200 月 | 10 万 AFP | — | 官网 ↗ |
套餐信息核实时间2026-09-08 20:10 周期月 额度说明每月额度 折算口径抵扣系数输入 ×0.5 · 输出 ×0.5 系数来源https://www.volcengine.com/docs/82379/2516283 限制与口径持有限制每 5 小时 10,000 AFP 计费说明套餐额度只供官方适配的 Agent/编程工具使用(Claude Code、Cursor、TRAE、OpenCode、Cline、Hermes Agent 等白名单内);不能自己写脚本或在后端直接调 API 跑批、做产品 缓存价未公开缓存扣积分:该套餐缓存命中无优惠,缓存 token 按输入同系数扣积分(官方抵扣公式已确认,无缓存折扣项) 套餐页https://www.volcengine.com/docs/82379/2366394 | |||||
| 火 火山方舟 | Agent Plan 个人版 · Large |
¥500 月 | 25 万 AFP | — | 官网 ↗ |
套餐信息核实时间2026-09-08 20:10 周期月 额度说明每月额度 折算口径抵扣系数输入 ×0.5 · 输出 ×0.5 系数来源https://www.volcengine.com/docs/82379/2516283 限制与口径持有限制每 5 小时 25,000 AFP 计费说明套餐额度只供官方适配的 Agent/编程工具使用(Claude Code、Cursor、TRAE、OpenCode、Cline、Hermes Agent 等白名单内);不能自己写脚本或在后端直接调 API 跑批、做产品 缓存价未公开缓存扣积分:该套餐缓存命中无优惠,缓存 token 按输入同系数扣积分(官方抵扣公式已确认,无缓存折扣项) 套餐页https://www.volcengine.com/docs/82379/2366394 | |||||
| 火 火山方舟 | Agent Plan 个人版 · Max |
¥1000 月 | 50 万 AFP | — | 官网 ↗ |
套餐信息核实时间2026-09-08 20:10 周期月 额度说明每月额度 折算口径抵扣系数输入 ×0.5 · 输出 ×0.5 系数来源https://www.volcengine.com/docs/82379/2516283 限制与口径持有限制每 5 小时 50,000 AFP 计费说明套餐额度只供官方适配的 Agent/编程工具使用(Claude Code、Cursor、TRAE、OpenCode、Cline、Hermes Agent 等白名单内);不能自己写脚本或在后端直接调 API 跑批、做产品 缓存价未公开缓存扣积分:该套餐缓存命中无优惠,缓存 token 按输入同系数扣积分(官方抵扣公式已确认,无缓存折扣项) 套餐页https://www.volcengine.com/docs/82379/2366394 | |||||
| 超 超算互联网 SCNet | Token Plan 基础版 |
¥30 月 | 6 万 Credits | — | 官网 ↗ |
套餐信息核实时间2026-09-09 11:00 周期月 额度说明活动价(原价 50 元/月) 折算口径扣减口径综合扣减倍率 0.40(官方 2026-09-01 口径,按周调整) 倍率说明扣减率由官方估算案例反推:倍率 1.00 的 Kimi-K2.6,60,000 Credits 全部换算为缓存命中输入约 1.2 亿 token、非命中输入约 720 万、输出约 170 万(官方 Token Plan 文档「综合扣减倍率与用量估算」节);除以 DeepSeek-V4-Flash-0731 倍率 0.40 得出。倍率按周综合调整,数字会随官方调整变化。 限制与口径计费说明仅限交互式 AI 工具(Claude Code、OpenClaw、Cursor 等),禁止后端 API 调用跑批 备注按量计费单价官方未公开(需登录查看),暂不纳入价格对比。 缓存价未公开Credits 折算(平台页面标注):缓存命中输入约 0.012 元/百万、未命中输入约 0.6 元/百万、输出约 1.2 元/百万。社区实测另有约 1.54 元/百万的口径,以实际账单为准 套餐页https://www.scnet.cn/ui/console/index.html#/llm/token-plan | |||||
| 超 超算互联网 SCNet | Token Plan 标准版 |
¥110 月 | 24 万 Credits | — | 官网 ↗ |
套餐信息核实时间2026-09-09 11:00 周期月 额度说明活动价(原价 185 元/月) 折算口径扣减口径综合扣减倍率 0.40(官方 2026-09-01 口径,按周调整) 倍率说明扣减率由官方估算案例反推:倍率 1.00 的 Kimi-K2.6,60,000 Credits 全部换算为缓存命中输入约 1.2 亿 token、非命中输入约 720 万、输出约 170 万(官方 Token Plan 文档「综合扣减倍率与用量估算」节);除以 DeepSeek-V4-Flash-0731 倍率 0.40 得出。倍率按周综合调整,数字会随官方调整变化。 限制与口径计费说明仅限交互式 AI 工具(Claude Code、OpenClaw、Cursor 等),禁止后端 API 调用跑批 备注按量计费单价官方未公开(需登录查看),暂不纳入价格对比。 缓存价未公开Credits 折算(平台页面标注):缓存命中输入约 0.012 元/百万、未命中输入约 0.6 元/百万、输出约 1.2 元/百万。社区实测另有约 1.54 元/百万的口径,以实际账单为准 套餐页https://www.scnet.cn/ui/console/index.html#/llm/token-plan | |||||
| 超 超算互联网 SCNet | Token Plan 高级版 |
¥265 月 | 60 万 Credits | — | 官网 ↗ |
套餐信息核实时间2026-09-09 11:00 周期月 额度说明活动价(原价 440 元/月) 折算口径扣减口径综合扣减倍率 0.40(官方 2026-09-01 口径,按周调整) 倍率说明扣减率由官方估算案例反推:倍率 1.00 的 Kimi-K2.6,60,000 Credits 全部换算为缓存命中输入约 1.2 亿 token、非命中输入约 720 万、输出约 170 万(官方 Token Plan 文档「综合扣减倍率与用量估算」节);除以 DeepSeek-V4-Flash-0731 倍率 0.40 得出。倍率按周综合调整,数字会随官方调整变化。 限制与口径计费说明仅限交互式 AI 工具(Claude Code、OpenClaw、Cursor 等),禁止后端 API 调用跑批 备注按量计费单价官方未公开(需登录查看),暂不纳入价格对比。 缓存价未公开Credits 折算(平台页面标注):缓存命中输入约 0.012 元/百万、未命中输入约 0.6 元/百万、输出约 1.2 元/百万。社区实测另有约 1.54 元/百万的口径,以实际账单为准 套餐页https://www.scnet.cn/ui/console/index.html#/llm/token-plan | |||||
| 超 超算互联网 SCNet | Token Plan 旗舰版 |
¥764 月 | 180 万 Credits | — | 官网 ↗ |
套餐信息核实时间2026-09-09 11:00 周期月 额度说明活动价(原价 1274 元/月);含 OpenClaw 2核4G 实例免费使用 折算口径扣减口径综合扣减倍率 0.40(官方 2026-09-01 口径,按周调整) 倍率说明扣减率由官方估算案例反推:倍率 1.00 的 Kimi-K2.6,60,000 Credits 全部换算为缓存命中输入约 1.2 亿 token、非命中输入约 720 万、输出约 170 万(官方 Token Plan 文档「综合扣减倍率与用量估算」节);除以 DeepSeek-V4-Flash-0731 倍率 0.40 得出。倍率按周综合调整,数字会随官方调整变化。 限制与口径计费说明仅限交互式 AI 工具(Claude Code、OpenClaw、Cursor 等),禁止后端 API 调用跑批 备注按量计费单价官方未公开(需登录查看),暂不纳入价格对比。 缓存价未公开Credits 折算(平台页面标注):缓存命中输入约 0.012 元/百万、未命中输入约 0.6 元/百万、输出约 1.2 元/百万。社区实测另有约 1.54 元/百万的口径,以实际账单为准 套餐页https://www.scnet.cn/ui/console/index.html#/llm/token-plan | |||||
| 联 联通云 AISP | Token Plan 25,000 Credits |
¥250 团队版 | 2.5 万 Credits | 0.7 | 官网 ↗ |
套餐信息核实时间2026-09-09 15:40 周期团队版 额度说明官方示例:约 357 百万 tokens 折算口径扣减口径官方综合单价 0.70 元/百万token 倍率说明1 credit ≈ 0.01 元(由官方示例反推:25,000 credits ≈ 357 百万 × 0.70 元 ≈ ¥250)。Credits 消耗由模型倍率、输入/输出/缓存、思考模式与工具调用动态决定,0.70 是官方给的综合折算口径。 限制与口径计费说明Token Plan 团队版(贵阳基地二区);版本只写 DeepSeek-V4-Flash,未标 0731 代次 备注API 按量计费已按控制台计费接口刊例接入(见按量渠道「联通云 AISP」,¥1/¥0.2/¥2)。 缓存价未公开综合单价口径:官方直给 0.70 元/百万tokens,不拆分输入/输出/缓存,按实际用量动态扣 Credits 套餐页https://support.cucloud.cn/document/127/591/2357.html?id=2357&arcid=6518&lang=zh | |||||
| 联 联通云 AISP | Token Plan 100,000 Credits |
¥1000 团队版 | 10 万 Credits | 0.7 | 官网 ↗ |
套餐信息核实时间2026-09-09 15:40 周期团队版 额度说明官方示例:约 1,429 百万 tokens 折算口径扣减口径官方综合单价 0.70 元/百万token 倍率说明1 credit ≈ 0.01 元(由官方示例反推:100,000 credits ≈ 1,429 百万 × 0.70 元 ≈ ¥1000)。 限制与口径计费说明Token Plan 团队版(贵阳基地二区);版本只写 DeepSeek-V4-Flash,未标 0731 代次 备注API 按量计费已按控制台计费接口刊例接入(见按量渠道「联通云 AISP」,¥1/¥0.2/¥2)。 缓存价未公开综合单价口径:官方直给 0.70 元/百万tokens,不拆分输入/输出/缓存,按实际用量动态扣 Credits 套餐页https://support.cucloud.cn/document/127/591/2357.html?id=2357&arcid=6518&lang=zh | |||||
| 联 联通云 AISP | Token Plan 250,000 Credits |
¥2500 团队版 | 25 万 Credits | 0.7 | 官网 ↗ |
套餐信息核实时间2026-09-09 15:40 周期团队版 额度说明官方示例:约 3,570 百万 tokens 折算口径扣减口径官方综合单价 0.70 元/百万token 倍率说明1 credit ≈ 0.01 元(由官方示例反推:250,000 credits ≈ 3,570 百万 × 0.70 元 ≈ ¥2500)。 限制与口径计费说明Token Plan 团队版(贵阳基地二区);版本只写 DeepSeek-V4-Flash,未标 0731 代次 备注API 按量计费已按控制台计费接口刊例接入(见按量渠道「联通云 AISP」,¥1/¥0.2/¥2)。 缓存价未公开综合单价口径:官方直给 0.70 元/百万tokens,不拆分输入/输出/缓存,按实际用量动态扣 Credits 套餐页https://support.cucloud.cn/document/127/591/2357.html?id=2357&arcid=6518&lang=zh | |||||
| 优 优云智算 | Coding Plan Mini 迷你版 |
¥49 月 | 1,900 次/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 17:05 周期月 额度说明官方口径「约 N 次调用」,滚动 5 小时窗口刷新;次数×模型倍率扣减(如 kimi-k2.6 倍率 5×),与 token 数无关 → 无法折算等效元/百万tokens,不编数 限制与口径持有限制5 小时窗口约 200 次;每周约 650 次;最大并发 3 计费说明面向 AI 编程工具(Claude Code/Trae 等)的 Coding Plan;专属 Key 仅限套餐内模型(含 DeepSeek 等编程模型,各模型倍率见官方「适用模型」弹窗);额度耗尽直接停服(429),不支持超额计费;订阅不支持退款 备注套餐规则见官方计费逻辑文档;快速上手页与逻辑页的 5 小时次数口径不一(如迷你版 300 vs 200),按计费逻辑页录入 缓存价未公开按调用次数计费:套餐额度是次数不是 token,等效价无法计算 套餐页https://www.compshare.cn/docs/modelverse/package_plan/package | |||||
| 优 优云智算 | Coding Plan Lite 入门版 |
¥99 月 | 3,800 次/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 17:05 周期月 额度说明官方口径「约 N 次调用」,滚动 5 小时窗口刷新;次数×模型倍率扣减(如 kimi-k2.6 倍率 5×),与 token 数无关 → 无法折算等效元/百万tokens,不编数 限制与口径持有限制5 小时窗口约 400 次;每周约 1,300 次;最大并发 5 计费说明面向 AI 编程工具(Claude Code/Trae 等)的 Coding Plan;专属 Key 仅限套餐内模型(含 DeepSeek 等编程模型,各模型倍率见官方「适用模型」弹窗);额度耗尽直接停服(429),不支持超额计费;订阅不支持退款 备注套餐规则见官方计费逻辑文档;快速上手页与逻辑页的 5 小时次数口径不一(如迷你版 300 vs 200),按计费逻辑页录入 缓存价未公开按调用次数计费:套餐额度是次数不是 token,等效价无法计算 套餐页https://www.compshare.cn/docs/modelverse/package_plan/package | |||||
| 优 优云智算 | Coding Plan Basic 基础版 |
¥199 月 | 7,600 次/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 17:05 周期月 额度说明官方口径「约 N 次调用」,滚动 5 小时窗口刷新;次数×模型倍率扣减(如 kimi-k2.6 倍率 5×),与 token 数无关 → 无法折算等效元/百万tokens,不编数 限制与口径持有限制5 小时窗口约 800 次;每周约 2,600 次;最大并发 10 计费说明面向 AI 编程工具(Claude Code/Trae 等)的 Coding Plan;专属 Key 仅限套餐内模型(含 DeepSeek 等编程模型,各模型倍率见官方「适用模型」弹窗);额度耗尽直接停服(429),不支持超额计费;订阅不支持退款 备注套餐规则见官方计费逻辑文档;快速上手页与逻辑页的 5 小时次数口径不一(如迷你版 300 vs 200),按计费逻辑页录入 缓存价未公开按调用次数计费:套餐额度是次数不是 token,等效价无法计算 套餐页https://www.compshare.cn/docs/modelverse/package_plan/package | |||||
| 优 优云智算 | Coding Plan Pro 增强版 |
¥499 月 | 1.9 万 次/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 17:05 周期月 额度说明官方口径「约 N 次调用」,滚动 5 小时窗口刷新;次数×模型倍率扣减(如 kimi-k2.6 倍率 5×),与 token 数无关 → 无法折算等效元/百万tokens,不编数 限制与口径持有限制5 小时窗口约 2,000 次;每周约 6,500 次;最大并发 10 计费说明面向 AI 编程工具(Claude Code/Trae 等)的 Coding Plan;专属 Key 仅限套餐内模型(含 DeepSeek 等编程模型,各模型倍率见官方「适用模型」弹窗);额度耗尽直接停服(429),不支持超额计费;订阅不支持退款 备注套餐规则见官方计费逻辑文档;快速上手页与逻辑页的 5 小时次数口径不一(如迷你版 300 vs 200),按计费逻辑页录入 缓存价未公开按调用次数计费:套餐额度是次数不是 token,等效价无法计算 套餐页https://www.compshare.cn/docs/modelverse/package_plan/package | |||||
| 优 优云智算 | Coding Plan Max 高级版 |
¥799 月 | 3.1 万 次/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 17:05 周期月 额度说明官方口径「约 N 次调用」,滚动 5 小时窗口刷新;次数×模型倍率扣减(如 kimi-k2.6 倍率 5×),与 token 数无关 → 无法折算等效元/百万tokens,不编数 限制与口径持有限制5 小时窗口约 3,000 次;每周约 10,500 次;最大并发 10 计费说明面向 AI 编程工具(Claude Code/Trae 等)的 Coding Plan;专属 Key 仅限套餐内模型(含 DeepSeek 等编程模型,各模型倍率见官方「适用模型」弹窗);额度耗尽直接停服(429),不支持超额计费;订阅不支持退款 备注套餐规则见官方计费逻辑文档;快速上手页与逻辑页的 5 小时次数口径不一(如迷你版 300 vs 200),按计费逻辑页录入 缓存价未公开按调用次数计费:套餐额度是次数不是 token,等效价无法计算 套餐页https://www.compshare.cn/docs/modelverse/package_plan/package | |||||
| 优 优云智算 | Coding Plan Ultra 畅享版 |
¥999 月 | 3.9 万 次/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 17:05 周期月 额度说明官方口径「约 N 次调用」,滚动 5 小时窗口刷新;次数×模型倍率扣减(如 kimi-k2.6 倍率 5×),与 token 数无关 → 无法折算等效元/百万tokens,不编数 限制与口径持有限制5 小时窗口约 4,000 次;每周约 13,500 次;最大并发 10 计费说明面向 AI 编程工具(Claude Code/Trae 等)的 Coding Plan;专属 Key 仅限套餐内模型(含 DeepSeek 等编程模型,各模型倍率见官方「适用模型」弹窗);额度耗尽直接停服(429),不支持超额计费;订阅不支持退款 备注套餐规则见官方计费逻辑文档;快速上手页与逻辑页的 5 小时次数口径不一(如迷你版 300 vs 200),按计费逻辑页录入 缓存价未公开按调用次数计费:套餐额度是次数不是 token,等效价无法计算 套餐页https://www.compshare.cn/docs/modelverse/package_plan/package | |||||
| 百 百度千帆 Token Plan | Token Plan Mini(Token制) |
¥9.9 月 | 1,000 万 Tokens/月 | 0.99 | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明官方口径(Token制):按实际消耗 Token 数量抵扣,不区分输入/输出/缓存,也不区分模型——GLM 系与 DeepSeek 系均按 1 token 抵 1 token(这是产品卖点,按模型差异化计费的功能在积分制档位);例外:官方模型范围表标注 0813 旗舰版为 1.8x 抵扣系数,实际消耗 1 token 套餐抵扣 1.8 token 折算口径扣减口径统一 Token 抵扣(官方文档:多模型共享额度、消耗统一抵扣) 倍率说明等效价 = 月费 ÷ 月度 Token 额度;夜间 2 折权益期间实际等效价可再降至约 1/5 限制与口径持有限制首购每日 10 点限量五折秒杀(如入门档 4.9 元起);额度耗尽等下一周期恢复 计费说明仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配;每账号限购一份;夜间 21:00-次日 8:00 套餐内 1 Token 抵 5 Tokens(约等于额度打 2 折用) 备注套餐模型范围(官方 9/9 快照核对):DeepSeek-V4-Flash-0731(正式版)、旗舰 0813 版(1.8x 抵扣)、无后缀 Flash 与 Kimi-K2.6(均 9/29 下线)、GLM-5.3-Flash、GLM-5.2、GLM-5.1、V4-Pro 基础版;注意 GLM-5.3 旗舰不在套餐内,仅 Flash 版入选。夜间 21:00-次日8:00 指定模型 2 折 缓存价未公开积分制系数:官方公开口径为 Token 福利包系数表(积分/千tokens)——V4-Pro 12/1/24(输入/缓存/输出)、V4-Flash(旧) 1/0.2/2、Kimi-K2.6 6.5/1.1/27、GLM-5.1 6~8/1.3~2/24~28(分段);V4-Pro-0813 在套餐内加收 1.8x 抵扣系数。0731 的积分制精确系数官方未单列,不编数 套餐页https://cloud.baidu.com/doc/qianfan/s/Dmrabu8b6 | |||||
| 百 百度千帆 Token Plan | Token Plan Lite(Token制) |
¥40 月 | 4,200 万 Tokens/月 | 0.952 | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明官方口径(Token制):按实际消耗 Token 数量抵扣,不区分输入/输出/缓存,也不区分模型——GLM 系与 DeepSeek 系均按 1 token 抵 1 token(这是产品卖点,按模型差异化计费的功能在积分制档位);例外:官方模型范围表标注 0813 旗舰版为 1.8x 抵扣系数,实际消耗 1 token 套餐抵扣 1.8 token 折算口径扣减口径统一 Token 抵扣(官方文档:多模型共享额度、消耗统一抵扣) 倍率说明等效价 = 月费 ÷ 月度 Token 额度;夜间 2 折权益期间实际等效价可再降至约 1/5 限制与口径持有限制首购每日 10 点限量五折秒杀(如入门档 4.9 元起);额度耗尽等下一周期恢复 计费说明仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配;每账号限购一份;夜间 21:00-次日 8:00 套餐内 1 Token 抵 5 Tokens(约等于额度打 2 折用) 备注套餐模型范围(官方 9/9 快照核对):DeepSeek-V4-Flash-0731(正式版)、旗舰 0813 版(1.8x 抵扣)、无后缀 Flash 与 Kimi-K2.6(均 9/29 下线)、GLM-5.3-Flash、GLM-5.2、GLM-5.1、V4-Pro 基础版;注意 GLM-5.3 旗舰不在套餐内,仅 Flash 版入选。夜间 21:00-次日8:00 指定模型 2 折 缓存价未公开积分制系数:官方公开口径为 Token 福利包系数表(积分/千tokens)——V4-Pro 12/1/24(输入/缓存/输出)、V4-Flash(旧) 1/0.2/2、Kimi-K2.6 6.5/1.1/27、GLM-5.1 6~8/1.3~2/24~28(分段);V4-Pro-0813 在套餐内加收 1.8x 抵扣系数。0731 的积分制精确系数官方未单列,不编数 套餐页https://cloud.baidu.com/doc/qianfan/s/Dmrabu8b6 | |||||
| 百 百度千帆 Token Plan | Token Plan Pro(Token制) |
¥200 月 | 2.3 万 万 Tokens/月 | 0.87 | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明官方口径(Token制):按实际消耗 Token 数量抵扣,不区分输入/输出/缓存,也不区分模型——GLM 系与 DeepSeek 系均按 1 token 抵 1 token(这是产品卖点,按模型差异化计费的功能在积分制档位);例外:官方模型范围表标注 0813 旗舰版为 1.8x 抵扣系数,实际消耗 1 token 套餐抵扣 1.8 token 折算口径扣减口径统一 Token 抵扣(官方文档:多模型共享额度、消耗统一抵扣) 倍率说明等效价 = 月费 ÷ 月度 Token 额度;夜间 2 折权益期间实际等效价可再降至约 1/5 限制与口径持有限制首购每日 10 点限量五折秒杀(如入门档 4.9 元起);额度耗尽等下一周期恢复 计费说明仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配;每账号限购一份;夜间 21:00-次日 8:00 套餐内 1 Token 抵 5 Tokens(约等于额度打 2 折用) 备注套餐模型范围(官方 9/9 快照核对):DeepSeek-V4-Flash-0731(正式版)、旗舰 0813 版(1.8x 抵扣)、无后缀 Flash 与 Kimi-K2.6(均 9/29 下线)、GLM-5.3-Flash、GLM-5.2、GLM-5.1、V4-Pro 基础版;注意 GLM-5.3 旗舰不在套餐内,仅 Flash 版入选。夜间 21:00-次日8:00 指定模型 2 折 缓存价未公开积分制系数:官方公开口径为 Token 福利包系数表(积分/千tokens)——V4-Pro 12/1/24(输入/缓存/输出)、V4-Flash(旧) 1/0.2/2、Kimi-K2.6 6.5/1.1/27、GLM-5.1 6~8/1.3~2/24~28(分段);V4-Pro-0813 在套餐内加收 1.8x 抵扣系数。0731 的积分制精确系数官方未单列,不编数 套餐页https://cloud.baidu.com/doc/qianfan/s/Dmrabu8b6 | |||||
| 百 百度千帆 Token Plan | Token Plan Max(Token制) |
¥600 月 | 7 万 万 Tokens/月 | 0.857 | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明官方口径(Token制):按实际消耗 Token 数量抵扣,不区分输入/输出/缓存,也不区分模型——GLM 系与 DeepSeek 系均按 1 token 抵 1 token(这是产品卖点,按模型差异化计费的功能在积分制档位);例外:官方模型范围表标注 0813 旗舰版为 1.8x 抵扣系数,实际消耗 1 token 套餐抵扣 1.8 token 折算口径扣减口径统一 Token 抵扣(官方文档:多模型共享额度、消耗统一抵扣) 倍率说明等效价 = 月费 ÷ 月度 Token 额度;夜间 2 折权益期间实际等效价可再降至约 1/5 限制与口径持有限制首购每日 10 点限量五折秒杀(如入门档 4.9 元起);额度耗尽等下一周期恢复 计费说明仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配;每账号限购一份;夜间 21:00-次日 8:00 套餐内 1 Token 抵 5 Tokens(约等于额度打 2 折用) 备注套餐模型范围(官方 9/9 快照核对):DeepSeek-V4-Flash-0731(正式版)、旗舰 0813 版(1.8x 抵扣)、无后缀 Flash 与 Kimi-K2.6(均 9/29 下线)、GLM-5.3-Flash、GLM-5.2、GLM-5.1、V4-Pro 基础版;注意 GLM-5.3 旗舰不在套餐内,仅 Flash 版入选。夜间 21:00-次日8:00 指定模型 2 折 缓存价未公开积分制系数:官方公开口径为 Token 福利包系数表(积分/千tokens)——V4-Pro 12/1/24(输入/缓存/输出)、V4-Flash(旧) 1/0.2/2、Kimi-K2.6 6.5/1.1/27、GLM-5.1 6~8/1.3~2/24~28(分段);V4-Pro-0813 在套餐内加收 1.8x 抵扣系数。0731 的积分制精确系数官方未单列,不编数 套餐页https://cloud.baidu.com/doc/qianfan/s/Dmrabu8b6 | |||||
| 华 华为云 MaaS | MaaS Token Plan Lite |
¥59 月 | 5,000 万 Tokens/月 | 1.18 | 官网 ↗ |
套餐信息核实时间2026-09-09 17:30 周期月 额度说明官方直给 Token 额度(每订阅月) 折算口径扣减口径统一 Token 额度(官方文档直给) 倍率说明等效价 = 月费 ÷ 月度 Token 额度 限制与口径持有限制每日限量发售,售卖时段内可购 计费说明务必使用 Token Plan 专属 Base URL,否则额度不抵扣且可能产生按量费用;仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配 备注个人版四档,适合 AI 编程工具场景 缓存价未公开套餐内可用模型:DeepSeek-V4-Flash、GLM-5.1、Kimi-K2.6(GLM-5 与 DeepSeek-V3.2 已从套餐下线) 套餐页https://support.huaweicloud.com/price-maas/price-maas-0035.html | |||||
| 华 华为云 MaaS | MaaS Token Plan Standard |
¥149 月 | 1.3 万 万 Tokens/月 | 1.146 | 官网 ↗ |
套餐信息核实时间2026-09-09 17:30 周期月 额度说明官方直给 Token 额度(每订阅月) 折算口径扣减口径统一 Token 额度(官方文档直给) 倍率说明等效价 = 月费 ÷ 月度 Token 额度 限制与口径持有限制每日限量发售,售卖时段内可购 计费说明务必使用 Token Plan 专属 Base URL,否则额度不抵扣且可能产生按量费用;仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配 备注个人版四档,适合 AI 编程工具场景 缓存价未公开套餐内可用模型:DeepSeek-V4-Flash、GLM-5.1、Kimi-K2.6(GLM-5 与 DeepSeek-V3.2 已从套餐下线) 套餐页https://support.huaweicloud.com/price-maas/price-maas-0035.html | |||||
| 华 华为云 MaaS | MaaS Token Plan Pro |
¥399 月 | 3.8 万 万 Tokens/月 | 1.05 | 官网 ↗ |
套餐信息核实时间2026-09-09 17:30 周期月 额度说明官方直给 Token 额度(每订阅月) 折算口径扣减口径统一 Token 额度(官方文档直给) 倍率说明等效价 = 月费 ÷ 月度 Token 额度 限制与口径持有限制每日限量发售,售卖时段内可购 计费说明务必使用 Token Plan 专属 Base URL,否则额度不抵扣且可能产生按量费用;仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配 备注个人版四档,适合 AI 编程工具场景 缓存价未公开套餐内可用模型:DeepSeek-V4-Flash、GLM-5.1、Kimi-K2.6(GLM-5 与 DeepSeek-V3.2 已从套餐下线) 套餐页https://support.huaweicloud.com/price-maas/price-maas-0035.html | |||||
| 华 华为云 MaaS | MaaS Token Plan Max |
¥799 月 | 8.8 万 万 Tokens/月 | 0.908 | 官网 ↗ |
套餐信息核实时间2026-09-09 17:30 周期月 额度说明官方直给 Token 额度(每订阅月) 折算口径扣减口径统一 Token 额度(官方文档直给) 倍率说明等效价 = 月费 ÷ 月度 Token 额度 限制与口径持有限制每日限量发售,售卖时段内可购 计费说明务必使用 Token Plan 专属 Base URL,否则额度不抵扣且可能产生按量费用;仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配 备注个人版四档,适合 AI 编程工具场景 缓存价未公开套餐内可用模型:DeepSeek-V4-Flash、GLM-5.1、Kimi-K2.6(GLM-5 与 DeepSeek-V3.2 已从套餐下线) 套餐页https://support.huaweicloud.com/price-maas/price-maas-0035.html | |||||
| 腾 腾讯云 · 原厂直供 | TokenHub Token Plan Lite |
¥39 月 | 780 积分/月 | 1.114 | 官网 ↗ |
套餐信息核实时间2026-09-09 17:30 周期月 额度说明官方测算预估:按刊例价抵扣约可用 3500 万 tokens(综合口径,已嵌入历史缓存命中率,不代表实际) 折算口径扣减口径官方综合预估口径(积分 ÷ 预估 token 数) 倍率说明等效价 = 月费 ÷ 官方预估可用 token 数(官方文档「不同套餐档位可用 token 数预估」节) 限制与口径持有限制2026-08-31 17:00 起由 Token 额度制改为积分抵扣制;剩余额度月底清零不结转 计费说明仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配;DeepSeek-V4-Flash 正式版由 DeepSeek 直供,TokenHub 不提供 SLA 保障 备注另有 Hy Token Plan(混元专用,¥28~468/月)不覆盖 DeepSeek,未录入;积分抵扣规则见官方文档 缓存价未公开具体到 DeepSeek-V4-Flash 的单模型积分价官方积分表未公布(表内留空),仅有官方综合预估 套餐页https://cloud.tencent.com/document/product/1772/129449 | |||||
| 腾 腾讯云 · 原厂直供 | TokenHub Token Plan Standard |
¥99 月 | 1,980 积分/月 | 0.99 | 官网 ↗ |
套餐信息核实时间2026-09-09 17:30 周期月 额度说明官方测算预估:按刊例价抵扣约可用 10000 万 tokens(综合口径,已嵌入历史缓存命中率,不代表实际) 折算口径扣减口径官方综合预估口径(积分 ÷ 预估 token 数) 倍率说明等效价 = 月费 ÷ 官方预估可用 token 数(官方文档「不同套餐档位可用 token 数预估」节) 限制与口径持有限制2026-08-31 17:00 起由 Token 额度制改为积分抵扣制;剩余额度月底清零不结转 计费说明仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配;DeepSeek-V4-Flash 正式版由 DeepSeek 直供,TokenHub 不提供 SLA 保障 备注另有 Hy Token Plan(混元专用,¥28~468/月)不覆盖 DeepSeek,未录入;积分抵扣规则见官方文档 缓存价未公开具体到 DeepSeek-V4-Flash 的单模型积分价官方积分表未公布(表内留空),仅有官方综合预估 套餐页https://cloud.tencent.com/document/product/1772/129449 | |||||
| 腾 腾讯云 · 原厂直供 | TokenHub Token Plan Pro |
¥299 月 | 5,980 积分/月 | 0.934 | 官网 ↗ |
套餐信息核实时间2026-09-09 17:30 周期月 额度说明官方测算预估:按刊例价抵扣约可用 32000 万 tokens(综合口径,已嵌入历史缓存命中率,不代表实际) 折算口径扣减口径官方综合预估口径(积分 ÷ 预估 token 数) 倍率说明等效价 = 月费 ÷ 官方预估可用 token 数(官方文档「不同套餐档位可用 token 数预估」节) 限制与口径持有限制2026-08-31 17:00 起由 Token 额度制改为积分抵扣制;剩余额度月底清零不结转 计费说明仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配;DeepSeek-V4-Flash 正式版由 DeepSeek 直供,TokenHub 不提供 SLA 保障 备注另有 Hy Token Plan(混元专用,¥28~468/月)不覆盖 DeepSeek,未录入;积分抵扣规则见官方文档 缓存价未公开具体到 DeepSeek-V4-Flash 的单模型积分价官方积分表未公布(表内留空),仅有官方综合预估 套餐页https://cloud.tencent.com/document/product/1772/129449 | |||||
| 腾 腾讯云 · 原厂直供 | TokenHub Token Plan Max |
¥599 月 | 1.2 万 积分/月 | 0.922 | 官网 ↗ |
套餐信息核实时间2026-09-09 17:30 周期月 额度说明官方测算预估:按刊例价抵扣约可用 65000 万 tokens(综合口径,已嵌入历史缓存命中率,不代表实际) 折算口径扣减口径官方综合预估口径(积分 ÷ 预估 token 数) 倍率说明等效价 = 月费 ÷ 官方预估可用 token 数(官方文档「不同套餐档位可用 token 数预估」节) 限制与口径持有限制2026-08-31 17:00 起由 Token 额度制改为积分抵扣制;剩余额度月底清零不结转 计费说明仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配;DeepSeek-V4-Flash 正式版由 DeepSeek 直供,TokenHub 不提供 SLA 保障 备注另有 Hy Token Plan(混元专用,¥28~468/月)不覆盖 DeepSeek,未录入;积分抵扣规则见官方文档 缓存价未公开具体到 DeepSeek-V4-Flash 的单模型积分价官方积分表未公布(表内留空),仅有官方综合预估 套餐页https://cloud.tencent.com/document/product/1772/129449 | |||||
| 阿 阿里云 · 0731 快照版 | 百炼 Token Plan Lite(个人版) |
¥39 月 | 2,500 Credits/7天 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 17:30 周期月 额度说明Credits/7天,每 7 天刷新;另有 5 小时窗口 700 Credits 折算口径倍率说明Credits 折算系数对 DeepSeek-V4-Flash 未公开(官方仅示例 V4-Pro 旗舰档 0.5/1.0),等效价无法折算,不编数 限制与口径持有限制Agent 并发 1~2 个 计费说明Credits 按模型系数折算扣减;仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配 备注官方 2026-08-03 公告确认 DeepSeek-V4-Flash-0731 首发即支持按量计费与 Token Plan 两种计费(aliyun.com/product/news/30085);新客常有首月特惠,以官方页面为准 缓存价未公开覆盖 Qwen/DeepSeek/GLM/Kimi 等 150+ 直供模型,包季低至 4.5 折 套餐页https://www.aliyun.com/benefit/scene/tokenplan | |||||
| 阿 阿里云 · 0731 快照版 | 百炼 Token Plan Standard(个人版) |
¥139 月 | 1 万 Credits/7天 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 17:30 周期月 额度说明Credits/7天,每 7 天刷新;另有 5 小时窗口 3,000 Credits 折算口径倍率说明Credits 折算系数对 DeepSeek-V4-Flash 未公开(官方仅示例 V4-Pro 旗舰档 0.5/1.0),等效价无法折算,不编数 限制与口径持有限制Agent 并发 3~4 个 计费说明Credits 按模型系数折算扣减;仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配 备注官方 2026-08-03 公告确认 DeepSeek-V4-Flash-0731 首发即支持按量计费与 Token Plan 两种计费(aliyun.com/product/news/30085);新客常有首月特惠,以官方页面为准 缓存价未公开覆盖 Qwen/DeepSeek/GLM/Kimi 等 150+ 直供模型,包季低至 4.5 折 套餐页https://www.aliyun.com/benefit/scene/tokenplan | |||||
| 阿 阿里云 · 0731 快照版 | 百炼 Token Plan Pro(个人版) |
¥499 月 | 4 万 Credits/7天 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 17:30 周期月 额度说明Credits/7天,每 7 天刷新;另有 5 小时窗口 12,000 Credits 折算口径倍率说明Credits 折算系数对 DeepSeek-V4-Flash 未公开(官方仅示例 V4-Pro 旗舰档 0.5/1.0),等效价无法折算,不编数 限制与口径持有限制Agent 并发 6~8 个 计费说明Credits 按模型系数折算扣减;仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配 备注官方 2026-08-03 公告确认 DeepSeek-V4-Flash-0731 首发即支持按量计费与 Token Plan 两种计费(aliyun.com/product/news/30085);新客常有首月特惠,以官方页面为准 缓存价未公开覆盖 Qwen/DeepSeek/GLM/Kimi 等 150+ 直供模型,包季低至 4.5 折 套餐页https://www.aliyun.com/benefit/scene/tokenplan | |||||
| 阿 阿里云 · 0731 快照版 | 百炼 Token Plan 标准坐席(团队版) |
¥198 月 | 2.5 万 Credits/月/坐席 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 17:30 周期月 额度说明Credits/月/坐席,10 席起购 折算口径倍率说明Credits 折算系数对 DeepSeek-V4-Flash 未公开,等效价无法折算,不编数 限制与口径持有限制包季低至 4.5 折;年付 8 折 计费说明团队版面向企业协作(成员管理/权限管控/统一计费);仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配 备注新客活动价常有(如标准坐席首月 150 元),以官方页面为准 缓存价未公开每坐席一个专属 API Key,不可共享 套餐页https://www.aliyun.com/benefit/scene/tokenplan | |||||
| 阿 阿里云 · 0731 快照版 | 百炼 Token Plan 高级坐席(团队版) |
¥698 月 | 10 万 Credits/月/坐席 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 17:30 周期月 额度说明Credits/月/坐席 折算口径倍率说明Credits 折算系数对 DeepSeek-V4-Flash 未公开,等效价无法折算,不编数 限制与口径持有限制包季低至 4.5 折;年付 8 折 计费说明团队版面向企业协作(成员管理/权限管控/统一计费);仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配 备注新客活动价常有(如标准坐席首月 150 元),以官方页面为准 缓存价未公开每坐席一个专属 API Key,不可共享 套餐页https://www.aliyun.com/benefit/scene/tokenplan | |||||
| 阿 阿里云 · 0731 快照版 | 百炼 Token Plan 尊享坐席(团队版) |
¥1398 月 | 25 万 Credits/月/坐席 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 17:30 周期月 额度说明Credits/月/坐席 折算口径倍率说明Credits 折算系数对 DeepSeek-V4-Flash 未公开,等效价无法折算,不编数 限制与口径持有限制包季低至 4.5 折;年付 8 折 计费说明团队版面向企业协作(成员管理/权限管控/统一计费);仅限交互式 AI 编程工具(OpenClaw/Claude Code/Cursor 等)中使用,严禁后端 API 跑批;一经开通不退款不降配 备注新客活动价常有(如标准坐席首月 150 元),以官方页面为准 缓存价未公开每坐席一个专属 API Key,不可共享 套餐页https://www.aliyun.com/benefit/scene/tokenplan | |||||
| 百 百度千帆 Token Plan | Token Plan Mini(积分制) |
¥9.9 月 | 1,400 积分/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明积分制:按输入/输出/缓存 Token 分别设系数折算积分统一抵扣,系数随模型动态变化(如官方系数表中旗舰推理模型约 12/1/24 积分/千tokens,高效模型约 1/0.2/2);积分制每5小时和7天使用限制当前限时取消,恢复前官方提前告知 限制与口径持有限制首购每日 10 点限量五折秒杀(积分制同享);额度耗尽等下一周期恢复 计费说明仅限交互式 AI 编程工具中使用,严禁后端 API 跑批;一经开通不退款不降配;积分制仅支持从 Token制单向转入(不可转回) 备注套餐模型范围同 Token制档:含 DeepSeek-V4-Flash-0731(正式版)、旗舰 0813 版(1.8x)、GLM-5.3-Flash、GLM-5.2、GLM-5.1 等;GLM-5.3 旗舰不在套餐内。积分按模型×输入/输出/缓存系数扣减(与 Token制的核心区别就在这) 缓存价未公开换算锚点:官方 Token 福利包口径 1 积分≈0.001 元;因系数按模型与 Token 类型动态变化,积分制等效元/百万tokens 无法统一折算,不编数;个别旗舰模型在套餐内加收 1.8 倍抵扣系数(官方模型范围表标注) 套餐页https://cloud.baidu.com/doc/qianfan/s/Dmrabu8b6 | |||||
| 百 百度千帆 Token Plan | Token Plan Lite(积分制) |
¥40 月 | 6,600 积分/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明积分制:按输入/输出/缓存 Token 分别设系数折算积分统一抵扣,系数随模型动态变化(如官方系数表中旗舰推理模型约 12/1/24 积分/千tokens,高效模型约 1/0.2/2);积分制每5小时和7天使用限制当前限时取消,恢复前官方提前告知 限制与口径持有限制首购每日 10 点限量五折秒杀(积分制同享);额度耗尽等下一周期恢复 计费说明仅限交互式 AI 编程工具中使用,严禁后端 API 跑批;一经开通不退款不降配;积分制仅支持从 Token制单向转入(不可转回) 备注套餐模型范围同 Token制档:含 DeepSeek-V4-Flash-0731(正式版)、旗舰 0813 版(1.8x)、GLM-5.3-Flash、GLM-5.2、GLM-5.1 等;GLM-5.3 旗舰不在套餐内。积分按模型×输入/输出/缓存系数扣减(与 Token制的核心区别就在这) 缓存价未公开换算锚点:官方 Token 福利包口径 1 积分≈0.001 元;因系数按模型与 Token 类型动态变化,积分制等效元/百万tokens 无法统一折算,不编数;个别旗舰模型在套餐内加收 1.8 倍抵扣系数(官方模型范围表标注) 套餐页https://cloud.baidu.com/doc/qianfan/s/Dmrabu8b6 | |||||
| 百 百度千帆 Token Plan | Token Plan Pro(积分制) |
¥200 月 | 4.5 万 积分/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明积分制:按输入/输出/缓存 Token 分别设系数折算积分统一抵扣,系数随模型动态变化(如官方系数表中旗舰推理模型约 12/1/24 积分/千tokens,高效模型约 1/0.2/2);积分制每5小时和7天使用限制当前限时取消,恢复前官方提前告知 限制与口径持有限制首购每日 10 点限量五折秒杀(积分制同享);额度耗尽等下一周期恢复 计费说明仅限交互式 AI 编程工具中使用,严禁后端 API 跑批;一经开通不退款不降配;积分制仅支持从 Token制单向转入(不可转回) 备注套餐模型范围同 Token制档:含 DeepSeek-V4-Flash-0731(正式版)、旗舰 0813 版(1.8x)、GLM-5.3-Flash、GLM-5.2、GLM-5.1 等;GLM-5.3 旗舰不在套餐内。积分按模型×输入/输出/缓存系数扣减(与 Token制的核心区别就在这) 缓存价未公开换算锚点:官方 Token 福利包口径 1 积分≈0.001 元;因系数按模型与 Token 类型动态变化,积分制等效元/百万tokens 无法统一折算,不编数;个别旗舰模型在套餐内加收 1.8 倍抵扣系数(官方模型范围表标注) 套餐页https://cloud.baidu.com/doc/qianfan/s/Dmrabu8b6 | |||||
| 百 百度千帆 Token Plan | Token Plan Max(积分制) |
¥600 月 | 16.5 万 积分/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明积分制:按输入/输出/缓存 Token 分别设系数折算积分统一抵扣,系数随模型动态变化(如官方系数表中旗舰推理模型约 12/1/24 积分/千tokens,高效模型约 1/0.2/2);积分制每5小时和7天使用限制当前限时取消,恢复前官方提前告知 限制与口径持有限制首购每日 10 点限量五折秒杀(积分制同享);额度耗尽等下一周期恢复 计费说明仅限交互式 AI 编程工具中使用,严禁后端 API 跑批;一经开通不退款不降配;积分制仅支持从 Token制单向转入(不可转回) 备注套餐模型范围同 Token制档:含 DeepSeek-V4-Flash-0731(正式版)、旗舰 0813 版(1.8x)、GLM-5.3-Flash、GLM-5.2、GLM-5.1 等;GLM-5.3 旗舰不在套餐内。积分按模型×输入/输出/缓存系数扣减(与 Token制的核心区别就在这) 缓存价未公开换算锚点:官方 Token 福利包口径 1 积分≈0.001 元;因系数按模型与 Token 类型动态变化,积分制等效元/百万tokens 无法统一折算,不编数;个别旗舰模型在套餐内加收 1.8 倍抵扣系数(官方模型范围表标注) 套餐页https://cloud.baidu.com/doc/qianfan/s/Dmrabu8b6 | |||||
| 京 京东云 JoyMaaS | Token Plan 个人版 Lite |
¥69 月 | 1.73 万 Credits/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 19:40 周期月 额度说明Credits 计量:消耗 =(输入token×输入系数 + 输出token×输出系数)÷10000。套餐内 DeepSeek-V4-Flash-0731(正式版)系数:输入 0–32K 为 0.6、32–64K 为 1.2、64K+ 为 2.4,输出 1.8(超档全量上浮);旧无后缀 Flash【官方标注即将下线】系数更低(输入 0.25),下线前更省;旗舰推理 5.5/16、GLM-5.2 4/10(官方文档口径) 限制与口径持有限制个人版每日限量发售,售完次日 00:00 重置;套餐内额度用完即停(不转按量),5 小时/周/月三级用量窗口 计费说明订阅制,开通/升级后不退款不退订;TokenPlan 专属 API Key 与按量计费 Key 不通用;兼容 OpenAI+Anthropic 双协议,面向 Cursor/Claude Code/Roo Code 等编程工具 备注限时 8 折(折后 55.2/159.2/479.2/799.2 元);模型池以官方文档为准(据官方文档):DeepSeek-V4-Flash-0731 正式版明确在列,无后缀 Flash/Pro 标注【即将下线】(下线后 0731 即池内主力 Flash),另有 Preview 版、GLM-5.2、GLM-5.1、Kimi-K2.6、MiniMax-M3 与 maas-token-latest 自动路由别名;营销页仅展示六大 缓存价未公开按 0731 正式版系数折算(输入 0.6 / 输出 1.8,0–32K 档):本档额度全部用于输入约可抵 2.88 亿 tokens、全部用于输出约可抵 0.96 亿 tokens;缓存命中积分系数官方未公布,不估算 套餐页https://www.jdcloud.com/cn/products/tokenplan | |||||
| 京 京东云 JoyMaaS | Token Plan 个人版 Standard |
¥199 月 | 4.97 万 Credits/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 19:40 周期月 额度说明Credits 计量:消耗 =(输入token×输入系数 + 输出token×输出系数)÷10000。套餐内 DeepSeek-V4-Flash-0731(正式版)系数:输入 0–32K 为 0.6、32–64K 为 1.2、64K+ 为 2.4,输出 1.8(超档全量上浮);旧无后缀 Flash【官方标注即将下线】系数更低(输入 0.25),下线前更省;旗舰推理 5.5/16、GLM-5.2 4/10(官方文档口径) 限制与口径持有限制个人版每日限量发售,售完次日 00:00 重置;套餐内额度用完即停(不转按量),5 小时/周/月三级用量窗口 计费说明订阅制,开通/升级后不退款不退订;TokenPlan 专属 API Key 与按量计费 Key 不通用;兼容 OpenAI+Anthropic 双协议,面向 Cursor/Claude Code/Roo Code 等编程工具 备注限时 8 折(折后 55.2/159.2/479.2/799.2 元);模型池以官方文档为准(据官方文档):DeepSeek-V4-Flash-0731 正式版明确在列,无后缀 Flash/Pro 标注【即将下线】(下线后 0731 即池内主力 Flash),另有 Preview 版、GLM-5.2、GLM-5.1、Kimi-K2.6、MiniMax-M3 与 maas-token-latest 自动路由别名;营销页仅展示六大 缓存价未公开按 0731 正式版系数折算(输入 0.6 / 输出 1.8,0–32K 档):本档额度全部用于输入约可抵 8.29 亿 tokens、全部用于输出约可抵 2.76 亿 tokens;缓存命中积分系数官方未公布,不估算 套餐页https://www.jdcloud.com/cn/products/tokenplan | |||||
| 京 京东云 JoyMaaS | Token Plan 个人版 Pro |
¥599 月 | 14.97 万 Credits/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 19:40 周期月 额度说明Credits 计量:消耗 =(输入token×输入系数 + 输出token×输出系数)÷10000。套餐内 DeepSeek-V4-Flash-0731(正式版)系数:输入 0–32K 为 0.6、32–64K 为 1.2、64K+ 为 2.4,输出 1.8(超档全量上浮);旧无后缀 Flash【官方标注即将下线】系数更低(输入 0.25),下线前更省;旗舰推理 5.5/16、GLM-5.2 4/10(官方文档口径) 限制与口径持有限制个人版每日限量发售,售完次日 00:00 重置;套餐内额度用完即停(不转按量),5 小时/周/月三级用量窗口 计费说明订阅制,开通/升级后不退款不退订;TokenPlan 专属 API Key 与按量计费 Key 不通用;兼容 OpenAI+Anthropic 双协议,面向 Cursor/Claude Code/Roo Code 等编程工具 备注限时 8 折(折后 55.2/159.2/479.2/799.2 元);模型池以官方文档为准(据官方文档):DeepSeek-V4-Flash-0731 正式版明确在列,无后缀 Flash/Pro 标注【即将下线】(下线后 0731 即池内主力 Flash),另有 Preview 版、GLM-5.2、GLM-5.1、Kimi-K2.6、MiniMax-M3 与 maas-token-latest 自动路由别名;营销页仅展示六大 缓存价未公开按 0731 正式版系数折算(输入 0.6 / 输出 1.8,0–32K 档):本档额度全部用于输入约可抵 24.96 亿 tokens、全部用于输出约可抵 8.32 亿 tokens;缓存命中积分系数官方未公布,不估算 套餐页https://www.jdcloud.com/cn/products/tokenplan | |||||
| 京 京东云 JoyMaaS | Token Plan 个人版 Max |
¥999 月 | 24.98 万 Credits/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 19:40 周期月 额度说明Credits 计量:消耗 =(输入token×输入系数 + 输出token×输出系数)÷10000。套餐内 DeepSeek-V4-Flash-0731(正式版)系数:输入 0–32K 为 0.6、32–64K 为 1.2、64K+ 为 2.4,输出 1.8(超档全量上浮);旧无后缀 Flash【官方标注即将下线】系数更低(输入 0.25),下线前更省;旗舰推理 5.5/16、GLM-5.2 4/10(官方文档口径) 限制与口径持有限制个人版每日限量发售,售完次日 00:00 重置;套餐内额度用完即停(不转按量),5 小时/周/月三级用量窗口 计费说明订阅制,开通/升级后不退款不退订;TokenPlan 专属 API Key 与按量计费 Key 不通用;兼容 OpenAI+Anthropic 双协议,面向 Cursor/Claude Code/Roo Code 等编程工具 备注限时 8 折(折后 55.2/159.2/479.2/799.2 元);模型池以官方文档为准(据官方文档):DeepSeek-V4-Flash-0731 正式版明确在列,无后缀 Flash/Pro 标注【即将下线】(下线后 0731 即池内主力 Flash),另有 Preview 版、GLM-5.2、GLM-5.1、Kimi-K2.6、MiniMax-M3 与 maas-token-latest 自动路由别名;营销页仅展示六大 缓存价未公开按 0731 正式版系数折算(输入 0.6 / 输出 1.8,0–32K 档):本档额度全部用于输入约可抵 41.63 亿 tokens、全部用于输出约可抵 13.88 亿 tokens;缓存命中积分系数官方未公布,不估算 套餐页https://www.jdcloud.com/cn/products/tokenplan | |||||
| 京 京东云 JoyMaaS | Token Plan 企业版 Lite |
¥207 月/席 | 3.45 万 Credits/月/席 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 19:40 周期月/席 额度说明Credits 计量:消耗 =(输入token×输入系数 + 输出token×输出系数)÷10000。套餐内 DeepSeek-V4-Flash-0731(正式版)系数:输入 0–32K 为 0.6、32–64K 为 1.2、64K+ 为 2.4,输出 1.8(超档全量上浮);旧无后缀 Flash【官方标注即将下线】系数更低(输入 0.25),下线前更省;旗舰推理 5.5/16、GLM-5.2 4/10(官方文档口径) 限制与口径持有限制企业版灰度开放中(白名单审核,3 个工作日内开通),最多 50 席位;主账号统一分配、子账号绑定 计费说明企业版灰度白名单审核制,一席位一个专属 Key;TokenPlan 专属 API Key 与按量计费 Key 不通用;兼容 OpenAI+Anthropic 双协议,面向 Cursor/Claude Code/Roo Code 等编程工具;订阅制,开通/升级后不退款不退订 备注限时 6 折(折后 124.2/358.2/1078.2/1798.2 元/席);模型池同个人版(据官方文档:0731 正式版在列,无后缀 Flash/Pro 标注【即将下线】) 缓存价未公开按 0731 正式版系数折算(输入 0.6 / 输出 1.8,0–32K 档):本档额度全部用于输入约可抵 5.75 亿 tokens、全部用于输出约可抵 1.92 亿 tokens;缓存命中积分系数官方未公布,不估算 套餐页https://www.jdcloud.com/cn/products/tokenplan | |||||
| 京 京东云 JoyMaaS | Token Plan 企业版 Standard |
¥597 月/席 | 9.95 万 Credits/月/席 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 19:40 周期月/席 额度说明Credits 计量:消耗 =(输入token×输入系数 + 输出token×输出系数)÷10000。套餐内 DeepSeek-V4-Flash-0731(正式版)系数:输入 0–32K 为 0.6、32–64K 为 1.2、64K+ 为 2.4,输出 1.8(超档全量上浮);旧无后缀 Flash【官方标注即将下线】系数更低(输入 0.25),下线前更省;旗舰推理 5.5/16、GLM-5.2 4/10(官方文档口径) 限制与口径持有限制企业版灰度开放中(白名单审核,3 个工作日内开通),最多 50 席位;主账号统一分配、子账号绑定 计费说明企业版灰度白名单审核制,一席位一个专属 Key;TokenPlan 专属 API Key 与按量计费 Key 不通用;兼容 OpenAI+Anthropic 双协议,面向 Cursor/Claude Code/Roo Code 等编程工具;订阅制,开通/升级后不退款不退订 备注限时 6 折(折后 124.2/358.2/1078.2/1798.2 元/席);模型池同个人版(据官方文档:0731 正式版在列,无后缀 Flash/Pro 标注【即将下线】) 缓存价未公开按 0731 正式版系数折算(输入 0.6 / 输出 1.8,0–32K 档):本档额度全部用于输入约可抵 16.58 亿 tokens、全部用于输出约可抵 5.53 亿 tokens;缓存命中积分系数官方未公布,不估算 套餐页https://www.jdcloud.com/cn/products/tokenplan | |||||
| 京 京东云 JoyMaaS | Token Plan 企业版 Pro |
¥1797 月/席 | 29.95 万 Credits/月/席 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 19:40 周期月/席 额度说明Credits 计量:消耗 =(输入token×输入系数 + 输出token×输出系数)÷10000。套餐内 DeepSeek-V4-Flash-0731(正式版)系数:输入 0–32K 为 0.6、32–64K 为 1.2、64K+ 为 2.4,输出 1.8(超档全量上浮);旧无后缀 Flash【官方标注即将下线】系数更低(输入 0.25),下线前更省;旗舰推理 5.5/16、GLM-5.2 4/10(官方文档口径) 限制与口径持有限制企业版灰度开放中(白名单审核,3 个工作日内开通),最多 50 席位;主账号统一分配、子账号绑定 计费说明企业版灰度白名单审核制,一席位一个专属 Key;TokenPlan 专属 API Key 与按量计费 Key 不通用;兼容 OpenAI+Anthropic 双协议,面向 Cursor/Claude Code/Roo Code 等编程工具;订阅制,开通/升级后不退款不退订 备注限时 6 折(折后 124.2/358.2/1078.2/1798.2 元/席);模型池同个人版(据官方文档:0731 正式版在列,无后缀 Flash/Pro 标注【即将下线】) 缓存价未公开按 0731 正式版系数折算(输入 0.6 / 输出 1.8,0–32K 档):本档额度全部用于输入约可抵 49.92 亿 tokens、全部用于输出约可抵 16.64 亿 tokens;缓存命中积分系数官方未公布,不估算 套餐页https://www.jdcloud.com/cn/products/tokenplan | |||||
| 京 京东云 JoyMaaS | Token Plan 企业版 Max |
¥2997 月/席 | 49.95 万 Credits/月/席 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 19:40 周期月/席 额度说明Credits 计量:消耗 =(输入token×输入系数 + 输出token×输出系数)÷10000。套餐内 DeepSeek-V4-Flash-0731(正式版)系数:输入 0–32K 为 0.6、32–64K 为 1.2、64K+ 为 2.4,输出 1.8(超档全量上浮);旧无后缀 Flash【官方标注即将下线】系数更低(输入 0.25),下线前更省;旗舰推理 5.5/16、GLM-5.2 4/10(官方文档口径) 限制与口径持有限制企业版灰度开放中(白名单审核,3 个工作日内开通),最多 50 席位;主账号统一分配、子账号绑定 计费说明企业版灰度白名单审核制,一席位一个专属 Key;TokenPlan 专属 API Key 与按量计费 Key 不通用;兼容 OpenAI+Anthropic 双协议,面向 Cursor/Claude Code/Roo Code 等编程工具;订阅制,开通/升级后不退款不退订 备注限时 6 折(折后 124.2/358.2/1078.2/1798.2 元/席);模型池同个人版(据官方文档:0731 正式版在列,无后缀 Flash/Pro 标注【即将下线】) 缓存价未公开按 0731 正式版系数折算(输入 0.6 / 输出 1.8,0–32K 档):本档额度全部用于输入约可抵 83.25 亿 tokens、全部用于输出约可抵 27.75 亿 tokens;缓存命中积分系数官方未公布,不估算 套餐页https://www.jdcloud.com/cn/products/tokenplan | |||||
| 讯 讯飞星辰MaaS | 星辰 Token Plan 标准版(企业) |
¥200 月/席 | 2 万 积分/月/席 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 19:25 周期月/席 额度说明企业级统一积分额度池,多模型共享;官方系数示例:DeepSeek-V4-Flash 输入约 100 积分/百万Token、自研 Spark-X2 输入 300 积分/百万;错峰时段(工作日 08:00-22:00 以外 + 周末全天)积分消耗享 0.8 倍系数 限制与口径持有限制单账号同时仅可生效一个同类订阅;TPM 上限 200万/成员 计费说明面向企业/团队的包月订阅(按席位采购,最高 200 成员);Token Plan 专属 API Key 与独立 BaseURL,不得与常规按量 Key 混用、严禁后端跑批;99.95% SLA,高峰期专属资源调度不排队;每成员最高 500 万 TPM 备注限时折扣活动价 160/420/1200 元/席;每份套餐赠 AstronClaw 基础版月度会员(价值 168 元)+ 讯飞核心能力(语音合成/OCR/翻译等)赠送额度;模型池含 Spark-X2、DeepSeek-V4、GLM-5.1、Kimi-K2.6 等(官方宣传口径,未注明 0731 后缀) 缓存价未公开积分按模型×输入/输出/缓存分设系数折算,缓存命中系数官方未单列 → 等效元/百万tokens 无法统一折算,不编数 套餐页https://maas.xfyun.cn/ | |||||
| 讯 讯飞星辰MaaS | 星辰 Token Plan 高级版(企业) |
¥600 月/席 | 6 万 积分/月/席 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 19:25 周期月/席 额度说明企业级统一积分额度池,多模型共享;官方系数示例:DeepSeek-V4-Flash 输入约 100 积分/百万Token、自研 Spark-X2 输入 300 积分/百万;错峰时段(工作日 08:00-22:00 以外 + 周末全天)积分消耗享 0.8 倍系数 限制与口径持有限制单账号同时仅可生效一个同类订阅;TPM 上限 300万/成员 计费说明面向企业/团队的包月订阅(按席位采购,最高 200 成员);Token Plan 专属 API Key 与独立 BaseURL,不得与常规按量 Key 混用、严禁后端跑批;99.95% SLA,高峰期专属资源调度不排队;每成员最高 500 万 TPM 备注限时折扣活动价 160/420/1200 元/席;每份套餐赠 AstronClaw 基础版月度会员(价值 168 元)+ 讯飞核心能力(语音合成/OCR/翻译等)赠送额度;模型池含 Spark-X2、DeepSeek-V4、GLM-5.1、Kimi-K2.6 等(官方宣传口径,未注明 0731 后缀) 缓存价未公开积分按模型×输入/输出/缓存分设系数折算,缓存命中系数官方未单列 → 等效元/百万tokens 无法统一折算,不编数 套餐页https://maas.xfyun.cn/ | |||||
| 讯 讯飞星辰MaaS | 星辰 Token Plan 尊享版(企业) |
¥2000 月/席 | 20 万 积分/月/席 | — | 官网 ↗ |
套餐信息核实时间2026-09-09 19:25 周期月/席 额度说明企业级统一积分额度池,多模型共享;官方系数示例:DeepSeek-V4-Flash 输入约 100 积分/百万Token、自研 Spark-X2 输入 300 积分/百万;错峰时段(工作日 08:00-22:00 以外 + 周末全天)积分消耗享 0.8 倍系数 限制与口径持有限制单账号同时仅可生效一个同类订阅;TPM 上限 500万/成员 计费说明面向企业/团队的包月订阅(按席位采购,最高 200 成员);Token Plan 专属 API Key 与独立 BaseURL,不得与常规按量 Key 混用、严禁后端跑批;99.95% SLA,高峰期专属资源调度不排队;每成员最高 500 万 TPM 备注限时折扣活动价 160/420/1200 元/席;每份套餐赠 AstronClaw 基础版月度会员(价值 168 元)+ 讯飞核心能力(语音合成/OCR/翻译等)赠送额度;模型池含 Spark-X2、DeepSeek-V4、GLM-5.1、Kimi-K2.6 等(官方宣传口径,未注明 0731 后缀) 缓存价未公开积分按模型×输入/输出/缓存分设系数折算,缓存命中系数官方未单列 → 等效元/百万tokens 无法统一折算,不编数 套餐页https://maas.xfyun.cn/ | |||||
| O OpenCode Go | Go 订阅(首月 $5 · 续费 $10/月) |
¥67.3 月 | 60 美元用量 | — | 官网 ↗ |
套餐信息核实时间2026-09-10 15:30 周期月 额度说明按美元价值扣费,路由到当下成本最低且有容量的供应商;额度当月有效不结转 限制与口径持有限制5 小时上限 $12 · 每周上限 $30 · 单模型月额度分 $15/$30/$60 三档(DeepSeek V4 Flash 为 $30 档;V4.1 Flash 上线后单列 $60 档) 计费说明重要:仅用 DeepSeek V4 Flash 时,月上限 $30 跑不满 $60 总额度。官方估算 Flash 约 31,650 次/5 小时(编程负载)。超额可开启 Use balance 回落到 Zen 按量额度。 备注含 14+ 款精选开源模型(DeepSeek V4 Pro/V4 Flash、GLM-5.x、Kimi、Qwen、MiniMax、MiMo 等)。API 可导出:OpenAI 兼容 /zen/go/v1/chat/completions 与 Anthropic 兼容 /v1/messages,model ID 前缀 opencode-go/。每工作空间限 1 人订阅。官方未公开每 token 扣费单价,等效价暂无法计算。【用量倍率预警 2026-09-10】据官方额度页:V4.1 Flash 标「New · 4× usage」,每次请求按 4 倍用量扣减——额度页显示 26,000 次/5h 是乘过倍率的账面数,按 1 倍口径实际等效仅 6,500 次/5h(页面已把旧值 6,500 划掉改标 26,000,月额度 $15 划掉改标 $60)。对比 V4 Flash:13,000 次/5h(1 倍)、月额度 $30——V4.1 Flash 有效请求数反而只有 V4 Flash 的一半、月额度门槛翻倍,性价比倒挂。本平台是首个对 V4.1 系加收用量倍率的渠道;若后续 V4 Flash 也被加倍率,全表所有套餐类渠道的等效价都要重算(将持续盯此项)。 套餐页https://opencode.ai/go | |||||
| C CommandCode | Go($1/月 + 处理费) |
¥6.7 月 | 10 美元 credits | 0.13 | 官网 ↗ |
套餐信息核实时间2026-09-10 22:10 周期月 额度说明$10 credits,各档通用(无单模型上限);credits 永不过期可累积;叠加限时优惠最高约 $20 等效用量(MiniMax M3 2×、MiMo V2.5 99% off 等);高峰时段为工作日 01–04 与 06–10 UTC(北京 09–12、14–18 点),输入/输出单价 ×2 按量对比无 API 调用 折算口径扣减口径等效综合单价(仅用 Flash 口径,谷时) 等效价计算等效 0.13 元/M = 官方综合 $0.186/M ÷ 10 × 6.73;月度约 5,400 万 tokens(基准负载) 倍率说明Flash 谷时综合 $0.186/M ×($1 ÷ $10 credits)× 汇率 6.73;仅用 Flash 时 credits 可跑满 限制与口径持有限制约 15K 次请求/月(官方口径:Flash 无缓存约 32K 次,计入典型 5 万缓存读后约 15K) 计费说明只能在 Command Code 官方 Agent 软件内使用——官方文档明确 Go 是唯一不提供 API 的档位;想导出 API 需订 GOAT 及以上或 Provider 档。官方未开放 API 导出口径,不建议变通使用。 备注官方文档:含 42 款模型(Kimi/DeepSeek/GLM/MiniMax/Qwen 开源全家 + GPT-5.6 Luna、Grok 4.5、Qwen Max & Plus 等);Flash 单价与各档一致(谷时 $0.22/缓存 $0.007/输出 $0.66)。 套餐页https://commandcode.ai/zh/pricing | |||||
| C CommandCode | GOAT($10/月 + 处理费) |
¥67.3 月 | 70 美元 credits | 0.21 | 官网 ↗ |
套餐信息核实时间2026-09-10 22:10 周期月 额度说明$70 credits(官方 7× 杠杆,叠加优惠超 $100);Flash 单模型月额度 $60;credits 永不过期;高峰时段为工作日 01–04 与 06–10 UTC(北京 09–12、14–18 点),输入/输出单价 ×2 折算口径等效价计算等效 0.21 元/M = 官方综合 $0.186/M ×($10 ÷ Flash 额度 $60)× 6.73;Flash 月度约 3.2 亿 tokens(基准负载) 限制与口径持有限制5 小时 $14 · 每周 $35 · 每月 $70(官方);Flash 官方估算 18,200 次/5h · 91,200 次/月 计费说明重要:仅用 Flash 跑不满 $70 总额度(Flash 月额度 $60,剩余 $10 可用于其他模型)。API 已确认:官方文档写明 GOAT 及以上均可调 Provider API(api.commandcode.ai/provider/v1,OpenAI/Anthropic 兼容),按订阅 credits 计量。 备注官方文档:49 款模型;Flash 单价与各档一致(谷时 $0.22/缓存 $0.007/输出 $0.66)。另有 Pro $20/$80、Max 10× $100/$150、Max 20× $200/$300。 套餐页https://commandcode.ai/zh/pricing | |||||
| C CommandCode | Pro($20/月 + 处理费) |
¥134.6 月 | 80 美元 credits | 0.36 | 官网 ↗ |
套餐信息核实时间2026-09-10 22:10 周期月 额度说明$80 credits(GOAT 全含 + Claude/GPT/Gemini 高级模型);Flash 单模型月额度 $70;credits 永不过期;高峰时段为工作日 01–04 与 06–10 UTC(北京 09–12、14–18 点),输入/输出单价 ×2 折算口径等效价计算等效 0.36 元/M = 官方综合 $0.186/M ×($20 ÷ Flash 额度 $70)× 6.73;Flash 月度约 3.8 亿 tokens(基准负载) 限制与口径持有限制5 小时 $16 · 每周 $40 · 每月 $80(官方);Flash 官方估算 21,300 次/5h · 106,000 次/月;约 100K 请求 / 12B+ tokens 计费说明重要:仅用 Flash 跑不满 $80 总额度(Flash 月额度 $70)。API 已确认:可调 Provider API,按订阅 credits 计量。 备注官方文档:61 款模型(45+ 开源与高级);Flash 单价与各档一致。 套餐页https://commandcode.ai/zh/pricing | |||||
| O Ollama Cloud | Pro($20/月) |
¥134.6 月 | 60 美元用量 | 0.42 | 官网 ↗ |
套餐信息核实时间2026-09-10 21:30 周期月 额度说明按官方每 M token 价扣费:DeepSeek V4 Flash 输入 $0.22 · 缓存读 $0.007 · 输出 $0.66(高峰时段工作日 12:00–18:00 UTC,即北京 20:00–次日 2:00,全部 ×2);用完后可按同价续期 折算口径扣减口径等效综合单价(谷时) 等效价计算等效 0.42 元/M(谷时)= 官方综合 $0.186/M ÷ 3 × 6.73;高峰时段约 0.84 元/M 倍率说明由官方 token 价 × 订阅杠杆(月费/用量 = 1/3)× 汇率 6.73 折出;高峰时段约 ×2 限制与口径持有限制3 路并发;无 5 小时/每周上限(2026-08 起改按 token 计费) 计费说明等效价 = 官方 Flash 单价 ×(月费 ÷ 月度用量)= 按量价的 1/3,非估算。按基准负载(3:1、缓存 90%)折算月度约可跑 322 百万 tokens(谷时口径,高峰翻倍扣费会减少)。 备注Ollama 为本地运行时起家(9M+ 开发者),云端原生权重、NVIDIA 云托管、零留存不训练;CLI/API/桌面端通用,兼容现有本地 Ollama 工作流。Pro 含 $60 用量、Max 含 $300 用量。 缓存价未公开缓存读按 $0.007/M 扣(高峰 $0.014),等效价已按 90% 命中率折入 套餐页https://ollama.com/pricing | |||||
| O Ollama Cloud | Max($100/月) |
¥673 月 | 300 美元用量 | 0.42 | 官网 ↗ |
套餐信息核实时间2026-09-10 21:30 周期月 额度说明按官方每 M token 价扣费:DeepSeek V4 Flash 输入 $0.22 · 缓存读 $0.007 · 输出 $0.66(高峰时段工作日 12:00–18:00 UTC,即北京 20:00–次日 2:00,全部 ×2);用完后可按同价续期 折算口径扣减口径等效综合单价(谷时) 等效价计算等效 0.42 元/M(谷时)= 官方综合 $0.186/M ÷ 3 × 6.73;高峰时段约 0.84 元/M 倍率说明由官方 token 价 × 订阅杠杆(月费/用量 = 1/3)× 汇率 6.73 折出;高峰时段约 ×2 限制与口径持有限制10 路并发;无 5 小时/每周上限(2026-08 起改按 token 计费) 计费说明等效价 = 官方 Flash 单价 ×(月费 ÷ 月度用量)= 按量价的 1/3,非估算。按基准负载(3:1、缓存 90%)折算月度约可跑 1611 百万 tokens(谷时口径,高峰翻倍扣费会减少)。 备注Ollama 为本地运行时起家(9M+ 开发者),云端原生权重、NVIDIA 云托管、零留存不训练;CLI/API/桌面端通用,兼容现有本地 Ollama 工作流。Pro 含 $60 用量、Max 含 $300 用量。 缓存价未公开缓存读按 $0.007/M 扣(高峰 $0.014),等效价已按 90% 命中率折入 套餐页https://ollama.com/pricing | |||||
| C CommandCode | Max 10×($100/月 + 处理费) |
¥673 月 | 150 美元 credits | 0.84 | 官网 ↗ |
套餐信息核实时间2026-09-10 22:10 周期月 额度说明$150 credits(标准模型上限 $150 + 高级模型上限 $100,Flash 属标准池);Flash 单模型月额度 $150;全部模型无限制(含 Claude Opus/Fable);credits 永不过期;高峰时段为工作日 01–04 与 06–10 UTC(北京 09–12、14–18 点),输入/输出单价 ×2 折算口径扣减口径等效综合单价(仅用 Flash 口径,谷时) 等效价计算等效 0.84 元/M;Flash 月度约 0 亿 tokens(基准负载,谷时口径) 倍率说明Flash 谷时综合 $0.186/M ×($100 ÷ Flash 额度 $150)× 汇率 6.73 限制与口径持有限制5 小时 $45 · 每周 $90 · 每月 $150(官方);Flash 官方估算 68,400 次/5h · 228,000 次/月 计费说明重要:Flash 属标准池,仅用 Flash 时 Flash 月额度 $150 为上限(占总额度 $100)。API 已确认:可调 Provider API(api.commandcode.ai/provider/v1),按订阅 credits 计量。 备注官方文档:全部 68+ 模型无限制;Flash 单价与各档一致(谷时 $0.22/缓存 $0.007/输出 $0.66);Max 20× 所有窗口为 10× 的两倍。 套餐页https://commandcode.ai/docs/plans/max | |||||
| C CommandCode | Max 20×($200/月 + 处理费) |
¥1346 月 | 300 美元 credits | 0.84 | 官网 ↗ |
套餐信息核实时间2026-09-10 22:10 周期月 额度说明$300 credits(标准模型上限 $300 + 高级模型上限 $200,Flash 属标准池);Flash 单模型月额度 $300;全部模型无限制(含 Claude Opus/Fable);credits 永不过期;高峰时段为工作日 01–04 与 06–10 UTC(北京 09–12、14–18 点),输入/输出单价 ×2 折算口径扣减口径等效综合单价(仅用 Flash 口径,谷时) 等效价计算等效 0.84 元/M;Flash 月度约 1 亿 tokens(基准负载,谷时口径) 倍率说明Flash 谷时综合 $0.186/M ×($200 ÷ Flash 额度 $300)× 汇率 6.73 限制与口径持有限制5 小时 $90 · 每周 $180 · 每月 $300(官方);Flash 官方估算 136,800 次/5h · 456,000 次/月 计费说明重要:Flash 属标准池,仅用 Flash 时 Flash 月额度 $300 为上限(占总额度 $200)。API 已确认:可调 Provider API(api.commandcode.ai/provider/v1),按订阅 credits 计量。 备注官方文档:全部 68+ 模型无限制;Flash 单价与各档一致(谷时 $0.22/缓存 $0.007/输出 $0.66);Max 20× 所有窗口为 10× 的两倍。 套餐页https://commandcode.ai/docs/plans/max | |||||
| 没有符合条件的套餐,试试放宽筛选。 | |||||
*「等效价」口径:TokenPlan 的「等效价格」= 套餐月费 ÷ 该套餐按官方抵扣系数折算出的 token 总量,且按额度 100% 全部用完计算。额度用不完,实际单价会高于此值。
| 渠道 | 元 / 百万 tokens | 元 / 百万 tokens | 元 / 百万 tokens | 峰谷时间 | 官网 | ||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| D DeepSeek 官方 官方自营 | 峰2 / 谷1 | 峰0.04 / 谷0.02 | 峰8 / 谷4 | 峰:周一至周五 9:00-12:00、14:00-18:00 谷:其余时间,含周末全天 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号deepseek-flash(即 DeepSeek-V4.1-Flash,1M 上下文 / 最大输出 384K / 支持图像理解) 版本说明已核实(据官方定价页):当前 Flash 模型的官方名为 deepseek-flash,即 DeepSeek-V4.1-Flash,原生多模态并支持图像理解。价格按峰谷分档:高峰时段 输入 2 · 缓存 0.04 · 输出 8,空闲时段 输入 1 · 缓存 0.02 · 输出 4(元每百万 tokens)。官方页面说明旧模型名 deepseek-v4-flash 已下线,调用会改由 V4.1-Flash 承接。 接入
接口地址https://api.deepseek.com 官方直连,无中间环节。 口径与备注核实时间2026-09-15 13:02 定价页https://api-docs.deepseek.com/zh-cn/quick_start/pricing | |||||||||||||||||||||||||
| 腾 腾讯云 · 原厂直供 原厂直供 | 峰2 / 谷1 | 峰0.04 / 谷0.02 | 峰8 / 谷4 | 峰:与官方峰谷同步 谷:与官方峰谷同步 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号DeepSeek-V4.1-Flash 原厂直供 版本说明已核实(据腾讯云 TokenHub 官方模型价格页):页面单列「DeepSeek-V4.1-Flash 原厂直供」一条,空闲时段 输入 1 · 缓存 0.02 · 输出 4,高峰时段 输入 2 · 缓存 0.04 · 输出 8(元每百万 tokens),与 DeepSeek 官方峰谷价一致。 接入
价格跟随 DeepSeek 官方峰谷,与官方完全一致 口径与备注核实时间2026-09-16 20:29 定价页https://cloud.tencent.com/document/product/1823/130055 | |||||||||||||||||||||||||
| 火 火山方舟 第三方部署 | 峰2 / 谷1 | 峰0.04 / 谷0.02 | 峰8 / 谷4 | 峰:周一至周五 9:00-12:00、14:00-18:00 谷:其余时间,含周末全天 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号deepseek-v4.1-flash(页面写作 deepseek-v4-1-flash) 版本说明已核实(据火山方舟官方定价页):页面单列「deepseek-v4-1-flash」,即 DeepSeek-V4.1-Flash,并按高峰/空闲时段分档 —— 高峰时段 输入 2 · 缓存 0.04 · 输出 8,空闲时段 输入 1 · 缓存 0.02 · 输出 4(元每百万 tokens),与 DeepSeek 官方峰谷价一致。页面对该模型给出的时段定义:高峰为北京时间周一至周五 09:00–12:00、14:00–18:00,其余时间为空闲时段。目录中另有 deepseek-v4-pro / deepseek-v4-flash 的正式版与预览版条目,属上一代模型,不在本条目范围。 接入
接口地址https://ark.cn-beijing.volces.com/api/v3 console.volcengine.com/ark 开通 deepseek-v4.1-flash,按量计费 口径与备注核实时间2026-09-17 13:01 定价页https://www.volcengine.com/docs/82379/1544106 | |||||||||||||||||||||||||
| 优 优云智算 自部署 | 2 | 2 | 8 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号deepseek-v4.1-flash(1M 上下文 / 最大输出 384K / 文本生成·视觉理解·深度思考) 版本说明已核实(据官网模型目录):deepseek-v4.1-flash 标价 输入 2 元 · 文本输出 8 元(每百万 Token),1M 上下文、支持深度思考与视觉理解。官网未单列缓存命中价,缓存档按输入价计入。 接入
优云智算是 UCloud 优刻得旗下 AI 算力/模型平台(上市公司背景,资质正规);目录共 71 个模型(DeepSeek/Qwen/GLM/Kimi/MiniMax/Doubao 等)。 口径与备注核实时间2026-09-17 19:59 风险说明官网模型目录未单列缓存命中价,缓存档按输入价计入;对高缓存命中率的连续会话,等效成本会高于带缓存折扣的渠道。 厂家身份优云智算是 UCloud 优刻得旗下 AI 算力/模型平台 定价页https://www.compshare.cn/model-api | |||||||||||||||||||||||||
| 矩 矩池云 Matpool 自部署 | 1 | 1 | 4 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号DeepSeek-V4.1-Flash 版本说明已核实(据官网模型列表):DeepSeek-V4.1-Flash 标价 输入 ¥1 · 输出 ¥4(每百万 tokens)。官网未单列缓存命中价,缓存档按输入价计入。 接入
接口地址https://newapi.matpool.com/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-13 17:17 风险说明官网模型列表未单列缓存命中价,缓存档按输入价计入。 厂家身份GPU 算力租赁商出身的大模型网关,规模小于云大厂 定价页https://matpool.com/models | |||||||||||||||||||||||||
| 中 中青 AI 聚合网关 第三方部署 | 1 | 0.02 | 4 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号deepseek-flash(平台说明为 DeepSeek-V4.1-Flash) 版本说明已核实(据官网模型广场):模型名 deepseek-flash,平台说明写明「由 DeepSeek 直接提供的最新的 DeepSeek-V4.1-Flash 多模态模型服务」,标价 输入 ¥1 · 缓存读取 ¥0.02 · 输出 ¥4(每百万 tokens)。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:29 定价页https://aiapi.zqgame.com/pricing | |||||||||||||||||||||||||
| 3 302.AI 聚合网关 美元刊例 · 折算展示 | 峰2.02 / 谷1.01 | 峰0.04 / 谷0.02 | 峰8.08 / 谷4.04 | 峰:北京时间 09:00–12:00、14:00–18:00(美元计价 · 按 1 USD ≈ 6.73 元(2026-09-13)) 谷:美元计价 · 按 1 USD ≈ 6.73 元(2026-09-13) | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径)。 版本说明✓ 已核实型号deepseek-v4.1-flash(1M 上下文 / 支持深度思考) 版本说明已核实(据官网模型页原文):deepseek-v4.1-flash 按峰谷两档计价,与 DeepSeek 官方同步 —— 空闲时段 输入 $0.15 · 缓存读取 $0.003 · 输出 $0.60;高峰时段(北京时间 09:00–12:00、14:00–18:00)输入 $0.30 · 缓存读取 $0.006 · 输出 $1.20(每 1M tokens)。页面同时标「起」价与完整价表,两处一致。 接入
一站式接 100+ 模型。 口径与备注核实时间2026-09-17 19:59 定价页https://302.ai/product/detail/deepseek-v4.1-flash | |||||||||||||||||||||||||
| P PPIO 派欧云 自部署 | 2 | 0.04 | 8 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号deepseek/deepseek-v4.1-flash 版本说明已核实(据官方模型目录接口):模型 id 为 deepseek/deepseek-v4.1-flash,输入 2 · 缓存读 0.04 · 输出 8(元每百万 tokens)。价格与 DeepSeek 官方高峰档一致。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-13 17:17 厂家身份派欧云计算(上海)有限公司(沪ICP备18048206号-33)运营的分布式云计算平台。 定价页https://ppio.com/llm | |||||||||||||||||||||||||
| O OfoxAI 聚合网关 美元刊例 · 折算展示 | 2.02 | 0.04 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径)。 版本说明✓ 已核实型号deepseek/deepseek-v4.1-flash 版本说明已核实(据官方模型目录接口):deepseek/deepseek-v4.1-flash 输入 $0.30 · 缓存读 $0.006 · 输出 $1.20(每 1M tokens)。 接入
另支持 Anthropic/Gemini 原生协议),宣称 0 加价、99.9% SLA 口径与备注核实时间2026-09-17 20:04 定价页https://ofox.ai/zh/models/deepseek/deepseek-v4.1-flash | |||||||||||||||||||||||||
| Z ZenMux 聚合平台 美元刊例 · 折算展示 | 0.5048 | 0.0101 | 2.019 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存 $0.003 · 输出 $0.60(每 1M token);此处为平台折扣价(5 折):输入 $0.075 · 缓存 $0.0015 · 输出 $0.30。人民币价 = 美元价 × 6.73(2026-09-15 汇率)。 版本说明✓ 已核实型号deepseek/deepseek-v4.1-flash 版本说明已核实(据官方模型目录接口):deepseek/deepseek-v4.1-flash 标准档 输入 $0.15 · 缓存读 $0.003 · 输出 $0.60(每 1M tokens)。目录同时列出优先档 $0.30 / $1.20,本条取标准档。 接入
接口地址https://zenmux.ai/api/v1 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-15 08:35 风险说明此处为平台当期折扣后的价格,官方上游刊例为 $0.15 / $0.003 / $0.60。平台未标注折扣结束时间,取消折扣后单价会上浮。同一模型由多家上游供货、缓存价随上游不同,本档取与官方刊例一致的上游口径。 厂家身份ZenMux,新加坡聚合网关(主体 AI Force Singapore Pte. Ltd.),目录覆盖 189 个模型。 定价页https://zenmux.ai | |||||||||||||||||||||||||
| N Naga(聚合平台) 聚合平台 美元刊例 · 折算展示 | 0.5048 | 0.0101 | 2.019 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-15 汇率口径,沿用表内既有条目)。 版本说明✓ 已核实型号deepseek-v4.1-flash 版本说明模型 ID 为 deepseek-v4.1-flash,即 DeepSeek-V4.1-Flash;据该平台官方接口(https://naga.ac/pricing)当场核对,标的为 DeepSeek-V4.1-Flash 本代版本,非同族旧代。 接入
接口地址https://api.naga.ac/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-15 08:20 风险说明报价约为表内同档中位数的 15%,显著低于同业,货源与限速请自行核对。 报价为同类中较低水平,未标注上游供应商,对比时留意。 该平台对多个模型长期挂促销价,本条按当前挂牌价收录,未回推标准价。 定价页https://naga.ac/pricing | |||||||||||||||||||||||||
| I Infron(零加价网关) 聚合网关 美元刊例 · 折算展示 | 峰0.82 / 谷0.57 | 峰0.05 / 谷0.06 | 峰3.27 / 谷2.28 | 峰:全时段(美元计价,按 1 USD ≈ 6.73 元折算) 谷:全时段,低优先级路由(适合离线评测、批处理等容忍波动的任务)(美元计价,按 1 USD ≈ 6.73 元折算) | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:Standard 档 输入 $0.1216 · 缓存读 $0.0081 · 输出 $0.4862;Flex 档 输入 $0.0849 · 缓存读 $0.0084 · 输出 $0.3393(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 部署说明零加价路由 版本说明✓ 已核实型号deepseek/deepseek-v4.1-flash(1M 上下文 / 384K 输出) 版本说明已核实(2026-09-15 据该站官方模型页数据):DeepSeek V4.1-Flash 的 Standard 档均值 输入 $0.1216 · 缓存读 $0.0081 · 输出 $0.4862,Flex 档均值 输入 $0.0849 · 缓存读 $0.0084 · 输出 $0.3393(每 1M tokens)。Standard 池 6 家上游:alibaba eu/hk/jp/us $0.0849、sg $0.09、deepseek 直连 $0.3,其中 5 家带 70% off 折扣(折扣前 $0.283 / $0.028 / $1.131);Flex 池仅 alibaba/cn 一家。缓存写入不单独计价(cache_write 为空,按输入价计)。 接入
接口地址https://api.infron.ai/v1 零 token 加价,平台按 $0.35 + 5% 收取账户服务费。分 Flex / Standard 档位池。 口径与备注核实时间2026-09-15 20:58 风险说明价格口径:这里的价格取自该站模型页卡片标示的「Avg list price」,即该档位池内全部可用上游的算术平均;站内逐上游明细另列每家单价,最低的一条常显著低于此均值。该站原话「your request is billed at the rate of the provider it is routed to」—— 实际费用取决于当次路由到的上游,故此处均值偏保守。折扣时效:部分上游当前有折扣,幅度与期限由各上游自行调整,随时可能回调。资历:域名 2026-01-07 注册,公司很新,零加价模式下无动力压价,但长周期可靠性未经验证,建议按需使用,不建议一次性投入大额资金。 定价页https://infron.ai/models/deepseek/deepseek-v4.1-flash | |||||||||||||||||||||||||
| O OpenRouter(聚合平台) 聚合平台 美元刊例 · 折算展示 | 峰2.5238 / 谷1.0095 | 峰0.0505 / 谷0.0202 | 峰10.095 / 谷4.038 | 峰:池内最高档,仅作比价上限参考 谷:池内最低档,单上游调价/撤单即失效,仅作比价下限参考 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径聚合口径(2026-09-16 复抓 OpenRouter 官方 endpoints 接口(17 家上游端点)):主档取「池内中位档」(按输入价升序取上中位,不再取最低档)—— 中位档 SiliconFlow 输入 $0.3 / 缓存 $0.006 / 输出 $1.2,池内区间输入 $0.15 ~ $0.375;人民币价 = 美元价 × 6.73(2026-09-16 汇率 1 USD ≈ 6.73 元)。 版本说明✓ 已核实型号deepseek/deepseek-v4.1-flash 版本说明已核实(据官方模型目录接口):模型 id deepseek/deepseek-v4.1-flash,输入 $0.15 · 缓存读 $0.003 · 输出 $0.60(每 1M tokens)。部分上游端点在高峰时段报 $0.30 / $1.20,本条取标准档。口径修正(2026-09-16):聚合平台主档取「池内中位档」——池内共 17 家上游,中位档为 SiliconFlow 输入 $0.3 / 输出 $1.2;原取池内最低档(受单上游撤单影响大)已降为次档。 接入
接口地址https://openrouter.ai/api/v1 可用 provider 参数指定供应商(如 DeepInfra)锁定价格与量化。 口径与备注核实时间2026-09-16 20:14 定价页https://openrouter.ai/deepseek/deepseek-v4.1-flash | |||||||||||||||||||||||||
| R Requesty(聚合平台) 聚合平台 美元刊例 · 折算展示 | 峰3.365 / 谷1.0095 | 峰0.3365 / 谷0.0673 | 峰10.095 / 谷4.038 | 峰:池内最高档,仅作比价上限参考 谷:池内最低档,单上游调价/撤单即失效,仅作比价下限参考 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径聚合口径(2026-09-16 复抓 Requesty 公开模型接口(6 家上游)):主档取「池内中位档」(按输入价升序取上中位,不再取最低档)—— 中位档 deepseek 输入 $0.3 / 缓存 $0.006 / 输出 $1.2,池内区间输入 $0.15 ~ $0.5;人民币价 = 美元价 × 6.73(2026-09-16 汇率 1 USD ≈ 6.73 元)。 版本说明✓ 已核实型号deepseek/deepseek-v4.1-flash(本条取上游 DeepInfra 路由) 版本说明已核实(据官方模型目录接口):DeepSeek V4.1-Flash 在该平台内有多条上游路由,本条取标准档中最低的一家(上游 DeepInfra)输入 $0.20 · 缓存 $0.006 · 输出 $0.60(每 1M tokens)。同页另有 Fireworks 路由 $0.22 / $0.66,主路由与 Novita 路由报 $0.30 / $1.20。口径修正(2026-09-16):聚合平台主档取「池内中位档」——池内共 6 家上游,中位档为 deepseek 输入 $0.3 / 输出 $1.2;原取池内最低档(受单上游撤单影响大)已降为次档。 接入
接口地址https://router.requesty.ai/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:25 定价页https://www.requesty.ai/models-new/deepinfra/deepseek-v4.1-flash | |||||||||||||||||||||||||
| R Routeway(聚合平台) 聚合平台 美元刊例 · 折算展示 | 1.0095 | 0.0202 | 4.038 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-15 汇率口径,沿用表内既有条目)。 版本说明✓ 已核实型号deepseek-v4.1-flash 版本说明模型 ID 为 deepseek-v4.1-flash,即 DeepSeek-V4.1-Flash;据该平台官方接口(https://routeway.ai)当场核对,标的为 DeepSeek-V4.1-Flash 本代版本,非同族旧代。 接入
接口地址https://api.routeway.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-15 08:20 风险说明极低价档与试验性路由不计入,此处取标准档。 定价页https://routeway.ai | |||||||||||||||||||||||||
| C Concentrate.ai(零加价网关) 聚合平台 美元刊例 · 折算展示 | 峰2.019 / 谷1.0095 | 峰0.0404 / 谷0.0202 | 峰8.076 / 谷4.038 | 峰:2026-09-16 复抓 平台公开单模型接口 providers 原文:池内按输入价升序取中位;美元计价,按 1 USD ≈ 6.73 元折算 谷:池内最低档,单上游调价/撤单即失效,仅作比价下限参考 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径聚合口径(2026-09-16 复抓 Concentrate.ai 公开单模型接口 providers(5 家上游)):主档取「池内中位档」(按输入价升序取上中位,不再取最低档)—— 中位档 novita 输入 $0.3 / 缓存 $0.006 / 输出 $1.2,池内区间输入 $0.15 ~ $0.3;人民币价 = 美元价 × 6.73(2026-09-16 汇率 1 USD ≈ 6.73 元)。 版本说明✓ 已核实型号deepseek-v4-1-flash 版本说明模型 ID 为 deepseek-v4-1-flash,即 DeepSeek-V4.1-Flash;据该平台官方接口(https://concentrate.ai/pricing)当场核对,标的为 DeepSeek-V4.1-Flash 本代版本,非同族旧代。口径修正(2026-09-16):聚合平台主档取「池内中位档」——池内共 5 家上游,中位档为 novita 输入 $0.3 / 输出 $1.2;原取池内最低档(受单上游撤单影响大)已降为次档。 接入concentrate.ai 注册 → 开通账号 → 接口 https://api.concentrate.ai/v1 (OpenAI 兼容)。平台为零加价网关(官方定价页写明 No platform markup on tokens,无服务费)。也支持 BYOK(自带上游密钥)消耗已有额度。 口径与备注核实时间2026-09-16 20:14 风险说明该平台为零加价网关:报价即各上游服务商的刊例价,本身不额外加价,故与直连上游渠道同价,不构成独立的一路供给。池内各上游的上下文长度与量化方式可能不同,横向比较时留意。 定价页https://concentrate.ai/pricing | |||||||||||||||||||||||||
| L LLM Gateway(聚合平台) 聚合平台 美元刊例 · 折算展示 | 1.01 | 0.02 | 4.04 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号deepseek-v4.1-flash 版本说明已核实(据官方模型目录接口):deepseek-v4.1-flash 输入 $0.15 · 缓存读 $0.003 · 输出 $0.60(每 1M tokens),按上游刊例价转发。 接入
接口地址https://api.llmgateway.io/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 定价页https://llmgateway.io/pricing | |||||||||||||||||||||||||
| D DeepInfra 自部署 美元刊例 · 折算展示 | 1.35 | 0.04 | 4.04 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.06 · 缓存 $0.015 · 输出 $0.18(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号deepseek-ai/DeepSeek-V4.1-Flash 版本说明已核实(据官方模型目录接口):deepseek-ai/DeepSeek-V4.1-Flash 输入 $0.20 · 缓存读 $0.006 · 输出 $0.60(每 1M tokens)。 接入
接口地址https://api.deepinfra.com/v1/openai 其官网价格与在 OpenRouter 上的报价一致($0.06/$0.18)。 口径与备注核实时间2026-09-17 20:04 定价页https://deepinfra.com/deepseek-ai/DeepSeek-V4.1-Flash | |||||||||||||||||||||||||
| V Vercel AI Gateway 聚合网关 美元刊例 · 折算展示 | 峰2.02 / 谷1.01 | 峰0.04 / 谷0.02 | 峰8.08 / 谷4.04 | 峰:北京时间 09:00–12:00、14:00–18:00(×2)(美元计价 · 按 1 USD ≈ 6.73 元(2026-09-13)) 谷:美元计价 · 按 1 USD ≈ 6.73 元(2026-09-13) | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径)。 版本说明✓ 已核实型号deepseek/deepseek-v4.1-flash 版本说明已核实(据官网模型页内嵌数据):deepseek-v4.1-flash,1,000,000 上下文、最大输出 384,000;输入 $0.15 · 缓存读取 $0.003 · 输出 $0.60(每 1M tokens)。页面同时给出峰谷倍率配置:周一至周五两个时段(对应北京时间 09:00–12:00 与 14:00–18:00)价格 ×2。 接入
官方模型页公开列出价格,可自行核对。 口径与备注核实时间2026-09-16 20:29 定价页https://vercel.com/ai-gateway/models/deepseek-v4.1-flash | |||||||||||||||||||||||||
| F Fireworks AI 自部署 美元刊例 · 折算展示 | 1.48 | 0.05 | 4.44 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径)。 版本说明✓ 已核实型号fireworks/deepseek-v4p1-flash 版本说明已核实(据官方 docs 价格表):DeepSeek V4.1 Flash 模型 id fireworks/deepseek-v4p1-flash,Standard 档 输入 $0.22 · 缓存 $0.007 · 输出 $0.66(每 1M tokens);同表另列 Priority 档 $0.275 / $0.00875 / $0.825,本条取 Standard 档。 接入
接口地址https://api.fireworks.ai/inference/v1 Standard 档即本站价格,Priority 档是加价 25% 的提速选项,批量推理打五折。 口径与备注核实时间2026-09-16 20:31 定价页https://docs.fireworks.ai/serverless/pricing | |||||||||||||||||||||||||
| I Impossibl(聚合平台) 聚合平台 美元刊例 · 折算展示 | 2.02 | 0.04 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号deepseek/deepseek-v4.1-flash 版本说明已核实(据官方模型目录接口):deepseek/deepseek-v4.1-flash 输入 $0.30 · 缓存 $0.006 · 输出 $1.20(每 1M tokens)。 接入
接口地址https://api.impossibl.com/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 17:17 定价页https://impossibl.com | |||||||||||||||||||||||||
| M MegaNova 聚合平台 美元刊例 · 折算展示 | 2.02 | 0.04 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号deepseek-ai/DeepSeek-V4.1-Flash 版本说明已核实(据官方模型目录接口):deepseek-ai/DeepSeek-V4.1-Flash 输入 $0.30 · 缓存读 $0.006 · 输出 $1.20(每 1M tokens)。 接入
接口地址https://api.meganova.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 定价页https://meganova.ai | |||||||||||||||||||||||||
| T Together AI 自部署 美元刊例 · 折算展示 | 2.02 | 0.04 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径)。 版本说明✓ 已核实型号deepseek-ai/DeepSeek-V4.1-Flash 版本说明已核实(据官方 docs Serverless 模型表):deepseek-ai/DeepSeek-V4.1-Flash,1,000,000 上下文,输入 $0.30 · 缓存 $0.006 · 输出 $1.20(每 1M tokens),页面标注量化方式为 FP8。 接入
接口地址https://api.together.xyz/v1 Serverless 即开即用,另有独享吞吐(Provisioned Throughput)按需选。 口径与备注核实时间2026-09-16 20:31 定价页https://docs.together.ai/docs/serverless/models | |||||||||||||||||||||||||
| C Cortecs 聚合平台 欧元刊例 · 折算展示 | 3.0218 | 0.7874 | 9.0586 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-15 汇率口径,沿用表内既有条目)。 版本说明✓ 已核实型号deepseek-v4.1-flash 版本说明模型 ID 为 deepseek-v4.1-flash,即 DeepSeek-V4.1-Flash;据该平台官方接口(https://cortecs.ai)当场核对,标的为 DeepSeek-V4.1-Flash 本代版本,非同族旧代。 接入
接口地址https://api.cortecs.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 风险说明欧洲节点,原站以欧元刊例。 定价页https://cortecs.ai | |||||||||||||||||||||||||
| I InferX 自部署 美元刊例 · 折算展示 人工核录 | 0.518 | 0.0165 | 1.036 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径折后美元价:输入 $0.077 · 缓存 $0.00245 · 输出 $0.154(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-12 汇率)折算,汇率或折扣变动时随之变化。 人工核录价目锁在登录后/仅控制台可见,需人工定期核对(建议每周),非实时刷新。 版本说明✓ 已核实型号deepseek-v4.1-flash 版本说明折后价(限时):deepseek-v4.1-flash 输入 $0.077 · 缓存 $0.00245 · 输出 $0.154(每 1M tokens),刊例 $0.22 / $0.44 的 35 折。该价目只在平台账户内展示,需自行核对。 接入
接口地址https://model.inferx.net/endpoints/v1 按量计费,无订阅、无最低消费。 口径与备注核实时间2026-09-13 17:17 风险说明折扣随时调整,取消后按刊例计费;该价目需在平台账户内自行核对。 厂家身份自建算力运行开源权重的按量推理平台,价格按刊例折扣浮动 定价页https://model.inferx.net/catalog/endpoints/deepseek-v4.1-flash | |||||||||||||||||||||||||
| D DoubleWord 自部署 美元刊例 · 折算展示 | 0.5384 ~ 1.0095 | 0.0673 | 2.019 ~ 4.038 | 无峰谷定价 实时(即时返回) / 异步(约 1 分钟起) / 批次(最长 24 小时交付) | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例(每 1M token,输入价):实时 $0.15、$0.12、$0.08,按 1 USD ≈ 6.73 元折算。人民币价 = 美元价 × 6.73(2026-09-14 汇率),汇率波动时人民币价随之变化。 版本说明✓ 已核实型号DeepSeek V4.1 Flash 版本说明已核实:其官方文档价格表按「输入 / 缓存读取 / 输出」三列列出「DeepSeek V4.1 Flash」的每百万 token 价,并分实时、异步、批次三档(美元计价)。 接入
接口地址https://api.doubleword.ai/v1 价格取自官方文档价格表,读者可直接打开核对。 口径与备注核实时间2026-09-14 22:20 风险说明海外推理服务商,按交付速度分档:实时档即时返回,异步档约 1 分钟起处理,批次档按文件批量提交、24 小时内交付。三档为同一模型、质量一致,差别只在等待时间与价格,批次档不适用于需要即时响应的场景。缓存命中价约为输入价的 10%~20%。 定价页https://docs.doubleword.ai/inference-api/models | |||||||||||||||||||||||||
| N NanoGPT 聚合网关 美元刊例 · 折算展示 | 1.05 | 0.21 | 2.1 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径)。 版本说明✓ 已核实型号deepseek/deepseek-v4.1-flash 版本说明已核实(据官方模型目录接口):deepseek/deepseek-v4.1-flash,1,000,000 上下文、最大输出 384,000,支持视觉 / 思考 / 工具调用;输入 $0.1562 · 缓存读取 $0.03124 · 输出 $0.3124(每 1M tokens)。⚠️ 同一接口的结构化字段另标 输入 $0.10 / 输出 $0.40,与该价目文字不一致,本条取可直接核对的价目文字。 接入
按量计费;另有套餐档位。 口径与备注核实时间2026-09-16 20:24 风险说明该平台对同一模型给出两套数字:价目文字(输入 $0.1562 / 输出 $0.3124)与接口结构化字段(输入 $0.10 / 输出 $0.40)不一致,实际以调用结算为准;平台另注明该模型为限流测试通道,容量有限。 定价页https://nano-gpt.com/models | |||||||||||||||||||||||||
| O OrcaRouter(零加价网关) 聚合网关 美元刊例 · 折算展示 | 1.01 | 0.02 | 4.04 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:闲时 输入 $0.242 · 缓存读 $0.0077 · 输出 $0.726;峰时全档 ×2(每 1M token)。缓存读价 $0.0077 为全表海外最低档。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号deepseek/deepseek-v4.1-flash 版本说明已核实(据官方模型目录接口):deepseek/deepseek-v4.1-flash 输入 $0.15 · 缓存读 $0.003 · 输出 $0.60(每 1M tokens)。该平台零 token 加价,此价即上游 provider 刊例价。 接入
免费档 3 个 API Key;支持 BYOK 自带上游 Key。零 token 加价:按上游 provider 刊例原价计费,收入来自 Team($499/月)等功能费。 OpenAI/Anthropic 双协议兼容) 口径与备注核实时间2026-09-17 20:04 定价页https://www.orcarouter.ai/models/deepseek-v4-flash-0731 | |||||||||||||||||||||||||
| A AiHubMix 聚合中转 美元刊例 · 折算展示 | 峰2.08 / 谷1.04 | 峰0.04 / 谷0.02 | 峰8.34 / 谷4.17 | 峰:09:00–12:00、14:00–18:00 GMT+8 谷:12:00–14:00、18:00–09:00 GMT+8 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元挂牌价:输入 $0.142 · 缓存读 $0.0284 · 输出 $0.284(每 1M token,实际按路由结算)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算。 版本说明✓ 已核实型号deepseek-v4.1-flash 版本说明已核实(据官网模型页):DeepSeek V4.1 Flash 分峰谷计价 —— 空闲时段(12:00–14:00、18:00–09:00 GMT+8)输入 $0.155 · 缓存读 $0.0031 · 输出 $0.62;高峰时段 输入 $0.3098 · 缓存读 $0.0062 · 输出 $1.2392(每 1M tokens)。上游为 DeepSeek 官方接口。 接入
聚合中转站,支持中文界面,国内可直连。 口径与备注核实时间2026-09-13 17:17 定价页https://aihubmix.com/model/deepseek-v4.1-flash | |||||||||||||||||||||||||
| E Eden AI(聚合平台) 聚合平台 美元刊例 · 折算展示 | 峰3.5501 / 谷1.065 | 峰0.8875 / 谷0.1065 | 峰10.6502 / 谷4.2601 | 峰:池内最高档,仅作比价上限参考,已含平台 5.5% 服务费 谷:池内最低档,单上游调价/撤单即失效,仅作比价下限参考,已含平台 5.5% 服务费 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径聚合口径(2026-09-16 复抓 Eden AI 公开模型目录接口(5 家上游)):主档取「池内中位档」(按输入价升序取上中位,不再取最低档)—— 中位档 fireworks_ai 输入 $0.22 / 缓存 $0.007 / 输出 $0.66,池内区间输入 $0.15 ~ $0.5;平台另收 5.5% 服务费,人民币价 = 美元价 × 1.055 × 6.73(2026-09-16 汇率 1 USD ≈ 6.73 元)。 版本说明✓ 已核实型号DeepSeek V4.1 Flash 版本说明已核实(2026-09-14 平台公开模型目录接口原文):该平台目录逐条给出模型标识、上游服务商、上下文长度与按 token 的三列价;表中取各上游的刊例价(非折后价)。本模型在目录中标注为「DeepSeek V4.1 Flash」,池内共 4 家上游(4 条可用报价),最低 qwen,最高 tensorx。口径修正(2026-09-16):聚合平台主档取「池内中位档」——池内共 5 家上游,中位档为 fireworks_ai 输入 $0.22 / 输出 $0.66;原取池内最低档(受单上游撤单影响大)已降为次档。,已含平台 5.5% 服务费 接入
接口地址https://api.edenai.run/v3 价格取自平台公开定价页与其公开模型目录,读者可直接打开核对。 口径与备注核实时间2026-09-16 20:14 风险说明聚合网关:本身不加工上游定价,报价为各上游服务商刊例价,另按 5.5% 收取平台服务费,表中价格已含该费用。同一模型池内多家上游的报价与上下文长度可能不同,若不指定上游,实际可能路由到池内任一家,横向比较时留意。 定价页https://www.edenai.co/pricing | |||||||||||||||||||||||||
| N Near AI 自营推理 美元刊例 · 折算展示 | 2.019 | 0.0404 | 8.076 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-15 汇率口径,沿用表内既有条目)。 版本说明✓ 已核实型号deepseek/deepseek-v4.1-flash 版本说明模型 ID 为 deepseek/deepseek-v4.1-flash,即 DeepSeek-V4.1-Flash;据该平台官方接口(https://cloud-api.near.ai/v1/model/list)当场核对,标的为 DeepSeek-V4.1-Flash 本代版本,非同族旧代。 接入
注意旧端点 api.near.ai 已于 2025-10-31 退役,新版 private.near.ai 需 Bearer token。 cloud-api.near.ai,OpenAI 兼容)按 token 结算 口径与备注核实时间2026-09-17 20:04 风险说明版本为 V4 Flash 初版(非 0731),与 0731 版口径不完全可比。价格 $0.17/$0.035/$0.35 在机密计算类渠道里偏低(Phala 同模型 $0.44/$0.028/$1.32),但比普通明文推理渠道贵一截——多付的钱买的是 TEE 隐私(TDX 机密 CVM、可远程 attest),不是性能。主体为 NEAR 协议官方(GitHub 2017 年、75 仓库),价格竞争力一般;页面较简陋属产品设计取舍,不代表主体不正规。 定价页https://cloud-api.near.ai/v1/model/list | |||||||||||||||||||||||||
| B BazaarLink 聚合网关 美元刊例 · 折算展示 | 2.02 | 0.0404 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.20 · 缓存 $0.03 · 输出 $0.40(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算;台币计费另按其汇率。 版本说明✓ 已核实型号deepseek-v4.1-flash(显示名 Deepseek V4.1 Flash) 版本说明已核实(据官方模型目录接口):模型 id deepseek-v4.1-flash,输入 $0.30 · 输出 $1.20(每 1M tokens),1M 上下文、支持文本与图像输入。目录未单列缓存读价,缓存档按输入价计入。 2026-09-16 全量核对:官网价目表列序为 输入/输出/缓存读,本 SKU 缓存读为 $0.006;本站该条此前缓存读与输入价同值,已按官网价目表修正(输入/输出未变)。 接入
接口地址https://api.bazaarlink.ai/v1(OpenAI 台灣時區中文支援。 口径与备注核实时间2026-09-16 21:00 风险说明模型目录未单列缓存命中价,缓存档按输入价计入,与带缓存折扣的渠道不直接可比。 定价页https://bazaarlink.ai/models | |||||||||||||||||||||||||
| N Novita AI 自部署 美元刊例 · 折算展示 | 2.02 | 0.04 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.44 · 缓存 $0.028 · 输出 $1.32(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号deepseek/deepseek-v4.1-flash 版本说明已核实(据官方模型目录接口):deepseek/deepseek-v4.1-flash 输入 $0.30 · 缓存读 $0.006 · 输出 $1.20(每 1M tokens)。 接入
接口地址https://api.novita.ai/v3/openai 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 17:17 定价页https://novita.ai/models | |||||||||||||||||||||||||
| W Wafer 自营推理 美元刊例 · 折算展示 | 2.02 | 0.04 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.10 · 缓存读 $0.05 · 输出 $0.25(每 1M token),取自官方接口。人民币价 = 美元价 × 6.73(2026-09-10 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号DeepSeek-V4.1-Flash 版本说明已核实(据官方模型目录接口):DeepSeek-V4.1-Flash 输入 $0.30 · 缓存读 $0.006 · 输出 $1.20(每 1M tokens),自营推理集群、支持零数据留存与图像理解,仅按量调用。 接入
接口地址https://pass.wafer.ai/v1/chat/completions 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 17:17 定价页https://pass.wafer.ai/v1/models | |||||||||||||||||||||||||
| M Morph(morphllm.com) 自营推理 美元刊例 · 折算展示 | 2.02 | 0.0606 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例(官网 morphllm.com/pricing):输入 $0.30 · 缓存读 $0.009 · 输出 $1.20(每 1M token)。人民币价 = 美元价 × 6.73(汇率 1 USD = 6.73 元)折算。 版本说明✓ 已核实型号morph-dsv41flash 版本说明已核实(据官网定价页):DeepSeek V4.1 Flash 模型名 morph-dsv41flash,标价 输入 $0.30 · 缓存 $0.03 · 输出 $1.20(每 1M tokens),1M 上下文。 2026-09-16 全量核对复抓:官网 Featured 表 morph-dsv41flash 缓存读为 $0.009(旧记 $0.03),输入 $0.30 / 输出 $1.20 不变。另更正本条目旧 fxNote 误抄 v4-flash 价的问题。 接入
官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-16 21:00 定价页https://www.morphllm.com/pricing | |||||||||||||||||||||||||
| S Synthetic.new 自营推理 美元刊例 · 折算展示 | 5.38 | 1.08 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号hf:deepseek-ai/DeepSeek-V4.1-Flash 版本说明已核实(据官方模型目录接口):hf:deepseek-ai/DeepSeek-V4.1-Flash 输入 $0.80 · 缓存 $0.16 · 输出 $1.20(每 1M tokens)。 接入
接口地址https://api.synthetic.new/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 17:17 定价页https://synthetic.new | |||||||||||||||||||||||||
| B BitDeer 自营推理 美元刊例 · 折算展示 | 1.01 | 0.02 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径)。 版本说明✓ 已核实型号deepseek-ai/DeepSeek-V4.1-Flash 版本说明已核实(据官方价目接口):deepseek-ai/DeepSeek-V4.1-Flash 输入 $0.15 · 缓存读 $0.003 · 输出 $1.20(每 1M tokens),接口标 discountPercent 0,即无进行中促销,属正常挂牌价。输入与官方空闲档一致,输出按官方高峰档计价。 接入
官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 厂家身份Bitdeer Technologies Group(纳斯达克上市 BTDR,比特大陆系,NVIDIA 官方云合作伙伴) 定价页https://www.bitdeer.ai/en/pricing/ai-models | |||||||||||||||||||||||||
| P Parasail 自营推理 美元刊例 · 折算展示 | 2.02 | 0.04 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径)。 版本说明✓ 已核实型号parasail-deepseek-v41-flash 版本说明已核实(据官方 billing 价格表):parasail-deepseek-v41-flash,即 DeepSeek-V4.1-Flash,输入 $0.30 · 输出 $1.20 · 缓存 $0.006(每 1M tokens)。 接入
价格与 OpenRouter 池内挂价一致(OR 加价为 0)。 口径与备注核实时间2026-09-16 20:29 定价页https://docs.parasail.io/parasail-docs/billing/services-billing | |||||||||||||||||||||||||
| C Canopywave 自营推理 美元刊例 · 折算展示 | 2.02 | 0.04 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径)。 版本说明✓ 已核实型号DeepSeek-V4.1-Flash 版本说明已核实(据官网定价页):DeepSeek-V4.1-Flash 输入 $0.30 · 输出 $1.20 · 缓存 $0.006(每 1M tokens)。 接入
接口地址https://api.canopywave.io/v1 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 18:35 定价页https://canopywave.com/pricing | |||||||||||||||||||||||||
| R RedPill(聚合网关) 聚合网关 美元刊例 · 折算展示 | 2.3218 | 0.0464 | 9.2874 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-15 汇率口径,沿用表内既有条目)。 版本说明✓ 已核实型号deepseek/deepseek-v4.1-flash 版本说明模型 ID 为 deepseek/deepseek-v4.1-flash,即 DeepSeek-V4.1-Flash;据该平台官方接口(https://redpill.ai/pricing)当场核对,标的为 DeepSeek-V4.1-Flash 本代版本,非同族旧代。 接入
接口地址https://api.redpill.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 风险说明跨 TEE 隐私推理网络的聚合网关,上游含 Phala、Tinfoil、NEAR AI、Chutes 等。 定价页https://redpill.ai/pricing | |||||||||||||||||||||||||
| T Tinfoil 隐私推理 美元刊例 · 折算展示 | 4.37 | 0.87 | 9.76 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号deepseek-v4-1-flash 版本说明已核实(据官方模型目录接口):模型 id deepseek-v4-1-flash,即 DeepSeek-V4.1-Flash,输入 $0.65 · 缓存 $0.13 · 输出 $1.45(每 1M tokens)。 接入
接口地址https://api.tinfoil.sh/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 定价页https://tinfoil.sh | |||||||||||||||||||||||||
| V Venice AI 隐私推理 美元刊例 · 折算展示 | 2.56 | 0.05 | 10.1 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径)。 版本说明✓ 已核实型号deepseek-v4-1-flash 版本说明已核实(据官方 docs 价格表):deepseek-v4-1-flash,即 DeepSeek-V4.1-Flash,1,000K 上下文,输入 $0.38 · 输出 $1.50 · 缓存 $0.0075(每 1M tokens)。该行标注为私有推理通道。 接入
匿名注册可用。 口径与备注核实时间2026-09-17 19:59 定价页https://docs.venice.ai/overview/pricing | |||||||||||||||||||||||||
| A AI/ML API 聚合网关 美元刊例 · 折算展示 | 2.62 | 0.05 | 10.5 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.195 · 输出 $0.325(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号deepseek/deepseek-v4.1-flash 版本说明已核实(据官网模型页):deepseek/deepseek-v4.1-flash 输入 $0.39 · 缓存输入 $0.0078 · 输出 $1.56(每 1M tokens),1M 上下文、最大输出 384K、默认开启思考模式。 接入
接口地址https://api.aimlapi.com/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-17 20:04 定价页https://aimlapi.com/models/deepseek-v4-1-flash | |||||||||||||||||||||||||
| B B.AI(b.ai) ⚠ 低价参考 · 谨慎 版本存疑 | 0.1009 | 0.002 | 0.4038 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本存疑 版本说明按活动价一折计;折扣随官方分时口径联动 接入
口径与备注核实时间2026-09-17 备注平台公开价目表(美元 / 100 万 tokens,按 token 四列价)+ 限时一折活动价(按标准价 10% 结算)。价格入口:原 b.ai 首页已改纯前端渲染、不再下发价目表,现行价目表在文档站 docs.b.ai/llmservice/models/<模型名>/(模型名里的点号要换成连字符),限时优惠另见 docs.b.ai/llmservice/promotions-and-pricing-notices/。2026-09-16 逐页核对标准价:V4.1-Flash 空闲 $0.15/$0.003/$0.60、高峰 $0.30/$0.006/$1.20;GLM-5.3-Flash $0.15/$0.03/$0.50;Qwen3.8-Flash $0.16/$0.016/$0.47;MiMo-V2.5 $0.14/$0.0028/$0.28。2026-09-17 复核优惠公告页:四条仍按标准价 10% 结算(V4.1-Flash 空闲与高峰同为 10%,GLM-5.3-Flash 标「低至 10%」),与库内折后值一致;首页横幅旧「五折」文案已撤,不再有口径冲突。卡片入口为本站邀请链接(含邀请码),点击直达注册/登录页。 风险说明该站为 Web3 形态:以链上结算为底座,账户身份可与链上地址绑定、资金由使用方自行保管,同时也提供常规账号登录。下列价是它自 2026-09-12 10:00 起的限时一折活动价(按标准价 10% 结算;GLM-5.3-Flash 官方用词为「低至 10%」),页面未标注结束时间、随时可能回调;活动价随官方分时口径同步变动(高峰为工作日 09:00-12:00 与 14:00-18:00,其余含周末为空闲)。折扣幅度明显偏大,接入前请自行判断。 活动未标注结束时间;标准价本身随分时变动,故实际单价随时段浮动。该站模型目录以海外一线型号为主,此处只列与我方价格表可比、且当前在活动期内的型号。 | |||||||||||||||||||||||||
| B B.AI(b.ai) ⚠ 低价参考 · 谨慎 版本存疑 | 0.2019 | 0.004 | 0.8076 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本存疑 版本说明高峰 = 工作日 09:00-12:00 与 14:00-18:00(UTC+8) 接入
口径与备注核实时间2026-09-17 备注平台公开价目表(美元 / 100 万 tokens,按 token 四列价)+ 限时一折活动价(按标准价 10% 结算)。价格入口:原 b.ai 首页已改纯前端渲染、不再下发价目表,现行价目表在文档站 docs.b.ai/llmservice/models/<模型名>/(模型名里的点号要换成连字符),限时优惠另见 docs.b.ai/llmservice/promotions-and-pricing-notices/。2026-09-16 逐页核对标准价:V4.1-Flash 空闲 $0.15/$0.003/$0.60、高峰 $0.30/$0.006/$1.20;GLM-5.3-Flash $0.15/$0.03/$0.50;Qwen3.8-Flash $0.16/$0.016/$0.47;MiMo-V2.5 $0.14/$0.0028/$0.28。2026-09-17 复核优惠公告页:四条仍按标准价 10% 结算(V4.1-Flash 空闲与高峰同为 10%,GLM-5.3-Flash 标「低至 10%」),与库内折后值一致;首页横幅旧「五折」文案已撤,不再有口径冲突。卡片入口为本站邀请链接(含邀请码),点击直达注册/登录页。 风险说明该站为 Web3 形态:以链上结算为底座,账户身份可与链上地址绑定、资金由使用方自行保管,同时也提供常规账号登录。下列价是它自 2026-09-12 10:00 起的限时一折活动价(按标准价 10% 结算;GLM-5.3-Flash 官方用词为「低至 10%」),页面未标注结束时间、随时可能回调;活动价随官方分时口径同步变动(高峰为工作日 09:00-12:00 与 14:00-18:00,其余含周末为空闲)。折扣幅度明显偏大,接入前请自行判断。 活动未标注结束时间;标准价本身随分时变动,故实际单价随时段浮动。该站模型目录以海外一线型号为主,此处只列与我方价格表可比、且当前在活动期内的型号。 | |||||||||||||||||||||||||
| 没有符合条件的渠道,试试放宽筛选。 | |||||||||||||||||||||||||
| 渠道 | 套餐 | 费用 元 | 额度 | 元 / 百万 tokens | 官网 |
|---|---|---|---|---|---|
| O OpenCode Go | Go 订阅(首月 $5 · 续费 $10/月) |
¥67.3 月 | 60 美元用量 | — | 官网 ↗ |
套餐信息核实时间2026-09-13 18:44 周期月 额度说明按美元价值扣费,路由到当下成本最低且有容量的供应商;额度当月有效不结转 限制与口径持有限制5 小时上限 $12 · 每周上限 $30 · 单模型月额度 $60(DeepSeek V4.1 Flash 单列此档) 计费说明重要:该模型的额度按 4× 用量倍率扣减(官方额度页标「4× usage limits」,限时活动)。页面上「26,000 次 / 5 小时」是乘过倍率后的账面值,按 1 倍口径等效约 6,500 次 / 5 小时;月额度一栏也已由 $15 改标为 $60。超额可开启 Use balance 回落到按量额度。 备注含 14+ 款精选开源模型(DeepSeek V4 Pro / V4.1 Flash / GLM-5.x / Kimi / Qwen / MiniMax / MiMo 等)。API 可导出:OpenAI 兼容 /zen/go/v1/chat/completions 与 Anthropic 兼容 /v1/messages,model ID 前缀 opencode-go/。每工作空间限 1 人订阅。官方未公开每 token 扣费单价,等效价暂无法计算。 套餐页https://opencode.ai/go | |||||
| C CommandCode | Go($1/月 + 处理费) |
¥6.7 月 | 10 美元 credits | 0.11 | 官网 ↗ |
套餐信息核实时间2026-09-13 18:44 周期月 额度说明$10 credits 各档通用(本模型无单模型上限);credits 永不过期可累积;高峰时段(工作日 01–04 与 06–10 UTC,即北京 09–12、14–18 点)单价 ×2 按量对比无 API 调用 折算口径扣减口径等效综合单价(谷时) 等效价计算等效 0.11 元/M;月度可跑 tokens ≈ 额度 ÷ 综合单价(谷时口径) 倍率说明按基准负载(输入:输出 = 3:1、缓存命中 90%)折出综合 $0.163275/M ×($1 ÷ $10 credits)× 汇率 6.73;高峰时段约 ×2。 限制与口径持有限制官方额度页未单列本模型的请求数;该档位为入门档,额度最紧 计费说明只能在 Command Code 官方 Agent 软件内使用——官方文档明确 Go 是唯一不提供 API 的档位;想导出 API 需订更高档位。官方未开放 API 导出口径,不建议变通使用。 备注官方文档:本模型单价与各档一致(输入 $0.15 · 缓存读 $0.003 · 输出 $0.60,每 1M tokens),且官方标注本模型在所有订阅档位均可选。本档无单模型额度,$10 credits 与其它模型共用。 套餐页https://commandcode.ai/zh/pricing | |||||
| C CommandCode | GOAT($10/月 + 处理费) |
¥67.3 月 | 70 美元 credits | 0.18 | 官网 ↗ |
套餐信息核实时间2026-09-13 18:44 周期月 额度说明$70 credits;本模型单模型月额度 $60(限时加成,原 $40,至 2026-09-17);credits 永不过期;高峰时段(工作日 01–04 与 06–10 UTC,即北京 09–12、14–18 点)单价 ×2 折算口径扣减口径等效综合单价(谷时) 等效价计算等效 0.18 元/M;按单模型额度 $60 折算 倍率说明按基准负载(3:1、缓存 90%)综合 $0.163275/M ×($10 ÷ 本模型单模型额度 $60)× 6.73;高峰时段约 ×2。 限制与口径持有限制官方额度页未单列本模型的请求数;单模型月额度 $60 为该档可用的上限 计费说明重要:仅用本模型跑不满 $70 总额度(本模型单模型额度 $60)。官方文档写明本档及以上均可调 Provider API(api.commandcode.ai/provider/v1,OpenAI / Anthropic 兼容),按订阅 credits 计量。 备注官方文档:本模型单价与各档一致(输入 $0.15 · 缓存读 $0.003 · 输出 $0.60,每 1M tokens);官方「DEAL」说明该加成自动生效,在 CLI 里选中本模型即可,无需手动开启。 套餐页https://commandcode.ai/docs/resources/pricing-limits | |||||
| C CommandCode | Pro($20/月 + 处理费) |
¥134.6 月 | 80 美元 credits | 0.31 | 官网 ↗ |
套餐信息核实时间2026-09-13 18:44 周期月 额度说明$80 credits;本模型单模型月额度 $70(限时加成,原 $50,至 2026-09-17);credits 永不过期;高峰时段(工作日 01–04 与 06–10 UTC,即北京 09–12、14–18 点)单价 ×2 折算口径扣减口径等效综合单价(谷时) 等效价计算等效 0.31 元/M;按单模型额度 $70 折算 倍率说明按基准负载(3:1、缓存 90%)综合 $0.163275/M ×($20 ÷ 本模型单模型额度 $70)× 6.73;高峰时段约 ×2。 限制与口径持有限制官方额度页未单列本模型的请求数;单模型月额度 $70 为该档可用的上限 计费说明重要:仅用本模型跑不满 $80 总额度(本模型单模型额度 $70)。官方文档写明本档及以上均可调 Provider API,按订阅 credits 计量。 备注官方文档:本模型单价与各档一致(输入 $0.15 · 缓存读 $0.003 · 输出 $0.60,每 1M tokens);该档在加成后本模型可用额度为全档最高。 套餐页https://commandcode.ai/docs/resources/pricing-limits | |||||
| C CommandCode | Max 10×($100/月 + 处理费) |
¥673 月 | 150 美元 credits | 0.73 | 官网 ↗ |
套餐信息核实时间2026-09-13 18:44 周期月 额度说明$150 credits(标准模型池上限 $150,本模型属开源标准池);全部模型无限制;credits 永不过期;高峰时段(工作日 01–04 与 06–10 UTC,即北京 09–12、14–18 点)单价 ×2 折算口径扣减口径等效综合单价(谷时) 等效价计算等效 0.73 元/M;按标准池上限 $150 折算 倍率说明按基准负载(3:1、缓存 90%)综合 $0.163275/M ×($100 ÷ 标准池上限 $150)× 6.73;高峰时段约 ×2。 限制与口径持有限制官方额度页未单列本模型的请求数;本档标准池上限 $150 即为本模型可用上限 计费说明重要:本模型属标准池,仅用本模型时以标准池上限 $150 为准。官方文档写明可调 Provider API(api.commandcode.ai/provider/v1),按订阅 credits 计量。 备注官方文档:本模型单价与各档一致(输入 $0.15 · 缓存读 $0.003 · 输出 $0.60,每 1M tokens);Max 20× 为各窗口的 10× 两倍。 套餐页https://commandcode.ai/docs/plans/max | |||||
| C CommandCode | Max 20×($200/月 + 处理费) |
¥1346 月 | 300 美元 credits | 0.73 | 官网 ↗ |
套餐信息核实时间2026-09-13 18:44 周期月 额度说明$300 credits(标准模型池上限 $300,本模型属开源标准池);全部模型无限制;credits 永不过期;高峰时段(工作日 01–04 与 06–10 UTC,即北京 09–12、14–18 点)单价 ×2 折算口径扣减口径等效综合单价(谷时) 等效价计算等效 0.73 元/M;按标准池上限 $300 折算 倍率说明按基准负载(3:1、缓存 90%)综合 $0.163275/M ×($200 ÷ 标准池上限 $300)× 6.73;高峰时段约 ×2。 限制与口径持有限制官方额度页未单列本模型的请求数;本档标准池上限 $300 即为本模型可用上限 计费说明重要:本模型属标准池,仅用本模型时以标准池上限 $300 为准。官方文档写明可调 Provider API,按订阅 credits 计量。 备注官方文档:本模型单价与各档一致(输入 $0.15 · 缓存读 $0.003 · 输出 $0.60,每 1M tokens)。 套餐页https://commandcode.ai/docs/plans/max | |||||
| O Ollama Cloud | Pro($20/月) |
¥134.6 月 | 60 美元用量 | 0.37 | 官网 ↗ |
套餐信息核实时间2026-09-13 18:44 周期月 额度说明按官方每 M token 价扣费:DeepSeek V4.1 Flash 输入 $0.15 · 缓存读 $0.003 · 输出 $0.60(高峰时段为工作日 12:00–18:00 UTC,即北京 20:00–次日 2:00,全部 ×2);用完后可按同价续期。 折算口径扣减口径等效综合单价(谷时) 等效价计算等效 0.37 元/M = 官方综合 $0.163275/M ×($20 ÷ 60)× 6.73 倍率说明由官方 token 价 × 订阅杠杆(月费 ÷ 用量 = 1/3)× 汇率 6.73 折出;高峰时段约 ×2。综合单价 $0.163275/M(输入 $0.15 · 缓存 $0.003 · 输出 $0.60,谷时)。 限制与口径持有限制3 路并发;无 5 小时 / 每周上限(2026-08 起改按 token 计费) 计费说明等效价 = 官方单价 ×(月费 ÷ 月度用量)= 按量价的 1/3,非估算。按基准负载(3:1、缓存 90%)折算;高峰翻倍扣费会减少实际可用量。 备注Ollama 为本地运行时起家(9M+ 开发者),云端原生权重、NVIDIA 云托管、零留存不训练;CLI / API / 桌面端通用,兼容现有本地 Ollama 工作流。 缓存价未公开缓存读按 $0.003/M 扣(高峰 $0.006),等效价已按 90% 命中率折入 套餐页https://ollama.com/pricing | |||||
| O Ollama Cloud | Max($100/月) |
¥673 月 | 300 美元用量 | 0.37 | 官网 ↗ |
套餐信息核实时间2026-09-13 18:44 周期月 额度说明按官方每 M token 价扣费:DeepSeek V4.1 Flash 输入 $0.15 · 缓存读 $0.003 · 输出 $0.60(高峰时段为工作日 12:00–18:00 UTC,即北京 20:00–次日 2:00,全部 ×2);用完后可按同价续期。 折算口径扣减口径等效综合单价(谷时) 等效价计算等效 0.37 元/M = 官方综合 $0.163275/M ×($100 ÷ 300)× 6.73 倍率说明由官方 token 价 × 订阅杠杆(月费 ÷ 用量 = 1/3)× 汇率 6.73 折出;高峰时段约 ×2。综合单价 $0.163275/M(输入 $0.15 · 缓存 $0.003 · 输出 $0.60,谷时)。 限制与口径持有限制3 路并发;无 5 小时 / 每周上限(2026-08 起改按 token 计费) 计费说明等效价 = 官方单价 ×(月费 ÷ 月度用量)= 按量价的 1/3,非估算。按基准负载(3:1、缓存 90%)折算;高峰翻倍扣费会减少实际可用量。 备注Ollama 为本地运行时起家(9M+ 开发者),云端原生权重、NVIDIA 云托管、零留存不训练;CLI / API / 桌面端通用,兼容现有本地 Ollama 工作流。 缓存价未公开缓存读按 $0.003/M 扣(高峰 $0.006),等效价已按 90% 命中率折入 套餐页https://ollama.com/pricing | |||||
| 没有符合条件的套餐,试试放宽筛选。 | |||||
*「等效价」口径:TokenPlan 的「等效价格」= 套餐月费 ÷ 该套餐按官方抵扣系数折算出的 token 总量,且按额度 100% 全部用完计算。额度用不完,实际单价会高于此值。
| 渠道 | 元 / 百万 tokens | 元 / 百万 tokens | 元 / 百万 tokens | 峰谷时间 | 官网 | ||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| 智 智谱官方 官方自营 | 0.8 | 0.23 | 2.8 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号glm-5.3-flash(GLM-5.3-Flash,官方当前版;1M 上下文 / 最大输出 128K / 原生多模态) 版本说明已核实(2026-09-11 官方定价页原文):旗舰模型表单列 GLM-5.3-Flash,输入 0.8 / 缓存命中 0.23 / 输出 2.8(元/百万 tokens),上下文 1M,输入模态含图片、视频、文件、文本,缓存存储标注「限时免费」。此前发布的限时五折(0.4 / 0.115 / 1.4)已不在官方定价页出现,此处按官方当前页所示标准价收录。模型规格(官方模型页):总参 320B / 激活 18B,GLM-5 系列首个原生多模态模型。 接入
接口地址https://open.bigmodel.cn/api/paas/v4 官方直连,无中间环节。 口径与备注核实时间2026-09-11 13:50 风险说明思考模式不可关闭(thinking.type 仅支持 enabled),推理过程消耗的 token 计入输出计费。 厂家身份智谱 AI 官方直营平台,模型与价格由官方发布。GLM-5.3-Flash 是 GLM-5 系列首个原生多模态模型,1M 上下文,支持图像、视频、文件输入。 定价页https://bigmodel.cn/pricing | |||||||||||||||||||||||||
| 阿 阿里云百炼 · 原厂直供 原厂直供 | 0.8 | 0.23 | 2.8 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号ZHIPU/GLM-5.3-Flash(原厂直供;1M 上下文 / 最大输出 128K) 版本说明已核实(2026-09-11 阿里云帮助文档原文):页面 ZHIPU/GLM-5.3-Flash 标注推理服务供应商为智谱 AI(原厂直供),华北2(北京)输入 0.8 / 输出 2.8 / 缓存命中 0.23 元每百万 tokens,与智谱官方一致。最大输入 1,048,576、最大输出 131,072。 接入
接口地址https://dashscope.aliyuncs.com 原厂直供,价格随智谱官方。 口径与备注核实时间2026-09-16 20:31 限速限流 RPM 200 · TPM 3,000,000 风险说明此处为按量计费原价,不含限时活动价;活动折扣需在控制台查看。 定价页https://help.aliyun.com/zh/model-studio/glm-5-3-flash-by-zhipu | |||||||||||||||||||||||||
| 腾 腾讯云国际版 TokenHub 原厂直供 美元刊例 · 折算展示 | 1.01 | 0.2 | 3.37 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存 $0.03 · 输出 $0.50(每 1M token,Singapore 区域目录价)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 部署说明腾讯云海外站 版本说明✓ 已核实型号GLM-5.3-Flash(Singapore 区域目录价) 版本说明已核实(2026-09-11 腾讯云国际站官方价目文档原文):Singapore 区域表列 GLM-5.3-Flash 目录价 输入 $0.15 / 输出 $0.50 / 缓存命中 $0.03(每 1M token)。该文档同时载有折扣说明:限时五折结算至 2026-09-10 23:59:59(北京时间),现已届满、恢复按目录价结算。国内站同页另以「新加坡」标签展示本目录价,折算后为 1.07949 / 3.5983 / 0.215898(人民币)。 接入
与国内腾讯云账号体系独立、单独计费。 口径与备注核实时间2026-09-16 20:29 风险说明全时段统一价、无峰谷分时(与国内站 DeepSeek 的峰谷计费不同)。国际站与国内腾讯云账号体系独立、单独计费。该文档下 Singapore / Guangzhou / Silicon Valley 三区域各有一套价目,此处取 Singapore(与智谱国际站同价);Guangzhou 区域另有一套更低的目录价,以控制台实际计费为准。 定价页https://www.tencentcloud.com/document/product/1300/78937 | |||||||||||||||||||||||||
| 腾 腾讯云 TokenHub(广州站) | 0.8 | 0.23 | 2.8 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
部署说明官方未公示部署方式:腾讯云该价目文档同类条目中,DeepSeek 的各条明确标注「原厂直供」,而 GLM 各行均无此标注,官方未说明属于「原厂直供」还是「自部署」,此处不做猜测,以官网说明为准。 版本说明✓ 已核实型号GLM-5.3-Flash(广州站价目) 版本说明已核实(2026-09-11 腾讯云官方价目文档原文):语言模型表(广州站)列 GLM-5.3-Flash,输入 0.8 / 输出 2.8 / 缓存命中 0.23(元/百万 tokens),与该模型官方定价一致,未分峰谷时段。同表另有 GLM-5.3(旗舰)输入 8 / 输出 28 / 缓存 2,属另一条价目。 接入
接口地址https://api.lkeap.cloud.tencent.com 按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:31 风险说明同表另有 GLM-5.3(旗舰)输入 8 / 输出 28 / 缓存 2,与 Flash 是两条独立价目,选型时勿混。 定价页https://cloud.tencent.com/document/product/1823/130055 | |||||||||||||||||||||||||
| 百 百度千帆 自部署 | 0.8 | 0.23 | 2.8 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号GLM-5.3-Flash 版本说明已核实(2026-09-11 百度千帆官方计费文档原文):模型列表中单列 GLM-5.3-Flash,输入 0.0008 / 命中缓存 0.00023 / 输出 0.0028(元/千 tokens),即 0.8 / 0.23 / 2.8 元每百万 tokens,与智谱官方一致,未分峰谷时段。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:29 风险说明同页另有 GLM-5.3(输入 8 / 缓存 2 / 输出 28)与 GLM-5.2、GLM-5.1,属各自独立价目,选型时勿混。 定价页https://cloud.baidu.com/doc/qianfan/s/wmh4sv6ya | |||||||||||||||||||||||||
| 七 七牛云 AI 推理 自部署 | 0.8 | 0.23 | 2.8 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号z-ai/glm-5.3-flash(1M 上下文 / 最大输出 128K) 版本说明已核实(2026-09-15 复核 qiniu.com/ai/models 页面内嵌数据原文):模型 z-ai/glm-5.3-flash,非缓存输入 0.0008 · 缓存输入 0.00023 · 输出 0.0028(元每千 tokens),即 0.8 / 0.23 / 2.8 元每百万 tokens,与官方刊例一致。1M 上下文、128K 最大输出,支持文本 / 图像 / 视频 / 文件输入。该模型上线期曾按官方刊例的半价计费(0.4 / 0.115 / 1.4),现已恢复刊例价。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:29 限速限流 TPM 500 万 风险说明价格随官方刊例调整,上线期优惠结束后已回到官方同价。该平台另售「国产模型融合资源包」,按模型不同有不同抵扣比例,实际结算以控制台为准。 定价页https://www.qiniu.com/ai/models | |||||||||||||||||||||||||
| U UCloud 优刻得 · 星图 AstraFlow 聚合网关 | 0.8 | — | 2.8 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号GLM-5.3-Flash 版本说明已核实(2026-09-11 UCloud 星图官方产品页原文):热门模型区列 GLM-5.3-Flash,标注「单档定价」,输入 0.8 / 输出 2.8(元每百万 tokens),与官方标准价一致;页面未列缓存命中价。页面同区另有 GLM-5.3(输入 8 / 输出 28)。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:29 风险说明同一网关汇聚 200+ 模型,价格随上游调整;页面未公示缓存命中价,实际计费以控制台为准。 定价页https://www.ucloud.cn/site/active/astraflow | |||||||||||||||||||||||||
| 优 优云智算 自部署 | 0.8 | — | 2.8 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号glm-5.3-flash(Zhipu AI;1000K 上下文) 版本说明已核实(2026-09-11 优云智算官方模型广场渲染原文):热门模型区列 glm-5.3-flash(厂商标 Zhipu AI),能力标注视觉理解 / 文本生成 / 深度思考,1000K 上下文,输入 0.8 / 文本输出 2.8(元/百万 Token),与智谱官方一致;页面未列缓存命中价。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-17 19:59 风险说明按量计费(Token 按量结算);页面未列缓存命中价,实际以控制台为准。 定价页https://www.compshare.cn/model-api | |||||||||||||||||||||||||
| 模 模力方舟(Gitee AI) 自部署 | 0.8 | — | 2.8 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号GLM-5.3-Flash(128K / 1M 上下文,原生多模态) 版本说明已核实(2026-09-11 模力方舟模型广场页面):GLM-5.3-Flash 输入 ¥0.8/M、输出 ¥2.8/M,与智谱官方挂牌一致。页面注明支持 1M 上下文与缓存。 接入访问 ai.gitee.com 模型广场可查看在售模型与价格;调用需注册账号 → 创建访问令牌 → 接口 https://ai.gitee.com/v1 (OpenAI 兼容)。平台依托沐曦(MetaX)国产算力。 口径与备注核实时间2026-09-16 19:12 风险说明该平台页面仅标注「缓存支持」,未公布缓存倍率,故缓存价留空。价格以其模型广场当前刊例为准,如遇平台促销可能低于此处所示。 厂家身份模力方舟(Gitee AI),开源中国旗下 AI 模型服务平台,依托沐曦(MetaX)国产算力提供 Serverless API,京ICP备2025119063号。 定价页https://ai.gitee.com/serverless-api | |||||||||||||||||||||||||
| S SiliconFlow 国际版 自部署 美元刊例 · 折算展示 | 1.01 | 0.2 | 3.37 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存 $0.03 · 输出 $0.5(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号zai-org/GLM-5.3-Flash(1049K 上下文 / 262K 最大输出) 版本说明已核实(2026-09-11 SiliconFlow 国际站官方模型页原文):条目 GLM-5.3-Flash(厂商标 Z.ai),Input $0.15 / Cached Input $0.03 / Output $0.5(每 1M tokens),总上下文 1049K、最大输出 262K,标注 Aug 27, 2026 发布。⚠️ 国内站(siliconflow.cn)未上该模型,仅国际站有。 接入
接口地址https://api.siliconflow.com/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-11 13:50 风险说明硅基流动为北京公司,国际站独立计价、与国内站账号体系不互通;国内站无此模型,勿混。 定价页https://www.siliconflow.com/models/glm-5-3-flash | |||||||||||||||||||||||||
| 矩 矩池云 Matpool 自部署 | 0.4 | — | 1.4 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号GLM-5.3-Flash(多模态) 版本说明已核实(2026-09-11 矩池云官方模型广场渲染原文):首页横幅「GLM-5.3-Flash 上线,限时5折,输入低至 ¥0.4/M」,模型条目输入 ¥0.4 / M、输出 ¥1.4 / M(元每百万 tokens),为标准价 0.8 / 2.8 的五折。 接入
接口地址https://token.matpool.com/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-11 13:50 风险说明当前为限时五折价,活动结束后恢复标准价 0.8 / 2.8;页面未列缓存命中价。 定价页https://matpool.com/models | |||||||||||||||||||||||||
| 共 共绩算力 聚合平台 人工核录 | 0.4 | 0.11 | 1.4 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
人工核录价目锁在登录后/仅控制台可见,需人工定期核对(建议每周),非实时刷新。 部署说明平台自述「模型聚合」,同时提供智谱、DeepSeek、月之暗面、阿里等多家模型;各模型的具体供应方式平台未逐项公示。 版本说明✓ 已核实型号z-ai/glm-5.3-flash(1M 上下文 / 最大输出 128K) 版本说明已核实(2026-09-11 平台控制台价目页,并经接口调用交叉验证):模型 id 为 z-ai/glm-5.3-flash,与智谱官方命名一致;接口调用成功,返回含 reasoning_tokens,与思考型模型特征一致。 接入
接口地址https://api.suanli.cn/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-11 15:50 风险说明当前为限时五折价(官方标准价 0.8 / 0.23 / 2.8 元每百万 tokens 的一半),活动结束后会恢复原价。平台同时提供「DeepSeek V4 Flash 预览版」与「V4 Flash 0731」两个在售条目,选型时勿混。 厂家身份北京共绩科技有限公司(京ICP备 2023013220 号-1)运营的弹性算力平台,聚合智谱、DeepSeek、月之暗面、阿里等多家模型。 定价页https://console.suanli.cn/models | |||||||||||||||||||||||||
| 3 302.AI 聚合网关 美元刊例 · 折算展示 | 0.5 | — | 1.68 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.075 · 输出 $0.25(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号glm-5.3-flash 版本说明已核实(2026-09-11 302.AI 官方模型页原文):模型条目 glm-5.3-flash,输入 $0.075 / 输出 $0.25(每 1M tokens),页面未列缓存命中价。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-17 19:59 风险说明聚合网关,一个模型多家上游供货,实际单价随路由浮动;页面未公示缓存命中价,以控制台实际计费为准。 定价页https://302.ai/ | |||||||||||||||||||||||||
| A AutoDL 自部署 | 0.8 | — | 2.8 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号GLM-5.3-flash 版本说明已核实(2026-09-11 AutoDL 官方模型广场渲染原文):模型条目 GLM-5.3-flash 标注「会员7折」,输入 ¥0.560(会员价)/ ¥0.800(原价)每 M token,输出 ¥1.960(会员价)/ ¥2.800(原价),此处按普通用户可见的原价收录;同页另有 GLM-5.3(8 / 28)。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-11 13:50 风险说明开通会员后享 7 折(输入 0.56 / 输出 1.96);页面未列缓存命中价。 定价页https://autodl.art/large-model/market | |||||||||||||||||||||||||
| P PPIO 派欧云 自部署 | 0.8 | 0.23 | 2.8 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号GLM-5.3-Flash(1M 上下文 / 最大输出 131K) 版本说明已核实(2026-09-11 PPIO 官方模型接口数据原文):模型 id zai-org/glm-5.3-flash,输入 0.8 / 缓存读取 0.23 / 输出 2.8(元每百万 tokens,与智谱官方一致);上下文 1,048,576、单次最长输出 131,072。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-11 17:25 风险说明缓存写入(创建)当前标价 0 元,实际以控制台为准。 厂家身份派欧云计算(上海)有限公司(沪ICP备18048206号-33)运营的分布式云计算平台。 定价页https://ppio.com/llm | |||||||||||||||||||||||||
| O OfoxAI 聚合网关 美元刊例 · 折算展示 | 1.01 | 0.2 | 3.37 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存读取 $0.03 · 输出 $0.5(每 1M token,三家上游同价)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号z-ai/glm-5.3-flash(1M 上下文 / 最大输出 131K) 版本说明已核实(2026-09-11 OfoxAI 官方模型页原文):模型条目 z-ai/glm-5.3-flash,可用供应商列为 Volcengine / Z.ai / Bedrock2,三家价格一致:输入 $0.15 / 输出 $0.5 / 缓存读取 $0.03(每 1M token),另列网络搜索 $0.01/次。 接入
接口地址https://api.ofox.ai/v1 按量计费,全时段统一价;联网搜索另按次计费。 口径与备注核实时间2026-09-17 20:04 风险说明含联网搜索等附加计费项($0.01/次),不使用则不计费;聚合网关,实际单价随上游供货浮动。 定价页https://ofox.ai/zh/models/z-ai/glm-5.3-flash | |||||||||||||||||||||||||
| N Naga(聚合平台) 聚合平台 美元刊例 · 折算展示 | 0.2524 | 0.0505 | 0.8413 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号glm-5.3-flash 版本说明模型 ID 为 glm-5.3-flash,即 GLM-5.3-Flash;据该平台官方定价页与官方接口(https://api.naga.ac/v1/models),两者一致。 接入
接口地址https://api.naga.ac/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明报价约为表内同档中位数的 32%,显著低于同业,货源与限速请自行核对。 报价为同类中较低水平,未标注上游供应商,对比时留意。 定价页https://naga.ac/pricing | |||||||||||||||||||||||||
| D DeepInfra 自部署 美元刊例 · 折算展示 | 0.5 | 0.1 | 1.68 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.075 · 缓存 $0.015 · 输出 $0.25(每 1M token,fp4 档折扣价)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号zai-org/GLM-5.3-Flash(fp4 量化,1024K 上下文) 版本说明已核实(2026-09-11 DeepInfra 官方模型列表原文):GLM-5.3-Flash 条目标注 fp4、1024k 上下文,页显「50% off」与「$0.015 cached, $0.075 in, $0.25 out / 1M」。 接入
接口地址https://api.deepinfra.com/v1/openai 按量计费,全时段统一价。 口径与备注核实时间2026-09-11 13:50 风险说明页显折扣价(标 50% off),恢复原价后单价会上浮;此处 fp4 量化档,量化口径与官方 bf16 不同,效果可能有差异。以美元计价,实际扣费以账户账单为准。 定价页https://deepinfra.com/models/text-generation | |||||||||||||||||||||||||
| O OpenRouter(聚合平台) 聚合平台 美元刊例 · 折算展示 | 峰3.0285 / 谷0.5048 | 峰0.6057 / 谷0.1009 | 峰10.095 / 谷1.6825 | 峰:池内最高档,仅作比价上限参考 谷:池内最低档,单上游调价/撤单即失效,仅作比价下限参考 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径聚合口径(2026-09-16 复抓 OpenRouter 官方 endpoints 接口(26 家上游端点)):主档取「池内中位档」(按输入价升序取上中位,不再取最低档)—— 中位档 SiliconFlow 输入 $0.15 / 缓存 $0.03 / 输出 $0.5,池内区间输入 $0.075 ~ $0.45;人民币价 = 美元价 × 6.73(2026-09-16 汇率 1 USD ≈ 6.73 元)。 版本说明✓ 已核实型号z-ai/glm-5.3-flash(1M 上下文) 版本说明已核实(2026-09-11 OpenRouter 官方模型接口原文):模型 ID z-ai/glm-5.3-flash,池内 25 家上游端点,输入 $0.075 ~ $0.45、输出 $0.25 ~ $1.50(每 1M token)。其中 Z.AI 官方端点与另 15 家同价 $0.15 / $0.50。口径修正(2026-09-16):聚合平台主档取「池内中位档」——池内共 26 家上游,中位档为 SiliconFlow 输入 $0.15 / 输出 $0.5;原取池内最低档(受单上游撤单影响大)已降为次档。 接入
接口地址https://openrouter.ai/api/v1 可用 provider 参数指定供应商锁定价格与量化。 口径与备注核实时间2026-09-16 20:14 风险说明同一模型 25 家供应商供货,量化不一(fp4 / fp8 / 未标注混挂),默认路由不保证中位价——主档按池内中位档展示,取下限需用 provider 参数锁定供应商。按用量计费另收平台服务费,推理价零加价,开通即用。默认路由按可用性择优、非按价格排序,故实际单价比表中的池内中位档上下浮动属正常。 定价页https://openrouter.ai/z-ai/glm-5.3-flash | |||||||||||||||||||||||||
| C Concentrate.ai(零加价网关) 聚合平台 美元刊例 · 折算展示 | 峰1.0095 / 谷0.5048 | 峰0.2019 / 谷0.1009 | 峰3.365 / 谷1.6825 | 峰:2026-09-16 复抓 平台公开单模型接口 providers 原文:池内按输入价升序取中位;美元计价,按 1 USD ≈ 6.73 元折算 谷:池内最低档,单上游调价/撤单即失效,仅作比价下限参考 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径聚合口径(2026-09-16 复抓 Concentrate.ai 公开单模型接口 providers(7 家上游)):主档取「池内中位档」(按输入价升序取上中位,不再取最低档)—— 中位档 cloudflare 输入 $0.15 / 缓存 $0.03 / 输出 $0.5,池内区间输入 $0.075 ~ $0.15;人民币价 = 美元价 × 6.73(2026-09-16 汇率 1 USD ≈ 6.73 元)。 版本说明✓ 已核实型号GLM-5.3-Flash(1M 上下文,原生多模态) 版本说明已核实(2026-09-11 平台公开模型接口):条目 glm-5.3-flash 池内 4 家上游,最低 智谱官方 / DeepInfra 输入 $0.075 / 输出 $0.25,最高 Cloudflare 输入 $0.15 / 输出 $0.5。口径修正(2026-09-16):聚合平台主档取「池内中位档」——池内共 7 家上游,中位档为 cloudflare 输入 $0.15 / 输出 $0.5;原取池内最低档(受单上游撤单影响大)已降为次档。 接入concentrate.ai 注册 → 开通账号 → 接口 https://api.concentrate.ai/v1 (OpenAI 兼容)。平台为零加价网关(官方定价页写明 No platform markup on tokens,无服务费)。也支持 BYOK(自带上游密钥)消耗已有额度。 口径与备注核实时间2026-09-16 20:14 风险说明该平台为零加价网关:报价即各上游服务商的刊例价,本身不额外加价,故与直连上游渠道同价,不构成独立的一路供给。池内各上游的上下文长度与量化方式可能不同,横向比较时留意。 厂家身份Concentrate.ai,面向团队的 LLM 网关(站内自述 LLM Gateway),零加价透传各上游刊例价,持 SOC 2 Type II 认证。 定价页https://concentrate.ai/pricing | |||||||||||||||||||||||||
| F FastRouter(聚合平台) 聚合平台 美元刊例 · 折算展示 | 0.5048 | 0.1009 | 1.6825 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号z-ai/glm-5.3-flash 版本说明模型 ID 为 z-ai/glm-5.3-flash,即 GLM-5.3-Flash;据该平台官方定价页与官方接口(https://api.fastrouter.ai/v1/models),两者一致。 接入
接口地址https://api.fastrouter.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 定价页https://fastrouter.ai | |||||||||||||||||||||||||
| L LLM Gateway(聚合平台) 聚合平台 美元刊例 · 折算展示 | 0.5922 | 0.1683 | 1.6825 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号glm-5.3-flash 版本说明模型 ID 为 glm-5.3-flash,即 GLM-5.3-Flash;据该平台官方定价页与官方接口(https://api.llmgateway.io/v1/models),两者一致。 接入
接口地址https://api.llmgateway.io/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明报价低于同类聚合平台,未标注上游供应商,对比时留意。 定价页https://llmgateway.io/pricing | |||||||||||||||||||||||||
| R Routeway(聚合平台) 聚合平台 美元刊例 · 折算展示 | 0.5048 | 0.1009 | 1.6825 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号glm-5.3-flash 版本说明模型 ID 为 glm-5.3-flash,即 GLM-5.3-Flash;据该平台官方定价页与官方接口(https://api.routeway.ai/v1/models),两者一致。 接入
接口地址https://api.routeway.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明极低价档与试验性路由不计入,此处取标准档。 定价页https://routeway.ai | |||||||||||||||||||||||||
| C Cortecs 聚合平台 欧元刊例 · 折算展示 | 0.7083 | 0.1259 | 2.4712 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 EUR 刊例,人民币价 = 原价 × 7.87(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号glm-5.3-flash 版本说明模型 ID 为 glm-5.3-flash,即 GLM-5.3-Flash;据该平台官方定价页与官方接口(https://api.cortecs.ai/v1/models),两者一致。 接入
接口地址https://api.cortecs.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明欧洲节点,原站以欧元刊例。 定价页https://cortecs.ai | |||||||||||||||||||||||||
| R Requesty(聚合平台) 聚合平台 美元刊例 · 折算展示 | 1.0095 | 0.2019 | 3.365 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例为上游透传价:输入 $0.15 · 缓存读 $0.03 · 输出 $0.50(每 1M token),取自官网模型页。人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号zai/glm-5.3-flash(1M 上下文 / 131K 输出) 版本说明已核实(2026-09-11 Requesty 官方模型页原文):模型 ID zai/glm-5.3-flash,官网列 Input $0.15 / Output $0.50 / Cache Read $0.03(每 1M token),7 家上游供应商,透传上游价。与智谱官方美元刊例一致。 接入
接口地址https://router.requesty.ai/v1 可用 provider 参数钉住上游供应商。 口径与备注核实时间2026-09-17 20:04 风险说明聚合网关类(与 OpenRouter 同类):600+ 模型经同一条 API 路由,本身不部署模型。官网明示「No markup / PAYG +5%、BYOK 0%」→ 推理价透传、平台收费在计费方式里。默认路由按可用性择优不保证最低价,可用 provider 参数钉住上游。 定价页https://www.requesty.ai/models-new/zai/glm-5.3-flash | |||||||||||||||||||||||||
| Z ZenMux 聚合平台 美元刊例 · 折算展示 | 1.0095 | 0.2019 | 3.365 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例为上游透传价:输入 $0.15 · 缓存读 $0.03 · 输出 $0.50(每 1M token),取自官网模型目录。人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时随之变化。 版本说明✓ 已核实型号z-ai/glm-5.3-flash(1M 上下文 / 131K 输出) 版本说明已核实(2026-09-11 ZenMux 官方模型目录原文):模型 ID z-ai/glm-5.3-flash,官网列 输入 $0.15 / 缓存读 $0.03 / 输出 $0.50(每 1M token),上下文 1,000,000,官方标注上线时间 2026-08-26,支持图片输入。该价与智谱国际站美元刊例一致,属上游透传。 接入
接口地址https://zenmux.ai/api/v1 口径与备注核实时间2026-09-17 20:04 风险说明聚合网关类(与 OpenRouter 同类):模型经同一条 API 路由,平台本身不部署模型,推理价透传上游。该条目价与智谱官方美元刊例一致,未发现加价。 厂家身份ZenMux,新加坡聚合网关(主体 AI Force Singapore Pte. Ltd.),目录覆盖 189 个模型。 定价页https://zenmux.ai | |||||||||||||||||||||||||
| E Eurouter(聚合平台) 聚合平台 美元刊例 · 折算展示 | 1.346 | 0.3365 | 3.365 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号glm-5.3-flash 版本说明模型 ID 为 glm-5.3-flash,即 GLM-5.3-Flash;据该平台官方定价页与官方接口(https://api.eurouter.ai/v1/models),两者一致。 接入
接口地址https://api.eurouter.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 风险说明部分模型原站以欧元刊例。 定价页https://eurouter.ai/models | |||||||||||||||||||||||||
| I Impossibl(聚合平台) 聚合平台 美元刊例 · 折算展示 | 1.0095 | 0.2019 | 3.365 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号zai/glm-5.3-flash 版本说明模型 ID 为 zai/glm-5.3-flash,即 GLM-5.3-Flash;据该平台官方定价页与官方接口(https://api.impossibl.com/v1/models),两者一致。 接入
接口地址https://api.impossibl.com/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 定价页https://impossibl.com | |||||||||||||||||||||||||
| M MegaNova 聚合平台 美元刊例 · 折算展示 | 1.0095 | 0.2019 | 3.365 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号zai-org/GLM-5.3-Flash 版本说明模型 ID 为 zai-org/GLM-5.3-Flash,即 GLM-5.3-Flash;据该平台官方定价页与官方接口(https://api.meganova.ai/v1/models),两者一致。 接入
接口地址https://api.meganova.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 定价页https://meganova.ai | |||||||||||||||||||||||||
| N NavyAI(聚合平台) 聚合平台 美元刊例 · 折算展示 | 1.0095 | 1.0095 | 3.365 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号glm-5.3-flash 版本说明模型 ID 为 glm-5.3-flash,即 GLM-5.3-Flash;据该平台官方定价页与官方接口(https://api.navy/v1/models),两者一致。该渠道未公布缓存价,此处按无缓存折扣计(缓存档等于输入价)。 接入
接口地址https://api.navy/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明报价明显低于同业,未标注上游供应商,货源请自行核对。 定价页https://api.navy | |||||||||||||||||||||||||
| D Databricks 自部署 美元刊例 · 折算展示 | 1.0096 | 0.2021 | 3.3651 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径该平台以自有计量单位计价:输入 2.143 / 输出 7.143 / 缓存读取 0.429(每 1M token)。折算链路:单位价 × $0.07 = 美元价,再按 1 USD ≈ 6.73 元的汇率折算人民币(即输入 $0.15001 / 输出 $0.50001 / 缓存 $0.03003 每 1M token);汇率与单位单价均会变动,实际以平台结算为准。 版本说明✓ 已核实型号GLM-5.3 Flash 版本说明已核实:其官方企业级模型服务公开定价页明确列出「GLM-5.3 Flash」的按 token 三列价(输入 / 输出 / 缓存读取),折算人民币后入表。该页未标注具体修订版号,按当前版收录。 接入
价格取自平台公开定价页,读者可直接打开核对,并按说明的单位单价折算。 口径与备注核实时间2026-09-16 20:29 风险说明平台按其自有计量单位计价(非美元直标),表中价格已按该单位当期单价折算为人民币,单位单价随所选版本档变化,实际以平台结算为准。该能力需在平台工作区内启用后调用,接入步骤多于一般接口服务;缓存读取价为输入价的 20%。 定价页https://www.databricks.com/product/pricing/foundation-model-serving | |||||||||||||||||||||||||
| F Fireworks AI 自部署 美元刊例 · 折算展示 | 1.01 | — | 3.37 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 输出 $0.5(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号GLM 5.3 Flash(1048576 上下文) 版本说明已核实(2026-09-11 Fireworks 官方模型库原文):Serverless 区列 GLM 5.3 Flash,标注 $0.15/M 输入 · $0.5/M 输出 · 1048576 上下文,与智谱国际站标准价一致。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:31 风险说明Serverless 标准档价格;页面未列缓存命中价,以控制台实际计费为准。 定价页https://fireworks.ai/models | |||||||||||||||||||||||||
| T Together AI 自部署 美元刊例 · 折算展示 | 1.01 | 0.2 | 3.37 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存 $0.03 · 输出 $0.50(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号zai-org/GLM-5.3-Flash 版本说明已核实(2026-09-11 Together 官方模型库原文):模型条目 zai-org/GLM-5.3-Flash(标注 Vision / Reasoning),Cached $0.03 / 1M · Input $0.15 / 1M · Output $0.50 / 1M,与智谱国际站标准价一致。 接入
接口地址https://api.together.xyz/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:31 风险说明Serverless 档价格;页面另标注 Function Calling / JSON Mode / Reasoning / Vision 能力。 定价页https://www.together.ai/models | |||||||||||||||||||||||||
| C Cloudflare Workers AI 自营推理 美元刊例 · 折算展示 | 1.01 | 0.2 | 3.37 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存 $0.03 · 输出 $0.50(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号@cf/zai-org/glm-5.3-flash(1048576 上下文) 版本说明已核实(2026-09-11 Cloudflare 官方模型文档原文):模型 @cf/zai-org/glm-5.3-flash,Unit Pricing 标注 $0.15 per M input tokens · $0.50 per M output tokens · $0.03 per M cached input tokens,上下文 1048576 tokens。 接入
需 Workers 计费方案或额度。 口径与备注核实时间2026-09-16 20:29 风险说明该模型不在 Workers 标准额度内,需计费方案或额度才能调用。 定价页https://developers.cloudflare.com/workers-ai/models/glm-5.3-flash/ | |||||||||||||||||||||||||
| D DigitalOcean 自营推理 美元刊例 · 折算展示 | 1.01 | 0.2 | 3.37 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存 $0.03 · 输出 $0.50(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号GLM-5.3 Flash(Z.ai) 版本说明已核实(2026-09-11 DigitalOcean 官方定价文档原文):Z.ai 分区列 GLM-5.3 Flash,Input $0.15 per 1M tokens · Output $0.50 per 1M tokens · Prompt caching $0.03 per 1M tokens。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:29 风险说明Serverless 按量价格;另有独占推理(Dedicated Inference)按 GPU 小时计费,与本价不同。 定价页https://docs.digitalocean.com/products/gradient-ai-platform/details/pricing/ | |||||||||||||||||||||||||
| F FriendliAI 自部署 美元刊例 · 折算展示 | 1.01 | 0.2 | 3.37 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存 $0.03 · 输出 $0.5(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号zai-org/GLM-5.3-Flash(1M 上下文) 版本说明已核实(2026-09-11 FriendliAI 官方模型页原文):条目 zai-org/GLM-5.3-Flash,Pricing - Model APIs 区标注 Input $0.15 / 1M tokens · Cached Input $0.03 / 1M tokens · Output $0.5 / 1M tokens,上下文 1M。页面版本字段为 5.3 / Flash,即同名当前版。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-16 19:12 风险说明此处为 Model APIs(按量)档价;同页另有专用端点(Dedicated Endpoints)按算力计费,与本价不同。 定价页https://friendli.ai/models/zai-org/GLM-5.3-Flash | |||||||||||||||||||||||||
| W WandB Inference 自营推理 美元刊例 · 折算展示 | 1.01 | 0.34 | 3.37 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存 $0.05 · 输出 $0.50(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Z.AI GLM 5.3 Flash(1M 上下文) 版本说明已核实(2026-09-11 Weights & Biases 官方 Serverless Inference 页渲染原文):可用模型区列 Z.AI GLM 5.3 Flash,标注 $0.15 input / $0.05 cached / $0.50 output(每 1M tokens),1M 上下文、320B 总参 18B 激活、支持视觉。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:31 风险说明缓存命中价 $0.05 略高于官方 $0.03;页面未列更高档位说明。 定价页https://wandb.ai/site/inference | |||||||||||||||||||||||||
| I Infron(零加价网关) 聚合网关 美元刊例 · 折算展示 | 1.01 | 0.2 | 3.37 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:Standard 档 输入 $0.15 · 缓存读 $0.03 · 输出 $0.5(每 1M token),无折扣。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 部署说明零加价路由 版本说明✓ 已核实型号z-ai/glm-5.3-flash 版本说明已核实(2026-09-15 据该站官方模型页数据):GLM-5.3-Flash 仅 Standard 一档,输入 $0.15 · 缓存读 $0.03 · 输出 $0.5(每 1M tokens),池内 2 家上游(z-ai 与 deepinfra 同价),无折扣。与智谱官方美元刊例一致。 接入
接口地址https://api.infron.ai/v1 零 token 加价,平台按 $0.35 + 5% 收取账户服务费。仅 Standard 档。 口径与备注核实时间2026-09-15 20:58 风险说明价格口径:这里的价格取自该站模型页卡片标示的「Avg list price」,即该档位池内全部可用上游的算术平均;站内逐上游明细另列每家单价,最低的一条常显著低于此均值。该站原话「your request is billed at the rate of the provider it is routed to」—— 实际费用取决于当次路由到的上游,故此处均值偏保守。折扣时效:部分上游当前有折扣,幅度与期限由各上游自行调整,随时可能回调。资历:域名 2026-01-07 注册,公司很新,零加价模式下无动力压价,但长周期可靠性未经验证,建议按需使用,不建议一次性投入大额资金。 定价页https://infron.ai/models/z-ai/glm-5.3-flash | |||||||||||||||||||||||||
| I InferX 自部署 美元刊例 · 折算展示 人工核录 | 0.303 | 0.0606 | 1.01 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径折后美元价:输入 $0.045 · 缓存 $0.009 · 输出 $0.15(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-12 汇率)折算,汇率或折扣变动时随之变化。 人工核录价目锁在登录后/仅控制台可见,需人工定期核对(建议每周),非实时刷新。 版本说明✓ 已核实型号glm-5.3-flash(开源权重,1M 上下文) 版本说明已核实:官方模型接口返回 zai-org/GLM-5.3-Flash(开源权重仓库),属自建算力部署而非官方接口转售。平台公开的 24 小时缓存命中率为 94.0%。 接入
接口地址https://model.inferx.net/endpoints/v1 按量计费,无订阅、无最低消费。 口径与备注核实时间2026-09-12 17:10 条目备注专用域名 2025-01 注册、注册有效期 3 年;已运营约 1 年 7 个月 风险说明价格随折扣浮动:当前为刊例 70% 折扣后的价格,折扣随时调整,取消折扣后按刊例计费;自建算力运行开源权重,无模型方授权背书与可用性承诺;公司主体未公开。使用前请以官方页面当前折扣为准。 厂家身份自建算力运行开源权重的按量推理平台,价格按刊例折扣浮动 定价页https://model.inferx.net/catalog/endpoints/glm-5.3-flash | |||||||||||||||||||||||||
| B BitDeer 自营推理 美元刊例 · 折算展示 | 0.5 | 0.1 | 1.68 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例(SALE 档):输入 $0.075 · 缓存 $0.015 · 输出 $0.25(每 1M token);标准价 $0.15 / $0.03 / $0.50。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算。 版本说明✓ 已核实型号zai-org/GLM-5.3-Flash 版本说明已核实(2026-09-11 BitDeer 官方价目页渲染原文):语言模型表列 zai-org/GLM-5.3-Flash 并标 SALE,输入 $0.15 → $0.075、输出 $0.50 → $0.25、缓存命中 $0.03 → $0.015(每 1M tokens),折后价恰为标准价五折;页首注明「Prices shown may reflect limited-time promotions」。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-17 20:04 风险说明页首明示价格可能含限时促销,活动结束后按标准价结算;以账户实际账单为准。 定价页https://www.bitdeer.ai/en/pricing/ai-models | |||||||||||||||||||||||||
| O OrcaRouter(零加价网关) 聚合网关 美元刊例 · 折算展示 | 0.5 | 0.12 | 1.68 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.075 · 缓存读取 $0.01725 · 输出 $0.25(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 部署说明零加价路由 版本说明✓ 已核实型号z-ai/glm-5.3-flash(1M 上下文 / 最大输出 128K) 版本说明已核实(2026-09-11 OrcaRouter 官方模型接口原文):条目 id z-ai/glm-5.3-flash,归属 z-ai,上下文 1,000,000、单次最长输出 128,000;输入 $0.075 / 缓存读取 $0.01725 / 输出 $0.25(每 1M token)。 接入
接口地址https://api.orcarouter.ai/v1 零 token 加价;支持 BYOK 自带上游 Key。 口径与备注核实时间2026-09-11 18:10 风险说明零加价网关,按上游刊例原价计费;平台存在工作日峰时倍率机制,本模型刊例表未标注峰谷,以控制台为准。 定价页https://www.orcarouter.ai/models/z-ai/glm-5.3-flash | |||||||||||||||||||||||||
| N NanoGPT 聚合网关 美元刊例 · 折算展示 | 0.5 | 0.1 | 1.68 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.075 · 缓存读取 $0.015 · 输出 $0.25(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号z-ai/glm-5.3-flash(1M 上下文 / 最大输出 131K) 版本说明已核实(2026-09-11 NanoGPT 官方模型目录接口原文):模型 id z-ai/glm-5.3-flash,上下文 1,048,576、单次最长输出 131,072,支持视觉 / 视频输入与工具调用;输入 $0.075 / 缓存读取 $0.015 / 输出 $0.25(每 1M token)。 接入
按量计费;另有套餐档位。 口径与备注核实时间2026-09-16 20:24 风险说明聚合网关;另有套餐档位与「零数据留存」档,价格可能不同,以控制台为准。 定价页https://nano-gpt.com/models | |||||||||||||||||||||||||
| D DoubleWord 自部署 美元刊例 · 折算展示 | 0.5384 ~ 1.0095 | 0.1346 ~ 0.2019 | 1.6825 ~ 3.365 | 无峰谷定价 实时(即时返回) / 异步(约 1 分钟起) / 批次(最长 24 小时交付) | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例(每 1M token,输入价):实时 $0.15、$0.11、$0.08,按 1 USD ≈ 6.73 元折算。人民币价 = 美元价 × 6.73(2026-09-14 汇率),汇率波动时人民币价随之变化。 版本说明✓ 已核实型号GLM-5.3-Flash 版本说明已核实:其官方文档价格表按「输入 / 缓存读取 / 输出」三列列出「GLM-5.3-Flash」的每百万 token 价,并分实时、异步、批次三档(美元计价)。 接入
接口地址https://api.doubleword.ai/v1 价格取自官方文档价格表,读者可直接打开核对。 口径与备注核实时间2026-09-14 22:20 风险说明海外推理服务商,按交付速度分档:实时档即时返回,异步档约 1 分钟起处理,批次档按文件批量提交、24 小时内交付。三档为同一模型、质量一致,差别只在等待时间与价格,批次档不适用于需要即时响应的场景。缓存命中价约为输入价的 10%~20%。 定价页https://docs.doubleword.ai/inference-api/models | |||||||||||||||||||||||||
| A AI/ML API 聚合网关 美元刊例 · 折算展示 | 1.31 | 0.2625 | 2.19 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.195 · 缓存命中 $0.039 · 输出 $0.325(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-15 汇率)。 版本说明✓ 已核实型号z-ai/glm-5.3-flash(1M 上下文) 版本说明已核实(2026-09-15 该平台官方模型页原文):模型 id z-ai/glm-5.3-flash,页面刊例 输入 $0.195 · 缓存命中 $0.039 · 输出 $0.325(每 1M token),上下文 1M tokens。为 GLM-5.3-Flash 本代版本。 接入
接口地址https://api.aimlapi.com/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-17 20:04 风险说明加价型聚合网关,刊例高于智谱官方直连价($0.075 / $0.25)。 定价页https://aimlapi.com/models/glm-5-3-flash | |||||||||||||||||||||||||
| M Morph(morphllm.com) 自营推理 美元刊例 · 折算展示 | 0.67 | 0.13 | 2.36 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.10 · 缓存读 $0.02 · 输出 $0.35(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号morph-glm53flash(1M 上下文) 版本说明已核实(2026-09-11 Morph 官方定价页原文):条目 GLM-5.3-Flash(模型 id morph-glm53flash),Input $0.10 / 1M · Cache read $0.02 / 1M · Output $0.35 / 1M,Context 1M。该平台主打延迟优化,同页另有 GLM-5.3 744B($1.00 / $0.20 / $3.41)。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:29 风险说明价格低于官方刊例,为平台自有部署定价;同页另有延迟优化(fast)档,单价更高,选型时注意区分。 定价页https://www.morphllm.com/pricing | |||||||||||||||||||||||||
| W Wafer 自营推理 美元刊例 · 折算展示 | 0.67 | 0.13 | 2.36 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.10 · 缓存读 $0.02 · 输出 $0.35(每 1M token),取自官方接口。人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 部署说明serverless 自有集群 版本说明✓ 已核实型号GLM-5.3-Flash(1M 上下文,原生多模态,serverless) 版本说明已核实(2026-09-11 官方接口原文):模型 id = GLM-5.3-Flash,官方描述「Z.ai's fast GLM-5.3 MoE variant, self-hosted on the Wafer fleet with a 1M-token context window」,tier = serverless_only,context_length 1048576,pricing 字段直给 input_cents_per_million=10 / cache_read_cents_per_million=2 / output_cents_per_million=35(美分每百万 token),支持视觉输入与 zero data retention。 接入
接口地址https://pass.wafer.ai/v1/chat/completions 与 DeepSeek 条目同一账号体系、共用工作台额度。 口径与备注核实时间2026-09-17 20:04 风险说明新锐小平台(域名 2022-07-12 注册,资历过关),官方描述「self-hosted on the Wafer fleet」,自有集群自营推理。该价为全表最低一档;平台规模与稳定性不及大厂,建议小额试用。官方描述称该模型「serverless 供应给网关合作伙伴」,且另有渠道定价与其逐项相同,两者可能存在上游供货关系——比价时留意它们未必是两条独立供给。 定价页https://pass.wafer.ai/v1/models | |||||||||||||||||||||||||
| A AiHubMix 聚合中转 美元刊例 · 折算展示 | 0.76 | 0.19 | 2.65 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.1127 · 缓存输入 $0.0282 · 输出 $0.3944(每 1M token,限时折扣价)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号glm-5.3-flash 版本说明已核实(2026-09-11 AiHubMix 官方模型页原文):模型 id glm-5.3-flash,定价 $0.1127 / 缓存输入 $0.0282 / 输出 $0.3944(每 1M tokens),页面同时标注「The model is offered at a limited-time 50% discount」。 接入
接口地址https://aihubmix.com/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-11 13:50 风险说明官方页明示为限时折扣价,期满恢复原价后单价会上浮;聚合中转,上游供货随路由变化,以账户账单为准。 定价页https://aihubmix.com/model/glm-5.3-flash | |||||||||||||||||||||||||
| R RunInfra 自营推理 美元刊例 · 折算展示 人工核录 | 0.67 | 0.07 | 2.69 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.10 · 缓存输入 $0.01 · 输出 $0.40(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 人工核录价目锁在登录后/仅控制台可见,需人工定期核对(建议每周),非实时刷新。 部署说明serverless 版本说明✓ 已核实型号glm-5-3-flash(GLM 5.3 Flash,1M 上下文 / 1M 最大输出) 版本说明已核实(数据源:平台官方 /v1/models 接口返回,采集于 2026-09-10 16:26):模型 id glm-5-3-flash、显示名 GLM 5.3 Flash,状态 available,上下文 1,048,576、最大输出 1,048,576,输入模态 text + image,推理强度可选 low / high / max(默认 max)。接口直给定价字段:输入 $0.10 / 输出 $0.40(每 1M token),缓存输入 $0.01,缓存隔离 isolated、保留策略 best_effort。 接入
与 DeepSeek 条目同一账号体系、共用工作台额度。 口径与备注核实时间2026-09-11 13:50 限速限流 TPM 2800 万 · 并发 34 条目备注开业时间:域名 2026-03-02 注册(约 6 个月) 风险说明成长期推理商(by RightNow),域名仅约 6 个月。同一接口下 DeepSeek 两条状态为 paused(暂停)、本条为 available,说明各模型可用性独立波动,调用前留意工作台状态。本条价格为 2026-09-10 接口快照,之后是否调整未复核。 定价页https://runinfra.ai/inference/glm-5-3-flash | |||||||||||||||||||||||||
| M Makora 自部署 美元刊例 · 折算展示 | 0.9422 | 0.1346 | 3.1631 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.14 · 缓存 $0.02 · 输出 $0.47(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-14 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号z-ai/glm-5.3-flash(1M 上下文) 版本说明已核实:主推区明列 GLM-5.3-Flash 的按 token 三列价(输入 $0.14 / 缓存 $0.02 / 输出 $0.47),1M 上下文;其在聚合平台上的端点报价与此一致。 接入
接口地址https://inference.makora.com 价格取自官网主推区,读者可直接打开官网核对。 口径与备注核实时间2026-09-14 20:40 风险说明海外自部署推理商,自研内核与调度优化栈,模型目录以开源权重为主(与「转售闭源模型」的平台形态不同)。价格取自官网主推区,与其在聚合平台上的报价一致。当前两档订阅均显示售罄,按量计费的常规开通条件尚未确认,接入前请先确认可用性;缓存命中按输入价的 20% 计。 定价页https://www.makora.com/ | |||||||||||||||||||||||||
| R RedPill(聚合网关) 聚合网关 美元刊例 · 折算展示 | 1.0095 | 0.2019 | 3.365 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号z-ai/glm-5.3-flash 版本说明模型 ID 为 z-ai/glm-5.3-flash,即 GLM-5.3-Flash;据该平台官方定价页与官方接口(https://api.redpill.ai/v1/models),两者一致。 接入
接口地址https://api.redpill.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 风险说明跨 TEE 隐私推理网络的聚合网关,上游含 Phala、Tinfoil、NEAR AI、Chutes 等。 定价页https://redpill.ai/pricing | |||||||||||||||||||||||||
| S Synthetic.new 自营推理 美元刊例 · 折算展示 | 1.0095 | 0.2692 | 3.365 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号hf:zai-org/GLM-5.3-Flash 版本说明模型 ID 为 hf:zai-org/GLM-5.3-Flash,即 GLM-5.3-Flash;据该平台官方定价页与官方接口(https://api.synthetic.new/v1/models),两者一致。 接入
接口地址https://api.synthetic.new/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 定价页https://synthetic.new | |||||||||||||||||||||||||
| U Umans 自营推理 美元刊例 · 折算展示 | 1.0095 | 1.0095 | 3.365 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号umans-glm-5.3-flash 版本说明模型 ID 为 umans-glm-5.3-flash,即 GLM-5.3-Flash;据该平台官方定价页与官方接口(https://api.code.umans.ai/v1/models),两者一致。该渠道未公布缓存价,此处按无缓存折扣计(缓存档等于输入价)。 接入
接口地址https://api.code.umans.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明其 V4-Flash-0731 报价与 NeuralWatt、AMD Radeon 两家完全一致,疑同一上游,对比时留意。 定价页https://umans.ai | |||||||||||||||||||||||||
| N Near AI 自营推理 美元刊例 · 折算展示 | 1.0095 | 0.2356 | 3.365 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-15 汇率口径,沿用表内既有条目)。 版本说明✓ 已核实型号z-ai/glm-5.3-flash 版本说明模型 ID 为 z-ai/glm-5.3-flash,即 GLM-5.3-Flash;据该平台官方接口(https://cloud-api.near.ai/v1/model/list)当场核对,标的为 GLM-5.3-Flash 本代版本,非同族旧代。 接入
注意旧端点 api.near.ai 已于 2025-10-31 退役,新版 private.near.ai 需 Bearer token。 cloud-api.near.ai,OpenAI 兼容)按 token 结算 口径与备注核实时间2026-09-17 20:04 风险说明版本为 V4 Flash 初版(非 0731),与 0731 版口径不完全可比。价格 $0.17/$0.035/$0.35 在机密计算类渠道里偏低(Phala 同模型 $0.44/$0.028/$1.32),但比普通明文推理渠道贵一截——多付的钱买的是 TEE 隐私(TDX 机密 CVM、可远程 attest),不是性能。主体为 NEAR 协议官方(GitHub 2017 年、75 仓库),价格竞争力一般;页面较简陋属产品设计取舍,不代表主体不正规。 定价页https://cloud-api.near.ai/v1/model/list | |||||||||||||||||||||||||
| V Venice AI 隐私推理 美元刊例 · 折算展示 | 1.01 | — | 3.37 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 输出 $0.50(每 1M token,常规档)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号z-ai-glm-5-3-flash(1049K 上下文) 版本说明已核实(2026-09-11 Venice 官方模型文档原文):模型表列 GLM 5.3 Flash,常规档 id 为 z-ai-glm-5-3-flash,$0.15 输入 / $0.50 输出、1049K 上下文;另有端到端加密档 e2ee-glm-5-3-flash,$0.16 / $0.54。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-17 19:59 风险说明常规档输入输出对第三方可见;如需端到端加密需改用 e2ee 档,单价略高($0.16/$0.54)。页面未列缓存命中价。 定价页https://docs.venice.ai/models/overview | |||||||||||||||||||||||||
| N Novita AI 自部署 美元刊例 · 折算展示 | 1.01 | 0.2 | 3.37 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存读取 $0.03 · 输出 $0.5(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号GLM 5.3 Flash(1M 上下文 / 128K 最大输出) 版本说明已核实(2026-09-11 Novita 官方模型列表原文):Serverless 区列 GLM 5.3 Flash,$0.15/Mt 输入 · $0.03/Mt 缓存读取 · $0.5/Mt 输出,1M 上下文、128K 最大输出,与智谱国际站标准价一致。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-11 13:50 风险说明Serverless 档价格;如需专属吞吐需另建 Dedicated Endpoint,价格另计。 定价页https://novita.ai/models/llm | |||||||||||||||||||||||||
| B Baseten 自部署 美元刊例 · 折算展示 | 1.01 | 0.2 | 3.37 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存 $0.03 · 输出 $0.50(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号GLM-5.3-Flash(320B-A18B,MIT 许可) 版本说明已核实(2026-09-11 Baseten 官方模型页原文):模型 Model API pricing 标注 Input $0.15 / Cache input $0.03 / Output $0.50(每 1M tokens),规格 320B-A18B、许可 MIT。页面版本字段为 5.3 / Variant Flash,即同名当前版。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:29 风险说明Model API 按量价格;如需独占部署(Dedicated)按 GPU 小时另计,与本价不同。 定价页https://www.baseten.co/library/glm-53-flash/ | |||||||||||||||||||||||||
| P Phala 自营推理 美元刊例 · 折算展示 | 1.01 | 0.2 | 3.37 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存读 $0.03 · 输出 $0.50(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号z-ai/glm-5.3-flash(TEE 部署,1M 上下文 / 128K 最大输出) 版本说明已核实(2026-09-11 Phala 官方模型接口原文):条目 z-ai/glm-5.3-flash,prompt $0.0000015、input_cache_read $0.0000003、completion $0.000005(每 token),即输入 $0.15 / 缓存读 $0.03 / 输出 $0.50 每 1M tokens;上下文 1048576、最大输出 131072,标注 is_tee=true(TEE 可信执行环境部署)。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-16 19:12 风险说明TEE(可信执行环境)部署,主打推理过程加密;单价与常规托管一致。 定价页https://phala.com/models | |||||||||||||||||||||||||
| B BazaarLink 聚合网关 美元刊例 · 折算展示 | 1.01 | 0.2 | 3.37 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存 $0.03 · 输出 $0.50(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Glm 5.3 Flash(Zhipu AI) 版本说明已核实(2026-09-11 BazaarLink 官方模型列表原文):条目 Glm 5.3 Flash(厂商标 Zhipu AI),$0.15 输入 / $0.50 输出 / $0.03 缓存,1M 上下文、输入模态含文本/图像/视频。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:31 风险说明聚合网关,模型由多家上游供货,实际单价随路由浮动;以账户实际计费为准。 定价页https://bazaarlink.ai/models | |||||||||||||||||||||||||
| E Eden AI(聚合平台) 聚合平台 美元刊例 · 折算展示 | 峰1.42 / 谷1.065 | 峰0.355 / 谷0.213 | 3.5501 | 峰:不指定上游时可能路由到的价;已含 5.5% 平台服务费 谷:2026-09-16 复抓 Eden AI 公开模型目录:池内 7 家上游,最低档与中位档同价 $0.15;美元计价,另收 5.5% 服务费,按 1 USD ≈ 6.73 元折算 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径上游刊例价(美元/1M token,输入):池内最低 $0.1500、最高 $0.2000;平台另收 5.5% 服务费,表中价格 = 上游刊例价 × 1.055 × 6.73(2026-09-14 汇率),即已含服务费的人民币价。汇率波动时随之变化。 版本说明✓ 已核实型号GLM-5.3-Flash 版本说明已核实(2026-09-14 平台公开模型目录接口原文):该平台目录逐条给出模型标识、上游服务商、上下文长度与按 token 的三列价;表中取各上游的刊例价(非折后价)。本模型在目录中标注为「GLM-5.3-Flash」,池内共 6 家上游(6 条可用报价),最低 deepinfra/together_ai/zai,最高 tensorx。 接入
接口地址https://api.edenai.run/v3 价格取自平台公开定价页与其公开模型目录,读者可直接打开核对。 口径与备注核实时间2026-09-14 22:30 风险说明聚合网关:本身不加工上游定价,报价为各上游服务商刊例价,另按 5.5% 收取平台服务费,表中价格已含该费用。同一模型池内多家上游的报价与上下文长度可能不同,若不指定上游,实际可能路由到池内任一家,横向比较时留意。 定价页https://www.edenai.co/pricing | |||||||||||||||||||||||||
| L LLM7(聚合平台) 聚合平台 美元刊例 · 折算展示 | 1.0095 | 0.2019 | 3.7015 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号glm-5.3-flash 版本说明模型 ID 为 glm-5.3-flash,即 GLM-5.3-Flash;据该平台官方定价页与官方接口(https://api.llm7.io/v1/models),两者一致。 接入
接口地址https://api.llm7.io/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明同一模型挂多档价位(按可用性分档),此处取基础标准档;低价档的限速与可用率需自行确认。 定价页https://llm7.io | |||||||||||||||||||||||||
| B Berget.AI 自营推理 欧元刊例 · 折算展示 | 1.9675 | 1.9675 | 3.935 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 EUR 刊例,人民币价 = 原价 × 7.87(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号zai-org/GLM-5.3-Flash 版本说明模型 ID 为 zai-org/GLM-5.3-Flash,即 GLM-5.3-Flash;据该平台官方定价页与官方接口(https://api.berget.ai/v1/models),两者一致。该渠道未公布缓存价,此处按无缓存折扣计(缓存档等于输入价)。 接入
接口地址https://api.berget.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明北欧节点,原站以欧元刊例。 定价页https://berget.ai | |||||||||||||||||||||||||
| T Tinfoil 隐私推理 美元刊例 · 折算展示 | 2.692 | 0.673 | 8.4125 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-15 汇率口径,沿用表内既有条目)。 版本说明✓ 已核实型号glm-5-3-flash 版本说明模型 ID 为 glm-5-3-flash,即 GLM-5.3-Flash;据该平台官方接口(https://tinfoil.sh)当场核对,标的为 GLM-5.3-Flash 本代版本,非同族旧代。 接入
接口地址https://api.tinfoil.sh/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 风险说明机密计算(TEE)隐私推理,模型运行在可信执行环境内。 定价页https://tinfoil.sh | |||||||||||||||||||||||||
| B B.AI(b.ai) ⚠ 低价参考 · 谨慎 版本存疑 | 0.1009 | 0.0202 | 0.3365 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本存疑 版本说明活动页用词为「低至 10%」,未逐档列明,此处按一折算 接入
口径与备注核实时间2026-09-17 备注平台公开价目表(美元 / 100 万 tokens,按 token 四列价)+ 限时一折活动价(按标准价 10% 结算)。价格入口:原 b.ai 首页已改纯前端渲染、不再下发价目表,现行价目表在文档站 docs.b.ai/llmservice/models/<模型名>/(模型名里的点号要换成连字符),限时优惠另见 docs.b.ai/llmservice/promotions-and-pricing-notices/。2026-09-16 逐页核对标准价:V4.1-Flash 空闲 $0.15/$0.003/$0.60、高峰 $0.30/$0.006/$1.20;GLM-5.3-Flash $0.15/$0.03/$0.50;Qwen3.8-Flash $0.16/$0.016/$0.47;MiMo-V2.5 $0.14/$0.0028/$0.28。2026-09-17 复核优惠公告页:四条仍按标准价 10% 结算(V4.1-Flash 空闲与高峰同为 10%,GLM-5.3-Flash 标「低至 10%」),与库内折后值一致;首页横幅旧「五折」文案已撤,不再有口径冲突。卡片入口为本站邀请链接(含邀请码),点击直达注册/登录页。 风险说明该站为 Web3 形态:以链上结算为底座,账户身份可与链上地址绑定、资金由使用方自行保管,同时也提供常规账号登录。下列价是它自 2026-09-12 10:00 起的限时一折活动价(按标准价 10% 结算;GLM-5.3-Flash 官方用词为「低至 10%」),页面未标注结束时间、随时可能回调;活动价随官方分时口径同步变动(高峰为工作日 09:00-12:00 与 14:00-18:00,其余含周末为空闲)。折扣幅度明显偏大,接入前请自行判断。 活动未标注结束时间;标准价本身随分时变动,故实际单价随时段浮动。该站模型目录以海外一线型号为主,此处只列与我方价格表可比、且当前在活动期内的型号。 | |||||||||||||||||||||||||
| I InferHub ⚠ 低价参考 · 谨慎 | 0.2019 | — | 0.673 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
接入
口径与备注核实时间2026-09-16 备注订单簿中间价档(各家卖方挂单按价升序,取中间偏高档;最低档受单卖家撤单影响大,不作代表价)。2026-09-16 全量复抓(口径 = 订单簿池内挂单中位档,非最低档):v4-flash 17 档取上中位 $0.031;glm-5.3-flash 22 档取上中位 $0.03;minimax-m3 22 档取上中位 $0.0423,较当日 20:17 记录的 $0.0399 再涨约 6%,已按新值下调。挂单池随卖方进出实时变动,同日不同时刻档位数在 17~28 之间浮动,故同一模型一天内可能反复微调;本次三个型号取同一时刻快照。 风险说明页面自述其做法是把各家 AI 订阅套餐中用不完的额度汇集起来对外提供接口,额度来源与上游供应方无法通过公开渠道核实。同一模型的『最低档』由各家卖方分别挂出、随供需浮动,卖方一撤单就回落到更贵的次档(次档通常贵 10%~200%)。 使用前请先看该档的『可供家数』:家数少的档随时会没有。 定价页https://inferhub.dev/pricing | |||||||||||||||||||||||||
| C CheaperInference ⚠ 低价参考 · 谨慎 | 0.4711 | — | 1.6152 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
接入
口径与备注核实时间2026-09-16 备注平台标价(页面直接展示折后价与原价)。2026-09-16 复抓:该站是实时容量市场(页面自述 live catalog rates),折后比例随供需变动。较 09-13 记录三条全部变动:deepseek-v4-flash 折后 $0.04/$0.08(69% off)→ $0.07/$0.14(45% off);glm-5.3-flash 折后 $0.10/$0.35(30% off)→ $0.07/$0.24(52% off);deepseek-v4-flash-0731 折后 $0.03/$0.06(58% off)→ $0.05/$0.09(40% off)。折扣比例一天内可再变,仅供参考。 风险说明公开披露的主要上游为一家『闲置容量聚合市场』,但该供应方的名称被刻意隐去 —— 其公开文档自述另有规则禁止在面向客户的页面点名该供应方。属转售而非独立供给,货源无法核实。 定价页https://www.cheaperinference.com/ | |||||||||||||||||||||||||
| R r4.codes ⚠ 低价参考 · 谨慎 | 0.5048 | 0.101 | 1.6825 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
接入
口径与备注核实时间2026-09-16 备注平台标价 + 分时低谷价(页面按标准价 / 低谷价两列展示)。2026-09-16 复抓:两列价与库内一致(标准 $0.15 / $0.50 / 缓存 $0.03;低谷 $0.075 / $0.25 / 缓存 $0.015)。注:该站直连偶发超时,需重试。 风险说明域名 2026-08-28 注册,上线不满 6 个月,长期稳定性待观察(收录门槛要求资历满 6 个月)。价格本身与官方刊例一致、未见异常。 定价页https://r4.codes/models | |||||||||||||||||||||||||
| R r4.codes ⚠ 低价参考 · 谨慎 | 1.0095 | 0.2019 | 3.365 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
接入
口径与备注核实时间2026-09-16 备注平台标价 + 分时低谷价(页面按标准价 / 低谷价两列展示)。2026-09-16 复抓:两列价与库内一致(标准 $0.15 / $0.50 / 缓存 $0.03;低谷 $0.075 / $0.25 / 缓存 $0.015)。注:该站直连偶发超时,需重试。 风险说明域名 2026-08-28 注册,上线不满 6 个月,长期稳定性待观察(收录门槛要求资历满 6 个月)。价格本身与官方刊例一致、未见异常。 定价页https://r4.codes/models | |||||||||||||||||||||||||
| 没有符合条件的渠道,试试放宽筛选。 | |||||||||||||||||||||||||
| 渠道 | 套餐 | 费用 元 | 额度 | 元 / 百万 tokens | 官网 |
|---|---|---|---|---|---|
| 智 智谱 GLM Coding Plan | Lite 套餐 |
¥118 月 | 4.33 万 积分 | — | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明官方按周发放:每周 10,000 积分(5 小时窗口 2,000 积分)。此处按月折算(每周 × 52÷12)≈ 43,333 积分/月。 折算口径扣减口径等效综合单价(按官方抵扣系数折算) 等效价计算每百万 token 约消耗 255 积分;月费 ÷(月积分 ÷ 255)× 1e6 = 等效元/百万 token。官方另说明:非高峰时段按基础积分的 50% 抵扣(高峰为周一至周五 14:00-18:00),本页不把非高峰折扣当默认口径。 倍率说明由官方积分抵扣系数折算:GLM-5.3-Flash 系数 Input 2.3 / 缓存 0.56 / 输出 8(消耗积分 =(输入×2.3 + 缓存×0.56 + 输出×8)÷ 10000);按基准负载(输入:输出 3:1、缓存命中 90%)折出约 255 积分/百万 token。 限制与口径持有限制5 小时积分 2,000 · 每周积分 10,000 计费说明套餐额度仅限在官方支持的指定工具与产品环境中调用(ZCode、Claude Code、Codex、Cursor、OpenCode 等);在规定工具之外调用 API,不可享用套餐额度。额度耗尽后等下一个 5 小时周期恢复。 备注日常使用档。连续包季 8 折(94.4 元/月)、连续包年 7 折;另有夜间畅用活动,特定时段额度翻倍。 缓存价未公开缓存命中按 0.56 系数抵扣(低于未命中输入的 2.3),官方已公示。 套餐页https://bigmodel.cn/glm-coding | |||||
| 智 智谱 GLM Coding Plan | Pro 套餐 |
¥538 月 | 26 万 积分 | — | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明官方按周发放:每周 60,000 积分(5 小时窗口 12,000 积分)。此处按月折算(每周 × 52÷12)≈ 260,000 积分/月。 折算口径扣减口径等效综合单价(按官方抵扣系数折算) 等效价计算每百万 token 约消耗 255 积分;月费 ÷(月积分 ÷ 255)× 1e6 = 等效元/百万 token。官方另说明:非高峰时段按基础积分的 50% 抵扣(高峰为周一至周五 14:00-18:00),本页不把非高峰折扣当默认口径。 倍率说明由官方积分抵扣系数折算:GLM-5.3-Flash 系数 Input 2.3 / 缓存 0.56 / 输出 8(消耗积分 =(输入×2.3 + 缓存×0.56 + 输出×8)÷ 10000);按基准负载(输入:输出 3:1、缓存命中 90%)折出约 255 积分/百万 token。 限制与口径持有限制5 小时积分 12,000 · 每周积分 60,000 计费说明套餐额度仅限在官方支持的指定工具与产品环境中调用(ZCode、Claude Code、Codex、Cursor、OpenCode 等);在规定工具之外调用 API,不可享用套餐额度。额度耗尽后等下一个 5 小时周期恢复。 备注高频使用档,用量为入门档的 6 倍;开放更多精选 MCP 工具与更快生成速度。连续包季 8 折(430.4 元/月)、连续包年 7 折。 缓存价未公开缓存命中按 0.56 系数抵扣(低于未命中输入的 2.3),官方已公示。 套餐页https://bigmodel.cn/glm-coding | |||||
| 智 智谱 GLM Coding Plan | Max 套餐 |
¥1078 月 | 60.67 万 积分 | — | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明官方按周发放:每周 140,000 积分(5 小时窗口 28,000 积分)。此处按月折算(每周 × 52÷12)≈ 606,667 积分/月。 折算口径扣减口径等效综合单价(按官方抵扣系数折算) 等效价计算每百万 token 约消耗 255 积分;月费 ÷(月积分 ÷ 255)× 1e6 = 等效元/百万 token。官方另说明:非高峰时段按基础积分的 50% 抵扣(高峰为周一至周五 14:00-18:00),本页不把非高峰折扣当默认口径。 倍率说明由官方积分抵扣系数折算:GLM-5.3-Flash 系数 Input 2.3 / 缓存 0.56 / 输出 8(消耗积分 =(输入×2.3 + 缓存×0.56 + 输出×8)÷ 10000);按基准负载(输入:输出 3:1、缓存命中 90%)折出约 255 积分/百万 token。 限制与口径持有限制5 小时积分 28,000 · 每周积分 140,000 计费说明套餐额度仅限在官方支持的指定工具与产品环境中调用(ZCode、Claude Code、Codex、Cursor、OpenCode 等);在规定工具之外调用 API,不可享用套餐额度。额度耗尽后等下一个 5 小时周期恢复。 备注深度使用档,用量为入门档的 14 倍;高峰期资源优先保障,首发接入最新旗舰能力。连续包季 8 折(862.4 元/月)、连续包年 7 折。 缓存价未公开缓存命中按 0.56 系数抵扣(低于未命中输入的 2.3),官方已公示。 套餐页https://bigmodel.cn/glm-coding | |||||
| O OpenCode Go | Go 订阅(首月 $5 · 续费 $10/月) |
¥67.3 月 | 60 美元用量 | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明按美元价值扣费。GLM-5.3-Flash 的单模型月额度为 $60;官方未公开每 token 扣费单价,等效价无法折算,不编数。 限制与口径持有限制5 小时上限 $12 · 每周上限 $30 · 单模型月额度分 $15/$30/$60 三档(GLM-5.3-Flash 为 $60 档)。官方估算 GLM-5.3-Flash 约 6,320 次/5 小时(编程负载)。 计费说明重要:单模型月额度 $60 封顶,即使总额度未用满也无法超出该模型的额度上限。超额可开启 Use balance 回落到按量额度。每工作空间限 1 人订阅。仅限在受支持的编程工具中交互式使用。 单独使用本模型时,$60 单模型额度可跑满。 备注含 27 款模型(官方页列出 10 款代表型号)。按美元价值扣费,路由到当下成本最低且有容量的供应商;额度当月有效不结转。API 可导出(OpenAI 兼容 /zen/go/v1/chat/completions 与 Anthropic 兼容 /v1/messages)。 套餐页https://opencode.ai/go | |||||
| O Ollama Cloud | Pro($20/月) |
¥134.6 月 | 60 美元用量 | 0.35 | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明按官方每 M token 价扣费:GLM-5.3-Flash 输入 $0.15 · 缓存读 $0.03 · 输出 $0.5(高峰时段工作日 12:00-18:00 UTC 全部 ×2);用完后可按同价续期。 折算口径扣减口径等效综合单价(谷时) 等效价计算等效 0.35 元/M(谷时)= 官方综合 $0.1565/M ÷ 3 × 6.73;高峰约 0.70 元/M 倍率说明由官方 token 价 × 订阅杠杆(月费/用量 = 1/3)× 汇率 6.73 折出;高峰时段约 ×2。综合单价 $0.1565/M(输入 $0.15 · 缓存 $0.03 · 输出 $0.5,按 3:1、缓存 90% 加权)。 限制与口径持有限制无 5 小时/每周上限(3 路并发) 计费说明等效价 = 官方单价 ×(月费 ÷ 月度用量)= 按量价的 1/3,非估算。按基准负载(3:1、缓存 90%%)折算;高峰翻倍扣费会减少实际可用量。 备注Ollama 为本地运行时起家(9M+ 开发者),云端原生权重、零留存不训练;CLI/API/桌面端通用,兼容现有本地 Ollama 工作流。Pro 含 $60 用量、Max 含 $300 用量。 缓存价未公开缓存读按官方价扣费,等效价已按 90% 命中率折入 套餐页https://ollama.com/pricing | |||||
| O Ollama Cloud | Max($100/月) |
¥673 月 | 300 美元用量 | 0.35 | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明按官方每 M token 价扣费:GLM-5.3-Flash 输入 $0.15 · 缓存读 $0.03 · 输出 $0.5(高峰时段工作日 12:00-18:00 UTC 全部 ×2);用完后可按同价续期。 折算口径扣减口径等效综合单价(谷时) 等效价计算等效 0.35 元/M(谷时)= 官方综合 $0.1565/M ÷ 3 × 6.73;高峰约 0.70 元/M 倍率说明由官方 token 价 × 订阅杠杆(月费/用量 = 1/3)× 汇率 6.73 折出;高峰时段约 ×2。综合单价 $0.1565/M(输入 $0.15 · 缓存 $0.03 · 输出 $0.5,按 3:1、缓存 90% 加权)。 限制与口径持有限制无 5 小时/每周上限(10 路并发) 计费说明等效价 = 官方单价 ×(月费 ÷ 月度用量)= 按量价的 1/3,非估算。按基准负载(3:1、缓存 90%%)折算;高峰翻倍扣费会减少实际可用量。 备注Ollama 为本地运行时起家(9M+ 开发者),云端原生权重、零留存不训练;CLI/API/桌面端通用,兼容现有本地 Ollama 工作流。Pro 含 $60 用量、Max 含 $300 用量。 缓存价未公开缓存读按官方价扣费,等效价已按 90% 命中率折入 套餐页https://ollama.com/pricing | |||||
| 火 火山方舟 | Agent Plan 个人版 · Small |
¥40 月 | 2 万 AFP | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明每月额度 限制与口径持有限制周额度 7,000 · 5 小时额度 2,000 · 日额度 10,000(AFT);建议同时进行单个项目的开发 计费说明AFP(Agent 燃料值)统一抵扣;文本生成模型不可用于 API 调用,在非 AI 工具中使用套餐权益对应的 Base URL 与 API Key 可能被识别为违规使用。套餐仅支持升配不支持降配;支持非七天无理由自助退订。 备注该模型在本档套餐中可用。采用 AFP(Agent 燃料值)统一抵扣,套餐额度在 5 小时、周、月三个周期内分别限额,耗尽后等下一周期自动恢复。不同模型的 AFP 抵扣系数不同,官方未公开本模型的具体系数,等效价无法折算,不编数。 套餐页https://www.volcengine.com/docs/82379/2366394 | |||||
| 火 火山方舟 | Agent Plan 个人版 · Medium |
¥200 月 | 10 万 AFP | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明每月额度 限制与口径持有限制周额度 35,000 · 5 小时额度 10,000 · 日额度 50,000(AFT);建议同时进行 1-2 个项目的开发 计费说明AFP(Agent 燃料值)统一抵扣;文本生成模型不可用于 API 调用,在非 AI 工具中使用套餐权益对应的 Base URL 与 API Key 可能被识别为违规使用。套餐仅支持升配不支持降配;支持非七天无理由自助退订。 备注该模型在本档套餐中可用。采用 AFP(Agent 燃料值)统一抵扣,套餐额度在 5 小时、周、月三个周期内分别限额,耗尽后等下一周期自动恢复。不同模型的 AFP 抵扣系数不同,官方未公开本模型的具体系数,等效价无法折算,不编数。 套餐页https://www.volcengine.com/docs/82379/2366394 | |||||
| 火 火山方舟 | Agent Plan 个人版 · Large |
¥500 月 | 25 万 AFP | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明每月额度 限制与口径持有限制周额度 87,500 · 5 小时额度 25,000 · 日额度 125,000(AFT);建议同时进行 2+ 个项目的开发 计费说明AFP(Agent 燃料值)统一抵扣;文本生成模型不可用于 API 调用,在非 AI 工具中使用套餐权益对应的 Base URL 与 API Key 可能被识别为违规使用。套餐仅支持升配不支持降配;支持非七天无理由自助退订。 备注该模型在本档套餐中可用。采用 AFP(Agent 燃料值)统一抵扣,套餐额度在 5 小时、周、月三个周期内分别限额,耗尽后等下一周期自动恢复。不同模型的 AFP 抵扣系数不同,官方未公开本模型的具体系数,等效价无法折算,不编数。 套餐页https://www.volcengine.com/docs/82379/2366394 | |||||
| 火 火山方舟 | Agent Plan 个人版 · Max |
¥1000 月 | 50 万 AFP | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明每月额度 限制与口径持有限制周额度 175,000 · 5 小时额度 50,000 · 日额度 250,000(AFT);建议同时进行 2+ 个项目的开发 计费说明AFP(Agent 燃料值)统一抵扣;文本生成模型不可用于 API 调用,在非 AI 工具中使用套餐权益对应的 Base URL 与 API Key 可能被识别为违规使用。套餐仅支持升配不支持降配;支持非七天无理由自助退订。 备注该模型在本档套餐中可用。采用 AFP(Agent 燃料值)统一抵扣,套餐额度在 5 小时、周、月三个周期内分别限额,耗尽后等下一周期自动恢复。不同模型的 AFP 抵扣系数不同,官方未公开本模型的具体系数,等效价无法折算,不编数。 套餐页https://www.volcengine.com/docs/82379/2366394 | |||||
| 百 百度千帆 Token Plan | Token Plan Mini(Token制) |
¥9.9 月 | 1,000 万 Tokens/月 | 0.99 | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明官方口径(Token 制):按实际消耗 Token 数量抵扣,不区分输入/输出/缓存,也不区分模型,多模型共享额度。 折算口径扣减口径统一 Token 抵扣(官方文档:多模型共享额度、消耗统一抵扣) 等效价计算等效 0.9900 元/百万 = 月费 9.9 ÷ 1000 万 token × 100 倍率说明等效价 = 月费 ÷ 月度 Token 额度;另有指定模型闲时限时低折扣活动,本页不把限时折扣当默认口径。 限制与口径持有限制配额可在 Token 制与积分制之间按官方指引迁移;额度耗尽需等下一周期恢复。 计费说明仅限在兼容的 AI 编程与智能体工具中交互式使用,不可用于自动化脚本或应用后端。专属 API-KEY 与 Base URL 仅限 Token Plan 使用,调用常规服务的 Key 不抵扣套餐额度。 备注套餐支持 GLM-5.3-Flash(model 参数 glm-5.3-flash)等主力模型。Token 制按 Token 数量统一抵扣,不区分模型与输入输出类型,因此本档等效价与所用模型无关。 套餐页https://cloud.baidu.com/doc/qianfan/s/Dmrabu8b6 | |||||
| 百 百度千帆 Token Plan | Token Plan Lite(Token制) |
¥40 月 | 4,200 万 Tokens/月 | 0.9524 | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明官方口径(Token 制):按实际消耗 Token 数量抵扣,不区分输入/输出/缓存,也不区分模型,多模型共享额度。 折算口径扣减口径统一 Token 抵扣(官方文档:多模型共享额度、消耗统一抵扣) 等效价计算等效 0.9524 元/百万 = 月费 40 ÷ 4200 万 token × 100 倍率说明等效价 = 月费 ÷ 月度 Token 额度;另有指定模型闲时限时低折扣活动,本页不把限时折扣当默认口径。 限制与口径持有限制配额可在 Token 制与积分制之间按官方指引迁移;额度耗尽需等下一周期恢复。 计费说明仅限在兼容的 AI 编程与智能体工具中交互式使用,不可用于自动化脚本或应用后端。专属 API-KEY 与 Base URL 仅限 Token Plan 使用,调用常规服务的 Key 不抵扣套餐额度。 备注套餐支持 GLM-5.3-Flash(model 参数 glm-5.3-flash)等主力模型。Token 制按 Token 数量统一抵扣,不区分模型与输入输出类型,因此本档等效价与所用模型无关。 套餐页https://cloud.baidu.com/doc/qianfan/s/Dmrabu8b6 | |||||
| 百 百度千帆 Token Plan | Token Plan Pro(Token制) |
¥200 月 | 2.3 万 万 Tokens/月 | 0.8696 | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明官方口径(Token 制):按实际消耗 Token 数量抵扣,不区分输入/输出/缓存,也不区分模型,多模型共享额度。 折算口径扣减口径统一 Token 抵扣(官方文档:多模型共享额度、消耗统一抵扣) 等效价计算等效 0.8696 元/百万 = 月费 200 ÷ 23000 万 token × 100 倍率说明等效价 = 月费 ÷ 月度 Token 额度;另有指定模型闲时限时低折扣活动,本页不把限时折扣当默认口径。 限制与口径持有限制配额可在 Token 制与积分制之间按官方指引迁移;额度耗尽需等下一周期恢复。 计费说明仅限在兼容的 AI 编程与智能体工具中交互式使用,不可用于自动化脚本或应用后端。专属 API-KEY 与 Base URL 仅限 Token Plan 使用,调用常规服务的 Key 不抵扣套餐额度。 备注套餐支持 GLM-5.3-Flash(model 参数 glm-5.3-flash)等主力模型。Token 制按 Token 数量统一抵扣,不区分模型与输入输出类型,因此本档等效价与所用模型无关。 套餐页https://cloud.baidu.com/doc/qianfan/s/Dmrabu8b6 | |||||
| 百 百度千帆 Token Plan | Token Plan Max(Token制) |
¥600 月 | 7 万 万 Tokens/月 | 0.8571 | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明官方口径(Token 制):按实际消耗 Token 数量抵扣,不区分输入/输出/缓存,也不区分模型,多模型共享额度。 折算口径扣减口径统一 Token 抵扣(官方文档:多模型共享额度、消耗统一抵扣) 等效价计算等效 0.8571 元/百万 = 月费 600 ÷ 70000 万 token × 100 倍率说明等效价 = 月费 ÷ 月度 Token 额度;另有指定模型闲时限时低折扣活动,本页不把限时折扣当默认口径。 限制与口径持有限制配额可在 Token 制与积分制之间按官方指引迁移;额度耗尽需等下一周期恢复。 计费说明仅限在兼容的 AI 编程与智能体工具中交互式使用,不可用于自动化脚本或应用后端。专属 API-KEY 与 Base URL 仅限 Token Plan 使用,调用常规服务的 Key 不抵扣套餐额度。 备注套餐支持 GLM-5.3-Flash(model 参数 glm-5.3-flash)等主力模型。Token 制按 Token 数量统一抵扣,不区分模型与输入输出类型,因此本档等效价与所用模型无关。 套餐页https://cloud.baidu.com/doc/qianfan/s/Dmrabu8b6 | |||||
| 百 百度千帆 Token Plan | Token Plan Mini(积分制) |
¥9.9 月 | 1,400 积分/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明积分制:按输入/输出/缓存 Token 分别设系数折算积分统一抵扣,系数随模型动态变化。 限制与口径持有限制积分制存在每 5 小时与 7 天积分使用限制(官方称当前限时取消)。 计费说明仅限在兼容的 AI 编程与智能体工具中交互式使用,不可用于自动化脚本或应用后端。专属 API-KEY 与 Base URL 仅限 Token Plan 使用。 备注套餐支持 GLM-5.3-Flash(model 参数 glm-5.3-flash)等主力模型。积分制按模型分别设系数,官方未公开本模型的积分系数,等效价无法折算,不编数。 套餐页https://cloud.baidu.com/doc/qianfan/s/Dmrabu8b6 | |||||
| 百 百度千帆 Token Plan | Token Plan Lite(积分制) |
¥40 月 | 6,600 积分/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明积分制:按输入/输出/缓存 Token 分别设系数折算积分统一抵扣,系数随模型动态变化。 限制与口径持有限制积分制存在每 5 小时与 7 天积分使用限制(官方称当前限时取消)。 计费说明仅限在兼容的 AI 编程与智能体工具中交互式使用,不可用于自动化脚本或应用后端。专属 API-KEY 与 Base URL 仅限 Token Plan 使用。 备注套餐支持 GLM-5.3-Flash(model 参数 glm-5.3-flash)等主力模型。积分制按模型分别设系数,官方未公开本模型的积分系数,等效价无法折算,不编数。 套餐页https://cloud.baidu.com/doc/qianfan/s/Dmrabu8b6 | |||||
| 百 百度千帆 Token Plan | Token Plan Pro(积分制) |
¥200 月 | 4.5 万 积分/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明积分制:按输入/输出/缓存 Token 分别设系数折算积分统一抵扣,系数随模型动态变化。 限制与口径持有限制积分制存在每 5 小时与 7 天积分使用限制(官方称当前限时取消)。 计费说明仅限在兼容的 AI 编程与智能体工具中交互式使用,不可用于自动化脚本或应用后端。专属 API-KEY 与 Base URL 仅限 Token Plan 使用。 备注套餐支持 GLM-5.3-Flash(model 参数 glm-5.3-flash)等主力模型。积分制按模型分别设系数,官方未公开本模型的积分系数,等效价无法折算,不编数。 套餐页https://cloud.baidu.com/doc/qianfan/s/Dmrabu8b6 | |||||
| 百 百度千帆 Token Plan | Token Plan Max(积分制) |
¥600 月 | 16.5 万 积分/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月 额度说明积分制:按输入/输出/缓存 Token 分别设系数折算积分统一抵扣,系数随模型动态变化。 限制与口径持有限制积分制存在每 5 小时与 7 天积分使用限制(官方称当前限时取消)。 计费说明仅限在兼容的 AI 编程与智能体工具中交互式使用,不可用于自动化脚本或应用后端。专属 API-KEY 与 Base URL 仅限 Token Plan 使用。 备注套餐支持 GLM-5.3-Flash(model 参数 glm-5.3-flash)等主力模型。积分制按模型分别设系数,官方未公开本模型的积分系数,等效价无法折算,不编数。 套餐页https://cloud.baidu.com/doc/qianfan/s/Dmrabu8b6 | |||||
| C CommandCode | GOAT($10/月 + 处理费) |
¥67.3 月 | 40 美元 credits | 0.263 | 官网 ↗ |
套餐信息核实时间2026-09-12 10:35 周期月 额度说明按官方文档的「按模型分配额度」:单模型月额度上限 $40(套餐总额度 $70;官方对各模型另设单模型额度上限)。额度按各模型官方单价扣减,平台零加价;credits 永不过期、可累积。 折算口径扣减口径等效综合单价 等效价计算等效 0.263 元/M = 综合 $0.1565/M × (10 ÷ 40) × 6.73 倍率说明由官方每 M token 价折算:GLM-5.3-Flash 输入 $0.15 · 缓存读 $0.03 · 输出 $0.5(按基准负载 输入:输出=3:1、缓存命中 90% 加权,得综合 $0.1565/M);再按套餐杠杆(月费 $10 ÷ 该模型月额度 $40)折算,乘汇率 6.73 得人民币价。 限制与口径持有限制官方设 5 小时与每周滚动上限(未公布具体数值) 计费说明套餐额度仅限在官方支持的编程工具中使用(该档可调 Provider API,按订阅 credits 计量);额度当月有效、不结转,用完后可按各模型成本价补充额度(补充额度可结转、不过期)。本档单价为固定价,不随峰谷变化。 备注含 68 款模型(官方目录)。额度按各模型官方单价扣减,平台标注零加价;另有入门档 Go($1/月 · $10 额度)与 API 档 Provider($15/月 + 按量),这两档该模型的单模型额度官方未公开,故未列等效价。 缓存价未公开缓存读按官方单价计费($0.03/M),已按 90% 命中率计入等效价 套餐页https://commandcode.ai/docs/resources/pricing-limits | |||||
| C CommandCode | Pro($20/月 + 处理费) |
¥134.6 月 | 50 美元 credits | 0.421 | 官网 ↗ |
套餐信息核实时间2026-09-12 10:35 周期月 额度说明按官方文档的「按模型分配额度」:单模型月额度上限 $50(套餐总额度 $80;官方对各模型另设单模型额度上限)。额度按各模型官方单价扣减,平台零加价;credits 永不过期、可累积。 折算口径扣减口径等效综合单价 等效价计算等效 0.421 元/M = 综合 $0.1565/M × (20 ÷ 50) × 6.73 倍率说明由官方每 M token 价折算:GLM-5.3-Flash 输入 $0.15 · 缓存读 $0.03 · 输出 $0.5(按基准负载 输入:输出=3:1、缓存命中 90% 加权,得综合 $0.1565/M);再按套餐杠杆(月费 $20 ÷ 该模型月额度 $50)折算,乘汇率 6.73 得人民币价。 限制与口径持有限制官方设 5 小时与每周滚动上限(未公布具体数值) 计费说明套餐额度仅限在官方支持的编程工具中使用(该档可调 Provider API,按订阅 credits 计量);额度当月有效、不结转,用完后可按各模型成本价补充额度(补充额度可结转、不过期)。本档单价为固定价,不随峰谷变化。 备注含 68 款模型(官方目录)。额度按各模型官方单价扣减,平台标注零加价;另有入门档 Go($1/月 · $10 额度)与 API 档 Provider($15/月 + 按量),这两档该模型的单模型额度官方未公开,故未列等效价。 缓存价未公开缓存读按官方单价计费($0.03/M),已按 90% 命中率计入等效价 套餐页https://commandcode.ai/docs/resources/pricing-limits | |||||
| C CommandCode | Max 10×($100/月 + 处理费) |
¥673 月 | 150 美元 credits | 0.702 | 官网 ↗ |
套餐信息核实时间2026-09-12 10:35 周期月 额度说明按官方文档的「按模型分配额度」:标准(开源)模型单模型月额度 $150(套餐总额度 $150)。额度按各模型官方单价扣减,平台零加价;credits 永不过期、可累积。 折算口径扣减口径等效综合单价 等效价计算等效 0.702 元/M = 综合 $0.1565/M × (100 ÷ 150) × 6.73 倍率说明由官方每 M token 价折算:GLM-5.3-Flash 输入 $0.15 · 缓存读 $0.03 · 输出 $0.5(按基准负载 输入:输出=3:1、缓存命中 90% 加权,得综合 $0.1565/M);再按套餐杠杆(月费 $100 ÷ 该模型月额度 $150)折算,乘汇率 6.73 得人民币价。 限制与口径持有限制官方设 5 小时与每周滚动上限(未公布具体数值)· 高级模型另设 $100 额度 计费说明套餐额度仅限在官方支持的编程工具中使用(该档可调 Provider API,按订阅 credits 计量);额度当月有效、不结转,用完后可按各模型成本价补充额度(补充额度可结转、不过期)。本档单价为固定价,不随峰谷变化。 备注含 68 款模型(官方目录)。额度按各模型官方单价扣减,平台标注零加价;另有入门档 Go($1/月 · $10 额度)与 API 档 Provider($15/月 + 按量),这两档该模型的单模型额度官方未公开,故未列等效价。 缓存价未公开缓存读按官方单价计费($0.03/M),已按 90% 命中率计入等效价 套餐页https://commandcode.ai/docs/resources/pricing-limits | |||||
| C CommandCode | Max 20×($200/月 + 处理费) |
¥1346 月 | 300 美元 credits | 0.702 | 官网 ↗ |
套餐信息核实时间2026-09-12 10:35 周期月 额度说明按官方文档的「按模型分配额度」:标准(开源)模型单模型月额度 $300(套餐总额度 $300)。额度按各模型官方单价扣减,平台零加价;credits 永不过期、可累积。 折算口径扣减口径等效综合单价 等效价计算等效 0.702 元/M = 综合 $0.1565/M × (200 ÷ 300) × 6.73 倍率说明由官方每 M token 价折算:GLM-5.3-Flash 输入 $0.15 · 缓存读 $0.03 · 输出 $0.5(按基准负载 输入:输出=3:1、缓存命中 90% 加权,得综合 $0.1565/M);再按套餐杠杆(月费 $200 ÷ 该模型月额度 $300)折算,乘汇率 6.73 得人民币价。 限制与口径持有限制官方设 5 小时与每周滚动上限(未公布具体数值)· 高级模型另设 $200 额度 计费说明套餐额度仅限在官方支持的编程工具中使用(该档可调 Provider API,按订阅 credits 计量);额度当月有效、不结转,用完后可按各模型成本价补充额度(补充额度可结转、不过期)。本档单价为固定价,不随峰谷变化。 备注含 68 款模型(官方目录)。额度按各模型官方单价扣减,平台标注零加价;另有入门档 Go($1/月 · $10 额度)与 API 档 Provider($15/月 + 按量),这两档该模型的单模型额度官方未公开,故未列等效价。 缓存价未公开缓存读按官方单价计费($0.03/M),已按 90% 命中率计入等效价 套餐页https://commandcode.ai/docs/resources/pricing-limits | |||||
| 腾 腾讯云 · 原厂直供 | TokenHub Token Plan Lite |
¥39 月 | 780 积分/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:50 周期月 额度说明每订阅月 780 积分(四档均为 20 积分/元,抵扣标准与档位无关)。按官方积分抵扣价折算:GLM-5.3-Flash 按基准负载约 18.3 积分/百万 token。 折算口径扣减口径等效综合单价(按官方积分抵扣价折算) 等效价计算等效价 = 月费 ÷(月积分 ÷ 18.3 积分/百万)= 39 ÷(780 ÷ 18.3) 倍率说明官方积分抵扣价(刊例):GLM-5.3-Flash 未命中缓存输入 16 积分/百万 · 输出 56 · 缓存命中 4.6。 单次请求积分 =(未命中缓存输入×16 + 输出×56 + 缓存命中×4.6)÷ 1,000,000;按基准负载(输入:输出 3:1、缓存命中 90%)折出约 18.3 积分/百万 token。 限制与口径持有限制每订阅月 780 积分;剩余积分月底清零、不结转。四档均支持同一模型池,档位越高额度越多(积分/元比例一致)。 计费说明仅限在交互式 AI 编程工具中使用(官方列举 OpenClaw、Claude Code、OpenCode、Cline、Cursor、Kilo Code、Codex CLI 等),共享同一套餐额度;通用与混元两条产品线共用一个 API Key 与调用地址,按请求中的 Model ID 自动匹配扣减。 备注腾讯云 TokenHub「通用 Token Plan」:官方写明四档均支持 MiniMax、GLM、DeepSeek、腾讯混元等多模型(池内无 Qwen 系列)。官方另有 GLM-5.3-Flash 的 5 折限时活动(2026-09-04 至 09-10,已结束,活动价 8/28/2.3);本页按刊例积分价计,不把限时活动价当默认口径。 缓存价未公开缓存命中按 4.6 积分/百万抵扣(低于未命中输入的 16),官方已公示。 套餐页https://cloud.tencent.com/document/product/1772/129449 | |||||
| 腾 腾讯云 · 原厂直供 | TokenHub Token Plan Standard |
¥99 月 | 1,980 积分/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:50 周期月 额度说明每订阅月 1980 积分(四档均为 20 积分/元,抵扣标准与档位无关)。按官方积分抵扣价折算:GLM-5.3-Flash 按基准负载约 18.3 积分/百万 token。 折算口径扣减口径等效综合单价(按官方积分抵扣价折算) 等效价计算等效价 = 月费 ÷(月积分 ÷ 18.3 积分/百万)= 99 ÷(1980 ÷ 18.3) 倍率说明官方积分抵扣价(刊例):GLM-5.3-Flash 未命中缓存输入 16 积分/百万 · 输出 56 · 缓存命中 4.6。 单次请求积分 =(未命中缓存输入×16 + 输出×56 + 缓存命中×4.6)÷ 1,000,000;按基准负载(输入:输出 3:1、缓存命中 90%)折出约 18.3 积分/百万 token。 限制与口径持有限制每订阅月 1980 积分;剩余积分月底清零、不结转。四档均支持同一模型池,档位越高额度越多(积分/元比例一致)。 计费说明仅限在交互式 AI 编程工具中使用(官方列举 OpenClaw、Claude Code、OpenCode、Cline、Cursor、Kilo Code、Codex CLI 等),共享同一套餐额度;通用与混元两条产品线共用一个 API Key 与调用地址,按请求中的 Model ID 自动匹配扣减。 备注腾讯云 TokenHub「通用 Token Plan」:官方写明四档均支持 MiniMax、GLM、DeepSeek、腾讯混元等多模型(池内无 Qwen 系列)。官方另有 GLM-5.3-Flash 的 5 折限时活动(2026-09-04 至 09-10,已结束,活动价 8/28/2.3);本页按刊例积分价计,不把限时活动价当默认口径。 缓存价未公开缓存命中按 4.6 积分/百万抵扣(低于未命中输入的 16),官方已公示。 套餐页https://cloud.tencent.com/document/product/1772/129449 | |||||
| 腾 腾讯云 · 原厂直供 | TokenHub Token Plan Pro |
¥299 月 | 5,980 积分/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:50 周期月 额度说明每订阅月 5980 积分(四档均为 20 积分/元,抵扣标准与档位无关)。按官方积分抵扣价折算:GLM-5.3-Flash 按基准负载约 18.3 积分/百万 token。 折算口径扣减口径等效综合单价(按官方积分抵扣价折算) 等效价计算等效价 = 月费 ÷(月积分 ÷ 18.3 积分/百万)= 299 ÷(5980 ÷ 18.3) 倍率说明官方积分抵扣价(刊例):GLM-5.3-Flash 未命中缓存输入 16 积分/百万 · 输出 56 · 缓存命中 4.6。 单次请求积分 =(未命中缓存输入×16 + 输出×56 + 缓存命中×4.6)÷ 1,000,000;按基准负载(输入:输出 3:1、缓存命中 90%)折出约 18.3 积分/百万 token。 限制与口径持有限制每订阅月 5980 积分;剩余积分月底清零、不结转。四档均支持同一模型池,档位越高额度越多(积分/元比例一致)。 计费说明仅限在交互式 AI 编程工具中使用(官方列举 OpenClaw、Claude Code、OpenCode、Cline、Cursor、Kilo Code、Codex CLI 等),共享同一套餐额度;通用与混元两条产品线共用一个 API Key 与调用地址,按请求中的 Model ID 自动匹配扣减。 备注腾讯云 TokenHub「通用 Token Plan」:官方写明四档均支持 MiniMax、GLM、DeepSeek、腾讯混元等多模型(池内无 Qwen 系列)。官方另有 GLM-5.3-Flash 的 5 折限时活动(2026-09-04 至 09-10,已结束,活动价 8/28/2.3);本页按刊例积分价计,不把限时活动价当默认口径。 缓存价未公开缓存命中按 4.6 积分/百万抵扣(低于未命中输入的 16),官方已公示。 套餐页https://cloud.tencent.com/document/product/1772/129449 | |||||
| 腾 腾讯云 · 原厂直供 | TokenHub Token Plan Max |
¥599 月 | 1.2 万 积分/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:50 周期月 额度说明每订阅月 11980 积分(四档均为 20 积分/元,抵扣标准与档位无关)。按官方积分抵扣价折算:GLM-5.3-Flash 按基准负载约 18.3 积分/百万 token。 折算口径扣减口径等效综合单价(按官方积分抵扣价折算) 等效价计算等效价 = 月费 ÷(月积分 ÷ 18.3 积分/百万)= 599 ÷(11980 ÷ 18.3) 倍率说明官方积分抵扣价(刊例):GLM-5.3-Flash 未命中缓存输入 16 积分/百万 · 输出 56 · 缓存命中 4.6。 单次请求积分 =(未命中缓存输入×16 + 输出×56 + 缓存命中×4.6)÷ 1,000,000;按基准负载(输入:输出 3:1、缓存命中 90%)折出约 18.3 积分/百万 token。 限制与口径持有限制每订阅月 11980 积分;剩余积分月底清零、不结转。四档均支持同一模型池,档位越高额度越多(积分/元比例一致)。 计费说明仅限在交互式 AI 编程工具中使用(官方列举 OpenClaw、Claude Code、OpenCode、Cline、Cursor、Kilo Code、Codex CLI 等),共享同一套餐额度;通用与混元两条产品线共用一个 API Key 与调用地址,按请求中的 Model ID 自动匹配扣减。 备注腾讯云 TokenHub「通用 Token Plan」:官方写明四档均支持 MiniMax、GLM、DeepSeek、腾讯混元等多模型(池内无 Qwen 系列)。官方另有 GLM-5.3-Flash 的 5 折限时活动(2026-09-04 至 09-10,已结束,活动价 8/28/2.3);本页按刊例积分价计,不把限时活动价当默认口径。 缓存价未公开缓存命中按 4.6 积分/百万抵扣(低于未命中输入的 16),官方已公示。 套餐页https://cloud.tencent.com/document/product/1772/129449 | |||||
| 没有符合条件的套餐,试试放宽筛选。 | |||||
*「等效价」口径:TokenPlan 的「等效价格」= 套餐月费 ÷ 该套餐按官方抵扣系数折算出的 token 总量,且按额度 100% 全部用完计算。额度用不完,实际单价会高于此值。
| 渠道 | 元 / 百万 tokens | 元 / 百万 tokens | 元 / 百万 tokens | 峰谷时间 | 官网 | |||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| 阿 阿里云百炼官方 官方自营 | 0.8 | 0.1 | 2.7 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号qwen3.8-flash(1M 上下文 / 最大输出 128K / 原生多模态) 版本说明已核实(2026-09-11 阿里云百炼官方模型文档原文):模型调用 ID 为 qwen3.8-flash,单价 输入 0.8 / 缓存命中 0.1 / 输出 2.7(元每百万 tokens);上下文 1,000,000、最大输出 131072,支持文本、图像、视频输入与深度思考。文档另列「显式缓存创建 1.25」,属缓存写入单价。 接入
接口地址https://dashscope.aliyuncs.com/compatible-mode/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-11 16:55 限速限流 动态限流(TPM 按平台月消费额度分档,RPM 限额较高) 风险说明同页另列新加坡部署区价格(输入 1.094 / 缓存 0.117 / 输出 3.427 元每百万 tokens),为独立的境外部署区刊例,与本条(华北 2 北京)不同,选型时勿混。 厂家身份阿里云通义千问官方模型服务。Qwen3.8-Flash 是轻量高速的原生多模态模型,支持可按请求开关的深度推理、工具调用与提示缓存,面向高并发低成本场景。 定价页https://help.aliyun.com/zh/model-studio/qwen3-8-flash | ||||||||||||||||||||
| 模 模力方舟(Gitee AI) 自部署 | 0.8 | — | 2.7 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号Qwen3.8-Flash(1M 上下文,原生多模态) 版本说明已核实(2026-09-11 模力方舟模型广场页面):Qwen3.8-Flash 输入 ¥0.8/M、输出 ¥2.7/M,与阿里云百炼官方挂牌一致。页面注明支持百万级上下文与缓存。 接入访问 ai.gitee.com 模型广场可查看在售模型与价格;调用需注册账号 → 创建访问令牌 → 接口 https://ai.gitee.com/v1 (OpenAI 兼容)。平台依托沐曦(MetaX)国产算力。 口径与备注核实时间2026-09-16 19:12 风险说明该平台页面仅标注「缓存支持」,未公布缓存倍率,故缓存价留空。价格以其模型广场当前刊例为准,如遇平台促销可能低于此处所示。 厂家身份模力方舟(Gitee AI),开源中国旗下 AI 模型服务平台,依托沐曦(MetaX)国产算力提供 Serverless API,京ICP备2025119063号。 定价页https://ai.gitee.com/serverless-api | ||||||||||||||||||||
| 七 七牛云 AI 推理 自部署 | 1 | 0.1 | 3 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号qwen/qwen3.8-flash-next(1M 上下文 / 最大输出 128K) 版本说明已核实(2026-09-11 七牛云官方模型页数据原文):条目 id 为 qwen/qwen3.8-flash-next,非缓存输入 0.001 / 缓存输入 0.0001 / 输出 0.003(元/千 tokens),即 1.0 / 0.1 / 3.0 元每百万 tokens;上下文 1,000,000、最大输出 128,000,支持文本、图像、视频输入与深度思考。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:29 限速限流 TPM 500 万 风险说明条目 id 带 -next 后缀(平台用以标记新一代快照),调用时以该 id 为准。 定价页https://www.qiniu.com/ai/models | ||||||||||||||||||||
| 阿 阿里云百炼国际版 自部署 美元刊例 · 折算展示 | 1.01 | 0.11 | 3.16 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存 $0.016 · 输出 $0.47(每 1M token,Global 范围)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 部署说明阿里云国际基础设施 版本说明✓ 已核实型号qwen3.8-flash(1M 上下文 / 最大输出 131K) 版本说明已核实(2026-09-11 阿里云国际站帮助文档原文):模型 ID qwen3.8-flash,Global 部署范围 输入 $0.15 / 隐式缓存 $0.016 / 输出 $0.47(每 1M token);International 部署范围另有更低一档(输入 $0.113 / 缓存 $0.014 / 输出 $0.382)。限流 RPM 30,000 · TPM 5,000,000。 接入
默认限流 RPM 30,000 / TPM 5,000,000。 口径与备注核实时间2026-09-16 19:12 限速限流 RPM 30000 · TPM 5,000,000 备注文档同页列多个部署范围价:International 档更低($0.113 / $0.014 / $0.382),本条录 Global 档,实际以控制台所选范围为准。 风险说明国际站与国内站是两套独立定价与账号体系,同一模型价差较大,选型时勿混。 定价页https://www.alibabacloud.com/help/en/model-studio/qwen3-8-flash | ||||||||||||||||||||
| O OfoxAI 聚合平台 美元刊例 · 折算展示 | 0.74 | 0.07 | 2.62 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.11 · 缓存读取 $0.011 · 输出 $0.39(每 1M token),供应商标注为 Aliyun。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号qwen/qwen3.8-flash(1M 上下文 / 131K 输出) 版本说明已核实(2026-09-11 OfoxAI 官方模型页原文):条目 "Qwen: Qwen3.8 Flash"(id qwen/qwen3.8-flash)由 Aliyun 供应,输入 $0.11/M · 缓存读取 $0.011/M · 输出 $0.39/M;上下文 1M、最大输出 131K,支持视觉、函数调用、推理、提示缓存、网络搜索、视频输入。 接入
接口地址https://api.ofox.ai/v1 按量计费,全时段统一价;联网搜索另按次计费。 口径与备注核实时间2026-09-17 20:04 风险说明联网搜索另按次计费($0.01/次)。 定价页https://ofox.ai/zh/models/qwen/qwen3.8-flash | ||||||||||||||||||||
| P PPIO 派欧云 自部署 | 0.8 | 0.1 | 2.7 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号qwen/qwen3.8-flash(1M 上下文 / 最大输出 131K) 版本说明已核实(2026-09-11 PPIO 官方模型接口数据原文):模型 id 为 qwen/qwen3.8-flash,输入 0.8 / 缓存读取 0.1 / 输出 2.7(元每百万 tokens,价与阿里云官方一致);上下文 1,000,000、单次最长输出 131K,支持文本、图片、视频输入,默认开启深度思考且可关闭;支持 OpenAI 与 Anthropic 双协议。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-11 17:20 风险说明缓存写入(创建)当前标价为 0 元,实际以控制台为准。 厂家身份派欧云计算(上海)有限公司(沪ICP备18048206号-33)运营的分布式云计算平台。 定价页https://ppio.com/llm | ||||||||||||||||||||
| 3 302.AI 聚合网关 美元刊例 · 折算展示 | 1.01 | 0.11 | 3.16 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存读取 $0.016 · 缓存写入 $0.2 · 输出 $0.47(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号qwen3.8-flash(1M 上下文) 版本说明已核实(2026-09-11 302.AI 官方模型页内嵌数据原文):模型条目 qwen3.8-flash,输入 $0.15 / 缓存读取 $0.016 / 缓存写入 $0.2 / 输出 $0.47(每 1M tokens),上下文 1,000,000;与阿里云百炼国际站 Global 档同价。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-17 19:59 风险说明聚合网关,一个模型多家上游供货,实际单价随路由浮动;标的折扣价可能随时调整,以控制台实际计费为准。 定价页https://302.ai/ | ||||||||||||||||||||
| I Infron(零加价网关) 聚合网关 美元刊例 · 折算展示 | 峰0.5 / 谷0.38 | 0.05 | 峰1.58 / 谷1.29 | 峰:全时段(美元计价,按 1 USD ≈ 6.73 元折算) 谷:全时段,低优先级路由(适合离线评测、批处理等容忍波动的任务)(美元计价,按 1 USD ≈ 6.73 元折算) | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:Standard 档 输入 $0.075 · 缓存读 $0.008 · 输出 $0.235;Flex 档 输入 $0.0565 · 缓存读 $0.007 · 输出 $0.191(每 1M token),当前为上游 50% off 折扣价。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 部署说明零加价路由 版本说明✓ 已核实型号qwen/qwen3.8-flash 版本说明已核实(2026-09-15 据该站官方模型页数据):Qwen3.8-Flash 的 Standard 档 输入 $0.075 · 缓存读 $0.008 · 输出 $0.235(alibaba/sg 一家),Flex 档 输入 $0.0565 · 缓存读 $0.007 · 输出 $0.191(alibaba/cn 一家);两档均带 50% off 折扣(Standard 折前 $0.15 / $0.016 / $0.47,Flex 折前 $0.113 / $0.014 / $0.382)。 接入
接口地址https://api.infron.ai/v1 零 token 加价,平台按 $0.35 + 5% 收取账户服务费。分 Flex / Standard 档位池。 口径与备注核实时间2026-09-15 20:58 风险说明价格口径:这里的价格取自该站模型页卡片标示的「Avg list price」,即该档位池内全部可用上游的算术平均;站内逐上游明细另列每家单价,最低的一条常显著低于此均值。该站原话「your request is billed at the rate of the provider it is routed to」—— 实际费用取决于当次路由到的上游,故此处均值偏保守。折扣时效:部分上游当前有折扣,幅度与期限由各上游自行调整,随时可能回调。资历:域名 2026-01-07 注册,公司很新,零加价模式下无动力压价,但长周期可靠性未经验证,建议按需使用,不建议一次性投入大额资金。 定价页https://infron.ai/models/qwen/qwen3.8-flash | ||||||||||||||||||||
| N Naga(聚合平台) 聚合平台 美元刊例 · 折算展示 | 0.5048 | 0.0538 | 1.5816 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号qwen3.8-flash 版本说明模型 ID 为 qwen3.8-flash,即 Qwen3.8-Flash;据该平台官方定价页与官方接口(https://api.naga.ac/v1/models),两者一致。 接入
接口地址https://api.naga.ac/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明报价为同类中较低水平,未标注上游供应商,对比时留意。 定价页https://naga.ac/pricing | ||||||||||||||||||||
| D DeepInfra 自部署 美元刊例 · 折算展示 | 0.7605 | 0.0949 | 2.5709 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-15 汇率口径,沿用表内既有条目)。 版本说明✓ 已核实型号Qwen/Qwen3.8-Flash 版本说明模型 ID 为 Qwen/Qwen3.8-Flash,即 Qwen3.8-Flash;据该平台官方接口(https://deepinfra.com/Qwen/Qwen3.8-Flash)当场核对,标的为 Qwen3.8-Flash 本代版本,非同族旧代。 接入
接口地址https://api.deepinfra.com/v1/openai 其官网价格与在 OpenRouter 上的报价一致($0.06/$0.18)。 口径与备注核实时间2026-09-17 20:04 风险说明海外托管商:自购 GPU 跑开源权重(fp8 量化版),能力表现与官方可能有差异;缓存命中按输入 25% 计,与官方缓存口径不同,重度用缓存的场景对比时要留意。 定价页https://deepinfra.com/Qwen/Qwen3.8-Flash | ||||||||||||||||||||
| O OpenRouter(聚合平台) 聚合平台 美元刊例 · 折算展示 | 1.01 | 0.11 | 3.16 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存 $0.016 · 输出 $0.47(每 1M token),池内两家端点同价。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号qwen/qwen3.8-flash(1M 上下文) 版本说明已核实(2026-09-11 OpenRouter 官方模型接口原文):模型 ID qwen/qwen3.8-flash,池内 2 家上游端点——Alibaba(阿里官方)与 Makora,两家同价 输入 $0.15 / 缓存 $0.016 / 输出 $0.47(每 1M token)。 接入
接口地址https://openrouter.ai/api/v1 可用 provider 参数指定供应商锁定价格。 口径与备注核实时间2026-09-17 20:04 风险说明池内含阿里官方端点与第三方端点,当前两家同价;默认路由按可用性择优、非按价格。按用量计费另收平台服务费。 定价页https://openrouter.ai/qwen/qwen3.8-flash | ||||||||||||||||||||
| T Together AI 自部署 美元刊例 · 折算展示 | 1.01 | — | 3.16 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 输出 $0.47(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号Qwen3.8 Flash(1M 上下文) 版本说明已核实(2026-09-11 Together AI 官方模型库原文):模型列表条目 "Qwen3.8 Flash" 标注 Input $0.15 / 1M · Output $0.47 / 1M。 接入
接口地址https://api.together.xyz/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:31 定价页https://www.together.ai/models | ||||||||||||||||||||
| L LLM Gateway(聚合平台) 聚合平台 美元刊例 · 折算展示 | 1.0095 | 0.1077 | 3.1631 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号qwen3.8-flash 版本说明模型 ID 为 qwen3.8-flash,即 Qwen3.8-Flash;据该平台官方定价页与官方接口(https://api.llmgateway.io/v1/models),两者一致。 接入
接口地址https://api.llmgateway.io/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 风险说明报价低于同类聚合平台,未标注上游供应商,对比时留意。 定价页https://llmgateway.io/pricing | ||||||||||||||||||||
| Z ZenMux 聚合平台 美元刊例 · 折算展示 | 1.0768 | 0.1077 | 3.1631 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-15 汇率口径,沿用表内既有条目)。 版本说明✓ 已核实型号qwen/qwen3.8-flash 版本说明模型 ID 为 qwen/qwen3.8-flash,即 Qwen3.8-Flash;据该平台官方接口(https://zenmux.ai)当场核对,标的为 Qwen3.8-Flash 本代版本,非同族旧代。 接入
接口地址https://zenmux.ai/api/v1 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 定价页https://zenmux.ai | ||||||||||||||||||||
| R Requesty(聚合平台) 聚合平台 美元刊例 · 折算展示 | 1.35 | — | 3.37 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.20 · 输出 $0.50(每 1M token),上游单一(tensorx)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号qwen3.8-flash-next(262K 上下文) 版本说明已核实(2026-09-11 Requesty 官方模型页原文):条目 id qwen3.8-flash-next,归属 Alibaba (Qwen),262K 上下文,池内 1 家上游(tensorx);输入 $0.20 / 输出 $0.50(每 1M token)。 接入
接口地址https://router.requesty.ai/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-11 17:20 风险说明池内仅 1 家上游(tensorx),供给集中;平台为透传式聚合(无推理加价)。同平台另有其他供应商版本时价格可能不同,以控制台为准。 定价页https://www.requesty.ai/model/alibaba/qwen3.8-flash-next | ||||||||||||||||||||
| C Cortecs 聚合平台 欧元刊例 · 折算展示 | 1.4166 | 0.3541 | 3.5336 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 EUR 刊例,人民币价 = 原价 × 7.87(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号qwen3.8-flash-next 版本说明模型 ID 为 qwen3.8-flash-next,即 Qwen3.8-Flash;据该平台官方定价页与官方接口(https://api.cortecs.ai/v1/models),两者一致。 接入
接口地址https://api.cortecs.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明欧洲节点,原站以欧元刊例。 定价页https://cortecs.ai | ||||||||||||||||||||
| A AiHubMix 聚合平台 美元刊例 · 折算展示 | 0.76 | — | 2.56 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.1126 · 输出 $0.38(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号qwen3.8-flash(1M 上下文 / 128K 输出) 版本说明已核实(2026-09-11 AiHubMix 官方模型页原文):条目 "Qwen3.8 Flash" 标注 Input $0.1126/M · Output $0.38/M,并注明 1M 上下文、128K 输出、支持联网与工具调用。 接入
接口地址https://aihubmix.com/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-11 16:55 定价页https://aihubmix.com/model/qwen3.8-flash | ||||||||||||||||||||
| N NanoGPT 聚合网关 美元刊例 · 折算展示 | 0.94 | 0.11 | 2.83 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.14 · 缓存读取 $0.016 · 输出 $0.42(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号alibaba/qwen3.8-flash(991,808 上下文 / 最大输出 131K) 版本说明已核实(2026-09-11 NanoGPT 官方模型目录接口原文):模型 id alibaba/qwen3.8-flash,归属 qwen,上下文 991,808、单次最长输出 131,072,支持视觉 / 视频输入、思考模式与工具调用;输入 $0.14 / 缓存读取 $0.016 / 输出 $0.42(每 1M token)。平台标注上线日期 2026-08-26,与官方发布一致。 接入
按量计费;另有套餐档位,价格可能不同。 口径与备注核实时间2026-09-16 19:12 风险说明聚合网关,单价低于官方直连价;平台同时提供按量与传统套餐两种口径,另有「零数据留存(ZDR)」档位价格可能不同,实际以控制台为准。 定价页https://nano-gpt.com/models | ||||||||||||||||||||
| N Novita AI 自部署 美元刊例 · 折算展示 | 1.01 | 0.11 | 3.16 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存 $0.016 · 输出 $0.47(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号qwen3.8-flash(1M 上下文) 版本说明已核实(2026-09-11 Novita AI 官方模型列表原文):Serverless 条目 "Qwen3.8 Flash" 标注 Input $0.15/Mt · Cache Read $0.016/Mt · Output $0.47/Mt。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-11 16:55 定价页https://novita.ai/models/llm | ||||||||||||||||||||
| O OrcaRouter(零加价网关) 聚合网关 美元刊例 · 折算展示 | 1.01 | 0.12 | 3.16 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存读取 $0.0184 · 输出 $0.47(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 部署说明零加价路由 版本说明✓ 已核实型号qwen/qwen3.8-flash(1M 上下文 / 最大输出 131K) 版本说明已核实(2026-09-11 OrcaRouter 官方模型接口原文):条目 id qwen/qwen3.8-flash,归属 Alibaba,上下文 1,000,000、单次最长输出 131,072,支持文本 / 图片 / 视频输入;平台官网刊例表列 输入 $0.150 / 输出 $0.470(每 1M token),模型质量分 7.0。缓存读取 $0.0184(每 1M token,取自官方接口 input_cache_read 字段)。 接入
接口地址https://api.orcarouter.ai/v1 零 token 加价;支持 BYOK 自带上游 Key。 口径与备注核实时间2026-09-17 20:04 风险说明零加价网关:按上游 provider 刊例原价计费,收入来自 Team 订阅等功能费。平台存在「工作日峰时倍率」机制(官网对 DeepSeek 条目写明 UTC 01:00–04:00、06:00–10:00 翻倍),本模型刊例表未标注峰谷,实际以控制台为准。 定价页https://www.orcarouter.ai/models/qwen/qwen3.8-flash | ||||||||||||||||||||
| M Makora 自部署 美元刊例 · 折算展示 | 1.0095 | 0.1346 | 3.1631 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存 $0.02 · 输出 $0.47(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-14 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号qwen/qwen3.8-flash(NVFP4 量化,262K 上下文) 版本说明已核实:主推区明列 Qwen3.8-Flash-Next-NVFP4 的按 token 三列价(输入 $0.15 / 缓存 $0.02 / 输出 $0.47),NVFP4 量化版、262K 上下文;其在聚合平台上的端点报价(输入 / 输出)与此一致。 接入
接口地址https://inference.makora.com 价格取自官网主推区,读者可直接打开官网核对。 口径与备注核实时间2026-09-14 20:40 风险说明海外自部署推理商,自研内核与调度优化栈,模型目录以开源权重为主(与「转售闭源模型」的平台形态不同)。价格取自官网主推区,与其在聚合平台上的报价一致。当前两档订阅均显示售罄,按量计费的常规开通条件尚未确认,接入前请先确认可用性;缓存命中按输入价的 20% 计。 定价页https://www.makora.com/ | ||||||||||||||||||||
| V Venice AI 自部署 美元刊例 · 折算展示 | 0.94 | — | 3.3 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.14 · 输出 $0.49(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号qwen-3-8-flash(1M 上下文) 版本说明已核实(2026-09-11 Venice AI 官方模型文档原文):条目 "Qwen 3.8 Flash"(id qwen-3-8-flash)标注输入 $0.14 / 输出 $0.49,上下文 1000K,能力含函数调用、推理、视觉、代码。 接入
按量计费,全时段统一价。 口径与备注核实时间2026-09-17 19:59 定价页https://docs.venice.ai/models/overview | ||||||||||||||||||||
| E Eden AI(聚合平台) 聚合平台 美元刊例 · 折算展示 | 峰1.42 / 谷1.065 | 峰0.355 / 谷0.1136 | 峰3.5501 / 谷3.3371 | 峰:不指定上游时可能路由到的价;已含 5.5% 平台服务费 谷:2026-09-16 复抓 Eden AI 公开模型目录:池内 3 家上游,中位档为 qwen $0.15;美元计价,另收 5.5% 服务费,按 1 USD ≈ 6.73 元折算 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径上游刊例价(美元/1M token,输入):池内最低 $0.1500、最高 $0.2000;平台另收 5.5% 服务费,表中价格 = 上游刊例价 × 1.055 × 6.73(2026-09-14 汇率),即已含服务费的人民币价。汇率波动时随之变化。 版本说明✓ 已核实型号Qwen3.8-Flash 版本说明已核实(2026-09-14 平台公开模型目录接口原文):该平台目录逐条给出模型标识、上游服务商、上下文长度与按 token 的三列价;表中取各上游的刊例价(非折后价)。本模型在目录中标注为「Qwen3.8-Flash」,池内共 2 家上游(2 条可用报价),最低 qwen,最高 tensorx。 接入
接口地址https://api.edenai.run/v3 价格取自平台公开定价页与其公开模型目录,读者可直接打开核对。 口径与备注核实时间2026-09-14 22:30 风险说明聚合网关:本身不加工上游定价,报价为各上游服务商刊例价,另按 5.5% 收取平台服务费,表中价格已含该费用。同一模型池内多家上游的报价与上下文长度可能不同,若不指定上游,实际可能路由到池内任一家,横向比较时留意。 定价页https://www.edenai.co/pricing | ||||||||||||||||||||
| C Canopywave 自营推理 美元刊例 · 折算展示 | 1.0095 | 0.1346 | 3.365 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号qwen3-8-flash-next 版本说明模型 ID 为 qwen3-8-flash-next,即 Qwen3.8-Flash;据该平台官方定价页与官方接口(https://api.canopywave.io/v1),两者一致。 接入
接口地址https://api.canopywave.io/v1 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 定价页https://canopywave.com/models | ||||||||||||||||||||
| F Featherless 聚合网关 美元刊例 · 折算展示 | 1.01 | — | 3.37 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 输出 $0.50(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号Qwen/Qwen3.8-Flash-Next(262K 上下文 / 最大输出 32K) 版本说明已核实(2026-09-11 Featherless 官方模型接口原文):条目 id Qwen/Qwen3.8-Flash-Next,上下文 262,144、单次最长输出 32,768,支持工具调用与图片输入;输入 $0.15 / 输出 $0.50(每 1M token)。条目名带 Next 后缀,与官方发布及七牛云别名表一致,为同一模型。 接入
按并发额度订阅 + token 计费,页面未公示缓存命中价。 口径与备注核实时间2026-09-16 19:12 风险说明计价模式特殊:平台以「并发额度」订阅制为主(接口 concurrency_cost=4,即为该模型占用 4 个并发位),token 价另计;实际成本取决于所选套餐档位,与官方 token 刊例不完全可比,选型时留意。 定价页https://featherless.ai/models/Qwen/Qwen3.8-Flash-Next | ||||||||||||||||||||
| A AI/ML API 聚合网关 美元刊例 · 折算展示 | 1.4 | 0.14 | 4.11 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.208 · 缓存命中 $0.0208 · 输出 $0.611(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-15 汇率)。 版本说明✓ 已核实型号alibaba/qwen3.8-flash(1M 上下文) 版本说明已核实(2026-09-15 该平台官方模型页原文):模型 id alibaba/qwen3.8-flash,上下文 1M tokens(默认 262K、可扩展),页面刊例 输入 $0.208 · 缓存命中 $0.0208 · 输出 $0.611(每 1M token)。该页标注发布时间 Aug 26, 2026,与官方发布节奏一致。 接入
接口地址https://api.aimlapi.com/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-17 20:04 风险说明加价型聚合网关:本站刊例高于官方直连价(约 +38%),实际计费以控制台为准。平台主体为美国公司(页脚 © AI/ML, LLC),网络足迹可追溯至 2021 年。 定价页https://aimlapi.com/models/qwen3-8-flash | ||||||||||||||||||||
| B B.AI(b.ai) ⚠ 低价参考 · 谨慎 版本存疑 | 0.1077 | 0.0108 | 0.3163 | 无峰谷定价 | 官网 ↗ | |||||||||||||||
价格档位单位:元 / 百万 tokens
版本存疑 版本说明2026-09-16 17:00(UTC+8)前免费,之后转一折 接入
口径与备注核实时间2026-09-17 备注平台公开价目表(美元 / 100 万 tokens,按 token 四列价)+ 限时一折活动价(按标准价 10% 结算)。价格入口:原 b.ai 首页已改纯前端渲染、不再下发价目表,现行价目表在文档站 docs.b.ai/llmservice/models/<模型名>/(模型名里的点号要换成连字符),限时优惠另见 docs.b.ai/llmservice/promotions-and-pricing-notices/。2026-09-16 逐页核对标准价:V4.1-Flash 空闲 $0.15/$0.003/$0.60、高峰 $0.30/$0.006/$1.20;GLM-5.3-Flash $0.15/$0.03/$0.50;Qwen3.8-Flash $0.16/$0.016/$0.47;MiMo-V2.5 $0.14/$0.0028/$0.28。2026-09-17 复核优惠公告页:四条仍按标准价 10% 结算(V4.1-Flash 空闲与高峰同为 10%,GLM-5.3-Flash 标「低至 10%」),与库内折后值一致;首页横幅旧「五折」文案已撤,不再有口径冲突。卡片入口为本站邀请链接(含邀请码),点击直达注册/登录页。 风险说明该站为 Web3 形态:以链上结算为底座,账户身份可与链上地址绑定、资金由使用方自行保管,同时也提供常规账号登录。下列价是它自 2026-09-12 10:00 起的限时一折活动价(按标准价 10% 结算;GLM-5.3-Flash 官方用词为「低至 10%」),页面未标注结束时间、随时可能回调;活动价随官方分时口径同步变动(高峰为工作日 09:00-12:00 与 14:00-18:00,其余含周末为空闲)。折扣幅度明显偏大,接入前请自行判断。 活动未标注结束时间;标准价本身随分时变动,故实际单价随时段浮动。该站模型目录以海外一线型号为主,此处只列与我方价格表可比、且当前在活动期内的型号。 | ||||||||||||||||||||
| 没有符合条件的渠道,试试放宽筛选。 | ||||||||||||||||||||
| 渠道 | 套餐 | 费用 元 | 额度 | 元 / 百万 tokens | 官网 |
|---|---|---|---|---|---|
| 阿 阿里云 · 百炼 Token Plan | 百炼 Token Plan Lite(个人版) |
¥39 月 | 2,500 Credits/7天 | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明Credits 每 7 天刷新(自首次调用起计时),窗口内未用完不结转;另有 5 小时窗口限制。 限制与口径持有限制并发 Agent 1-2 个;原价 60 元/月 计费说明仅限在受支持的 AI 编程与智能体工具中交互式使用,不可用于自动化脚本或应用后端。专属 API Key 与 Base URL 与常规服务不同,使用常规 Key 不抵扣套餐额度。 备注该模型在 Token Plan 的可用模型清单内(官方模型表含 qwen3.8-flash)。套餐以 Credits 统一抵扣,不同模型按分档抵扣系数计费,官方未公开本模型的具体系数,等效价无法折算,不编数。 套餐页https://www.alibabacloud.com/help/zh/model-studio/token-plan-personal-overview | |||||
| 阿 阿里云 · 百炼 Token Plan | 百炼 Token Plan Standard(个人版) |
¥139 月 | 1 万 Credits/7天 | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明Credits 每 7 天刷新(自首次调用起计时),窗口内未用完不结转;另有 5 小时窗口限制。 限制与口径持有限制并发 Agent 3-4 个;原价 180 元/月 计费说明仅限在受支持的 AI 编程与智能体工具中交互式使用,不可用于自动化脚本或应用后端。专属 API Key 与 Base URL 与常规服务不同,使用常规 Key 不抵扣套餐额度。 备注该模型在 Token Plan 的可用模型清单内(官方模型表含 qwen3.8-flash)。套餐以 Credits 统一抵扣,不同模型按分档抵扣系数计费,官方未公开本模型的具体系数,等效价无法折算,不编数。 套餐页https://www.alibabacloud.com/help/zh/model-studio/token-plan-personal-overview | |||||
| 阿 阿里云 · 百炼 Token Plan | 百炼 Token Plan Pro(个人版) |
¥499 月 | 4 万 Credits/7天 | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明Credits 每 7 天刷新(自首次调用起计时),窗口内未用完不结转;另有 5 小时窗口限制。 限制与口径持有限制并发 Agent 6-8 个;原价 600 元/月 计费说明仅限在受支持的 AI 编程与智能体工具中交互式使用,不可用于自动化脚本或应用后端。专属 API Key 与 Base URL 与常规服务不同,使用常规 Key 不抵扣套餐额度。 备注该模型在 Token Plan 的可用模型清单内(官方模型表含 qwen3.8-flash)。套餐以 Credits 统一抵扣,不同模型按分档抵扣系数计费,官方未公开本模型的具体系数,等效价无法折算,不编数。 套餐页https://www.alibabacloud.com/help/zh/model-studio/token-plan-personal-overview | |||||
| 阿 阿里云 · 百炼 Token Plan | 百炼 Token Plan 标准坐席(团队版) |
¥134.6 月/坐席 | 2.5 万 Credits/月/坐席 | — | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月/坐席 额度说明每席位每月 Credits 额度,席位不可共享;额度用尽后可从共享用量包抵扣。 限制与口径持有限制适用场景:轻度使用;USD 20/坐席/月(原价 USD 30) 计费说明仅限在受支持的 AI 编程与智能体工具中交互式使用,不可用于自动化脚本或应用后端。专属 API Key 与 Base URL 与常规服务不同,使用常规 Key 不抵扣套餐额度。团队版目前仅在新加坡地域提供服务。 备注该模型在 Token Plan 的可用模型清单内(官方模型表含 qwen3.8-flash)。套餐以 Credits 统一抵扣,不同模型按分档抵扣系数计费,官方未公开本模型的具体系数,等效价无法折算,不编数。 套餐页https://www.alibabacloud.com/help/zh/model-studio/token-plan-team-overview | |||||
| 阿 阿里云 · 百炼 Token Plan | 百炼 Token Plan 高级坐席(团队版) |
¥504.75 月/坐席 | 10 万 Credits/月/坐席 | — | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月/坐席 额度说明每席位每月 Credits 额度,席位不可共享;额度用尽后可从共享用量包抵扣。 限制与口径持有限制适用场景:日常高频使用;USD 75/坐席/月(原价 USD 100) 计费说明仅限在受支持的 AI 编程与智能体工具中交互式使用,不可用于自动化脚本或应用后端。专属 API Key 与 Base URL 与常规服务不同,使用常规 Key 不抵扣套餐额度。团队版目前仅在新加坡地域提供服务。 备注该模型在 Token Plan 的可用模型清单内(官方模型表含 qwen3.8-flash)。套餐以 Credits 统一抵扣,不同模型按分档抵扣系数计费,官方未公开本模型的具体系数,等效价无法折算,不编数。 套餐页https://www.alibabacloud.com/help/zh/model-studio/token-plan-team-overview | |||||
| 阿 阿里云 · 百炼 Token Plan | 百炼 Token Plan 尊享坐席(团队版) |
¥1346 月/坐席 | 25 万 Credits/月/坐席 | — | 官网 ↗ |
套餐信息核实时间2026-09-16 21:35 周期月/坐席 额度说明每席位每月 Credits 额度,席位不可共享;额度用尽后可从共享用量包抵扣。 限制与口径持有限制适用场景:重度依赖;USD 200/坐席/月 计费说明仅限在受支持的 AI 编程与智能体工具中交互式使用,不可用于自动化脚本或应用后端。专属 API Key 与 Base URL 与常规服务不同,使用常规 Key 不抵扣套餐额度。团队版目前仅在新加坡地域提供服务。 备注该模型在 Token Plan 的可用模型清单内(官方模型表含 qwen3.8-flash)。套餐以 Credits 统一抵扣,不同模型按分档抵扣系数计费,官方未公开本模型的具体系数,等效价无法折算,不编数。 套餐页https://www.alibabacloud.com/help/zh/model-studio/token-plan-team-overview | |||||
| C CommandCode | GOAT($10/月 + 处理费) |
¥67.3 月 | 20 美元 credits | 0.472 | 官网 ↗ |
套餐信息核实时间2026-09-12 10:35 周期月 额度说明按官方文档的「按模型分配额度」:单模型月额度上限 $40(套餐总额度 $70;官方对各模型另设单模型额度上限)。额度按各模型官方单价扣减,平台零加价;credits 永不过期、可累积。 折算口径扣减口径等效综合单价 等效价计算等效 0.472 元/M = 综合 $0.1403/M × (10 ÷ 20) × 6.73 倍率说明由官方每 M token 价折算:Qwen3.8-Flash 输入 $0.16 · 缓存读 $0.016 · 输出 $0.47(按基准负载 输入:输出=3:1、缓存命中 90% 加权,得综合 $0.1403/M);再按套餐杠杆(月费 $10 ÷ 该模型月额度 $20)折算,乘汇率 6.73 得人民币价。 限制与口径持有限制官方设 5 小时与每周滚动上限(未公布具体数值) 计费说明套餐额度仅限在官方支持的编程工具中使用(该档可调 Provider API,按订阅 credits 计量);额度当月有效、不结转,用完后可按各模型成本价补充额度(补充额度可结转、不过期)。本档单价为固定价,不随峰谷变化。 备注含 68 款模型(官方目录)。额度按各模型官方单价扣减,平台标注零加价;另有入门档 Go($1/月 · $10 额度)与 API 档 Provider($15/月 + 按量),这两档该模型的单模型额度官方未公开,故未列等效价。 缓存价未公开缓存读按官方单价计费($0.016/M),已按 90% 命中率计入等效价 套餐页https://commandcode.ai/docs/resources/pricing-limits | |||||
| C CommandCode | Pro($20/月 + 处理费) |
¥134.6 月 | 30 美元 credits | 0.629 | 官网 ↗ |
套餐信息核实时间2026-09-12 10:35 周期月 额度说明按官方文档的「按模型分配额度」:单模型月额度上限 $50(套餐总额度 $80;官方对各模型另设单模型额度上限)。额度按各模型官方单价扣减,平台零加价;credits 永不过期、可累积。 折算口径扣减口径等效综合单价 等效价计算等效 0.629 元/M = 综合 $0.1403/M × (20 ÷ 30) × 6.73 倍率说明由官方每 M token 价折算:Qwen3.8-Flash 输入 $0.16 · 缓存读 $0.016 · 输出 $0.47(按基准负载 输入:输出=3:1、缓存命中 90% 加权,得综合 $0.1403/M);再按套餐杠杆(月费 $20 ÷ 该模型月额度 $30)折算,乘汇率 6.73 得人民币价。 限制与口径持有限制官方设 5 小时与每周滚动上限(未公布具体数值) 计费说明套餐额度仅限在官方支持的编程工具中使用(该档可调 Provider API,按订阅 credits 计量);额度当月有效、不结转,用完后可按各模型成本价补充额度(补充额度可结转、不过期)。本档单价为固定价,不随峰谷变化。 备注含 68 款模型(官方目录)。额度按各模型官方单价扣减,平台标注零加价;另有入门档 Go($1/月 · $10 额度)与 API 档 Provider($15/月 + 按量),这两档该模型的单模型额度官方未公开,故未列等效价。 缓存价未公开缓存读按官方单价计费($0.016/M),已按 90% 命中率计入等效价 套餐页https://commandcode.ai/docs/resources/pricing-limits | |||||
| C CommandCode | Max 10×($100/月 + 处理费) |
¥673 月 | 150 美元 credits | 0.629 | 官网 ↗ |
套餐信息核实时间2026-09-12 10:35 周期月 额度说明按官方文档的「按模型分配额度」:标准(开源)模型单模型月额度 $150(套餐总额度 $150)。额度按各模型官方单价扣减,平台零加价;credits 永不过期、可累积。 折算口径扣减口径等效综合单价 等效价计算等效 0.629 元/M = 综合 $0.1403/M × (100 ÷ 150) × 6.73 倍率说明由官方每 M token 价折算:Qwen3.8-Flash 输入 $0.16 · 缓存读 $0.016 · 输出 $0.47(按基准负载 输入:输出=3:1、缓存命中 90% 加权,得综合 $0.1403/M);再按套餐杠杆(月费 $100 ÷ 该模型月额度 $150)折算,乘汇率 6.73 得人民币价。 限制与口径持有限制官方设 5 小时与每周滚动上限(未公布具体数值)· 高级模型另设 $100 额度 计费说明套餐额度仅限在官方支持的编程工具中使用(该档可调 Provider API,按订阅 credits 计量);额度当月有效、不结转,用完后可按各模型成本价补充额度(补充额度可结转、不过期)。本档单价为固定价,不随峰谷变化。 备注含 68 款模型(官方目录)。额度按各模型官方单价扣减,平台标注零加价;另有入门档 Go($1/月 · $10 额度)与 API 档 Provider($15/月 + 按量),这两档该模型的单模型额度官方未公开,故未列等效价。 缓存价未公开缓存读按官方单价计费($0.016/M),已按 90% 命中率计入等效价 套餐页https://commandcode.ai/docs/resources/pricing-limits | |||||
| C CommandCode | Max 20×($200/月 + 处理费) |
¥1346 月 | 300 美元 credits | 0.629 | 官网 ↗ |
套餐信息核实时间2026-09-12 10:35 周期月 额度说明按官方文档的「按模型分配额度」:标准(开源)模型单模型月额度 $300(套餐总额度 $300)。额度按各模型官方单价扣减,平台零加价;credits 永不过期、可累积。 折算口径扣减口径等效综合单价 等效价计算等效 0.629 元/M = 综合 $0.1403/M × (200 ÷ 300) × 6.73 倍率说明由官方每 M token 价折算:Qwen3.8-Flash 输入 $0.16 · 缓存读 $0.016 · 输出 $0.47(按基准负载 输入:输出=3:1、缓存命中 90% 加权,得综合 $0.1403/M);再按套餐杠杆(月费 $200 ÷ 该模型月额度 $300)折算,乘汇率 6.73 得人民币价。 限制与口径持有限制官方设 5 小时与每周滚动上限(未公布具体数值)· 高级模型另设 $200 额度 计费说明套餐额度仅限在官方支持的编程工具中使用(该档可调 Provider API,按订阅 credits 计量);额度当月有效、不结转,用完后可按各模型成本价补充额度(补充额度可结转、不过期)。本档单价为固定价,不随峰谷变化。 备注含 68 款模型(官方目录)。额度按各模型官方单价扣减,平台标注零加价;另有入门档 Go($1/月 · $10 额度)与 API 档 Provider($15/月 + 按量),这两档该模型的单模型额度官方未公开,故未列等效价。 缓存价未公开缓存读按官方单价计费($0.016/M),已按 90% 命中率计入等效价 套餐页https://commandcode.ai/docs/resources/pricing-limits | |||||
| 没有符合条件的套餐,试试放宽筛选。 | |||||
*「等效价」口径:TokenPlan 的「等效价格」= 套餐月费 ÷ 该套餐按官方抵扣系数折算出的 token 总量,且按额度 100% 全部用完计算。额度用不完,实际单价会高于此值。
| 渠道 | 元 / 百万 tokens | 元 / 百万 tokens | 元 / 百万 tokens | 峰谷时间 | 官网 | ||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| M MiniMax 官方 官方自营 | 2.1 ~ 4.2 | 0.42 ~ 0.84 | 8.4 ~ 16.8 | 无峰谷定价 ≤512K 输入档 / >512K 输入档 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号MiniMax-M3(1M 上下文 / 最大输出 128K) 版本说明已核实(2026-09-11 MiniMax 官方按量计费页):M3 采用分档计价 —— 单次输入 ≤512K tokens 时 输入 2.1 / 缓存命中 0.42 / 输出 8.4(元每百万 tokens);超过 512K 时整单按 输入 4.2 / 缓存 0.84 / 输出 16.8 计价。官方页面注明 ≤512K 档为「永久五折」后的价格,原价 4.2 / 16.8。另设优先层级(service_tier=priority),价为基础价 1.5 倍,用于更稳定的响应时延。 接入
按量计费;分两档(512K 输入为界)。 口径与备注核实时间2026-09-16 19:12 风险说明长输入会跳档:单次输入超过 512K tokens 时整单价格翻倍,长文档场景需留意。海外站点同价($0.30 / $1.20,按当地汇率结算)。 厂家身份MiniMax(上海稀宇科技)官方开放平台。 定价页https://platform.minimaxi.com/docs/guides/pricing-paygo | |||||||||||||||||||||||||
| 阿 阿里云百炼 · 原厂直供 原厂直供 | 4.2 | 0.84 | 16.8 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号MiniMax/MiniMax-M3(1M 上下文) 版本说明已核实(2026-09-11 阿里云百炼官方文档):模型 MiniMax/MiniMax-M3,上下文 1,048,576;文档刊例 输入 4.2 / 缓存命中 0.84 / 输出 16.8(元每百万 tokens),限流 RPM 500 · TPM 20,000,000。页面注明「仅展示模型调用原价,不包含限时优惠」,实际可能存在活动折扣。 接入
默认限流 RPM 500 · TPM 20,000,000。 口径与备注核实时间2026-09-11 19:55 限速限流 RPM 500 · TPM 20,000,000 风险说明文档刊例为原价档(4.2 / 16.8),比已跟随官方降价的平台(七牛云、腾讯云,2.1 / 8.4)贵一倍。页面提示另有控制台活动优惠,开通前建议在控制台确认实付价。 定价页https://help.aliyun.com/zh/model-studio/minimax-m3 | |||||||||||||||||||||||||
| 七 七牛云 AI 推理 自部署 | 2.1 ~ 4.2 | 0.42 ~ 0.84 | 8.4 ~ 16.8 | 无峰谷定价 ≤512K 输入档 / >512K 输入档 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号minimax/minimax-m3(1M 上下文 / 最大输出 128K) 版本说明已核实(2026-09-11 七牛云模型广场数据):条目 id minimax/minimax-m3(即 MiniMax-M3),上下文 1,000,000、最大输出 128,000;单次输入 ≤512K tokens 时 输入 2.1 / 缓存命中 0.42 / 输出 8.4;超过 512K 时 输入 4.2 / 缓存 0.84 / 输出 16.8(元每百万 tokens),与官方一致。 接入
按量计费;分两档(512K 输入为界)。 口径与备注核实时间2026-09-16 20:29 风险说明价格与官方完全一致,且同样实现 512K 分档。 定价页https://www.qiniu.com/ai/models | |||||||||||||||||||||||||
| 腾 腾讯云 TokenHub(广州站) 自部署 | 2.1 ~ 4.2 | 0.42 ~ 0.84 | 8.4 ~ 16.8 | 无峰谷定价 ≤512K 输入档 / >512K 输入档 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号MiniMax-M3(1M 上下文) 版本说明已核实(腾讯云官方调价公告,2026-06-15 起生效;模型 MiniMax-M3):单次输入 (0, 512k] 档 输入 2.1 / 缓存命中 0.42 / 输出 8.4;512k+ 档 输入 4.2 / 缓存 0.84 / 输出 16.8(元每百万 tokens)。本次为在原价(4.2 / 16.8)基础上整体下调 50%。 接入
按量计费;分两档(512K 输入为界)。 口径与备注核实时间2026-09-16 20:31 风险说明公告明确两档阶梯与官方一致;实际计费以控制台为准。 定价页https://cloud.tencent.com/announce/detail/2321 | |||||||||||||||||||||||||
| 京 京东云 JoyMaaS | 4.2 ~ 8.4 | 0.84 ~ 1.68 | 16.8 ~ 33.6 | 无峰谷定价 单次输入 <512K 档 / 单次输入 ≥512K 档 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
部署说明官方未公示部署方式:以 JoyMaaS 托管版形式提供,官方未说明模型来源与部署形式,此处不做猜测,以官网说明为准。 版本说明✓ 已核实型号MiniMax-M3(1M 上下文) 版本说明已核实(2026-09-11 京东云官方计费文档《模型服务价格及计费规则》,页面更新于 2026-08-13):MiniMax-M3 按单次输入长度分两档 —— 输入 <512K tokens 时 输入 0.0042 元/千 token(= 4.2 元/百万)、缓存命中 0.00084(= 0.84)、输出 0.0168(= 16.8);输入 ≥512K 时 输入 0.0084(= 8.4)、缓存命中 0.00168(= 1.68)、输出 0.0336(= 33.6)。同一份文档另列 MiniMax-M2.7(0.0021 / 0.0084 元每千 token)。 接入
按 token 用量计费;分两档(512K 输入为界)。 口径与备注核实时间2026-09-16 20:29 风险说明该刊例为「未跟随官方降价的档位」:MiniMax 官方 ≤512K 档已降至 2.1 / 0.42 / 8.4 元每百万,此处仍按原价 4.2 / 0.84 / 16.8 计价,约为官方现价的 2 倍。另注意长输入会跳档:单次输入达到 512K tokens 时整单按高档计价。对价格敏感的场景可优先对比已跟随降价的平台。 厂家身份京东云 JoyMaaS(JoyBuilder 模型开发平台),国内首家上线 MiniMax-M3 的平台(2026-06-01 官方发布)。 定价页https://docs.jdcloud.com/cn/jdaip/maas-billing-rules | |||||||||||||||||||||||||
| 模 模力方舟(Gitee AI) 自部署 | 4.2 | — | 16.8 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号MiniMax-M3(1M 上下文,原生多模态) 版本说明已核实(2026-09-11 模力方舟模型广场页面):MiniMax-M3 输入 ¥4.2/M、输出 ¥16.8/M,为官方「原价档」;官方对 ≤512K 输入的请求另有 2.1/8.4 的永久五折档,本渠道未跟随。 接入访问 ai.gitee.com 模型广场可查看在售模型与价格;调用需注册账号 → 创建访问令牌 → 接口 https://ai.gitee.com/v1 (OpenAI 兼容)。平台依托沐曦(MetaX)国产算力。 口径与备注核实时间2026-09-16 19:12 风险说明该平台页面仅标注「缓存支持」,未公布缓存倍率,故缓存价留空。价格以其模型广场当前刊例为准,如遇平台促销可能低于此处所示。该渠道按官方原价档计价,高于已跟随五折的渠道(如七牛云 / 腾讯云 / PPIO),选型时留意。 厂家身份模力方舟(Gitee AI),开源中国旗下 AI 模型服务平台,依托沐曦(MetaX)国产算力提供 Serverless API,京ICP备2025119063号。 定价页https://ai.gitee.com/serverless-api | |||||||||||||||||||||||||
| P PPIO 派欧云 自部署 | 2.1 | 0.84 | 8.4 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号minimax/minimax-m3(1M 上下文) 版本说明已核实(2026-09-11 PPIO 官方模型接口数据):条目 id minimax/minimax-m3(即 MiniMax-M3),上下文 1,000,000;输入 2.1 / 输出 8.4(元每百万 tokens),与官方 ≤512K 档一致;接口未标注分档规则。 接入
按量计费。 口径与备注核实时间2026-09-11 19:55 风险说明缓存读取标注为 0.84 元每百万 tokens,是官方 ≤512K 档缓存价(0.42)的两倍,选型时留意。接口未标注长输入分档规则,实际以控制台为准。 厂家身份派欧云计算(上海)有限公司(沪ICP备18048206号-33)运营的分布式云计算平台。 定价页https://ppio.com/llm | |||||||||||||||||||||||||
| O OfoxAI 聚合网关 美元刊例 · 折算展示 | 4.04 | 0.81 | 16.15 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.6 · 缓存读取 $0.12 · 输出 $2.4(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号minimax/minimax-m3(1.1M 上下文) 版本说明已核实(2026-09-11 OfoxAI 官方模型接口原文):条目 minimax/minimax-m3(即 MiniMax-M3),上下文 1,131,000;输入 $0.60 / 缓存读取 $0.12 / 输出 $2.40(每 1M token)。该报价对应官方「未打折的原价」档位。 接入ofox.ai 注册 → 创建 API Key → OpenAI 兼容端点接入 按量计费,全时段统一价。 口径与备注核实时间2026-09-17 20:04 风险说明报价为官方原价档($0.60/$2.40),是已跟随官方折扣的平台($0.30/$1.20)的两倍,选型时留意。 定价页https://ofox.ai/models | |||||||||||||||||||||||||
| N Naga(聚合平台) 聚合平台 美元刊例 · 折算展示 | 1.0095 | 0.2019 | 4.038 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号minimax-m3 版本说明模型 ID 为 minimax-m3,即 MiniMax M3;据该平台官方定价页与官方接口(https://api.naga.ac/v1/models),两者一致。 接入
接口地址https://api.naga.ac/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明报价为同类中较低水平,未标注上游供应商,对比时留意。 定价页https://naga.ac/pricing | |||||||||||||||||||||||||
| C CoreWeave 自营推理 美元刊例 · 折算展示 | 1.55 | 0.34 | 6.46 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.23 · 缓存读取 $0.05 · 输出 $0.96(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号MiniMax-M3(262K 上下文 / fp4 量化) 版本说明已核实(2026-09-11 该平台公开模型接口报价):条目 MiniMax M3,上下文 262,144,fp4 量化;输入 $0.23 / 缓存读取 $0.05 / 输出 $0.96(每 1M token),为全表输入价最低档。 接入coreweave.com 注册 → 创建 API Key → OpenAI 兼容端点接入 按量计费,全时段统一价。 口径与备注核实时间2026-09-17 19:59 风险说明上下文 262K,低于官方 1M;采用 fp4 量化,输出质量可能与全精度版本有差异。 定价页https://www.coreweave.com | |||||||||||||||||||||||||
| Z ZenMux 聚合平台 美元刊例 · 折算展示 | 1.8171 ~ 3.6342 | 0.3634 ~ 0.7268 | 7.2684 ~ 14.5368 | 无峰谷定价 <512K 输入档 / ≥512K 输入档 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例(每 1M token):<512K 档 输入 $0.27 · 缓存 $0.054 · 输出 $1.08;≥512K 档 输入 $0.54 · 缓存 $0.108 · 输出 $2.16。人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算。 版本说明✓ 已核实型号minimax/minimax-m3(1M 上下文 / 支持图片与视频输入) 版本说明已核实(2026-09-11 ZenMux 官方模型目录原文):模型为 MiniMax-M3(条目 id minimax/minimax-m3),官网按单次输入长度分两档计价 —— 输入 <512K tokens 时 输入 $0.27 / 缓存读 $0.054 / 输出 $1.08;≥512K 时 输入 $0.54 / 缓存读 $0.108 / 输出 $2.16(每 1M token)。上下文 1,000,000,官方标注上线时间 2026-06-01。 接入
接口地址https://zenmux.ai/api/v1 口径与备注核实时间2026-09-15 08:35 风险说明该档位与 MiniMax 官方一致,均以单次请求的输入长度划档、按整单计价 —— 长输入会跳档。此处为平台当期折扣后的价格,较官方美元刊例($0.30 / $1.20)低一档;平台未标注折扣结束时间,取消折扣后单价会上浮,以官网当期报价为准。 厂家身份ZenMux,新加坡聚合网关(主体 AI Force Singapore Pte. Ltd.),目录覆盖 189 个模型。 定价页https://zenmux.ai | |||||||||||||||||||||||||
| D DeepInfra 自部署 美元刊例 · 折算展示 | 1.88 | 0.38 | 7.4 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.28 · 缓存读取 $0.056 · 输出 $1.1(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号MiniMax-M3(512K 上下文 / fp8 量化) 版本说明已核实(2026-09-11 DeepInfra 官方模型接口原文):条目 MiniMaxAI/MiniMax-M3,上下文 524,288,fp8 量化;输入 $0.28 / 缓存读取 $0.056 / 输出 $1.10(每 1M token)。 接入deepinfra.com 注册 → 创建 API Key → OpenAI 兼容端点接入 按量计费,全时段统一价。 口径与备注核实时间2026-09-17 20:04 定价页https://deepinfra.com/MiniMaxAI/MiniMax-M3 | |||||||||||||||||||||||||
| I Infron(零加价网关) 聚合网关 美元刊例 · 折算展示 | 峰2.02 / 谷1.88 | 峰0.4 / 谷0.34 | 峰8.08 / 谷7.4 | 峰:全时段(美元计价,按 1 USD ≈ 6.73 元折算) 谷:全时段,低优先级路由(适合离线评测、批处理等容忍波动的任务)(美元计价,按 1 USD ≈ 6.73 元折算) | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:Standard 档 输入 $0.3 · 缓存读 $0.06 · 输出 $1.2;Flex 档 输入 $0.28 · 缓存读 $0.05 · 输出 $1.1(每 1M token),无折扣。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 部署说明零加价路由 版本说明✓ 已核实型号minimax/minimax-m3 版本说明已核实(2026-09-15 据该站官方模型页数据):MiniMax M3 的 Standard 档 输入 $0.3 · 缓存读 $0.06 · 输出 $1.2(池内 6 家上游同价:minimax / deepinfra / novita / fireworks / together / atlas-cloud),Flex 档 输入 $0.28 · 缓存读 $0.05 · 输出 $1.1(lilac 一家);两档均无折扣。 接入
接口地址https://api.infron.ai/v1 零 token 加价,平台按 $0.35 + 5% 收取账户服务费。分 Flex / Standard 档位池。 口径与备注核实时间2026-09-15 20:58 风险说明价格口径:这里的价格取自该站模型页卡片标示的「Avg list price」,即该档位池内全部可用上游的算术平均;站内逐上游明细另列每家单价,最低的一条常显著低于此均值。该站原话「your request is billed at the rate of the provider it is routed to」—— 实际费用取决于当次路由到的上游,故此处均值偏保守。折扣时效:部分上游当前有折扣,幅度与期限由各上游自行调整,随时可能回调。资历:域名 2026-01-07 注册,公司很新,零加价模式下无动力压价,但长周期可靠性未经验证,建议按需使用,不建议一次性投入大额资金。 定价页https://infron.ai/models/minimax/minimax-m3 | |||||||||||||||||||||||||
| C Concentrate.ai(零加价网关) 聚合平台 美元刊例 · 折算展示 | 峰2.019 / 谷1.8844 | 峰0.4038 / 谷0.3769 | 峰8.076 / 谷7.403 | 峰:2026-09-16 复抓 平台公开单模型接口 providers 原文:池内按输入价升序取中位;美元计价,按 1 USD ≈ 6.73 元折算 谷:池内最低档,单上游调价/撤单即失效,仅作比价下限参考 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径聚合口径(2026-09-16 复抓 Concentrate.ai 公开单模型接口 providers(4 家上游)):主档取「池内中位档」(按输入价升序取上中位,不再取最低档)—— 中位档 novita 输入 $0.3 / 缓存 $0.06 / 输出 $1.2,池内区间输入 $0.28 ~ $0.3;人民币价 = 美元价 × 6.73(2026-09-16 汇率 1 USD ≈ 6.73 元)。 版本说明✓ 已核实型号MiniMax-M3(1M 上下文,原生多模态) 版本说明已核实(2026-09-11 平台公开模型接口):条目 MiniMax-M3(id minimax-m3) 池内 4 家上游,最低 DeepInfra 输入 $0.28 / 输出 $1.10(与 DeepInfra 直连报价一致),最高 MiniMax 官方 / Novita / Fireworks 输入 $0.30 / 输出 $1.20。口径修正(2026-09-16):聚合平台主档取「池内中位档」——池内共 4 家上游,中位档为 novita 输入 $0.3 / 输出 $1.2;原取池内最低档(受单上游撤单影响大)已降为次档。 接入concentrate.ai 注册 → 开通账号 → 接口 https://api.concentrate.ai/v1 (OpenAI 兼容)。平台为零加价网关(官方定价页写明 No platform markup on tokens,无服务费)。也支持 BYOK(自带上游密钥)消耗已有额度。 口径与备注核实时间2026-09-16 20:14 风险说明该平台为零加价网关:报价即各上游服务商的刊例价,本身不额外加价,故与直连上游渠道同价,不构成独立的一路供给。池内各上游的上下文长度与量化方式可能不同,横向比较时留意。 厂家身份Concentrate.ai,面向团队的 LLM 网关(站内自述 LLM Gateway),零加价透传各上游刊例价,持 SOC 2 Type II 认证。 定价页https://concentrate.ai/pricing | |||||||||||||||||||||||||
| F FastRouter(聚合平台) 聚合平台 美元刊例 · 折算展示 | 2.019 | 0.4038 | 8.076 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号minimax/minimax-m3 版本说明模型 ID 为 minimax/minimax-m3,即 MiniMax M3;据该平台官方定价页与官方接口(https://api.fastrouter.ai/v1/models),两者一致。 接入
接口地址https://api.fastrouter.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 定价页https://fastrouter.ai | |||||||||||||||||||||||||
| I Impossibl(聚合平台) 聚合平台 美元刊例 · 折算展示 | 2.019 | 0.4038 | 8.076 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号minimaxai/minimax-m3 版本说明模型 ID 为 minimaxai/minimax-m3,即 MiniMax M3;据该平台官方定价页与官方接口(https://api.impossibl.com/v1/models),两者一致。 接入
接口地址https://api.impossibl.com/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 定价页https://impossibl.com | |||||||||||||||||||||||||
| L LLM Gateway(聚合平台) 聚合平台 美元刊例 · 折算展示 | 2.019 | 0.4038 | 8.076 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号minimax-m3 版本说明模型 ID 为 minimax-m3,即 MiniMax M3;据该平台官方定价页与官方接口(https://api.llmgateway.io/v1/models),两者一致。 接入
接口地址https://api.llmgateway.io/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明报价低于同类聚合平台,未标注上游供应商,对比时留意。 定价页https://llmgateway.io/pricing | |||||||||||||||||||||||||
| M MegaNova 聚合平台 美元刊例 · 折算展示 | 2.019 | 0.4038 | 8.076 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号MiniMaxAI/MiniMax-M3 版本说明模型 ID 为 MiniMaxAI/MiniMax-M3,即 MiniMax M3;据该平台官方定价页与官方接口(https://api.meganova.ai/v1/models),两者一致。 接入
接口地址https://api.meganova.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 定价页https://meganova.ai | |||||||||||||||||||||||||
| N NavyAI(聚合平台) 聚合平台 美元刊例 · 折算展示 | 2.019 | 2.019 | 8.076 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号minimax-m3 版本说明模型 ID 为 minimax-m3,即 MiniMax M3;据该平台官方定价页与官方接口(https://api.navy/v1/models),两者一致。该渠道未公布缓存价,此处按无缓存折扣计(缓存档等于输入价)。 接入
接口地址https://api.navy/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明报价明显低于同业,未标注上游供应商,货源请自行核对。 定价页https://api.navy | |||||||||||||||||||||||||
| O OpenRouter(聚合平台) 聚合平台 美元刊例 · 折算展示 | 2.02 | 0.4 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.3 · 缓存读取 $0.06 · 输出 $1.2(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号MiniMax M3(池内 12 家上游) 版本说明已核实(2026-09-11 该平台公开模型列表):MiniMax M3 条目池内有 12 家上游(含 MiniMax 官方、DeepInfra、Together、Novita、Parasail、AtlasCloud、GMICloud、Venice、CoreWeave、StreamLake、SambaNova、ModelRun),刊例 输入 $0.30 / 缓存读取 $0.06 / 输出 $1.20。各上游价差较大(输入 $0.23 ~ $0.75),此处取池内主流价。 接入openrouter.ai 注册 → 创建 API Key → OpenAI 兼容端点接入 按量计费,全时段统一价。 口径与备注核实时间2026-09-17 20:04 风险说明池内 12 家上游价差不小(输入 $0.23~$0.75、输出 $0.96~$3.00),实际按命中路由计费,可在控制台指定偏好上游。 定价页https://openrouter.ai/minimax/minimax-m3 | |||||||||||||||||||||||||
| T Together AI 自部署 美元刊例 · 折算展示 | 2.02 | 0.4 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.3 · 缓存读取 $0.06 · 输出 $1.2(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号MiniMax M3(524K 上下文) 版本说明已核实(2026-09-11 该平台公开模型接口报价):条目 MiniMax M3,上下文 524,288;输入 $0.30 / 缓存读取 $0.06 / 输出 $1.20(每 1M token)。 接入together.ai 注册 → 创建 API Key → OpenAI 兼容端点接入 按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:31 定价页https://www.together.ai/models | |||||||||||||||||||||||||
| R Routeway(聚合平台) 聚合平台 美元刊例 · 折算展示 | 2.1536 | 0.4038 | 8.4798 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号minimax-m3 版本说明模型 ID 为 minimax-m3,即 MiniMax M3;据该平台官方定价页与官方接口(https://api.routeway.ai/v1/models),两者一致。 接入
接口地址https://api.routeway.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明极低价档与试验性路由不计入,此处取标准档。 定价页https://routeway.ai | |||||||||||||||||||||||||
| E Eurouter(聚合平台) 聚合平台 美元刊例 · 折算展示 | 2.692 | 2.692 | 13.46 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号minimax-m3 版本说明模型 ID 为 minimax-m3,即 MiniMax M3;据该平台官方定价页与官方接口(https://api.eurouter.ai/v1/models),两者一致。该渠道未公布缓存价,此处按无缓存折扣计(缓存档等于输入价)。 接入
接口地址https://api.eurouter.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明部分模型原站以欧元刊例。 定价页https://eurouter.ai/models | |||||||||||||||||||||||||
| C Cortecs 聚合平台 欧元刊例 · 折算展示 | 2.7938 | 0.7004 | 13.9692 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 EUR 刊例,人民币价 = 原价 × 7.87(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号minimax-m3 版本说明模型 ID 为 minimax-m3,即 MiniMax M3;据该平台官方定价页与官方接口(https://api.cortecs.ai/v1/models),两者一致。 接入
接口地址https://api.cortecs.ai/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 风险说明欧洲节点,原站以欧元刊例。 定价页https://cortecs.ai | |||||||||||||||||||||||||
| G GMICloud 自营推理 美元刊例 · 折算展示 | 1.62 | 0.32 | 6.46 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.24 · 缓存读取 $0.048 · 输出 $0.96(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号MiniMax-M3(1M 上下文 / fp8 量化) 版本说明已核实(2026-09-11 该平台公开模型接口报价):条目 MiniMax M3,上下文 1,048,576,fp8 量化;输入 $0.24 / 缓存读取 $0.048 / 输出 $0.96(每 1M token)。 接入gmicloud.ai 登录控制台 → 创建 API Key → OpenAI 兼容端点接入 按量计费,全时段统一价。 口径与备注核实时间2026-09-11 19:55 风险说明价格只在登录后的控制台展示,本价取自该平台公开模型列表,以控制台为准。 定价页https://gmicloud.ai/models | |||||||||||||||||||||||||
| L Lilac 自营推理 美元刊例 · 折算展示 | 1.8844 | 0.3365 | 7.403 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号minimaxai/minimax-m3 版本说明模型 ID 为 minimaxai/minimax-m3,即 MiniMax M3;据该平台官方定价页与官方接口(https://api.getlilac.com/v1/models),两者一致。 接入
接口地址https://api.getlilac.com/v1/models 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 定价页https://getlilac.com | |||||||||||||||||||||||||
| A AiHubMix 聚合中转 美元刊例 · 折算展示 | 1.9382 | 1.9382 | 7.753 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-15 汇率口径,沿用表内既有条目)。 版本说明✓ 已核实型号minimax-m3 版本说明模型 ID 为 minimax-m3,即 MiniMax M3;据该平台官方接口(https://aihubmix.com/model/minimax-m3)当场核对,标的为 MiniMax M3 本代版本,非同族旧代。 接入
聚合中转站,支持中文界面,国内可直连。 口径与备注核实时间2026-09-15 08:20 风险说明挂牌价 $0.142/$0.284 低于池内最低上游(DeepInfra $0.198),疑似限时补贴价——以实际结算为准,涨回原价属正常。缓存读挂牌 $0.0284。 该模型在该平台未单独标注缓存命中价,缓存价按输入价计。 定价页https://aihubmix.com/model/minimax-m3 | |||||||||||||||||||||||||
| E Eden AI(聚合平台) 聚合平台 美元刊例 · 折算展示 | 峰2.8401 / 谷1.988 | 峰0.71 / 谷0.355 | 峰14.2003 / 谷7.8102 | 峰:池内最高档,仅作比价上限参考,已含平台 5.5% 服务费 谷:池内最低档,单上游调价/撤单即失效,仅作比价下限参考,已含平台 5.5% 服务费 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径聚合口径(2026-09-16 复抓 Eden AI 公开模型目录接口(7 家上游)):主档取「池内中位档」(按输入价升序取上中位,不再取最低档)—— 中位档 minimax 输入 $0.3 / 缓存 $0.06 / 输出 $1.2,池内区间输入 $0.28 ~ $0.4;平台另收 5.5% 服务费,人民币价 = 美元价 × 1.055 × 6.73(2026-09-16 汇率 1 USD ≈ 6.73 元)。 版本说明✓ 已核实型号MiniMax M3 版本说明已核实(2026-09-14 平台公开模型目录接口原文):该平台目录逐条给出模型标识、上游服务商、上下文长度与按 token 的三列价;表中取各上游的刊例价(非折后价)。本模型在目录中标注为「MiniMax M3」,池内共 7 家上游(7 条可用报价),最低 lilac,最高 tensorx。口径修正(2026-09-16):聚合平台主档取「池内中位档」——池内共 7 家上游,中位档为 minimax 输入 $0.3 / 输出 $1.2;原取池内最低档(受单上游撤单影响大)已降为次档。,已含平台 5.5% 服务费 接入
接口地址https://api.edenai.run/v3 价格取自平台公开定价页与其公开模型目录,读者可直接打开核对。 口径与备注核实时间2026-09-16 20:14 风险说明聚合网关:本身不加工上游定价,报价为各上游服务商刊例价,另按 5.5% 收取平台服务费,表中价格已含该费用。同一模型池内多家上游的报价与上下文长度可能不同,若不指定上游,实际可能路由到池内任一家,横向比较时留意。 定价页https://www.edenai.co/pricing | |||||||||||||||||||||||||
| C Canopywave 自营推理 美元刊例 · 折算展示 | 2.019 | 0.4038 | 8.076 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号minimax-m3 版本说明模型 ID 为 minimax-m3,即 MiniMax M3;据该平台官方定价页与官方接口(https://api.canopywave.io/v1),两者一致。 接入
接口地址https://api.canopywave.io/v1 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 09:33 定价页https://canopywave.com/models | |||||||||||||||||||||||||
| O OrcaRouter(零加价网关) 聚合网关 美元刊例 · 折算展示 | 2.019 | 0.4038 | 8.076 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-15 汇率口径,沿用表内既有条目)。 版本说明✓ 已核实型号minimax/minimax-m3 版本说明模型 ID 为 minimax/minimax-m3,即 MiniMax M3;据该平台官方接口(https://www.orcarouter.ai/models/minimax/minimax-m3)当场核对,标的为 MiniMax M3 本代版本,非同族旧代。 接入
免费档 3 个 API Key;支持 BYOK 自带上游 Key。零 token 加价:按上游 provider 刊例原价计费,收入来自 Team($499/月)等功能费。 OpenAI/Anthropic 双协议兼容) 口径与备注核实时间2026-09-17 20:04 风险说明背景:Continuum AI(新加坡)研发、FlashLabs(东京)日本市场发行,2026 年中上线,10 周获 11 万开发者,MIT 开源 OrcaRouter-Lite 可自托管,宣称 SOC2/GDPR 合规。公司年轻、融资未披露——零加价模式下无动力压价,但长周期可靠性未经验证,建议按需使用,不建议一次性大额开通。
价格口径:峰时(UTC 01:00–04:00、06:00–10:00,即北京时间 09:00–12:00、14:00–18:00)全档 ×2;缓存按上游缓存费率计。页面 FAQ 文本仍显示旧价 $0.15/$0.29,以定价区块(官方称每 60 秒刷新)为准。官方页自报实测:p50 首 token 752ms、输出 126 tok/s、7 天错误率 0.61%。 定价页https://www.orcarouter.ai/models/minimax/minimax-m3 | |||||||||||||||||||||||||
| N Novita AI 自部署 美元刊例 · 折算展示 | 2.02 | 0.4 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.3 · 缓存读取 $0.06 · 输出 $1.2(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号MiniMax-M3(1M 上下文 / fp8 量化) 版本说明已核实(2026-09-11 Novita 官方模型接口原文):条目 minimax/minimax-m3(即 MiniMax-M3),上下文 1,000,000,最大输出 131,072,fp8 量化;输入 $0.30 / 缓存读取 $0.06 / 输出 $1.20(每 1M token)。 接入novita.ai 注册 → 创建 API Key → OpenAI 兼容端点接入 按量计费,全时段统一价。 口径与备注核实时间2026-09-11 19:55 定价页https://novita.ai/models | |||||||||||||||||||||||||
| V Venice AI 隐私推理 美元刊例 · 折算展示 | 2.02 | 0.4 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.3 · 缓存读取 $0.06 · 输出 $1.2(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号MiniMax-M3(524K 上下文 / fp8 量化) 版本说明已核实(2026-09-11 该平台公开模型接口报价):条目 MiniMax M3,上下文 524,288,fp8 量化;输入 $0.30 / 缓存读取 $0.06 / 输出 $1.20(每 1M token)。 接入venice.ai 注册 → 创建 API Key → OpenAI 兼容端点接入 按量计费,全时段统一价。 口径与备注核实时间2026-09-17 19:59 风险说明平台主打隐私推理(不留存对话),其定位与价格口径与常规托管商略有不同。 定价页https://docs.venice.ai/models/overview | |||||||||||||||||||||||||
| P Parasail 自营推理 美元刊例 · 折算展示 | 2.02 | 0.4 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.3 · 缓存读取 $0.06 · 输出 $1.2(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号MiniMax-M3(1M 上下文 / fp8 量化) 版本说明已核实(2026-09-11 该平台公开模型接口报价):条目 MiniMax M3,上下文 1,048,576,fp8 量化;输入 $0.30 / 缓存读取 $0.06 / 输出 $1.20(每 1M token)。 接入parasail.io 注册 → 创建 API Key → OpenAI 兼容端点接入 按量计费,全时段统一价。 口径与备注核实时间2026-09-16 20:29 定价页https://www.parasail.io/models | |||||||||||||||||||||||||
| A AtlasCloud 自营推理 美元刊例 · 折算展示 | 2.02 ~ 4.04 | 0.4 ~ 0.81 | 8.08 ~ 16.15 | 无峰谷定价 ≤512K 输入档 / >512K 输入档 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.3 · 缓存读取 $0.06 · 输出 $1.2(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号MiniMax-M3(524K 上下文 / fp8 量化) 版本说明已核实(2026-09-11 AtlasCloud 官方模型接口原文):条目 minimaxai/minimax-m3(即 MiniMax-M3),上下文 524,300,fp8 量化;输入 $0.30 / 缓存读取 $0.06 / 输出 $1.20(每 1M token);接口明确声明单次输入超 512,000 tokens 后翻倍为 输入 $0.60 / 缓存 $0.12 / 输出 $2.40。 接入atlascloud.ai 注册 → 创建 API Key → OpenAI 兼容端点接入 按量计费,全时段统一价。 口径与备注核实时间2026-09-16 19:12 风险说明与官方一致设有长输入翻倍档(>512K 时整单翻倍),长文档场景需留意。 定价页https://www.atlascloud.ai/models | |||||||||||||||||||||||||
| N NanoGPT 聚合网关 美元刊例 · 折算展示 | 2.02 | 0.4 | 8.08 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.3 · 缓存读取 $0.06 · 输出 $1.2(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号minimax/minimax-m3(512K 上下文) 版本说明已核实(2026-09-11 NanoGPT 官方模型目录接口原文):条目 minimax/minimax-m3(即 MiniMax-M3),上下文 512,000;输入 $0.30 / 缓存读取 $0.06 / 输出 $1.20(每 1M token)。 接入nano-gpt.com 注册 → 创建 API Key → OpenAI 兼容端点接入 按量计费,全时段统一价。 口径与备注核实时间2026-09-16 19:12 定价页https://nano-gpt.com/models | |||||||||||||||||||||||||
| A AI/ML API 聚合网关 美元刊例 · 折算展示 | 2.6247 | 0.5249 | 10.4988 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.39 · 缓存命中 $0.078 · 输出 $1.56(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-15 汇率)。 版本说明✓ 已核实型号minimax/minimax-m3 版本说明已核实(2026-09-15 该平台官方模型页原文):模型 id minimax/minimax-m3,页面刊例 输入 $0.39 · 缓存命中 $0.078 · 输出 $1.56(每 1M token)。该页标注发布时间 Jun 1, 2026,为 MiniMax M3 本代版本,非同族旧代。 接入
接口地址https://api.aimlapi.com/v1 按量计费,全时段统一价。 口径与备注核实时间2026-09-17 20:04 风险说明加价型聚合网关:本站刊例高于 MiniMax 官方价($0.30 / $1.20)。平台主体为美国公司(页脚 © AI/ML, LLC),网络足迹可追溯至 2021 年。 定价页https://aimlapi.com/models/minimax-m3 | |||||||||||||||||||||||||
| F Featherless 聚合网关 美元刊例 · 折算展示 | 3.7 | — | 14.81 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.55 · 输出 $2.2(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号MiniMaxAI/MiniMax-M3(262K 上下文) 版本说明已核实(2026-09-11 Featherless 官方模型接口原文):条目 MiniMaxAI/MiniMax-M3,上下文 262,144;输入 $0.55 / 输出 $2.20(每 1M token)。 接入featherless.ai 注册 → 订阅套餐(按并发额度)→ 创建 API Key 按量计费,全时段统一价。 口径与备注核实时间2026-09-16 19:12 风险说明计价模式特殊:平台以「并发额度」订阅制为主,token 价另计,实际成本取决于套餐档位;上下文 262K 低于官方 1M。 定价页https://featherless.ai/models/MiniMaxAI/MiniMax-M3 | |||||||||||||||||||||||||
| S SambaNova 自营推理 美元刊例 · 折算展示 | 4.04 | — | 16.15 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.6 · 输出 $2.4(每 1M token)。人民币价 = 美元价 × 6.73(2026-09-11 汇率)。 版本说明✓ 已核实型号MiniMax-M3(1M 上下文) 版本说明已核实(2026-09-11 SambaNova 官方模型接口原文):条目 MiniMax-M3,上下文 1,048,576;输入 $0.60 / 输出 $2.40(每 1M token),接口未提供缓存命中价。 接入cloud.sambanova.ai 注册 → 创建 API Key → OpenAI 兼容端点接入 按量计费,全时段统一价。 口径与备注核实时间2026-09-16 19:12 风险说明报价为官方原价档,且未提供缓存命中折扣,多轮对话场景成本会偏高。 定价页https://cloud.sambanova.ai/apis | |||||||||||||||||||||||||
| I InferHub ⚠ 低价参考 · 谨慎 | 0.2847 | — | 1.1387 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
接入
口径与备注核实时间2026-09-16 备注订单簿中间价档(各家卖方挂单按价升序,取中间偏高档;最低档受单卖家撤单影响大,不作代表价)。2026-09-16 全量复抓(口径 = 订单簿池内挂单中位档,非最低档):v4-flash 17 档取上中位 $0.031;glm-5.3-flash 22 档取上中位 $0.03;minimax-m3 22 档取上中位 $0.0423,较当日 20:17 记录的 $0.0399 再涨约 6%,已按新值下调。挂单池随卖方进出实时变动,同日不同时刻档位数在 17~28 之间浮动,故同一模型一天内可能反复微调;本次三个型号取同一时刻快照。 风险说明页面自述其做法是把各家 AI 订阅套餐中用不完的额度汇集起来对外提供接口,额度来源与上游供应方无法通过公开渠道核实。同一模型的『最低档』由各家卖方分别挂出、随供需浮动,卖方一撤单就回落到更贵的次档(次档通常贵 10%~200%)。 使用前请先看该档的『可供家数』:家数少的档随时会没有。 定价页https://inferhub.dev/pricing | |||||||||||||||||||||||||
| 没有符合条件的渠道,试试放宽筛选。 | |||||||||||||||||||||||||
| 渠道 | 套餐 | 费用 元 | 额度 | 元 / 百万 tokens | 官网 |
|---|---|---|---|---|---|
| O OpenCode Go | Go 订阅(首月 $5 · 续费 $10/月) |
¥67.3 月 | 60 美元用量 | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明按美元价值扣费。MiniMax M3 的单模型月额度为 $60;官方未公开每 token 扣费单价,等效价无法折算,不编数。 限制与口径持有限制5 小时上限 $12 · 每周上限 $30 · 单模型月额度分 $15/$30/$60 三档(MiniMax M3 为 $60 档)。官方估算 MiniMax M3 约 3,200 次/5 小时(编程负载)。 计费说明重要:单模型月额度 $60 封顶,即使总额度未用满也无法超出该模型的额度上限。超额可开启 Use balance 回落到按量额度。每工作空间限 1 人订阅。仅限在受支持的编程工具中交互式使用。 单独使用本模型时,$60 单模型额度可跑满。 备注含 27 款模型(官方页列出 10 款代表型号)。按美元价值扣费,路由到当下成本最低且有容量的供应商;额度当月有效不结转。API 可导出(OpenAI 兼容 /zen/go/v1/chat/completions 与 Anthropic 兼容 /v1/messages)。 套餐页https://opencode.ai/go | |||||
| O Ollama Cloud | Pro($20/月) |
¥134.6 月 | 60 美元用量 | 1.63 | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明按官方每 M token 价扣费:MiniMax-M3 输入 $0.6 · 缓存读 $0.12 · 输出 $2.4(高峰时段工作日 12:00-18:00 UTC 全部 ×2);用完后可按同价续期。 折算口径扣减口径等效综合单价(谷时) 等效价计算等效 1.63 元/M(谷时)= 官方综合 $0.726/M ÷ 3 × 6.73;高峰约 3.26 元/M 倍率说明由官方 token 价 × 订阅杠杆(月费/用量 = 1/3)× 汇率 6.73 折出;高峰时段约 ×2。综合单价 $0.726/M(输入 $0.6 · 缓存 $0.12 · 输出 $2.4,按 3:1、缓存 90% 加权)。 限制与口径持有限制无 5 小时/每周上限(3 路并发) 计费说明等效价 = 官方单价 ×(月费 ÷ 月度用量)= 按量价的 1/3,非估算。按基准负载(3:1、缓存 90%%)折算;高峰翻倍扣费会减少实际可用量。 备注Ollama 为本地运行时起家(9M+ 开发者),云端原生权重、零留存不训练;CLI/API/桌面端通用,兼容现有本地 Ollama 工作流。Pro 含 $60 用量、Max 含 $300 用量。 缓存价未公开缓存读按官方价扣费,等效价已按 90% 命中率折入 套餐页https://ollama.com/pricing | |||||
| O Ollama Cloud | Max($100/月) |
¥673 月 | 300 美元用量 | 1.63 | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明按官方每 M token 价扣费:MiniMax-M3 输入 $0.6 · 缓存读 $0.12 · 输出 $2.4(高峰时段工作日 12:00-18:00 UTC 全部 ×2);用完后可按同价续期。 折算口径扣减口径等效综合单价(谷时) 等效价计算等效 1.63 元/M(谷时)= 官方综合 $0.726/M ÷ 3 × 6.73;高峰约 3.26 元/M 倍率说明由官方 token 价 × 订阅杠杆(月费/用量 = 1/3)× 汇率 6.73 折出;高峰时段约 ×2。综合单价 $0.726/M(输入 $0.6 · 缓存 $0.12 · 输出 $2.4,按 3:1、缓存 90% 加权)。 限制与口径持有限制无 5 小时/每周上限(10 路并发) 计费说明等效价 = 官方单价 ×(月费 ÷ 月度用量)= 按量价的 1/3,非估算。按基准负载(3:1、缓存 90%%)折算;高峰翻倍扣费会减少实际可用量。 备注Ollama 为本地运行时起家(9M+ 开发者),云端原生权重、零留存不训练;CLI/API/桌面端通用,兼容现有本地 Ollama 工作流。Pro 含 $60 用量、Max 含 $300 用量。 缓存价未公开缓存读按官方价扣费,等效价已按 90% 命中率折入 套餐页https://ollama.com/pricing | |||||
| 火 火山方舟 | Agent Plan 个人版 · Small |
¥40 月 | 2 万 AFP | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明每月额度 限制与口径持有限制周额度 7,000 · 5 小时额度 2,000 · 日额度 10,000(AFT);建议同时进行单个项目的开发 计费说明AFP(Agent 燃料值)统一抵扣;文本生成模型不可用于 API 调用,在非 AI 工具中使用套餐权益对应的 Base URL 与 API Key 可能被识别为违规使用。套餐仅支持升配不支持降配;支持非七天无理由自助退订。 备注该模型在本档套餐中可用。采用 AFP(Agent 燃料值)统一抵扣,套餐额度在 5 小时、周、月三个周期内分别限额,耗尽后等下一周期自动恢复。不同模型的 AFP 抵扣系数不同,官方未公开本模型的具体系数,等效价无法折算,不编数。 套餐页https://www.volcengine.com/docs/82379/2366394 | |||||
| 火 火山方舟 | Agent Plan 个人版 · Medium |
¥200 月 | 10 万 AFP | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明每月额度 限制与口径持有限制周额度 35,000 · 5 小时额度 10,000 · 日额度 50,000(AFT);建议同时进行 1-2 个项目的开发 计费说明AFP(Agent 燃料值)统一抵扣;文本生成模型不可用于 API 调用,在非 AI 工具中使用套餐权益对应的 Base URL 与 API Key 可能被识别为违规使用。套餐仅支持升配不支持降配;支持非七天无理由自助退订。 备注该模型在本档套餐中可用。采用 AFP(Agent 燃料值)统一抵扣,套餐额度在 5 小时、周、月三个周期内分别限额,耗尽后等下一周期自动恢复。不同模型的 AFP 抵扣系数不同,官方未公开本模型的具体系数,等效价无法折算,不编数。 套餐页https://www.volcengine.com/docs/82379/2366394 | |||||
| 火 火山方舟 | Agent Plan 个人版 · Large |
¥500 月 | 25 万 AFP | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明每月额度 限制与口径持有限制周额度 87,500 · 5 小时额度 25,000 · 日额度 125,000(AFT);建议同时进行 2+ 个项目的开发 计费说明AFP(Agent 燃料值)统一抵扣;文本生成模型不可用于 API 调用,在非 AI 工具中使用套餐权益对应的 Base URL 与 API Key 可能被识别为违规使用。套餐仅支持升配不支持降配;支持非七天无理由自助退订。 备注该模型在本档套餐中可用。采用 AFP(Agent 燃料值)统一抵扣,套餐额度在 5 小时、周、月三个周期内分别限额,耗尽后等下一周期自动恢复。不同模型的 AFP 抵扣系数不同,官方未公开本模型的具体系数,等效价无法折算,不编数。 套餐页https://www.volcengine.com/docs/82379/2366394 | |||||
| 火 火山方舟 | Agent Plan 个人版 · Max |
¥1000 月 | 50 万 AFP | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明每月额度 限制与口径持有限制周额度 175,000 · 5 小时额度 50,000 · 日额度 250,000(AFT);建议同时进行 2+ 个项目的开发 计费说明AFP(Agent 燃料值)统一抵扣;文本生成模型不可用于 API 调用,在非 AI 工具中使用套餐权益对应的 Base URL 与 API Key 可能被识别为违规使用。套餐仅支持升配不支持降配;支持非七天无理由自助退订。 备注该模型在本档套餐中可用。采用 AFP(Agent 燃料值)统一抵扣,套餐额度在 5 小时、周、月三个周期内分别限额,耗尽后等下一周期自动恢复。不同模型的 AFP 抵扣系数不同,官方未公开本模型的具体系数,等效价无法折算,不编数。 套餐页https://www.volcengine.com/docs/82379/2366394 | |||||
| 京 京东云 JoyMaaS | Token Plan 个人版 Lite |
¥69 月 | 1.73 万 Credits/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明Credits 计量:消耗 =(输入 Token×输入系数 + 输出 Token×输出系数)÷10000。 限制与口径持有限制一个 Key 通用套餐内所有模型(官方列六大模型,含 MiniMax-M3),切换模型只需更改 model 参数。 计费说明个人版每日限量发售,售完次日 00:00 重置。套餐一经开通,不支持退订与退款。不同模型 Credits 系数不同,官方未公开本模型的具体系数,等效价无法折算,不编数。 备注套餐覆盖六个主流模型:GLM-5.2、GLM-5.1、DeepSeek-Pro、DeepSeek-Flash、MiniMax-M3、Kimi-K2.6。兼容 OpenAI 与 Anthropic 双协议。 套餐页https://www.jdcloud.com/cn/products/tokenplan | |||||
| 京 京东云 JoyMaaS | Token Plan 个人版 Standard |
¥199 月 | 4.97 万 Credits/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明Credits 计量:消耗 =(输入 Token×输入系数 + 输出 Token×输出系数)÷10000。 限制与口径持有限制一个 Key 通用套餐内所有模型(官方列六大模型,含 MiniMax-M3),切换模型只需更改 model 参数。 计费说明个人版每日限量发售,售完次日 00:00 重置。套餐一经开通,不支持退订与退款。不同模型 Credits 系数不同,官方未公开本模型的具体系数,等效价无法折算,不编数。 备注套餐覆盖六个主流模型:GLM-5.2、GLM-5.1、DeepSeek-Pro、DeepSeek-Flash、MiniMax-M3、Kimi-K2.6。兼容 OpenAI 与 Anthropic 双协议。 套餐页https://www.jdcloud.com/cn/products/tokenplan | |||||
| 京 京东云 JoyMaaS | Token Plan 个人版 Pro |
¥599 月 | 14.97 万 Credits/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明Credits 计量:消耗 =(输入 Token×输入系数 + 输出 Token×输出系数)÷10000。 限制与口径持有限制一个 Key 通用套餐内所有模型(官方列六大模型,含 MiniMax-M3),切换模型只需更改 model 参数。 计费说明个人版每日限量发售,售完次日 00:00 重置。套餐一经开通,不支持退订与退款。不同模型 Credits 系数不同,官方未公开本模型的具体系数,等效价无法折算,不编数。 备注套餐覆盖六个主流模型:GLM-5.2、GLM-5.1、DeepSeek-Pro、DeepSeek-Flash、MiniMax-M3、Kimi-K2.6。兼容 OpenAI 与 Anthropic 双协议。 套餐页https://www.jdcloud.com/cn/products/tokenplan | |||||
| 京 京东云 JoyMaaS | Token Plan 个人版 Max |
¥999 月 | 24.98 万 Credits/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:40 周期月 额度说明Credits 计量:消耗 =(输入 Token×输入系数 + 输出 Token×输出系数)÷10000。 限制与口径持有限制一个 Key 通用套餐内所有模型(官方列六大模型,含 MiniMax-M3),切换模型只需更改 model 参数。 计费说明个人版每日限量发售,售完次日 00:00 重置。套餐一经开通,不支持退订与退款。不同模型 Credits 系数不同,官方未公开本模型的具体系数,等效价无法折算,不编数。 备注套餐覆盖六个主流模型:GLM-5.2、GLM-5.1、DeepSeek-Pro、DeepSeek-Flash、MiniMax-M3、Kimi-K2.6。兼容 OpenAI 与 Anthropic 双协议。 套餐页https://www.jdcloud.com/cn/products/tokenplan | |||||
| C CommandCode | GOAT($10/月 + 处理费) |
¥67.3 月 | 47 美元 credits | 0.52 | 官网 ↗ |
套餐信息核实时间2026-09-12 10:35 周期月 额度说明按官方文档的「按模型分配额度」:单模型月额度上限 $40(套餐总额度 $70;官方对各模型另设单模型额度上限)。额度按各模型官方单价扣减,平台零加价;credits 永不过期、可累积。 折算口径扣减口径等效综合单价 等效价计算等效 0.520 元/M = 综合 $0.363/M × (10 ÷ 47) × 6.73 倍率说明由官方每 M token 价折算:MiniMax-M3 输入 $0.3 · 缓存读 $0.06 · 输出 $1.2(按基准负载 输入:输出=3:1、缓存命中 90% 加权,得综合 $0.363/M);再按套餐杠杆(月费 $10 ÷ 该模型月额度 $47)折算,乘汇率 6.73 得人民币价。 限制与口径持有限制官方设 5 小时与每周滚动上限(未公布具体数值) 计费说明套餐额度仅限在官方支持的编程工具中使用(该档可调 Provider API,按订阅 credits 计量);额度当月有效、不结转,用完后可按各模型成本价补充额度(补充额度可结转、不过期)。本档单价为固定价,不随峰谷变化。 备注含 68 款模型(官方目录)。额度按各模型官方单价扣减,平台标注零加价;另有入门档 Go($1/月 · $10 额度)与 API 档 Provider($15/月 + 按量),这两档该模型的单模型额度官方未公开,故未列等效价。 该模型在官方「优惠」列表中:列表价 $0.60/$2.40/$0.12,折后 $0.30/$1.20/$0.06(官方称 50% off,等效 2 倍用量);等效价已按折后单价计入。 缓存价未公开缓存读按官方单价计费($0.06/M),已按 90% 命中率计入等效价 套餐页https://commandcode.ai/docs/resources/pricing-limits | |||||
| C CommandCode | Pro($20/月 + 处理费) |
¥134.6 月 | 57 美元 credits | 0.857 | 官网 ↗ |
套餐信息核实时间2026-09-12 10:35 周期月 额度说明按官方文档的「按模型分配额度」:单模型月额度上限 $50(套餐总额度 $80;官方对各模型另设单模型额度上限)。额度按各模型官方单价扣减,平台零加价;credits 永不过期、可累积。 折算口径扣减口径等效综合单价 等效价计算等效 0.857 元/M = 综合 $0.363/M × (20 ÷ 57) × 6.73 倍率说明由官方每 M token 价折算:MiniMax-M3 输入 $0.3 · 缓存读 $0.06 · 输出 $1.2(按基准负载 输入:输出=3:1、缓存命中 90% 加权,得综合 $0.363/M);再按套餐杠杆(月费 $20 ÷ 该模型月额度 $57)折算,乘汇率 6.73 得人民币价。 限制与口径持有限制官方设 5 小时与每周滚动上限(未公布具体数值) 计费说明套餐额度仅限在官方支持的编程工具中使用(该档可调 Provider API,按订阅 credits 计量);额度当月有效、不结转,用完后可按各模型成本价补充额度(补充额度可结转、不过期)。本档单价为固定价,不随峰谷变化。 备注含 68 款模型(官方目录)。额度按各模型官方单价扣减,平台标注零加价;另有入门档 Go($1/月 · $10 额度)与 API 档 Provider($15/月 + 按量),这两档该模型的单模型额度官方未公开,故未列等效价。 该模型在官方「优惠」列表中:列表价 $0.60/$2.40/$0.12,折后 $0.30/$1.20/$0.06(官方称 50% off,等效 2 倍用量);等效价已按折后单价计入。 缓存价未公开缓存读按官方单价计费($0.06/M),已按 90% 命中率计入等效价 套餐页https://commandcode.ai/docs/resources/pricing-limits | |||||
| C CommandCode | Max 10×($100/月 + 处理费) |
¥673 月 | 150 美元 credits | 1.629 | 官网 ↗ |
套餐信息核实时间2026-09-12 10:35 周期月 额度说明按官方文档的「按模型分配额度」:标准(开源)模型单模型月额度 $150(套餐总额度 $150)。额度按各模型官方单价扣减,平台零加价;credits 永不过期、可累积。 折算口径扣减口径等效综合单价 等效价计算等效 1.629 元/M = 综合 $0.363/M × (100 ÷ 150) × 6.73 倍率说明由官方每 M token 价折算:MiniMax-M3 输入 $0.3 · 缓存读 $0.06 · 输出 $1.2(按基准负载 输入:输出=3:1、缓存命中 90% 加权,得综合 $0.363/M);再按套餐杠杆(月费 $100 ÷ 该模型月额度 $150)折算,乘汇率 6.73 得人民币价。 限制与口径持有限制官方设 5 小时与每周滚动上限(未公布具体数值)· 高级模型另设 $100 额度 计费说明套餐额度仅限在官方支持的编程工具中使用(该档可调 Provider API,按订阅 credits 计量);额度当月有效、不结转,用完后可按各模型成本价补充额度(补充额度可结转、不过期)。本档单价为固定价,不随峰谷变化。 备注含 68 款模型(官方目录)。额度按各模型官方单价扣减,平台标注零加价;另有入门档 Go($1/月 · $10 额度)与 API 档 Provider($15/月 + 按量),这两档该模型的单模型额度官方未公开,故未列等效价。 该模型在官方「优惠」列表中:列表价 $0.60/$2.40/$0.12,折后 $0.30/$1.20/$0.06(官方称 50% off,等效 2 倍用量);等效价已按折后单价计入。 缓存价未公开缓存读按官方单价计费($0.06/M),已按 90% 命中率计入等效价 套餐页https://commandcode.ai/docs/resources/pricing-limits | |||||
| C CommandCode | Max 20×($200/月 + 处理费) |
¥1346 月 | 300 美元 credits | 1.629 | 官网 ↗ |
套餐信息核实时间2026-09-12 10:35 周期月 额度说明按官方文档的「按模型分配额度」:标准(开源)模型单模型月额度 $300(套餐总额度 $300)。额度按各模型官方单价扣减,平台零加价;credits 永不过期、可累积。 折算口径扣减口径等效综合单价 等效价计算等效 1.629 元/M = 综合 $0.363/M × (200 ÷ 300) × 6.73 倍率说明由官方每 M token 价折算:MiniMax-M3 输入 $0.3 · 缓存读 $0.06 · 输出 $1.2(按基准负载 输入:输出=3:1、缓存命中 90% 加权,得综合 $0.363/M);再按套餐杠杆(月费 $200 ÷ 该模型月额度 $300)折算,乘汇率 6.73 得人民币价。 限制与口径持有限制官方设 5 小时与每周滚动上限(未公布具体数值)· 高级模型另设 $200 额度 计费说明套餐额度仅限在官方支持的编程工具中使用(该档可调 Provider API,按订阅 credits 计量);额度当月有效、不结转,用完后可按各模型成本价补充额度(补充额度可结转、不过期)。本档单价为固定价,不随峰谷变化。 备注含 68 款模型(官方目录)。额度按各模型官方单价扣减,平台标注零加价;另有入门档 Go($1/月 · $10 额度)与 API 档 Provider($15/月 + 按量),这两档该模型的单模型额度官方未公开,故未列等效价。 该模型在官方「优惠」列表中:列表价 $0.60/$2.40/$0.12,折后 $0.30/$1.20/$0.06(官方称 50% off,等效 2 倍用量);等效价已按折后单价计入。 缓存价未公开缓存读按官方单价计费($0.06/M),已按 90% 命中率计入等效价 套餐页https://commandcode.ai/docs/resources/pricing-limits | |||||
| 腾 腾讯云 · 原厂直供 | TokenHub Token Plan Lite |
¥39 月 | 780 积分/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:50 周期月 额度说明每订阅月 780 积分(四档均为 20 积分/元,抵扣标准与档位无关)。按官方积分抵扣价折算:MiniMax-M3 按基准负载约 50.8 积分/百万 token。 折算口径扣减口径等效综合单价(按官方积分抵扣价折算) 等效价计算等效价 = 月费 ÷(月积分 ÷ 50.8 积分/百万)= 39 ÷(780 ÷ 50.8) 倍率说明官方积分抵扣价(刊例):MiniMax-M3 输入 ≤ 512K 时未命中缓存输入 42 积分/百万 · 输出 168 · 缓存命中 8.4;输入 > 512K 时整档翻倍(84 / 336 / 16.8)。本页等效价按 ≤ 512K 档计。 单次请求积分 =(未命中缓存输入×42 + 输出×168 + 缓存命中×8.4)÷ 1,000,000;按基准负载(输入:输出 3:1、缓存命中 90%)折出约 50.8 积分/百万 token。 输入 > 512K 时积分价翻倍(84 / 336 / 16.8)→ 等效价同步翻倍。 限制与口径持有限制每订阅月 780 积分;剩余积分月底清零、不结转。四档均支持同一模型池,档位越高额度越多(积分/元比例一致)。 计费说明仅限在交互式 AI 编程工具中使用(官方列举 OpenClaw、Claude Code、OpenCode、Cline、Cursor、Kilo Code、Codex CLI 等),共享同一套餐额度;通用与混元两条产品线共用一个 API Key 与调用地址,按请求中的 Model ID 自动匹配扣减。 备注腾讯云 TokenHub「通用 Token Plan」:官方写明四档均支持 MiniMax、GLM、DeepSeek、腾讯混元等多模型(池内无 Qwen 系列)。官方另有 MiniMax-M3 的 5 折限时活动(2026-09-01 至 09-30,活动价 ≤512K 为 21/84/4.2);本页按刊例积分价计,不把限时活动价当默认口径。 缓存价未公开缓存命中按 8.4 积分/百万抵扣(低于未命中输入的 42),官方已公示。 套餐页https://cloud.tencent.com/document/product/1772/129449 | |||||
| 腾 腾讯云 · 原厂直供 | TokenHub Token Plan Standard |
¥99 月 | 1,980 积分/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:50 周期月 额度说明每订阅月 1980 积分(四档均为 20 积分/元,抵扣标准与档位无关)。按官方积分抵扣价折算:MiniMax-M3 按基准负载约 50.8 积分/百万 token。 折算口径扣减口径等效综合单价(按官方积分抵扣价折算) 等效价计算等效价 = 月费 ÷(月积分 ÷ 50.8 积分/百万)= 99 ÷(1980 ÷ 50.8) 倍率说明官方积分抵扣价(刊例):MiniMax-M3 输入 ≤ 512K 时未命中缓存输入 42 积分/百万 · 输出 168 · 缓存命中 8.4;输入 > 512K 时整档翻倍(84 / 336 / 16.8)。本页等效价按 ≤ 512K 档计。 单次请求积分 =(未命中缓存输入×42 + 输出×168 + 缓存命中×8.4)÷ 1,000,000;按基准负载(输入:输出 3:1、缓存命中 90%)折出约 50.8 积分/百万 token。 输入 > 512K 时积分价翻倍(84 / 336 / 16.8)→ 等效价同步翻倍。 限制与口径持有限制每订阅月 1980 积分;剩余积分月底清零、不结转。四档均支持同一模型池,档位越高额度越多(积分/元比例一致)。 计费说明仅限在交互式 AI 编程工具中使用(官方列举 OpenClaw、Claude Code、OpenCode、Cline、Cursor、Kilo Code、Codex CLI 等),共享同一套餐额度;通用与混元两条产品线共用一个 API Key 与调用地址,按请求中的 Model ID 自动匹配扣减。 备注腾讯云 TokenHub「通用 Token Plan」:官方写明四档均支持 MiniMax、GLM、DeepSeek、腾讯混元等多模型(池内无 Qwen 系列)。官方另有 MiniMax-M3 的 5 折限时活动(2026-09-01 至 09-30,活动价 ≤512K 为 21/84/4.2);本页按刊例积分价计,不把限时活动价当默认口径。 缓存价未公开缓存命中按 8.4 积分/百万抵扣(低于未命中输入的 42),官方已公示。 套餐页https://cloud.tencent.com/document/product/1772/129449 | |||||
| 腾 腾讯云 · 原厂直供 | TokenHub Token Plan Pro |
¥299 月 | 5,980 积分/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:50 周期月 额度说明每订阅月 5980 积分(四档均为 20 积分/元,抵扣标准与档位无关)。按官方积分抵扣价折算:MiniMax-M3 按基准负载约 50.8 积分/百万 token。 折算口径扣减口径等效综合单价(按官方积分抵扣价折算) 等效价计算等效价 = 月费 ÷(月积分 ÷ 50.8 积分/百万)= 299 ÷(5980 ÷ 50.8) 倍率说明官方积分抵扣价(刊例):MiniMax-M3 输入 ≤ 512K 时未命中缓存输入 42 积分/百万 · 输出 168 · 缓存命中 8.4;输入 > 512K 时整档翻倍(84 / 336 / 16.8)。本页等效价按 ≤ 512K 档计。 单次请求积分 =(未命中缓存输入×42 + 输出×168 + 缓存命中×8.4)÷ 1,000,000;按基准负载(输入:输出 3:1、缓存命中 90%)折出约 50.8 积分/百万 token。 输入 > 512K 时积分价翻倍(84 / 336 / 16.8)→ 等效价同步翻倍。 限制与口径持有限制每订阅月 5980 积分;剩余积分月底清零、不结转。四档均支持同一模型池,档位越高额度越多(积分/元比例一致)。 计费说明仅限在交互式 AI 编程工具中使用(官方列举 OpenClaw、Claude Code、OpenCode、Cline、Cursor、Kilo Code、Codex CLI 等),共享同一套餐额度;通用与混元两条产品线共用一个 API Key 与调用地址,按请求中的 Model ID 自动匹配扣减。 备注腾讯云 TokenHub「通用 Token Plan」:官方写明四档均支持 MiniMax、GLM、DeepSeek、腾讯混元等多模型(池内无 Qwen 系列)。官方另有 MiniMax-M3 的 5 折限时活动(2026-09-01 至 09-30,活动价 ≤512K 为 21/84/4.2);本页按刊例积分价计,不把限时活动价当默认口径。 缓存价未公开缓存命中按 8.4 积分/百万抵扣(低于未命中输入的 42),官方已公示。 套餐页https://cloud.tencent.com/document/product/1772/129449 | |||||
| 腾 腾讯云 · 原厂直供 | TokenHub Token Plan Max |
¥599 月 | 1.2 万 积分/月 | — | 官网 ↗ |
套餐信息核实时间2026-09-12 10:50 周期月 额度说明每订阅月 11980 积分(四档均为 20 积分/元,抵扣标准与档位无关)。按官方积分抵扣价折算:MiniMax-M3 按基准负载约 50.8 积分/百万 token。 折算口径扣减口径等效综合单价(按官方积分抵扣价折算) 等效价计算等效价 = 月费 ÷(月积分 ÷ 50.8 积分/百万)= 599 ÷(11980 ÷ 50.8) 倍率说明官方积分抵扣价(刊例):MiniMax-M3 输入 ≤ 512K 时未命中缓存输入 42 积分/百万 · 输出 168 · 缓存命中 8.4;输入 > 512K 时整档翻倍(84 / 336 / 16.8)。本页等效价按 ≤ 512K 档计。 单次请求积分 =(未命中缓存输入×42 + 输出×168 + 缓存命中×8.4)÷ 1,000,000;按基准负载(输入:输出 3:1、缓存命中 90%)折出约 50.8 积分/百万 token。 输入 > 512K 时积分价翻倍(84 / 336 / 16.8)→ 等效价同步翻倍。 限制与口径持有限制每订阅月 11980 积分;剩余积分月底清零、不结转。四档均支持同一模型池,档位越高额度越多(积分/元比例一致)。 计费说明仅限在交互式 AI 编程工具中使用(官方列举 OpenClaw、Claude Code、OpenCode、Cline、Cursor、Kilo Code、Codex CLI 等),共享同一套餐额度;通用与混元两条产品线共用一个 API Key 与调用地址,按请求中的 Model ID 自动匹配扣减。 备注腾讯云 TokenHub「通用 Token Plan」:官方写明四档均支持 MiniMax、GLM、DeepSeek、腾讯混元等多模型(池内无 Qwen 系列)。官方另有 MiniMax-M3 的 5 折限时活动(2026-09-01 至 09-30,活动价 ≤512K 为 21/84/4.2);本页按刊例积分价计,不把限时活动价当默认口径。 缓存价未公开缓存命中按 8.4 积分/百万抵扣(低于未命中输入的 42),官方已公示。 套餐页https://cloud.tencent.com/document/product/1772/129449 | |||||
| 没有符合条件的套餐,试试放宽筛选。 | |||||
*「等效价」口径:TokenPlan 的「等效价格」= 套餐月费 ÷ 该套餐按官方抵扣系数折算出的 token 总量,且按额度 100% 全部用完计算。额度用不完,实际单价会高于此值。
| 渠道 | 元 / 百万 tokens | 元 / 百万 tokens | 元 / 百万 tokens | 峰谷时间 | 官网 | ||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| X Xiaomi MiMo 官方 国际版 官方自营 美元刊例 · 折算展示 | 0.9422 | 0.0188 | 1.8844 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号MiMo-V2.5(原生全模态,1M 上下文) 版本说明官方公开模型目录所列 xiaomi/mimo-v2.5(即 Xiaomi MiMo V2.5)单价:prompt $0.14 / completion $0.28 / cache_read $0.0028(每百万 tokens)。与国内站人民币刊例为两套独立标价。官方定价文档页(按量计费)同时列出国内与海外两套价目:国内 mimo-v2.5 缓存命中 0.02 元 / 未命中 1 元 / 输出 2 元;海外 $0.0028 / $0.14 / $0.28(每百万 tokens)。 接入
接口地址https://api.xiaomimimo.com/v1 官方公开模型目录可查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 风险说明海外分区,按美元刊例;与国内站人民币刊例为两套独立标价,比价时留意分区。 定价页https://mimo.mi.com/docs/price/pay-as-you-go | |||||||||||||||||||||||||
| X Xiaomi MiMo 官方 官方自营 | 1 | 0.02 | 2 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号MiMo-V2.5(原生全模态,1M 上下文;Artificial Analysis 智能指数 22.3) 版本说明据小米 MiMo 官网首页所列刊例价(MiMo-V2.5 输入 ¥1 / 缓存命中 ¥0.02 / 输出 ¥2,单位每百万 tokens);同页 MiMo-V2.5-Pro 为 ¥3 / ¥0.025 / ¥6。官方定价文档页(按量计费)同时列出国内与海外两套价目:国内 mimo-v2.5 缓存命中 0.02 元 / 未命中 1 元 / 输出 2 元;海外 $0.0028 / $0.14 / $0.28(每百万 tokens)。 接入
接口地址https://api.xiaomimimo.com/v1 官网首页与开放平台均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 10:40 定价页https://mimo.mi.com/docs/price/pay-as-you-go | |||||||||||||||||||||||||
| P PPIO 派欧云 自部署 | 1 | 0.02 | 2 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号Xiaomi MiMo V2.5(原生全模态,1M 上下文 / 最大输出 131K) 版本说明Xiaomi MiMo V2.5(基础版)。据 PPIO 官方模型接口原文:模型 id xiaomimimo/mimo-v2.5,输入 1 元 / 缓存命中 0.02 元 / 输出 2 元(每百万 tokens),与小米国内站刊例同价;上下文 1,048,576、单次最长输出 131,072,支持图片与视频输入、函数调用、结构化输出与思考模式。 接入
接口地址https://api.ppinfra.com/v3/openai 按量计费,全时段统一价。 口径与备注核实时间2026-09-13 11:20 风险说明缓存命中 0.02 元每百万,为国内同档最低之一。该平台同时挂 MiMo-V2.5-Pro 与 TTS / ASR 系列,本档只收基础版。 定价页https://ppio.com/model-api/product | |||||||||||||||||||||||||
| Z ZenMux 聚合平台 | 0.8076 | 0.0156 | 1.5614 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:输入 $0.15 · 缓存 $0.0029 · 输出 $0.29(每 1M token);此处为活动价(20% OFF):输入 $0.12 · 缓存 $0.00232 · 输出 $0.232。人民币价 = 美元价 × 6.73(2026-09-15 汇率)。 版本说明✓ 已核实型号Xiaomi MiMo V2.5(原生全模态) 版本说明Xiaomi MiMo V2.5(基础版)。据 ZenMux 模型页所列标准价(供应商 Xiaomi 一条):输入 $0.15 / 输出 $0.29 / 缓存读取 $0.0029(每百万 tokens)。同页另列金山云供给档 $0.4–0.8 / $0.32–0.64,价差较大,比价时留意实际路由到的供应商。 接入
接口地址https://zenmux.ai/api/v1 注册后按量调用。 口径与备注核实时间2026-09-15 08:35 风险说明同一模型由多家上游供货,默认路由不保证最低价;要锁定本档需用 provider 参数指定供应商。此处为站点 20% OFF 活动价(页面同时标注原价 $0.15 / $0.29 与折后 $0.12 / $0.232);平台未标注活动结束时间,恢复原价后单价会上涨。 定价页https://zenmux.ai/xiaomi/mimo-v2.5 | |||||||||||||||||||||||||
| O OpenRouter(聚合平台) 聚合平台 美元刊例 · 折算展示 | 峰2.692 / 谷0.8009 | 峰0.5384 / 谷0.0172 | 峰13.46 / 谷1.6017 | 峰:池内最高档,仅作比价上限参考 谷:池内最低档,单上游调价/撤单即失效,仅作比价下限参考 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径聚合口径(2026-09-16 复抓 OpenRouter 官方 endpoints 接口(6 家上游端点)):主档取「池内中位档」(按输入价升序取上中位,不再取最低档)—— 中位档 StreamLake 输入 $0.168 / 缓存 $0.00336 / 输出 $0.336,池内区间输入 $0.119 ~ $0.4;人民币价 = 美元价 × 6.73(2026-09-16 汇率 1 USD ≈ 6.73 元)。 版本说明✓ 已核实型号MiMo-V2.5(原生全模态,1M 上下文;Artificial Analysis 智能指数 22.3) 版本说明模型 ID 为 xiaomi/mimo-v2.5,即 Xiaomi MiMo V2.5;据该平台公开模型目录所列单价折人民币。该档与表内多家渠道同为 $0.14 / $0.28 —— 这是小米官方海外刊例价,本档为其原价转发,非独家低价;实际结算以该平台当期页面为准。口径修正(2026-09-16):聚合平台主档取「池内中位档」——池内共 6 家上游,中位档为 StreamLake 输入 $0.168 / 输出 $0.336;原取池内最低档(受单上游撤单影响大)已降为次档。 接入
接口地址https://openrouter.ai/api/v1 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-16 20:14 风险说明海外平台,按美元刊例。本档为池内中位档(6 家上游端点中的 StreamLake,输入 $0.168 / 输出 $0.336),非小米官方刊例的转挂;实际结算以该平台当期页面为准。聚合口径:该价取自平台模型目录,站内同一模型由多家供应商供货,默认路由不保证最低价;要锁定本档需用 provider 参数指定供应商。 定价页https://openrouter.ai/xiaomi/mimo-v2.5 | |||||||||||||||||||||||||
| D DeepInfra 自部署 美元刊例 · 折算展示 | 0.9422 | 0.9422 | 1.8844 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号MiMo-V2.5(原生全模态,1M 上下文;Artificial Analysis 智能指数 22.3) 版本说明模型 ID 为 xiaomi/mimo-v2.5,即 Xiaomi MiMo V2.5;据该平台公开模型目录所列单价折人民币。该档与表内多家渠道同为 $0.14 / $0.28 —— 这是小米官方海外刊例价,本档为其原价转发,非独家低价;实际结算以该平台当期页面为准。 接入
接口地址https://api.deepinfra.com/v1/openai 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 10:40 风险说明海外平台,按美元刊例。该档与表内多家渠道同为 $0.14 / $0.28 —— 这是小米官方海外刊例价,本档为其原价转发,非独家低价;实际结算以该平台当期页面为准。 定价页https://deepinfra.com/XiaomiMiMo/MiMo-V2.5 | |||||||||||||||||||||||||
| L LLM Gateway(聚合平台) 聚合平台 美元刊例 · 折算展示 | 0.9422 | 0.0188 | 1.8844 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号MiMo-V2.5(原生全模态,1M 上下文;Artificial Analysis 智能指数 22.3) 版本说明模型 ID 为 xiaomi/mimo-v2.5,即 Xiaomi MiMo V2.5;据该平台公开模型目录所列单价折人民币。该档与表内多家渠道同为 $0.14 / $0.28 —— 这是小米官方海外刊例价,本档为其原价转发,非独家低价;实际结算以该平台当期页面为准。 接入
接口地址https://api.llmgateway.io/v1 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 风险说明海外平台,按美元刊例。该档与表内多家渠道同为 $0.14 / $0.28 —— 这是小米官方海外刊例价,本档为其原价转发,非独家低价;实际结算以该平台当期页面为准。 定价页https://llmgateway.io/models | |||||||||||||||||||||||||
| N NavyAI(聚合平台) 聚合平台 美元刊例 · 折算展示 | 0.9422 | 0.9422 | 1.8844 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号MiMo-V2.5(原生全模态,1M 上下文;Artificial Analysis 智能指数 22.3) 版本说明模型 ID 为 xiaomi/mimo-v2.5,即 Xiaomi MiMo V2.5;据该平台公开模型目录所列单价折人民币。该档与表内多家渠道同为 $0.14 / $0.28 —— 这是小米官方海外刊例价,本档为其原价转发,非独家低价;实际结算以该平台当期页面为准。 接入
接口地址https://api.navy/v1 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 10:40 风险说明海外平台,按美元刊例。该档与表内多家渠道同为 $0.14 / $0.28 —— 这是小米官方海外刊例价,本档为其原价转发,非独家低价;实际结算以该平台当期页面为准。 定价页https://api.navy | |||||||||||||||||||||||||
| R Requesty(聚合平台) 聚合平台 美元刊例 · 折算展示 | 0.9422 | 0.9422 | 1.8844 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号MiMo-V2.5(原生全模态,1M 上下文;Artificial Analysis 智能指数 22.3) 版本说明模型 ID 为 xiaomi/mimo-v2.5,即 Xiaomi MiMo V2.5;据该平台公开模型目录所列单价折人民币。该档与表内多家渠道同为 $0.14 / $0.28 —— 这是小米官方海外刊例价,本档为其原价转发,非独家低价;实际结算以该平台当期页面为准。 接入
接口地址https://router.requesty.ai/v1 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 10:40 风险说明海外平台,按美元刊例。该档与表内多家渠道同为 $0.14 / $0.28 —— 这是小米官方海外刊例价,本档为其原价转发,非独家低价;实际结算以该平台当期页面为准。 定价页https://www.requesty.ai/models | |||||||||||||||||||||||||
| R Routeway(聚合平台) 聚合平台 | 0.9422 | — | 1.8844 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目)。 版本说明✓ 已核实型号Xiaomi MiMo V2.5(原生全模态) 版本说明据 Routeway 官网模型页所列:MiMo V2.5 输入 $0.14 / 输出 $0.28(每百万 tokens)。同页 MiMo V2.5 Pro 为 $0.43 / $0.87,另有 V2.5-Pro-UltraSpeed 变体。 接入
接口地址https://api.routeway.ai/v1/models 注册后按量调用。 口径与备注核实时间2026-09-13 11:20 风险说明聚合口径:该价取自平台模型目录,站内同一模型由多家供应商供货,默认路由不保证最低价;要锁定本档需用 provider 参数指定供应商。 定价页https://routeway.ai | |||||||||||||||||||||||||
| I Impossibl(聚合平台) 聚合平台 | 0.9422 | 0.0202 | 1.8844 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目)。 版本说明✓ 已核实型号Xiaomi MiMo V2.5(原生全模态) 版本说明Xiaomi MiMo V2.5(基础版)。据 Impossibl 官方模型接口(字段 input_per_mtok_usd / output_per_mtok_usd / cached_input_per_mtok_usd):输入 $0.14 / 输出 $0.28 / 缓存命中 $0.003(每百万 tokens)。站内模型页与接口两处数值一致。 接入
接口地址https://api.impossibl.com/v1/models 注册后按量调用。 口径与备注核实时间2026-09-13 11:20 风险说明聚合口径:该价取自平台模型目录,站内同一模型由多家供应商供货,默认路由不保证最低价;要锁定本档需用 provider 参数指定供应商。 定价页https://impossibl.com | |||||||||||||||||||||||||
| N Naga(聚合平台) 聚合平台 | 0.9422 | — | 1.8844 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目)。 版本说明✓ 已核实型号Xiaomi MiMo V2.5(原生全模态) 版本说明Xiaomi MiMo V2.5(基础版)。标准价输入 $0.14 / 输出 $0.28(每百万 tokens)。官网当前挂「-50%」限时促销,站内实时显示为 $0.07 / $0.14;本档按标准价入表,促销结束不影响本行。 接入
接口地址https://api.naga.ac/v1/models 注册后按量调用。 口径与备注核实时间2026-09-13 11:20 风险说明聚合口径:该价取自平台模型目录,站内同一模型由多家供应商供货,默认路由不保证最低价;要锁定本档需用 provider 参数指定供应商。 站点当前有限时折扣活动,实际结算以该平台当期页面为准。 定价页https://naga.ac/models | |||||||||||||||||||||||||
| I Infron(零加价网关) 聚合网关 美元刊例 · 折算展示 | 1.82 | 0.28 | 7.67 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例:Standard 档 均值 输入 $0.27 · 缓存读 $0.0414 · 输出 $1.14(每 1M token);池内最低上游(xiaomi 直连)为 输入 $0.14 · 缓存读 $0.0028 · 输出 $0.28。人民币价 = 美元价 × 6.73(2026-09-09 汇率)折算,汇率波动时人民币价随之变化。 部署说明零加价路由 版本说明✓ 已核实型号xiaomi/mimo-v2.5 版本说明已核实(2026-09-15 据该站官方模型页数据):小米 MiMo V2.5 仅 Standard 一档,均值 输入 $0.27 · 缓存读 $0.0414 · 输出 $1.14(每 1M tokens),池内 2 家上游价差近 3 倍:xiaomi 直连 $0.14 / $0.0028 / $0.28、deepinfra $0.4 / $0.08 / $2。均值被高价上游显著拉高,逐上游表里 xiaomi 直连一条即为最低价。无折扣。(同站另有 xiaomi/mimo-v2.5-pro,是兄弟型号,不计入本槽。) 接入
接口地址https://api.infron.ai/v1 零 token 加价,平台按 $0.35 + 5% 收取账户服务费。仅 Standard 档。 口径与备注核实时间2026-09-15 20:58 风险说明价格口径:这里的价格取自该站模型页卡片标示的「Avg list price」,即该档位池内全部可用上游的算术平均;站内逐上游明细另列每家单价,最低的一条常显著低于此均值。该站原话「your request is billed at the rate of the provider it is routed to」—— 实际费用取决于当次路由到的上游,故此处均值偏保守。折扣时效:部分上游当前有折扣,幅度与期限由各上游自行调整,随时可能回调。资历:域名 2026-01-07 注册,公司很新,零加价模式下无动力压价,但长周期可靠性未经验证,建议按需使用,不建议一次性投入大额资金。 定价页https://infron.ai/models/xiaomi/mimo-v2.5 | |||||||||||||||||||||||||
| M MegaNova 聚合平台 美元刊例 · 折算展示 | 2.692 | 0.5384 | 13.46 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号MiMo-V2.5(原生全模态,1M 上下文;Artificial Analysis 智能指数 22.3) 版本说明模型 ID 为 xiaomi/mimo-v2.5,即 Xiaomi MiMo V2.5;据该平台公开模型目录所列单价折人民币。该档与表内另一家渠道报价完全相同,可能同属一个上游货源;本档只做价格陈列,实际结算以该平台当期页面为准。 接入
接口地址https://api.meganova.ai/v1 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 风险说明海外平台,按美元刊例。该档与表内另一家渠道报价完全相同,可能同属一个上游货源;本档只做价格陈列,实际结算以该平台当期页面为准。 定价页https://meganova.ai | |||||||||||||||||||||||||
| B BazaarLink 聚合网关 美元刊例 · 折算展示 | 0.9422 | 0.0188 | 1.8844 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号MiMo-V2.5(原生全模态,1M 上下文;Artificial Analysis 智能指数 22.3) 版本说明模型 ID 为 xiaomi/mimo-v2.5,即 Xiaomi MiMo V2.5;据该平台公开模型目录所列单价折人民币。该档与表内多家渠道同为 $0.14 / $0.28 —— 这是小米官方海外刊例价,本档为其原价转发,非独家低价;实际结算以该平台当期页面为准。 2026-09-16 全量核对:官网价目表列序为 输入/输出/缓存读,本 SKU 缓存读为 $0.0028;本站该条此前缓存读与输入价同值,已按官网价目表修正(输入/输出未变)。 接入
接口地址https://api.bazaarlink.ai/v1 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-16 21:00 风险说明海外平台,按美元刊例。该档与表内多家渠道同为 $0.14 / $0.28 —— 这是小米官方海外刊例价,本档为其原价转发,非独家低价;实际结算以该平台当期页面为准。 定价页https://bazaarlink.ai/models | |||||||||||||||||||||||||
| E Eden AI(聚合平台) 聚合平台 美元刊例 · 折算展示 | 0.994 | 0.0199 | 1.988 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径上游刊例价(美元/1M token,输入):池内最低 $0.1400、最高 $0.1400;平台另收 5.5% 服务费,表中价格 = 上游刊例价 × 1.055 × 6.73(2026-09-14 汇率),即已含服务费的人民币价。汇率波动时随之变化。 版本说明✓ 已核实型号MiMo V2.5 版本说明已核实(2026-09-14 平台公开模型目录接口原文):该平台目录逐条给出模型标识、上游服务商、上下文长度与按 token 的三列价;表中取各上游的刊例价(非折后价)。本模型在目录中标注为「MiMo V2.5」,池内共 2 家上游(2 条可用报价),最低 deepinfra/xiaomi,最高 deepinfra/xiaomi。 接入
接口地址https://api.edenai.run/v3 价格取自平台公开定价页与其公开模型目录,读者可直接打开核对。 口径与备注核实时间2026-09-14 22:30 风险说明聚合网关:本身不加工上游定价,报价为各上游服务商刊例价,另按 5.5% 收取平台服务费,表中价格已含该费用。同一模型池内多家上游的报价与上下文长度可能不同,若不指定上游,实际可能路由到池内任一家,横向比较时留意。 定价页https://www.edenai.co/pricing | |||||||||||||||||||||||||
| A AiHubMix 聚合中转 美元刊例 · 折算展示 | 1.0432 | 0.0209 | 2.0863 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号MiMo-V2.5(原生全模态,1M 上下文;Artificial Analysis 智能指数 22.3) 版本说明模型 ID 为 xiaomi/mimo-v2.5,即 Xiaomi MiMo V2.5;据该平台公开模型目录所列单价折人民币。 接入
接口地址https://aihubmix.com/v1 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 10:40 风险说明海外平台,按美元刊例。 定价页https://aihubmix.com/model/xiaomi-mimo-v2.5 | |||||||||||||||||||||||||
| N Novita AI 自部署 美元刊例 · 折算展示 | 1.1306 | 0.0229 | 2.2613 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号MiMo-V2.5(原生全模态,1M 上下文;Artificial Analysis 智能指数 22.3) 版本说明模型 ID 为 xiaomi/mimo-v2.5,即 Xiaomi MiMo V2.5;据该平台公开模型目录所列单价折人民币。 接入
接口地址https://api.novita.ai/v3/openai 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-13 10:40 风险说明海外平台,按美元刊例。 定价页https://novita.ai/models | |||||||||||||||||||||||||
| R RedPill(聚合网关) 聚合网关 美元刊例 · 折算展示 | 1.1306 | 0.0242 | 2.2613 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号MiMo-V2.5(原生全模态,1M 上下文;Artificial Analysis 智能指数 22.3) 版本说明模型 ID 为 xiaomi/mimo-v2.5,即 Xiaomi MiMo V2.5;据该平台公开模型目录所列单价折人民币。 接入
接口地址https://api.redpill.ai/v1 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 风险说明海外平台,按美元刊例。 定价页https://redpill.ai/pricing | |||||||||||||||||||||||||
| A AI/ML API 聚合网关 | 1.2959 | 0.0259 | 2.5918 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目)。 版本说明✓ 已核实型号Xiaomi MiMo V2.5(原生全模态,1M 上下文 / 最大输出 128K) 版本说明Xiaomi MiMo V2.5(基础版)。据 AI/ML API 模型页所列:输入 $0.192556 / 输出 $0.385112 / 缓存命中 $0.0038511(每百万 tokens),约为小米官方海外刊例的 1.375 倍(平台加价)。 接入
接口地址https://api.aimlapi.com/v1 注册后按量调用。 口径与备注核实时间2026-09-17 20:04 风险说明站内单价含平台加价,高于官方海外原价,比价时排在后段。聚合口径:该价取自平台模型目录,站内同一模型由多家供应商供货,默认路由不保证最低价;要锁定本档需用 provider 参数指定供应商。 定价页https://aimlapi.com/models/mimo-v2-5 | |||||||||||||||||||||||||
| L LLM7(聚合平台) 聚合平台 美元刊例 · 折算展示 | 2.692 | 0.5384 | 13.46 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径原站以 USD 刊例,人民币价 = 原价 × 6.73(2026-09-13 汇率口径,沿用表内既有条目汇率)。 版本说明✓ 已核实型号MiMo-V2.5(原生全模态,1M 上下文;Artificial Analysis 智能指数 22.3) 版本说明模型 ID 为 xiaomi/mimo-v2.5,即 Xiaomi MiMo V2.5;据该平台公开模型目录所列单价折人民币。该档与表内另一家渠道报价完全相同,可能同属一个上游货源;本档只做价格陈列,实际结算以该平台当期页面为准。 接入
接口地址https://api.llm7.io/v1 官方定价页与模型目录均可公开查阅,价格可自行核对。 口径与备注核实时间2026-09-17 20:04 风险说明海外平台,按美元刊例。该档与表内另一家渠道报价完全相同,可能同属一个上游货源;本档只做价格陈列,实际结算以该平台当期页面为准。 定价页https://llm7.io | |||||||||||||||||||||||||
| B B.AI(b.ai) ⚠ 低价参考 · 谨慎 版本存疑 | 0.0942 | 0.0019 | 0.1884 | 无峰谷定价 | 官网 ↗ | ||||||||||||||||||||
价格档位单位:元 / 百万 tokens
版本存疑 版本说明2026-09-16 17:00(UTC+8)前免费,之后转一折 接入
口径与备注核实时间2026-09-17 备注平台公开价目表(美元 / 100 万 tokens,按 token 四列价)+ 限时一折活动价(按标准价 10% 结算)。价格入口:原 b.ai 首页已改纯前端渲染、不再下发价目表,现行价目表在文档站 docs.b.ai/llmservice/models/<模型名>/(模型名里的点号要换成连字符),限时优惠另见 docs.b.ai/llmservice/promotions-and-pricing-notices/。2026-09-16 逐页核对标准价:V4.1-Flash 空闲 $0.15/$0.003/$0.60、高峰 $0.30/$0.006/$1.20;GLM-5.3-Flash $0.15/$0.03/$0.50;Qwen3.8-Flash $0.16/$0.016/$0.47;MiMo-V2.5 $0.14/$0.0028/$0.28。2026-09-17 复核优惠公告页:四条仍按标准价 10% 结算(V4.1-Flash 空闲与高峰同为 10%,GLM-5.3-Flash 标「低至 10%」),与库内折后值一致;首页横幅旧「五折」文案已撤,不再有口径冲突。卡片入口为本站邀请链接(含邀请码),点击直达注册/登录页。 风险说明该站为 Web3 形态:以链上结算为底座,账户身份可与链上地址绑定、资金由使用方自行保管,同时也提供常规账号登录。下列价是它自 2026-09-12 10:00 起的限时一折活动价(按标准价 10% 结算;GLM-5.3-Flash 官方用词为「低至 10%」),页面未标注结束时间、随时可能回调;活动价随官方分时口径同步变动(高峰为工作日 09:00-12:00 与 14:00-18:00,其余含周末为空闲)。折扣幅度明显偏大,接入前请自行判断。 活动未标注结束时间;标准价本身随分时变动,故实际单价随时段浮动。该站模型目录以海外一线型号为主,此处只列与我方价格表可比、且当前在活动期内的型号。 | |||||||||||||||||||||||||
| 没有符合条件的渠道,试试放宽筛选。 | |||||||||||||||||||||||||
| 渠道 | 套餐 | 费用 元 | 额度 | 元 / 百万 tokens | 官网 |
|---|---|---|---|---|---|
| 该模型暂无套餐渠道,欢迎在渠道表查看按量计费。 | |||||
*「等效价」口径:TokenPlan 的「等效价格」= 套餐月费 ÷ 该套餐按官方抵扣系数折算出的 token 总量,且按额度 100% 全部用完计算。额度用不完,实际单价会高于此值。
| 渠道 | 元 / 百万 tokens | 元 / 百万 tokens | 元 / 百万 tokens | 官网 | |||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| L Ling 3.0 Flash 聚合平台 美元刊例 · 折算展示 | 0.1413 | 0.0283 | 0.424 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Ling 3.0 Flash(AA 智能指数 24.9 / 262144 tokens) 版本说明其他模型参考价:取自「OpenRouter」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id inclusionai/ling-3.0-flash,上下文 262144 tokens。Artificial Analysis 智能指数 24.9。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 19:04 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份蚂蚁百灵出品,Artificial Analysis 智能指数 24.9(满分 100)。 | |||||||||||||||||||
| Q Qwen3.7 Flash 聚合平台 美元刊例 · 折算展示 | 0.2019 | 0.0404 | 0.8749 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Qwen3.7 Flash(AA 榜单暂未收录 / 1000000 tokens) 版本说明其他模型参考价:取自「OpenRouter」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id qwen/qwen3.7-flash,上下文 1000000 tokens。Artificial Analysis 智能指数 (暂未收录)。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 20:24 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份阿里通义出品,Artificial Analysis 智能指数暂未收录。 | |||||||||||||||||||
| A Agnes 3.0 Flash 聚合平台 美元刊例 · 折算展示 | 0.3365 | 0.0337 | 1.0095 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Agnes 3.0 Flash(AA 智能指数 35.5 / 524288 tokens) 版本说明其他模型参考价:取自「NanoGPT」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id agnes-3.0-flash,上下文 524288 tokens。Artificial Analysis 智能指数 35.5。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-17 19:59 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份Agnes AI出品,Artificial Analysis 智能指数 35.5(满分 100)。 | |||||||||||||||||||
| M Muse Spark 1.3 Contributor 聚合平台 美元刊例 · 折算展示 | 0.673 | 0.0135 | 1.346 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Muse Spark 1.3 Contributor(AA 智能指数 48.2 / 1048576 tokens) 版本说明其他模型参考价:取自「OpenRouter」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id meta/muse-spark-1.3-contributor,上下文 1048576 tokens。Artificial Analysis 智能指数 48.2。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 19:04 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份Meta出品,Artificial Analysis 智能指数 48.2(满分 100)。 | |||||||||||||||||||
| T Tencent Hy3 聚合平台 美元刊例 · 折算展示 | 0.4442 | 0.1952 | 1.7498 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Tencent Hy3(AA 智能指数 25.8 / 262144 tokens) 版本说明其他模型参考价:取自「NanoGPT」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id tencent/hy3,上下文 262144 tokens。Artificial Analysis 智能指数 25.8。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-11 21:10 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份腾讯混元出品,Artificial Analysis 智能指数 25.8(满分 100)。 | |||||||||||||||||||
| D Doubao Seed 2.0 Mini 聚合平台 美元刊例 · 折算展示 | 0.2019 | 0.0673 | 1.8844 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Doubao Seed 2.0 Mini(AA 榜单暂未收录 / 256000 tokens) 版本说明其他模型参考价:取自「ZenMux」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id bytedance/doubao-seed-2.0-mini,上下文 256000 tokens。Artificial Analysis 智能指数 (暂未收录)。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 20:24 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份字节火山出品,Artificial Analysis 智能指数暂未收录。 | |||||||||||||||||||
| D Doubao Seed 2.0 Mini 自部署 | 0.2 | 0.04 | 2 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号Doubao Seed 2.0 Mini(AA 榜单暂未收录 / 256000 tokens) 版本说明其他模型参考价:取自「七牛云 AI 推理」模型广场公开刊例价,条目名 doubao-seed-2.0-mini。Artificial Analysis 智能指数 (暂未收录)。 接入该条目为国内平台参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 20:24 风险说明该条目为国内平台的公开刊例价,通常为厂商原价;海外渠道常有折扣,故此处可能高于「国外」分区所示价格。如需长期使用,建议回模型官网核实当期价格。 厂家身份字节火山出品,Artificial Analysis 智能指数暂未收录。 | |||||||||||||||||||
| S Step 3.5 Flash 聚合平台 美元刊例 · 折算展示 | 0.673 | — | 2.019 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Step 3.5 Flash(AA 智能指数 16.6 / 262144 tokens) 版本说明其他模型参考价:取自「OpenRouter」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id stepfun/step-3.5-flash,上下文 262144 tokens。Artificial Analysis 智能指数 16.6。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 20:24 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份阶跃星辰出品,Artificial Analysis 智能指数 16.6(满分 100)。 | |||||||||||||||||||
| D Doubao Seed 2.0 Lite 聚合平台 美元刊例 · 折算展示 | 0.6057 | 0.1346 | 3.4323 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Doubao Seed 2.0 Lite(AA 榜单暂未收录 / 256000 tokens) 版本说明其他模型参考价:取自「ZenMux」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id bytedance/doubao-seed-2.0-lite,上下文 256000 tokens。Artificial Analysis 智能指数 (暂未收录)。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 20:24 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份字节火山出品,Artificial Analysis 智能指数暂未收录。 | |||||||||||||||||||
| D Doubao Seed 2.0 Lite 自部署 | 0.6 | 0.12 | 3.6 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号Doubao Seed 2.0 Lite(AA 榜单暂未收录 / 256000 tokens) 版本说明其他模型参考价:取自「七牛云 AI 推理」模型广场公开刊例价,条目名 doubao-seed-2.0-lite。Artificial Analysis 智能指数 (暂未收录)。 接入该条目为国内平台参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 20:24 风险说明该条目为国内平台的公开刊例价,通常为厂商原价;海外渠道常有折扣,故此处可能高于「国外」分区所示价格。如需长期使用,建议回模型官网核实当期价格。 厂家身份字节火山出品,Artificial Analysis 智能指数暂未收录。 | |||||||||||||||||||
| E ERNIE X1.1 聚合平台 美元刊例 · 折算展示 | 0.9422 | — | 3.7688 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号ERNIE X1.1(AA 榜单暂未收录 / 65536 tokens) 版本说明其他模型参考价:取自「ZenMux」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id baidu/ernie-x1.1-preview,上下文 65536 tokens。Artificial Analysis 智能指数 (暂未收录)。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 19:04 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份百度出品,Artificial Analysis 智能指数暂未收录。 | |||||||||||||||||||
| T Tencent Hy3 自部署 | 1.2 | 0.4 | 4 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号Tencent Hy3(AA 智能指数 25.8 / 262144 tokens) 版本说明其他模型参考价:取自「七牛云 AI 推理」模型广场公开刊例价,条目名 tencent/hy3-preview。Artificial Analysis 智能指数 25.8。 接入该条目为国内平台参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 20:24 风险说明该条目为国内平台的公开刊例价,通常为厂商原价;海外渠道常有折扣,故此处可能高于「国外」分区所示价格。如需长期使用,建议回模型官网核实当期价格。 厂家身份腾讯混元出品,Artificial Analysis 智能指数 25.8(满分 100)。 | |||||||||||||||||||
| X Xiaomi MiMo V2.5 Pro 聚合平台 美元刊例 · 折算展示 | 2.692 | 0.0202 | 5.384 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Xiaomi MiMo V2.5 Pro(AA 智能指数 26.4 / 1000000 tokens) 版本说明其他模型参考价:取自「NanoGPT」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id xiaomi/mimo-v2.5-pro-crof,上下文 1000000 tokens。Artificial Analysis 智能指数 26.4。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-11 21:10 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份小米出品,Artificial Analysis 智能指数 26.4(满分 100)。 | |||||||||||||||||||
| M Muse Glimmer 30B 聚合平台 美元刊例 · 折算展示 | 2.019 | 0.2692 | 7.403 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Muse Glimmer 30B(AA 智能指数 18.1 / 131072 tokens) 版本说明其他模型参考价:取自「OpenRouter」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id meta/muse-glimmer-30b,上下文 131072 tokens。Artificial Analysis 智能指数 18.1。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-17 19:59 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份Meta出品,Artificial Analysis 智能指数 18.1(满分 100)。 | |||||||||||||||||||
| S Step 3.7 Flash 聚合平台 美元刊例 · 折算展示 | 1.346 | 0.2692 | 7.7395 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Step 3.7 Flash(AA 智能指数 19.5 / 262144 tokens) 版本说明其他模型参考价:取自「OpenRouter」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id stepfun/step-3.7-flash,上下文 262144 tokens。Artificial Analysis 智能指数 19.5。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 20:24 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份阶跃星辰出品,Artificial Analysis 智能指数 19.5(满分 100)。 | |||||||||||||||||||
| I Inkling Small 聚合平台 美元刊例 · 折算展示 | 3.0285 | 0.673 | 8.076 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Inkling Small(AA 智能指数 26.1 / 1048576 tokens) 版本说明其他模型参考价:取自「OpenRouter」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id thinkingmachines/inkling-small,上下文 1048576 tokens。Artificial Analysis 智能指数 26.1。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 19:04 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份Thinking Machines出品,Artificial Analysis 智能指数 26.1(满分 100)。 | |||||||||||||||||||
| G GPT-5.6 Luna Pro 聚合平台 美元刊例 · 折算展示 | 1.346 | 0.1346 | 8.076 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号GPT-5.6 Luna Pro(AA 智能指数 37.5 / 1050000 tokens) 版本说明其他模型参考价:取自「OpenRouter」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id openai/gpt-5.6-luna-pro,上下文 1050000 tokens。Artificial Analysis 智能指数 37.5。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 19:04 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份OpenAI出品,Artificial Analysis 智能指数 37.5(满分 100)。 | |||||||||||||||||||
| G GPT-5.6 Luna 聚合平台 美元刊例 · 折算展示 | 1.346 | 0.1346 | 8.076 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号GPT-5.6 Luna(AA 智能指数 37.5 / 1050000 tokens) 版本说明其他模型参考价:取自「OpenRouter」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id openai/gpt-5.6-luna,上下文 1050000 tokens。Artificial Analysis 智能指数 37.5。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 19:04 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份OpenAI出品,Artificial Analysis 智能指数 37.5(满分 100)。 | |||||||||||||||||||
| S Step 3.7 Flash 自部署 | 1.35 | 0.27 | 8.1 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号Step 3.7 Flash(AA 智能指数 19.5 / 256000 tokens) 版本说明其他模型参考价:取自「七牛云 AI 推理、模力方舟(Gitee AI)」模型广场公开刊例价,条目名 stepfun/step-3.7-flash。Artificial Analysis 智能指数 19.5。 接入该条目为国内平台参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 20:24 风险说明该条目为国内平台的公开刊例价,通常为厂商原价;海外渠道常有折扣,故此处可能高于「国外」分区所示价格。如需长期使用,建议回模型官网核实当期价格。 厂家身份阶跃星辰出品,Artificial Analysis 智能指数 19.5(满分 100)。 | |||||||||||||||||||
| G GLM 5.2 聚合平台 美元刊例 · 折算展示 | 2.8266 | 0.5249 | 8.8836 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号GLM 5.2(AA 智能指数 38.6 / 1048576 tokens) 版本说明其他模型参考价:取自「NanoGPT」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id z-ai/glm-5.2,上下文 1048576 tokens。Artificial Analysis 智能指数 38.6。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-11 21:10 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份智谱出品,Artificial Analysis 智能指数 38.6(满分 100)。 | |||||||||||||||||||
| G Gemini 3.5 Flash Lite 聚合平台 美元刊例 · 折算展示 | 2.019 | 0.2019 | 16.825 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Gemini 3.5 Flash Lite(AA 智能指数 22.7 / 1048576 tokens) 版本说明其他模型参考价:取自「OpenRouter」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id google/gemini-3.5-flash-lite,上下文 1048576 tokens。Artificial Analysis 智能指数 22.7。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 19:04 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份Google出品,Artificial Analysis 智能指数 22.7(满分 100)。 | |||||||||||||||||||
| T Tencent Hy4 Preview 聚合平台 美元刊例 · 折算展示 | 5.6128 | 0.2827 | 16.8317 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Tencent Hy4 Preview(AA 榜单暂未收录 / 1048576 tokens) 版本说明其他模型参考价:取自「OpenRouter」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id tencent/hy4-preview,上下文 1048576 tokens。Artificial Analysis 智能指数 (暂未收录)。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 20:24 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份腾讯混元出品,Artificial Analysis 智能指数暂未收录。 | |||||||||||||||||||
| T Tencent Hy4 Preview 自部署 | 6 | 0.3 | 18 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号Tencent Hy4 Preview(AA 榜单暂未收录 / 1000000 tokens) 版本说明其他模型参考价:取自「七牛云 AI 推理」模型广场公开刊例价,条目名 tencent/hy4-preview。Artificial Analysis 智能指数 (暂未收录)。 接入该条目为国内平台参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 20:24 风险说明该条目为国内平台的公开刊例价,通常为厂商原价;海外渠道常有折扣,故此处可能高于「国外」分区所示价格。如需长期使用,建议回模型官网核实当期价格。 厂家身份腾讯混元出品,Artificial Analysis 智能指数暂未收录。 | |||||||||||||||||||
| X Xiaomi MiMo V2.5 Pro 自部署 | 7 | — | 21 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号Xiaomi MiMo V2.5 Pro(AA 智能指数 26.4) 版本说明其他模型参考价:取自「模力方舟(Gitee AI)」模型广场公开刊例价,条目名 MiMo-V2.5-Pro。Artificial Analysis 智能指数 26.4。 接入该条目为国内平台参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-11 21:10 风险说明该条目为国内平台的公开刊例价,通常为厂商原价;海外渠道常有折扣,故此处可能高于「国外」分区所示价格。如需长期使用,建议回模型官网核实当期价格。 厂家身份小米出品,Artificial Analysis 智能指数 26.4(满分 100)。 | |||||||||||||||||||
| K Kimi K2.7 Code 聚合平台 美元刊例 · 折算展示 | 4.7783 | 1.0095 | 23.555 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Kimi K2.7 Code(AA 智能指数 26.3 / 262144 tokens) 版本说明其他模型参考价:取自「OpenRouter」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id moonshotai/kimi-k2.7-code,上下文 262144 tokens。Artificial Analysis 智能指数 26.3。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-11 21:10 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份月之暗面出品,Artificial Analysis 智能指数 26.3(满分 100)。 | |||||||||||||||||||
| G Gemini 3.8 Flash 聚合平台 美元刊例 · 折算展示 | 5.0475 | 0.5048 | 25.2375 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Gemini 3.8 Flash(AA 智能指数 41.2 / 1048576 tokens) 版本说明其他模型参考价:取自「OpenRouter」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id google/gemini-3.8-flash,上下文 1048576 tokens。Artificial Analysis 智能指数 41.2。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 19:04 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份Google出品,Artificial Analysis 智能指数 41.2(满分 100)。 | |||||||||||||||||||
| K Kimi K2.7 Code 自部署 | 6.5 | 1.3 | 27 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号Kimi K2.7 Code(AA 智能指数 26.3 / 262144 tokens) 版本说明其他模型参考价:取自「七牛云 AI 推理、模力方舟(Gitee AI)」模型广场公开刊例价,条目名 moonshotai/kimi-k2.7-code。Artificial Analysis 智能指数 26.3。 接入该条目为国内平台参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-11 21:10 风险说明该条目为国内平台的公开刊例价,通常为厂商原价;海外渠道常有折扣,故此处可能高于「国外」分区所示价格。如需长期使用,建议回模型官网核实当期价格。 厂家身份月之暗面出品,Artificial Analysis 智能指数 26.3(满分 100)。 | |||||||||||||||||||
| G GLM 5.2 自部署 | 8 | 2 | 28 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号GLM 5.2(AA 智能指数 38.6 / 1000000 tokens) 版本说明其他模型参考价:取自「七牛云 AI 推理、模力方舟(Gitee AI)」模型广场公开刊例价,条目名 z-ai/glm-5.2。Artificial Analysis 智能指数 38.6。 接入该条目为国内平台参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 20:24 风险说明该条目为国内平台的公开刊例价,通常为厂商原价;海外渠道常有折扣,故此处可能高于「国外」分区所示价格。如需长期使用,建议回模型官网核实当期价格。 厂家身份智谱出品,Artificial Analysis 智能指数 38.6(满分 100)。 | |||||||||||||||||||
| M Muse Spark 1.3 聚合平台 美元刊例 · 折算展示 | 8.4125 | 1.0095 | 28.6025 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Muse Spark 1.3(AA 智能指数 48.2 / 1048576 tokens) 版本说明其他模型参考价:取自「OpenRouter」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id meta/muse-spark-1.3,上下文 1048576 tokens。Artificial Analysis 智能指数 48.2。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 19:04 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份Meta出品,Artificial Analysis 智能指数 48.2(满分 100)。 | |||||||||||||||||||
| K Kimi K3 聚合平台 美元刊例 · 折算展示 | 13.46 | 1.346 | 67.3 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号Kimi K3(AA 智能指数 43.8 / 1048576 tokens) 版本说明其他模型参考价:取自「NanoGPT」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id moonshotai/kimi-k3,上下文 1048576 tokens。Artificial Analysis 智能指数 43.8。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 20:24 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份月之暗面出品,Artificial Analysis 智能指数 43.8(满分 100)。 | |||||||||||||||||||
| G GPT-5.6 Sol 聚合平台 美元刊例 · 折算展示 | 13.46 | 1.346 | 67.3 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号GPT-5.6 Sol(AA 智能指数 47.1 / 1050000 tokens) 版本说明其他模型参考价:取自「OpenRouter」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id openai/gpt-5.6-sol,上下文 1050000 tokens。Artificial Analysis 智能指数 47.1。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 19:04 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份OpenAI出品,Artificial Analysis 智能指数 47.1(满分 100)。 | |||||||||||||||||||
| G GPT-5.6 Terra 聚合平台 美元刊例 · 折算展示 | 13.46 | 1.346 | 80.76 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
折算口径美元刊例取自平台公开模型接口,人民币价 = 美元价 × 6.73(2026-09-11 汇率)折算,汇率波动时人民币价随之变化。 版本说明✓ 已核实型号GPT-5.6 Terra(AA 智能指数 42.3 / 1050000 tokens) 版本说明其他模型参考价:取自「OpenRouter」公开模型接口(该模型在我们已收录平台中的最低输出价档),条目 id openai/gpt-5.6-terra,上下文 1050000 tokens。Artificial Analysis 智能指数 42.3。 接入该条目为参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 19:04 风险说明该条目只取此模型在已收录平台中的最低输出价档,不同平台的上下文长度与量化方式可能不同,横向比较时留意。如需长期使用,建议回模型官网核实当期价格。 厂家身份OpenAI出品,Artificial Analysis 智能指数 42.3(满分 100)。 | |||||||||||||||||||
| K Kimi K3 自部署 | 20 | 2 | 100 | — | |||||||||||||||
价格档位单位:元 / 百万 tokens
版本说明✓ 已核实型号Kimi K3(AA 智能指数 43.8 / 1048576 tokens) 版本说明其他模型参考价:取自「七牛云 AI 推理、模力方舟(Gitee AI)」模型广场公开刊例价,条目名 moonshotai/kimi-k3。Artificial Analysis 智能指数 43.8。 接入该条目为国内平台参考价,用于快速判断「还有哪些便宜好用的模型」,不含渠道矩阵。需要比价请回到主推模型页。 口径与备注核实时间2026-09-16 20:24 风险说明该条目为国内平台的公开刊例价,通常为厂商原价;海外渠道常有折扣,故此处可能高于「国外」分区所示价格。如需长期使用,建议回模型官网核实当期价格。 厂家身份月之暗面出品,Artificial Analysis 智能指数 43.8(满分 100)。 | |||||||||||||||||||
| 没有符合条件的渠道,试试放宽筛选。 | |||||||||||||||||||
| 渠道 | 套餐 | 费用 元 | 额度 | 元 / 百万 tokens | 官网 |
|---|---|---|---|---|---|
| 该模型暂无套餐渠道,欢迎在渠道表查看按量计费。 | |||||
*「等效价」口径:TokenPlan 的「等效价格」= 套餐月费 ÷ 该套餐按官方抵扣系数折算出的 token 总量,且按额度 100% 全部用完计算。额度用不完,实际单价会高于此值。