¥Tokens 官方价格查看器

能力与折扣

大模型 API 能力与折扣对照

同样的用量,换一种计费方式就能差出几倍成本。下面按缓存、批处理、低谷价和多模态四类能力和折扣切开,每类都是真实价格数据,不是关键词堆砌。

能力 / 折扣支持的官方模型该类别最便宜说明
提示词缓存 33 GLM-4.7-Flash 缓存命中价通常是标准输入价的 10%–25%。只要你的请求反复带同一段前缀(系统提示词、长文档、代码仓库上下文),命中率就能压住大部分输入成本。
批处理折扣 4 Mistral Large 批处理价换的是时间:任务进队列,厂商在空闲算力上跑,价格通常打五折。适合翻译、打标、摘要、数据清洗这类不需要即时返回的活。
低谷时段价 2 deepseek-flash 低谷价换的是时段。把定时任务挪到厂商的流量空闲窗口执行,是不改代码就能省钱的少数手段之一。
图像与多模态 29 GLM-5.3-Flash 支持图像输入意味着同一份价格表能同时处理截图、表格照片和扫描件,省掉单独的 OCR 环节。

怎么组合使用

缓存、批处理和低谷价通常不能叠加,要按任务分别取最优:实时接口吃缓存,离线任务吃批处理或低谷时段。三者都会改变最终账单,所以本站在估算器里把它们拆成了独立参数,填完再和下表的单价对照更准。