能力与折扣
大模型 API 能力与折扣对照
同样的用量,换一种计费方式就能差出几倍成本。下面按缓存、批处理、低谷价和多模态四类能力和折扣切开,每类都是真实价格数据,不是关键词堆砌。
| 能力 / 折扣 | 支持的官方模型 | 该类别最便宜 | 说明 |
|---|---|---|---|
| 提示词缓存 | 33 | GLM-4.7-Flash | 缓存命中价通常是标准输入价的 10%–25%。只要你的请求反复带同一段前缀(系统提示词、长文档、代码仓库上下文),命中率就能压住大部分输入成本。 |
| 批处理折扣 | 4 | Mistral Large | 批处理价换的是时间:任务进队列,厂商在空闲算力上跑,价格通常打五折。适合翻译、打标、摘要、数据清洗这类不需要即时返回的活。 |
| 低谷时段价 | 2 | deepseek-flash | 低谷价换的是时段。把定时任务挪到厂商的流量空闲窗口执行,是不改代码就能省钱的少数手段之一。 |
| 图像与多模态 | 29 | GLM-5.3-Flash | 支持图像输入意味着同一份价格表能同时处理截图、表格照片和扫描件,省掉单独的 OCR 环节。 |
怎么组合使用
缓存、批处理和低谷价通常不能叠加,要按任务分别取最优:实时接口吃缓存,离线任务吃批处理或低谷时段。三者都会改变最终账单,所以本站在估算器里把它们拆成了独立参数,填完再和下表的单价对照更准。