能力与折扣 · 提示词缓存
支持提示词缓存的大模型 API 价格
缓存命中价通常是标准输入价的 10%–25%。只要你的请求反复带同一段前缀(系统提示词、长文档、代码仓库上下文),命中率就能压住大部分输入成本。
| # | 模型 | 厂商 | 输入 /1M | 输出 /1M | 缓存命中 /1M | 综合 ¥ /1M | 上下文 |
|---|---|---|---|---|---|---|---|
| 1 | GLM-4.7-Flash | 智谱 GLM | ¥0 | ¥0 | ¥0 | ¥0.000 | 200K |
| 2 | GLM-5.3-Flash | 智谱 GLM | ¥0.4 | ¥1.4 | ¥0.115 | ¥0.650 | 1M |
| 3 | Doubao Seed 2.0 Mini | 火山方舟(豆包) | ¥0.2 | ¥8 | ¥0.16 | ¥2.15 | 32.8K |
| 4 | Qwen3.7-Plus | 阿里云百炼(Qwen) | ¥1.6 | ¥6.4 | ¥0.16 | ¥2.80 | 1M |
| 5 | GPT-5.6 Luna | OpenAI | US$0.2 | US$1.2 | US$0.02 | ¥3.02 | 272K |
| 6 | Doubao Seed 2.0 Lite | 火山方舟(豆包) | ¥0.6 | ¥10.8 | ¥0.36 | ¥3.15 | 32.8K |
| 7 | deepseek-flash | DeepSeek | US$0.3 | US$1.2 | US$0.006 | ¥3.52 | 1M |
| 8 | Gemini 3.1 Flash-Lite | Google Gemini | US$0.25 | US$1.5 | US$0.025 | ¥3.77 | 1M |
| 9 | Mistral Large | Mistral AI | US$0.5 | US$1.5 | US$0.05 | ¥5.03 | 128K |
| 10 | Gemini 3.5 Flash-Lite | Google Gemini | US$0.3 | US$2.5 | US$0.03 | ¥5.70 | 1M |
| 11 | Doubao Seed 2.1 Turbo | 火山方舟(豆包) | ¥3 | ¥15 | ¥0.6 | ¥6.00 | 262.1K |
| 12 | Gemini 3.8 Flash | Google Gemini | US$0.75 | US$3.75 | US$0.075 | ¥10.06 | 1M |
| 13 | Gemini 3.7 Flash | Google Gemini | US$0.75 | US$3.75 | US$0.075 | ¥10.06 | 1M |
| 14 | Gemini 3.6 Flash | Google Gemini | US$0.75 | US$3.75 | US$0.075 | ¥10.06 | 1M |
| 15 | Kimi K2.7 Code | Moonshot Kimi | ¥6.5 | ¥27 | ¥1.3 | ¥11.63 | 262.1K |
| 16 | Kimi K2.6 | Moonshot Kimi | ¥6.5 | ¥27 | ¥1.1 | ¥11.63 | 262.1K |
| 17 | Doubao Seed Evolving | 火山方舟(豆包) | ¥6 | ¥30 | ¥1.2 | ¥12.00 | 1.0M |
| 18 | Doubao Seed 2.1 Pro | 火山方舟(豆包) | ¥6 | ¥30 | ¥1.2 | ¥12.00 | 1.0M |
| 19 | GLM-5.3 | 智谱 GLM | ¥8 | ¥28 | ¥2 | ¥13.00 | 1M |
| 20 | GLM-5.2 | 智谱 GLM | ¥8 | ¥28 | ¥2 | ¥13.00 | 1M |
| 21 | deepseek-v4-pro | DeepSeek | US$1.32 | US$3.96 | US$0.044 | ¥13.28 | 1M |
| 22 | Haiku 4.5 | Anthropic | US$1 | US$5 | US$0.1 | ¥13.41 | 1M |
| 23 | Qwen3.8-Max | 阿里云百炼(Qwen) | ¥12 | ¥36 | ¥1.2 | ¥18.00 | 1M |
| 24 | Gemini 3.5 Flash | Google Gemini | US$1.5 | US$9 | US$0.15 | ¥22.64 | 1M |
| 25 | Kimi K2.7 Code Highspeed | Moonshot Kimi | ¥13 | ¥54 | ¥2.6 | ¥23.25 | 262.1K |
| 26 | Sonnet 5 | Anthropic | US$2 | US$10 | US$0.2 | ¥26.83 | 1M |
| 27 | GPT-5.6 Terra | OpenAI | US$2 | US$12 | US$0.2 | ¥30.18 | 272K |
| 28 | Gemini 3 Pro 预览版 | Google Gemini | US$2 | US$12 | US$0.2 | ¥30.18 | 1M |
| 29 | Kimi K3 | Moonshot Kimi | ¥20 | ¥100 | ¥2 | ¥40.00 | 1.0M |
| 30 | GPT-5.6 Sol | OpenAI | US$4 | US$20 | US$0.4 | ¥53.66 | 272K |
| 31 | Opus 5 | Anthropic | US$5 | US$25 | US$0.5 | ¥67.07 | 1M |
| 32 | GPT-6 Astra | OpenAI | US$10 | US$50 | US$1 | ¥134.15 | 272K |
| 33 | Fable 5.1 | Anthropic | US$10 | US$50 | US$0.25 | ¥134.15 | 1M |
选型建议
本类里 GLM-4.7-Flash 的综合单价最低。如果还需要长上下文,可以接着看上下文分档;如果只看绝对低价,直接看最便宜排行。
常见问题
- 哪些大模型 API 有提示词缓存(缓存命中价)?
- 本站已核价范围内有 33 个官方模型支持提示词缓存,包括 GPT-6 Astra、GPT-5.6 Sol、GPT-5.6 Terra、GPT-5.6 Luna、Fable 5.1、Opus 5 等。完整清单与单项价格见本页表格。
- 提示词缓存能省多少钱?
- 缓存命中价通常是标准输入价的 10%–25%。只要你的请求反复带同一段前缀(系统提示词、长文档、代码仓库上下文),命中率就能压住大部分输入成本。以本页综合单价最低的 GLM-4.7-Flash 为例,标准价输入 ¥0 / 1M tokens。实际折扣幅度以各模型页标注的档位价为准。
- 这类折扣和免费额度能叠加吗?
- 不能。免费额度和试用赠金是有限期的营销资源,不在本站排名口径内;折扣价只按官方公布的计费档位计算。
价格单位统一为“每 100 万 tokens”,只收录官方第一方公开标价;免费额度、促销券、企业协议价和中转站价格不参与排名。数据核对日期见各模型页。