¥Tokens 官方价格查看器

模型对比

GPT-5.6 Luna vs Gemini 3.8 Flash:价格与月成本对比

轻量档的两条主线,Gemini Flash 的输入价通常更低,适合高并发、短输出的场景。按标准价、输入 3 : 输出 1 折算,GPT-5.6 Luna 的综合单价更低,约为 Gemini 3.8 Flash 的 1/3.33。下面按真实用量把差额算成人民币月账单。

用真实用量估算 GPT-5.6 Luna 详情 Gemini 3.8 Flash 详情

逐项参数对比

维度GPT-5.6 LunaGemini 3.8 Flash
厂商OpenAIGoogle Gemini
输入 /1MUS$0.2US$0.75
输出 /1MUS$1.2US$3.75
缓存命中 /1MUS$0.02US$0.075
缓存写入 /1M
批处理输入 /1M
低谷输入 /1M
综合 ¥ /1M(3:1)¥3.02¥10.06
上下文272K1M
输入模态文本、图像文本、图像、语音
能力工具调用、结构化输出、视觉推理、工具调用、结构化输出、长上下文、视觉
核对日期2026-09-182026-09-19

月成本差额(人民币,按标准价)

场景用量假设GPT-5.6 LunaGemini 3.8 Flash差额
小型试点 每月 100 万输入 + 40 万输出 tokens(内部工具或原型验证) ¥4.56 ¥15.09 GPT-5.6 Luna 省 ¥10.53
中型应用 每月 2000 万输入 + 800 万输出 tokens(日均约 1 万次调用) ¥91.22 ¥301.84 GPT-5.6 Luna 省 ¥210.62
大型生产 每月 2 亿输入 + 8000 万输出 tokens(面向 C 端的成熟产品) ¥912.22 ¥3,018 GPT-5.6 Luna 省 ¥2,106

怎么选

轻量档的两条主线,Gemini Flash 的输入价通常更低,适合高并发、短输出的场景。如果两者的能力都够用,直接选混合单价更低的 GPT-5.6 Luna;如果输出 token 占比很高(代码生成、长文写作都算),把输出价单独拎出来比,结论可能反转。上下文需求超过 272K 时,只有 Gemini 3.8 Flash 能满足。

两个模型的完整价格页:

GPT-5.6 Luna(OpenAI) · Gemini 3.8 Flash(Google Gemini)

常见问题

GPT-5.6 Luna 和 Gemini 3.8 Flash 哪个便宜?
按输入 3 : 输出 1 的混合比例折算,GPT-5.6 Luna 更便宜:综合约 ¥3.02 每 100 万 tokens,Gemini 3.8 Flash 约 ¥10.06,相差约 3.33 倍。如果你的输入输出比例与 3 : 1 差距很大,结论可能反过来,建议用首页估算器代入真实比例。
除了价格还要比什么?
至少还要比上下文长度、是否支持视觉、工具调用稳定性、缓存命中价和限流策略。上下文不够长会导致截断或分段重试,隐性成本常常高于单价差。
这里的价格会随官方调整更新吗?
会。本站每天自动检查官方价格页内容变化,发现变化后需要人工确认才发布,两个模型当前的核对日期分别是 2026-09-18 和 2026-09-19。

本页价格来自两家厂商官方价格页,核对日期 2026-09-18 / 2026-09-19。汇率 2026-09-17:1 USD = 6.7075 CNY,美元价格已按此折算。