2026年8月,AI大模型的定价市场发生了两件大事:DeepSeek官宣API全面涨价约100%,OpenAI的GPT-5.6 Luna降价80%。一个在涨,一个在降,但指向同一个结论——AI定价正在从”价格战”走向”价值分层”。便宜的越来越便宜,贵的开始涨价,中间地带的玩家在加速消失。
这篇文章是Token套餐选购指南的8月更新版。如果你错过了之前的版本,可以先回顾:
一、8月三大重磅价格变动
在展开全面盘点之前,先把这个月最值得关注的三件事说清楚:
事件一:DeepSeek官宣API全面涨价(8月6日)
DeepSeek V4-Flash当前平峰价为1/2元每百万Token,预计涨幅约100%。原因是单日处理8万亿Token的算力压力和芯片成本飙升。这意味着国产AI”白菜价”时代可能正式终结。DeepSeek一直被视为行业定价的”底线”,它涨价后,其他厂商跟进只是时间问题。
事件二:OpenAI GPT-5.6 Luna降价80%
GPT-5.6 Luna从$1/$6降至$0.20/$1.20每百万Token,永久生效。ChatGPT免费版同步升级至GPT-5.6 Luna。这一降价幅度堪称OpenAI史上最大单次降价,本质上是被中国开源模型的低价逼出来的。
事件三:阿里Qwen3.8-Max正式发布
2.4万亿参数的旗舰模型,定价输入12元/输出36元每百万Token,256K上下文。夜间(00:00-08:00)可享0.2折超级优惠(约2.4元/7.2元),是目前旗舰模型中夜间性价比最高的选择。
二、国内API定价速查表(2026年8月)
以下价格均为每百万Token的人民币价格,标注”免费”的为永久免费额度:
旗舰级模型
| 厂商 | 模型 | 输入价格 | 输出价格 | 上下文 | 备注 |
|---|---|---|---|---|---|
| DeepSeek | V4-Pro | ¥3 | ¥6 | 128K | 当前价,即将涨价 |
| 阿里 | Qwen3.8-Max | ¥12 | ¥36 | 256K | 夜间0.2折 |
| 智谱 | GLM-5.2 | ¥4 | ¥12 | 128K | 近期涨价83% |
| 月之暗面 | Kimi K3 | ¥20 | ¥100 | 256K | 2.8T参数,定价最贵 |
| 百度 | ERNIE 5.0 | ¥8 | ¥24 | 128K | |
| 腾讯 | 混元 Pro | ¥6 | ¥18 | 128K | |
| MiniMax | M3 | ¥5 | ¥15 | 128K |
高性价比/轻量级模型
| 厂商 | 模型 | 输入价格 | 输出价格 | 上下文 | 备注 |
|---|---|---|---|---|---|
| DeepSeek | V4-Flash | ¥1 | ¥2 | 128K | 当前价,即将涨100% |
| 阿里 | Qwen3.6-Flash | ¥0.5 | ¥2 | 128K | |
| 智谱 | GLM-4-Flash | 免费 | 免费 | 128K | 永久免费 |
| 百度 | ERNIE Lite | 免费 | 免费 | 128K | 永久免费 |
| 讯飞 | Spark Lite | 免费 | 免费 | 128K | 永久免费 |
| 腾讯 | 混元 Lite | 免费 | 免费 | 128K | 永久免费 |
| 字节 | 豆包 Lite | ¥0.3 | ¥1 | 128K | |
| 小米 | Mi-Mo-V2.5 | ¥0.5 | ¥2 | 128K | 开源 |
三、海外API定价速查表(2026年8月)
以下价格为每百万Token的美元价格:
| 厂商 | 模型 | 输入价格 | 输出价格 | 上下文 | 备注 |
|---|---|---|---|---|---|
| OpenAI | GPT-5.6 Sol | $15 | $60 | 128K | 旗舰级 |
| OpenAI | GPT-5.6 Terra | $5 | $20 | 128K | 均衡型 |
| OpenAI | GPT-5.6 Luna | $0.20 | $1.20 | 64K | 8月降价80% |
| Anthropic | Claude Fable 5 | $10 | $50 | 200K | 最贵旗舰 |
| Anthropic | Claude Sonnet 5 | $3 | $15 | 200K | 降价后 |
| Gemini 2.5 Pro | $3.50 | $10.50 | 2M | 超长上下文 | |
| Gemini 2.5 Flash | $0.075 | $0.30 | 1M | 极致低价 | |
| xAI | Grok 4.7 | $3 | $12 | 128K | 2.1T参数 |
| Mistral | Large 3 | $2 | $6 | 128K |
一个关键观察:GPT-5.6 Luna降价后($0.20/$1.20),折合人民币约1.4元/8.6元每百万Token,已经进入了与国内模型直接竞争的价格区间。Google Gemini 2.5 Flash($0.075/$0.30)折合人民币约0.5元/2.2元,是目前海外最便宜的选择。
四、免费额度盘点:还有哪些模型能白嫖?
2026年8月,免费额度的格局相比6月有明显收缩——多家的”限时免费”活动已经到期,但永久免费的选项仍然存在:
永久免费模型(无限量)
- 智谱 GLM-4-Flash:128K上下文,通用对话和基础编程能力不错,是目前免费模型中综合能力最强的
- 百度 ERNIE Lite:128K上下文,中文理解能力强,适合日常对话和文档处理
- 讯飞 Spark Lite:128K上下文,语音交互场景有额外优势
- 腾讯 混元 Lite:128K上下文,适合轻量级对话和简单任务
有限免费额度
- 阿里百炼:新用户注册送100万Token,部分模型限时免费
- DeepSeek:个人用户通过网页端使用完全免费,API无免费额度
- 字节豆包:新用户有少量免费额度,之后需付费
- OpenAI ChatGPT免费版:8月升级至GPT-5.6 Luna,每日有使用上限
- Google Gemini:免费版可使用Gemini 2.5 Flash,有速率限制
- Claude:免费版可使用Sonnet 5,每日约20条消息
五、消费级订阅对比(2026年8月)
如果你不想按Token付费,订阅制可能是更省心的选择:
海外订阅
| 产品 | 档位 | 月费 | 核心权益 |
|---|---|---|---|
| ChatGPT | Free | $0 | GPT-5.6 Luna,每日限额 |
| ChatGPT | Go | $8 | 新增档位,Luna无限量+少量Terra额度 |
| ChatGPT | Plus | $20 | Terra无限量+Sol少量 |
| ChatGPT | Pro | $100 | Sol无限量+优先响应 |
| Claude | Free | $0 | Sonnet 5,约20条/天 |
| Claude | Pro | $20 | Sonnet 5无限量+Opus额度 |
| Gemini | Advanced | $20 | Gemini 2.5 Pro无限量 |
国内订阅
| 产品 | 档位 | 月费 | 核心权益 |
|---|---|---|---|
| Kimi | 基础版 | ¥49 | K3基础额度 |
| Kimi | 标准版 | ¥149 | K3标准额度+高级功能 |
| Kimi | 专业版 | ¥399 | K3大额度+全功能 |
| Kimi | 旗舰版 | ¥699 | K3无限量+优先响应 |
| 豆包 | 标准版 | ¥68 | 豆包Pro额度 |
| 豆包 | 专业版 | ¥198 | 大额度+高级模型 |
| 通义千问 | 免费 | ¥0 | 基础对话免费 |
| 文心一言 | 会员 | ¥59.9 | ERNIE 5.0额度+高级功能 |
六、场景选型:你的场景该用哪个模型?
场景一:日常对话与知识问答
推荐:GLM-4-Flash(免费)或GPT-5.6 Luna($0.20/$1.20)。日常对话不需要旗舰模型,GLM-4-Flash免费且够用;如果你更看重英文能力和知识广度,GPT-5.6 Luna降价后性价比极高。
场景二:编程开发
推荐:DeepSeek V4-Pro(¥3/¥6)或Claude Sonnet 5($3/$15)。DeepSeek在代码生成上的性价比仍然是国内最高(但注意即将涨价)。Claude Sonnet 5在复杂编程任务上的质量最高,SWE-Bench得分62.4%。
场景三:长文档分析与研究
推荐:Gemini 2.5 Pro($3.50/$10.50,200万上下文)。在超长上下文场景下,Gemini没有竞争对手。200万Token约等于3000页文档,一次塞进去做全局分析。
场景四:大规模API调用/企业应用
推荐:Qwen3.6-Flash(¥0.5/¥2)+ 夜间Qwen3.8-Max(0.2折)。日常轻量调用用Flash模型压成本,复杂任务在夜间用旗舰模型的0.2折价格处理。这个组合可以把API成本压到最低。
场景五:中文内容创作
推荐:ERNIE Lite(免费)+ DeepSeek V4-Pro(¥3/¥6)。日常文案和创意生成用免费的ERNIE Lite即可;需要高质量长文创作时切DeepSeek V4-Pro。
七、性价比排名(8月更新)
综合模型能力(基于第三方评测Elo分数)和价格,以下是8月的性价比排名:
| 排名 | 模型 | 综合评分 | 月成本估算* | 性价比 |
|---|---|---|---|---|
| 1 | GLM-4-Flash | ★★★★☆ | ¥0 | ★★★★★ |
| 2 | GPT-5.6 Luna | ★★★★☆ | ≈¥15 | ★★★★★ |
| 3 | DeepSeek V4-Pro | ★★★★★ | ≈¥50 | ★★★★☆ |
| 4 | Qwen3.6-Flash | ★★★★☆ | ≈¥12 | ★★★★☆ |
| 5 | Claude Sonnet 5 | ★★★★★ | ≈¥80 | ★★★★☆ |
| 6 | Qwen3.8-Max(夜间) | ★★★★★ | ≈¥25 | ★★★★☆ |
| 7 | Gemini 2.5 Flash | ★★★★☆ | ≈¥5 | ★★★★☆ |
| 8 | GLM-5.2 | ★★★★★ | ≈¥70 | ★★★☆☆ |
| 9 | GPT-5.6 Terra | ★★★★★ | ≈¥100 | ★★★☆☆ |
| 10 | Kimi K3 | ★★★★★ | ≈¥200 | ★★☆☆☆ |
*月成本估算基于日均50次对话、每次约2000 Token输入+1000 Token输出的使用强度。
八、8月省钱策略
- 组合使用”免费+旗舰”:日常任务全部走GLM-4-Flash或ERNIE Lite(免费),只在需要高质量输出时切换到付费模型。这一个策略就能砍掉70%以上的API支出
- 善用夜间折扣:阿里百炼的夜间0.2折是目前最大的价格优惠。如果你的任务不需要实时响应(比如批量数据处理、报告生成),设定在凌晨执行可以省下98%的费用
- 关注DeepSeek涨价前的窗口期:如果你目前重度依赖DeepSeek V4-Flash,建议在涨价正式生效前尽可能多地预充值或迁移到替代方案(Qwen3.6-Flash、Mi-Mo-V2.5)
- 用订阅代替按量付费:如果你是个人用户且使用量大,ChatGPT Go($8/月)或Claude Pro($20/月)的固定月费可能比按Token付费便宜得多
- 海外模型走中转API:部分国内API中转平台提供OpenAI/Claude的折扣价,通常比官方价低15%-30%,但要注意稳定性和数据安全风险
九、趋势判断:接下来价格会怎么走?
基于8月的定价变动,我对未来几个月的价格走势有三个判断:
判断一:国内低价红利正在消退。DeepSeek的涨价是一个标志性信号。当”价格底线”开始涨价,整个市场的定价重心都会上移。如果你的业务重度依赖低价API,现在是时候做成本重新评估了。
判断二:海外模型在降价追赶。GPT-5.6 Luna降到$0.20/$1.20、Gemini Flash低至$0.075/$0.30——海外厂商正在用价格战回应中国开源模型的冲击。未来几个月,”海外模型不一定比国产贵”将成为新常态。
判断三:免费模型将成为”最低保障”。GLM-4-Flash、ERNIE Lite、Spark Lite、混元Lite四款永久免费模型,构成了一道”定价底线”——无论市场怎么变,至少基础对话能力始终有免费选项可用。
十、总结
2026年8月的Token定价市场,最核心的变化是:价格战正在从”全面低价”转向”分层定价”。免费层保底、轻量层竞争激烈、旗舰层开始涨价——这个结构越来越接近传统云计算的定价模型。
对个人用户来说,核心策略是”免费为主、按需升级”。对企业用户来说,核心策略是”多供应商组合、善用折扣窗口”。对开发者来说,最重要的不是哪个模型最便宜,而是在满足质量要求的前提下选最便宜的模型。
最贵的模型不等于最适合你的模型。选Token套餐和选手机一样——先想清楚你的需求,再看价格。
系列文章回顾:
