更新日期:2026年7月 | 价格单位:人民币(元)/ 百万 tokens
一、价格速览:旗舰模型对比
| 厂商 | 旗舰模型 | 输入价格 | 输出价格 | 备注 |
|---|---|---|---|---|
| 腾讯 | 混元 T1 | 1.00 | 4.00 | 性价比突出 |
| 零一万物 | Yi-Lightning | 0.99 | 0.99 | 输入输出同价 |
| DeepSeek | V4-Pro | 3.00 | 6.00 | 开源标杆 |
| 字节跳动 | Seed-2.0-Pro | 3.20 | 16.00 | |
| 阶跃星辰 | Step-3.7-Flash | 1.35 | 8.10 | |
| MiniMax | M3 | 2.10 | 8.40 | |
| 百川智能 | M3-Plus | 5.00 | 9.00 | |
| 百度 | ERNIE 5.1 | 4.00 | 18.00 | |
| 阿里云 | Qwen3.7-Max | 6.00 | 18.00 | 促销价 |
| 智谱AI | GLM-5.2 | 8.00 | 28.00 | |
| 月之暗面 | K2.7 Code | 6.50 | 27.00 | 代码特化 |
| 商汤 | SenseNova 6.5 | ~4.50 | ~9.00 | 公测中 |
| 科大讯飞 | Spark 4.0 Ultra | ~5.00 | ~10.00 |
二、各厂商详细定价
1. 百度 — 文心一言 / ERNIE 系列
定价页面: cloud.baidu.com/doc/qianfan…
| 模型 | 输入价格 | 输出价格 | 说明 |
|---|---|---|---|
| ERNIE 5.1 | 4.00 | 18.00 | 最新旗舰 |
| ERNIE 4.0 Turbo | 3.00 | 9.00 | 高性能 |
| ERNIE 4.0 | 3.00 | 9.00 | |
| ERNIE 3.5 | 0.80 | 2.00 | 通用场景 |
| ERNIE Speed | 免费 | 免费 | 轻量快速 |
| ERNIE Lite | 免费 | 免费 | |
| ERNIE Tiny | 免费 | 免费 |
备注: ERNIE Speed/Lite/Tiny 长期免费开放,适合对延迟和成本敏感的场景。
2. 阿里云 — 通义千问 / Qwen 系列
定价页面: help.aliyun.com/zh/model-st…
| 模型 | 输入价格 | 输出价格 | 说明 |
|---|---|---|---|
| Qwen3.7-Max | 6.00 | 18.00 | 旗舰,促销价 |
| Qwen-Max | 2.00 | 6.00 | |
| Qwen-Plus | 0.80 | 2.00 | 性价比之选 |
| Qwen-Turbo | 0.30 | 0.60 | 快速响应 |
| Qwen-Long | 0.50 | 2.00 | 长文本处理 |
| Qwen2.5-72B-Instruct | 4.00 | 12.00 | 开源大参数 |
| Qwen2.5-7B 及以下 | 免费 | 免费 | 开源小模型 |
备注: 阿里云经常推出限时促销和免费额度,Qwen 开源系列的小模型可免费调用。Qwen3.7-Max 当前为推广期价格。
3. 字节跳动 — 豆包 / Seed 系列
定价页面: www.volcengine.com/docs/82379/…
| 模型 | 输入价格 | 输出价格 | 说明 |
|---|---|---|---|
| Seed-2.0-Pro | 3.20 | 16.00 | 最新旗舰 |
| Seed-2.0-Mini | 0.20 | 2.00 | 高性价比 |
| Doubao-Pro(128K) | 0.80 | 2.00 | 128K 上下文 |
| Doubao-Pro(32K) | 0.80 | 2.00 | |
| Doubao-Lite(128K) | 0.10 | 0.10 | 极致低价 |
| Doubao-Lite(32K) | 0.10 | 0.10 |
备注: 豆包 Lite 系列定价极低(0.10 元/百万 tokens),适合大规模批处理。Seed-2.0-Pro 为 2026 年新发布的旗舰模型。
4. 腾讯 — 混元 Hunyuan 系列
定价页面: cloud.tencent.com/document/pr…
| 模型 | 输入价格 | 输出价格 | 说明 |
|---|---|---|---|
| 混元 T1 | 1.00 | 4.00 | 旗舰推理 |
| 混元 TurboS | 0.80 | 2.00 | 性能均衡 |
| 混元 Standard | 0.50 | 1.00 | 通用场景 |
| 混元 Lite | 免费 | 免费 | 轻量版 |
备注: 混元 T1 作为旗舰推理模型,输入仅 1 元/百万 tokens,在旗舰模型中价格优势明显。
5. 智谱AI — GLM 系列
定价页面: bigmodel.cn/pricing
| 模型 | 输入价格 | 输出价格 | 说明 |
|---|---|---|---|
| GLM-5.2 | 8.00 | 28.00 | 最新旗舰 |
| GLM-4-Plus | 4.00 | 16.00 | 上一代旗舰 |
| GLM-4-Air | 1.00 | 2.00 | 均衡版 |
| GLM-4.7-Flash | 免费 | 免费 | 免费开放 |
| GLM-4-Flash | 免费 | 免费 |
备注: 智谱 2025—2026 年经历多轮涨价(涨幅超 80%),但 Flash 系列仍免费。GLM-5.2 定价处于行业较高水平。
6. DeepSeek
定价页面: api-docs.deepseek.com/zh-cn/quick…
| 模型 | 输入价格 | 输出价格 | 说明 |
|---|---|---|---|
| DeepSeek V4-Pro | 3.00 | 6.00 | 最新旗舰 |
| DeepSeek V4-Flash | 1.00 | 2.00 | 快速版 |
| DeepSeek R1 | 1.00 | 4.00 | 推理模型(缓存命中 0.25 元) |
| DeepSeek V3 | 2.00 | 8.00 | 输出从 2 元涨至 8 元 |
| DeepSeek R1(蒸馏版) | 0.50 | 2.00 | 小参数蒸馏 |
备注: DeepSeek 支持 token 缓存机制,缓存命中时价格大幅降低(约为原价的 1/4)。R1 推理模型在思维链输出时也计费。V3 输出价格在 2025 年从 2 元涨至 8 元,涨幅较大。V4-Flash 是当前性价比最优的选择之一。
7. 科大讯飞 — 星火 Spark 系列
定价页面: xinghuo.xfyun.cn/sparkapi
| 模型 | 输入价格 | 输出价格 | 说明 |
|---|---|---|---|
| Spark 4.0 Ultra | ~5.00 | ~10.00 | 旗舰 |
| Spark 4.0 Pro | ~3.00 | ~6.00 | |
| Spark Max | ~2.00 | ~5.00 | |
| Spark Pro | ~1.00 | ~3.00 | |
| Spark Lite | 免费 | 免费 | 免费版 |
备注: 讯飞星火按"千 tokens"计费,上表已换算为百万 tokens 统一口径。Lite 版长期免费。
8. 月之暗面(Moonshot AI)— Kimi 系列
定价页面: platform.moonshot.cn/docs/pricin…
| 模型 | 输入价格 | 输出价格 | 说明 |
|---|---|---|---|
| K2.7 Code | 6.50 | 27.00 | 代码特化旗舰 |
| K2 | 4.00 | 16.00 | 通用旗舰 |
| Moonshot v1-128k | 5.00 | 20.00 | 长上下文 |
| Moonshot v1-32k | 2.00 | 8.00 | |
| Moonshot v1-8k | 1.00 | 4.00 | 短文本 |
备注: Kimi 系列按上下文长度分档定价,上下文越长价格越高。K2.7 Code 是面向编程场景的特化模型,定价较高。
9. 百川智能(Baichuan)
定价页面: platform.baichuan-ai.com/prices
| 模型 | 输入价格 | 输出价格 | 说明 |
|---|---|---|---|
| Baichuan-M3-Plus | 5.00 | 9.00 | 最新旗舰 |
| Baichuan-4 | 3.00 | 12.00 | |
| Baichuan-3-Turbo | 2.00 | 8.00 | 快速版 |
| Baichuan-2-Turbo | 0.80 | 2.00 | 经济版 |
10. MiniMax
定价页面: platform.minimaxi.com/docs/guides…
| 模型 | 输入价格 | 输出价格 | 说明 |
|---|---|---|---|
| M3 | 2.10 | 8.40 | 最新旗舰 |
| abab7-chat | 5.00 | 20.00 | |
| abab6.5s | 1.00 | 1.00 | 输入输出同价 |
| abab5.5-chat | 0.50 | 0.50 | 经济版 |
备注: MiniMax 的 abab6.5s 输入输出同价(1 元/百万 tokens),对于输出较长的场景较友好。
11. 零一万物(01.AI)— Yi 系列
定价页面: platform.lingyiwanwu.com/docs/pricin…
| 模型 | 输入价格 | 输出价格 | 说明 |
|---|---|---|---|
| Yi-Lightning | 0.99 | 0.99 | 旗舰,输入输出同价 |
| Yi-Medium | 0.50 | 0.50 | |
| Yi-Vision | 1.00 | 1.00 | 多模态 |
| Yi-Large | 2.00 | 2.00 | 大参数 |
备注: 零一万物全线产品输入输出同价,策略简洁。Yi-Lightning 以不到 1 元/百万 tokens 的定价,在旗舰模型中极具竞争力。
12. 阶跃星辰(StepFun)
定价页面: platform.stepfun.com/docs/zh/gui…
| 模型 | 输入价格 | 输出价格 | 说明 |
|---|---|---|---|
| Step-3.7-Flash | 1.35 | 8.10 | 旗舰 |
| Step-2-16K | 2.00 | 10.00 | |
| Step-1-128K | 5.00 | 25.00 | 长上下文 |
| Step-1-8K | 1.00 | 5.00 | 短文本 |
备注: 与 Moonshot 类似,阶跃星辰也按上下文长度分档定价。
13. 商汤科技 — 日日新 SenseNova 系列
定价页面: www.sensetime.com/cn
| 模型 | 输入价格 | 输出价格 | 说明 |
|---|---|---|---|
| SenseNova 6.5 | ~4.50 | ~9.00 | 最新旗舰 |
| SenseNova 5.5 | ~2.00 | ~5.00 | |
| SenseChat | ~1.00 | ~3.00 | 通用对话 |
备注: 商汤日日新部分模型仍在公测阶段,公测期间可免费使用。正式定价以官网公告为准。
三、免费模型汇总
以下模型可长期免费调用,适合原型开发和小规模应用:
| 厂商 | 免费模型 | 适用场景 |
|---|---|---|
| 百度 | ERNIE Speed / Lite / Tiny | 通用对话、轻量任务 |
| 阿里云 | Qwen2.5-7B 及以下小模型 | 开源部署、小规模推理 |
| 智谱AI | GLM-4-Flash / GLM-4.7-Flash | 通用对话、快速响应 |
| 科大讯飞 | Spark Lite | 通用对话 |
| 腾讯 | 混元 Lite | 轻量对话 |
| 商汤 | SenseNova 全系(公测期) | 公测期间全量免费 |
四、性价比推荐(按场景)
旗舰级(追求最强能力)
| 推荐 | 输入/输出价格 | 理由 |
|---|---|---|
| 腾讯混元 T1 | 1.00 / 4.00 | 旗舰模型中最低价 |
| DeepSeek V4-Pro | 3.00 / 6.00 | 开源生态 + 合理定价 |
| 零一万物 Yi-Lightning | 0.99 / 0.99 | 输入输出同价,极低 |
均衡级(能力与成本兼顾)
| 推荐 | 输入/输出价格 | 理由 |
|---|---|---|
| 阿里 Qwen-Plus | 0.80 / 2.00 | 阿里系生态完善 |
| 腾讯混元 TurboS | 0.80 / 2.00 | 性能均衡 |
| DeepSeek V4-Flash | 1.00 / 2.00 | 开源 + 缓存折扣 |
| 字节 Seed-2.0-Mini | 0.20 / 2.00 | 输入价极低 |
极致低成本(大规模批处理)
| 推荐 | 输入/输出价格 | 理由 |
|---|---|---|
| 字节 Doubao-Lite | 0.10 / 0.10 | 全场最低价 |
| 免费模型 | 0 / 0 | 见上表 |
| 零一万物 Yi-Medium | 0.50 / 0.50 | 同价策略 |
五、市场趋势观察
价格战后的回涨: 2025 年国内大模型经历了激烈的价格战,多家厂商将价格压至极低水平。进入 2026 年,随着模型能力升级和运营成本压力,多数厂商已显著提价。例如智谱涨幅超 80%,DeepSeek V3 输出价格从 2 元涨至 8 元。
按上下文分档定价: 越来越多厂商(如 Moonshot、阶跃星辰)采用按上下文长度分档的定价策略,长上下文场景价格明显更高。
Token 缓存机制普及: DeepSeek 等厂商引入 token 缓存(Cache)机制,命中缓存时价格大幅降低(通常为原价的 1/4),对重复调用场景非常友好。
免费模型作为入口: 各厂商普遍保留免费模型作为开发者引流入口(百度 ERNIE Speed/Lite、智谱 Flash、讯飞 Lite 等),形成"免费入门 → 付费升级"的转化路径。