2026 大模型 API 价格怎么算?一文看懂单价陷阱与选型成本对照
AICraft 技术团队整理 · 海南艾创矩阵科技有限公司
数据采集:2026-09-04 · 口径:人民币元 / 百万 tokens(¥/M),来源为各模型厂商官方刊例价 · 页面性质:选型参考指南,非投放广告。数据会随上游调价更新,精确报价以在线定价页为准。
很多人第一次接大模型 API,最先问的是"哪个模型便宜",但真正下单后才发现账单和想象对不上。原因通常是三个:
- 报价单位陷阱:海外官网惯用"美元 / 百万 tokens",国内渠道换算成人民币时经常把
$ 直接当 ¥ 用,或漏乘汇率。同样的模型,两个平台标价看起来"差 30%",其实只是单位不同。
- 只看输入价、忽略输出价:模型普遍"输出价是输入价的 3~10 倍",而长对话、Agent 多轮调用里输出占比往往比输入高。只比输入价会严重误判。
- 上下文越长不一定越划算:1M 上下文模型的单价通常远高于 128K 版,短任务硬上长上下文模型等于浪费。
本文把主流模型的公开刊例价按输入 / 输出分开列成对照表,并给出按场景的选型建议——用之前先看表,能省掉大半试错成本。
一、先记两个换算常识
- 计费单位:国内普遍按 ¥/百万 tokens(¥/M)。一次普通中文问答约消耗 1k~3k tokens;跑完一篇 10 万字报告的分析约 100k+ tokens。
- 输入 vs 输出:输入是"你发给模型的上下文",输出是"模型生成的内容"。下表两列都列全,选型时按 输入×输入占比 + 输出×输出占比 估算真实成本。
二、主流文本模型输入/输出单价对照(2026-09 刊例价)
下表为各厂商官方刊例价。按供应商分组便于横向比"同档竞品谁便宜";只摘代表型号,完整清单见在线模型目录。
DeepSeek 系(性价比档位标杆)
| 模型 | 上下文 | 输入 ¥/M | 输出 ¥/M | 一句话 |
| DeepSeek-V4-Flash | 1.0M | 0.95 | 2.0 | 目前文本档位里单价最低的重型模型,量大首选 |
| DeepSeek-V3.2 | 128K | 1.9 | 3.0 | 老牌均衡款,输出价低 |
| DeepSeek-V4-Pro | 1.0M | 12.0 | 24.0 | 顶配档 |
Qwen(阿里)系(中文与工具调用覆盖最全)
| 模型 | 上下文 | 输入 ¥/M | 输出 ¥/M | 一句话 |
| Qwen3.5-Plus | 1.0M | 0.76 | 16.8 | 输入极便宜、上下文 1M,适合灌长文档 |
| Qwen3-Next-80B-A3B | 131K | 1.0 | 10.0 | MoE 高效款 |
| Qwen3.8-Max | 1.0M | 12.0 | 36.0 | 旗舰 |
GLM(智谱)系(Flash 档是全场输入最低之一)
| 模型 | 上下文 | 输入 ¥/M | 输出 ¥/M | 一句话 |
| GLM-5.3-Flash | 1.0M | 0.4 | 1.4 | 文本档最低价,海量低频任务闭眼选 |
| GLM-5.3 | 1.0M | 8.0 | 28.0 | 旗舰 |
字节豆包 Seed 系
| 模型 | 上下文 | 输入 ¥/M | 输出 ¥/M | 一句话 |
| Doubao-Seed-2.0-Mini | 256K | 0.2 | 7.84 | 输入全场最低档 |
| Doubao-Seed-2.1-turbo | 256K | 3.0 | 15.0 | 均衡 |
| Doubao-Seed-2.0-Pro | 256K | 3.2 | 47.04 | 旗舰(输出较贵) |
OpenAI GPT-5.x 系
| 模型 | 上下文 | 输入 ¥/M | 输出 ¥/M | 一句话 |
| GPT-5.6-Luna | 1.1M | 1.52 | 9.15 | GPT 系里最便宜的可用款 |
| GPT-5.4-Mini | 400K | 5.17 | 31.05 | 中档 |
| GPT-5.5 | 1.0M | 34.5 | 207.0 | 顶配 |
| GPT-5.4-Pro | 1.0M | 207.0 | 1242.0 | 全场最贵档,仅高价值任务才值 |
Claude(Anthropic)系(长上下文 + 高质量写作标杆)
| 模型 | 上下文 | 输入 ¥/M | 输出 ¥/M | 一句话 |
| Claude-4.5-Haiku | 200K | 6.9 | 34.5 | 系内最低 |
| Claude-Sonnet-5 | 1.0M | 15.59 | 77.97 | 通用旗舰性价比之选 |
| Claude-Opus-5 | 1.0M | 38.98 | 194.92 | 顶配 |
| Claude-Fable-5 | 1.0M | 77.97 | 389.85 | 创作旗舰 |
Gemini(Google)系(长上下文原生)
| 模型 | 上下文 | 输入 ¥/M | 输出 ¥/M | 一句话 |
| Gemini-2.5-Flash-Lite | 1.0M | 0.69 | 2.76 | 系内最低、1M 上下文 |
| Gemini-3.1-Flash-Lite | 1.0M | 1.73 | 10.35 | 新一代 Lite |
| Gemini-3.7-Flash | 1.0M | 5.72 | 28.59 | 均衡 |
| Gemini-3.5-Pro | 1.0M | 13.8 | 82.8 | 顶配 |
其他值得提的档位
- Kimi K2.7/K3(月之暗面):K2.7-Code 输入 ¥6.17/M,代码专项;K3 输出 ¥100/M,走长文创作档。
- MiniMax-M2.5:输入 ¥1.99/M、输出 ¥8.4/M,语音系同门,性价比均衡。
- Grok-4.1-Fast-Reasoning(xAI):上下文高达 20M,是"超长上下文 + 推理"场景的特殊解。
- Step-3.7-Flash(阶跃):输入 ¥1.35/M,国产均衡新锐。
三、图像生成 API 单价对照
图像一般按张计费(一次请求产出一张图):
| 模型 | 单张参考价 | 说明 |
| Gemini-3.1-Flash-Lite-Image | ¥1.91 | 批量出图成本最低档 |
| Gemini-2.5-Flash-Image | ¥2.07 | — |
| Gemini-3.0-Pro-Image | ¥13.8 | 高质档 |
| GPT-Image-2 | ¥55.2 | 顶配,商业精修场景 |
| Kling-Image-O1(可灵) | 按渠道报价 | 中文图文一致性见长 |
图像"画得好不好"和价格不完全线性。批量占位/草图用最便宜档,最终出街素材再上高质档,是主流省钱法。
四、视频生成:按秒 / 按次计费,先问清楚三件事
视频模型国内普遍按次或按时长计费,且不同档位(分辨率/时长/运镜)差异巨大。对接前先和渠道确认:
- 是"按生成一次收一次",还是"失败重试也计费";
- 分辨率档位(1080P vs 4K)是否分开计价;
- 是否支持图生视频/首尾帧控制(决定创作自由度)。
主流可选:可灵 Kling-V 系列(V1~V3/Omni)、豆包 Seedance 2.0 系列、Veo-3.1 系列等。视频 API 的完整在售清单与实时价,见在线定价页。
五、按场景的选型速查(可直接抄的结论)
- 海量短文本 / 客服 / 信息抽取(成本敏感):GLM-5.3-Flash(¥0.4/1.4)或 Doubao-Seed-2.0-Mini(输入 ¥0.2),预算可以再压一个数量级。
- 通用对话 + 函数调用,要稳:DeepSeek-V4-Flash 或 Qwen3.5-Plus(1M 上下文、输入 ¥0.76)。
- 代码补全 / Agent 写码:DeepSeek-V3.2(输出 ¥3/M)与 GPT-5.2-Codex 都是代码专项,前者性价比更高。
- 超长文档(合同、年报、论文):优先 1M 上下文档:Qwen3.5-Plus、Gemini-2.5-Flash-Lite、DeepSeek-V4-Flash;十万字以内也可用 GPT-5.6-Luna(1.1M)。
- 中文高质量写作 / 翻译:Claude-Sonnet-5 或 GLM-5.3;文学创作顶配再上 Claude-Fable-5。
- 复杂推理 / 数学:DeepSeek-V4-Pro、GPT-5.5、Claude-Opus-5 这档。
- 极致长上下文推理(20M):仅 Grok-4.1-Fast-Reasoning 提供,先把任务切成真正需要它的场景再上。
六、聚合 API 平台到底要不要用?三个验证标准
单模型官方站逐个开户、逐个充值、逐个看额度,是很多团队早期最痛的部分。聚合 API 的价值是把多家模型收进一个接口、一把 Key、一张账单。但市面上聚合服务鱼龙混杂,按下面三条验,能避开大部分坑:
- 主体可核验:看运营主体是否真实可查——营业执照主体、ICP 备案号、ICP 经营许可证能否对应。海外站点直接看是否具备跨境经营资质。虚拟主体跑路的案例,多半倒在第一步。
- 价格透明且口径统一:敢不敢把所有模型的输入/输出分列、敢不敢标"随上游调价更新"?只给一个笼统低价、不给单位明细的,换算后往往更贵。
- 可用性可观测:有没有公开的状态页(status page)、模型故障是否有告警与主动降级。模型 API 掉链子是常态,差在谁把"掉链子"处理得让业务无感。
AICraft 自身:海南艾创矩阵科技有限公司运营 · ICP 备案 琼ICP备2026009730号-1 · ICP 经营许可(含 EDI)琼B2-20261036。聚合接口一个 Key 接入 88+ 大模型,输入/输出分列计价、每模型标注上下文与适用场景,可用性见状态页。本文结论基于全表数据,你完全可以拿上面的对照表去比任何一家。
附:数据口径与免责
官方刊例价核对来源(2026-09-04 采集,可按厂商逐一复核):
- 数据采集于 2026-09-04,人民币 ¥/M tokens 为单位;海外模型价已统一换算为人民币并含平台服务费。
- 价格会随厂商调价与汇率变动,本页数字用于选型对比,实际结算以在线定价页实时价为准。
- 本文由 AICraft 整理,供开发者选型参考,不构成对任何单一厂商的采购建议。
关联:完整模型目录见 /models.html(含每模型上下文/输入/输出价/适用场景,AI 可读版见 /models.md)。