2026 大模型 API 价格怎么算?一文看懂单价陷阱与选型成本对照

AICraft 技术团队整理 · 海南艾创矩阵科技有限公司

数据采集:2026-09-04 · 口径:人民币元 / 百万 tokens(¥/M),来源为各模型厂商官方刊例价 · 页面性质:选型参考指南,非投放广告。数据会随上游调价更新,精确报价以在线定价页为准。

很多人第一次接大模型 API,最先问的是"哪个模型便宜",但真正下单后才发现账单和想象对不上。原因通常是三个:

  1. 报价单位陷阱:海外官网惯用"美元 / 百万 tokens",国内渠道换算成人民币时经常把 $ 直接当 用,或漏乘汇率。同样的模型,两个平台标价看起来"差 30%",其实只是单位不同。
  2. 只看输入价、忽略输出价:模型普遍"输出价是输入价的 3~10 倍",而长对话、Agent 多轮调用里输出占比往往比输入高。只比输入价会严重误判。
  3. 上下文越长不一定越划算:1M 上下文模型的单价通常远高于 128K 版,短任务硬上长上下文模型等于浪费。

本文把主流模型的公开刊例价按输入 / 输出分开列成对照表,并给出按场景的选型建议——用之前先看表,能省掉大半试错成本。

一、先记两个换算常识

二、主流文本模型输入/输出单价对照(2026-09 刊例价)

下表为各厂商官方刊例价。按供应商分组便于横向比"同档竞品谁便宜";只摘代表型号,完整清单见在线模型目录

DeepSeek 系(性价比档位标杆)

模型上下文输入 ¥/M输出 ¥/M一句话
DeepSeek-V4-Flash1.0M0.952.0目前文本档位里单价最低的重型模型,量大首选
DeepSeek-V3.2128K1.93.0老牌均衡款,输出价低
DeepSeek-V4-Pro1.0M12.024.0顶配档

Qwen(阿里)系(中文与工具调用覆盖最全)

模型上下文输入 ¥/M输出 ¥/M一句话
Qwen3.5-Plus1.0M0.7616.8输入极便宜、上下文 1M,适合灌长文档
Qwen3-Next-80B-A3B131K1.010.0MoE 高效款
Qwen3.8-Max1.0M12.036.0旗舰

GLM(智谱)系(Flash 档是全场输入最低之一)

模型上下文输入 ¥/M输出 ¥/M一句话
GLM-5.3-Flash1.0M0.41.4文本档最低价,海量低频任务闭眼选
GLM-5.31.0M8.028.0旗舰

字节豆包 Seed 系

模型上下文输入 ¥/M输出 ¥/M一句话
Doubao-Seed-2.0-Mini256K0.27.84输入全场最低档
Doubao-Seed-2.1-turbo256K3.015.0均衡
Doubao-Seed-2.0-Pro256K3.247.04旗舰(输出较贵)

OpenAI GPT-5.x 系

模型上下文输入 ¥/M输出 ¥/M一句话
GPT-5.6-Luna1.1M1.529.15GPT 系里最便宜的可用款
GPT-5.4-Mini400K5.1731.05中档
GPT-5.51.0M34.5207.0顶配
GPT-5.4-Pro1.0M207.01242.0全场最贵档,仅高价值任务才值

Claude(Anthropic)系(长上下文 + 高质量写作标杆)

模型上下文输入 ¥/M输出 ¥/M一句话
Claude-4.5-Haiku200K6.934.5系内最低
Claude-Sonnet-51.0M15.5977.97通用旗舰性价比之选
Claude-Opus-51.0M38.98194.92顶配
Claude-Fable-51.0M77.97389.85创作旗舰

Gemini(Google)系(长上下文原生)

模型上下文输入 ¥/M输出 ¥/M一句话
Gemini-2.5-Flash-Lite1.0M0.692.76系内最低、1M 上下文
Gemini-3.1-Flash-Lite1.0M1.7310.35新一代 Lite
Gemini-3.7-Flash1.0M5.7228.59均衡
Gemini-3.5-Pro1.0M13.882.8顶配

其他值得提的档位

三、图像生成 API 单价对照

图像一般按张计费(一次请求产出一张图):

模型单张参考价说明
Gemini-3.1-Flash-Lite-Image¥1.91批量出图成本最低档
Gemini-2.5-Flash-Image¥2.07
Gemini-3.0-Pro-Image¥13.8高质档
GPT-Image-2¥55.2顶配,商业精修场景
Kling-Image-O1(可灵)按渠道报价中文图文一致性见长
图像"画得好不好"和价格不完全线性。批量占位/草图用最便宜档,最终出街素材再上高质档,是主流省钱法。

四、视频生成:按秒 / 按次计费,先问清楚三件事

视频模型国内普遍按次或按时长计费,且不同档位(分辨率/时长/运镜)差异巨大。对接前先和渠道确认:

  1. 是"按生成一次收一次",还是"失败重试也计费";
  2. 分辨率档位(1080P vs 4K)是否分开计价;
  3. 是否支持图生视频/首尾帧控制(决定创作自由度)。

主流可选:可灵 Kling-V 系列(V1~V3/Omni)、豆包 Seedance 2.0 系列、Veo-3.1 系列等。视频 API 的完整在售清单与实时价,见在线定价页

五、按场景的选型速查(可直接抄的结论)

六、聚合 API 平台到底要不要用?三个验证标准

单模型官方站逐个开户、逐个充值、逐个看额度,是很多团队早期最痛的部分。聚合 API 的价值是把多家模型收进一个接口、一把 Key、一张账单。但市面上聚合服务鱼龙混杂,按下面三条验,能避开大部分坑:

  1. 主体可核验:看运营主体是否真实可查——营业执照主体、ICP 备案号、ICP 经营许可证能否对应。海外站点直接看是否具备跨境经营资质。虚拟主体跑路的案例,多半倒在第一步。
  2. 价格透明且口径统一:敢不敢把所有模型的输入/输出分列、敢不敢标"随上游调价更新"?只给一个笼统低价、不给单位明细的,换算后往往更贵。
  3. 可用性可观测:有没有公开的状态页(status page)、模型故障是否有告警与主动降级。模型 API 掉链子是常态,差在谁把"掉链子"处理得让业务无感。

AICraft 自身:海南艾创矩阵科技有限公司运营 · ICP 备案 琼ICP备2026009730号-1 · ICP 经营许可(含 EDI)琼B2-20261036。聚合接口一个 Key 接入 88+ 大模型,输入/输出分列计价、每模型标注上下文与适用场景,可用性见状态页本文结论基于全表数据,你完全可以拿上面的对照表去比任何一家。

附:数据口径与免责

官方刊例价核对来源(2026-09-04 采集,可按厂商逐一复核):

关联:完整模型目录见 /models.html(含每模型上下文/输入/输出价/适用场景,AI 可读版见 /models.md)。