综合对比重点
本页不是单纯列价格,而是围绕 Token Plan、Coding Plan、价格对比、额度、额度重置、免费额度、优惠、官网入口、申请入口、Claude Code 平替和 Cursor 接入等搜索场景做综合整理。
LLM API 价格对比:Claude、Gemini、DeepSeek、通义、豆包、Kimi 单价表
本文根据 TokenPlan 整理 LLM API 价格。API 成本不能只看最低输入价,还要同时看输出价、缓存命中、Batch 折扣、上下文分档、免费模型限制和订阅是否与 API 独立。
LLM API 横向价格表
横向表用于快速定位“哪个 API 便宜、哪个 API 适合生产、哪个 API 有免费档”。但 LLM API 的真实成本通常不是最低输入价决定的,而是输出长度、缓存命中率、Batch 是否可用、上下文是否跨档、模型是否路由到更贵供应商共同决定。
| 厂商 | 代表模型/套餐 | 输入价 | 输出价 | 免费档/免费额度 | 适合场景 |
|---|---|---|---|---|---|
| 豆包 API | Doubao-Seed-2.0-Mini ≤32K | ¥0.2/M | ¥2/M | 资料当前可核对的信息以按量计费为主,免费额度以页面更新为准 | 高吞吐轻量任务、成本敏感基础流量 |
| 通义千问 API | Qwen-Turbo 非思考 | ¥0.3/M | ¥0.6/M | 新用户通常有免费额度,需控制台确认 | 轻量问答、批处理、默认路由层 |
| 智谱 GLM API | GLM-4.5-Air <32K | ¥0.8/M | ¥2/M | GLM-4.7-Flash 等多款免费模型 | 中文应用、MCP、低价文本/视觉测试 |
| DeepSeek API | DeepSeek-V4-Flash | ¥1/M | ¥2/M | 资料当前可核对的信息以按量计费为主,免费额度以页面更新为准 | 高频批量、自建后端、Agent 流水线 |
| Kimi API | Moonshot V1 8K / K2.5 | ¥2/M 起 | ¥10/M 起 | 资料当前可核对的信息以按量计费为主,免费额度以页面更新为准 | 长文本、代码 Agent、Kimi 工具链 |
| MiniMax API | MiniMax-M3 / M2.7 | ¥2.1/M | ¥8.4/M | 资料当前可核对的信息以按量计费为主,免费额度以页面更新为准 | 多模态 Agent、长上下文、语音视频扩展 |
| Gemini API | Gemini 3.5 Flash | $1.50/M | $9/M | AI Studio Free tier 可免费调用部分模型 | 搜索 grounding、Google 生态、快速 Agent |
| Claude API | Claude Sonnet 4.6 | $3/M | $15/M | 资料当前可核对的信息以按量计费为主,免费额度以页面更新为准 | 生产 Agent、代码改造、长上下文任务 |
| OpenRouter | Pay-as-you-go Credits | $0.15/M 参考 | $0.60/M 参考 | 免费模型 50 次/天,充值 $10+ 后 1000 次/天 | 多模型统一网关、fallback、路由比较 |
LLM API 价格不能只看输入价:输出价、缓存和 Batch 为什么重要
输入价只覆盖请求里的 prompt、上下文和工具返回内容。真实账单还要加输出 token,输出价通常高于输入价。代码生成、长回答、Agent 多轮调用、失败重试都会让输出成为主要成本。
缓存和 Batch 会改变同一模型的实际单价。DeepSeek-V4-Flash 缓存命中输入 ¥0.02/M,Kimi K2.5 缓存命中 ¥0.70/M,MiniMax-M3 缓存读 ¥0.42/M,Gemini 3.5 Flash Batch 输入 $0.75/M、输出 $4.50/M,Claude 和 Gemini 的资料也记录 Batch 约 50%。固定 system prompt、长项目上下文和离线批处理,都应该优先看这些折扣。
低价中文 API 怎么选:豆包、通义、智谱、DeepSeek 对比
低价中文 API 的代表低价档集中在豆包、通义、智谱和 DeepSeek。豆包 Doubao-Seed-2.0-Mini ≤32K 输入 ¥0.2/M、输出 ¥2/M,适合高吞吐轻量任务;通义 Qwen-Turbo 非思考输入 ¥0.3/M、输出 ¥0.6/M,适合轻量问答和批处理;智谱 GLM-4.5-Air <32K 输入 ¥0.8/M、输出 ¥2/M,并有多款免费模型;DeepSeek-V4-Flash 输入 ¥1/M、输出 ¥2/M,缓存命中输入 ¥0.02/M。
如果任务是分类、摘要、抽取、轻量客服,优先看输出价和吞吐。若任务带长 system prompt 或重复上下文,DeepSeek 的缓存命中价会更关键。若需要免费模型测试或中文视觉/文本混合验证,智谱 GLM 免费模型更适合起步。
Claude、Gemini、Kimi 这类高价模型适合什么任务
价格更高的模型通常用于更复杂的任务,而不是所有请求默认使用。Claude Sonnet 4.6 为 $3/M 输入、$15/M 输出,Opus 4.8 为 $5/M、$25/M;Gemini 3.5 Flash 为 $1.50/M、$9/M,Gemini 3.1 Pro ≤200K 为 $2/M、$12/M,>200K 为 $4/M、$18/M;Kimi K2.7 Code 未命中输入 ¥6.50/M、输出 ¥27/M,缓存命中 ¥1.30/M。
这些模型适合复杂代码改造、长上下文分析、多步 Agent、研究型任务和关键结果生成。低价值、高频、短文本请求应先用低价模型承接,再把复杂节点升级到 Claude、Gemini Pro、Kimi K2.7 Code 或 K2.6。
OpenRouter 多模型路由价格怎么理解
OpenRouter 不是固定套餐价。套餐信息显示它通过 Credits 按量计费,340+ 模型按 provider 直透价扣费,gpt-4o-mini 参考价为 $0.15/M 输入、$0.60/M 输出;免费模型 API 默认 50 次/天,充值 $10+ 后 1000 次/天。
使用 OpenRouter 时,账单取决于最终 model id 和 provider。Auto Router 会按 prompt 选择底层模型并按选中模型计费,Fusion Router 这类多模型模式可能按参与模型 token 消耗累加。生产系统需要记录实际模型、provider、输入输出 tokens 和 Credits 扣费,不能只按参考价估算全部请求。
Batch 半价、缓存命中和长上下文分档怎么影响账单
Batch 适合离线任务,例如批量摘要、标签生成、数据清洗、离线评测。套餐信息显示通义 Qwen-Turbo Batch 输入输出 50%,Gemini 3.5 Flash Batch 输入 $0.75/M、输出 $4.50/M,Gemini 3.1 Pro 支持约 50% Batch,Claude 也记录 Batch 约 50%。如果任务不要求实时返回,Batch 往往比换模型更直接。
缓存命中适合重复上下文,例如固定提示词、同一代码仓库、同一文档集合。长上下文分档会让超出阈值后的请求变贵,例如通义 Qwen3.7-Plus 0–256K 为 ¥2/M、¥12/M,Qwen3.7-Max 0–1M 为 ¥12/M、¥36/M;Gemini 3.1 Pro ≤200K 为 $2/M、$12/M,>200K 为 $4/M、$18/M。上线前要按真实上下文长度估算。
上线前怎么估算 LLM API 成本
上线前估算成本应按一次完整请求链路计算,而不是只看单次模型调用。先估算每次请求的输入 tokens、输出 tokens、工具返回内容、上下文长度、平均重试次数和 Agent 多轮次数,再乘以对应模型输入价与输出价。
如果系统有大量相同提示词或仓库上下文,要单独估算缓存命中率。如果任务可以异步处理,要估算 Batch 折扣。如果使用 OpenRouter,要记录实际底层模型。如果使用订阅产品做人工工作流,也不要把订阅额度折算成 API 成本。
API 单价/Token 价格表
下面保留源头单价表。单位均为每百万 tokens,币种按资料保留。表内“缓存/Batch/分档”列是估算账单时最容易被忽略的部分。
| 厂商 | 模型 | 输入价 | 输出价 | 缓存/Batch/分档 | 计价单位 |
|---|---|---|---|---|---|
| 豆包 API | Doubao-Seed-2.0-Mini ≤32K | ¥0.2 | ¥2 | 更长上下文分档上浮;Batch 部分 Seed 模型约 50% | 百万 tokens |
| 豆包 API | Doubao-Seed-2.0-Lite ≤32K | ¥0.6 | ¥3.6 | 缓存命中输入 ¥0.12 | 百万 tokens |
| 通义千问 API | Qwen-Turbo 非思考 | ¥0.3 | ¥0.6 | 思考模式输出 ¥3;Batch 输入输出 50% | 百万 tokens |
| 通义千问 API | Qwen3.7-Plus 0–256K | ¥2 | ¥12 | 更高上下文区间上浮;支持 Batch 与缓存 | 百万 tokens |
| 通义千问 API | Qwen3.7-Max 0–1M | ¥12 | ¥36 | 单次请求按输入总量所在区间结算 | 百万 tokens |
| 智谱 GLM API | GLM-4.5-Air <32K | ¥0.8 | ¥2 | 32K–128K 为 ¥1.2/¥8 | 百万 tokens |
| 智谱 GLM API | GLM-4.7 <32K 且输出 <20% | ¥2 | ¥8 | 输出占比 ≥20% 为 ¥3/¥14;32K–1M 为 ¥4/¥16 | 百万 tokens |
| 智谱 GLM API | GLM-5.2 | ¥6 起 | ¥24 起 | ≥32K 为 ¥8/¥28;缓存命中 ¥1.3 起 | 百万 tokens |
| DeepSeek API | DeepSeek-V4-Flash | ¥1 | ¥2 | 缓存命中输入 ¥0.02;并发 2500 | 百万 tokens |
| DeepSeek API | DeepSeek-V4-Pro | ¥3 | ¥6 | 缓存命中输入 ¥0.025;并发 500 | 百万 tokens |
| Kimi API | Kimi K2.7 Code | ¥6.5 | ¥27 | 缓存命中 ¥1.30;HighSpeed 为 ¥13/¥54 | 百万 tokens |
| Kimi API | Kimi K2.5 | ¥4 | ¥21 | 缓存命中 ¥0.70 | 百万 tokens |
| Kimi API | Moonshot V1 8K | ¥2 | ¥10 | V1 32K 为 ¥5/¥20,128K 为 ¥10/¥30 | 百万 tokens |
| MiniMax API | MiniMax-M3 ≤512k | ¥2.1 | ¥8.4 | 永久五折;缓存读 ¥0.42 | 百万 tokens |
| MiniMax API | MiniMax-M2.7 | ¥2.1 | ¥8.4 | 缓存读 ¥0.42、写 ¥2.625 | 百万 tokens |
| Gemini API | Gemini 3.5 Flash | $1.50 | $9 | 缓存 $0.15;Batch $0.75/$4.50 | 百万 tokens |
| Gemini API | Gemini 3.1 Pro ≤200K | $2 | $12 | >200K 为 $4/$18;Batch 约 50% | 百万 tokens |
| Claude API | Claude Opus 4.8 | $5 | $25 | 缓存命中 $0.50;Batch 约 50% | 百万 tokens |
| Claude API | Claude Sonnet 4.6 | $3 | $15 | 缓存命中 $0.30;1M 上下文 | 百万 tokens |
| Claude API | Claude Fable 5 / Haiku 4.5 入门价 | $1 | $5 | 源头 entryPrice 记录 $1/$5 | 百万 tokens |
| OpenRouter | gpt-4o-mini 参考 | $0.15 | $0.60 | 340+ 模型各不同价;Router 可能按底层模型累加 | 百万 tokens |
| OpenRouter | Free Models | $0 | $0 | 50/1000 次/天限制 | 请求次数 + token |
免费额度/免费档表
免费额度适合验证调用链路,不适合替代上线预算。下表区分 API 免费档、免费模型、试用 Credits 和页面未列明明确固定免费额度的厂商。
| 厂商 | 免费额度/免费档 | API 可用性 | 备注 |
|---|---|---|---|
| Gemini API | Free tier 对部分模型免费;Gemini 3 系 Grounding 5,000 次/月免费 | 可用于 AI Studio 免费调用,生产应 Paid | 内容可能用于产品改进 |
| OpenRouter | 免费模型 50 次/天;充值 $10+ 后 1000 次/天 | API 可用 | :free 模型和 openrouter/free 路由器 |
| 智谱 GLM API | GLM-4.7-Flash、GLM-4-Flash、GLM-4V-Flash、CogView-3-Flash 等免费模型 | API 可用 | 受平台速率与公平使用规则约束 |
| 通义千问 API | 新用户通常有免费额度 | API 可用,需控制台确认 | 有效期和模型共享规则不固定 |
| OpenRouter Credits | 新账号极少量试用 Credits | API / Chatroom 共用 | 页面未列明固定金额 |
| Claude API | 资料当前可核对的信息以按量计费为主,免费额度以页面更新为准 | - | API 按量计费,与订阅独立 |
| DeepSeek API | 资料当前可核对的信息以按量计费为主,免费额度以页面更新为准 | - | 可有赠送余额,但页面未列明固定额度 |
| 豆包 API | 资料当前可核对的信息以按量计费为主,免费额度以页面更新为准 | - | Batch 折扣不等于免费额度 |
| Kimi API | 资料当前可核对的信息以按量计费为主,免费额度以页面更新为准 | - | 文件抽取与存储接口限时免费,模型输入仍计费 |
| MiniMax API | 文本 API 资料当前可核对的信息以按量计费为主,免费额度以页面更新为准 | - | Music-2.6 与歌词生成当前标注限免 |
会员/订阅套餐价格表
订阅价格可以帮助判断人工使用成本,但不能直接用于 API 后端预算。Claude、Gemini、Kimi、GLM、MiniMax 等资料显示订阅和 API 独立或 Key 分离。
| 厂商 | 套餐 | 价格 | 额度摘要 | API 是否独立 |
|---|---|---|---|---|
| Claude | Pro / Max 5x / Max 20x / Team | $20/月;$100/月;$200/月;Team $20–125/席/月 | Claude Code、Cowork 与 claude.ai 共用订阅额度 | 是,Console API 单独按 token 计费 |
| Gemini | Google AI Plus / Pro / Ultra | $4.99/月;$19.99/月;$99.99 或 $199.99/月 | Plus 约 2×、Pro 约 4×、Ultra 最高约 20× Free | 是,ai.google.dev API 独立 |
| Kimi | Moderato / Allegretto / Allegro / Vivace | ¥49/月;¥99/月;¥199/月;¥699/月 | Kimi Code 1–60 倍,约 30–360 Agent/月 | 是,Kimi API 单独按 token 计费 |
| 智谱 GLM | Lite / Pro / Max / Team | ¥49/月;¥149/月;¥469/月;团队 ¥598/席/月起 | 个人按 prompt,团队按 seat token;含 MCP | 是,开放平台 API Key 分离 |
| MiniMax | Plus / Max / Ultra | ¥49/月;¥119/月;¥469/月 | 积分池共享文本、图像、语音、音乐等 | 是,订阅 Key 与按量 API Key 不可混用 |
| OpenRouter | Free / Credits | 免费;Credits 预充值 | 免费模型限制 + 充值余额按模型价扣费 | API 与 Chatroom 共用 Credits |
| DeepSeek | 官方无包月 Coding Plan | API 按量 | 从余额或赠送余额扣费 | 官方只有按量 API |
| 豆包 | Coding Plan 与 API 分离 | 源头 API 数据未列具体订阅价 | 订阅 Key 与 API Key 分离 | 是 |
| 通义千问 | Token Plan 团队版与 API 分离 | 源头 API 数据未列具体订阅价 | Credits 包月与工具内交互 | 是,DashScope API Key 独立 |
相关 TokenPlan 厂商详情
FAQ 常见问题
LLM API 单价最低的是哪类模型?
按资料中的代表低价档,豆包 Doubao-Seed-2.0-Mini ≤32K 输入 ¥0.2/M、输出 ¥2/M,通义 Qwen-Turbo 非思考输入 ¥0.3/M、输出 ¥0.6/M,智谱 GLM-4.5-Air <32K 输入 ¥0.8/M、输出 ¥2/M,DeepSeek-V4-Flash 输入 ¥1/M、输出 ¥2/M。
Claude API、Gemini API 和 Kimi API 价格怎么比?
Claude API 入门价源头记录为 $1/M 输入、$5/M 输出,Sonnet 4.6 为 $3/$15,Opus 4.8 为 $5/$25;Gemini 3.5 Flash 为 $1.50/$9;Kimi K2.7 Code 为缓存 ¥1.30、未命中输入 ¥6.50、输出 ¥27。币种和模型定位不同,不能只看数字大小。
API 价格表里的缓存命中价重要吗?
重要。DeepSeek、Kimi、MiniMax、智谱、Claude、Gemini、豆包等资料显示缓存或 Batch 折扣。长 system prompt、长对话历史和代码仓库上下文会让缓存命中率直接影响账单。
OpenRouter 的 API 价格是不是固定套餐?
不是。OpenRouter 套餐信息显示它通过 Credits 按量计费,340+ 模型按 provider 直透价扣费,gpt-4o-mini 参考价为 $0.15/M 输入、$0.60/M 输出;免费模型 API 默认 50 次/天。
哪些厂商资料当前可核对的信息以按量计费为主,免费额度以页面更新为准?
Claude、DeepSeek、豆包、Kimi、MiniMax 的 当前可核对的信息以按量计费为主,免费额度以页面更新为准。本文只写资料有记录的信息,不补写免费额度以页面更新为准。