← 返回首页
LLM APIAPI 价格大模型 API价格目录API key 申请

综合对比重点

本页不是单纯列价格,而是围绕 Token Plan、Coding Plan、价格对比、额度、额度重置、免费额度、优惠、官网入口、申请入口、Claude Code 平替和 Cursor 接入等搜索场景做综合整理。

LLM API 价格对比:Claude、Gemini、DeepSeek、通义、豆包、Kimi 单价表

本文根据 TokenPlan 整理 LLM API 价格。API 成本不能只看最低输入价,还要同时看输出价、缓存命中、Batch 折扣、上下文分档、免费模型限制和订阅是否与 API 独立。

TokenPlan 详情:

LLM API 横向价格表

横向表用于快速定位“哪个 API 便宜、哪个 API 适合生产、哪个 API 有免费档”。但 LLM API 的真实成本通常不是最低输入价决定的,而是输出长度、缓存命中率、Batch 是否可用、上下文是否跨档、模型是否路由到更贵供应商共同决定。

厂商代表模型/套餐输入价输出价免费档/免费额度适合场景
豆包 APIDoubao-Seed-2.0-Mini ≤32K¥0.2/M¥2/M资料当前可核对的信息以按量计费为主,免费额度以页面更新为准高吞吐轻量任务、成本敏感基础流量
通义千问 APIQwen-Turbo 非思考¥0.3/M¥0.6/M新用户通常有免费额度,需控制台确认轻量问答、批处理、默认路由层
智谱 GLM APIGLM-4.5-Air <32K¥0.8/M¥2/MGLM-4.7-Flash 等多款免费模型中文应用、MCP、低价文本/视觉测试
DeepSeek APIDeepSeek-V4-Flash¥1/M¥2/M资料当前可核对的信息以按量计费为主,免费额度以页面更新为准高频批量、自建后端、Agent 流水线
Kimi APIMoonshot V1 8K / K2.5¥2/M 起¥10/M 起资料当前可核对的信息以按量计费为主,免费额度以页面更新为准长文本、代码 Agent、Kimi 工具链
MiniMax APIMiniMax-M3 / M2.7¥2.1/M¥8.4/M资料当前可核对的信息以按量计费为主,免费额度以页面更新为准多模态 Agent、长上下文、语音视频扩展
Gemini APIGemini 3.5 Flash$1.50/M$9/MAI Studio Free tier 可免费调用部分模型搜索 grounding、Google 生态、快速 Agent
Claude APIClaude Sonnet 4.6$3/M$15/M资料当前可核对的信息以按量计费为主,免费额度以页面更新为准生产 Agent、代码改造、长上下文任务
OpenRouterPay-as-you-go Credits$0.15/M 参考$0.60/M 参考免费模型 50 次/天,充值 $10+ 后 1000 次/天多模型统一网关、fallback、路由比较

LLM API 价格不能只看输入价:输出价、缓存和 Batch 为什么重要

输入价只覆盖请求里的 prompt、上下文和工具返回内容。真实账单还要加输出 token,输出价通常高于输入价。代码生成、长回答、Agent 多轮调用、失败重试都会让输出成为主要成本。

缓存和 Batch 会改变同一模型的实际单价。DeepSeek-V4-Flash 缓存命中输入 ¥0.02/M,Kimi K2.5 缓存命中 ¥0.70/M,MiniMax-M3 缓存读 ¥0.42/M,Gemini 3.5 Flash Batch 输入 $0.75/M、输出 $4.50/M,Claude 和 Gemini 的资料也记录 Batch 约 50%。固定 system prompt、长项目上下文和离线批处理,都应该优先看这些折扣。

低价中文 API 怎么选:豆包、通义、智谱、DeepSeek 对比

低价中文 API 的代表低价档集中在豆包、通义、智谱和 DeepSeek。豆包 Doubao-Seed-2.0-Mini ≤32K 输入 ¥0.2/M、输出 ¥2/M,适合高吞吐轻量任务;通义 Qwen-Turbo 非思考输入 ¥0.3/M、输出 ¥0.6/M,适合轻量问答和批处理;智谱 GLM-4.5-Air <32K 输入 ¥0.8/M、输出 ¥2/M,并有多款免费模型;DeepSeek-V4-Flash 输入 ¥1/M、输出 ¥2/M,缓存命中输入 ¥0.02/M。

如果任务是分类、摘要、抽取、轻量客服,优先看输出价和吞吐。若任务带长 system prompt 或重复上下文,DeepSeek 的缓存命中价会更关键。若需要免费模型测试或中文视觉/文本混合验证,智谱 GLM 免费模型更适合起步。

Claude、Gemini、Kimi 这类高价模型适合什么任务

价格更高的模型通常用于更复杂的任务,而不是所有请求默认使用。Claude Sonnet 4.6 为 $3/M 输入、$15/M 输出,Opus 4.8 为 $5/M、$25/M;Gemini 3.5 Flash 为 $1.50/M、$9/M,Gemini 3.1 Pro ≤200K 为 $2/M、$12/M,>200K 为 $4/M、$18/M;Kimi K2.7 Code 未命中输入 ¥6.50/M、输出 ¥27/M,缓存命中 ¥1.30/M。

这些模型适合复杂代码改造、长上下文分析、多步 Agent、研究型任务和关键结果生成。低价值、高频、短文本请求应先用低价模型承接,再把复杂节点升级到 Claude、Gemini Pro、Kimi K2.7 Code 或 K2.6。

OpenRouter 多模型路由价格怎么理解

OpenRouter 不是固定套餐价。套餐信息显示它通过 Credits 按量计费,340+ 模型按 provider 直透价扣费,gpt-4o-mini 参考价为 $0.15/M 输入、$0.60/M 输出;免费模型 API 默认 50 次/天,充值 $10+ 后 1000 次/天。

使用 OpenRouter 时,账单取决于最终 model id 和 provider。Auto Router 会按 prompt 选择底层模型并按选中模型计费,Fusion Router 这类多模型模式可能按参与模型 token 消耗累加。生产系统需要记录实际模型、provider、输入输出 tokens 和 Credits 扣费,不能只按参考价估算全部请求。

Batch 半价、缓存命中和长上下文分档怎么影响账单

Batch 适合离线任务,例如批量摘要、标签生成、数据清洗、离线评测。套餐信息显示通义 Qwen-Turbo Batch 输入输出 50%,Gemini 3.5 Flash Batch 输入 $0.75/M、输出 $4.50/M,Gemini 3.1 Pro 支持约 50% Batch,Claude 也记录 Batch 约 50%。如果任务不要求实时返回,Batch 往往比换模型更直接。

缓存命中适合重复上下文,例如固定提示词、同一代码仓库、同一文档集合。长上下文分档会让超出阈值后的请求变贵,例如通义 Qwen3.7-Plus 0–256K 为 ¥2/M、¥12/M,Qwen3.7-Max 0–1M 为 ¥12/M、¥36/M;Gemini 3.1 Pro ≤200K 为 $2/M、$12/M,>200K 为 $4/M、$18/M。上线前要按真实上下文长度估算。

上线前怎么估算 LLM API 成本

上线前估算成本应按一次完整请求链路计算,而不是只看单次模型调用。先估算每次请求的输入 tokens、输出 tokens、工具返回内容、上下文长度、平均重试次数和 Agent 多轮次数,再乘以对应模型输入价与输出价。

如果系统有大量相同提示词或仓库上下文,要单独估算缓存命中率。如果任务可以异步处理,要估算 Batch 折扣。如果使用 OpenRouter,要记录实际底层模型。如果使用订阅产品做人工工作流,也不要把订阅额度折算成 API 成本。

API 单价/Token 价格表

下面保留源头单价表。单位均为每百万 tokens,币种按资料保留。表内“缓存/Batch/分档”列是估算账单时最容易被忽略的部分。

厂商模型输入价输出价缓存/Batch/分档计价单位
豆包 APIDoubao-Seed-2.0-Mini ≤32K¥0.2¥2更长上下文分档上浮;Batch 部分 Seed 模型约 50%百万 tokens
豆包 APIDoubao-Seed-2.0-Lite ≤32K¥0.6¥3.6缓存命中输入 ¥0.12百万 tokens
通义千问 APIQwen-Turbo 非思考¥0.3¥0.6思考模式输出 ¥3;Batch 输入输出 50%百万 tokens
通义千问 APIQwen3.7-Plus 0–256K¥2¥12更高上下文区间上浮;支持 Batch 与缓存百万 tokens
通义千问 APIQwen3.7-Max 0–1M¥12¥36单次请求按输入总量所在区间结算百万 tokens
智谱 GLM APIGLM-4.5-Air <32K¥0.8¥232K–128K 为 ¥1.2/¥8百万 tokens
智谱 GLM APIGLM-4.7 <32K 且输出 <20%¥2¥8输出占比 ≥20% 为 ¥3/¥14;32K–1M 为 ¥4/¥16百万 tokens
智谱 GLM APIGLM-5.2¥6 起¥24 起≥32K 为 ¥8/¥28;缓存命中 ¥1.3 起百万 tokens
DeepSeek APIDeepSeek-V4-Flash¥1¥2缓存命中输入 ¥0.02;并发 2500百万 tokens
DeepSeek APIDeepSeek-V4-Pro¥3¥6缓存命中输入 ¥0.025;并发 500百万 tokens
Kimi APIKimi K2.7 Code¥6.5¥27缓存命中 ¥1.30;HighSpeed 为 ¥13/¥54百万 tokens
Kimi APIKimi K2.5¥4¥21缓存命中 ¥0.70百万 tokens
Kimi APIMoonshot V1 8K¥2¥10V1 32K 为 ¥5/¥20,128K 为 ¥10/¥30百万 tokens
MiniMax APIMiniMax-M3 ≤512k¥2.1¥8.4永久五折;缓存读 ¥0.42百万 tokens
MiniMax APIMiniMax-M2.7¥2.1¥8.4缓存读 ¥0.42、写 ¥2.625百万 tokens
Gemini APIGemini 3.5 Flash$1.50$9缓存 $0.15;Batch $0.75/$4.50百万 tokens
Gemini APIGemini 3.1 Pro ≤200K$2$12>200K 为 $4/$18;Batch 约 50%百万 tokens
Claude APIClaude Opus 4.8$5$25缓存命中 $0.50;Batch 约 50%百万 tokens
Claude APIClaude Sonnet 4.6$3$15缓存命中 $0.30;1M 上下文百万 tokens
Claude APIClaude Fable 5 / Haiku 4.5 入门价$1$5源头 entryPrice 记录 $1/$5百万 tokens
OpenRoutergpt-4o-mini 参考$0.15$0.60340+ 模型各不同价;Router 可能按底层模型累加百万 tokens
OpenRouterFree Models$0$050/1000 次/天限制请求次数 + token

免费额度/免费档表

免费额度适合验证调用链路,不适合替代上线预算。下表区分 API 免费档、免费模型、试用 Credits 和页面未列明明确固定免费额度的厂商。

厂商免费额度/免费档API 可用性备注
Gemini APIFree tier 对部分模型免费;Gemini 3 系 Grounding 5,000 次/月免费可用于 AI Studio 免费调用,生产应 Paid内容可能用于产品改进
OpenRouter免费模型 50 次/天;充值 $10+ 后 1000 次/天API 可用:free 模型和 openrouter/free 路由器
智谱 GLM APIGLM-4.7-Flash、GLM-4-Flash、GLM-4V-Flash、CogView-3-Flash 等免费模型API 可用受平台速率与公平使用规则约束
通义千问 API新用户通常有免费额度API 可用,需控制台确认有效期和模型共享规则不固定
OpenRouter Credits新账号极少量试用 CreditsAPI / Chatroom 共用页面未列明固定金额
Claude API资料当前可核对的信息以按量计费为主,免费额度以页面更新为准-API 按量计费,与订阅独立
DeepSeek API资料当前可核对的信息以按量计费为主,免费额度以页面更新为准-可有赠送余额,但页面未列明固定额度
豆包 API资料当前可核对的信息以按量计费为主,免费额度以页面更新为准-Batch 折扣不等于免费额度
Kimi API资料当前可核对的信息以按量计费为主,免费额度以页面更新为准-文件抽取与存储接口限时免费,模型输入仍计费
MiniMax API文本 API 资料当前可核对的信息以按量计费为主,免费额度以页面更新为准-Music-2.6 与歌词生成当前标注限免

会员/订阅套餐价格表

订阅价格可以帮助判断人工使用成本,但不能直接用于 API 后端预算。Claude、Gemini、Kimi、GLM、MiniMax 等资料显示订阅和 API 独立或 Key 分离。

厂商套餐价格额度摘要API 是否独立
ClaudePro / Max 5x / Max 20x / Team$20/月;$100/月;$200/月;Team $20–125/席/月Claude Code、Cowork 与 claude.ai 共用订阅额度是,Console API 单独按 token 计费
GeminiGoogle AI Plus / Pro / Ultra$4.99/月;$19.99/月;$99.99 或 $199.99/月Plus 约 2×、Pro 约 4×、Ultra 最高约 20× Free是,ai.google.dev API 独立
KimiModerato / Allegretto / Allegro / Vivace¥49/月;¥99/月;¥199/月;¥699/月Kimi Code 1–60 倍,约 30–360 Agent/月是,Kimi API 单独按 token 计费
智谱 GLMLite / Pro / Max / Team¥49/月;¥149/月;¥469/月;团队 ¥598/席/月起个人按 prompt,团队按 seat token;含 MCP是,开放平台 API Key 分离
MiniMaxPlus / Max / Ultra¥49/月;¥119/月;¥469/月积分池共享文本、图像、语音、音乐等是,订阅 Key 与按量 API Key 不可混用
OpenRouterFree / Credits免费;Credits 预充值免费模型限制 + 充值余额按模型价扣费API 与 Chatroom 共用 Credits
DeepSeek官方无包月 Coding PlanAPI 按量从余额或赠送余额扣费官方只有按量 API
豆包Coding Plan 与 API 分离源头 API 数据未列具体订阅价订阅 Key 与 API Key 分离
通义千问Token Plan 团队版与 API 分离源头 API 数据未列具体订阅价Credits 包月与工具内交互是,DashScope API Key 独立

相关 TokenPlan 厂商详情

TokenPlan 主站:

FAQ 常见问题

LLM API 单价最低的是哪类模型?

按资料中的代表低价档,豆包 Doubao-Seed-2.0-Mini ≤32K 输入 ¥0.2/M、输出 ¥2/M,通义 Qwen-Turbo 非思考输入 ¥0.3/M、输出 ¥0.6/M,智谱 GLM-4.5-Air <32K 输入 ¥0.8/M、输出 ¥2/M,DeepSeek-V4-Flash 输入 ¥1/M、输出 ¥2/M。

Claude API、Gemini API 和 Kimi API 价格怎么比?

Claude API 入门价源头记录为 $1/M 输入、$5/M 输出,Sonnet 4.6 为 $3/$15,Opus 4.8 为 $5/$25;Gemini 3.5 Flash 为 $1.50/$9;Kimi K2.7 Code 为缓存 ¥1.30、未命中输入 ¥6.50、输出 ¥27。币种和模型定位不同,不能只看数字大小。

API 价格表里的缓存命中价重要吗?

重要。DeepSeek、Kimi、MiniMax、智谱、Claude、Gemini、豆包等资料显示缓存或 Batch 折扣。长 system prompt、长对话历史和代码仓库上下文会让缓存命中率直接影响账单。

OpenRouter 的 API 价格是不是固定套餐?

不是。OpenRouter 套餐信息显示它通过 Credits 按量计费,340+ 模型按 provider 直透价扣费,gpt-4o-mini 参考价为 $0.15/M 输入、$0.60/M 输出;免费模型 API 默认 50 次/天。

哪些厂商资料当前可核对的信息以按量计费为主,免费额度以页面更新为准?

Claude、DeepSeek、豆包、Kimi、MiniMax 的 当前可核对的信息以按量计费为主,免费额度以页面更新为准。本文只写资料有记录的信息,不补写免费额度以页面更新为准。