更新日期:2026-06-06
模型官方定价方式
本文只解释上游厂商的官方计费口径,不等同于 Crazyrouter 的实际售价。- 上游官方口径:厂商自己的
input、output、cached input、tool call、search grounding、prompt caching等收费方式 - Crazyrouter 口径:本站自己的售价、倍率、折扣、渠道差异与结算方式
本页按
2026-04-27 查询到的厂商官方文档整理。厂商会改价,也会调整预览模型、长上下文、搜索工具和缓存规则;上线前请再点官方链接核对一次。官方单价示例表
以下示例只取各厂商最常见、最容易和业务预算直接对应的一档:- Anthropic:标准 API 价,不含
Fast mode、US-only inference乘数和 Batch 折扣 - OpenAI:
Standard价,不含 Batch、Priority、Regional Processing 加价 - Gemini:
Standard价,默认按文本 / 图像 / 视频输入,且对Gemini 3*取<= 200K prompt档 - xAI:若站内路由名没有公开静态单列价,本表会明确写成“未单列”
- Z.AI:取官方
Text Models价 - MiniMax:主表取
Pay as You Go,订阅制单独列Token Plan
除特别标注外,下表金额默认都是
USD / 1M tokens。Anthropic 示例单价
OpenAI 示例单价
Gemini 示例单价
xAI 示例单价
xAI 当前公开静态文档能稳定核到的是 token 分类规则、tool invocation 费用、Batch
5 折 与“到模型详情页或 console 查看具体 per-model token price”。由于 grok-4.1 / grok-4.1-fast 在静态文档里未单列价格,本页不把其他 SKU 的数字硬套给它们。Z.AI / GLM 示例单价
MiniMax 示例单价
Pay as You Go
Token Plan
Anthropic
Anthropic 这组模型的官方计费方式不是简单的input / output 两栏,而是拆成:
Base Input Tokens5m Cache Writes1h Cache WritesCache Hits & RefreshesOutput Tokens
Batch API输入和输出通常按标准价5 折- Prompt caching 的公开倍数规则是:
5 分钟写缓存 = 1.25x input、1 小时写缓存 = 2x input、读缓存 = 0.1x input
官方链接:
- Anthropic Pricing: platform.claude.com/docs/en/about-claude/pricing
- Anthropic Models Overview: platform.claude.com/docs/en/about-claude/models/overview
OpenAI
OpenAI 这组文本模型的官方公开口径最统一,核心都是:InputCached inputOutput
Responses API本身不单独加价,仍按所选模型的 token 单价计费Web search、容器/代码执行、Computer Use 等工具按工具收费,不包含在纯 token 单价里Batch API输入和输出通常按标准价5 折
官方链接:
- OpenAI Pricing: openai.com/api/pricing
- OpenAI Docs Pricing: platform.openai.com/docs/pricing
- OpenAI Models: developers.openai.com/api/docs/models
Google Gemini
Gemini 的官方计费方式与前两家差别最大,通常不只一个标准价,而是同时给出:StandardBatchFlexPriority
InputOutput (including thinking tokens)Context caching priceContext caching storageGrounding with Google SearchGrounding with Google Maps
官方链接:
- Gemini Pricing: ai.google.dev/gemini-api/docs/pricing
- Gemini Models: ai.google.dev/models/gemini
xAI Grok
xAI 的官方规则重点不是“thinking 模型有没有另一张价格表”,而是把 token 和工具拆开:Prompt tokensCached prompt tokensCompletion tokensReasoning tokens
Reasoning tokens按completion token price收费Web Search、X Search、Code Execution、Collections Search等 server-side tools 按每 1000 次调用单独收费Batch API对 token 类费用通常是5 折
官方链接:
- xAI Models and Pricing: docs.x.ai/developers/models
- xAI Consumption and Rate Limits: docs.x.ai/developers/rate-limits
- xAI Prompt Caching Pricing: docs.x.ai/developers/advanced-api-usage/prompt-caching/usage-and-pricing
Z.AI / GLM
Z.AI 的GLM-5 官方口径和 OpenAI 类似,但又多了一项缓存存储费:
InputCached InputCached Input StorageOutput
Web Search 会按使用次数单独收费。
官方链接:
- Z.AI Pricing: docs.z.ai/guides/overview/pricing
- GLM-5 Overview: docs.z.ai/guides/llm/glm-5
MiniMax
MiniMax 这组模型要先区分两种官方售卖方式:Pay as You GoToken Plan
Pay as You Go是标准 API 按量计费Token Plan是订阅制,M2.7按5 小时滚动窗口的请求额度计,不是单纯按 token 结算
官方链接:
- MiniMax Pricing Overview: platform.minimax.io/docs/pricing/overview
- MiniMax Pay as You Go: platform.minimax.io/docs/guides/pricing-paygo
- MiniMax Token Plan: platform.minimax.io/docs/guides/pricing-token-plan
结论
如果你只是想快速判断“官方到底按什么收费”,可以直接记这几类:- Anthropic:
base input + cache write/read + output - OpenAI:
input + cached input + output,工具另计 - Gemini:
多处理模式 + input/output + caching + search/maps grounding - xAI:
prompt/cached/completion/reasoning,server-side tools 另计 - Z.AI:
input + cached input + cached storage + output - MiniMax:
按量 token或订阅额度两套并存