Skip to main content
更新日期:2026-06-06

模型官方定价方式

本文只解释上游厂商的官方计费口径,不等同于 Crazyrouter 的实际售价。
  • 上游官方口径:厂商自己的 inputoutputcached inputtool callsearch groundingprompt caching 等收费方式
  • Crazyrouter 口径:本站自己的售价、倍率、折扣、渠道差异与结算方式
本页按 2026-04-27 查询到的厂商官方文档整理。厂商会改价,也会调整预览模型、长上下文、搜索工具和缓存规则;上线前请再点官方链接核对一次。

官方单价示例表

以下示例只取各厂商最常见、最容易和业务预算直接对应的一档:
  • Anthropic:标准 API 价,不含 Fast modeUS-only inference 乘数和 Batch 折扣
  • OpenAI:Standard 价,不含 Batch、Priority、Regional Processing 加价
  • Gemini:Standard 价,默认按文本 / 图像 / 视频输入,且对 Gemini 3*<= 200K prompt
  • xAI:若站内路由名没有公开静态单列价,本表会明确写成“未单列”
  • Z.AI:取官方 Text Models
  • MiniMax:主表取 Pay as You Go,订阅制单独列 Token Plan
除特别标注外,下表金额默认都是 USD / 1M tokens

Anthropic 示例单价

OpenAI 示例单价

Gemini 示例单价

xAI 示例单价

xAI 当前公开静态文档能稳定核到的是 token 分类规则、tool invocation 费用、Batch 5 折 与“到模型详情页或 console 查看具体 per-model token price”。由于 grok-4.1 / grok-4.1-fast 在静态文档里未单列价格,本页不把其他 SKU 的数字硬套给它们。

Z.AI / GLM 示例单价

MiniMax 示例单价

Pay as You Go

Token Plan

Anthropic

Anthropic 这组模型的官方计费方式不是简单的 input / output 两栏,而是拆成:
  • Base Input Tokens
  • 5m Cache Writes
  • 1h Cache Writes
  • Cache Hits & Refreshes
  • Output Tokens
同时还有两条共通规则:
  • Batch API 输入和输出通常按标准价 5 折
  • Prompt caching 的公开倍数规则是:5 分钟写缓存 = 1.25x input1 小时写缓存 = 2x input读缓存 = 0.1x input
官方链接:

OpenAI

OpenAI 这组文本模型的官方公开口径最统一,核心都是:
  • Input
  • Cached input
  • Output
额外规则通常是:
  • Responses API 本身不单独加价,仍按所选模型的 token 单价计费
  • Web search、容器/代码执行、Computer Use 等工具按工具收费,不包含在纯 token 单价里
  • Batch API 输入和输出通常按标准价 5 折
官方链接:

Google Gemini

Gemini 的官方计费方式与前两家差别最大,通常不只一个标准价,而是同时给出:
  • Standard
  • Batch
  • Flex
  • Priority
并且会单独列出:
  • Input
  • Output (including thinking tokens)
  • Context caching price
  • Context caching storage
  • Grounding with Google Search
  • Grounding with Google Maps
官方链接:

xAI Grok

xAI 的官方规则重点不是“thinking 模型有没有另一张价格表”,而是把 token 和工具拆开:
  • Prompt tokens
  • Cached prompt tokens
  • Completion tokens
  • Reasoning tokens
xAI 官方还特别说明:
  • Reasoning tokenscompletion token price 收费
  • Web SearchX SearchCode ExecutionCollections Search 等 server-side tools 按 每 1000 次调用 单独收费
  • Batch API 对 token 类费用通常是 5 折
官方链接:

Z.AI / GLM

Z.AI 的 GLM-5 官方口径和 OpenAI 类似,但又多了一项缓存存储费:
  • Input
  • Cached Input
  • Cached Input Storage
  • Output
同时内置工具如 Web Search 会按使用次数单独收费。 官方链接:

MiniMax

MiniMax 这组模型要先区分两种官方售卖方式:
  • Pay as You Go
  • Token Plan
其中:
  • Pay as You Go 是标准 API 按量计费
  • Token Plan 是订阅制,M2.75 小时滚动窗口的请求额度 计,不是单纯按 token 结算
官方链接:

结论

如果你只是想快速判断“官方到底按什么收费”,可以直接记这几类:
  • Anthropic:base input + cache write/read + output
  • OpenAI:input + cached input + output,工具另计
  • Gemini:多处理模式 + input/output + caching + search/maps grounding
  • xAI:prompt/cached/completion/reasoning,server-side tools 另计
  • Z.AI:input + cached input + cached storage + output
  • MiniMax:按量 token订阅额度 两套并存
本页解释的是“上游官方定价方式”,不是 Crazyrouter 对外售卖价格。实际充值、扣费、倍率和优惠,请以 Crazyrouter 站内 pricing、控制台和 /api/pricing 返回为准。

站内相关页面