TokHub 成本预估与 AI API 月成本估算
本页按每日请求数、平均输入输出 Token 和缓存命中率预估月度账单,并汇总主流 AI 模型的官方输入价、输出价、缓存读价和上下文窗口,用于在接入中转站前先做成本基准判断。
模型成本预估
首屏工作台模块用于输入每日请求量、平均输入 Token、平均输出 Token 和缓存命中率,并即时估算 30 天账单。
价格数据范围
- 覆盖供应商
- OpenAI、Anthropic、Google、xAI、Mistral、DeepSeek、Cohere
- 价格单位
- USD / 1M tokens
- 估算周期
- 30 天
- 核对时间
- 2026-06-26
AI 摘要要点
- 本页是模型成本预估工作台,不是网关调用接口,适合比较模型价格和估算月度 Token 成本。
- 价格维度包括供应商、模型、模型类型、输入价、输出价、缓存读价、上下文窗口、最大输出和官方来源。
- 成本估算按每日请求数、平均输入 Token、平均输出 Token、缓存命中率和 30 天周期计算。
成本估算参数
- 快速场景:代码 Agent、RAG 问答、批量分类、长文总结。
- 参数输入:每日请求数、平均输入 Token、平均输出 Token、缓存命中率。
- 筛选条件:供应商、模型类型、模型或用途关键词。
当前成本结果
结果模块展示当前参数下的预估月成本、输入成本、输出成本、缓存读成本和低价候选模型,帮助用户在进入官方价格表前先形成预算范围。
覆盖供应商
- OpenAI
- Anthropic
- Google
- xAI
- Mistral
- DeepSeek
- Cohere
官方价格表
官方价格表模块按 per 1M tokens 展示模型、类型、输入价、输出价、缓存读、上下文窗口、最大输出、估算月成本、价格指数和官方来源。
| 供应商 | 模型 | 类型 | 输入价 | 输出价 | 缓存读 | 上下文 | 来源 |
|---|
| OpenAI | GPT-4.1 | 旗舰 | $2 | $8 | $0.5 | 1M | 官方价格 |
| OpenAI | GPT-4.1 mini | 均衡 | $0.4 | $1.6 | $0.1 | 1M | 官方价格 |
| Anthropic | Claude Sonnet 4.5 | 均衡 | $3 | $15 | $0.3 | 200K | 官方价格 |
| Google | Gemini 3.5 Flash | 均衡 | $1.5 | $9 | $0.15 | 1M | 官方价格 |
| xAI | Grok 4.3 | 旗舰 | $1.25 | $2.5 | 未公开 | 256K | 官方价格 |
| Mistral | Mistral Large | 旗舰 | $2 | $6 | 未公开 | 128K | 官方价格 |
| DeepSeek | DeepSeek Chat | 低价 | $0.27 | $1.1 | $0.07 | 64K | 官方价格 |
| Cohere | Command A | 企业 | $2.5 | $10 | 未公开 | 256K | 官方价格 |
表格筛选
表格筛选模块提供供应商、模型类型和关键词筛选,方便搜索引擎理解页面支持按模型、厂商和用途定位价格信息。
价格排行
- 当前场景低价优先:按当前 Token 参数排序。
- 旗舰模型成本对比:对比高能力模型的月成本。
- 高频任务候选:筛选适合批量分类、抽取、路由等任务的低价模型。
典型估算场景
- 代码 Agent:多轮上下文、工具调用和中等输出
- RAG 问答:输入较长、输出稳定
- 批量分类:高频短输入短输出
- 长文总结:长输入、中等输出并受缓存影响
读表口径
输入价、输出价、缓存读价均按 USD / 1M tokens 展示。页面估算不含税、最低消费、区域价、搜索、工具、图片等附加费用,正式接入前应回到供应商官网核对最新条款。
官方来源
官方来源模块记录各供应商价格页链接和最后核对时间,第一版为静态数据,后续建议由后台维护来源 URL 和生效时间。