分组与计价说明
本页解释两件事:
- 模型怎么计费
- 为什么有“分组倍率”,以及该怎么选分组更省钱
计费说明
什么是 Token?
Token 是模型处理文本的基本单位。粗略理解:
- 1 个英文单词 ≈ 1-2 tokens
- 1 个中文字符 ≈ 1.5-2 tokens
如何计费?
费用 = (输入tokens × 输入价格 + 输出tokens × 输出价格) × 分组倍率
示例:
- 输入:500 tokens
- 输出:300 tokens
- 模型:Claude 模型(输入 ¥2/M,输出 ¥10/M)
- 分组:Claude-Mixed
- 费用:(500 × 2 + 300 × 10) / 1,000,000 × 0.5 = ¥0.002
分组说明
闪电API提供多种令牌分组,每种分组有不同的特性和计费倍率:
| 分组名称 | 倍率 | 特性说明 |
|---|---|---|
| Claude-Mixed | 0.5x | Kiro 号池,1M 上下文,90% 以上缓存,可用于养虾及常见 Claude 客户端 |
| ClaudeCode专用版 | 1.4x | Claude Code MAX 订阅号池,仅用于 Claude Code;该分组不做公开探针 |
| ClaudeMax外接版 | 1.4x | Claude Code MAX 订阅号池,可在其他兼容客户端中使用 |
| Claude逆向-Kiro-特价版 | 0.35x | Kiro Bug 号池限时特惠,1M 上下文,80% 以上缓存 |
| Codex-GPT | 0.3x | Codex PRO 号池,支持 Codex 桌面端、CLI 和养虾,稳定优选 |
| GPT | 0.2x | Codex Plus/Team 号池,支持 Codex 桌面端、CLI 和养虾,价格更低但稳定性优先级较低 |
| 图片视频专用分组 | 2x | GPT 图片与视频模型,图片按次、视频按秒计费 |
| Gemini | 2x | Gemini 文本与图片生成资源,资源不足时可重试或切换模型 |
| Gemini-CLI | 0.4x | Gemini AntiGravity/CLI 文本资源,高并发 |
| Grok | 0.3x | SuperGrok 会员号池,适合 Grok 编码模型 |
分组选择建议
- Codex 编程/养虾:优先
Codex-GPT;更看重价格时可选择GPT - Claude Code:使用
ClaudeCode专用版;其他客户端不要选择这个专用分组 - 其他 Claude 客户端:选择
Claude-Mixed、ClaudeMax外接版或特价分组 - Gemini 文本任务:优先
Gemini-CLI;需要图片生成时使用Gemini - 图片/视频生成:选择
图片视频专用分组
分组与模型会随官网资源变化。创建令牌前,建议先到实时定价页确认当前可用模型和价格。
模型定价
最新价格请查看:Flash API 实时定价
具体的价格信息请访问官网查看最新定价。
节省成本的技巧
1. 选择合适的模型
- 简单任务:Claude haiku
- 复杂任务:
gpt-5.6-sol或 Claude Sonnet - 最高质量:
claude-opus-5
使用小技巧:复杂规划可以交给 claude-opus-5,代码实现优先使用 gpt-5.6-sol。最终费用仍由模型原价、输入输出 Token 和所选分组倍率共同决定。
2. 优化使用方式
- 控制输出长度:让工具少输出一点
- 提示词更具体:减少反复来回
- 能复用上下文就复用:减少重复输入(在模型对应工具中使用,命中上下文缓存内容,计费价格仅为输入价格的10% - 20%)
3. 费用监控
控制台一般会提供:
- 当前余额
- 今日/本月消费
- 分组使用统计
- 模型使用分布
常见问题
Q: 如何选择合适的分组?
A: Codex 桌面端、CLI 和养虾优先 Codex-GPT;Claude Code 使用 ClaudeCode专用版;其他 Claude 客户端优先 Claude-Mixed 或 ClaudeMax外接版。需要最低价时,也要同时考虑线路稳定性和缓存命中率。
Q: ClaudeCode专用版只能在 Claude Code 工具中使用吗?
A: 是。这个分组依赖 Claude Code 的调用方式,不能作为通用探针或普通兼容接口使用。其他客户端请选择 ClaudeMax外接版 或 Claude-Mixed。