购买余额时真正要看的数字
购买 LLMFly AI 余额时,以模型广场显示的当前价格为准,而不是上面的厂商参考价。随后发送一个小请求,在估算月度费用前核对用量记录。
价格说明
这里至少有三种不同的数字:模型厂商公开价、LLMFly AI 当前价格或计费倍率,以及用量记录中的实际扣费。把它们混在一起,预算就会失真。
从 3 个分组、24 个模型中筛选。所有金额均为每 100 万 Token 的美元价格。
当前显示 6 个模型
70% 优惠 · 计费倍率 0.3x
| 模型 / 计费层级 | LLMFly AI | 官方价格 | 比官方节省 / 1M |
|---|---|---|---|
| codex-auto-review≤272K / >272K · 整个请求 | ≤272K 输入$0.06输出$0.36缓存写入$0.075缓存读取$0.006 >272K 输入$0.12输出$0.54缓存写入$0.15缓存读取$0.012 | ≤272K 输入$0.2输出$1.2缓存写入$0.25缓存读取$0.02 >272K 输入$0.4输出$1.8缓存写入$0.5缓存读取$0.04 | 70% OFF ≤272K输入 省 $0.14输出 省 $0.84写入 省 $0.175读取 省 $0.014 >272K输入 省 $0.28输出 省 $1.26写入 省 $0.35读取 省 $0.028 |
| gpt-5.4标准 | 输入$0.75输出$4.5缓存写入—缓存读取$0.075 | 输入$2.5输出$15缓存写入—缓存读取$0.25 | 70% OFF 输入 省 $1.75输出 省 $10.5读取 省 $0.175 |
| gpt-5.4-mini标准 | 输入$0.225输出$1.35缓存写入—缓存读取$0.0225 | 输入$0.75输出$4.5缓存写入—缓存读取$0.075 | 70% OFF 输入 省 $0.525输出 省 $3.15读取 省 $0.0525 |
| gpt-5.5标准 | 输入$1.5输出$9缓存写入—缓存读取$0.15 | 输入$5输出$30缓存写入—缓存读取$0.5 | 70% OFF 输入 省 $3.5输出 省 $21读取 省 $0.35 |
| gpt-5.6-sol≤272K / >272K · 整个请求 | ≤272K 输入$1.5输出$9缓存写入$1.875缓存读取$0.15 >272K 输入$3输出$13.5缓存写入$3.75缓存读取$0.3 | ≤272K 输入$5输出$30缓存写入$6.25缓存读取$0.5 >272K 输入$10输出$45缓存写入$12.5缓存读取$1 | 70% OFF ≤272K输入 省 $3.5输出 省 $21写入 省 $4.375读取 省 $0.35 >272K输入 省 $7输出 省 $31.5写入 省 $8.75读取 省 $0.7 |
| gpt-5.6-terra≤272K / >272K · 整个请求 | ≤272K 输入$0.6输出$3.6缓存写入$0.75缓存读取$0.06 >272K 输入$1.2输出$5.4缓存写入$1.5缓存读取$0.12 | ≤272K 输入$2输出$12缓存写入$2.5缓存读取$0.2 >272K 输入$4输出$18缓存写入$5缓存读取$0.4 | 70% OFF ≤272K输入 省 $1.4输出 省 $8.4写入 省 $1.75读取 省 $0.14 >272K输入 省 $2.8输出 省 $12.6写入 省 $3.5读取 省 $0.28 |
购买 LLMFly AI 余额时,以模型广场显示的当前价格为准,而不是上面的厂商参考价。随后发送一个小请求,在估算月度费用前核对用量记录。
月成本 =
输入 Token / 1,000,000 × 输入费率 +
输出 Token / 1,000,000 × 输出费率 +
缓存与工具费用 + 重试费用不等于。厂商价只是参考,实际费用以模型广场和用量记录为准。
便宜的 Token 如果需要更多重试、更长上下文或人工修正,最终结果可能更贵。
打开模型广场,查看当前 API Key 可用模型的价格和计费倍率。
先在模型广场查看价格,再用一条请求核对用量记录。