按你的用量权衡 AI 订阅与按量付费 API。订阅按时间窗口计费而非按 token,因此不存在精确的盈亏平衡点:结果以区间给出,并附缓存敏感度与每个套餐的核对日期。
对话约为 1。Agent 要规划、检索、调工具、执行、总结,一个 prompt 常触发 5–30 次调用。这就是每 token 单价低的模型、每个任务仍可能很贵的原因。
第一方牌价,与第一方订阅属同类可比的替代方案。
这个用量下约 4,800 次模型调用 / 月。
这份额度比按 API 买同等用量便宜约 100%。
基于 GPT-5.6 Terra 与左侧画像计算。未计入缓存写入费用,实际 API 成本略高于此。
这份额度比按 API 买同等用量便宜约 99%。
官方口径里还有未公开具体数字的额外上限,因此这里的容量和上面的折扣都是高估值。
基于 Claude Sonnet 5 与左侧画像计算。未计入缓存写入费用,实际 API 成本略高于此。
这份额度比按 API 买同等用量便宜约 99%。
基于 Claude Fable 5.1 与左侧画像计算。未计入缓存写入费用,实际 API 成本略高于此。
成本区间来自缓存命中的不确定带(±15 个百分点);容量区间来自对窗口额度的保守/乐观两种读法。盈亏平衡是一个区域而不是一个点,因为订阅额度按时间窗口计,折不成固定的 token 数。
短于一天的滚动窗按每月 176 个活跃小时(8 小时 × 22 天)折算;日/周/月额度属日历窗口,不打折。
这些套餐没有公布绝对额度,或计价单位无法折算成模型调用次数。这里如实列出,而不是给一个编造的数字。