自分の使用量で AI サブスクリプションと従量課金 API を比較します。サブスクリプションは token ではなく時間ウィンドウ単位の課金なので、正確な損益分岐点は存在しません。結果は範囲で示し、キャッシュ感度と各プランの確認日を併記します。
チャットでは約 1 回。エージェントは計画・検索・ツール呼び出し・要約を行うため、1 プロンプトで 5〜30 回の呼び出しが発生します。token 単価が安いモデルでもタスク単価では高くなるのはこのためです。
一次提供元の表示価格で、一次提供元のサブスクと同種の比較対象になります。
この使用量ならおよそ月 4,800 回のモデル呼び出しです。
この枠は、同じ量を API で買うより約 100% 安いです。
GPT-5.6 Terra と左側のプロファイルに基づく計算です。キャッシュ書き込み料金は含まないため、実際の API 費用はやや高くなります。
この枠は、同じ量を API で買うより約 99% 安いです。
公式の枠には数値が公開されていない別の上限も含まれるため、このキャパシティと上の割引率はいずれも過大評価です。
Claude Sonnet 5 と左側のプロファイルに基づく計算です。キャッシュ書き込み料金は含まないため、実際の API 費用はやや高くなります。
この枠は、同じ量を API で買うより約 99% 安いです。
Claude Fable 5.1 と左側のプロファイルに基づく計算です。キャッシュ書き込み料金は含まないため、実際の API 費用はやや高くなります。
費用の範囲はキャッシュヒット率の不確実性(±15 ポイント)から、キャパシティの範囲は各ウィンドウ枠の保守的/楽観的な読み方から出ています。サブスクの枠は時間ウィンドウであり固定の token 数に還元できないため、損益分岐点は点ではなく領域です。
1 日未満のローリングウィンドウは、月あたり 176 稼働時間(8 時間 × 22 日)を仮定して換算します。日次・週次・月次の上限はカレンダーウィンドウなので割り引きません。
絶対値の枠が公開されていない、またはモデル呼び出し数に換算できない単位で課金されるプランです。数字を当てはめず、そのまま列挙しています。