API(外部からAIを呼び出す仕組み)の従量課金で組んだ問い合わせボットや文書処理は、動かすたびにトークン単価がそのまま請求に乗ります。「便利なのはわかったが、月の請求が読めないから本番に載せられない」。中小の現場でいちばん多いブレーキがこれです。その単価が2026年8月21日に一段下がりました。しかも、ずっと安いままではありません。

OpenAI が主力の中位モデル GPT-5.6 Sol の API 料金を20%超引き下げると発表しました(OpenAI Developer Community・発表本体)。恒久値下げではなく、少なくとも2026年11月21日まで、およそ3か月の期間限定価格です。この3か月をどう使うか、ククルデザインの費用設計の目線で整理します。

何が、どれだけ下がったのか

料金の下げ幅が項目ごとに違うことを示す概念図。大小の下向き矢印が横に並び、出力にあたる中央の矢印がいちばん長く下を向く。全体をサンセットオレンジの濃淡でまとめた暖色のグラデーション。文字や数字は描かない。

「一律20%オフ」と読むと外します。項目ごとに下げ幅が違うからです。100万トークンあたりで見ると、入力は $5 から $4(-20%)、出力は $30 から $20(約-33%)、キャッシュ入力は $0.50 から $0.40(-20%)。下がり方がいちばん大きいのは出力側です。

この差は費用設計に効きます。長い指示を投げて短く答えさせる用途(分類・要約・タグ付け)は入力が重いので恩恵は控えめ。逆に、下書き生成や長文の回答を返す用途は出力が重いので、今回の3割引きがそのまま効きます。自社の処理が入力寄りか出力寄りかで、下がり幅の実感は変わります。

入力 $5→$4/出力 $30→$20/キャッシュ入力 $0.50→$0.40(いずれも100万トークンあたり・2026年8月時点)。数字はOpenAI 公式のモデルページで最新を確認してから見積もりに使ってください。

安くなった範囲を取り違えない

ここが中小読者にいちばん誤解されやすいところです。今回の値下げが効くのは API と、ChatGPT Work・Codex クレジットです。ただし後者2つは「対象となるプランへ順次提供中」で、契約プランによっては対象外の場合があります。適用されるかは自社の契約で確認してください。ChatGPT の Plus・Pro・Business といった月額サブスクの料金は据え置きです。

つまり「ChatGPT の有料プランが安くなった」わけではありません。恩恵を受けるのは、自社のシステムや自動化にAPIを組み込んで従量で使っている場合です。社内で ChatGPT の画面を開いて使うだけなら、今回の改定で払う額は変わりません。この線引きを取り違えると、来ない請求減を前提に予算を組むことになります。

中小の従量課金に、なぜ効くのか

従量課金のイメージを表す概念図。細い管の中をたくさんの小さな粒が流れ、その先で歯車のような処理装置が回り続ける。管が太くなって流れがスムーズになる様子を、サンセットオレンジの濃淡で描く。文字や数字は入れない。

API 従量課金は、使った分だけ積み上がります。だからランニングコストがそのまま単価に連動します。問い合わせ自動応答、メールや議事録の下書き、大量ファイルのバッチ処理。この手の「回すほど請求が伸びる」仕組みは、単価が2割から3割下がれば月次の請求もそのまま軽くなります。

効いてくるのは、これまで単価が高くて見送っていた処理です。「全メールを自動で一次仕分けしたいが、量が多くて単価的に厳しい」といった案件は、出力の3割引きで採算ラインをまたぐことがあります。値下げ期間中に、いったん試算をやり直す価値があります。

もうひとつの使い道が二層運用です。判断が要る処理は上位モデルへ、定型の下ごしらえは安いモデルへと振り分ける組み方です。GPT-5.6 Sol の単価が下がったことで、中位モデルに任せられる範囲が広がりました。全部を最上位モデルで回して請求に驚くより、処理ごとに置き場所を分けるほうが月額は読めます。

この3か月でやること

砂時計と、二つの棚へ荷物を振り分ける仕分けの様子を組み合わせた概念図。限られた時間のうちに処理を試算して置き場所を分ける動きを、サンセットオレンジ基調で表現する。文字や数字は描かない。

期間限定なので、動く順番が普段と逆になります。「導入すべきか」をじっくり議論するより先に、今の単価で費用を測ってしまう。判断の材料を、安いうちに集めておく発想です。

  1. いちばん量の多い処理を1つ選び、直近1か月の呼び出し回数とトークン量をログから拾う
  2. 新単価(入力 $4/出力 $20)で月額を試算し、これまでの見送り理由が消えるか確認する
  3. 採算が合いそうなら、本番ではなく小さな試作(PoC)で2週間だけ動かして実測する
  4. 実測値で、上位モデルに残す処理と中位モデルへ回す処理を2枚に仕分ける

3か月あれば、測って試して仕分けるところまで回せます。公式が明言しているのは「少なくとも11月21日まで」で、その先の価格は未定です。プロモが終わって単価が上がっても採算が合うか、その一点を通常価格で試算して先に確かめておけば、いつ価格が動いても慌てません。

正直に言うと

浮かれて先走ると損をする点を3つ。

  • 期間限定価格です。公式が示すのは「少なくとも11月21日まで」で、その先の単価は未定。この安い単価が続く前提でコストを組まず、通常価格でも回るかを先に確認してください。
  • 安くなったのは中位モデルの単価であって、精度が上がったわけではありません。自社のタスク10件ほどで出力の質を測り、使えるかを判断してから本番に載せます。
  • 値下げの背景には Anthropic の Claude Opus 5 など競合との価格競争があり(報道)、単価は今後も動きます。特定モデルに固定しすぎず、切り替えられる作りにしておくほうが安全です。

まとめ

  • GPT-5.6 Sol の API 料金が2026年8月21日に値下げ。入力-20%・出力約-33%・キャッシュ-20%で、下げ幅は項目ごとに違う。
  • 効くのは API・ChatGPT Work・Codex クレジット。Plus・Pro・Business のサブスク料金は据え置き。
  • 少なくとも11月21日までの期間限定。導入判断より先に、今の単価で費用を試算し、二層運用の仕分けまで進めておく。

ククルデザインでは、AIを組み込んだ自動化の内製を伴走でお手伝いしています。モデルの単価は費用設計の前提そのものなので、今回のような改定は自社案件でも毎回追いかけています。「自社のこの処理、新単価だといくらで回せるか」を一緒に試算するところから始められます。まずは量の多い1業務を選んで、費用の試算だけ持ち帰ってみませんか。ご相談はこちらからどうぞ。