ジャーナル

gpt-5.6の価格改定——lunaの5分の1コストが顧客対応コストに与える影響

openaiの新しいgpt-5.6 lunaティアは、solより5倍安い。次の財務レビューを迎える前に、その価格差が自社のAI機能の顧客対応コストにどう影響するかを解説する。

omar f.applied ai & data··1 分で読了

gpt-5.6の価格体系と顧客対応コスト. 顧客対応コストとは、ユーザーが自社のAI機能に触れるたびに発生する費用のことだ。gpt-5.6の3つのティアを使えば呼び出しを振り分けられるので、安く済むはずの処理がフラッグシップの料金を払わされることもなくなる。これはモデルを見るエンジニアの視点ではなく、請求書を見るプロダクトオーナーの視点で書いている。

2026年6月26日、OpenAIはgpt-5.6ファミリー——sol、terra、luna——を公開した。lunaは100万トークンあたり入力$1・出力$6。solは$5/$30。同じプロダクト上で5倍の価格差があることをfinoutが報じている。

顧客向けAI機能を持つシリーズBのSaaSでプロダクトを率いているなら、この価格差こそ次の財務レビューの論点になる。問題は、どのモデルが一番賢いかではない。問題は、どの呼び出しが本当にsolを必要としていて、どれが気づかぬうちに払いすぎていたのか、という点だ。

#gpt-5.6のlunaティアは実際何のためにあるのか

gpt-5.6のlunaティアとは何で、どのくらい安いのか

lunaは2026年6月26日に登場したopenaiのgpt-5.6の3ティアのうち最も安いもので、100万トークンあたり入力$1・出力$6。solの$5/$30と比べて5倍の差がある。openaiはlunaを分類、意図のルーティング、要約向けに位置づけている——ほとんどのAI機能を支える、高頻度で推論負荷の低い処理だ。

顧客向けのAI機能の大半は、ひとつの仕事ではない。ひとつのボタンの下に小さな仕事が積み重なっているだけだ。このメッセージにタグを付ける。適切なフローに振り分ける。スレッドを要約する。そして時折、本当に難しいケースについて考える。

最初の3つはまさにlunaが想定する処理だ。4つ目のためにsolを残しておけばいい。もし今、そのすべての呼び出しがフラッグシップモデルに向かっているなら、トークン量の8割ほどが必要以上に5倍の料金を払っていることになる。

ティアを分けることで、請求額は実際どのくらい下がるのか

月に1,000万出力トークンを処理する機能を例にとろう。そのうち8割がルーティング、タグ付け、要約だとする。すべてsolで処理すると、その出力だけで月$300,000かかる。8割をlunaに移すと、同じ処理が$88,000で済む。推論が必要な呼び出しはsolのまま手を付けない。品質を保つべきはそこだからだ。

ユーザーからは何も変わって見えない。タグは変わらず付き、要約は変わらず読める。難しい質問には変わらず良い答えが返る。変わったのは、どの呼び出しをどのティアが請求するか、それだけだ。

キャッシュも計算を変えるのか

変える。しかも積み重なる。gpt-5.6はキャッシュされた入力に90%の割引を維持しており、明示的なキャッシュのブレークポイントと最短30分のキャッシュ保持時間を備えている、と2026年6月26日にeeselが伝えている。キャッシュの書き込みは1.25倍の課金なので、一度限りのコストはわずかだ。

システムプロンプトはどの呼び出しでも同じだ。そこをキャッシュすればいい。毎回のリクエストで2,000トークンの指示ブロックを送っている機能なら、それをキャッシュするだけで、その部分の入力コストが90%下がる。どのティアに振り分けたかとは別に、さらに上乗せできる節約だ。

we are

stennirはAIコンサルティングとして、機能が各呼び出しを読み取り、安く済む処理はlunaへ、本当に推論が必要な処理はsolへ送るルーティング層を構築し、実際に稼働させる。

we aren't

stennirは、モデルIDを最安のティアに差し替えて品質が保たれることを祈るだけの再販業者ではない。

これを実現するために機能を作り直す必要はあるのか

ない。私たちのプロダクト向けAIの構築では、すでにタスクごとにトラフィックを分けている。ルーティング、タグ付け、モデレーションは安いティアへ、推論はフラッグシップへ向かう。だからlunaのような新しいティアが出ても、それは安いレーンの設定変更で済み、ユーザーが頼っている機能を作り直す話にはならない。

もし今、機能のすべてをひとつのモデルに送っているなら、まずそこを埋めるべきだ。振り分け自体は1〜2日の作業で終わる。節約額は、利用が増えるごとに毎月積み上がっていく。

CFOはどのモデルを使っているかを聞かなかった。アクティブユーザー1人あたりのコストを聞いてきた。ティアを分けたことが、その機能がレビューを乗り切れた答えだった。

プロダクトリード、シリーズBのSaaS(NDA案件)

これは私たちのコンサルティング実務の一部であり、ジャーナルにはすでに本番稼働させた機能の実績が載っている。次の財務レビューの前に自分の数字を知りたいなら、30分のディスカバリー通話を予約してほしい。あなたの機能のトラフィック振り分けを一緒に見ていく。

ジャーナルに戻る
productgpt-5.6ai newscost to servemodel pricing

出荷してほしいものを、教えてください。

30分の通話を予約する