AIの値下げは、モデル名を書き換えるまで届かない——Opus 5.5「単価20%減・費用40%減」の内訳
2026.10.02 夕 | 株式会社NGraph
2026年9月22日、AnthropicとOpenAIが同じ日に新しいAIモデルを出し、どちらも以前のモデルより低い単価を付けました。Anthropicは、新モデルのClaude Opus 5.5がOpus 5より40%安く動くと説明しています(同社の発表、2026年9月22日)。ただし、この40%をそのまま自社の請求書に当てはめるのは危険です。月額プランの発表が書いているのは利用上限の引き上げで、料金の変更は書かれていません。自社のシステムからAIを呼び出す窓口である「API」で使った分だけ払っている会社には、コードに書かれたモデル名を書き換えるまで、値下げが1円も届かないからです。
先に結論を書きます。中小企業の判断は、「どのモデルが安いか」から、「自社の仕事1件がいくらかかるか、そしてモデル名を誰が書き換えるか」に変わりました。公開から3日後にOpenAIが不具合を直し、7日後に次の版を出したことを見ると、書き換える前に、自社の仕事で費用と出来を測る必要もあります。
・「20%」「40%」「50%」が、それぞれ別のものを数えていること
・払い方で、値下げの届き方が3通りに分かれること
・自社の本番コードで数えた、モデル名の直書き137箇所と、書き換え前に測る手順
9月22日から10日間に起きたこと——2社の新モデルと、10月2日時点の単価表
AIの料金は、文章を読み書きするときの数え方の単位である「トークン」で決まります。単価は100万トークンあたりのドルで示され、AIに読ませた量の「入力」と、AIが書いた量の「出力」で別々です。同じ資料を2回目以降に読ませるとき、前回の処理を再利用して安く読ませる仕組みが「キャッシュ」で、その読み出しにも別の単価が付きます。
9月22日から10月2日までの動きを、時系列で並べます。
- 9月22日:AnthropicがClaude Opus 5.5を公開しました。Claude 5.5ファミリーの最初のモデルです。同じ日に、OpenAIがGPT-6 SolとGPT-6 Lunaを公開しました。
- 9月25日:OpenAIが、GPT-6 SolとGPT-6 Lunaで、画像を読み取る処理の不具合を直しました。画像の理解を劣化させていた不具合です。
- 9月29日:OpenAIがGPT-6.1 Solを公開しました。GPT-6 Astraより低コストで、複雑なコーディングと業務に向けたモデルと説明されています。
- 10月2日:OpenAIの料金ページで、主力モデルの表に載っているのは、gpt-6-astra、gpt-6.1-sol、gpt-6-lunaの3つです。
9月22日に出たgpt-6-solは、10月2日の主力モデルの表に載っていません。載っていない理由は、私たちは確かめていません。次の表は、各社の料金ページと更新履歴から、単価を並べたものです。
| 会社 | モデル名 | 入力 | 出力 | キャッシュ読み出し | 備考 |
|---|---|---|---|---|---|
| Anthropic | Claude Opus 5.5 | 4ドル | 20ドル | 0.20ドル | 9月22日公開。Opus 5より入力・出力が20%、キャッシュ読み出しが60%安い |
| Anthropic | Claude Opus 5 | 5ドル | 25ドル | 0.50ドル | Anthropicが比べた相手 |
| Anthropic | Claude Sonnet 5.5 | 2ドル | 10ドル | 0.20ドル | 9月22日の発表は「今後数週間で続く」と書いている |
| Anthropic | Claude Fable 5.1 | 10ドル | 50ドル | 0.25ドル | Opus 5.5が多くの仕事で同等の水準と説明された相手 |
| OpenAI | GPT-6 Sol | 2ドル | 10ドル | 0.20ドル | 9月22日公開。入力27万2千トークンまでのプロンプトの標準価格 |
| OpenAI | GPT-6.1 Sol | 2ドル | 10ドル | 0.10ドル | 9月29日公開。キャッシュ書き込みは2.50ドル |
| OpenAI | GPT-6 Luna | 0.10ドル | 0.50ドル | 0.01ドル | OpenAIの小型で安いモデル |
| OpenAI | GPT-6 Astra | 10ドル | 50ドル | 1.00ドル | OpenAIの上位モデル |
| OpenAI | GPT-5.6 Sol | 4ドル | 20ドル | 0.40ドル | キャンペーン価格。料金ページに「少なくとも2026年11月21日まで」とある |
単位は100万トークンあたり。Anthropicは料金ページ、OpenAIのGPT-6 SolとGPT-6 Lunaは更新履歴、そのほかは料金ページの2026年10月2日の表示です。Claude Sonnet 5.5の行は料金ページの表の値で、使える状態かどうかは確かめていません。
Anthropicの3つの単価を、Opus 5とOpus 5.5で並べたのが、次の図です。
Opus 5→Opus 5.5、単価は3つとも下がった
「20%」「40%」「50%」は、別のものを数えている
ニュースで目にする値下げ率は、何を数えた率なのかが、3つとも違います。読み分けないと、自社の請求がどう変わるかを見誤ります。
20%は、100万トークンあたりの単価の下げ幅
Anthropicの発表にある20%は、料金表の単価の話です。入力はOpus 5の5ドルからOpus 5.5の4ドルへ、出力は25ドルから20ドルへ下がり、どちらも20%の値下げになります。キャッシュ読み出しは0.50ドルから0.20ドルへで、60%の値下げです。同社は、AIが自分で手順を進める作業やコーディングでは、このキャッシュ読み出しの費用が全体の大半を占めると書いています。
40%は、仕事1件あたりの費用。同社が典型的な使い方で試算した値
40%は、単価ではなく、仕事1件あたりの費用の話です。Anthropicは、既定の設定で典型的な使い方をしたとき、Opus 5より40%安くなると、同社のテスト結果として書いています。単価の20%より下げ幅が大きい理由は、単価が下がることに加えて、仕事1件に使うトークンも少ないからだと、同社は説明しています。
ここから先は、記事側の計算です。キャッシュを使わず、入力と出力だけでできた仕事なら、単価が0.8倍で費用が0.6倍のとき、仕事1件に使う量は0.6を0.8で割った0.75倍で、4分の1少ない計算になります。キャッシュ読み出しが多い仕事では、単価だけで20%より大きく下がるので、使う量の減り方がもっと小さくても40%に届きえます。40%は、仕事の中身である入力、出力、キャッシュ読み出しの比率と、使う量の両方で決まる数字で、自社の仕事でどうなるかは、測るまで分かりません。
次の図は、例えば、キャッシュを使わない仕事で、Opus 5で1件1.00ドルかかるものが、Anthropicの試算どおりに使う量も減った場合に、どう変わるかを描いた例です。
例えば、キャッシュを使わない仕事で、Opus 5で1件1.00ドルなら、Anthropicの試算どおりで0.60ドル
使う量が仕事で大きく変わりうることは、同社が発表で紹介した早期テスターの事例からも読めます。20万行のコードの監査と修正を、Opus 5.5は3時間未満で終え、Opus 5は20時間超かかって、使ったトークンは2.5倍でした。発表が紹介した1件の話で、典型値の40%とは別のものです。同じ差が自社の仕事で出るとは言えませんが、使う量が仕事で変わることは読み取れます。
OpenAIの「半分」は、キャンペーン価格との比較
OpenAIの数字は、事情が別です。GPT-6 Solの入力2ドル・出力10ドルは、GPT-5.6 Solのキャンペーン価格である入力4ドル・出力20ドルの、ちょうど半分です。この「半分」は、料金ページの価格を並べて出した記事側の比較で、比べている相手が、常設の価格ではなくキャンペーン価格であることが、読むときの条件になります。料金ページには、GPT-5.6 Solのキャンペーン価格は少なくとも2026年11月21日まで、と書かれています。GPT-5.6 Solの値下げは、8月の記事で別に扱いました。
3つの数字を、物差しで並べ直します。
- 20%:100万トークンあたりの単価。Opus 5とOpus 5.5の料金表の差です。
- 40%:仕事1件あたりの費用。Anthropicが典型的な使い方で試算した値で、単価の下げ(キャッシュ読み出しは60%)と、使う量の減少の両方を含みます。
- 50%:キャンペーン価格との比較。期限のある価格を相手にした、記事側の計算です。
自社の請求がどう変わるかを整理したい方は、FDE型AI導入支援(無料相談・無料AI診断)からご相談ください。
払い方で、届く値下げが違う
同じ新モデルの発表でも、月額プランで使う会社と、APIで使う会社と、業者のサービスを経由する会社では、値下げの届き方が変わります。APIは、自社のシステムからAIを呼び出す窓口のことで、使った分だけ払う従量課金です。
| 払い方 | 今回、何が変わったか | 請求はどうなるか | 社内で確かめること |
|---|---|---|---|
| 月額プラン | Claudeは、Pro・Max・Team・席単位のEnterpriseで、5時間あたりの利用上限が上がり、利用上限のリセットを保存していつでも使えるようになった | 発表に書かれているのは上限の引き上げで、料金の変更は書かれていない。増えたのは使える量 | 利用上限に当たって止まっていた人がいたか |
| APIの従量課金 | 新しいモデル名を指定した呼び出しに、新しい単価が付く | 古いモデル名を書いたままなら、古い単価の請求が続く | コードと設定に、どのモデル名が書かれているか |
| 業者のサービス経由 | どのモデルを呼ぶかは、業者が決める | 値下げを価格に反映するかも、業者が決める | 呼んでいるモデルと、値下げの反映の考え方を業者に聞く |
Claudeの料金ページでは、Proが年払いで月17ドル(200ドルの前払い)、月払いなら20ドル、Maxは月100ドルからと表示されています。ChatGPTの月額プランは今回読んでいないので、この表の対象外です。
業者のサービスは、一般論として、使うモデルも値下げの反映も業者の判断です。先方に聞くまでは、請求が下がるとも下がらないとも言えません。
値下げは、モデル名を書き換えるまで届かない
APIでは、どのAIを使うかを、モデル名という文字列で指定します。claude-opus-5-5やgpt-6.1-solのような名前で、コードか設定ファイルに書かれています。請求は呼び出しに書かれた名前の単価で計算されるので、古いモデル名を書いたままなら、新しいモデルの単価は適用されません。
自社の本番コードに、新モデルの名前は0箇所だった
自社の本番2サービスに書かれたモデル名、新モデルは0箇所
数え方には限りがあります。コメントの中の例示も数えているので、137箇所は、実際に呼び出している数ではありません。環境変数や管理画面で指定している分は、コードの文字列として出てこないので、この数え方には入りません。書類作成のSaaSの対話機能のうち1つは、使うモデルを環境変数1つで切り替える作りで、その機能だけは書き換えが1か所で済みます。ほかの箇所は、呼び出しごとにモデル名が直接書かれています。値下げ前と後の請求額の比較、実際に乗り換えた結果、エラーが出ていたかは、測っていません。
新モデルの名前が0箇所ということは、この2サービスのコードの上では、新しい単価で請求される呼び出しが、いまはないということです。
書き換えを、担当者の仕事にしない設計
設計の要点は3つあります。
- モデル名を1か所にまとめる。設定ファイルか環境変数に1回だけ書き、各機能はそこを読む形にします。自社の対話機能が、この形でした。
- 書き換える担当を決める。「誰かが気づいて直す」にしておくと、8日たっても10箇所が残っていた自社のように、そのまま残ります。
- 書き換えた日を記録する。どの日から、どのモデルで動いているかが分かれば、請求の変化の原因を探せます。
私たちの立場は、新モデルが出るたびに調べて書き換える役を、AI担当の社員に足さないことです。その人にとっては、覚えることと責任が増えるだけで、続かないと考えています。モデル名を1か所に集め、測る手順を用意し、人に残すのは、測った結果を見て書き換えるかどうかを決めることだけにします。
乗り換える前に、自社の仕事1件で測る
公開日に全部を新しいモデルへ切り替えない理由は、9月25日の出来事にあります。OpenAIは、画像を読み取る処理の不具合を公開の3日後に直し、画像入力を使っている場合は、評価をやり直して、影響を受けた処理を再実行するよう勧めています。公開の7日後にはGPT-6.1 Solが出て、10月2日の主力モデルの表にGPT-6 Solは載っていません。9月22日にGPT-6 Solへ切り替えた会社は、10日後に、その名前が主力の表から消えた状態を見ることになります。
測るのに、新しいシステムは要りません。次の5つの手順で足ります。
| 手順 | やること | 残すもの |
|---|---|---|
| 1. 10件を選ぶ | いつもAIに頼んでいる仕事から、易しいものと難しいものを混ぜて10件選ぶ | 10件のリスト |
| 2. 同じ10件を流す | 旧モデルと新モデルで、同じ入力を動かす。変えるのはモデル名だけ | 両方の出力 |
| 3. 3つを並べる | 1件あたりの費用、やり直しの回数、人が直した箇所 | 比べた表 |
| 4. 合格なら1か所を書き換える | 設定にあるモデル名を新しいものにする | 書き換えた設定 |
| 5. 日と理由を残す | 書き換えた日、旧と新のモデル名、比べた結果を記録する | 記録 |
10件は推奨の目安で、統計の裏づけのある件数ではありません。手順の3つ目にある「人が直した箇所」は、費用の表に出ない費用です。1件あたりの費用が下がっても、人が直す時間が増えれば、会社にとっての費用は下がっていないことになります。
1件の費用は、3つの単価で決まる
仕事1件の費用は、入力の量に入力の単価を掛けたもの、出力の量に出力の単価を掛けたもの、キャッシュ読み出しの量にその単価を掛けたもの、の合計です。どの単価が効くかは、仕事の形で変わります。
同じ資料を毎回読ませる仕事では、2回目以降の読み出しが、キャッシュ読み出しの単価で計算されます。Opus 5.5のキャッシュ読み出しは100万トークンあたり0.20ドルで、入力の4ドルとは別の単価です。Opus 5は0.50ドルだったので、60%下がっています。GPT-6.1 Solのキャッシュ入力は0.10ドルで、入力の2ドルとは別です。自社の仕事で資料を毎回読ませているかどうかが、費用の読み方を変えます。
急がない処理には、バッチという仕組みがあります。急がない処理をまとめて頼むと半額になる仕組みで、AnthropicのBatch APIは入力・出力とも50%引きです。OpenAIも、gpt-6.1-solのバッチは入力1ドル・出力5ドルで、標準価格の半額です。
逆に、速さを買う方向の区分が高速モードで、同じモデルを速く動かす代わりに単価が上がります。Opus 5.5の高速モードは入力8ドル・出力40ドルで、最大2.5倍の速さです。通常の入力4ドル・出力20ドルと取り違えると、見積もりが大きくずれます。なお、Opus 5.5は出力の生成がOpus 5より30%以上速いとも書かれています。
よくある失敗・NGパターン4つ
- ニュースの値下げ率で、来期の予算を組む。20%、40%、50%は、単価、仕事1件あたりの費用、キャンペーン価格との比較と、別のものを数えています。40%は、単価の下げと、使う量の減少の両方を含んだ、Anthropicの試算です。
- 月額プランを「安くなったから」と見直す。Claudeの月額プランで発表に書かれていたのは、5時間あたりの利用上限の引き上げです。料金の変更は書かれていません。
- 公開日に全部を新しいモデルに切り替える。OpenAIは、公開の3日後に画像を読み取る処理の不具合を直し、7日後に次の版を出しました。
- キャンペーン価格を、常設の前提にする。GPT-5.6 Solのキャンペーン価格は、料金ページに少なくとも2026年11月21日までと書かれています。OpenAIの「半分」は、その期限つきの価格を相手にした比較です。
自社のAIが、どのモデル名で動いているかを確かめたい方は、無料相談でも確認可能です。
よくある質問
月額のChatGPTやClaudeの料金は下がりましたか?
Anthropicの9月22日の発表に書かれているのは、Pro・Max・Team・席単位のEnterpriseでの5時間あたりの利用上限の引き上げと、利用上限のリセットを保存していつでも使えることで、料金の変更は書かれていません。ChatGPTの月額プランは今回読んでいないので、契約中のプランの案内を確かめてください。
Opus 5.5に変えれば、費用は必ず40%下がりますか?
下がるとは限りません。40%は、Anthropicが既定の設定で典型的な使い方を試算した値です。単価の下げ(キャッシュ読み出しは60%)と、使う量の減少の両方を含む試算です。自社の仕事10件で費用を測ってから決めてください。
GPT-6 SolとGPT-6.1 Solは、どちらを使えばよいですか?
10月2日の料金ページの主力モデルの表に載っているのはgpt-6.1-solで、gpt-6-solは載っていません。標準価格は、入力2ドル・出力10ドルで同じで、キャッシュ入力はGPT-6 Solが0.20ドル、GPT-6.1 Solが0.10ドルです。どちらにするかは、自社の仕事で測ってから決めてください。
モデル名は、どこに書いてありますか?
コードの中か、設定ファイル、環境変数、提供元の管理画面です。自社のコードを探すときは、gpt- や claude- を検索するのが近道です。外部の開発会社が作ったシステムなら、その会社に聞いてください。
業者のサービス経由で使っている場合は、どうなりますか?
どのモデルを呼ぶかも、値下げを価格に反映するかも、業者が決めます。業者に、いま呼んでいるモデルの名前と、値下げを価格に反映する考え方を聞いてください。
乗り換えの検証には、どれくらいかかりますか?
仕事の種類と件数で変わるので、時間は断定できません。手順は、いつもの仕事を10件選び、旧モデルと新モデルで同じ10件を流して、費用とやり直しと人が直した箇所を並べるだけです。
まとめ
9月22日の値下げは、数え方の違う3つの率で伝わりました。20%は単価、40%はAnthropicが試算した仕事1件あたりの費用で、OpenAIの半分は期限つきのキャンペーン価格との比較です。APIで使う会社の値下げは、コードのモデル名を書き換えるまで届かず、自社の2サービスでは、新モデルの名前が0箇所でした。書き換える前に、いつもの仕事10件で費用と出来を測り、モデル名を1か所にまとめ、書き換える担当と日を決めてください。
・Anthropic「Introducing Claude Opus 5.5 \ Anthropic」(2026年9月22日)
・Anthropic「Pricing - Claude Platform Docs」(2026年10月2日確認)
・Anthropic「Plans & Pricing | Claude by Anthropic」(2026年10月2日閲覧)
・OpenAI「Changelog | OpenAI API」(2026年10月2日確認)
・OpenAI「Pricing | OpenAI API」(2026年10月2日確認)
・自社の実測は、本番稼働している自社の2サービスのコードに出てくるモデル名の数え上げ(2026年10月2日)による。
・あわせて読む:AIモデルの終了日、3社の予告の違い(当ブログ)
・あわせて読む:OpenAIがGPT-5.6 Solを20%値下げ(当ブログ)
