Claude Sonnet 5 が Claude Code の既定モデルに — 1Mコンテキストと月コスト激減を実額で検証

AI・テック動向

Claude Sonnet 5 が Claude Code の既定モデルに — 1Mコンテキストと月コスト激減を実額で検証

入力$2・出力$10 per 100万トークン。2026年8月31日まで続くClaude Sonnet 5の導入プロモ価格だ。この主力モデルは6月30日にClaude Codeの既定モデルへ昇格し、ネイティブ1Mトークンのコンテキストと最大128k出力を標準で備える。「トークン代がかさむから最上位モデルは常用しづらい」と足踏みしていた個人開発者にとって、モデル運用を組み直す条件がそろった。効き方はAPI従量課金かPro/Maxのサブスクかで変わる。筆者は両方の実際の数字と設定で確かめていく。

目次
  1. 何が起きたのか
  2. 見落としやすい伏線: 新しいトークナイザー
  3. API従量課金なら月コストはどう動くか
  4. サブスク(Pro/Max)ではどう違うのか
  5. 移行で引っかかる3つの挙動変更
  6. Claude Codeでの切り替え方
  7. opusplanで設計と実装を自動で切り替える
  8. 開発者としての実践ポイント
  9. まとめ
  10. 参考

何が起きたのか

Anthropicは2026年6月30日、Claude Sonnet 5を発表した。開発者に効くポイントは3つに絞れる。

  • Claude Codeの既定モデルに昇格。新規セッションは何も設定しなくてもSonnet 5で動く。モデルIDはclaude-sonnet-5だ。
  • ネイティブ1Mトークンのコンテキスト窓。1Mが既定かつ上限で、小さいコンテキスト版は存在しない。最大出力は128k。中規模のコードベースを丸ごと渡しても収まる。
  • プロモ価格 $2 / $10 per MTok(入力$2・出力$10、8月31日まで)。9月1日以降は標準の$3 / $15に戻る。

Sonnet 5はSonnet 4.6と同じツール群・プラットフォーム機能を引き継ぐ(Priority Tierのみ非対応)。コーディングとエージェント作業での伸びが最も大きく、Opus 4.8との差を詰めた世代だ。「Sonnetだから一段格下」という感覚は、もう当てはまらない。

見落としやすい伏線: 新しいトークナイザー

単価だけ見て「実質値下げだ」と早合点すると、請求書で計算が合わなくなる。Sonnet 5は新しいトークナイザーを積んでいて、同じテキストでも数えられるトークンが約30%増えるからだ。

例えば同じソースコード1ファイルをSonnet 4.6に渡して1,000トークンだったとする。Sonnet 5では同じ中身がおよそ1,300トークンとして数えられる。単価が下がっても、数えるトークンが増えれば1リクエストの実費は思ったほど下がらない。

Anthropic自身、標準価格$3/$15はSonnet 4.6から据え置きだと明言している。導入プロモの$2/$10は、このトークナイザー変更を織り込むと「同じテキストに対してSonnet 4.6の$3/$15とおおむね実費が並ぶ」水準だと理解しておくのが正確だ。トークン数を過去のモデルの実測値で見積もらず、Sonnet 5で測り直すのが安全になる。

API従量課金なら月コストはどう動くか

1日に入力300k・出力60kトークンをClaude Codeで消費するとする。中規模の開発作業でよくある量だ。月20営業日で見積もると、月間のトークン量はこうなる。

入力: 300k × 20日 = 6.0 MTok / 月
出力:  60k × 20日 = 1.2 MTok / 月

この量を各モデルの単価に当てはめる。Opus 4.8は入力$5・出力$25なので、6.0×$5+1.2×$25=$30+$30=月$60。Sonnet 5のプロモ期は6.0×$2+1.2×$10=$12+$12=月$24という計算だ。

モデル 入力単価 出力単価 月額(この使用量の場合)
Opus 4.8 $5 / MTok $25 / MTok $60
Sonnet 5(プロモ、〜8/31)おすすめ $2 / MTok $10 / MTok $24
Sonnet 5(標準、9/1〜) $3 / MTok $15 / MTok $36

同じ作業量なら、Opusからプロモ期のSonnet 5へ寄せるだけで月額はおよそ4割、Opusの約1/2.5に収まる。プロンプトキャッシュを効かせればさらに下がる。「難しい設計判断だけOpus、通常のコーディングはSonnet 5」という使い分けが、料金面でもはっきり正当化される数字だ。ここには前述のトークナイザー増分がすでに乗っているので、実測はこの表より1〜2割上振れすると見ておくと堅い。

サブスク(Pro/Max)ではどう違うのか

ここまではAPI従量課金の話だ。Claude ProやMaxでClaude Codeを使っている場合、課金の仕組みそのものが変わる。

  • 利用枠を消費する仕組み。トークン単価では測らない。Claude.aiのチャットとClaude Codeは同じ枠を共有し、最初のメッセージから5時間のローリングセッション上限と、週次の上限で管理される。
  • プランごとに既定モデルが違う。Pro・Team Standard・Enterprise(サブスク席)は既定でSonnet 5、Max・APIは既定でOpus 4.8になる。同じ「Claude Code」でも、プランによって最初に動くモデルが変わる。
  • Max 5x/Max 20xは、Proのセッション枠をそれぞれ5倍・20倍に広げたプランで、Opusを常用したい場合の選択肢になる。

会計の性質そのものが違う。APIは使った分だけの従量課金で上限がなく、サブスクは決まった枠を使い切れば次の窓まで待つことになる。月あたりの開発量が読めているならサブスクの方が予算は立てやすく、月ごとの変動が大きいならAPIの方が柔軟に伸縮する。

移行で引っかかる3つの挙動変更

Sonnet 5はSonnet 4.6のドロップイン置き換えを謳うが、API直叩きで使っているなら3点だけ挙動が変わっている。Claude CodeのUIから使う分には意識しなくてよいが、自作スクリプトから呼んでいるなら確認しておきたい。

変更点 Sonnet 4.6まで Sonnet 5
Adaptive thinking 指定しなければ思考なし 既定でオン
手動の extended thinking 非推奨だが動作 指定すると400エラー
temperature等のサンプリング指定 受け付ける 既定値以外は400エラー

影響が出やすいのはmax_tokensだ。思考がオフ前提で上限を詰めていたコードは、adaptive thinkingの思考トークンが出力枠を食って本文が途中で切れることがある。思考と応答の合計がmax_tokensに収まるよう、移行時に見直しておく。

Claude Codeでの切り替え方

既定がSonnet 5になったので、日常のコーディングは何もしなくていい。明示的に指定したいときは/modelを使う。エイリアスの解決先は、Anthropic APIならsonnetがSonnet 5、opusがOpus 4.8を指す。

# セッション内で対話的に選ぶ
/model

# 難しいタスクだけ一時的にOpusへ上げる
/model opus

# 通常のコーディングに戻す
/model sonnet

さらに重い調査や長時間の自律作業が必要なら、Claude Codeで最も高性能なFable 5を/model fableで選べる。根本原因調査やアーキテクチャ判断のような、腰を据えて検証させたい仕事に向く。

opusplanで設計と実装を自動で切り替える

手動の切り替えを毎回覚えていられないなら、opusplanというエイリアスがある。設定ファイルにこの一行を書くだけでいい。

{
  "model": "opusplan"
}

opusplan公式ドキュメントが定義する特殊なモードで、Plan mode(設計・計画のフェーズ)ではOpusを、実行フェーズではSonnetを自動で使い分ける。Anthropic APIなら設計はOpus 4.8、実装はSonnet 5に振り分けられる計算だ。

エイリアスは時間とともに推奨バージョンを指すよう更新される仕様なので、6月30日のリリース以降、opusplanの実行フェーズは自動的にSonnet 5へ切り替わっている。バージョン番号を追いかけなくても最新の推奨構成に乗れる。

特定バージョンに固定したいなら、claude-opus-4-8のようにフルのモデル名を書くか、ANTHROPIC_DEFAULT_SONNET_MODELのような環境変数で指定する。

設計だけOpusにするとコストはOpus単価だが、Plan modeは分量が短いので跳ね上がりにくい。設計品質とコスト管理を両立したいなら、最初に設定しておく価値がある一行だ。

開発者としての実践ポイント

  1. 8月31日までのプロモ期間を使い倒す。標準価格に戻ると出力単価は1.5倍になる。試したい実験はこの期間に寄せる。
  2. 1Mコンテキストに甘えすぎない。窓が大きくても、無関係なファイルを丸投げすれば入力トークン=コストが膨らむ。渡す範囲は絞る。プロンプトキャッシュが効く構成なら、繰り返し読ませる前提のファイルほど割安になる。
  3. モデル選択をコストの設計変数として扱う。「常に最上位」をやめ、タスクの難度でモデルを段階的に上げ下げする。opusplanはその判断を仕組み化する一つの答えだ。

AIを使ったアプリ開発を、モデル選定から実装まで一気通貫で学びたいなら、バイブコーディングの進め方で具体的なワークフローを公開している。あわせて読むと、今日のモデル選択が実際の開発でどう効くかが掴める。

まとめ

Claude Sonnet 5は、Opus級に迫る性能を日常使いできる価格に載せた主力モデルだ。既定モデル化とプロモ価格が重なった今が、モデル運用と予算を組み直す好機になる。API課金ならまず料金計算とトークナイザー増分を、サブスクなら自分のプランの既定モデルと利用枠を確認するところから始めよう。

参考

ブラウザで動く都市開発シミュを作る①|React+TypeScript+Canvasの土台と3レイヤ設計【Aurum City制作】ブラウザで動く都市開発シミュを作る①|React+TypeScript+Canvasの土台と3レイヤ設計【Aurum City制作】前のページ

OpenAI GPT-Image-1.5 — 最大4倍高速・ディテール維持の精密編集をアイキャッチ量産に活かす次のページOpenAI GPT-Image-1.5 — 最大4倍高速・ディテール維持の精密編集をアイキャッチ量産に活かす

ピックアップ記事

  1. 高精度OCRデスクトップアプリの作り方 — PaddleOCR-VLとPyIns…

  2. New Eden Intelligence Hub の作り方 — EVE Onl…

  3. Claude Mission Control の作り方 — Tauri+Pyth…

  4. 競艇予想AIの作り方 — LightGBMで「当たる順位」を学習させる実装ガイド…

関連記事

  1. WebSearch とサブエージェントに上限200 — 片方は無言で止まる
  2. GPT-5.6 Sol/Terra/Luna が Copilot に — 従量課金で3層を使い分ける
  3. AnimeGen のライセンスを条文まで読んだ — SDXL の挿絵を動かす前に確認したこと
  4. Anthropic「Reflect」— AI利用の可視化を自動化の材料にする

    AI・テック動向

    Anthropic「Reflect」— AI利用の可視化を自動化の材料にする

    Claudeの使い方を振り返るダッシュボードReflectがベータ公開…

  5. Claude Code の /doctor が診断して直す — 肥大化した設定の健診

    AI・テック動向

    Claude Code の /doctor が診断して直す — 肥大化した設定の健診

    読み取り専用だったClaude Codeの/doctorが、確認の上で…

注目

AIで、ここまで作れる

AIで作った2D RPGを、ブラウザでそのまま遊べます。その「作り方=最後まで完成させる進め方」も実例つきで公開中。

▶ ゲームを遊ぶやり方を読む

PR

お名前.com 独自ドメイン取得(PR)

独自ドメイン:お名前.com(本サイトで使用・PR)

  1. Whisper文字起こしアプリの作り方 — 録音から Word 出力までローカルで完結させる

    アプリの作り方

    Whisper文字起こしアプリの作り方 — 録音から Word 出力までローカル…
  2. 正解が分かる音声を自分で作って、日本語ASRを測る(そして、その限界)

    アプリの作り方

    正解が分かる音声を自分で作って、日本語ASRを測る(そして、その限界)
  3. 作ったアプリを公開する|ローカルから人に使ってもらうまでの最短ルート【入門7】

    バイブコーディング

    作ったアプリを公開する|ローカルから人に使ってもらうまでの最短ルート【入門7】
  4. GitHub Copilot CLI が大型更新 — auto allow-all の是非を Claude Code の権限モデルと比べる

    AI・テック動向

    GitHub Copilot CLI が大型更新 — auto allow-al…
  5. はじめての“動くアプリ”を1本作る|メモ帳をステップバイステップで【入門4】

    バイブコーディング

    はじめての“動くアプリ”を1本作る|メモ帳をステップバイステップで【入門4】
PAGE TOP

TAG CLOUD

ドラッグで回転・クリックでそのタグの記事一覧へ