LAST UPDATED: 2026-09-05 / 毎週金曜の週刊タスクで点検・更新、変更があった日は随時追記(9/5:OpenAIのGPT-6 Astraを追加。円換算は1ドル=159.5円(8/14時点)を据え置き)
生成AIモデル料金比較・早見表。
ChatGPT・Claude・Gemini・Grok・Kimiほか主要モデルの月額プラン・性能ランキング・API単価を1枚に置いておく定点観測ページです。個人での契約、チーム・会社への導入、開発でのAPI利用のどれでも、ここから選べる順に並べました。円は1ドル=159.5円(2026年8月14日時点)での概算併記。変わった数字だけを毎週差し替えます。
API料金(開発者向け・100万トークンあたり・米ドル・標準レート)
| モデル | 入力 | 出力 | 位置づけ・備考 |
|---|---|---|---|
| OPENAI GPT-6 Astra NEW | $10.00約1,595円 | $50.00約7,975円 | 2026年9月4日発表。コーディング・エージェント・科学知識で新フラッグシップ。Fast modeは2倍速・2倍単価($20/$100)。キャッシュ料金は別途設定されるが、発表ページに具体的な倍率の記載はなし。数日内にChatGPT全プラン・API・Azure・Bedrockへ拡大予定 |
| OPENAI GPT-5.6 Sol | $4.00約638円 | $20.00約3,190円 | 2026年8月21日、期間限定で20%/33%値下げ(旧$5.00/$30.00)。少なくとも11月21日まで最低保証。対象はAPI・Codexクレジット・対象のChatGPT Workプランのみで、ChatGPT Plus/Pro/Businessの個人向け契約は対象外。フラッグシップ。2026年7月9日GA。コンテキスト約100万・出力最大12.8万トークン。キャッシュ入力$0.40。Priority Processingは7月30日にFast modeへ置き換わっており、標準の2倍単価(今回の値下げ後は$8/$40) |
| OPENAI GPT-5.6 Terra | $2.00約319円 | $12.00約1,914円 | 2026年7月30日に20%値下げ(旧 $2.50/$15.00)。バランス型の中位グレード。期限のない標準単価の改定 |
| OPENAI GPT-5.6 Luna | $0.20約32円 | $1.20約191円 | 2026年7月30日に80%値下げ(旧 $1.00/$6.00)。最安・高速。大量処理の既定候補。入力単価はDeepSeek V4 Proを下回る |
| ANTHROPIC Claude Opus 5 NEW | $5.00約798円 | $25.00約3,988円 | 2026年7月24日リリース。Fable 5に迫る性能を半額で。コンテキスト100万トークン(既定=上限)、思考が既定オン+effort(low/medium/high/xhigh/max)で深さ調整。Fast modeは$10/$50で約2.5倍速。Maxの既定・Proの最上位モデル |
| ANTHROPIC Claude Fable 5.1 NEW | $10.00約1,595円 | $50.00約7,975円 | 2026年9月1日公開、Claude Codeの既定モデルに設定。単価はFable 5と同額だが、キャッシュ読み取りが標準の0.1倍でなく0.025倍と有利($0.25/MTok)。限定提供の姉妹モデルClaude Mythos 5.1も同額帯 |
| ANTHROPIC Claude Fable 5 | $10.00約1,595円 | $50.00約7,975円 | 6月投入のプレミア帯。SWE-Bench Proではなお首位(80.0%)だが、多くの用途でOpus 5が半額で並ぶ。キャッシュ読み取りは標準の0.1倍 |
| ANTHROPIC Claude Opus 4.8 | $5.00約798円 | $25.00約3,988円 | 前フラッグシップ。Opus 5が同価格で置き換え(移行推奨) |
| ANTHROPIC Claude Sonnet 5 | $2.00約319円 | $10.00約1,595円 | 主力中位。導入価格($2/$10)が恒久化。予告されていた9月1日の$3/$15への引き上げは実施されないとAnthropic公式ページが明記(本紙が8/28時点で書いた「9月1日から$3/$15に戻る」は誤りだったため訂正) |
| ANTHROPIC Claude Haiku 4.5 | $1.00約160円 | $5.00約798円 | 最安帯 |
| GOOGLE Gemini 3.1 Pro | $2.00約319円 | $12.00約1,914円 | 20万トークン超の長文は $4/$18 に上がる。思考トークンも出力課金される点に注意 |
| GOOGLE Gemini 3.7 Flash NEW | $0.75約120円 | $3.75約598円 | 2026年8月13日(現地時間)公開。3.6 Flashからわずか3週間。この$0.75/$3.75は2026年12月31日までの導入価格で、2027年1月1日から $1.50/$7.50 に戻る(入力・出力とも2倍)。同じ導入価格が3.6 Flashにも適用されるので、年内は両モデルが同額。文脈100万トークン・出力最大6万4000トークン。推論の労力はlow/medium/highの3段階(既定medium・highはトークン消費とコストが増える) |
| GOOGLE Gemini 3.6 Flash | $0.75約120円 | $3.75約598円 | 2026年7月21日公開。3.7 Flashと同じ導入価格が2026年12月31日まで適用(2027年1月1日から $1.50/$7.50)。年内は3.7 Flashと同額なので、乗り換えは価格ではなく性能で判断できる |
| GOOGLE Gemini 3.5 Flash-Lite | $0.30約48円 | $2.50約399円 | 最軽量帯 |
| XAI Grok 4.6 NEW | $2.00約319円 | $6.00約957円 | 2026年8月12日リリース。コンテキスト50万、入出力単価はGrok 4.5と同額。キャッシュ入力は$0.50(4.5の$0.30から上昇)。20万トークン超の長文は$4.00/$1.00/$12.00。データ共有プログラム参加で毎月最大$175の無料APIクレジット |
| XAI Grok 4.5 | $2.00約319円 | $6.00約957円 | 前世代。Grok 4.6と同額帯だが、キャッシュ入力は$0.30(85%引)とやや安い |
| MOONSHOT Kimi K3 | $3.00約478円 | $15.00約2,392円 | 2026年7月公開の最新フラッグシップ |
| MOONSHOT Kimi K2.5 | $0.60約96円 | $3.00約478円 | K2系はオープンウェイト。自前ホスティングや他社経由の提供もあり |
| ALIBABA Qwen3.8-Max NEW | $2.00約319円 | $6.00約957円 | 2026年8月3日正式リリース。総パラメータ2.4兆(アクティブ95B)、文脈100万トークン、画像・動画入力に対応。提供はQwenCloudのAPIのみで、オープンウェイトは同時に予告された27B版を含め公開待ち(ライセンス条文は未公表) |
| DEEPSEEK DeepSeek V4 Pro | $0.66約105円 | $1.98約316円 | 2026年8月17日午前1時(JST)から値上げ。入力はキャッシュミス時$0.66/キャッシュヒット時$0.022(約4円)。従来比で入力約12.1倍(ヒット)・約3.0倍(ミス)、出力約4.5倍。さらにピーク時価格(通常の2倍)を新設し、適用は日本時間10時〜13時と15時〜19時——日本の業務時間とほぼ重なるので、対話用途は2倍側から始まる前提で積む。中国系のため入力データの取り扱い・利用規約は導入前に要確認 |
| DEEPSEEK DeepSeek V4 Flash | $0.22約35円 | $0.66約105円 | 値上げ後の廉価版(2026年8月17日午前1時JSTから)。入力はキャッシュミス時$0.22/キャッシュヒット時$0.007(約1円)。ピーク時価格(10時〜13時・15時〜19時JST)は同じく2倍 |
※ 表の見方: 実務のコストはたいてい出力側の単価×出力量で決まります。さらに各社とも割引レバーがあり、プロンプトキャッシュで入力最大90%減(OpenAIはキャッシュ書き込みに1.25倍課金)、バッチ処理でOpenAI/Anthropic/Googleとも約50%減。「定価で常用する」設計がいちばん損です。
月額プラン(個人・チーム/米ドル)
| プラン | 月額 | 備考 |
|---|---|---|
| OPENAI ChatGPT Go/Plus | $8/$20約1,276円/約3,190円 | Goは2026年に新設された廉価枠 |
| OPENAI ChatGPT Pro | $100/$200約15,950円/約31,900円 | $100が5倍・$200が20倍の利用枠 |
| OPENAI ChatGPT Business | $25/席約3,988円/席 | 旧Team($30)を2026年4月2日に置き換え。年払いなら$20/席(約3,190円)、最低2席。Enterpriseは個別見積 |
| ANTHROPIC Claude Pro | $20約3,190円 | 個人の標準枠 |
| ANTHROPIC Claude Max | $100/$200約15,950円/約31,900円 | $100が5倍・$200が20倍。月払いのみ(年割なし)。Claude Codeを日常的に回すならここ |
| ANTHROPIC Claude Team | $25〜/席約3,988円〜/席 | Standard $25(年払い$20=約3,190円)/Premium $125(年払い$100=約15,950円)。最低5席、同一チームで両プラン混在可。Enterpriseは個別見積 |
| GOOGLE Google AI Plus/Pro | $4.99/$19.99約796円/約3,188円 | Plusは2026年6月に$7.99から値下げ |
| GOOGLE Google AI Ultra | $99.99/$199.99約15,948円/約31,898円 | 旧$249.99から改定。$99.99が5倍・$199.99が20倍の利用枠 |
| GOOGLE Workspace(Gemini同梱) | $7〜22/席約1,116〜3,509円/席 | Gemini単体アドオンは廃止され、Business Starter $7/Standard $14/Plus $22(年払い)にAI機能が同梱。Gmail・Docs等で使うだけならこれで足りる |
| XAI SuperGrok/Heavy | $30/$300約4,785円/約47,850円 | SuperGrokは年払い$300/年(約17%引)あり。HeavyのみGrok 4.5フルアクセス+最大レート。X Premium+でも段階的に利用可 |
| MOONSHOT Kimi メンバーシップ | $19〜199約3,031〜31,741円 | 無料枠あり。上位はKimi Code等の利用枠が拡大 |
| DEEPSEEK DeepSeek(チャット) | 無料 | チャット利用は無料、課金はAPIのみ。業務データを入れる場合は取り扱い規約を要確認 |
※ チーム導入の比較ポイント: 3社とも「1人あたり月$20〜25」に収束していますが、性質が違います。ChatGPT Business・Claude TeamはAIチャットの席課金、WorkspaceはグループウェアにAIが同梱される形。すでにGWSを使っている組織は追加費用ゼロでGeminiが付いてくる一方、重い利用(開発・長文処理)は各社の上位枠(Pro/Max/Premium)が別途必要になります。最低席数(Business 2席・Team 5席)も小規模チームでは効いてきます。
※ 円表記は1ドル=159.5円(2026年8月14日時点)の参考換算です。日本からの契約では各社が別途円建て価格(税込・税別)を設定している場合があり、実際の請求額とは異なることがあります。
AIサービスの月額プラン(エージェント・検索・開発支援)
モデルそのものではなく、モデルを載せて売られているサービスの料金です。エージェント(Manus・Genspark ほか)、AI検索、コーディング支援など。トークン課金ではなく月額・クレジット制が中心なので、上のAPI料金表とは分けています。
| サービス | 月額 | 備考 |
|---|---|---|
| ANYSPHERE Cursor | $20/$60/$200約3,190円/約9,570円/約31,900円 | コーディング支援。個人はPro $20/Pro+ $60(Proの3倍の利用上限)/Ultra $200(同20倍)の3段階+無料のHobby。チームはTeams $40/席。各プランに一定量のモデル使用量が含まれ、超過はオンデマンドの後払い課金。税別。公式料金ページで確認(2026年8月21日) |
| MANUS Manus | $20/$40/$200約3,190円/約6,380円/約31,900円 | 汎用エージェント。クレジット制で、$20=月4,000クレジット、$40=月8,000クレジット(使用量を自己設定できる枠)、$200=月40,000クレジット+無料クラウドコンピュータ。全プランに毎日300クレジットのリフレッシュ付与あり。年払いは17%引。公式料金ページで確認(2026年8月21日) |
| PERPLEXITY Perplexity NEW | $0/$20/$200無料/約3,190円/約31,900円 | AI検索・エージェント。無料は上位モデルに週の利用上限つきでアクセス。Pro $20はComputer機能の拡張・4,000クレジット付与・Deep Research・上位モデルの選択が可能。Max $200はComputerを無制限級まで拡張し、月10,000クレジット+一時金35,000クレジットを付与(クレジットは主にComputerの実行回数を消費)。年払いはPro機能相当が実質$200/年(月換算約$16.67)。公式料金ページで確認(2026年8月28日) |
※ この枠は公式の料金ページで確認できた金額だけを載せます。まとめ記事や第三者サイトの数字は使いません(クレジット制のサービスは、同じ月額でも含まれる作業量が各社で違うため、金額だけの横並び比較は誤解を生みます。含まれるクレジットと、その消費単位も併記します)。
料金の変更履歴(ネダンログ)
上の2つの表が変わるたび、変わった行だけを機械が自動で記録しています。料金の「いま」は各社の公式ページにありますが、「いつ、いくらから、いくらに変わったか」はどこにも残りません。ここはその記録です。
購読:RSS/引用・再利用:JSON(出典として本ページのURLを明記してください)
| 記録日 | 表 | 対象 | 変更前 | 変更後 |
|---|---|---|---|---|
| 2026-09-05 | API料金 | OPENAI / GPT-6 Astra | — | 入力 $10.00 / 出力 $50.00 |
| 2026-09-04 | API料金 | ANTHROPIC / Claude Fable 5.1 | — | 入力 $10.00 / 出力 $50.00 |
| 2026-09-04 | API料金 | ANTHROPIC / Claude Sonnet 5 | $3.00 | $2.00 |
| 2026-09-04 | API料金 | ANTHROPIC / Claude Sonnet 5 | $15.00 | $10.00 |
| 2026-08-28 | API料金 | OPENAI / GPT-5.6 Sol | $5.00 | $4.00 |
| 2026-08-28 | API料金 | OPENAI / GPT-5.6 Sol | $30.00 | $20.00 |
| 2026-08-28 | API料金 | XAI / Grok 4.6 | — | 入力 $2.00 / 出力 $6.00 |
| 2026-08-28 | AIサービス の月額プラン | PERPLEXITY / Perplexity | — | 月額 $0/$20/$200 |
| 2026-08-21 | AIサービス の月額プラン | ANYSPHERE / Cursor | — | 月額 $20/$60/$200 |
| 2026-08-21 | AIサービス の月額プラン | MANUS / Manus | — | 月額 $20/$40/$200 |
| 2026-07-30 | API料金 | OPENAI / GPT-5.6 Terra | $2.50 | $2.00 |
| 2026-07-30 | API料金 | OPENAI / GPT-5.6 Terra | $15.00 | $12.00 |
| 2026-07-30 | API料金 | OPENAI / GPT-5.6 Luna | $1.00 | $0.20 |
| 2026-07-30 | API料金 | OPENAI / GPT-5.6 Luna | $6.00 | $1.20 |
| 2026-04-02 | 月額プラン | OPENAI / ChatGPT Business | $30/席 | $25/席 |
※ 直近20件を表示しています。全件は price-log.json にあります。記録日は本紙が差分を検出した日で、各社が改定を実施した日とは異なることがあります(実施日は各行の備考と該当の速報記事に書いています)。元の表の確認日 — API料金: 2026-09-05 / AIサービス の月額プラン: 2026-08-28 / 月額プラン: 2026-07-23
編集部の見立て — 立場からの逆算
2026年9月5日の追記。表に抜けていたOpenAIのGPT-6 Astra(9月4日発表)を追加しました。API標準単価は入力$10・出力$50で、9月1日に公開されたAnthropicのClaude Fable 5.1と同額です。Fast modeは2倍速・2倍単価($20/$100)。キャッシュ料金は別途設定されると発表ページに書かれていますが、具体的な倍率の記載は確認できませんでした。契約前にOpenAIの開発者向けドキュメントで数字を確認してください。
2026年9月4日の週次点検で、本紙自身の誤りを1件訂正します。先週(8/28)の点検で「Claude Sonnet 5は8月31日までの導入価格($2/$10)で、9月1日から$3/$15に戻る」と書きましたが、これは誤りでした。Anthropicは公式ページで、この導入価格が恒久化し、予告されていた9月1日の値上げは実施されないと明記しています。8月中旬時点ですでに据え置きが決まっていたとみられ、先週の点検はこれを取りこぼしたまま「値上げ予定」を前提に書いていました。Sonnet 5で見積もりを組んでいる場合、9月分の請求が$3/$15基準で来ることはありません。あわせて、AnthropicはClaude Fable 5.1とClaude Mythos 5.1(限定提供)を9月1日に公開し、Claude Codeの既定モデルに設定しました。単価はFable 5と同額($10/$50)ですが、キャッシュ読み取りが標準の0.1倍でなく0.025倍という違いがあります。プロンプトキャッシュを多用する構成では、単価表の「入力・出力」だけでなくキャッシュの列も見直してください。
2026年8月28日の週次点検。今週いちばん効くのはOpenAIのGPT-5.6 Solです。8月21日、入力$5.00→$4.00(20%減)・出力$30.00→$20.00(33%減)に値下げし、少なくとも11月21日までこの価格を保証すると明記しています。対象はAPI・Codexクレジット・対象のChatGPT Workプランのみで、ChatGPT Plus/Pro/Businessの個人契約は対象外です。API経由でSolを使っている見積もりは、いま計算し直す価値があります。あわせてxAIがGrok 4.6を8月12日に投入していたのを今週把握しました。入出力の単価は4.5と同額($2/$6)ですが、キャッシュ入力だけ$0.30から$0.50へ上がっています。プロンプトキャッシュを多用する設計は、単価表の「入力・出力」だけでなく「キャッシュ」の列も確認してください。AIサービスの表にPerplexityを追加しました。無料/Pro $20/Max $200の3段階で、ProとMaxの差はComputer機能のクレジット枠(Proは4,000付与、Maxは月10,000+一時金35,000)です。
2026年8月15日の臨時更新。8月13日から14日の48時間で、API単価が二方向に動きました。GoogleはGemini 3.7 Flashを$0.75/$3.75で公開——3.6 Flashの半額ですが、これは2026年12月31日までの導入価格で、2027年1月1日に$1.50/$7.50へ戻ります。年をまたぐ見積もりを平均単価ひとつで積むと、後半が半分になります。この導入価格は3.6 Flashにも適用されるので、年内は両モデルが同額——乗り換えを価格で急ぐ理由はありません。反対側で、DeepSeekは8月17日午前1時(JST)から値上げし、V4 Proの入力はキャッシュヒット時で従来の約12.1倍になります。効いてくるのは倍率よりも新設されたピーク時価格(通常の2倍)で、適用が日本時間10時〜13時と15時〜19時という点です。日本の業務時間とほぼ重なるので、対話用途は2倍側から始まる前提で積んでください。逆に実行時刻を選べるバッチ処理は、13時〜15時・夜間・早朝に寄せれば通常価格で通ります。8/15の速報で分けています。
2026年8月14日の更新で、この表の誤りを2行直しました。OpenAIは7月30日にGPT-5.6 Lunaを80%、Terraを20%値下げしています(Luna $1.00/$6.00 → $0.20/$1.20、Terra $2.50/$15.00 → $2.00/$12.00)。期限のない標準単価の改定で、前回8月7日の点検はこれを取りこぼしていました。単価表を信用してくださっている方に、7日間ぶん古い数字を出していたことをお詫びします。効いてくるのはLunaのほうです——入力$0.20は、これまで「最安帯」と書いてきたDeepSeek V4 Pro($0.435)より安い。大量処理を最安帯の中国系モデルで組む理由が、価格だけでは説明できなくなりました。あわせて同日、Priority ProcessingがFast mode(標準の2倍単価)に置き換わっています。旧来のpriorityフラグを立てたままのシステムは、黙って2倍の枠を買っている状態になるので、9月の請求を待たずに一度確かめてください。もう一つ日付を。Claude Sonnet 5の導入価格 $2/$10 は8月31日までで、9月1日から $3/$15 に戻ります(入力・出力とも50%増)。円換算のレートも1ドル=163円から159.5円へ改め、全行を計算し直しました。
2026年8月7日には、8/3に正式リリースされたAlibaba CloudのQwen3.8-Max($2/$6)を1行足しています。8月14日時点でも手に入るのはQwenCloudのAPIのみで、自社サーバーに置ける重みは公開待ち、ライセンス条文も出ていません。「オープン」の一語で選定を進めないでください(8/4の速報で分けています)。
2026年7月25日時点の最大の変化は、7/24のClaude Opus 5です。Fable 5に迫る性能が半額($5/$25)で、しかも「まとめて作業させる」用途の数字が突出しています。Opus 4.8を使っていた人は同価格で乗り換えるだけで得。Fable 5を難コード用途で使っている人は、SWE-Bench Proだけまだ0.8ポイント差でFable 5が上、それ以外はOpus 5で足りる可能性が高いので、自分の主用途で1週間試して判断するのが賢い動きです。個人でまず1本選ぶなら、$20帯(ChatGPT Plus/Claude Pro/Google AI Pro)が基準線です。無料側を攻めるならDeepSeekのチャット無料と、Grokの開発者向け月$175無料クレジット(データ共有プログラム)が2026年夏時点の最大枠。チーム・会社への導入は、3社とも1人月$20〜25に収束しているので、価格より「席課金か、グループウェア同梱か」で選ぶのが実際的です。GWSを使っている組織はWorkspace同梱のGeminiが実質追加費用ゼロ。個人開発・API利用は、最安帯(GPT-5.6 Luna/Gemini Flash-Lite/DeepSeek V4 Flash/Kimi K2.5)でまず組み、品質が足りない工程だけ上位へ差し替える。7月30日の値下げでLunaがこの帯の先頭に来たので、規約・リージョンの確認で止まっていた案件は組み直す価値があります。コーディング品質を数字で選ぶならSWE-Bench Pro首位のFable 5、コスト込みの現実解はSolかSonnet 5です(本紙ツギノテの自動発行もこの「安い段から」の考え方で動いています)。迷ったら、8月末までのSonnet 5導入価格($2/$10)が今期いちばんの「試しどき」。中国系モデル(Kimi/DeepSeek)は価格性能比が魅力ですが、業務データを入れる前に取り扱い規約とリージョンの確認だけは省かないでください。
直接対決表(Opus 5 リリース時の公表比較+他社を同じ行に)
Anthropicがリリース時に出した比較表の指標に、他社モデルの公表値・独立計測を同じ行へ並べたものです(2026-07-24発表分)。空欄は「その指標での公表値が見つからないだけ」で、弱いという意味ではありません。
| 指標(何を測るか) | Claude Opus 5 | Claude Fable 5 | GPT-5.6 Sol | その他 |
|---|---|---|---|---|
| FrontierBench v0.1 端末上の自律コーディング(74課題) | 43.3%max/xhigh時44.4% | 33.7% | 37.5% | Opus 4.8: 18.7% |
| SWE-Bench Verified 検証済みタスクのコード修正 | 96.0% | 95.0% | 96.2% | GPT-5.6 Luna: 93.0% |
| SWE-Bench Pro 実務条件に近い難条件 | 79.2% | 80.0% | 64.6%独立計測 | |
| SWE-Bench Multimodal 画面・図を含む開発 | 59.4% | Opus 4.8: 38.4% | ||
| OSWorld 2.0 PC操作の自律実行 | 70.6% | Opus 4.8: 55.7% | ||
| Zapier AutomationBench 業務自動化の組み立て | 26.0%medium時24%/1課題$0.89 | 17.4% | Opus 4.8: 17.0% | |
| ARC-AGI-3 未知パターンへの一般化 | 30.16%high・ARC財団検証 | 7.78% | Opus 4.8: 1.52% | |
| Humanity's Last Exam 専門家水準の総合難問 | 56.3%ツール併用64.7% | Gemini 3.1 Pro: 44.4% | ||
| GPQA Diamond 大学院レベルの科学知識 | ほぼ互角との評 | Gemini 3.1 Ultra/Pro: 94.3/94.1%/Opus 4.8: 93.6% | ||
| GDPval-AA v2(Elo) 実務タスクの総合評価 | 1,861 / 1,827上位2枠を独占 | Sonnet 5: 1,618/Opus 4.8: 1,615 | ||
| 間接プロンプトインジェクション 攻撃成功率(低いほど安全) | 2.0%15回試行内・Gray Swan | 20.0% | Mythos 5: 2.6%/Opus 4.8: 5.5% | |
| IMO 2026(数学五輪) 6問・ツールなし | 42/42金メダル水準(基準29) |
※ 読み方のコツ:Opus 5の勝ちは「自律的に手を動かす」系(端末作業・PC操作・業務自動化・未知パターン)に集中しています。逆に一問一答の知識テスト(GPQA)はGemini勢が強く、SWE-Bench Proのような難条件コード修正はFable 5がまだ上。用途が「調べる」ならGemini、「難コードを一撃で」ならFable 5、「まとめて作業させる」ならOpus 5、という読み替えが実用的です。Anthropicは自社の弱点(Opus 4.8より事実誤り=ハルシネーションがやや増加)も併せて公表しています。
ベンチマーク(公表値・独立計測の混在に注意)
| 指標 | 何を測るか | 現在の上位 |
|---|---|---|
| SWE-Bench Pro | 実務に近い難条件のソフトウェア開発 | Claude Fable 5: 80.0%(首位)/Claude Opus 5: 79.2%(半額で僅差)/GPT-5.6 Sol: 64.6%(独立トラッカー計測) |
| SWE-Bench Verified | 検証済みタスクでのコード修正 | GPT-5.6 Sol: 96.2%/Claude Opus 5: 96.0%/Claude Fable 5: 95.0%(ほぼ横並び) |
| GPQA Diamond | 大学院レベルの科学知識 | Gemini 3.1 Pro: 94.3%。SolとFable 5はほぼ互角との評 |
| Humanity's Last Exam | 専門家水準の総合難問 | Gemini 3.1 Pro: 44.4% |
| AA Intelligence Index | Artificial Analysisの総合指数 | Claude Fable 5がGPT-5.6 Solを1ポイント上回る(Sol: 59)。ただしSolのコストは約3分の1 |
| GDPval-AA v2 | 実務タスクのElo評価 | Claude Opus 5: 1,861/1,827(上位2枠を独占。xhighはmaxより出力トークン25%少なく上位)/Sonnet 5: 1,618/Opus 4.8: 1,615 |
※ ベンチマークは「どのテストを引用するか」で勝者が変わります。ベンダー公表値と独立計測が混在しているため、本表では計測元を明記しました。単一の数字でモデルを選ばないでください。
総合性能ランキング(独立集計)
| 順位 | モデル | スコア | 備考 |
|---|---|---|---|
| — | Claude Opus 5 NEW | 集計待ち | 7/24リリース。GDPval-AA v2では上位2枠を独占。同集計への反映待ち |
| 1 | Claude Mythos 5 | 64.5 | Fable 5と同系のAnthropic最上位モデル(承認組織向け提供版) |
| 2 | Claude Opus 4.8 | 57.9 | Opus 5が同価格で置き換え |
| 3 | Claude Sonnet 5 | 57.4 | 2位とほぼ互角。単価は半分以下($3/$15) |
| 4 | Gemini 3 Pro | 45.8 | |
| 5 | Gemini 3.1 Pro | 44.4 | |
| — | GPT-5.5/GPT-5.5 Pro | 40.2/43.1 | GPT-5.6(7月9日GA)は同集計に未反映。参考: Grok 4は21.6 |
※ 別集計のArtificial Analysis Intelligence IndexではClaude Fable 5がGPT-5.6 Solを1ポイント差で上回る接戦(Sol: 59)です。総合指数は「何をどう平均するか」で順位が入れ替わるため、順位そのものより点差の開き方(上位3つが僅差、以下に段差)を読むのが実用的です。
関連用語
検証税、GenAI Divide、ワークスロップ — 単価を下げても、出力の検品コストを設計しないと総コストは下がりません。
出典: Anthropic公式発表・Claude Opus 5 システムカード/MarkTechPost・TechCrunch・Quartz(2026-07-24 Opus 5リリースと各ベンチマーク値)/OpenAI公式発表(2026-07-09 GA)およびAI Pricing Guru・eesel AI(GPT-5.6料金)/BenchLM・AI Pricing Guru(Claude料金)/PC Watch・Google発表(Gemini 3.6 Flash)/Google Japan Blog「Gemini 3.7 Flash を発表」およびITmedia AI+(2026-08-14 Gemini 3.7 Flashの導入価格・期限・3.6 Flashへの同額適用・推論labor・仕様)/ITmedia AI+(2026-08-13 DeepSeekのAPI値上げ・ピーク時価格・適用時間帯・8/17午前1時JST適用)/devtk.ai(Gemini 3.1 Pro料金)/AI Pricing Guru・Fritz.ai(ChatGPTプラン)/ai-toolbox・tygartmedia(Claudeプラン)/costbench・eesel AI(Google AIプラン・Workspace)/felloai・ai-toolbox(Grokプラン・API)/BenchLM・NxCode(Kimi)/costbench(DeepSeek)/OpenAI公式「GPT-5.6」ページおよび price-performance 発表・CNBC・Axios(2026-07-30 Luna 80%・Terra 20%値下げとFast mode)/Anthropic公式価格ページ(Sonnet 5 導入価格の期限)/OANDA(2026-08-14 のドル円レート)/Vellum LLM Leaderboard(総合ランキング)/vals.ai・Artificial Analysis・TechTimes・emergent.sh(ベンチマーク)/OpenAI公式モデルページ developers.openai.com(2026-08-21 GPT-5.6 Sol価格改定・11月21日までの期間保証・対象範囲、2026-08-28閲覧)/xAI公式 docs.x.ai(2026-08-12 Grok 4.6・料金表、2026-08-28閲覧)/Perplexity公式 perplexity.ai/hub/pricing(2026-08-28閲覧)/Anthropic公式 platform.claude.com/docs/en/about-claude/pricing(Claude Sonnet 5導入価格の恒久化・9月1日値上げの取り消し、Claude Fable 5.1/Mythos 5.1の料金、2026-09-04閲覧)/OpenAI公式 openai.com/index/gpt-6-astra(2026-09-04発表・GPT-6 Astraの料金とベンチマーク、2026-09-05閲覧)。価格・スコアは変動します。契約前に必ず各社公式ページでご確認ください。
この早見表も、AIが毎週自動で点検・更新しています。同じ仕組みの構築相談は 構築の相談 へ。
