DATA — 定点観測 TSUGINOTE AI NEWSROOM

LAST UPDATED: 2026-09-05 / 毎週金曜の週刊タスクで点検・更新、変更があった日は随時追記(9/5:OpenAIのGPT-6 Astraを追加。円換算は1ドル=159.5円(8/14時点)を据え置き)

生成AIモデル料金比較・早見表

ChatGPT・Claude・Gemini・Grok・Kimiほか主要モデルの月額プラン・性能ランキング・API単価を1枚に置いておく定点観測ページです。個人での契約、チーム・会社への導入、開発でのAPI利用のどれでも、ここから選べる順に並べました。円は1ドル=159.5円(2026年8月14日時点)での概算併記。変わった数字だけを毎週差し替えます。

API料金(開発者向け・100万トークンあたり・米ドル・標準レート)

API PRICING — AS OF 2026-09-05
モデル入力出力位置づけ・備考
OPENAI
GPT-6 Astra NEW
$10.00約1,595円$50.00約7,975円2026年9月4日発表。コーディング・エージェント・科学知識で新フラッグシップ。Fast modeは2倍速・2倍単価($20/$100)。キャッシュ料金は別途設定されるが、発表ページに具体的な倍率の記載はなし。数日内にChatGPT全プラン・API・Azure・Bedrockへ拡大予定
OPENAI
GPT-5.6 Sol
$4.00約638円$20.00約3,190円2026年8月21日、期間限定で20%/33%値下げ(旧$5.00/$30.00)。少なくとも11月21日まで最低保証。対象はAPI・Codexクレジット・対象のChatGPT Workプランのみで、ChatGPT Plus/Pro/Businessの個人向け契約は対象外。フラッグシップ。2026年7月9日GA。コンテキスト約100万・出力最大12.8万トークン。キャッシュ入力$0.40。Priority Processingは7月30日にFast modeへ置き換わっており、標準の2倍単価(今回の値下げ後は$8/$40)
OPENAI
GPT-5.6 Terra
$2.00約319円$12.00約1,914円2026年7月30日に20%値下げ(旧 $2.50/$15.00)。バランス型の中位グレード。期限のない標準単価の改定
OPENAI
GPT-5.6 Luna
$0.20約32円$1.20約191円2026年7月30日に80%値下げ(旧 $1.00/$6.00)。最安・高速。大量処理の既定候補。入力単価はDeepSeek V4 Proを下回る
ANTHROPIC
Claude Opus 5 NEW
$5.00約798円$25.00約3,988円2026年7月24日リリース。Fable 5に迫る性能を半額で。コンテキスト100万トークン(既定=上限)、思考が既定オン+effort(low/medium/high/xhigh/max)で深さ調整。Fast modeは$10/$50で約2.5倍速。Maxの既定・Proの最上位モデル
ANTHROPIC
Claude Fable 5.1 NEW
$10.00約1,595円$50.00約7,975円2026年9月1日公開、Claude Codeの既定モデルに設定。単価はFable 5と同額だが、キャッシュ読み取りが標準の0.1倍でなく0.025倍と有利($0.25/MTok)。限定提供の姉妹モデルClaude Mythos 5.1も同額帯
ANTHROPIC
Claude Fable 5
$10.00約1,595円$50.00約7,975円6月投入のプレミア帯。SWE-Bench Proではなお首位(80.0%)だが、多くの用途でOpus 5が半額で並ぶ。キャッシュ読み取りは標準の0.1倍
ANTHROPIC
Claude Opus 4.8
$5.00約798円$25.00約3,988円前フラッグシップ。Opus 5が同価格で置き換え(移行推奨)
ANTHROPIC
Claude Sonnet 5
$2.00約319円$10.00約1,595円主力中位。導入価格($2/$10)が恒久化。予告されていた9月1日の$3/$15への引き上げは実施されないとAnthropic公式ページが明記(本紙が8/28時点で書いた「9月1日から$3/$15に戻る」は誤りだったため訂正)
ANTHROPIC
Claude Haiku 4.5
$1.00約160円$5.00約798円最安帯
GOOGLE
Gemini 3.1 Pro
$2.00約319円$12.00約1,914円20万トークン超の長文は $4/$18 に上がる。思考トークンも出力課金される点に注意
GOOGLE
Gemini 3.7 Flash NEW
$0.75約120円$3.75約598円2026年8月13日(現地時間)公開。3.6 Flashからわずか3週間。この$0.75/$3.75は2026年12月31日までの導入価格で、2027年1月1日から $1.50/$7.50 に戻る(入力・出力とも2倍)。同じ導入価格が3.6 Flashにも適用されるので、年内は両モデルが同額。文脈100万トークン・出力最大6万4000トークン。推論の労力はlow/medium/highの3段階(既定medium・highはトークン消費とコストが増える)
GOOGLE
Gemini 3.6 Flash
$0.75約120円$3.75約598円2026年7月21日公開。3.7 Flashと同じ導入価格が2026年12月31日まで適用(2027年1月1日から $1.50/$7.50)。年内は3.7 Flashと同額なので、乗り換えは価格ではなく性能で判断できる
GOOGLE
Gemini 3.5 Flash-Lite
$0.30約48円$2.50約399円最軽量帯
XAI
Grok 4.6 NEW
$2.00約319円$6.00約957円2026年8月12日リリース。コンテキスト50万、入出力単価はGrok 4.5と同額。キャッシュ入力は$0.50(4.5の$0.30から上昇)。20万トークン超の長文は$4.00/$1.00/$12.00。データ共有プログラム参加で毎月最大$175の無料APIクレジット
XAI
Grok 4.5
$2.00約319円$6.00約957円前世代。Grok 4.6と同額帯だが、キャッシュ入力は$0.30(85%引)とやや安い
MOONSHOT
Kimi K3
$3.00約478円$15.00約2,392円2026年7月公開の最新フラッグシップ
MOONSHOT
Kimi K2.5
$0.60約96円$3.00約478円K2系はオープンウェイト。自前ホスティングや他社経由の提供もあり
ALIBABA
Qwen3.8-Max NEW
$2.00約319円$6.00約957円2026年8月3日正式リリース。総パラメータ2.4兆(アクティブ95B)、文脈100万トークン、画像・動画入力に対応。提供はQwenCloudのAPIのみで、オープンウェイトは同時に予告された27B版を含め公開待ち(ライセンス条文は未公表)
DEEPSEEK
DeepSeek V4 Pro
$0.66約105円$1.98約316円2026年8月17日午前1時(JST)から値上げ。入力はキャッシュミス時$0.66/キャッシュヒット時$0.022(約4円)。従来比で入力約12.1倍(ヒット)・約3.0倍(ミス)、出力約4.5倍。さらにピーク時価格(通常の2倍)を新設し、適用は日本時間10時〜13時と15時〜19時——日本の業務時間とほぼ重なるので、対話用途は2倍側から始まる前提で積む。中国系のため入力データの取り扱い・利用規約は導入前に要確認
DEEPSEEK
DeepSeek V4 Flash
$0.22約35円$0.66約105円値上げ後の廉価版(2026年8月17日午前1時JSTから)。入力はキャッシュミス時$0.22/キャッシュヒット時$0.007(約1円)。ピーク時価格(10時〜13時・15時〜19時JST)は同じく2倍

※ 表の見方: 実務のコストはたいてい出力側の単価×出力量で決まります。さらに各社とも割引レバーがあり、プロンプトキャッシュで入力最大90%減(OpenAIはキャッシュ書き込みに1.25倍課金)、バッチ処理でOpenAI/Anthropic/Googleとも約50%減。「定価で常用する」設計がいちばん損です。

月額プラン(個人・チーム/米ドル)

SUBSCRIPTIONS — AS OF 2026-07-23
プラン月額備考
OPENAI
ChatGPT Go/Plus
$8/$20約1,276円/約3,190円Goは2026年に新設された廉価枠
OPENAI
ChatGPT Pro
$100/$200約15,950円/約31,900円$100が5倍・$200が20倍の利用枠
OPENAI
ChatGPT Business
$25/席約3,988円/席旧Team($30)を2026年4月2日に置き換え。年払いなら$20/席(約3,190円)、最低2席。Enterpriseは個別見積
ANTHROPIC
Claude Pro
$20約3,190円個人の標準枠
ANTHROPIC
Claude Max
$100/$200約15,950円/約31,900円$100が5倍・$200が20倍。月払いのみ(年割なし)。Claude Codeを日常的に回すならここ
ANTHROPIC
Claude Team
$25〜/席約3,988円〜/席Standard $25(年払い$20=約3,190円)/Premium $125(年払い$100=約15,950円)。最低5席、同一チームで両プラン混在可。Enterpriseは個別見積
GOOGLE
Google AI Plus/Pro
$4.99/$19.99約796円/約3,188円Plusは2026年6月に$7.99から値下げ
GOOGLE
Google AI Ultra
$99.99/$199.99約15,948円/約31,898円旧$249.99から改定。$99.99が5倍・$199.99が20倍の利用枠
GOOGLE
Workspace(Gemini同梱)
$7〜22/席約1,116〜3,509円/席Gemini単体アドオンは廃止され、Business Starter $7/Standard $14/Plus $22(年払い)にAI機能が同梱。Gmail・Docs等で使うだけならこれで足りる
XAI
SuperGrok/Heavy
$30/$300約4,785円/約47,850円SuperGrokは年払い$300/年(約17%引)あり。HeavyのみGrok 4.5フルアクセス+最大レート。X Premium+でも段階的に利用可
MOONSHOT
Kimi メンバーシップ
$19〜199約3,031〜31,741円無料枠あり。上位はKimi Code等の利用枠が拡大
DEEPSEEK
DeepSeek(チャット)
無料チャット利用は無料、課金はAPIのみ。業務データを入れる場合は取り扱い規約を要確認

※ チーム導入の比較ポイント: 3社とも「1人あたり月$20〜25」に収束していますが、性質が違います。ChatGPT Business・Claude TeamはAIチャットの席課金、WorkspaceはグループウェアにAIが同梱される形。すでにGWSを使っている組織は追加費用ゼロでGeminiが付いてくる一方、重い利用(開発・長文処理)は各社の上位枠(Pro/Max/Premium)が別途必要になります。最低席数(Business 2席・Team 5席)も小規模チームでは効いてきます。
※ 円表記は1ドル=159.5円(2026年8月14日時点)の参考換算です。日本からの契約では各社が別途円建て価格(税込・税別)を設定している場合があり、実際の請求額とは異なることがあります。

AIサービスの月額プラン(エージェント・検索・開発支援)

モデルそのものではなく、モデルを載せて売られているサービスの料金です。エージェント(Manus・Genspark ほか)、AI検索、コーディング支援など。トークン課金ではなく月額・クレジット制が中心なので、上のAPI料金表とは分けています。

SAAS · AIサービス — AS OF 2026-08-28
サービス月額備考
ANYSPHERE
Cursor
$20/$60/$200約3,190円/約9,570円/約31,900円コーディング支援。個人はPro $20/Pro+ $60(Proの3倍の利用上限)/Ultra $200(同20倍)の3段階+無料のHobby。チームはTeams $40/席。各プランに一定量のモデル使用量が含まれ、超過はオンデマンドの後払い課金。税別。公式料金ページで確認(2026年8月21日)
MANUS
Manus
$20/$40/$200約3,190円/約6,380円/約31,900円汎用エージェント。クレジット制で、$20=月4,000クレジット、$40=月8,000クレジット(使用量を自己設定できる枠)、$200=月40,000クレジット+無料クラウドコンピュータ。全プランに毎日300クレジットのリフレッシュ付与あり。年払いは17%引。公式料金ページで確認(2026年8月21日)
PERPLEXITY
Perplexity NEW
$0/$20/$200無料/約3,190円/約31,900円AI検索・エージェント。無料は上位モデルに週の利用上限つきでアクセス。Pro $20はComputer機能の拡張・4,000クレジット付与・Deep Research・上位モデルの選択が可能。Max $200はComputerを無制限級まで拡張し、月10,000クレジット+一時金35,000クレジットを付与(クレジットは主にComputerの実行回数を消費)。年払いはPro機能相当が実質$200/年(月換算約$16.67)。公式料金ページで確認(2026年8月28日)

※ この枠は公式の料金ページで確認できた金額だけを載せます。まとめ記事や第三者サイトの数字は使いません(クレジット制のサービスは、同じ月額でも含まれる作業量が各社で違うため、金額だけの横並び比較は誤解を生みます。含まれるクレジットと、その消費単位も併記します)。

料金の変更履歴(ネダンログ)

上の2つの表が変わるたび、変わった行だけを機械が自動で記録しています。料金の「いま」は各社の公式ページにありますが、「いつ、いくらから、いくらに変わったか」はどこにも残りません。ここはその記録です。
購読:RSS/引用・再利用:JSON(出典として本ページのURLを明記してください)

PRICE LOG — 2026-09-07
記録日対象変更前変更後
2026-09-05API料金OPENAI / GPT-6 Astra入力 $10.00 / 出力 $50.00
2026-09-04API料金ANTHROPIC / Claude Fable 5.1入力 $10.00 / 出力 $50.00
2026-09-04API料金ANTHROPIC / Claude Sonnet 5$3.00$2.00
2026-09-04API料金ANTHROPIC / Claude Sonnet 5$15.00$10.00
2026-08-28API料金OPENAI / GPT-5.6 Sol$5.00$4.00
2026-08-28API料金OPENAI / GPT-5.6 Sol$30.00$20.00
2026-08-28API料金XAI / Grok 4.6入力 $2.00 / 出力 $6.00
2026-08-28AIサービス の月額プランPERPLEXITY / Perplexity月額 $0/$20/$200
2026-08-21AIサービス の月額プランANYSPHERE / Cursor月額 $20/$60/$200
2026-08-21AIサービス の月額プランMANUS / Manus月額 $20/$40/$200
2026-07-30API料金OPENAI / GPT-5.6 Terra$2.50$2.00
2026-07-30API料金OPENAI / GPT-5.6 Terra$15.00$12.00
2026-07-30API料金OPENAI / GPT-5.6 Luna$1.00$0.20
2026-07-30API料金OPENAI / GPT-5.6 Luna$6.00$1.20
2026-04-02月額プランOPENAI / ChatGPT Business$30/席$25/席

※ 直近20件を表示しています。全件は price-log.json にあります。記録日は本紙が差分を検出した日で、各社が改定を実施した日とは異なることがあります(実施日は各行の備考と該当の速報記事に書いています)。元の表の確認日 — API料金: 2026-09-05 / AIサービス の月額プラン: 2026-08-28 / 月額プラン: 2026-07-23

編集部の見立て — 立場からの逆算

2026年9月5日の追記。表に抜けていたOpenAIのGPT-6 Astra(9月4日発表)を追加しました。API標準単価は入力$10・出力$50で、9月1日に公開されたAnthropicのClaude Fable 5.1と同額です。Fast modeは2倍速・2倍単価($20/$100)。キャッシュ料金は別途設定されると発表ページに書かれていますが、具体的な倍率の記載は確認できませんでした。契約前にOpenAIの開発者向けドキュメントで数字を確認してください。

2026年9月4日の週次点検で、本紙自身の誤りを1件訂正します。先週(8/28)の点検で「Claude Sonnet 5は8月31日までの導入価格($2/$10)で、9月1日から$3/$15に戻る」と書きましたが、これは誤りでした。Anthropicは公式ページで、この導入価格が恒久化し、予告されていた9月1日の値上げは実施されないと明記しています。8月中旬時点ですでに据え置きが決まっていたとみられ、先週の点検はこれを取りこぼしたまま「値上げ予定」を前提に書いていました。Sonnet 5で見積もりを組んでいる場合、9月分の請求が$3/$15基準で来ることはありません。あわせて、AnthropicはClaude Fable 5.1とClaude Mythos 5.1(限定提供)を9月1日に公開し、Claude Codeの既定モデルに設定しました。単価はFable 5と同額($10/$50)ですが、キャッシュ読み取りが標準の0.1倍でなく0.025倍という違いがあります。プロンプトキャッシュを多用する構成では、単価表の「入力・出力」だけでなくキャッシュの列も見直してください。

2026年8月28日の週次点検。今週いちばん効くのはOpenAIのGPT-5.6 Solです。8月21日、入力$5.00→$4.00(20%減)・出力$30.00→$20.00(33%減)に値下げし、少なくとも11月21日までこの価格を保証すると明記しています。対象はAPI・Codexクレジット・対象のChatGPT Workプランのみで、ChatGPT Plus/Pro/Businessの個人契約は対象外です。API経由でSolを使っている見積もりは、いま計算し直す価値があります。あわせてxAIがGrok 4.6を8月12日に投入していたのを今週把握しました。入出力の単価は4.5と同額($2/$6)ですが、キャッシュ入力だけ$0.30から$0.50へ上がっています。プロンプトキャッシュを多用する設計は、単価表の「入力・出力」だけでなく「キャッシュ」の列も確認してください。AIサービスの表にPerplexityを追加しました。無料/Pro $20/Max $200の3段階で、ProとMaxの差はComputer機能のクレジット枠(Proは4,000付与、Maxは月10,000+一時金35,000)です。

2026年8月15日の臨時更新。8月13日から14日の48時間で、API単価が二方向に動きました。GoogleはGemini 3.7 Flashを$0.75/$3.75で公開——3.6 Flashの半額ですが、これは2026年12月31日までの導入価格で、2027年1月1日に$1.50/$7.50へ戻ります。年をまたぐ見積もりを平均単価ひとつで積むと、後半が半分になります。この導入価格は3.6 Flashにも適用されるので、年内は両モデルが同額——乗り換えを価格で急ぐ理由はありません。反対側で、DeepSeekは8月17日午前1時(JST)から値上げし、V4 Proの入力はキャッシュヒット時で従来の約12.1倍になります。効いてくるのは倍率よりも新設されたピーク時価格(通常の2倍)で、適用が日本時間10時〜13時と15時〜19時という点です。日本の業務時間とほぼ重なるので、対話用途は2倍側から始まる前提で積んでください。逆に実行時刻を選べるバッチ処理は、13時〜15時・夜間・早朝に寄せれば通常価格で通ります。8/15の速報で分けています。

2026年8月14日の更新で、この表の誤りを2行直しました。OpenAIは7月30日にGPT-5.6 Lunaを80%、Terraを20%値下げしています(Luna $1.00/$6.00 → $0.20/$1.20、Terra $2.50/$15.00 → $2.00/$12.00)。期限のない標準単価の改定で、前回8月7日の点検はこれを取りこぼしていました。単価表を信用してくださっている方に、7日間ぶん古い数字を出していたことをお詫びします。効いてくるのはLunaのほうです——入力$0.20は、これまで「最安帯」と書いてきたDeepSeek V4 Pro($0.435)より安い。大量処理を最安帯の中国系モデルで組む理由が、価格だけでは説明できなくなりました。あわせて同日、Priority ProcessingがFast mode(標準の2倍単価)に置き換わっています。旧来のpriorityフラグを立てたままのシステムは、黙って2倍の枠を買っている状態になるので、9月の請求を待たずに一度確かめてください。もう一つ日付を。Claude Sonnet 5の導入価格 $2/$10 は8月31日までで、9月1日から $3/$15 に戻ります(入力・出力とも50%増)。円換算のレートも1ドル=163円から159.5円へ改め、全行を計算し直しました。

2026年8月7日には、8/3に正式リリースされたAlibaba CloudのQwen3.8-Max($2/$6)を1行足しています。8月14日時点でも手に入るのはQwenCloudのAPIのみで、自社サーバーに置ける重みは公開待ち、ライセンス条文も出ていません。「オープン」の一語で選定を進めないでください8/4の速報で分けています)。

2026年7月25日時点の最大の変化は、7/24のClaude Opus 5です。Fable 5に迫る性能が半額($5/$25)で、しかも「まとめて作業させる」用途の数字が突出しています。Opus 4.8を使っていた人は同価格で乗り換えるだけで得。Fable 5を難コード用途で使っている人は、SWE-Bench Proだけまだ0.8ポイント差でFable 5が上、それ以外はOpus 5で足りる可能性が高いので、自分の主用途で1週間試して判断するのが賢い動きです。個人でまず1本選ぶなら、$20帯(ChatGPT Plus/Claude Pro/Google AI Pro)が基準線です。無料側を攻めるならDeepSeekのチャット無料と、Grokの開発者向け月$175無料クレジット(データ共有プログラム)が2026年夏時点の最大枠。チーム・会社への導入は、3社とも1人月$20〜25に収束しているので、価格より「席課金か、グループウェア同梱か」で選ぶのが実際的です。GWSを使っている組織はWorkspace同梱のGeminiが実質追加費用ゼロ。個人開発・API利用は、最安帯(GPT-5.6 Luna/Gemini Flash-Lite/DeepSeek V4 Flash/Kimi K2.5)でまず組み、品質が足りない工程だけ上位へ差し替える。7月30日の値下げでLunaがこの帯の先頭に来たので、規約・リージョンの確認で止まっていた案件は組み直す価値があります。コーディング品質を数字で選ぶならSWE-Bench Pro首位のFable 5、コスト込みの現実解はSolかSonnet 5です(本紙ツギノテの自動発行もこの「安い段から」の考え方で動いています)。迷ったら、8月末までのSonnet 5導入価格($2/$10)が今期いちばんの「試しどき」。中国系モデル(Kimi/DeepSeek)は価格性能比が魅力ですが、業務データを入れる前に取り扱い規約とリージョンの確認だけは省かないでください。

直接対決表(Opus 5 リリース時の公表比較+他社を同じ行に)

Anthropicがリリース時に出した比較表の指標に、他社モデルの公表値・独立計測を同じ行へ並べたものです(2026-07-24発表分)。空欄は「その指標での公表値が見つからないだけ」で、弱いという意味ではありません。

HEAD-TO-HEAD — AS OF 2026-07-25
指標(何を測るか)Claude Opus 5Claude Fable 5GPT-5.6 Solその他
FrontierBench v0.1
端末上の自律コーディング(74課題)
43.3%max/xhigh時44.4%33.7%37.5%Opus 4.8: 18.7%
SWE-Bench Verified
検証済みタスクのコード修正
96.0%95.0%96.2%GPT-5.6 Luna: 93.0%
SWE-Bench Pro
実務条件に近い難条件
79.2%80.0%64.6%独立計測
SWE-Bench Multimodal
画面・図を含む開発
59.4%Opus 4.8: 38.4%
OSWorld 2.0
PC操作の自律実行
70.6%Opus 4.8: 55.7%
Zapier AutomationBench
業務自動化の組み立て
26.0%medium時24%/1課題$0.8917.4%Opus 4.8: 17.0%
ARC-AGI-3
未知パターンへの一般化
30.16%high・ARC財団検証7.78%Opus 4.8: 1.52%
Humanity's Last Exam
専門家水準の総合難問
56.3%ツール併用64.7%Gemini 3.1 Pro: 44.4%
GPQA Diamond
大学院レベルの科学知識
ほぼ互角との評Gemini 3.1 Ultra/Pro: 94.3/94.1%/Opus 4.8: 93.6%
GDPval-AA v2(Elo)
実務タスクの総合評価
1,861 / 1,827上位2枠を独占Sonnet 5: 1,618/Opus 4.8: 1,615
間接プロンプトインジェクション
攻撃成功率(低いほど安全)
2.0%15回試行内・Gray Swan20.0%Mythos 5: 2.6%/Opus 4.8: 5.5%
IMO 2026(数学五輪)
6問・ツールなし
42/42金メダル水準(基準29)

※ 読み方のコツ:Opus 5の勝ちは「自律的に手を動かす」系(端末作業・PC操作・業務自動化・未知パターン)に集中しています。逆に一問一答の知識テスト(GPQA)はGemini勢が強く、SWE-Bench Proのような難条件コード修正はFable 5がまだ上。用途が「調べる」ならGemini、「難コードを一撃で」ならFable 5、「まとめて作業させる」ならOpus 5、という読み替えが実用的です。Anthropicは自社の弱点(Opus 4.8より事実誤り=ハルシネーションがやや増加)も併せて公表しています。

ベンチマーク(公表値・独立計測の混在に注意)

BENCHMARKS — AS OF 2026-07-23
指標何を測るか現在の上位
SWE-Bench Pro実務に近い難条件のソフトウェア開発Claude Fable 5: 80.0%(首位)/Claude Opus 5: 79.2%(半額で僅差)/GPT-5.6 Sol: 64.6%(独立トラッカー計測)
SWE-Bench Verified検証済みタスクでのコード修正GPT-5.6 Sol: 96.2%/Claude Opus 5: 96.0%/Claude Fable 5: 95.0%(ほぼ横並び)
GPQA Diamond大学院レベルの科学知識Gemini 3.1 Pro: 94.3%。SolとFable 5はほぼ互角との評
Humanity's Last Exam専門家水準の総合難問Gemini 3.1 Pro: 44.4%
AA Intelligence IndexArtificial Analysisの総合指数Claude Fable 5がGPT-5.6 Solを1ポイント上回る(Sol: 59)。ただしSolのコストは約3分の1
GDPval-AA v2実務タスクのElo評価Claude Opus 5: 1,861/1,827(上位2枠を独占。xhighはmaxより出力トークン25%少なく上位)/Sonnet 5: 1,618/Opus 4.8: 1,615

※ ベンチマークは「どのテストを引用するか」で勝者が変わります。ベンダー公表値と独立計測が混在しているため、本表では計測元を明記しました。単一の数字でモデルを選ばないでください。

総合性能ランキング(独立集計)

RANKING — VELLUM LLM LEADERBOARD, AS OF 2026-07-23
順位モデルスコア備考
Claude Opus 5 NEW集計待ち7/24リリース。GDPval-AA v2では上位2枠を独占。同集計への反映待ち
1Claude Mythos 564.5Fable 5と同系のAnthropic最上位モデル(承認組織向け提供版)
2Claude Opus 4.857.9Opus 5が同価格で置き換え
3Claude Sonnet 557.42位とほぼ互角。単価は半分以下($3/$15)
4Gemini 3 Pro45.8
5Gemini 3.1 Pro44.4
GPT-5.5/GPT-5.5 Pro40.2/43.1GPT-5.6(7月9日GA)は同集計に未反映。参考: Grok 4は21.6

※ 別集計のArtificial Analysis Intelligence IndexではClaude Fable 5がGPT-5.6 Solを1ポイント差で上回る接戦(Sol: 59)です。総合指数は「何をどう平均するか」で順位が入れ替わるため、順位そのものより点差の開き方(上位3つが僅差、以下に段差)を読むのが実用的です。

関連用語

検証税GenAI Divideワークスロップ — 単価を下げても、出力の検品コストを設計しないと総コストは下がりません。

出典: Anthropic公式発表・Claude Opus 5 システムカード/MarkTechPost・TechCrunch・Quartz(2026-07-24 Opus 5リリースと各ベンチマーク値)/OpenAI公式発表(2026-07-09 GA)およびAI Pricing Guru・eesel AI(GPT-5.6料金)/BenchLM・AI Pricing Guru(Claude料金)/PC Watch・Google発表(Gemini 3.6 Flash)/Google Japan Blog「Gemini 3.7 Flash を発表」およびITmedia AI+(2026-08-14 Gemini 3.7 Flashの導入価格・期限・3.6 Flashへの同額適用・推論labor・仕様)/ITmedia AI+(2026-08-13 DeepSeekのAPI値上げ・ピーク時価格・適用時間帯・8/17午前1時JST適用)/devtk.ai(Gemini 3.1 Pro料金)/AI Pricing Guru・Fritz.ai(ChatGPTプラン)/ai-toolbox・tygartmedia(Claudeプラン)/costbench・eesel AI(Google AIプラン・Workspace)/felloai・ai-toolbox(Grokプラン・API)/BenchLM・NxCode(Kimi)/costbench(DeepSeek)/OpenAI公式「GPT-5.6」ページおよび price-performance 発表・CNBC・Axios(2026-07-30 Luna 80%・Terra 20%値下げとFast mode)/Anthropic公式価格ページ(Sonnet 5 導入価格の期限)/OANDA(2026-08-14 のドル円レート)/Vellum LLM Leaderboard(総合ランキング)/vals.ai・Artificial Analysis・TechTimes・emergent.sh(ベンチマーク)/OpenAI公式モデルページ developers.openai.com(2026-08-21 GPT-5.6 Sol価格改定・11月21日までの期間保証・対象範囲、2026-08-28閲覧)/xAI公式 docs.x.ai(2026-08-12 Grok 4.6・料金表、2026-08-28閲覧)/Perplexity公式 perplexity.ai/hub/pricing(2026-08-28閲覧)/Anthropic公式 platform.claude.com/docs/en/about-claude/pricing(Claude Sonnet 5導入価格の恒久化・9月1日値上げの取り消し、Claude Fable 5.1/Mythos 5.1の料金、2026-09-04閲覧)/OpenAI公式 openai.com/index/gpt-6-astra(2026-09-04発表・GPT-6 Astraの料金とベンチマーク、2026-09-05閲覧)。価格・スコアは変動します。契約前に必ず各社公式ページでご確認ください。

この早見表も、AIが毎週自動で点検・更新しています。同じ仕組みの構築相談は 構築の相談 へ。