★
【2026-09-30 追加更新】9-09以降に登場した7モデルを追加しました(12→19モデル):Claude Opus 5.5(9-22)/Claude Sonnet 5.5(9-28)/GPT-6.1 Sol(9-29)/GPT-6 Sol・GPT-6 Luna(9-22)/Grok 4.7(9-21)/Gemini 3.8 Flash(9-02・前回の掲載漏れ)。
値はすべて artificialanalysis.ai の各モデル個別ページを直接取得した一次値(Intelligence Index v4.3.2)です。
★
既存12行の指数は9-09時点のまま据え置きです。指数のバージョンが v4.3 → v4.3.2 に上がっているため、上位(Astra・Fable 5.1=53)以外は再測定値と微差がある可能性があります(未再確認)。
★
未掲載: GPT-6 Terra(指数・価格を一次ページで確認できず)、Meta Muse Spark 1.3(48)・Xiaomi MiMo-V2.6-Pro(46)(本表の対象4社外)。
★ 旧モデルの行(GPT-5.6系・Sonnet 5・Grok 4.5・Gemini 3.6 Flash など)は比較用に残しています。
★ 参照データ更新日:
2026-07-17(初版。OpenAI、Anthropic、Google、SpaceXAIの主要モデルを統合)
★ 同日、Claude Opus 4.8 / GPT-5.5 / Gemini 3.1 Pro の3モデルを
artificialanalysis.ai の個別モデルページを一次情報として追加。あわせて既存7モデルを同サイトと突き合わせ、GPT-5.6 Solの総合知能指数を59→
58へ補正(価格は変更なし。ベンチマーク再評価による変動と見られる)。
★
2026-07-23、2026-07-21登場の
Gemini 3.6 Flash(high・reasoning版)を追加。知能指数50で自社の3.1 Pro(46)を上回りつつ、3.5 Flashより低価格($1.50/$7.50)。artificialanalysis.aiの個別モデルページを一次情報として採用。
★
【2026-09-09 全面更新】Intelligence Index を v4.1 → v4.3 へ切り替え、GPT-6 Astra を追加。
v4.3は10評価の合成(AA-Briefcase / GDPval-AA v2 / AutomationBench-AA / Terminal-Bench v4.0 / SciCode / Humanity's Last Exam
/ GDP.pdf / CritPt / AA-Omniscience / AA-LCR v1.1)で、
v4.1とはスケールが別物のため、旧版の数値との直接比較はできません。
出典はartificialanalysis.aiの各モデル個別ページを直接WebFetchした一次値のみを採用し、WebSearchのAI要約が示すバージョン混在の数値(例:
Grok 4.5=54点、Claude Opus 4.8=61.4点等)は不採用としました。
★
Coding Agent Index は12モデル全て「未確認」に統一しました。 リーダーボード(artificialanalysis.ai/agents/coding-agents)が
JS描画のため取得できず、旧v4.1時点の数値(例: GPT-5.6 Sol=80)をそのまま残すとバージョンが混在するため、正直に空欄化しています。
★
Claude Fable 5 → Claude Fable 5.1 に差し替え。 5.1がGPT-6 Astraと並ぶ現行の同点首位(53点)です。
★
価格も同時に再確認しています。 GPT-5.6 Sol/Terra/Luna・Gemini 3.6 Flashは前回掲載時より値下げされていました(詳細は各行の feature 欄)。
★ 価格・モデル構成・ベンチマークは短期間で変わるため、
利用前に公式ページを再確認してください。
★ ※ Claude Sonnet 5 の単価$2.00/$10.00は、2026-09-09時点でartificialanalysis.aiに表示されている現行の通常価格です(旧行にあった「8/31までの導入価格・通常$3/$15」という期限表記は、現行ページ上では確認できませんでした)。
★ ※ GPT-5.6の価格は通常コンテキスト帯。長文帯では価格が上がる場合があります。
★ ※ 簡易混合価格は「入力80%・出力20%」での架空の計算値です。