AIモデルランキング

17種類のベンチマークによるAIモデル総合ランキング。カテゴリ別に詳細な比較が可能です。

総合ランキング

HLE、ARC-AGI-2、FrontierMath、SWE-bench、τ²-Bench の総合スコア

960 件のモデル

#モデル名開発元オープンソース
1Claude Mythos PreviewAnthropic64.793.9クローズド
2Muse Spark 1.1Meta AI62.1クローズド
3Claude Fable 5Anthropic59.095.0クローズド
4GPT-5.4 ProOpenAI58.783.338.0クローズド
5Muse SparkMeta AI58.042.514.677.4クローズド
6Claude Opus 4.8Anthropic57.988.6クローズド
7Claude Sonnet 5Anthropic57.485.2クローズド
8GPT-5.5 ProOpenAI57.284.639.6クローズド
9Kimi K3Moonshot AI56.0クローズド
10GLM-5.2Zhipu AI54.7クローズド
11Opus 4.7Anthropic54.775.822.987.6クローズド
12Kimi K2.6Moonshot AI54.080.2クローズド
13Qwen3.7-Max-Previewアリババ53.580.4クローズド
14Hy3テンセントAI研究所53.278.0クローズド
15Claude Opus 4.6Anthropic53.066.322.975.691.9クローズド
16GLM 5.1Zhipu AI52.3クローズド
17GPT-5.5OpenAI52.285.035.4クローズド
18GPT-5.4OpenAI52.177.127.1クローズド
19Gemini 3.1 Pro PreviewGoogle DeepMind51.477.116.780.690.8クローズド
20Kimi K2 ThinkingMoonshot AI51.071.3クローズド
21Qwen 3.6 Plus Previewアリババ50.678.8クローズド
22GLM-5Zhipu AI50.44.92.172.889.7クローズド
23Kimi K2.5Moonshot AI50.211.84.270.8クローズド
24Qwen3.6-Max-Previewアリババ50.278.8クローズド
25GPT-5.2 ProOpenAI50.054.231.3クローズド
26Qwen3-Max-Thinkingアリババ49.875.382.1クローズド
27Claude Sonnet 4.6Anthropic49.058.38.379.6クローズド
28Qwen3.5-27Bアリババ48.572.479.0クローズド
29Gemini 3 Deep Think - 2620Google DeepMind48.484.6クローズド
30Qwen3.5-397B-A17Bアリババ48.376.486.7クローズド