AIモデル比較・検討

,

AIモデル一覧

AIモデル実行アプリケーション

AIモデル比較・動向

AIモデルランキング


チャット、コードベースの分野では、ChatGPTやGeminiを抑えClaudeのOpus 4.6の評価が一番高くなっています(あくまで投稿時点での評価です)。


コーディング(プロプライエタリ + オープンソース)

View overall rankings across AI models on agentic coding tasks involving multi-step reasoning and tool use.

Rank Model Score Price $/M Context
1 claude-opus-4-6-thinking Anthropic · Proprietary 1546+12/-12 $5 / $25 1M
2 claude-opus-4-6 Anthropic · Proprietary 1543+11/-11 $5 / $25 1M
3 claude-sonnet-4-6 Anthropic · Proprietary 1521+9/-9 $3 / $15 1M
4 claude-opus-4-5-20251101-thinking-32k Anthropic · Proprietary 1491+7/-7 $5 / $25 200K
5 claude-opus-4-5-20251101 Anthropic · Proprietary 1465+7/-7 $5 / $25 200K
6 gpt-5.4-high (codex-harness) OpenAI · Proprietary 1457+17/-17 N/A N/A
7 gemini-3.1-pro-preview Google · Proprietary 1456+9/-9 $2 / $12 1M
8 qwen3.6-plus-preview Alibaba · Proprietary 1454+19/-19 Preliminary $0.33 / $1.95 1M
9 glm-5 Z.ai · MIT 1441+10/-10 $1 / $3.20 202.8K
10 glm-4.7 Z.ai · MIT 1439+10/-10 $0.39 / $1.75 202.8K

コーディング(オープンソースに限定)

Rank Overall Rank Model Score Price $/M Context
1 9 glm-5 Z.ai · MIT 1441+10/-10 $1 / $3.20 202.8K
2 10 glm-4.7 Z.ai · MIT 1439+10/-10 $0.39 / $1.75 202.8K
3 14 kimi-k2.5-thinking Moonshot · Modified MIT 1429+8/-8 $0.60 / $3 N/A
4 17 kimi-k2.5-instant Moonshot · Modified MIT 1408+11/-11 $0.38 / $1.72 262.1K
5 20 minimax-m2.5 MiniMax · Modified MIT 1396+8/-8 $0.12 / $0.99 196.6K
6 22 minimax-m2.1-preview MiniMax · MIT 1391+8/-8 $0.27 / $0.95 196.6K
7 26 qwen3.5-397b-a17b Alibaba · Apache 2.0 1386+9/-9 $0.39 / $2.34 262.1K
8 31 deepseek-v3.2-thinking DeepSeek · MIT 1368+8/-8 $0.26 / $0.38 163.8K
9 32 qwen3.5-122b-a10b Alibaba · Apache 2.0 1362+10/-10 $0.26 / $2.08 262.1K
10 33 glm-4.6 Z.ai · MIT 1354+9/-9 $0.39 / $1.90 204.8K

チャット(テキストベース、プロプライエタリ + オープンソース)

Rank Model Score Price $/M Context
1 claude-opus-4-6-thinking Anthropic · Proprietary 1503±5 $5 / $25 1M
2 claude-opus-4-6 Anthropic · Proprietary 1497±5 $5 / $25 1M
3 gemini-3.1-pro-preview Google · Proprietary 1493±5 $2 / $12 1M
4 grok-4.20-beta1 xAI · Proprietary 1490±7 N/A N/A
5 gemini-3-pro Google · Proprietary 1486±4 $2 / $12 1M
6 gpt-5.4-high OpenAI · Proprietary 1484±7 $2.50 / $15 1.1M
7 grok-4.20-beta-0309-reasoning xAI · Proprietary 1480±6 $2 / $6 2M
8 gpt-5.2-chat-latest-20260210 OpenAI · Proprietary 1477±5 $1.75 / $14 128K
9 grok-4.20-multi-agent-beta-0309 xAI · Proprietary 1475±6 $2 / $6 2M
10 gemini-3-flash Google · Proprietary 1474±4 $0.50 / $3 1M

チャット(テキストベース、オープンソース限定)

Rank Overall Rank Model Score Price $/M Context
1 14 glm-5.1 Z.ai · MIT 1467±9 $1.40 / $4.40 202.8K
2 23 glm-5 Z.ai · MIT 1456±6 $1 / $3.20 202.8K
3 25 kimi-k2.5-thinking Moonshot · Modified MIT 1452±5 $0.60 / $3 N/A
4 29 gemma-4-31b Google · Apache 2.0 1451±8 Preliminary $0.14 / $0.40 262.1K
5 33 qwen3.5-397b-a17b Alibaba · Apache 2.0 1448±5 $0.39 / $2.34 262.1K
6 39 glm-4.7 Z.ai · MIT 1443±6 $0.39 / $1.75 202.8K
7 43 gemma-4-26b-a4b Google · Apache 2.0 1438±8 Preliminary N/A N/A
8 47 kimi-k2.5-instant Moonshot · Modified MIT 1433±7 $0.38 / $1.72 262.1K
9 50 kimi-k2-thinking-turbo Moonshot · Modified MIT 1430±4 $1.15 / $8 262.1K
10 53 glm-4.6 Z.ai · MIT 1426±4 $0.39 / $1.90 204.8K