XSCT Bench AI モデルランキング
実際のシナリオに基づく AI モデル評価とランキング
もっと詳しく
XSCT Bench とは?
XSCT Bench は独立運営の AI モデル評価プラットフォームです。実際のビジネスシナリオでモデルをテストし、ユーザーが自分のニーズに最適な AI モデルを見つけるお手伝いをします。
現在のランキング
以下は総合、基本、上級、極限の4つの難易度レベルでの AI モデルランキングです:
トップ 20 モデル
- doubao-seed-2-1-pro - 総合:91.6 点 - 基礎:93.8 点 - 応用:91.5 点 - 難関:89.5 点
- Anthropic: Claude Sonnet 4.6 - 総合:90.3 点 - 基礎:90.7 点 - 応用:90.3 点 - 難関:89.8 点
- Gpt 5.5 - 総合:89.4 点 - 基礎:90.2 点 - 応用:89.3 点 - 難関:88.8 点
- Claude Opus 4.6 - 総合:89.1 点 - 基礎:90.8 点 - 応用:89.1 点 - 難関:87.5 点
- gpt-5.6-sol - 総合:88.9 点 - 基礎:89.8 点 - 応用:88.7 点 - 難関:88.2 点
- qwen3.8-max - 総合:88.7 点 - 基礎:89.5 点 - 応用:88.5 点 - 難関:88.2 点
- grok-4.5 - 総合:88.4 点 - 基礎:89.4 点 - 応用:88.2 点 - 難関:87.7 点
- qwen3.6-plus-preview - 総合:88.3 点 - 基礎:89.8 点 - 応用:88.1 点 - 難関:87.2 点
- Tencent: Hy3 preview (free) - 総合:87.8 点 - 基礎:88.9 点 - 応用:87.4 点 - 難関:87.1 点
- kimi-for-coding - 総合:87.7 点 - 基礎:89.0 点 - 応用:87.7 点 - 難関:86.6 点
- deepseek-v4-pro - 総合:87.7 点 - 基礎:89.1 点 - 応用:87.4 点 - 難関:86.5 点
- GLM-5v-turbo - 総合:87.7 点 - 基礎:89.0 点 - 応用:87.4 点 - 難関:86.5 点
- OpenAI: GPT-5.4 - 総合:87.1 点 - 基礎:87.5 点 - 応用:87.2 点 - 難関:86.7 点
- kimi-k3 - 総合:86.9 点 - 基礎:87.8 点 - 応用:86.8 点 - 難関:85.9 点
- kimi-k2-thinking-turbo - 総合:86.8 点 - 基礎:87.8 点 - 応用:86.5 点 - 難関:86.1 点
- Qwen 3.7 Max - 総合:86.7 点 - 基礎:88.6 点 - 応用:86.4 点 - 難関:85.2 点
- Claude Opus 4 7 - 総合:86.5 点 - 基礎:87.7 点 - 応用:86.4 点 - 難関:85.3 点
- kimi-k2.6 - 総合:86.3 点 - 基礎:87.2 点 - 応用:86.1 点 - 難関:85.7 点
- GPT-5.2 - 総合:86.3 点 - 基礎:86.8 点 - 応用:86.3 点 - 難関:85.7 点
- qwen3.5-plus-2026-02-15 - 総合:86.3 点 - 基礎:88.3 点 - 応用:86.1 点 - 難関:84.5 点