Claude Opus 5が人工分析インテリジェンスリーダーボードで1位を獲得
Opus 5 is currently #1 on Artificial Analysis Intelligence Leaderboard
Claude Opus 5 (Adaptive Reasoning, Max Effort)が、評価された170モデル中61点を獲得し、人工分析インテリジェンスインデックスで首位に立った。2位はClaude Opus 5 (Adaptive Reasoning, Xhigh Effort) (60点)、3位はClaude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) (60点)だった。速度面では、Mercury 2が938.7トークン/秒で最速であり、次いでHyperNova 60B 2605 (436.2 t/s)、Granite 4.0 H Small (431.0 t/s)が続いた。コスト面では、Gemma 3n E4B Instructが100万トークンあたり$0.02で最も安価であり、次いでNova Micro ($0.03)、Sarvam 30B (high) ($0.03)だった。初回応答速度(First Token)では、Gemini 2.5 Flash-Lite (Non-reasoning)が0.35秒で最も速かった。オープンウェイトモデルでは、GLM-5.2 (max)がインテリジェンスインデックスで51点を獲得し、最高位のオープンウェイトモデルとなった。評価は、インテリジェンス(品質)、価格、出力速度、レイテンシ、エンドツーエンド応答時間、コンテキストウィンドウサイズなど、複数の次元で測定されている。
- Claude Opus 5 (Adaptive Reasoning, Max Effort) が人工分析インテリジェンスリーダーボードで170モデル中61点を獲得し1位を獲得した
- Open-weightモデルではGLM-5.2 (max) が51点で最高位となった
- Mercury 2が938.7トークン/秒で最速、Gemma 3n E4B Instructが100万トークンあたり$0.02で最も安価
Claude Opus 5が新たなベンチマークリーダーボードで1位を獲得したことは、AnthropicのAIモデル競争力が依然として業界トップ級であることを示している。同時に、Open-weightモデルのGLM-5.2が追従しており、オープンモデルの性能向上も無視できない。また、Mercury 2の速度やGemma 3nのコスト競争力など、モデルごとに差別化軸が明確化している点は、AI業界への投資判断において重要。インフラ投資・推論最適化・モデル選定の観点で、単一の評価指標ではなく用途に応じた多軸評価が必要であることを示唆している。