人工知能評価指標のベンチマークテスト「Intelligence Index」が、Artificial Analysisによりバージョン4.2へと更新されました。今回の改訂では、評価に用いる非公開データの比率が従来の2倍に増やされ、評価の公正性と実用性が高められています。ITmedia AI+が報じています。

さらに、実際の利用に近い評価項目が追加されることで、AIモデルの性能をより実践的に測定可能となりました。最新のランキングでは、Claude Fable 5.1が首位に立ち、続いてGPT-6 Astraが高評価を獲得しています。

日本市場においても、こうした高度なAI評価指標の進化は、FXや暗号資産、株式取引におけるAI活用の信頼性向上に寄与することが期待されます。