総合ランキングへ戻る
GPT-5.2 2025-12-11
OpenAI · 2025-12 公開 · 10/7(水) 14:05 更新
総合28.4総合ランキングの 30位より下
カテゴリの成績2/ 4 カテゴリ
成績のある評価15評価
コンテキスト長不明トークン
能力ごとの順位
能力は別々に計算します。十分な実測がないものは、空欄のままです。
コーディング証拠が足りません不明比べられる成績がまだありません推論22位63.95 評価が支えています知識30位より下29.82 評価が支えています業務証拠が足りません不明比べられる成績がまだありません
カテゴリごとの点数は、それぞれの比較グループの中での並びを表します。足し合わせたり、能力ごとの絶対的な高低を比べたりはできません。
総合順位の安定度
評価や機関を 1 つずつ外し、重みや誤差の扱いを変えたときの、順位の動きを見ます。
資格を確かめ直したときの順位31〜54位敏感
終わった比較では、どれも評価の資格がありました。候補を変えない場合は 32〜54位です。この範囲は信頼区間ではなく、公開されていない成績も含みません。
成績の出どころ
このモデルの公開されている成績です。開くと、実行の設定と採り方が見られます。
総合評価と使い心地6評価
コーディング1評価
推論5評価
知識2評価
視覚理解1評価
測られていない評価
これらの評価は、このモデルの成績を公開していません。未測は 0 点にしません。
まだ分かっていないこと
足りない評価は 0 点にしません。新しい証拠が入ると順位は変わります。点数が近いときは、小さな差を読みすぎないでください。
計算方法 →