{
    "data": {
        "run_id": 331,
        "run_date": "2026-09-20",
        "benchmark_version": "v7",
        "rankings": [
            {
                "model_slug": "grok-4",
                "model_name": "Grok 4",
                "dcd_raw": 91.76,
                "rank": 1,
                "dcd_r1_score": 1,
                "dcd_r2_score": 0.88,
                "dcd_r3_score": 1.25,
                "core_overall_display": 79.55,
                "main_rank": 2,
                "rank_diff_vs_main": 1
            },
            {
                "model_slug": "gemini-3.1-pro",
                "model_name": "Gemini 3.1 Pro",
                "dcd_raw": 89.59,
                "rank": 2,
                "dcd_r1_score": 1,
                "dcd_r2_score": 0.88,
                "dcd_r3_score": 1.38,
                "core_overall_display": 70.67,
                "main_rank": 7,
                "rank_diff_vs_main": 5
            },
            {
                "model_slug": "gpt-o3",
                "model_name": "GPT-o3",
                "dcd_raw": 87.86,
                "rank": 3,
                "dcd_r1_score": 0.88,
                "dcd_r2_score": 0.88,
                "dcd_r3_score": 0.75,
                "core_overall_display": 76.61,
                "main_rank": 5,
                "rank_diff_vs_main": 2
            },
            {
                "model_slug": "claude-opus-4.7",
                "model_name": "Claude Opus 4.7",
                "dcd_raw": 83.97,
                "rank": 4,
                "dcd_r1_score": 1,
                "dcd_r2_score": 0.75,
                "dcd_r3_score": 1.25,
                "core_overall_display": 80.07,
                "main_rank": 1,
                "rank_diff_vs_main": -3
            },
            {
                "model_slug": "deepseek-v4-pro",
                "model_name": "DeepSeek V4 Pro",
                "dcd_raw": 83.62,
                "rank": 5,
                "dcd_r1_score": 1,
                "dcd_r2_score": 0.75,
                "dcd_r3_score": 1.13,
                "core_overall_display": 69.85,
                "main_rank": 9,
                "rank_diff_vs_main": 4
            },
            {
                "model_slug": "gemini-2.5-pro",
                "model_name": "Gemini 2.5 Pro",
                "dcd_raw": 81.1,
                "rank": 6,
                "dcd_r1_score": 1,
                "dcd_r2_score": 0.63,
                "dcd_r3_score": 1.25,
                "core_overall_display": 65.28,
                "main_rank": 10,
                "rank_diff_vs_main": 4
            },
            {
                "model_slug": "doubao-pro",
                "model_name": "豆包 Pro",
                "dcd_raw": 79.69,
                "rank": 7,
                "dcd_r1_score": 0.63,
                "dcd_r2_score": 0.88,
                "dcd_r3_score": 1.13,
                "core_overall_display": 72.01,
                "main_rank": 6,
                "rank_diff_vs_main": -1
            },
            {
                "model_slug": "claude-sonnet-4.6",
                "model_name": "Claude Sonnet 4.6",
                "dcd_raw": 78.69,
                "rank": 8,
                "dcd_r1_score": 1,
                "dcd_r2_score": 0.75,
                "dcd_r3_score": 0.88,
                "core_overall_display": 76.83,
                "main_rank": 4,
                "rank_diff_vs_main": -4
            },
            {
                "model_slug": "qwen3-max",
                "model_name": "Qwen3 Max",
                "dcd_raw": 76.48,
                "rank": 9,
                "dcd_r1_score": 1,
                "dcd_r2_score": 0.88,
                "dcd_r3_score": 1,
                "core_overall_display": 70,
                "main_rank": 8,
                "rank_diff_vs_main": -1
            },
            {
                "model_slug": "gpt-5.5",
                "model_name": "GPT-5.5",
                "dcd_raw": 73.76,
                "rank": 10,
                "dcd_r1_score": 1,
                "dcd_r2_score": 0.63,
                "dcd_r3_score": 0.88,
                "core_overall_display": 77.79,
                "main_rank": 3,
                "rank_diff_vs_main": -7
            },
            {
                "model_slug": "glm-4.6",
                "model_name": "GLM-4.6",
                "dcd_raw": 61.55,
                "rank": 11,
                "dcd_r1_score": 0,
                "dcd_r2_score": 0,
                "dcd_r3_score": 0,
                "core_overall_display": 0,
                "main_rank": 11,
                "rank_diff_vs_main": 0
            }
        ]
    },
    "meta": {
        "experimental": true,
        "experimental_note": "WDCD is an experimental dimension introduced in v7. Data is being collected and stabilized. Not yet counted in main leaderboard.",
        "experimental_since": "2026-05-01",
        "stability_assessment_date": "2026-08-01",
        "total_questions": 30,
        "total_models": 11,
        "subtypes": [
            "data_boundary",
            "resource_limit",
            "business_rule",
            "security",
            "engineering"
        ]
    }
}