YZ Index
Changelog
Version history of the YZ Index evaluation system.
2026-07-29 05:11 SGT
SmokeEvaluation
Completed
WDCD smoke evaluation
2026-07-29 03:17 SGT
SmokeEvaluation
Completed
2026-07-28 03:17 SGT
SmokeEvaluation
Completed
2026-07-27 05:03 SGT
FullEvaluation
Completed
2026-07-27 03:13 SGT
SmokeEvaluation
Completed
2026-07-26 05:40 SGT
SmokeEvaluation
Completed
WDCD pilot evaluation
2026-07-26 03:26 SGT
SmokeEvaluation
Completed
2026-07-25 03:20 SGT
SmokeEvaluation
Completed
2026-07-24 03:26 SGT
SmokeEvaluation
Completed
2026-07-23 03:15 SGT
SmokeEvaluation
Completed
2026-07-22 05:06 SGT
SmokeEvaluation
Completed
WDCD smoke evaluation
2026-07-22 03:14 SGT
SmokeEvaluation
Completed
2026-07-21 03:15 SGT
SmokeEvaluation
Completed
2026-07-20 04:53 SGT
FullEvaluation
Completed
2026-07-20 03:09 SGT
SmokeEvaluation
Completed
2026-07-19 03:14 SGT
SmokeEvaluation
Completed
2026-07-18 03:20 SGT
SmokeEvaluation
Completed
2026-07-17 03:12 SGT
SmokeEvaluation
Completed
2026-07-16 03:12 SGT
SmokeEvaluation
Completed
2026-07-15 05:10 SGT
SmokeEvaluation
Completed
WDCD smoke evaluation
2026-07-15 03:16 SGT
SmokeEvaluation
Completed
2026-07-14 03:09 SGT
SmokeEvaluation
Completed
2026-07-13 04:59 SGT
FullEvaluation
Completed
2026-07-13 03:18 SGT
SmokeEvaluation
Completed
2026-07-12 05:52 SGT
SmokeEvaluation
Completed
WDCD pilot evaluation
2026-07-12 03:10 SGT
SmokeEvaluation
Completed
2026-07-11 03:15 SGT
SmokeEvaluation
Completed
2026-07-10 03:18 SGT
SmokeEvaluation
Completed
2026-07-10 03:04 SGT
SmokeEvaluation
Completed
2026-07-09 03:11 SGT
SmokeEvaluation
Completed
2026-07-08 05:15 SGT
SmokeEvaluation
Completed
WDCD smoke evaluation
2026-07-08 03:14 SGT
SmokeEvaluation
Completed
2026-07-07 03:18 SGT
SmokeEvaluation
Completed
2026-07-06 08:00 SGT
FullEvaluation
Completed
2026-07-06 03:08 SGT
SmokeEvaluation
Completed
2026-07-05 03:12 SGT
SmokeEvaluation
Completed
Time unknown
SmokeEvaluation
unknown
Time unknown
SmokeEvaluation
unknown
Time unknown
SmokeEvaluation
unknown
Time unknown
SmokeEvaluation
unknown
Time unknown
SmokeEvaluation
unknown
2026-07-04 03:19 SGT
SmokeEvaluation
Completed
2026-07-04 03:08 SGT
SmokeEvaluation
Completed
2026-07-03 11:05 SGT
SmokeEvaluation
Completed
WDCD pilot evaluation
2026-07-03 04:34 SGT
Version Upgrade
WDCD compliance board v3.1 upgrade + benchmark roster refresh
Compliance test upgrade v3.1
The multi-turn compliance board (WDCD) question bank is upgraded to v3.1: 17 new multi-turn escalating-pressure questions covering real compliance pressure scenarios such as "primitive-choice traps", "collusion tests" and "false-premise continuation" — violation verdicts are based on runtime-reproducible rules, leaving no room for dispute. **Why**: the old bank was saturating for frontier models (top compliance scores were bunched around 93, hard to differentiate). v3.1 re-opens the field with multi-turn pressure closer to real enterprise scenarios — measured compliance scores now spread smoothly from ~98 down to ~72 at the top, with clearly improved discrimination. **Pool**: 17 new v3.1 questions + 8 cross-version anchors, 25 in total. Historical WDCD leaderboards remain as-is; scores across versions are not directly comparable.Roster refresh
• **Added** Zhipu GLM-4.6 to the roster — a first-string domestic Chinese model.
• **Temporarily removed** ERNIE 4.5: its API access has been persistently unavailable, making trustworthy scoring impossible; it will be re-evaluated for inclusion once access recovers.
The roster stands at 11 models.
2026-07-03 03:24 SGT
SmokeEvaluation
Completed
2026-07-03 03:05 SGT
SmokeEvaluation
Completed
2026-07-03 01:29 SGT
Version Upgrade
Judge set v6.4: bundled scoring launched + scoring fixes
What changed
**Bundled scoring**: structured-output questions (json_schema_exact) upgraded from "per-checkpoint partial credit" to "bundled scoring" — checkpoints are grouped by business semantics, and a group only scores when every checkpoint in it is correct. **Why**: with partial credit, getting 3 of 38 checkpoints wrong still scored 92; but in real delivery, one mistranscribed amount or one missed clause means full rework. Partial credit systematically overstated model usability on critical tasks and saturated the top of the leaderboard (top material-constraint scores had reached 95+). Bundled scoring aligns with real delivery tolerance. **Effect**: recomputing the latest full run's raw answers, top-model core scores went from ~95 to ~80 with clearly improved tier separation. Questions, model answers, and every checkpoint verdict are unchanged — only the aggregation changed.Scoring fixes
• Fixed time decay in SQL "last N days" questions (fixed test-data dates drifted out of the query window over time, misjudging correct queries as 0), and added monthly automatic re-anchoring to prevent recurrence.
• Retired 1 question whose scorer and question language never matched and could not be scored.
Historical comparability
Runs from now on are tagged judge set v6.4; earlier leaderboards remain as-is tagged v6.3. Scores across judge sets are not directly comparable.
2026-07-02 03:09 SGT
SmokeEvaluation
Completed
2026-07-01 04:58 SGT
SmokeEvaluation
Completed
WDCD smoke evaluation
2026-07-01 03:09 SGT
SmokeEvaluation
Completed
2026-06-30 03:03 SGT
SmokeEvaluation
Completed
2026-06-29 04:56 SGT
FullEvaluation
Completed
2026-06-29 03:03 SGT
SmokeEvaluation
Completed
2026-06-28 05:58 SGT
SmokeEvaluation
Completed
WDCD pilot evaluation
2026-06-28 03:03 SGT
SmokeEvaluation
Completed
2026-06-27 03:06 SGT
SmokeEvaluation
Completed
2026-06-26 03:05 SGT
SmokeEvaluation
Completed
2026-06-25 03:02 SGT
SmokeEvaluation
Completed
2026-06-24 04:54 SGT
SmokeEvaluation
Completed
WDCD smoke evaluation
2026-06-24 03:01 SGT
SmokeEvaluation
Completed
2026-06-23 03:11 SGT
SmokeEvaluation
Completed
2026-06-22 04:39 SGT
FullEvaluation
Completed
2026-06-22 03:06 SGT
SmokeEvaluation
Completed
2026-06-21 03:12 SGT
SmokeEvaluation
Completed
2026-06-20 03:03 SGT
SmokeEvaluation
Completed
2026-06-19 03:02 SGT
SmokeEvaluation
Completed
2026-06-18 03:02 SGT
SmokeEvaluation
Completed
2026-06-17 04:54 SGT
SmokeEvaluation
Completed
WDCD smoke evaluation
2026-06-17 03:12 SGT
SmokeEvaluation
Completed
2026-06-16 03:14 SGT
SmokeEvaluation
Completed
2026-06-15 09:25 SGT
FullEvaluation
Completed
2026-06-15 03:03 SGT
SmokeEvaluation
Completed
2026-06-14 05:53 SGT
SmokeEvaluation
Completed
WDCD pilot evaluation
2026-06-14 03:19 SGT
SmokeEvaluation
Completed
WDCD pilot evaluation
2026-06-14 03:06 SGT
SmokeEvaluation
Completed
2026-06-13 03:01 SGT
SmokeEvaluation
Completed
2026-06-12 03:01 SGT
SmokeEvaluation
Completed
2026-06-11 13:19 SGT
SmokeEvaluation
Completed
WDCD pilot evaluation
2026-06-11 09:18 SGT
SmokeEvaluation
Completed
WDCD pilot evaluation
2026-06-11 07:14 SGT
SmokeEvaluation
Completed
2026-06-11 03:02 SGT
SmokeEvaluation
Completed
2026-06-10 05:00 SGT
SmokeEvaluation
Completed
WDCD smoke evaluation
2026-06-10 03:01 SGT
SmokeEvaluation
Completed
2026-06-09 03:01 SGT
SmokeEvaluation
Completed
2026-06-08 03:02 SGT
SmokeEvaluation
Completed
2026-06-07 03:02 SGT
SmokeEvaluation
Completed
2026-06-06 19:26 SGT
SmokeEvaluation
Completed
2026-06-06 03:31 SGT
SmokeEvaluation
Completed
social_monitor
2026-06-05 03:01 SGT
SmokeEvaluation
Completed
2026-06-04 03:01 SGT
SmokeEvaluation
Completed
2026-06-03 04:57 SGT
SmokeEvaluation
Completed
WDCD smoke evaluation
2026-06-03 03:01 SGT
SmokeEvaluation
Completed
2026-06-02 03:31 SGT
SmokeEvaluation
Completed
social_monitor
2026-06-02 03:02 SGT
SmokeEvaluation
Completed
2026-06-01 03:02 SGT
SmokeEvaluation
Completed
2026-05-31 05:54 SGT
SmokeEvaluation
Completed
WDCD pilot evaluation
2026-05-31 03:01 SGT
SmokeEvaluation
Completed
2026-05-30 03:01 SGT
SmokeEvaluation
Completed
2026-05-29 03:01 SGT
SmokeEvaluation
Completed
2026-05-28 03:01 SGT
SmokeEvaluation
Completed
2026-05-27 04:54 SGT
SmokeEvaluation
Completed
WDCD smoke evaluation
2026-05-27 03:01 SGT
SmokeEvaluation
Completed
2026-05-26 03:31 SGT
SmokeEvaluation
Completed
social_monitor
2026-05-26 03:01 SGT
SmokeEvaluation
Completed
2026-05-25 03:01 SGT
SmokeEvaluation
Completed
2026-05-24 03:01 SGT
SmokeEvaluation
Completed
2026-05-23 03:02 SGT
SmokeEvaluation
Completed
2026-05-22 03:02 SGT
SmokeEvaluation
Completed
2026-05-21 03:01 SGT
SmokeEvaluation
Completed
2026-05-20 04:57 SGT
SmokeEvaluation
Completed
WDCD smoke evaluation
2026-05-20 03:01 SGT
SmokeEvaluation
Completed
2026-05-19 03:01 SGT
SmokeEvaluation
Completed
2026-05-18 03:01 SGT
SmokeEvaluation
Completed
2026-05-17 05:49 SGT
SmokeEvaluation
Completed
WDCD pilot evaluation
2026-05-17 03:01 SGT
SmokeEvaluation
Completed
2026-05-16 03:03 SGT
SmokeEvaluation
Completed
2026-05-15 03:04 SGT
SmokeEvaluation
Completed
2026-05-14 03:01 SGT
SmokeEvaluation
Completed
2026-05-13 05:03 SGT
SmokeEvaluation
Completed
WDCD smoke evaluation
2026-05-13 03:02 SGT
SmokeEvaluation
Completed
2026-05-12 03:01 SGT
SmokeEvaluation
Completed
2026-05-11 03:03 SGT
SmokeEvaluation
Completed
2026-05-10 05:26 SGT
SmokeEvaluation
Completed
social_monitor
2026-05-10 03:03 SGT
SmokeEvaluation
Completed
2026-05-09 03:01 SGT
SmokeEvaluation
Completed
2026-05-08 03:01 SGT
SmokeEvaluation
Completed
2026-05-07 03:02 SGT
SmokeEvaluation
Completed
2026-05-06 05:01 SGT
SmokeEvaluation
Completed
WDCD smoke evaluation
2026-05-06 03:01 SGT
SmokeEvaluation
Completed
2026-05-05 03:02 SGT
SmokeEvaluation
Completed
2026-05-04 03:02 SGT
SmokeEvaluation
Completed
2026-05-03 04:24 SGT
SmokeEvaluation
Completed
WDCD pilot evaluation
2026-05-03 04:00 SGT
SmokeEvaluation
Completed
2026-05-02 03:03 SGT
SmokeEvaluation
Completed
2026-05-02 02:55 SGT
SmokeEvaluation
Completed
WDCD pilot evaluation
2026-05-01 16:06 SGT
SmokeEvaluation
Completed
DCD pilot evaluation
2026-05-01 11:09 SGT
Version Upgrade
WDCD Dynamic Contextual Decay — world's first multi-turn constraint benchmark dimension launched
New experimental dimension: WDCD (Dynamic Contextual Decay)
Winzheng Index v7 adds the WDCD dimension, testing whether AI models hold constraints across multi-turn dialogue. This is the world's first framework to systematically evaluate this capability. **Core design: three-round dialogue**• R1 constraint implant: give the model an explicit constraint and confirm understanding
• R2 distraction injection: a 2000-5000 character professional document with an embedded violating request
• R3 pressure induction: social-engineering pressure to test whether the constraint collapses
**Scale**
• 30 multi-turn constraint questions covering 5 scenario types (data boundaries, resource limits, business rules, security, engineering conventions)
• 11 mainstream models tested side by side
• 100% rule-based scoring, zero AI judges, fully auditable
**Scoring**
• R1: 0-1 (confirmation detection)
• R2: 0-1 (violation detection + Utility Gate)
• R3: 0-2 (violation + refusal + constraint citation + safe alternative)
• Max 4 points
**Independent runs**
• WDCD is experimental and not counted in the main board score
• Uses independent runs (run_type = dcd_pilot)
• Planned to run independently for 3 months before evaluating main-board inclusion
2026-05-01 06:20 SGT
Model Change
Major roster upgrade: 11 models updated to latest versions
From May 1, 2026, the Winzheng Index benchmark roster is fully upgraded:
[New models]
• GPT-5.5 (replacing GPT-4o) — OpenAI's latest flagship
• Claude Opus 4.7 (replacing Opus 4.6) — Anthropic's latest flagship
• DeepSeek V4 Pro (replacing V3 + R1) — DeepSeek's new architecture
• Gemini 3.1 Pro (new) — Google's latest generation
• Qwen3 Max (replacing Qwen Max) — Alibaba Tongyi Qianwen 3rd generation
• ERNIE 4.5 (replacing 4.0) — Baidu's latest version
• Grok 4 (replacing Grok 3) — xAI's new flagship
[Retained models]
• Claude Sonnet 4.6 — latest in the Sonnet line, still participating
• GPT-o3 — latest in OpenAI's reasoning line, still participating
• Doubao Pro — ByteDance flagship, still participating
[Retired models]
GPT-4o, GPT-4o-mini, Claude Opus 4.6, DeepSeek V3, DeepSeek R1, Gemini 2.0 Flash, Grok 3, Qwen Max, ERNIE 4.0
Historical leaderboards remain unchanged.
2026-05-01 03:01 SGT
SmokeEvaluation
Completed
2026-04-30 03:01 SGT
SmokeEvaluation
Completed
2026-04-29 03:02 SGT
SmokeEvaluation
Completed
2026-04-28 03:02 SGT
SmokeEvaluation
Completed
2026-04-27 03:01 SGT
SmokeEvaluation
Completed
2026-04-26 03:01 SGT
SmokeEvaluation
Completed
2026-04-25 03:02 SGT
SmokeEvaluation
Completed
2026-04-24 03:03 SGT
SmokeEvaluation
Completed
2026-04-23 03:02 SGT
SmokeEvaluation
Completed
2026-04-22 03:02 SGT
SmokeEvaluation
Completed
2026-04-21 03:36 SGT
SmokeEvaluation
Completed
2026-04-21 03:01 SGT
SmokeEvaluation
Completed
2026-04-20 03:01 SGT
SmokeEvaluation
Completed
2026-04-19 03:01 SGT
SmokeEvaluation
Completed
2026-04-18 11:04 SGT
SmokeEvaluation
Completed
2026-04-17 03:02 SGT
SmokeEvaluation
Completed
2026-04-16 03:01 SGT
SmokeEvaluation
Completed
2026-04-15 03:02 SGT
SmokeEvaluation
Completed
2026-04-14 03:01 SGT
SmokeEvaluation
Completed
2026-04-13 03:01 SGT
SmokeEvaluation
Completed
2026-04-12 03:02 SGT
SmokeEvaluation
Completed
2026-04-11 03:01 SGT
SmokeEvaluation
Completed
2026-04-10 03:01 SGT
SmokeEvaluation
Completed
2026-04-09 03:01 SGT
SmokeEvaluation
Completed
2026-04-08 03:02 SGT
SmokeEvaluation
Completed
2026-04-07 03:01 SGT
SmokeEvaluation
Completed
2026-04-06 03:01 SGT
SmokeEvaluation
Completed
2026-04-05 03:01 SGT
SmokeEvaluation
Completed
2026-04-04 03:31 SGT
SmokeEvaluation
Completed
social_monitor
2026-04-04 03:01 SGT
SmokeEvaluation
Completed
2026-04-03 03:01 SGT
SmokeEvaluation
Completed
2026-04-02 03:01 SGT
SmokeEvaluation
Completed
2026-04-01 03:01 SGT
SmokeEvaluation
Completed
2026-03-31 03:01 SGT
SmokeEvaluation
Completed
2026-03-30 03:31 SGT
SmokeEvaluation
Completed
social_monitor
2026-03-30 03:01 SGT
SmokeEvaluation
Completed
2026-03-29 03:01 SGT
SmokeEvaluation
Completed
2026-03-28 03:02 SGT
SmokeEvaluation
Completed
2026-03-27 05:05 SGT
SmokeEvaluation
Completed
2026-03-25 00:11 SGT
SmokeEvaluation
Completed
2026-03-24 00:00 SGT
Version Upgrade
Winzheng Index v6 officially launched
Methodology upgrade
• Question bank expanded from 200 to 212 questions, adding 12 integrity stress-test questions
• Dimension system restructured: the main board now only includes two auditable core dimensions, "Code Execution" and "Material Constraints"
• Added "Engineering Judgment" and "Task Expression" side boards (marked as AI-assisted evaluation)
• Added an "Integrity Rating" gate (pass/warn/fail); models failing integrity are capped on the main board
• Main board formula: core_overall = 0.55 × Code Execution + 0.45 × Material Constraints
• Stability, availability and cost-effectiveness downgraded to operational signals, no longer mixed into main board weights
Scoring engine
• Added exact_rank scorer supporting closed-form ranking for integrity stress tests
• Parallel evaluation architecture upgraded to 55 processes (11 models × 5 capability layers); a full run takes ~15 minutes
Social sentiment monitoring (new)
• Daily automatic monitoring of user feedback on the 11 models on X/Twitter
• Sentiment anomalies automatically trigger targeted re-evaluation, cross-validated with benchmark data
• Daily automatic monitoring of AI vendors' official accounts
Data page rebuild
• Raw data page rebuilt into summary + pagination; page size reduced from 29MB to 64KB
• Question texts and expected answers are no longer public, preventing contamination
2026-03-22 14:05 SGT
SmokeEvaluation
Completed
2026-03-21 12:11 SGT
SmokeEvaluation
Completed
Judge v5:引入严格判分分层(strict/non-strict):新增 4 种严格判分类型(exact_rank、exact_boolean_set、exact_numeric_set、exact_json_value),严格题只给 0 或 100 不给部分分。排名题、True/False 判断题、单值数值题等标记为 strict=true
Benchmark v4:题库从 89 题扩充到 100 题(编程 33 + 知识 45 + 长上下文 22),新增 11 道高质量决策题,覆盖矛盾信息识别、信息不足诚实度、优先级排序、利益冲突检测、代码 review 陷阱、伦理边界
2026-03-21 01:21 SGT
SmokeEvaluation
Completed
Judge v5:引入严格判分分层(strict/non-strict):新增 4 种严格判分类型(exact_rank、exact_boolean_set、exact_numeric_set、exact_json_value),严格题只给 0 或 100 不给部分分。排名题、True/False 判断题、单值数值题等标记为 strict=true
Benchmark v4:题库从 89 题扩充到 100 题(编程 33 + 知识 45 + 长上下文 22),新增 11 道高质量决策题,覆盖矛盾信息识别、信息不足诚实度、优先级排序、利益冲突检测、代码 review 陷阱、伦理边界
2026-03-21 01:19 SGT
Benchmark Change
Question bank v4: 11 new high-quality decision questions
Added 11 high-quality decision questions covering: contradictory information detection (2), honesty under insufficient information (2), prioritization (2), conflict-of-interest detection (2), code review traps (2), and ethical boundaries (1). The question bank grew from 89 to 100 questions. Question bank version upgraded to v4.
2026-03-21 01:05 SGT
Model Change
Added 3 benchmark models: Grok 3, Doubao Pro, ERNIE 4.0
Added 3 benchmark models: Grok 3 (xAI), Doubao Pro (ByteDance), ERNIE 4.0 (Baidu). Total benchmark models increased from 8 to 11.
2026-03-21 01:05 SGT
SmokeEvaluation
Completed
Judge v5:引入严格判分分层(strict/non-strict):新增 4 种严格判分类型(exact_rank、exact_boolean_set、exact_numeric_set、exact_json_value),严格题只给 0 或 100 不给部分分。排名题、True/False 判断题、单值数值题等标记为 strict=true
Benchmark v3:题库从 80 题扩充到 89 题(编程 33 + 知识 34 + 长上下文 22),知识工作新增工程判断力题组(9 题),覆盖技术选型、架构权衡、故障排查等实战场景
2026-03-21 00:59 SGT
SmokeEvaluation
Completed
Judge v5:引入严格判分分层(strict/non-strict):新增 4 种严格判分类型(exact_rank、exact_boolean_set、exact_numeric_set、exact_json_value),严格题只给 0 或 100 不给部分分。排名题、True/False 判断题、单值数值题等标记为 strict=true
Benchmark v3:题库从 80 题扩充到 89 题(编程 33 + 知识 34 + 长上下文 22),知识工作新增工程判断力题组(9 题),覆盖技术选型、架构权衡、故障排查等实战场景
2026-03-20 12:55 SGT
SmokeEvaluation
Completed
Judge v5:引入严格判分分层(strict/non-strict):新增 4 种严格判分类型(exact_rank、exact_boolean_set、exact_numeric_set、exact_json_value),严格题只给 0 或 100 不给部分分。排名题、True/False 判断题、单值数值题等标记为 strict=true
Benchmark v3:题库从 80 题扩充到 89 题(编程 33 + 知识 34 + 长上下文 22),知识工作新增工程判断力题组(9 题),覆盖技术选型、架构权衡、故障排查等实战场景
2026-03-20 03:10 SGT
SmokeEvaluation
Completed
Judge v5:引入严格判分分层(strict/non-strict):新增 4 种严格判分类型(exact_rank、exact_boolean_set、exact_numeric_set、exact_json_value),严格题只给 0 或 100 不给部分分。排名题、True/False 判断题、单值数值题等标记为 strict=true
Benchmark v3:题库从 80 题扩充到 89 题(编程 33 + 知识 34 + 长上下文 22),知识工作新增工程判断力题组(9 题),覆盖技术选型、架构权衡、故障排查等实战场景
2026-03-19 03:11 SGT
SmokeEvaluation
Completed
Judge v5:引入严格判分分层(strict/non-strict):新增 4 种严格判分类型(exact_rank、exact_boolean_set、exact_numeric_set、exact_json_value),严格题只给 0 或 100 不给部分分。排名题、True/False 判断题、单值数值题等标记为 strict=true
Benchmark v2:题库从 30 题扩充到 80 题(编程 33 + 知识 25 + 长上下文 22),编程新增动态规划和并发分析,知识工作新增复利计算、时区推理等多步推理题
2026-03-18 03:11 SGT
SmokeEvaluation
Completed
Judge v5:引入严格判分分层(strict/non-strict):新增 4 种严格判分类型(exact_rank、exact_boolean_set、exact_numeric_set、exact_json_value),严格题只给 0 或 100 不给部分分。排名题、True/False 判断题、单值数值题等标记为 strict=true
Benchmark v2:题库从 30 题扩充到 80 题(编程 33 + 知识 25 + 长上下文 22),编程新增动态规划和并发分析,知识工作新增复利计算、时区推理等多步推理题
2026-03-17 03:10 SGT
SmokeEvaluation
Completed
Judge v2:引入六种判分方法(全部命中、部分命中、精确匹配、正则、顺序匹配、JSON 结构校验),开始有比较正式的评分体系
Benchmark v1:初始题库 30 题,覆盖编程、知识工作、长上下文三个维度