Run
4 emulators 572 tests
Results as of this run. The arrow shows each target's movement since the previous run it was tested in.
When this run was published the board led with a single correctness percentage. The figures here are that run's own results restated as divergence and coverage, so they read differently from what this page showed at the time. The changelog has the change.
-
Grade baselineground truth
no divergence in all 33 regions · covers 100.0% of the suite
Tier breakdown
Tier 1 · Core 0.0% diverges100.0% coveredTier 2 · Complete 0.0% diverges100.0% coveredTier 3 · Strict 0.0% diverges100.0% covered -
-
Runs via: npx, Docker, Homebrew, binary, npm, cargo, embedded, GitHub Action, source
Disclosure: maintained by this board's author
Grade Adiverged 1.0 percentage points morelow divergence (1.0%) · covers 100.0% of the suite
Tier breakdown
Tier 1 · Core 0.0% diverges100.0% coveredTier 2 · Complete 0.0% diverges100.0% coveredTier 3 · Strict 3.6% diverges100.0% covered -
Grade Bdiverged 1.2 percentage points more
moderate divergence (7.7%) · covers 100.0% of the suite
Tier breakdown
Tier 1 · Core 1.0% diverges100.0% coveredTier 2 · Complete 3.9% diverges100.0% coveredTier 3 · Strict 22.3% diverges100.0% covered -
Grade Bdiverged 1.2 percentage points more
moderate divergence (8.6%) · covers 100.0% of the suite
Tier breakdown
Tier 1 · Core 1.0% diverges100.0% coveredTier 2 · Complete 8.7% diverges100.0% coveredTier 3 · Strict 22.3% diverges100.0% covered -
Grade Cdiverged 0.9 percentage points more
moderate divergence (12.6%) · covers 92.5% of the suite · coverage lowers this row to C
Tier breakdown
Tier 1 · Core 1.7% diverges100.0% coveredTier 2 · Complete 48.5% diverges58.3% covered 43 unsupportedTier 3 · Strict 10.2% diverges100.0% covered