Run
7 emulators 625 tests
Results as of this run. The arrow shows each target's movement since the previous run it was tested in. The suite grew this run, so an upward arrow can be the new tests biting rather than a target getting worse.
When this run was published the board led with a single correctness percentage. The figures here are that run's own results restated as divergence and coverage, so they read differently from what this page showed at the time. The changelog has the change.
Suite grew from 601 to 625 tests this run.
That's 24 new tests measured against every target. Movement below compares to the previous run, so a rise here is as likely to be the stricter suite as a real regression.
What changed in the suite this run
Suite on
Grew to 625 tests, up 24 on the previous run: eleven more in Tier 1 and thirteen more in Tier 3, tightening coverage of core operations and the strict edge cases.
-
Grade baselineground truth
no divergence in all 33 regions · covers 100.0% of the suite
Tier breakdown
Tier 1 · Core 0.0% diverges100.0% coveredTier 2 · Complete 0.0% diverges100.0% coveredTier 3 · Strict 0.0% diverges100.0% covered -
0.9.13
Runs via: npx, Docker, Homebrew, binary, npm, cargo, embedded, GitHub Action, source
Disclosure: maintained by this board's author
Grade Adiverged 2.1 percentage points morelow divergence (2.1%) · covers 100.0% of the suite
Tier breakdown
Tier 1 · Core 2.2% diverges100.0% coveredTier 2 · Complete 0.0% diverges100.0% coveredTier 3 · Strict 2.9% diverges100.0% covered -
Grade Adiverged 3.0 percentage points more
low divergence (3.0%) · covers 96.0% of the suite
Tier breakdown
Tier 1 · Core 3.2% diverges100.0% coveredTier 2 · Complete 0.0% diverges75.7% covered 25 unsupportedTier 3 · Strict 4.3% diverges100.0% covered -
Grade Adiverged 3.0 percentage points more
low divergence (3.5%) · covers 100.0% of the suite
Tier breakdown
Tier 1 · Core 3.2% diverges100.0% coveredTier 2 · Complete 1.9% diverges100.0% coveredTier 3 · Strict 4.8% diverges100.0% covered -
Grade Bdiverged 0.7 percentage points more
moderate divergence (11.7%) · covers 100.0% of the suite
Tier breakdown
Tier 1 · Core 1.3% diverges100.0% coveredTier 2 · Complete 3.9% diverges100.0% coveredTier 3 · Strict 31.3% diverges100.0% covered -
Grade Bdiverged 0.7 percentage points more
moderate divergence (12.5%) · covers 100.0% of the suite
Tier breakdown
Tier 1 · Core 1.3% diverges100.0% coveredTier 2 · Complete 8.7% diverges100.0% coveredTier 3 · Strict 31.3% diverges100.0% covered -
Grade Cdiverged 0.6 percentage points less
moderate divergence (14.2%) · covers 93.1% of the suite · coverage lowers this row to C
Tier breakdown
Tier 1 · Core 1.6% diverges100.0% coveredTier 2 · Complete 48.5% diverges58.3% covered 43 unsupportedTier 3 · Strict 16.3% diverges100.0% covered -
Grade Ddiverged 2.3 percentage points more
very high divergence (33.9%) · covers 100.0% of the suite
Tier breakdown
Tier 1 · Core 16.9% diverges100.0% coveredTier 2 · Complete 23.3% diverges100.0% coveredTier 3 · Strict 64.9% diverges100.0% covered