Skip to content

Run

7 emulators 998 tests

Results as of this run. The arrow shows each target's movement since the previous run it was tested in. The suite grew this run, so an upward arrow can be the new tests biting rather than a target getting worse.

When this run was published the board led with a single correctness percentage. The figures here are that run's own results restated as divergence and coverage, so they read differently from what this page showed at the time. The changelog has the change.

Suite grew from 982 to 998 tests this run.

That's 16 new tests measured against every target. Movement below compares to the previous run, so a rise here is as likely to be the stricter suite as a real regression.

Scored against 33 real regions. 1 dropped, out of scoring until it returns: me-south-1
  1. live (AWS)

    Runs via: AWS service

    Grade baseline

    no divergence in all 33 regions · covers 100.0% of the suite

    ground truth
    Tier breakdown
    Tier 1 · Core 0.0% diverges
    100.0% covered
    Tier 2 · Complete 0.0% diverges
    100.0% covered
    Tier 3 · Strict 0.0% diverges
    100.0% covered
  2. Runs via: npx, Docker, Homebrew, binary, npm, cargo, embedded, GitHub Action, source

    Disclosure: maintained by this board's author

    Grade B

    moderate divergence (5.2%) · covers 98.6% of the suite

    diverged 1.5 percentage points more
    Tier breakdown
    Tier 1 · Core 0.2% diverges
    100.0% covered
    Tier 2 · Complete 20.6% diverges
    93.0% covered 14 unsupported
    Tier 3 · Strict 3.1% diverges
    100.0% covered
  3. Grade C

    high divergence (15.3%) · covers 91.3% of the suite

    diverged 0.2 percentage points less
    Tier breakdown
    Tier 1 · Core 14.5% diverges
    100.0% covered
    Tier 2 · Complete 8.0% diverges
    58.3% covered 83 unsupported
    Tier 3 · Strict 21.0% diverges
    98.8% covered 4 unsupported
  4. Runs via: Docker, pip, Homebrew, binary

    Grade C

    high divergence (15.7%) · covers 99.2% of the suite

    diverged 1.0 percentage points more
    Tier breakdown
    Tier 1 · Core 6.5% diverges
    100.0% covered
    Tier 2 · Complete 18.1% diverges
    96.0% covered 8 unsupported
    Tier 3 · Strict 27.8% diverges
    100.0% covered
  5. Grade C

    high divergence (16.8%) · covers 98.7% of the suite

    diverged 0.9 percentage points more
    Tier breakdown
    Tier 1 · Core 7.8% diverges
    100.0% covered
    Tier 2 · Complete 20.1% diverges
    93.5% covered 13 unsupported
    Tier 3 · Strict 28.1% diverges
    100.0% covered
  6. 7485cab02cd8

    Runs via: pip, Docker, source

    Grade C

    high divergence (18.0%) · covers 100.0% of the suite

    diverged 1.3 percentage points more
    Tier breakdown
    Tier 1 · Core 10.9% diverges
    100.0% covered
    Tier 2 · Complete 29.6% diverges
    100.0% covered
    Tier 3 · Strict 21.3% diverges
    100.0% covered
  7. Runs via: Docker, Homebrew, install script, Scoop, binary, JAR

    Grade C

    high divergence (20.9%) · covers 99.1% of the suite

    diverged 1.3 percentage points more
    Tier breakdown
    Tier 1 · Core 8.6% diverges
    100.0% covered
    Tier 2 · Complete 36.7% diverges
    95.5% covered 9 unsupported
    Tier 3 · Strict 29.3% diverges
    100.0% covered
  8. Grade D

    high divergence (21.3%) · covers 88.8% of the suite · coverage lowers this row to D

    diverged 0.1 percentage points less
    Tier breakdown
    Tier 1 · Core 8.6% diverges
    100.0% covered
    Tier 2 · Complete 39.7% diverges
    45.7% covered 108 unsupported
    Tier 3 · Strict 28.7% diverges
    98.8% covered 4 unsupported