Skip to content

Run

4 emulators 572 tests

Results as of this run. The arrow shows each target's movement since the previous run it was tested in.

When this run was published the board led with a single correctness percentage. The figures here are that run's own results restated as divergence and coverage, so they read differently from what this page showed at the time. The changelog has the change.

  1. live (AWS)

    Runs via: AWS service

    Grade baseline

    no divergence in all 33 regions · covers 100.0% of the suite

    ground truth
    Tier breakdown
    Tier 1 · Core 0.0% diverges
    100.0% covered
    Tier 2 · Complete 0.0% diverges
    100.0% covered
    Tier 3 · Strict 0.0% diverges
    100.0% covered
  2. -

    Runs via: npx, Docker, Homebrew, binary, npm, cargo, embedded, GitHub Action, source

    Disclosure: maintained by this board's author

    Grade A

    low divergence (1.0%) · covers 100.0% of the suite

    diverged 1.0 percentage points more
    Tier breakdown
    Tier 1 · Core 0.0% diverges
    100.0% covered
    Tier 2 · Complete 0.0% diverges
    100.0% covered
    Tier 3 · Strict 3.6% diverges
    100.0% covered
  3. -

    Runs via: Docker, pip, Homebrew, binary

    Grade B

    moderate divergence (7.7%) · covers 100.0% of the suite

    diverged 1.2 percentage points more
    Tier breakdown
    Tier 1 · Core 1.0% diverges
    100.0% covered
    Tier 2 · Complete 3.9% diverges
    100.0% covered
    Tier 3 · Strict 22.3% diverges
    100.0% covered
  4. -

    Runs via: Docker, JAR, Maven

    Grade B

    moderate divergence (8.6%) · covers 100.0% of the suite

    diverged 1.2 percentage points more
    Tier breakdown
    Tier 1 · Core 1.0% diverges
    100.0% covered
    Tier 2 · Complete 8.7% diverges
    100.0% covered
    Tier 3 · Strict 22.3% diverges
    100.0% covered
  5. Grade C

    moderate divergence (12.6%) · covers 92.5% of the suite · coverage lowers this row to C

    diverged 0.9 percentage points more
    Tier breakdown
    Tier 1 · Core 1.7% diverges
    100.0% covered
    Tier 2 · Complete 48.5% diverges
    58.3% covered 43 unsupported
    Tier 3 · Strict 10.2% diverges
    100.0% covered