Skip to content

Run

7 emulators 873 tests

Results as of this run. The arrow shows each target's movement since the previous run it was tested in. The suite grew this run, so an upward arrow can be the new tests biting rather than a target getting worse.

When this run was published the board led with a single correctness percentage. The figures here are that run's own results restated as divergence and coverage, so they read differently from what this page showed at the time. The changelog has the change.

Suite grew from 824 to 873 tests this run.

That's 49 new tests measured against every target. Movement below compares to the previous run, so a rise here is as likely to be the stricter suite as a real regression.

What changed in the suite this run

Suite on

Grew to 873 tests, up 49, all characterised against real DynamoDB in eu-west-2. New coverage in three areas:

  • ConsumedCapacity: the transactional read/write split on a same-token replay and on ExecuteTransaction, and a correction that single-item operations report the aggregate CapacityUnits and omit the split, which is transactional-only.
  • Empty-binary key values: rejected as a top-level ValidationException on every path, including secondary-index keys and inside transactions, mirroring the empty-string rejection.
  • Expression, limit and response-shape parity: KeyConditionExpression operand and nested-path rules, ExpressionAttributeNames/Values hygiene, projection validation and list-index fidelity, reversed-bounds BETWEEN, read-path key-length and segment caps, whitespace numbers, batch unprocessed fields and cross-table projection mixing, the bare no-op upsert, multi-subpath UPDATED_NEW, filter operand ordering, hash-only-GSI pagination, and CreateTable spec validation.
  1. live (AWS)

    Runs via: AWS service

    Grade baseline

    no divergence in all 33 regions · covers 100.0% of the suite

    ground truth
    Tier breakdown
    Tier 1 · Core 0.0% diverges
    100.0% covered
    Tier 2 · Complete 0.0% diverges
    100.0% covered
    Tier 3 · Strict 0.0% diverges
    100.0% covered
  2. Runs via: npx, Docker, Homebrew, binary, npm, cargo, embedded, GitHub Action, source

    Disclosure: maintained by this board's author

    Grade A

    low divergence (2.3%) · covers 98.4% of the suite

    diverged 0.8 percentage points more
    Tier breakdown
    Tier 1 · Core 2.0% diverges
    100.0% covered
    Tier 2 · Complete 1.9% diverges
    91.0% covered 14 unsupported
    Tier 3 · Strict 2.9% diverges
    100.0% covered
  3. Grade B

    moderate divergence (13.3%) · covers 95.1% of the suite

    diverged 2.5 percentage points more
    Tier breakdown
    Tier 1 · Core 15.0% diverges
    100.0% covered
    Tier 2 · Complete 7.7% diverges
    72.3% covered 43 unsupported
    Tier 3 · Strict 13.6% diverges
    100.0% covered
  4. 65f91ff15e63

    Runs via: pip, Docker, source

    Grade B

    moderate divergence (13.5%) · covers 100.0% of the suite

    diverged 2.5 percentage points more
    Tier breakdown
    Tier 1 · Core 9.0% diverges
    100.0% covered
    Tier 2 · Complete 18.1% diverges
    100.0% covered
    Tier 3 · Strict 18.4% diverges
    100.0% covered
  5. Runs via: Docker, Homebrew, install script, Scoop, binary, JAR

    Grade C

    high divergence (15.1%) · covers 99.0% of the suite

    diverged 2.9 percentage points more
    Tier breakdown
    Tier 1 · Core 8.3% diverges
    100.0% covered
    Tier 2 · Complete 21.3% diverges
    94.2% covered 9 unsupported
    Tier 3 · Strict 22.8% diverges
    100.0% covered
  6. Runs via: Docker, pip, Homebrew, binary

    Grade C

    high divergence (15.8%) · covers 99.1% of the suite

    diverged 0.7 percentage points less
    Tier breakdown
    Tier 1 · Core 7.0% diverges
    100.0% covered
    Tier 2 · Complete 11.6% diverges
    94.8% covered 8 unsupported
    Tier 3 · Strict 32.7% diverges
    100.0% covered
  7. Grade C

    high divergence (17.1%) · covers 98.5% of the suite

    diverged 0.8 percentage points less
    Tier breakdown
    Tier 1 · Core 8.3% diverges
    100.0% covered
    Tier 2 · Complete 14.2% diverges
    91.6% covered 13 unsupported
    Tier 3 · Strict 33.1% diverges
    100.0% covered
  8. Grade D

    high divergence (22.9%) · covers 92.2% of the suite · coverage lowers this row to D

    diverged 0.6 percentage points more
    Tier breakdown
    Tier 1 · Core 8.7% diverges
    100.0% covered
    Tier 2 · Complete 49.0% diverges
    56.1% covered 68 unsupported
    Tier 3 · Strict 31.3% diverges
    100.0% covered