ScoreLens · Dart-Erkennung per Handykamera

Benchmark v3

Wie oft wertet ein Modell ein ganzes Bild richtig, wenn die Bedingungen schlecht sind? Der alte Test zeigte für jedes Modell 96–97 % und damit keinen Unterschied mehr. Dieser hier ist absichtlich schwer.

Rangliste

BasismodellEigenes FeintuningMittel über alle Kategorien – jede Kategorie zählt gleich viel

Was der Benchmark macht

Er nimmt echte Dartfotos, die kein Modell je im Training gesehen hat, und macht sie auf eine jeweils genau definierte Weise schwer: einmal nur der Blickwinkel, einmal nur das Licht, einmal nur die Bildqualität. So zeigt jede Kategorie eine einzelne Schwäche statt eines Mischwerts. Dazu kommen Kombinationen, unveränderte schwere Würfe und Fotos völlig fremder Boards.

Jedes Bild hat dieselben Störungen für jedes Modell – die Zufallswerte hängen nur am Bildnamen. Ein neues Modell lässt sich also jederzeit fair daneben stellen.

So entsteht die App-Wertung

  1. Board finden. Im Originalbild sucht das Modell sechs Kalibrierpunkte am Doppelring. Vier davon genügen – die daraus berechnete Entzerrung muss die wahren Punkte auf 3 mm treffen.
  2. Entzerren. Der Board-Ausschnitt wird in die Frontalansicht gerechnet: Board als Kreis, die 20 oben. Genau dieses Bild bekommt das Modell auch in der App.
  3. Spitzen finden und werten. Die bis zu drei sichersten Spitzen zählen; Feld und Ring folgen aus der Lage im entzerrten Bild, mit den Ringmaßen der App.
  4. Vergleichen. Nur wenn jede Wertung stimmt – etwa T20, S5, D16 – zählt das Bild. Ein fehlender, ein zusätzlicher oder ein falsch gewerteter Dart macht es falsch.

Nach Art der Schwierigkeit

Gleiche Skala in allen Feldern, Modelle in zeitlicher Reihenfolge.

Alle Kategorien

Je dunkler, desto besser. Umrandet ist der Bestwert der Zeile; „Spanne“ ist der Abstand zwischen bestem und schlechtestem Modell.