Methode
Was die Tests messen, wie die Uhr läuft und woher die Kurve hinter jedem Perzentil kommt. Jede Zahl auf humanlag ist entweder hier gemessen oder eine Annahme, die als solche deklariert ist; diese Seite sagt, welche was ist.
Wie die Uhr läuft
Jeder Test läuft in deinem Browser und misst deine Eingabe an Ort und Stelle; nichts wird zur Auswertung irgendwohin geschickt. Ein Test auf Zeit startet seine Uhr mit dem Frame, in dem sich der Bildschirm tatsächlich ändert, gekoppelt an den Bildaufbau des Browsers, und wertet deinen Druck in dem Moment, in dem Taste oder Finger runtergehen, nicht erst beim Loslassen. Ein Fehlstart zählt nie. Die meisten Tests mitteln mehrere Versuche, weil ein einzelner Versuch vor allem Glück ist. Der Lag deines eigenen Bildschirms und Eingabegeräts ist Teil der Zahl: ein 60 Hz-Panel und ein Touchscreen messen langsamer als ein 144 Hz-Monitor und eine kabelgebundene Maus, dasselbe Gehirn. Ein Druck unter 100 ms ist keine Reaktion, denn kein Mensch kommt so schnell vom Auge zur Hand; der Reaktionstest wertet ihn als Fehlstart und wiederholt den Durchgang.
Die Kurve hinter jedem Perzentil
Jede Ergebniskarte setzt dein Ergebnis auf eine Kurve und liest daran ein Perzentil ab. Diese Kurve ist ein Histogramm mit festen Klassen, und sie beginnt als Annahme: eine Startform, die eine feste Zahl angenommener Durchläufe wert ist, entnommen aus veröffentlichten Normwerten oder dem veröffentlichten Histogramm einer anderen Seite (die Liste unten sagt, Test für Test, welches von beiden). Jeder auf dieser Seite gespielte Durchlauf zählt in seiner Klasse einen dazu, sodass die gemessenen Durchläufe die Annahme überwiegen, je mehr sich ansammeln. Ein Test, dessen Startform auf veröffentlichten Daten ruht, beginnt mit 1000 angenommenen Durchläufen; die vier ohne veröffentlichten Normwert dahinter beginnen mit 300 und treten deshalb früher hinter die gemessenen Durchläufe zurück.
Das Perzentil ist der Anteil des Pools auf der schlechteren Seite deines Ergebnisses, plus die Hälfte derer, die genau gleichauf liegen. Ein Pool pro Test: Handy und Desktop, jede Sprache, erste und wiederholte Durchläufe, alles in einer Kurve. Bei den Tests auf Zeit heißt das: ein Handy-Durchlauf liest sich etwas langsamer, als du bist, und ein Desktop-Durchlauf etwas schneller; vergleich dich mit dir selbst am selben Setup. Nur der erste abgeschlossene Durchlauf pro Gerät, Test und Tag kommt dazu; wer den ganzen Nachmittag übt, zählt einmal. Und ein Netzwerk steuert pro Tag höchstens zwei Durchläufe zu einem einzelnen Balken einer Testkurve bei, damit kein einzelner Anschluss einen Balken aufblasen kann: „gemessene Durchläufe“ heißt auf dieser Seite gemessene Durchläufe nach dieser Grenze.
Die Startkurve, Test für Test
Für jeden Test: welche Startform er hat und woher sie kommt, wie viele angenommene Durchläufe sie wert ist und wie viele Durchläufe diese Seite bisher gemessen hat. Die gemessene Zahl wird live aus den eigenen Aufzeichnungen der Seite gelesen; sie ist es, die aus einer Annahme eine Messung macht.
Reaktionszeit
Log-Normal-Fit, Median 273 ms, σ 0,22, eine Annahme aus veröffentlichten Normwerten.
Wahlreaktion
Log-Normalverteilung, Median 500 ms, σ 0,22, angesetzt bei Labor-Reaktionszeiten mit vier Wahlmöglichkeiten plus Bildschirm- und Eingabe-Lag eines Browsers.
Go/No-Go
Normalverteilung, Mittel 53,4 s, SD 6,7, hergeleitet aus den Zeiten des Tests selbst und einer angenommenen Fehlerrate, ohne veröffentlichten Normwert dahinter.
Antizipation
Log-Normalverteilung, Median 55 ms, σ 0,45, eine Annahme aus dem, was Labormessungen für Erwachsene berichten (ein paar Dutzend Millisekunden), plus Bildschirm- und Eingabe-Lag eines Browsers.
Aim Trainer
Log-Normalverteilung, Median 500 ms pro Ziel, σ 0,30, eine Annahme aus dem, was Studien zur Zeigebewegung für eine Maus bei diesem Verhältnis von Distanz zu Größe berichten (Fitts' Gesetz), plus Bildschirm- und Eingabe-Lag eines Browsers. Maus und Daumen teilen sich den einen Pool.
Stroop
Log-Normalverteilung, Median 750 ms, σ 0,22, angesetzt bei Labor-Reaktionszeiten mit vier Wahlmöglichkeiten plus Bildschirm- und Eingabe-Lag eines Browsers plus die Stroop-Interferenz.
Tippen
Log-Normalverteilung, Median 45 wpm, σ 0,45, eine Annahme aus dem, was Tipptests für Alltagstipper berichten, die Streuung an das Tipp-Histogramm von Human Benchmark angepasst.
Zahlengedächtnis
Das veröffentlichte Histogramm gespeicherter Ergebnisse von Human Benchmark, wegen Selbstselektion um eine Ziffer nach unten verschoben, steht für die angenommenen Durchläufe (Median 8 Ziffern).
Sequenzgedächtnis
Das veröffentlichte Histogramm gespeicherter Ergebnisse von Human Benchmark, wegen Selbstselektion um ein Level nach unten verschoben, steht für die angenommenen Durchläufe (Median 8 Level, langer rechter Ausläufer).
Visuelles Gedächtnis
Das veröffentlichte Histogramm gespeicherter Ergebnisse von Human Benchmark, wegen Selbstselektion um ein Level nach unten verschoben und in Felder umgerechnet, steht für die angenommenen Durchläufe (Median 12 Felder).
Schimpansentest
Das veröffentlichte Histogramm gespeicherter Ergebnisse von Human Benchmark, wegen Selbstselektion um eine Zahl nach unten verschoben, steht für die angenommenen Durchläufe (Median 9 Zahlen).
Was die Kurve dir nicht sagen kann
Jeder gemessene Durchlauf wird beim Wort genommen. Die Seite prüft, ob ein übermitteltes Ergebnis für diesen Test körperlich möglich ist, mit einer Unter- und einer Obergrenze pro Test, damit kein Balken einer Kurve auf einem Ergebnis steht, das kein Mensch erzeugen kann: eine Reaktion unter 100 ms oder ein Tipptempo, das nur ein Skript erreicht, wird abgewiesen und nie gezählt. Das entfernt das Unmögliche, nicht das Unehrliche. Ein glaubwürdiges Ergebnis, das jemand eingetippt statt gespielt hat, sieht genauso aus wie ein gespieltes, und Ausreißer streicht die Seite nicht. Was den Schaden begrenzt, ist die Grenze weiter oben: höchstens zwei Durchläufe pro Balken, Netzwerk und Tag. Deshalb kann eine einzelne Person mit einem Skript kein Perzentil an sich reißen. Die Regel „einmal pro Tag“ stützt sich auf eine Kennung, die der Browser bei sich behält; wer die Browserdaten löscht oder einen zweiten Browser nimmt, ist für sie ein neues Gerät. Die meisten spielen; ein paar tun es nicht, und die Kurve trägt sie mit.
Der Pool ist, wer hier spielt. Leute, die nach einem Reaktionszeit-Test suchen und einen Durchlauf zu Ende spielen, sind kein Querschnitt durch die Bevölkerung: jünger, mehr Gamer, neugieriger, und mit der Zeit immer mehr, die wiederkommen. Ein Perzentil auf dieser Seite vergleicht dich mit den Spielern dieser Seite, nicht mit den Menschen insgesamt. Die gespeicherten Ergebnisse von Human Benchmark sind aus genau diesem Grund um ein Level nach unten verschoben; unsere eigenen Durchläufe werden nicht verschoben, weil es nichts gibt, woran man die Verschiebung festmachen könnte.
Solange die gemessene Zahl klein ist, ist das Perzentil vor allem die Annahme. Gegen 1000 angenommene Durchläufe bewegen hundert gemessene die Kurve nur ein wenig, bei tausend steht es halbe-halbe; die Zahl in jedem Eintrag oben sagt, wo ein Test steht. Bis die Durchläufe da sind, ist ein Perzentil eine Schätzung mit einer Zahl dran.
Die Uhr ist so fein, wie Browser und Gerät es zulassen. Ein Ergebnis auf Zeit wird so genau abgelesen, wie es die Auflösung des Browser-Timers hergibt (in manchen Browsern eine zehntel Millisekunde, in anderen eine ganze), und deinen Druck tastet Bildschirm oder Maus im eigenen Takt ab, auf einem Touchscreen im Abstand von ein paar Millisekunden. Alle Stellen darunter sind Rauschen. Und die Zahl bist du, heute: Schlaf, Koffein, Tageszeit und Übung verschieben sie alle, und wiederholte Durchläufe liegen im selben Pool wie erste.
Was die Seite aufzeichnet
Quellen
Die veröffentlichten Statistiken und Histogramme gespeicherter Ergebnisse von Human Benchmark (Stand 27. August 2026) verankern sieben der elf Startkurven; gemessen haben sie, verschoben haben wir, und die Verschiebung ist eine Annahme. Die anderen vier stützen sich auf die Literatur zu Reaktionszeit, Zeigebewegung (Fitts' Gesetz) und Tippen, aus dem Gedächtnis zitiert, plus einem Aufschlag für den Lag eines Browsers. Nichts davon ist eine Diagnose oder eine Beurteilung: die Tests sind für die Neugier da und für den Vergleich mit dir selbst.