# Dual N-Back: Punkte, Formeln und Rechner

Canonical: https://romeoapps.app/de/dual-n-back/dual-n-back-scoring/
Author: Roméo Gambino · Published: 2026-09-07 · Updated: 2026-09-08 · App: Dual N-Back (https://romeoapps.app/de/dual-n-back/)

Verstehen Sie Treffer, Auslassungen und Fehlalarme in dual n-back. Vergleichen Sie Bewertungsformeln mit einem ausgearbeiteten Beispiel und einem interaktiven Rechner.

## Beginnen Sie mit einem Stream und einer Vergleichsregel

Dual n-back fordert Sie auf, Position und Klang getrennt zu beurteilen. Für jeden Stream ist ein Ziel ein Gegenstand, der genau N Runden zuvor mit dem Gegenstand übereinstimmt. Eine Antwort ist ein Druck auf das entsprechende Steuerelement im Antwortfenster. In derselben Runde kann sich ein Ziel in einem Strom, in beiden oder in keinem von beiden befinden. Bevor Sie einen Prozentsatz interpretieren, stellen Sie fest, welcher Strom, welche berechtigten Wendungen und welches Antwortfenster er beschreibt. Ein Prozentsatz ohne seine Zählregel lässt Informationen aus, die Sie zur Interpretation benötigen.


## Die vier möglichen Ergebnisse

Ein Treffer bedeutet, dass Sie auf ein echtes Match gedrängt haben. Ein Fehlschlag bedeutet, dass ein echtes Spiel ohne die erforderliche Antwort bestanden wurde. Ein Fehlalarm bedeutet, dass Sie gedrückt haben, als es in der erforderlichen Entfernung keine Übereinstimmung gab. Eine korrekte Ablehnung bedeutet, dass es keine Übereinstimmung gab und Sie nicht gedrückt haben. Diese vier Zählungen bilden einen vollständigen Datensatz für die zulässigen Vergleiche in einem Stream. Sie beschreiben Ergebnisse, nicht ihre Ursachen: Ein Fehlalarm kann zu Verwirrung über N, einem versehentlichen Antippen oder einer unsicheren Entscheidung führen. Die Zählung allein kann Ihnen nicht sagen, was passiert ist.


## Ein praktisches Beispiel: 100 geeignete Vergleiche

Stellen Sie sich einen Stream mit 20 Matches und 80 Non-Matches vor. Sie identifizieren 16 Übereinstimmungen richtig, verpassen 4, drücken bei 8 Nicht-Übereinstimmungen falsch und lassen 72 Nicht-Übereinstimmungen korrekt in Ruhe. Die vier Zählungen ergeben zusammen 100: 16 + 4 + 8 + 72. Dabei handelt es sich um erfundene Lehrwerte, nicht um Ergebnisse von Benutzern oder um eine empfohlene Zielvorgabe. Wenn Sie ein vollständiges Beispiel führen, können Sie leichter erkennen, wie die gleiche Leistung zu unterschiedlichen Prozentsätzen führen kann, ohne dass eine der Berechnungen arithmetisch falsch ist.

### 100 comparisons, four possible outcomes

Dies ist ein fiktives Beispiel für einen Stream. Es gibt 20 Ziele: 16 wurden richtig erkannt und 4 verfehlt. Es gibt 80 Nichtziele: Auf 8 antwortet der Spieler falsch und auf 72 nicht richtig. Jedes Quadrat stellt einen Vergleich dar. Die Farben gruppieren die vier Ergebnistypen, nicht die chronologische Reihenfolge einer Sitzung. Überprüfen Sie diese einzelnen Zählungen sowie den Gesamtprozentsatz.


## Trefferquote und Fehlalarmquote verwenden unterschiedliche Nenner

Trefferquote: Treffer / (Treffer + Auslassungen) = 16 / (16 + 4) = 80 %. Fehlalarmquote: Fehlalarme / (Fehlalarme + Korrekte Zurückweisungen) = 8 / (8 + 72) = 10 %. Wenn der Nenner Null ist, ist die Rate undefiniert. Formeln und das vollständige Beispiel bleiben auch ohne JavaScript lesbar.


## Gesamtgenauigkeit und aktive Genauigkeit beantworten unterschiedliche Fragen

Gesamtgenauigkeit: (Treffer + Korrekte Zurückweisungen) / (Treffer + Auslassungen + Fehlalarme + Korrekte Zurückweisungen) = (16 + 72) / 100 = 88 %. Aktive Genauigkeit: Treffer / (Treffer + Auslassungen + Fehlalarme) = 16 / (16 + 4 + 8) ≈ 57.1 %. Precision (PPV): Treffer / (Treffer + Fehlalarme) = 16 / (16 + 8) ≈ 66.7 %.


## Warum es täuschend gut aussehen kann, wenn man nie drückt

Behalten Sie die 20 Übereinstimmungen und 80 Nicht-Übereinstimmungen des Beispiels bei, aber stellen Sie sich vor, Sie würden nie drücken. Die Zählungen ergeben 0 Treffer, 20 Fehlschüsse, 0 Fehlalarme und 80 korrekte Ablehnungen. Die Gesamtgenauigkeit beträgt 80 %, obwohl jedes Spiel verpasst wurde. Die aktive Genauigkeit beträgt 0 %, die Trefferquote beträgt 0 % und die Fehlalarmrate beträgt 0 %. Das Beispiel zeigt die Bedeutung des Nenners; Dies bedeutet nicht, dass eine App unbedingt 80 % für Nichtstun vergibt. Eine zielsensitive Bewertungsregel kann dasselbe Verhalten ganz unterschiedlich behandeln.


## Probieren Sie die Zählungen aus, ohne sie mit einem App-Ergebnis zu verwechseln

Der folgende Rechner funktioniert mit einem Stream. Seine Startwerte reproduzieren das 100-Vergleichsbeispiel. Ändern Sie eine Zählung, um die vier Formeln zu erkunden, oder verwenden Sie das Beispiel „Niemals drücken“, um die Anzahl der Ziele konstant zu halten und gleichzeitig das Antwortmuster zu ändern. Null-Nenner-Ergebnisse werden als undefiniert angezeigt und nicht stillschweigend in eine gute oder schlechte Bewertung umgewandelt. Dies ist ein Lehrmittel, kein Import Ihres App-Verlaufs, keine Rekonstruktion jeder App-Version oder eine klinische Bewertung. Die Werte bleiben in Ihrem Browser.


## Lesen Sie Position und Ton ab, bevor Sie sie kombinieren

Berechnen Sie jeden Stream separat, wenn die zugrunde liegenden Zählungen verfügbar sind. Wenn Sie Streams kombinieren, entscheiden Sie, ob Sie die Zählungen bündeln oder Prozentsätze mitteln. Diese Verfahren können unterschiedlich sein, wenn die Nenner unterschiedlich sind. Beispielsweise hat ein Stream mit 9 Treffern in 10 Zielversuchen eine Trefferquote von 90 %, während ein anderer mit 1 Treffer in 2 Zielversuchen eine Trefferquote von 50 % hat. Ihr einfacher Durchschnitt liegt bei 70 %; Ihre gepoolte Trefferquote beträgt 10/12, also etwa 83,3 %. Geben Sie an, welche Berechnung Sie verwendet haben. Keiner sollte stillschweigend den anderen ersetzen.


## Eine gute Punktzahl hängt von den Aufgabeneinstellungen ab

N, die Anzahl der aktiven Streams, das Tempo, die Anzahl der zulässigen Versuche, die Zielhäufigkeit und die Bewertungsformel beeinflussen alle die Bedeutung einer Bewertung. Ein Ergebnis aus einem anderen Setup ist nicht automatisch besser oder schlechter als Ihres. Überprüfen Sie, wie erste Runden ohne ausreichende Historie behandelt werden, ob bei gleichzeitigen Spielen zwei Antworten erforderlich sind und ob verpasste Antworten getrennt nach Stream gezählt werden. Halten Sie diese Einstellungen für Vergleiche im Zeitverlauf so konsistent wie möglich und zeichnen Sie Änderungen auf, anstatt jeden Prozentsatz als austauschbar zu behandeln.

### Read the settings before comparing scores

In diesem erfassten Einstellungsbildschirm: 1 ändert den Audiomodus; 2 changes immediate feedback; 3 wählt die N-Ebene; 4 selects the number of rounds. Vergleichen Sie die Ergebnisse erst, nachdem Sie diese Bedingungen überprüft haben. Die verfügbaren Stufen und Bezeichnungen können je nach App-Version und Kaufstatus variieren.

![In den englischen App-Einstellungen werden „Kein Ton“, „Sofortiges Feedback“, „N-Level“ und „Runden“ angezeigt.](https://romeoapps.app/assets/dnb-settings-capture-2026-09.png)
Tatsächliche App-Erfassung · September 2026 · Die Sprache der Benutzeroberfläche kann abweichen · EN · 2026-09-06

[Dual N-Back-Einstellungen auf iPhone: Audio, Feedback und Pegel](https://romeoapps.app/de/dual-n-back/dual-n-back-settings-iphone/)

## Variabilität ist eine Information, keine Diagnose

Eine Sitzung kann je nach Aufmerksamkeit, Vertrautheit mit den Bedienelementen, Unterbrechungen oder anderen Bedingungen variieren. Ein Score allein gibt keinen Aufschluss darüber, warum es sich verändert hat, und es gibt hier keine Grundlage dafür, Schlaf, Koffein oder einem bestimmten Tag einen festen Effekt zuzuordnen. Schauen Sie sich mehrere vergleichbare Sitzungen an, bevor Sie einen Trend interpretieren. Ein Plateau stellt keine biologische Obergrenze dar und ein niedrigeres Ergebnis bedeutet nicht automatisch einen Verlust der allgemeinen Gedächtnisleistung. Wenn sich eine Sitzung unangenehm oder frustrierend anfühlt, ist eine kürzere Sitzung oder eine Pause eher eine praktische Option als eine garantierte Punktestrategie.


## Was in einem einfachen Übungsprotokoll aufbewahrt werden sollte

Behalten Sie Datum, N, aktive Streams, Tempo, Anzahl der berechtigten Testversionen und die verwendete Formel bei. Behalten Sie, sofern verfügbar, die vier Ergebniszählungen für jeden Stream bei; Die Kurse können dann neu berechnet werden, ohne ihren Nenner zu erraten. Fügen Sie eine kurze Notiz zu einer Unterbrechung oder einer Einstellungsänderung hinzu, wenn dies Ihnen später bei der Interpretation der Sitzung hilft. Eine persönliche Bestleistung kann motivierend sein, ist aber nicht dasselbe wie ein typisches Ergebnis. Einige vergleichbare Datensätze sind aussagekräftiger als eine Sammlung von Prozentsätzen ohne Beschreibung der Aufgabe.

[Dual-N-Back-Fortschritt mit einem Sitzungsprotokoll verfolgen](https://romeoapps.app/de/dual-n-back/dual-n-back-progress-log/)

## Was diese Zahlen belegen können und was nicht

Diese Bewertungen beschreiben Antworten auf eine bestimmte Aufgabe unter bestimmten Regeln. Eine Verbesserung bei dieser Aufgabe ist an sich noch kein messbarer Anstieg des IQ oder ein Beweis für bessere Leistungen in der Schule oder am Arbeitsplatz. Der Forschungsleitfaden erläutert den Unterschied zwischen Praxisgewinnen und der Übertragung auf andere Ergebnisse. Nutzen Sie die Ergebnisse, um Ihre Antworten und die Regeln der Übung zu verstehen. Ihr tatsächliches Sitzungsergebnis finden Sie in den Definitionen und der Aufschlüsselung pro Stream, die von der App angezeigt werden. Der Taschenrechner ist dazu da, die Arithmetik transparent zu machen.

[Wirkt Dual N-Back? Studien und Grenzen](https://romeoapps.app/de/dual-n-back/does-dual-n-back-work/)

## Fragen

### Was ist ein Fehlalarm in n-back?

Eine Antwort, wenn es im erforderlichen N-back-Abstand keine Übereinstimmung gab. Es beschreibt ein Ergebnis; Die Zählung allein gibt keinen Aufschluss darüber, ob die Ursache eine Vermutung, Verwirrung oder ein versehentliches Antippen war.

### Warum kann dieselbe Sitzung 88 % und 57,1 % anzeigen?

Die Formeln können unterschiedliche Nenner verwenden. Im ausgearbeiteten Beispiel beträgt die Gesamtgenauigkeit (16 + 72) / 100 = 88 %, während die aktive Genauigkeit 16 / (16 + 4 + 8) beträgt, also etwa 57,1 %.

### Reproduziert der Rechner meinen App-Score?

Es veranschaulicht vier explizite Formeln für einen Stream. Ihr angezeigtes App-Ergebnis kann unterschiedliche Berechtigungsregeln verwenden oder mehrere Streams kombinieren. Überprüfen Sie vor dem Vergleich die Definitionen der App.

### Was passiert, wenn ein Nenner Null ist?

Diese Rate ist nicht definiert. Der Rechner zeigt ein undefiniertes Ergebnis an, anstatt fehlende Beobachtungen als perfekte oder fehlgeschlagene Leistung zu behandeln.

## Weiterlesen

- Kane et al. (2007), Working memory, attention control, and the n-back task, Journal of Experimental Psychology: Learning, Memory, and Cognition — https://doi.org/10.1037/0278-7393.33.3.615
- Cowan (2010), The Magical Mystery Four: How is working memory capacity limited, and why?, Current Directions in Psychological Science — https://doi.org/10.1177/0963721409359277
- scikit-learn documentation — classification metrics and confusion matrices (mathematical definitions) — https://scikit-learn.org/stable/modules/model_evaluation.html#classification-metrics

