Der Durchschnitt verschweigt den langen Donnerstag
Sieben Bearbeitungszeiten ergeben einen Mittelwert von elf Minuten. Trotzdem lagen sechs der sieben Vorgänge unter acht Minuten. Ein erfundenes Zahlenbeispiel zeigt, welche Frage hinter einer Kennzahl stehen sollte.

In diesem Artikel
Unsere fiktive Aufgabenliste enthält sieben Bearbeitungszeiten in Minuten: 4, 5, 5, 6, 6, 7 und 44. Die Werte sind erfunden. Wir betrachten nur diese sieben Vorgänge, keine repräsentative Stichprobe und keine Messung eines echten Betriebs.
Die Summe beträgt 77 Minuten. Geteilt durch sieben ergibt das einen arithmetischen Mittelwert von elf Minuten. Wenn wir die Werte sortieren, steht in der Mitte die 6. Dieser Median beträgt also sechs Minuten. Beide Zahlen sind richtig. Sie beschreiben verschiedene Eigenschaften derselben kleinen Liste.
Zwei Zahlen, zwei Fragen
Der Mittelwert bezieht alle Werte ein und reagiert auf den langen Vorgang. Der Median teilt die geordnete Liste: Drei Werte liegen davor, drei danach. Er beschreibt hier die Mitte, aber nicht die gesamte aufgewendete Zeit.
Wenn du abschätzen möchtest, wie viel Arbeitszeit für genau diese sieben Vorgänge angefallen ist, brauchst du die Summe. Wenn du wissen möchtest, wo die Mitte dieser Liste liegt, hilft der Median. Für die Planung einer einzelnen Anfrage reicht keine der beiden Zahlen als Versprechen.
Bei einem Ablauf wie unserer E-Mail-zu-Aufgabe-Werkstatt kann ein langer Vorgang durch menschliche Klärung entstehen. Ob er ein vermeidbarer Fehler oder ein normaler Sonderfall war, lässt sich nicht aus der Zahl allein erkennen. Dafür braucht es eine Beschreibung des Vorgangs.
Den Ausreißer nicht heimlich löschen
Die 44 Minuten stören die schöne Erzählung vom schnellen Ablauf. Genau deshalb sollten sie sichtbar bleiben. Ein Messfehler darf korrigiert werden, wenn er als solcher belegt ist. Ein tatsächlich schwieriger Auftrag darf nicht verschwinden, nur weil der Mittelwert danach freundlicher aussieht.
Wurde dieselbe Arbeit zweimal erfasst, liegt eine andere Frage vor. Dann muss zunächst geklärt werden, was ein Vorgang ist. Der Beitrag über doppelte Bot-Aufträge zeigt, warum stabile Kennungen auch für die spätere Auswertung nützlich sind.
Unterscheide außerdem langsame korrekte Ergebnisse von schnellen falschen Ergebnissen. Ein Chatbot kann eine fehlerhafte Antwort sehr schnell erzeugen. Die Sicherheit seines Tonfalls macht diese Antwort nicht zu einem erledigten Vorgang.
Ein Regler für genau eine Annahme
In der begleitenden Darstellung kannst du den letzten Wert zwischen 8 und 60 Minuten verändern. Die ersten sechs Werte bleiben 4, 5, 5, 6, 6 und 7. Ihre Summe ist 33. Der Mittelwert lautet deshalb (33 + letzter Wert) / 7. Der Median bleibt in diesem Bereich sechs Minuten.
Bei acht Minuten für den letzten Vorgang beträgt der Mittelwert rund 5,86 Minuten. Bei 44 Minuten sind es elf, bei 60 Minuten rund 13,29. Die Anzeige rundet für die Lesbarkeit; intern wird mit dem ungerundeten Wert gerechnet. Das ist ein Rechenbeispiel, keine Prognose.
Ein Backtest für einen Trading-Bot braucht einen ähnlichen Blick auf Annahmen. Dort können Kosten oder eine andere Ausführungsannahme das Ergebnis verändern. Ein Regler zeigt, wie ein Modell reagiert. Er zeigt nicht, welche Annahme in der Wirklichkeit eintreten wird.
Rechenbeispiel: sieben Bearbeitungszeiten
Die ersten sechs Werte bleiben 4, 5, 5, 6, 6 und 7 Minuten. Der Regler verändert nur den siebten Wert. Mittelwert und Median werden aus allen sieben Werten berechnet.
| Vorgang | 1 | 2 | 3 | 4 | 5 | 6 | 7 |
|---|---|---|---|---|---|---|---|
| Minuten | 4 | 5 | 5 | 6 | 6 | 7 | 44 |
Erfundenes Rechenbeispiel mit fiktiven Werten
Mittelwert: Summe geteilt durch Anzahl. Median: mittlerer Wert der sortierten Liste. Die Anzeige rundet für die Lesbarkeit, gerechnet wird mit dem ungerundeten Wert. Es handelt sich nicht um eine repräsentative Stichprobe und nicht um eine Prognose.
Vor der Kennzahl die Entscheidung notieren
Schreibe auf, welche Entscheidung du treffen möchtest. Geht es um Personalzeit, um Fehlerhäufigkeit oder um die Frage, wann eine Anfrage eskaliert? Wähle danach die Darstellung. Bei sieben Fällen ist eine kleine Tabelle mit allen Einzelwerten oft verständlicher als ein Dashboard mit sechs Kennzahlen.
Wenn du Cloud und eigenen Workflow-Server vergleichst, miss bei beiden die gleiche Aufgabe einschließlich Betreuung und Fehlerklärung. Unterschiedliche Messgrenzen liefern Zahlen, die gleich aussehen und unterschiedliche Arbeit enthalten.
Bearbeitungsprotokolle können außerdem Informationen über Menschen enthalten. Nicht jede Auswertung braucht Namen oder vollständige Nachrichten. Der Leitfaden zu Bot-Rechten und Datengrenzen hilft, die nötigen Informationen vom bequem verfügbaren Rest zu trennen.
Der lange Donnerstag ist damit kein statistischer Unfall, den man schnell wegrechnet. Er ist ein Anlass, nachzufragen. Vielleicht fehlt im Ablauf eine Rückfrage. Vielleicht war der Auftrag tatsächlich schwieriger. Erst die Antwort darauf macht aus der Kennzahl eine brauchbare Entscheidungshilfe.
Quellen und weiterführende Lektüre
Quellen und weiterführende Lektüre
Eigenes erfundenes Rechenbeispiel. Mittelwert: Summe geteilt durch Anzahl. Median: mittlerer Wert der sortierten Liste mit sieben Einträgen. Alle Daten und Rechenschritte sind oben vollständig angegeben.
Eigenes erfundenes Rechenbeispiel der Redaktion. Mittelwert: Summe geteilt durch Anzahl. Median: mittlerer Wert der sortierten Liste mit sieben Einträgen.
Prüfprotokoll: docs/research/A06.md, kein öffentlicher Link
Alle Daten und Rechenschritte sind im Beitrag vollständig angegeben. Es handelt sich um keine Messung eines echten Betriebs.
Prüfprotokoll: docs/research/A06.md, kein öffentlicher Link
Schlagwörter
- Mittelwert
- Median
- Ausreißer
- Verteilung
- Stichprobe
Weiterlesen
Eine einzelne Erfolgsquote sagt auch bei Antworten wenig über ihre Art aus: Einen FAQ-Bot mit überprüfbaren Fundstellen planen.