Quiz-Ergebnisbewertung
Die Quiz-Ergebnisbewertung ist die Logik, die die Antworten eines Teilnehmers in eine Gesamtpunktzahl umwandelt, die anschließend einer Ergebnisstufe zugeordnet wird.
Das Wichtigste in Kürze
- Summe geteilt durch erreichbares Maximum macht Ergebnisse über Quizversionen hinweg vergleichbar.
- Optionen, die nur einen Punkt auseinanderliegen, pressen alle in ein Band.
- Grenzen dort setzen, wo die beobachtete Verteilung bricht, nicht bei runden Zahlen.
- Eignung und Kaufabsicht getrennt bewerten; ihr Mittelwert verdeckt beide Signale.
- Negative Werte lassen eine disqualifizierende Antwort die Summe senken statt nur nicht erhöhen.
Im Detail
Die Rechnung ist kurz. Jede gewählte Option trägt ihren Wert zur laufenden Summe bei, und das Maximum ist die Summe der höchstwertigen Option jeder bewerteten Frage. Die Summe durch dieses Maximum zu teilen, macht aus dem Ergebnis einen Anteil, und erst das macht Quizze unterschiedlicher Länge vergleichbar. Die Stufengrenzen sind geordnete Limits: Es gewinnt das erste Band, dessen Obergrenze die Summe nicht überschreitet. Kategorieteilsummen entstehen nach derselben Rechnung.
Ob Bewertung funktioniert, entscheidet die Form der Verteilung, nicht die Größe der Zahlen. Liegen alle Optionen einer Frage nur einen Punkt auseinander, ballen sich die Teilnehmer und die Stufen trennen niemanden mehr. Große Abstände zwischen bester und schlechtester Option ziehen die Ergebnisse auseinander, Gewichte drücken die wichtigen Fragen stärker durch, und negative Werte lassen eine disqualifizierende Antwort die Summe aktiv senken. Mehr Stufen bedeuten feinere Unterschiede, aber dünnere Bänder.
Verlässlich ist diese Reihenfolge: flach starten, die Verteilung echter Teilnehmer beobachten und die Grenzen dort setzen, wo das Histogramm tatsächlich bricht, statt bei runden Zahlen. In einem Scorecard-Funnel lohnen oft zwei Punktzahlen statt einer, denn Eignung und Kaufabsicht beantworten verschiedene Fragen, und ihr Mittelwert verdeckt beide. Nach jeder Grenzverschiebung prüfen Sie den Bandmix erneut, denn früh gesetzte Schwellen überstehen einen Kanalwechsel selten.
Eine Punktzahl ist ordinal, keine Messgröße. Siebzig liegt über fünfunddreißig, ist aber nicht doppelt so gut, und wer die Zahlen als Menge behandelt, verspricht mehr, als die Daten tragen. Alles beruht auf Selbstauskunft, die Summe bildet also ab, was jemand in wenigen Minuten zu behaupten bereit war. Der Score kann zudem nichts abbilden, wonach nie gefragt wurde, etwa Budgethoheit oder Zeitpunkt, und Summen aus zwei Quizversionen gehören nie direkt verglichen.
Beispiel aus der Praxis
So wird es gemessen
Beginnen Sie mit der Verteilung der Summen als Histogramm statt mit einem Mittelwert. Sie suchen Streuung und Lücken: Ein einzelner hoher Block heißt, die Fragen unterscheiden nicht, ein Stau am Maximum heißt, die Optionen sind zu großzügig. Prüfen Sie jede Frage einzeln auf denselben Effekt, denn eine Frage, bei der fast alle die Topoption wählen, trägt nur Rauschen zur Summe bei.
Validieren Sie danach die Grenzen an den Ergebnissen. Verfolgen Sie je Band, welcher Anteil den nächsten Schritt geht und welcher am Ende konvertiert. Eine Schwelle leistet Arbeit, wenn die Conversion beim Überschreiten deutlich springt und innerhalb eines Bandes kaum variiert. Konvertieren zwei benachbarte Bänder identisch, ist die Grenze dazwischen dekorativ und die Stufen gehören zusammengelegt.
Häufige Fehler
Der klassische Fehler ist ein ausgefeiltes Gewichtungsschema, bevor eine einzige Antwort vorliegt. Die Gewichte kodieren Annahmen, die Annahmen erweisen sich als falsch, und der erste Bericht zeigt fast alle im mittleren Band. Starten Sie mit einer flachen Skala, sammeln Sie einige hundert Abschlüsse, betrachten Sie dann das Histogramm der Summen und justieren Sie die Gewichte der Fragen, die erkennbar niemanden getrennt haben.
Der zweite ist, Fragen oder Gewichte zu ändern und danach den Bandmix dieses Monats mit dem des Vormonats zu vergleichen. Ein verändertes Maximum, eine entfernte Frage oder eine neu gewichtete Antwort verschieben die Verteilung, der Vergleich misst also Ihre Änderung statt Ihr Publikum. Speichern Sie die Version zu jedem Ergebnis, behandeln Sie jede Änderung als neue Basislinie und lassen Sie die neue Version eigene Historie sammeln.
Häufig gestellte Fragen
Wie werden bei der Quiz-Ergebnisbewertung Punkte vergeben?
Jede Antwortoption erhält einen Punktwert, und Fragen mit hoher Kaufabsicht können stärker gewichtet werden. Die Plattform summiert diese Werte während der Beantwortung zu einer Gesamtzahl, die einer Ergebnisstufe zugeordnet wird.
Kann die Bewertung nach Kategorie aufgeschlüsselt werden?
Ja. Die meisten Scorecard-Tools erfassen neben der Gesamtpunktzahl auch Teilsummen pro Kategorie. So können Sie Teilnehmern eine Stärken-und-Schwächen-Auswertung statt nur einer Zahl zeigen.
Wie lege ich die Schwellenwerte zum Start fest?
Beginnen Sie mit einfachen, gleichmäßigen Gewichten und vorläufigen Stufengrenzen und beobachten Sie die Verteilung echter Teilnehmer. Justieren Sie die Schwellen anschließend anhand realer Conversion-Daten nach.
Wie wähle ich die Punktwerte für Antworten?
Beginnen Sie mit einer kleinen einheitlichen Skala, etwa null bis drei, in jeder Frage gleich angewandt. Einheitliche Werte halten das Maximum leicht berechenbar und die Summen nachvollziehbar. Zeigen echte Antworten, welche Fragen starke Interessenten von Neugierigen trennen, erhöhen Sie nur dort das Gewicht und ändern Sie jeweils eines, damit die Wirkung auf die Verteilung sichtbar bleibt.
Wo sollten die Stufengrenzen liegen?
Dort, wo die Daten brechen. Tragen Sie die Summen echter Teilnehmer auf, suchen Sie Lücken in der Verteilung und setzen Sie die Grenzen dorthin statt gewohnheitsmäßig bei einem und zwei Dritteln. Prüfen Sie danach die Bandgrößen: Enthält das oberste Band fast niemanden, entsteht dort keine Pipeline; enthält es die Hälfte, erkennt es nichts.
Prozentwerte oder Rohpunkte zeigen?
Zeigen Sie Teilnehmern einen Prozentwert und behalten Sie Rohpunkte für Ihre Logik. Ein Anteil am Maximum braucht keine Erklärung und bleibt gültig, wenn sich die Quizlänge ändert, während Rohpunkte die Kenntnis der Skala voraussetzen. Intern lässt sich die Rohsumme leichter zu einzelnen Antworten zurückverfolgen, wenn Sie ein unerwartetes Band nachvollziehen wollen.
Kann eine Antwort Punkte abziehen?
Ja, und negative Werte sind für wirklich disqualifizierende Antworten nützlich, etwa eine Branche, die Sie nicht bedienen. Ein Abzug senkt die Summe, statt sie nur nicht zu erhöhen, sodass eine starke Antwort an anderer Stelle einen harten Ausschluss nicht ausgleicht. Legen Sie fest, ob die Summe unter null fallen darf, und prüfen Sie, dass keine Kombination außerhalb Ihrer Stufengrenzen landet.
Wie viele Ergebnisstufen sollte ein Quiz haben?
So viele, wie Sie unterschiedliche nächste Schritte haben, für die meisten Funnels also drei oder vier. Jedes Band braucht eigenen Text, eigenes Angebot und genug Teilnehmer für verlässliche Aussagen. Eine fünfte Stufe, die sich den nächsten Schritt mit der vierten teilt, zerteilt das Publikum, ohne das Handeln zu ändern, und erzeugt nur Pflegeaufwand.
Wie oft sollte die Bewertung neu kalibriert werden?
Immer wenn Angebot, Zielgruppe oder Fragen sich ändern, und ansonsten bei einer regelmäßigen Prüfung des Bandmix. Früh gesetzte Schwellen passen oft nicht mehr, sobald ein neuer Kanal andere Besucher schickt. Das übliche Signal ist eine stetige Drift der Teilnehmer in ein Band, und sie zeigt sich in der Verteilung lange vor den abgeschlossenen Deals.