Marketing Glossar

2.413 Fachbegriffe aus 22 Bereichen des Online Marketings

User Testing (UX)

Definition: User Testing (Usability-Test; Nutzertest; Nutzer-Evaluation) bezeichnet eine empirische UX-Forschungsmethode bei der repräsentative Endnutzer realistische Aufgaben mit einem Produkt; Prototypen oder Teilsystem ausführen während Moderatoren oder automatisierte Systeme Verhalten; Schwierigkeiten; Fehler und Metriken beobachten und aufzeichnen – der direkteste Weg um zu verstehen wie echte Nutzer mit einem Interface interagieren und wo Usability-Probleme entstehen. User-Testing-Varianten nach Moderations-Typ: Moderierter Usability-Test (Gold-Standard; Moderator stellt Aufgaben; beobachtet live; stellt Nachfragen; Think-Aloud-Protokoll; 5–8 Teilnehmer für qualitative Problemfindung); Unmoderierter Remote-Test (kein Moderator; automatisierte Aufgaben-Zuweisung; Videoaufzeichnung; skalierbar; günstig; 20–100+ Teilnehmer für quantitative Daten); User-Testing-Varianten nach Durchführungsort: Labor-Test (dedizierter Testraum; Einwegspiegel; Kameraaufnahme; maximale Kontrolle; teuer); Remote-moderiert (Zoom + Screen-Sharing; kostengünstig; breiteres Nutzer-Panel möglich; ohne Einwegspiegel); Remote-unmoderiert (UserTesting.com; Maze; Lookback; asynchron; scalierbar; günstig); Field-Test (Nutzer im natürlichen Kontext; Contextual Inquiry-Charakter); User-Testing nach Fidelity des Testgegenstands: Paper-Prototyp-Test (Bleistift-Skizzen; Wizard-of-Oz; frühe Discovery); Low-Fidelity-Wireframe-Test (Balsamiq; Figma-Wireframe; Struktur ohne Visuelles); High-Fidelity-Prototyp-Test (Figma-Interaktiv-Prototyp; nahezu produktnah); Live-Produkt-Test (echte Produktionsumgebung; mit Test-Accounts).

Erläuterung

Die wissenschaftliche Grundlage des User Testings entstand an der Schnittstelle von kognitiver Psychologie und Mensch-Computer-Interaktion. John Gould und Clayton Lewis (IBM T.J. Watson Research Center; Yorktown Heights; NY; «Designing for Usability: Key Principles and What Designers Think», Communications of the ACM, 1985) formulierten früh die drei Grundprinzipien nutzerzentrierter Entwicklung: früher Fokus auf Nutzer und Aufgaben; empirische Messung der Nutzung; iteratives Design; Gould/Lewis-Prinzipien wurden zur konzeptuellen Grundlage für strukturiertes User Testing in der Softwareentwicklung. Jakob Nielsen (Sun Microsystems; Palo Alto; CA; dann Nielsen Norman Group; Fremont; CA; gegründet mit Don Norman 1998; «Usability Engineering», Morgan Kaufmann, 1993; «Why You Only Need to Test with 5 Users», nngroup.com, 19. März 2000) popularisierte User Testing als kosteneffiziente Praxis: Nielsen's bekannteste Erkenntnis ist die 5-Nutzer-Regel aus der binomialen Entdeckungskurve (Jakob Nielsen/Thomas K. Landauer; «A Mathematical Model of the Finding of Usability Problems», ACM CHI, 1993): N = n × (1 − (1 − L)^n); bei L=0,31 (durchschnittliche Entdeckungswahrscheinlichkeit pro Nutzer) entdecken 5 Nutzer ~85% aller gravierenden Usability-Probleme; 15 Nutzer ~99%; jeder zusätzliche Nutzer liefert degressiven Mehrwert; Nielsen's Einschränkungen: gilt für eine homogene Nutzergruppe; für heterogene Zielgruppen mehrere separate 5-Nutzer-Tests (segmentiert nach Nutzertyp). Tom Tullis (Fidelity Investments; Boston; MA; dann Human Factors International) und Bill Albert (Bentley University; Waltham; MA; «Measuring the User Experience: Collecting, Analyzing, and Presenting Usability Metrics», Morgan Kaufmann, 2008; zweite Auflage 2013) systematisierten die Metriken-Seite des User Testings: Task-Completion-Rate (Effektivität; ISO 9241-11); Time-on-Task (Effizienz; log-normal verteilt; geometrisches Mittel); Error-Rate; Zufriedenheits-Scores (SUS; SEQ; SUPR-Q); Tullis/Albert unterschieden zwischen formativen Tests (Probleme identifizieren; qualitativ; kleine Stichprobe) und summativen Tests (Performance messen; quantitativ; Benchmark; große Stichprobe); dieser Unterschied ist fundamental für die Wahl der Test-Methode. Steve Krug (Advanced Common Sense; Brooklyn; MA; «Don't Make Me Think», New Riders, 2000; dritte Auflage 2014; «Rocket Surgery Made Easy», New Riders, 2010) demokratisierte User Testing für kleine Teams und Nicht-Forscher: Krug's «Rocket Surgery Made Easy»-Konzept: monatliche Usability-Tests mit 3 Teilnehmern; 2-Stunden-Sessions; Team beobachtet live; sofortige Debrief-Session; 5 wichtigste Probleme identifizieren; iterieren; Krug argumentierte überzeugend dass ein einfacher Test früh besser ist als kein Test; seine Praxis-Anleitungen wurden in kleinen Produktteams weltweit übernommen. Jared Spool (User Interface Engineering; UIE; Andover; MA; 1988 gegründet; Autor und Forscher) betonte die Bedeutung der Aufgaben-Formulierung als kritischsten Faktor im User Testing: schlecht formulierte Tasks kontaminieren Testergebnisse; Spool unterschied Scenario-Tasks (kontextuell eingebettet: «Stellen Sie sich vor Sie wollen einen Geburtstagskuchen bestellen und haben 3 Tage Zeit») von Directive-Tasks (direkt: «Gehen Sie zur Produktseite für Schokoladenkuchen»); Scenario-Tasks generieren natürlicheres Verhalten da sie den Nutzer weniger direkt zur Lösung führen; UIE-Forschung zeigte dass Task-Wording die Completion-Rate um bis zu 40% beeinflussen kann. Laura Faulkner (University of Texas at Austin; «Beyond the Five-User Assumption: Benefits of Increased Sample Sizes in Usability Testing», Behavior Research Methods, Instruments & Computers, 2003) untersuchte die Variabilität in Problemfindungs-Raten und zeigte dass 5 Nutzer je nach Test zwischen 55% und 99% der Probleme entdecken können (hohes Variabilitätsproblem bei kleinen Stichproben); Faulkner's Ergebnis relativierte Nielsen's 5-Nutzer-Regel: 5 Nutzer genügen als Minimum wenn die Aufgaben gut sind und die Nutzer repräsentativ gewählt; für kritische Systeme (Medizin; Finanzen; Behörden) sind größere Stichproben notwendig.

Test-Planung und Aufgaben-Design

Moderations-Techniken und Durchführung

Analyse und Reporting

Praxistipp: Der häufigste Fehler beim User Testing: zu lange warten bis das Design «fertig» ist. Paper-Prototyp-Tests mit Bleistiftskizzen (Wizard-of-Oz: Moderator «spielt» das System manuell) finden in zwei Stunden die grundlegendsten Struktur- und Navigations-Probleme – bevor ein einziger Pixel gesetzt ist. Zweiter Tipp: Laden Sie Ihr Entwicklungs-Team als stille Beobachter ein. Entwickler die einen echten Nutzer beim Scheitern zusehen ändern ihre Prioritäten schneller als jedes Report-Dokument. Dritter Tipp: Stellen Sie nach jeder Aufgabe die SEQ (Single Ease Question: «Wie schwierig war diese Aufgabe? 1–7»). Diese 10-sekündige Messung gibt Ihnen vergleichbare Zahlen quer über alle Aufgaben und macht qualitative Findings quantifizierbar.