Umfrage (Survey)
Definition: Eine Umfrage (englisch: Survey) ist ein standardisiertes, strukturiertes Befragungsverfahren, bei dem einer definierten Personengruppe (Stichprobe) ein Fragenkatalog vorgelegt wird, um Meinungen, Einstellungen, Verhaltensweisen, Präferenzen oder soziodemografische Merkmale zu erfassen. Im Gegensatz zu qualitativen Befragungsmethoden (Tiefeninterview, Fokusgruppe) zielen Umfragen auf die quantitative Erfassung von Merkmalen ab, die statistisch ausgewertet, hochgerechnet und über Gruppen und Zeitpunkte hinweg verglichen werden können. Umfragen sind das am häufigsten eingesetzte Verfahren der quantitativen Primärforschung und bilden die methodische Grundlage für Kundenzufriedenheitsstudien, Markenbefragungen, Produkttests, NPS-Erhebungen, politische Meinungsforschung und sozialwissenschaftliche Erhebungen. Die Qualität einer Umfrage hängt von drei Kernelementen ab: dem Stichprobendesign (Wen befragen wir?), dem Fragebogendesign (Was und wie fragen wir?) und der Erhebungsdurchführung (Wie und wann erheben wir die Daten?). Fehler in einem dieser Bereiche können die Validität und Repräsentativität der Ergebnisse grundlegend gefährden.
Erläuterung
Umfragen können in verschiedenen Erhebungsmodi durchgeführt werden, die sich hinsichtlich Kosten, Erreichbarkeit, Antwortqualität und möglichen Verzerrungen unterscheiden. Die Online-Umfrage ist heute der dominierende Modus in der kommerziellen Marktforschung: Sie ist kostengünstig, skalierbar, erlaubt Routing-Logiken und Multimedia-Elemente, leidet aber unter Selbstselektion und Cover-age-Bias gegenüber nicht-internetaffinen Bevölkerungsgruppen. Die telefonische Befragung (CATI: Computer Assisted Telephone Interviewing) erreicht breitere Zielgruppen, ist aber durch sinkende Erreichbarkeit und Interviewer-Effekte belastet. Die persönliche Face-to-Face-Befragung (CAPI: Computer Assisted Personal Interviewing) erlaubt komplexere Fragebogen und höchste Datenqualität, ist aber sehr kostenintensiv. Die postalische Befragung hat durch geringe Rücklaufquoten und lange Feldzeiten an Bedeutung verloren.
Das Fragebogendesign ist eine wissenschaftliche Disziplin für sich. Grundregeln sind: Fragen sollen eindeutig, einfach und unmissverständlich formuliert sein; Doppelfragen ("Wie zufrieden sind Sie mit Preis und Qualität?") sind zu vermeiden; Fragen sollen keine Antwort suggerieren; die Reihenfolge von Fragen beeinflusst die Antworten (Primacy/Recency-Effekte, Kontext-Priming). Die Wahl des Skalenniveaus bestimmt die statistischen Auswertungsoptionen: Nominalskalen (z. B. Geschlecht, Markenwahl) erlauben Häufigkeitsanalysen; Ordinalskalen (Likert-Skalen, Rankings) erlauben Median- und Rangkorrelationen; Intervall- und Ratioskalen erlauben Mittelwerte und parametrische Tests.
Ein häufig unterschätzter Qualitätsfaktor ist der kognitive Pretest: Vor dem eigentlichen Feldeinsatz werden 5–10 Personen gebeten, den Fragebogen laut durchzugehen und alle Gedanken zu verbalisieren. Dabei treten missverständliche Fragen, unklare Antwortkategorien und Ermüdungseffekte zutage, die im fertigen Fragebogen nicht mehr sichtbar sind. Zusätzlich empfiehlt sich ein Pilottest mit ca. 50 Personen, der Abbruchquoten und Interviewdauer misst. Die Länge des Fragebogens ist einer der stärksten Prädiktoren für Abbruchrate: Jede zusätzliche Minute Befragungsdauer erhöht den Abbruch – in der Praxis gelten 10–12 Minuten als Maximum für Online-Umfragen ohne besondere Incentivierung.
Referenzen: Diekmann (2016): "Empirische Sozialforschung". Rowohlt. – Porst (2014): "Fragebogen. Ein Arbeitsbuch". Springer VS. – Groves et al. (2009): "Survey Methodology". Wiley. – Bradburn/Sudman/Wansink (2004): "Asking Questions: The Definitive Guide to Questionnaire Design". Jossey-Bass. – ESOMAR (2023): "ICC/ESOMAR International Code on Market, Opinion and Social Research and Data Analytics".
Fragebogendesign: Häufige Fehler und Best Practices
- Einfache, klare Sprache: Fragen müssen für alle Zielgruppensegmente verständlich sein; Fachbegriffe, Anglizismen und Abkürzungen sind zu vermeiden oder zu erklären.
- Keine Doppelfragen: Jede Frage soll genau eine Sache erfragen; "Wie zufrieden sind Sie mit Preis und Qualität?" zwingt zu Kompromissen und macht die Antwort uninterpretierbar.
- Keine Leading Questions: "Würden Sie auch das innovative neue Produkt X kaufen?" suggeriert die gewünschte Antwort; neutrale Formulierungen sind Pflicht für valide Ergebnisse.
- Fragenreihenfolge und Trichterstruktur: Von allgemeinen zu spezifischen Fragen; Einstellungsfragen vor Verhaltensfragen; demografische Fragen ans Ende – verhindert Kontaminationseffekte durch frühzeitig aktivierte Schemata.
- Ausgewogene Skalen: Antwortskalen sollen symmetrisch und erschöpfend sein; eine Mittekategorie ("weder noch") sollte bei Einstellungsmessungen angeboten werden, damit Erzwingungseffekte vermieden werden.
Gütekriterien und Qualitätssicherung
- Inhaltsvalidität: Die Fragen erfassen tatsächlich das theoretische Konstrukt, das gemessen werden soll – geprüft durch Expertenurteile oder explorative qualitative Vorstudien.
- Reliabilität: Mehrere Items, die dasselbe Konstrukt messen, sollten hoch miteinander korrelieren (Cronbachs Alpha > 0,70); Split-half-Reliabilität prüft Konsistenz zwischen zwei Fragehälften.
- Kognitiver Pretest: Lautes Denken von 5–10 Personen vor dem Feldeinsatz deckt Missverständnisse auf; unverzichtbar für hohe Fragebogenqualität.
- Rücklaufmonitoring und Feldsteuerung: Tägliche Überprüfung von Abbruchquoten (nach Frage, Screener), Ausfüllzeiten und demografischer Zusammensetzung – ermöglicht frühzeitige Korrekturen.