Ein Usability Test prüft, ob reale Personen eine Aufgabe mit einem System tatsächlich erledigen können – und woran sie scheitern.
Der Aufbau ist denkbar einfach: Eine Person bekommt eine realistische Aufgabe und bearbeitet sie, während jemand zusieht. Der Wert entsteht nicht durch Aufwand, sondern durch Verzicht – darauf, zu erklären, zu helfen und einzugreifen.
Genau das ist die schwierigste Anforderung. Wer ein System kennt, will helfen, sobald jemand zögert. Aber an genau diesen Stellen liegt das Ergebnis. Jede Hilfestellung löscht einen Befund.
Dieser Artikel zeigt, wie ein Test geplant, durchgeführt und ausgewertet wird – in einem Umfang, der auch ohne eigene Forschungsabteilung machbar ist.
Inhaltsverzeichnis
- Wozu ein Usability Test dient
- Vorbereitung: Ziel, Umfang, Zeitpunkt
- Wen Sie testen sollten
- Aufgaben richtig formulieren
- Die Durchführung
- Beobachten und festhalten
- Auswertung und Priorisierung
- Wann ein Usability Test belastbare Ergebnisse liefert
- Fazit zu Usability Test
- FAQ zum Usability Test
Wozu ein Usability Test dient
Ein Test beantwortet eine Frage, die keine Befragung beantworten kann: Was passiert tatsächlich, wenn jemand die Aufgabe erledigen soll?
Der Unterschied ist grundlegend. In einer Befragung berichten Menschen, was sie erinnern, für richtig halten oder sagen wollen. Im Test zeigt sich, was sie tun. Beides weicht regelmäßig voneinander ab – nicht aus Unehrlichkeit, sondern weil eingespielte Umwege nicht mehr bewusst wahrgenommen werden.
Ein Test liefert damit:
- Stellen, an denen Menschen zögern oder den falschen Weg wählen
- Begriffe, die anders verstanden werden als gemeint
- Erwartungen, die das System nicht erfüllt
- Umwege, die Anwender sich selbst gebaut haben
- eine belastbare Grundlage für Priorisierung statt Meinungsdiskussion
Der letzte Punkt ist im Projektalltag oft der wertvollste. Eine beobachtete Szene beendet Diskussionen, die eine Meinung nicht beenden kann. Wenn mehrere Personen unabhängig voneinander an derselben Stelle stocken, ist das ein starkes Indiz für ein systematisches Problem.
Was ein Test dagegen nicht leistet: Er sagt nichts über Häufigkeit im Gesamtbestand aus und ersetzt keine Auswertung von Nutzungsdaten. Er zeigt, dass ein Problem existiert und warum – nicht, wie viele Personen es betrifft.
Auch das Fraunhofer FIT beschreibt Usability Tests als zentralen Bestandteil der systematischen Evaluation und Optimierung interaktiver Produkte und Anwendungen.
Die Einordnung der Begriffe behandelt der Beitrag zur Usability, den größeren Zusammenhang der Beitrag zur User Experience.
Vorbereitung: Ziel, Umfang, Zeitpunkt
Vor dem Test stehen drei Festlegungen.
- Das Ziel. Nicht „wir schauen uns das mal an", sondern eine konkrete Frage: Finden neue Mitarbeitende die Freigabefunktion ohne Hilfe? Lässt sich eine Bestellung mit Teillieferung fehlerfrei erfassen?
- Der Umfang. Ein Test deckt zwei bis vier Aufgaben ab und dauert je Person 30 bis 60 Minuten. Mehr führt zu Ermüdung und schlechteren Beobachtungen.
- Der Zeitpunkt. Je früher, desto günstiger. Getestet werden kann bereits eine Skizze auf Papier – lange bevor etwas programmiert ist. Eine Änderung an einer Skizze kostet Minuten, dieselbe Änderung nach der Umsetzung ein Vielfaches.
Wie solche frühen Entwürfe, Wireframes und Prototypen im Gestaltungsprozess entstehen, zeigt ergänzend der Beitrag „UX Design“.
Für den Test brauchen Sie außerdem eine Testumgebung mit realistischen Daten. Ein leeres System verhält sich anders als ein gefülltes: Suchfunktionen wirken schneller, Listen bleiben übersichtlich, Sortierungen fallen nicht auf. Wer im leeren System testet, findet die Probleme des vollen nicht.
Wen Sie testen sollten
Für einen qualitativen, explorativen Usability Test reichen häufig wenige Personen pro klar definierter Nutzergruppe aus. Als praktische Orientierung werden oft etwa fünf Testpersonen genannt. Entscheidend ist jedoch nicht eine feste Zahl, sondern ob relevante Nutzerrollen und Aufgaben ausreichend abgedeckt sind.
Gibt es mehrere klar unterschiedliche Nutzergruppen – etwa Innendienst und Lager –, sollten diese getrennt betrachtet und mit jeweils passenden Testpersonen abgedeckt werden.
Eine Anmerkung zur Rekrutierung im eigenen Haus: Machen Sie deutlich, dass das System geprüft wird, nicht die Person. Ohne diesen Hinweis verhalten sich Teilnehmende anders, versuchen Fehler zu vermeiden und melden Unklarheiten nicht.

Aufgaben richtig formulieren
Die Aufgabenstellung entscheidet über die Qualität der Ergebnisse. Eine gute Aufgabe beschreibt ein Ziel, keinen Weg.
|
Ungeeignet |
Geeignet |
|
„Klicken Sie auf Aufträge und dann auf Neu" |
„Ein Kunde bestellt telefonisch zehn Stück. Erfassen Sie die Bestellung." |
|
„Testen Sie die Suchfunktion" |
„Finden Sie heraus, ob Artikel 4711 noch verfügbar ist." |
|
„Wie gefällt Ihnen die Übersicht?" |
„Sagen Sie mir, welcher Auftrag als nächstes bearbeitet werden muss." |
Die linke Spalte verrät jeweils den Lösungsweg oder fragt nach Meinung. Beides macht den Test wertlos, weil genau das Finden des Wegs die interessante Beobachtung wäre.
Formulieren Sie Aufgaben als realistische Situationen aus dem Arbeitsalltag und beginnen Sie mit einer einfachen Aufgabe zum Ankommen. Vermeiden Sie in der Aufgabenstellung Begriffe, die im System als Beschriftung vorkommen – sonst wird die Aufgabe zur Suchübung nach dem Wort.
Die Durchführung
Der Ablauf je Person:
- Begrüßung und Rahmen erklären: Das System wird geprüft, nicht die Person. Es gibt kein Richtig oder Falsch.
- Um lautes Denken bitten: „Sagen Sie einfach, was Sie gerade denken und erwarten."
- Erste Aufgabe stellen – vorlesen und schriftlich hinlegen
- Beobachten, nicht eingreifen
- Nach jeder Aufgabe kurz nachfragen: Was war unklar? Was hatten Sie erwartet?
- Abschluss: Gesamteindruck, offene Punkte
Schritt vier ist der schwerste. Halten Sie Hilfestellungen zurück, auch wenn es unangenehm wird. Wenn eine Person zwei Minuten sucht, ist das ein Ergebnis, kein Versagen der Moderation.
Zulässig sind Gegenfragen, die nicht auf die Lösung führen: „Was würden Sie als Nächstes versuchen?" oder „Was erwarten Sie hinter dieser Schaltfläche?"
Wird eine Aufgabe gar nicht gelöst, brechen Sie nach einer vorab festgelegten Zeit ab – etwa fünf Minuten – und gehen zur nächsten über. Notieren Sie den Abbruch; er ist ein besonders deutlicher Befund.
Moderiert oder unmoderiert?
Für interne Anwendungen ist die moderierte Variante fast immer besser: Sie liefert Begründungen, nicht nur Klickpfade. Unmoderierte Tests über Werkzeuge lohnen sich eher bei großen Nutzerzahlen und öffentlich zugänglichen Anwendungen.
Vor Ort oder aus der Ferne?
Beides funktioniert. Vor Ort sehen Sie mehr – Körperhaltung, Blickrichtung, das Notizbuch neben der Tastatur. Aus der Ferne ist die Organisation einfacher und die Situation für Teilnehmende oft entspannter.
Damit aus einzelnen Beobachtungen belastbare Verbesserungen entstehen, verbindet die DIPS GmbH Testplanung, Moderation und Auswertung mit einem klaren Blick auf Nutzerrollen, Geschäftsprozesse und technische Rahmenbedingungen. Gemeinsam mit den Fachbereichen werden realistische Aufgaben ausgewählt, relevante Befunde priorisiert und anschließend in konkrete Anforderungen und umsetzbare Maßnahmen überführt – auch bei bestehenden Systemen, die nicht von DIPS entwickelt wurden.
Beobachten und festhalten
Halten Sie während des Tests fest, was passiert ist, nicht Ihre Deutung:
|
Notieren |
Nicht notieren |
|
„Sucht 90 Sekunden im Menü Stammdaten" |
„Menü ist unlogisch" |
|
„Sagt: Ich dachte, das wäre unter Aufträge" |
„Person war verwirrt" |
|
„Klickt dreimal auf dieselbe Schaltfläche" |
„Reaktionszeit zu langsam" |
Die Deutung folgt in der Auswertung, gemeinsam und mit allen Beobachtungen im Blick. Wer während des Tests bereits interpretiert, sieht danach nur noch die eigene Erklärung.
Nützlich sind vier Kategorien je Beobachtung:
- Aufgabe gelöst (ja, mit Umweg, nein)
- Dauer
- Stelle im Ablauf
- wörtliches Zitat.
Zitate sind später das wirksamste Mittel, um Befunde zu vermitteln – ein Satz einer Anwenderin überzeugt mehr als jede Zusammenfassung.
Je nach Testziel können zusätzlich Erfolgsquote, Bearbeitungszeit, Fehlversuche und benötigte Hilfestellungen erfasst werden. Diese Werte ersetzen die qualitative Beobachtung nicht, erleichtern aber den Vergleich zwischen Aufgaben, Varianten oder späteren Testdurchläufen.
Eine Aufzeichnung von Bildschirm und Ton erleichtert die Auswertung erheblich. Holen Sie dafür vorab die Zustimmung ein und klären Sie, wer die Aufnahme sieht und wann sie gelöscht wird – insbesondere bei Aufzeichnungen mit Mitarbeitenden.

Auswertung und Priorisierung
Werten Sie zeitnah aus, idealerweise am selben oder nächsten Tag.
- Beobachtungen sammeln – alle Personen, alle Aufgaben
- Gruppieren: Welche Befunde traten mehrfach auf?
- Ursache bestimmen: Liegt es an Bezeichnung, Anordnung, Ablauf oder fehlender Rückmeldung?
- Schwere einstufen
- Aufwand schätzen
- Maßnahmen ableiten mit verantwortlicher Person und Termin
Für die Einstufung genügt eine einfache Skala:
|
Stufe |
Kriterium |
|
Kritisch |
Aufgabe nicht lösbar oder Fehler mit Folgen |
|
Schwer |
Aufgabe nur mit erheblichem Umweg lösbar |
|
Leicht |
Verzögerung oder Irritation ohne Folgen |
|
Hinweis |
Einzelmeinung, kein Muster |
Die Priorisierung ergibt sich aus Schwere mal Häufigkeit gegen Aufwand. Auffällig oft entstehen daraus Verbesserungen, die wenig kosten: eine geänderte Beschriftung, ein zusätzlicher Hinweistext, eine andere Reihenfolge.
Beginnen Sie mit diesen schnellen Punkten. Sie zeigen den Beteiligten, dass die Teilnahme etwas bewirkt hat – die Voraussetzung dafür, dass beim nächsten Mal wieder jemand mitmacht.
Der Bericht sollte kurz sein: die drei bis fünf wichtigsten Befunde, je mit einem Zitat und einer konkreten Empfehlung. Ein dreißigseitiger Bericht wird nicht gelesen und ändert deshalb nichts.
Wann ein Usability Test belastbare Ergebnisse liefert
|
Voraussetzung |
Warum sie wichtig ist |
|
Aufgaben verraten den Lösungsweg nicht |
der tatsächliche Weg bleibt beobachtbar |
|
Testpersonen entsprechen der Zielgruppe |
Vorwissen verfälscht Ergebnisse weniger |
|
realistische Daten und Inhalte |
Probleme des echten Betriebs werden sichtbar |
|
Moderator greift nicht ein |
Schwierigkeiten bleiben als Befund erhalten |
|
Beobachtung und Interpretation werden getrennt |
Ursachen werden erst nach mehreren Tests eingeordnet |
|
früh und iterativ testen |
Änderungen sind leichter umsetzbar |
|
Ergebnisse priorisieren |
aus Befunden entstehen konkrete Maßnahmen |
Ein guter Usability Test zeichnet sich deshalb nicht durch möglichst viele Teilnehmende oder aufwendige Technik aus, sondern durch realistische Aufgaben, passende Testpersonen und eine konsequent neutrale Beobachtung.
Fazit um Usability Test
Ein Usability Test ist eine besonders direkte und vergleichsweise schlanke Möglichkeit, herauszufinden, ob ein System im Alltag tatsächlich funktioniert.
Bereits wenige passende Testpersonen und einige realistische Kernaufgaben können zentrale Bedienprobleme sichtbar machen – insbesondere, wenn früh und iterativ getestet wird.
Drei Regeln entscheiden über den Wert: Ziele stellen, keine Wege, damit das Finden beobachtbar bleibt. Nicht eingreifen, auch wenn es unangenehm wird. Und beobachten statt deuten, bis alle Ergebnisse vorliegen.
Besonders wertvoll sind frühe Tests, weil Änderungen an Skizzen oder Prototypen noch mit geringem Aufwand möglich sind. Getestet werden kann bereits eine Papierskizze – und dort kostet jede Änderung Minuten statt Entwicklungstage.
Die DIPS GmbH unterstützt Unternehmen dabei, digitale Anwendungen und Arbeitsabläufe aus Nutzersicht zu prüfen und gezielt weiterzuentwickeln. Je nach Ausgangslage umfasst das die Planung und Durchführung von Usability Tests, die strukturierte Auswertung der Ergebnisse sowie die Überführung relevanter Befunde in priorisierte Anforderungen und konkrete Verbesserungsmaßnahmen.
FAQ zum Usability Test
Was ist ein Usability Test?
Eine Überprüfung, bei der reale Personen realistische Aufgaben mit einem System bearbeiten, während jemand beobachtet, ohne einzugreifen. Der Test zeigt, wo Menschen zögern, den falschen Weg wählen oder scheitern – und liefert damit Befunde statt Meinungen.
Wie viele Testpersonen sind nötig?
Für qualitative Usability Tests reichen häufig wenige passende Testpersonen pro Nutzergruppe. Als praktische Orientierung werden oft etwa fünf Personen genannt. Die erforderliche Zahl hängt jedoch von Nutzergruppen, Aufgaben, Testziel und der Vielfalt der erwarteten Probleme ab.
Wann sollte getestet werden?
So früh wie möglich. Getestet werden kann bereits eine Papierskizze, lange vor der Umsetzung. Eine Änderung an einer Skizze kostet Minuten, dieselbe Änderung nach der Programmierung ein Vielfaches. Ergänzend lohnt ein Test einige Wochen nach der Einführung.
Wie formuliert man gute Testaufgaben?
Als realistische Situation mit einem Ziel, nicht mit einem Weg. Statt „Klicken Sie auf Aufträge" besser „Ein Kunde bestellt telefonisch zehn Stück, erfassen Sie die Bestellung". Vermeiden Sie Begriffe, die im System als Beschriftung vorkommen.
Darf man während des Tests helfen?
Nein. Jede Hilfestellung löscht einen Befund. Zulässig sind nur Gegenfragen, die nicht zur Lösung führen, etwa „Was würden Sie als Nächstes versuchen?". Wird eine Aufgabe nicht gelöst, wird nach einer vorab festgelegten Zeit abgebrochen und der Abbruch notiert.
Moderiert oder unmoderiert testen?
Für interne Unternehmensanwendungen ist die moderierte Variante meist besser, weil sie Begründungen liefert und nicht nur Klickpfade. Unmoderierte Tests eignen sich eher bei großen Nutzerzahlen und öffentlich zugänglichen Anwendungen.
Wie sieht ein brauchbarer Ergebnisbericht aus?
Kurz: die drei bis fünf wichtigsten Befunde, je mit einem wörtlichen Zitat, einer Einstufung nach Schwere und einer konkreten Empfehlung. Umfangreiche Berichte werden selten gelesen und führen deshalb seltener zu Umsetzung.

