
Defect Management ist das, was mit einem Fehler zwischen dem Moment passiert, in dem ihn jemand bemerkt, und dem Moment, in dem jemand bestätigt, dass er weg ist. Es ist ein Prozess, kein Werkzeug: die Zustände, die ein Fehler durchläuft, wer ihn weiterbewegt, und wie das Team entscheidet, welche zuerst behoben werden.
Die meisten Teams haben einen, ob sie ihn aufgeschrieben haben oder nicht. Die undokumentierte Fassung lautet meist “ab in den Tracker und hoffen”, und das funktioniert, bis es mehr Fehler gibt, als irgendjemand im Kopf behalten kann - typischerweise etwa dreißig.
Der Lebenszyklus
Die Zustände heißen in verschiedenen Trackern verschieden, und die Form darunter ist dieselbe.
- Neu. Gemeldet, noch niemand hat hineingeschaut.
- Triagiert. Jemand hat ihn gelesen, bestätigt, dass er echt ist, und entschieden, wie dringend er ist.
- Zugewiesen. Er hat einen Verantwortlichen.
- Behoben. Der Verantwortliche glaubt, dass es erledigt ist. Sonst glaubt noch niemand etwas.
- Verifiziert. Jemand, der nicht der Verantwortliche ist, hat es gegen die ursprüngliche Meldung bestätigt.
- Geschlossen. Fertig.
Zwei weitere Enden sind legitim und werden oft falsch behandelt. Abgelehnt heißt, es ist kein Fehler - das Verhalten ist so gewollt, oder die Meldung beschrieb ein Missverständnis. Zurückgestellt heißt, er ist echt und wird jetzt nicht behoben. Für beide gehört ein Grund ins Ticket, denn die Alternative ist, dass derselbe Fehler in sechs Wochen erneut gemeldet wird, von jemandem, der nicht wissen kann, dass er bereits bedacht wurde.
Der Schritt, den Teams stillschweigend überspringen, ist die Verifikation. Ein Fehler, den die Person schließt, die ihn behoben hat, ist ein Fehler, der auf der Meinung einer einzigen Person geschlossen wurde, und die Korrektur, die den gemeldeten Fall gar nicht abgedeckt hat, ist eine verbreitete genug Erfahrung, um ihr eigenes Reproduktionsproblem zu haben.
Schweregrad und Priorität sind nicht dasselbe
Das ist die Verwechslung, die sich zu klären lohnt, denn sie verursacht Streit, der aussieht wie Uneinigkeit über den Fehler, tatsächlich aber zwei Menschen sind, die ein Wort für zwei Ideen benutzen.
Schweregrad ist, wie schlimm das Verhalten ist. Datenverlust ist schwer. Ein verrutschtes Symbol nicht. Es ist eine Eigenschaft des Fehlers selbst und ändert sich nicht, weil sich der Kalender geändert hat.
Priorität ist, wie bald er behoben wird. Das ist eine geschäftliche Entscheidung, und sie hängt davon ab, wer betroffen ist, wie viele, ob es einen Workaround gibt, und was sonst noch um dieselbe Woche konkurriert.
Die beiden laufen in beide Richtungen auseinander, und genau das macht ihre Trennung wertvoll:
- Hoher Schweregrad, niedrige Priorität
- Ein Absturz in einer Admin-Maske, die zweimal im Jahr von einer Person benutzt wird, die den Workaround kennt
- Niedriger Schweregrad, hohe Priorität
- Der Firmenname auf der Preisseite falsch geschrieben, von allen gesehen, heute Vormittag korrigiert
Tracker, die nur ein Feld anbieten, zwingen dazu, beides zu einer Zahl zu mitteln, die keines von beiden bedeutet. Wenn Ihrer das tut, legen Sie fest, welches der beiden gemeint ist, und schreiben Sie es auf, denn sonst sortiert die eine Hälfte des Teams nach Schaden und die andere nach Dringlichkeit.
Wer triagiert, und wie oft
Triage ist eine Entscheidung, also braucht sie jemanden, der sie treffen darf. In einem kleinen Team ist das eine Person, die jeden Morgen die neue Warteschlange durchgeht. In einem größeren ist es ein kurzer regelmäßiger Termin mit einem Entwickler, einem Tester und jemandem, der für das Produkt spricht.
Wichtiger als das Format ist, dass es regelmäßig geschieht. Eine Warteschlange, die triagiert wird, wenn jemand daran denkt, bildet einen Schwanz aus Fehlern, die niemand gelesen hat, und dessen Preis ist nicht der unberührte Schwanz - es ist, dass niemand der Warteschlange mehr vertraut, sodass echte Fehler stattdessen in den Chat gemeldet werden.
Triage braucht drei Antworten pro Fehler, und nicht mehr: ist er echt, wie schlimm ist er, wem gehört er. Alles Längere ist Entwurfsarbeit im falschen Termin.
Meldungen entscheiden, wie schnell der Prozess läuft
Jeder Zustand nach “neu” hängt davon ab, wie gut die Meldung war.
Die Triage kann den Schweregrad nicht beurteilen, ohne zu wissen, was tatsächlich passiert ist. Der Verantwortliche kann nicht beheben, was er nicht reproduzieren kann. Die Verifikation kann nichts bestätigen, wenn die ursprünglichen Schritte nicht mehr aufgeschrieben sind. Eine vage Meldung kostet nicht einfach die fünf Minuten des Melders - sie kostet in jeder Phase einen Hin- und Rückweg, und jeder Hin- und Rückweg ist ein Tag.
Hier geht die meiste Zeit hin. Nicht ins Beheben, ins erneute Nachfragen.
Session Replay
Kostenlose Chrome-Erweiterung. Ein Klick auf der Seite, die sich falsch verhält, erfasst den Screenshot, die Konsole und das Netzwerkprotokoll und gibt Ihnen einen Link, den Sie ins Ticket einfügen können.
Unser Leitfaden für Fehlerberichte hat die Form, die eine Triage übersteht: was passiert ist, was erwartet wurde, die Schritte und die Umgebung. Fragen Sie nach diesen vieren, und die meisten Hin- und Rückwege hören auf.
Kennzahlen, die in die Irre führen
Drei Zahlen werden gezählt, weil sie leicht zu zählen sind, und jede einzelne liest man besser genau.
- Anzahl offener Fehler. Steigt, wenn das Testen besser wird, was das Gegenteil dessen ist, wonach es aussieht. Fällt sie auf null, heißt das öfter, dass Leute aufgehört haben zu melden, als dass die Software besser geworden wäre.
- Fehler pro Entwickler. Belohnt, wer den wenigsten Code anfasst. Lassen Sie es.
- Zeit bis zum Schließen. Nützlich, aber sie misst den Prozess genauso wie die Arbeit - eine Woche Warten auf die Antwort des Melders zählt genauso wie eine Woche Debugging.
Die eine, die stattdessen einen Blick wert ist, ist die Wiedereröffnungsrate: als behoben markierte Fehler, die zurückkamen. Sie misst direkt, ob “behoben” in Ihrem Team etwas bedeutet, und anders als die anderen ist sie schwer zu manipulieren.
Die Kurzfassung
Sechs Zustände, ein geschriebener Grund für alles Abgelehnte oder Zurückgestellte, und eine Verifikation durch jemand anderen als die Person, die es behoben hat. Schweregrad ist, wie schlimm, Priorität ist, wie bald, und das sind verschiedene Felder. Triage nach Plan statt dann, wenn jemand daran denkt. Und die meiste gesparte Zeit wird am Anfang gespart, in der Meldung - ein Fehler, der vollständig ankommt, durchläuft den ganzen Prozess, ohne dass jemand eine Frage stellen muss.