10.15

View in English

10.15 Schätzung und Prognose

Überblick und Motivation

Jedem Softwareteam wird dieselbe Frage gestellt: wann ist es fertig? Hinter dieser Frage sitzt Software-Entwicklungsaufwandsschätzung, die Praxis vorherzusagen, wie viel Arbeit etwas brauchen wird, bevor Sie es getan haben. Es ist eines der schwierigsten Dinge, die wir tun, und eines der leichtesten, schlecht zu tun. Das Problem ist, dass Software Discovery-Arbeit ist. Sie bauen etwas, das nie existierte, und viel von dem, was Sie über das Problem lernen werden, wird erst sichtbar, während Sie bauen. Den Aufwand des Lernens vorherzusagen ist echt anders, als den Aufwand einer bekannten Aufgabe zu wiederholen vorherzusagen.

Warum das als eigene Disziplin behandeln statt als Ecke des Projektmanagements (Kapitel 10.6)? Weil die Fehlschläge so konsistent und so teuer sind. Teams verpflichten sich routinemäßig zu Einzeldaten, für die sie keinen Beleg haben, dann verteidigen sie diese Daten weit über den Punkt hinaus, an dem Realität ihnen widersprochen hat. Führungskräfte verwechseln eine Schätzung mit einem Versprechen. Verträge frieren eine an einem Nachmittag produzierte Zahl ein und halten Menschen ein Jahr lang daran. Das Ergebnis ist späte Lieferung, erodiertes Vertrauen, und eine Kultur, wo niemand sagt, was er tatsächlich glaubt. Das richtig zu bekommen handelt weniger von besserer Mathematik und mehr von Ehrlichkeit: zu trennen, was Sie wissen, von dem, was Sie hoffen, und Unsicherheit als Unsicherheit zu kommunizieren.

Die Einsätze steigen scharf in Unternehmens- und Behördenumgebungen. Unternehmen finanzieren Portfolios ineinandergreifender Initiativen gegen Jahresbudgets und erwarten feste Zahlen, um Kapital zuzuweisen (Kapitel 10.1). Behörden machen öffentliche Verpflichtungen unter Bewilligungsregeln, unterschreiben Festpreisverträge, und antworten Gesetzgeberinnen, wenn ein Datum rutscht. In beiden Welten ist der Druck, eine zuversichtliche Einzelzahl zu produzieren, immens, und die tiefe Unsicherheit, die diese Zahl unzuverlässig macht, verschwindet nicht, weil jemand Wichtiges Sicherheit will. Dieses Kapitel argumentiert für eine andere Haltung: schätzen Sie, wenn es Ihnen bei der Entscheidung hilft, prognostizieren Sie mit Beleg statt Optimismus, und sagen Sie die Wahrheit über den Bereich.

Kernprinzipien

  • Eine Schätzung ist eine Vorhersage, kein Versprechen. Halten Sie sie getrennt von Zielen und Verpflichtungen.
  • Unsicherheit ist echt, drücken Sie sie also aus. Ein Bereich mit Wahrscheinlichkeit schlägt ein falsches Einzeldatum.
  • Die Vergangenheit sagt die Zukunft besser voraus als Optimismus. Bevorzugen Sie gemessene Geschichte über frische Vermutungen.
  • Zerlegen Sie, um zu verstehen, prognostizieren Sie, um sich zu verpflichten. Kleine Scheiben reduzieren sowohl Risiko als auch den Schätzungsbedarf.
  • Nehmen Sie die Außensicht. Vergleichen Sie mit ähnlichen vergangenen Bemühungen, bevor Sie Ihrer Innensicht vertrauen.
  • Prognostizieren Sie kontinuierlich neu. Eine einmal gemachte und nie aktualisierte Vorhersage ist Dekoration.
  • Schätzen Sie nur, wenn die Antwort eine Entscheidung ändert. Sonst ist es Verschwendung.

Empfehlungen

Schätzung, Ziel, und Verpflichtung trennen

Der einzige nützlichste Zug in diesem ganzen Kapitel kostet nichts: halten Sie drei Ideen getrennt. Eine Schätzung ist Ihre ehrliche Vorhersage, wie lange etwas dauern wird, mit angehängter Unsicherheit. Ein Ziel ist eine Geschäftsvorgabe, die Sie treffen möchten, wie eine Messeneinführung oder eine regulatorische Frist. Eine Verpflichtung ist ein Versprechen, das Sie jemand anderem machen, das Sie zu halten beabsichtigen. Das sind drei unterschiedliche Dinge, und sie ineinanderfallen zu lassen ist, wie Projekte beginnen, sich selbst zu belügen. Wenn eine Führungskraft “ungefähr drei bis fünf Monate” hört und “drei Monate” aufschreibt, und das Verkaufsteam einer Kundin “zwölf Wochen” verspricht, ist eine Schätzung still zu einer Verpflichtung geworden, ohne dass jemand entschied, das Risiko zu akzeptieren.

Sagen Sie jedes Mal, welche Sie geben. Wenn nach einem Datum gefragt, antworten Sie mit einer als Bereich ausgedrückten Schätzung, dann lassen Sie das Geschäft ein Ziel dagegen setzen und absichtlich entscheiden, wozu sich zu verpflichten ist. Eine Verpflichtung sollte eine mit offenen Augen getroffene Wahl sein, die Unsicherheit der Schätzung gegen die Kosten des Verpassens abwägend. Diese Disziplin bindet direkt an, wie Ihre Organisation Entscheidungen trifft und erfasst (Kapitel 1.5): eine Verpflichtung ist eine Entscheidung, und sie verdient die Strenge einer Entscheidung statt ein Flurnicken.

Verstehen, warum Schätzungen falsch sind, und in welche Richtung

Softwareschätzungen sind nicht zufällig falsch. Sie sind auf vorhersehbare, systematische Weisen falsch, und das Muster zu kennen erlaubt Ihnen, dafür zu korrigieren. Früh in jeder Bemühung sitzen Sie im Unsicherheitskegel: am Anfang kann Ihre Schätzung leicht um einen Faktor vier in beide Richtungen daneben liegen, und der Bereich verengt sich erst, während Sie bauen und lernen. Sich am weiten Maul des Kegels auf eine präzise Zahl zu verpflichten ist, sich auf eine Figur zu verpflichten, die Sie noch nicht stützen können.

Über dieser strukturellen Unsicherheit sitzt eine menschliche Verzerrung. Der Planungsfehlschluss ist unsere verlässliche Tendenz, die Zeit, Kosten, und das Risiko unserer eigenen Pläne zu unterschätzen, während wir uns den besten Fall vorstellen. Wir stellen uns den glücklichen Pfad vor, vergessen die Unterbrechungen und die Integrationsüberraschungen und die Krankheitstage, und produzieren eine Zahl, die annimmt, dass nichts schiefgeht. Polstern ist die übliche defensive Antwort, aber nach Gefühl hinzugefügtes Polstern ist nur eine zweite Vermutung, auf die erste gestapelt, und wird weggehandelt, sobald sich Zeitpläne verengen. Die Heilung ist nicht mehr Willenskraft; es ist Methode. Basieren Sie Vorhersagen auf dem, was ähnliche Arbeit tatsächlich brauchte, nicht darauf, wie sich diese Arbeit von innen anfühlt.

Zerlegung und Expertinnenurteil nutzen, und ihre Grenzen kennen

Die Arbeitspferd-Techniken sind es wert, gekannt und begrenzt zu werden. Zerlegung bricht ein großes Liefergut in kleinere Stücke herunter, über die Sie nachdenken können, rollt die Stücke dann auf. Sie hilft, weil Menschen kleine, vertraute Dinge weit besser schätzen als große, vage, und weil das Summieren vieler unabhängiger Punkte manche Überschätzungen manche Unterschätzungen aufheben lässt. Ihre Grenze ist, dass Zerlegung die Arbeit zwischen den Kästen verpasst: Integration, Koordination, und die Aufgaben, an die Sie nicht dachten, sie zu listen. Expertinnenurteil und Schätzung durch Analogie (“das ist wie das Berichtsmodul, das wir letztes Jahr bauten, das zwei Monate dauerte”) sind schnell und oft überraschend gut, erben aber den Optimismus und die blinden Flecken der Schätzerin.

Für alles, worauf Sie eine Zahl setzen müssen, bevorzugen Sie Drei-Punkt-Schätzung, die nach einer optimistischen, einer wahrscheinlichsten, und einer pessimistischen Figur fragt und sie kombiniert, oft als PERT-gewichteter Durchschnitt (optimistisch plus vier mal wahrscheinlichste plus pessimistisch, geteilt durch sechs). Der Wert ist nicht die präzise Formel. Es ist, dass Drei-Punkt-Schätzung Sie zwingt, Ihre Unsicherheit laut zu erklären, und einen Bereich statt einen falschen Punkt produziert. Relative Dimensionierungsmethoden wie Story-Points und T-Shirt-Größen (klein, mittel, groß, extra-groß) umgehen die Falle, exakte Stunden vorherzusagen, indem sie Punkte gegeneinander vergleichen. Sie funktionieren gut für Ordnung und grobe Kapazität, aber behandeln Sie sie als Eingaben zu einer Prognose, nicht als Währung. Punkte sind keine Stunden, und Geschwindigkeit mit Punkten zu multiplizieren, um ein Datum zu produzieren, reintroduziert jedes Problem, das relative Dimensionierung vermeiden sollte.

Probabilistisch aus Ihren eigenen Flussdaten prognostizieren

Hier ist der Wandel, der alles ändert: hören Sie auf, Menschen zu bitten zu raten, wie lange Arbeit dauern wird, und beginnen Sie zu messen, wie schnell Ihr Team tatsächlich Arbeit abschließt. Ihre Lieferpipeline (Kapitel 11.2) produziert bereits die Daten, die Sie brauchen. Wenn Sie Durchsatz verfolgen, die Anzahl Punkte, die Ihr Team pro Woche abschließt, können Sie die Zukunft aus der Vergangenheit statt aus Hoffnung prognostizieren. Ein Team, das in den letzten drei Monaten sechs bis elf Punkte pro Woche schloss, wird mit hoher Wahrscheinlichkeit ungefähr vier bis sieben Wochen brauchen, vierzig verbleibende Punkte fertigzustellen. Diese Prognose ruht auf Beleg, und sie aktualisiert sich jede Woche selbst, während neue Daten ankommen.

Die rigorose Version führt eine Monte-Carlo-Methode-Simulation durch: aus Ihrem historischen wöchentlichen Durchsatz Tausende Male probieren, um eine Verteilung möglicher Fertigstellungsdaten zu bauen, dann die Antwort als Wahrscheinlichkeit ablesen. “Wir sind zu 85% wahrscheinlich bis 14. März fertig, und zu 50% wahrscheinlich eine Woche früher” ist eine weit nützlichere und ehrlichere Aussage als “es wird am 1. März fertig sein.” Dieser Ansatz bindet direkt an Warteschlangentheorie (Kapitel 11.3): Durchlaufzeit gleich Work in Progress geteilt durch Durchsatz, dieselben Flusskennzahlen, die regieren, wie sich Arbeit bewegt, regieren also auch, wann sie ankommen wird. Probabilistische Prognose braucht Geschichte und einen einigermaßen stabilen Prozess, weshalb sie genau Teams belohnt, die Arbeit klein und Fluss stetig halten. Sie entfernt auch still das meiste der Schätzungszeremonie, denn Sie müssen nicht mehr jeden Punkt dimensionieren, um zu wissen, wann die Charge ankommen wird.

Die Außensicht für große Programme nehmen

Für große, lange, teure Programme können individuelle Schätzungen und selbst Flussprognosen in die Irre führen, denn ein neuartiges Programm hat noch keine Durchsatzgeschichte, und seine Innengeschichte ist genau, wo der Planungsfehlschluss am härtesten beißt. Das Gegenmittel ist Referenzklassenprognose: finden Sie eine Referenzklasse ähnlicher abgeschlossener Bemühungen, schauen Sie, wie lange und wie viel sie tatsächlich brauchten, und platzieren Sie Ihr Programm in dieser Verteilung, bevor Sie Ihrem eigenen Bottom-up-Plan vertrauen. Wenn vergleichbare Plattformersetzungen in Ihrem Unternehmen ihre anfänglichen Schätzungen im Durchschnitt um 60% überzogen, ist diese Zahl besserer Beleg für Ihre als der ordentliche Plan, den Ihr Team gerade zusammenstellte. Die Außensicht fühlt sich entmutigend an, und das ist genau ihr Wert: sie wirkt dem Optimismus entgegen, den jeder frische Plan trägt. Nutzen Sie sie für Portfoliofinanzierung und Megaprogramm-Budgetierung (Kapitel 10.1), wo die Kosten eines systematischen Überziehens in Millionen und in Glaubwürdigkeit gemessen werden.

Weniger schätzen, indem kleiner geschnitten wird, und nach Verzögerungskosten sequenzieren

Manchmal ist die richtige Menge Schätzung fast keine. Das #NoEstimates-Argument beobachtet, in seinem vernünftigen Kern, dass, wenn Sie Arbeit in Stücke schneiden, klein genug, dass jedes ein bis zwei Tage dauert, die Schätzung eines einzelnen Stücks aufhört zu zählen. Sie zählen einfach Durchsatz und prognostizieren aus der Zählung. Wenn Scheiben einheitlich und klein sind, ist aufwendige Dimensionierung Verschwendung: sie verbraucht Aufwand, Präzision zu produzieren, die die Prognose nicht braucht. Das ist kein Argument gegen Vorausdenken. Es ist ein Argument, individuelle Vorhersagen günstig zu machen, indem individuelle Stücke klein gemacht werden.

Was noch eine Entscheidung braucht, ist Reihenfolge. Wenn Sie nicht alles auf einmal tun können, sequenzieren Sie nach Verzögerungskosten: der Wert, den Sie für jede Zeiteinheit verlieren, die ein gegebenes Arbeitsstück spät ist. Ein Feature, das nächstes Quartal einen großen Vertrag entsperrt, hat hohe Verzögerungskosten und sollte vor einem netten-zu-haben ohne welche springen, selbst wenn das nette-zu-haben leichter ist. Verzögerungskosten gegen Aufwand abzuwägen (die “Weighted Shortest Job First”-Heuristik aus Lean-Denken) sagt Ihnen weit verlässlicher, was als Nächstes zu tun ist, als ein nach Bauchgefühl sortierter Rückstand. Beachten Sie, dass das das ganze Gespräch umrahmt: statt “wann ist alles fertig,” was falsche Präzision einlädt, fragen Sie “was ist das wertvollste Ding, als Nächstes abzuschließen,” was Sie tatsächlich beantworten können.

Abwägungen: Vor- und Nachteile

AnsatzVorteileNachteile
Einzeldatum-SchätzungEinfach; was Stakeholder fragenPräzise falsch; versteckt Risiko; wird zu versehentlicher Verpflichtung
Drei-Punkt-/PERT-SchätzungZwingt Unsicherheit ins Offene; günstigImmer noch eine Vermutung; die Formel impliziert falsche Rigorosität
Story-Points/T-Shirt-GrößenSchnell; gut für Ordnung und grobe KapazitätKeine Stunden; Geschwindigkeitsmathematik schleicht Einzeldaten zurück
Probabilistische FlussprognoseEvidenzbasiert; selbstaktualisierend; ehrliche BereicheBraucht Geschichte und stabilen Fluss; sieht weniger “sicher” aus
ReferenzklassenprognoseKorrigiert Optimismus bei großen ProgrammenBraucht vergleichbare vergangene Bemühungen; entmutigend zu hören
#NoEstimates (kleine Scheiben)Entfernt Verschwendung; Prognose durch ZählenBraucht disziplinierte Zerlegung; beunruhigend für Finanziererinnen, die eine Zahl wollen

Die zentrale Spannung ist die Sicherheit, die Menschen wollen, versus die Ehrlichkeit, die die Arbeit fordert. Finanziererinnen, Führungskräfte, Verträge, und Gesetzgeberinnen fragen nach einem festen Einzeldatum, weil ein Einzeldatum leicht zu budgetieren, zu versprechen, und zu verteidigen ist. Software unterstützt selten eines. Lösen Sie die Spannung nicht, indem Sie Sicherheit fabrizieren, und nicht, indem Sie sich weigern zu antworten, sondern indem Sie in der Währung von Wahrscheinlichkeit antworten: ein Bereich mit Zuversichtsniveaus, neu prognostiziert, während Beleg ankommt. Paaren Sie es mit kleinen Scheiben, damit frühe, echte Lieferungen entfernte, imaginäre als das Ding ersetzen, dem Menschen vertrauen. Ein demonstriertes Inkrement ist mehr wert als jede Schätzung.

Fragen zur Diskussion mit Ihrem Team

  1. Wenn jemand Sie nach einem Datum fragt, geben Sie eine Schätzung, ein Ziel, oder eine Verpflichtung, und weiß jeder im Raum, welche? Das ist die Frage, die den meisten Schaden für den wenigsten Aufwand verhindert. In den meisten Organisationen fallen diese drei in dem Moment zu einer Zahl ineinander, in dem sie den Mund des Teams verlässt, und niemand entschied, das Risiko zu akzeptieren, dass eine Vorhersage zu einem Versprechen wurde. Bringen Sie ein echtes Beispiel: nehmen Sie Ihre letzte verpflichtete Frist und verfolgen Sie sie zurück zum Gespräch, wo sie zuerst geäußert wurde, und fragen Sie, ob sie je etwas anderes war als eine hoffnungsvolle Vermutung im Anzug. Die Antwort sollte Ihre Sprache dauerhaft ändern, damit Schätzungen als Bereiche rausgehen, Ziele als Geschäftswünsche benannt werden, und Verpflichtungen absichtlich mit der abgewogenen und als Entscheidung erfassten Unsicherheit gemacht werden (Kapitel 1.5). Wenn Ihr Team nicht zeigen kann, wo eine Verpflichtung bewusst akzeptiert wurde, machen Sie versehentlich Versprechen.

  2. Könnten Sie Ihre nächste Veröffentlichung aus gemessenem Durchsatz statt frischen Schätzungen prognostizieren, und was hält Sie zurück? Die meisten Teams haben bereits die Daten, um “wann ist es fertig” empirisch zu beantworten, ungenutzt in dem Werkzeug sitzend, das ihre Arbeit verfolgt. Wenn Sie wissen, wie viele Punkte Ihr Team im letzten Quartal pro Woche abgeschlossen hat, können Sie eine Fertigstellungsdatum-Verteilung simulieren und eine Wahrscheinlichkeit statt eines Wunsches zitieren. Bringen Sie Ihre tatsächliche Durchsatzgeschichte und Ihre verbleibende Punktzahl, und vergleichen Sie die flussbasierte Prognose mit dem Datum, das das Team nach Gefühl schätzte; die Lücke ist üblicherweise aufschlussreich. Wenn der Blocker ist, dass Ihre Punkte wild unterschiedliche Größen haben oder Ihr Fluss unregelmäßig ist, ist das selbst die Erkenntnis, denn instabiler Fluss ist ein zu behebendes Lieferproblem, unabhängig davon (Kapitel 11.2, 11.3). Von Schätzung zu Messung zu wechseln ist oft weniger eine Werkzeugänderung als eine Entscheidung, Ihrer eigenen Geschichte mehr zu vertrauen als Ihrem Optimismus.

  3. Haben Sie für Ihr aktuelles größtes Programm die Außensicht genommen, oder nur einen Innenplan aufgebaut? Große Programme sind, wo sich Optimismus zu teuren Überziehungen verdichtet, und wo ein zuversichtlicher Bottom-up-Plan am verführerischsten und am wenigsten verlässlich ist. Die Disziplin ist, eine Referenzklasse ähnlicher abgeschlossener Bemühungen innerhalb oder außerhalb Ihrer Organisation zu benennen, herauszufinden, was sie tatsächlich kosteten und wie lange sie tatsächlich brauchten, und Ihr Programm ehrlich in dieser Verteilung zu lokalisieren, bevor Sie Ihre eigenen Zahlen verteidigen. Bringen Sie die Daten: wie haben vergleichbare Initiativen hier ihre ersten Schätzungen überzogen, und nimmt Ihr aktueller Plan still an, dass Sie jede von ihnen schlagen werden? Wenn ja, wetten Sie darauf, außergewöhnlich zu sein, was eine Wette ist, die die Basisraten verlässlich verlieren. Die Außensicht wird Ihre Prognose weniger schmeichelhaft und weit verteidigbarer gegenüber den Finanziererinnen und Prüferinnen machen, die sich an die Zahl erinnern werden, die Sie gaben (Kapitel 10.1).

  4. Wenn eine Finanziererin, ein Vertrag, oder eine Gesetzgeberin ein einzelnes festes Datum fordert, wie antworten Sie, ohne zu lügen oder abzulehnen? Hier ist der Druck am heftigsten und hier geben ehrliche Teams am häufigsten nach, denn “70% wahrscheinlich bis September” klingt ausweichend neben dem zuversichtlichen “September” einer Konkurrentin. Für eine große Organisation vervielfachen sich die Einsätze: ein festes Datum pflanzt sich in Budgets, abhängige Programme, und öffentliche Versprechen fort, eine für Komfort gewählte Zahl wird also in dem Moment, in dem sie rutscht, zu einer systemischen Verbindlichkeit. Bringen Sie die Sprache, die Sie tatsächlich planen zu nutzen, ein durchgearbeitetes Beispiel eines Bereichs mit Zuversichtsniveaus, und ein kleines frühes Inkrement, zu dem Sie sich fest verpflichten können, während Sie späteren Umfang als finanzierten Bereich belassen. Die konkurrierende Überlegung ist echt, denn manche Fristen (ein regulatorischer Umstieg, eine Messeneinführung) sind echt fest, und der richtige Zug dort ist, das Datum zu fixieren und den Umfang flexen zu lassen, statt vorzugeben, der Aufwand sei sicher. In Unternehmens- und Behördenumgebungen, binden Sie das daran, wie der Vertrag geformt ist: eine modulare, inkrementfinanzierte Vereinbarung lässt Sie sich ehrlich zu einem wertvollen Kern verpflichten, während ein einzelner festpreis-, umfangsfester Vertrag, an einen entfernten Meilenstein verankert, genau die falsche Sicherheit erzwingt, die die Überziehung und die Schlagzeile produziert.

  5. Wie entscheidet Ihr Team, was als Nächstes zu bauen ist, und würde explizites Sequenzieren nach Verzögerungskosten die Reihenfolge ändern? Die meisten Rückstände sind nach einer Mischung aus Bauchgefühl, wer auch immer am lautesten schrie, und grobem Aufwand geordnet, was still für leichte Gewinne statt wertvolle optimiert. Verzögerungskosten, der Wert, den Sie für jede Zeiteinheit verlieren, die ein Arbeitsstück spät ist, rahmt die Frage von “wann ist alles fertig” zu “was ist das wertvollste Ding, als Nächstes abzuschließen,” die Sie tatsächlich mit Beleg beantworten können, um. Bringen Sie drei oder vier echte Rückstandspunkte mit einer ehrlichen Schätzung des Werts, den jeder entsperrt, und wann dieser Wert abläuft, dann rangieren Sie sie nach Wert-verloren-pro-Woche gegen Aufwand und vergleichen Sie diese Reihenfolge mit Ihrem aktuellen Plan; die Neuordnung ist üblicherweise überraschend und schwer zu widerlegen. Die konkurrierende Überlegung ist, dass Verzögerungskosten selbst eine Schätzung sind und von wer auch immer seinen Punkt zuerst will manipuliert werden können, benennen Sie also, wer die Zahlen besitzt und wie sie herausgefordert werden. Für ein Unternehmensportfolio oder ein Behördenprogramm ist diese Disziplin, was Ihnen erlaubt, Sequenzierungsentscheidungen gegenüber Stakeholdern zu verteidigen, die jede glaubt, ihre Initiative sollte zuerst kommen, denn die Ordnung ruht auf erklärtem Wert statt Politik.

  6. Wer prognostiziert neu, wie oft, und wer ist rechenschaftspflichtig, zu handeln, wenn sich die Prognose bewegt? Eine einmal beim Kickoff gemachte und nie überdachte Vorhersage ist Dekoration, und die teuersten Rutscher sind jene, die eine lebende Prognose Monate gezeigt hätte, bevor die Frist sie unbestreitbar machte. Für ein großes Team ist der Fehlschlag selten die Abwesenheit von Daten und üblicherweise die Abwesenheit einer stehenden Kadenz und einer benannten Besitzerin: Durchsatz driftet, die Fertigstellungsdatum-Verteilung verschiebt sich nach rechts, und niemand, dessen Job es ist es zu bemerken, schaut hin. Bringen Sie Ihren tatsächlichen Neu-Prognose-Rhythmus (oder geben Sie zu, dass es keinen gibt), das letzte Mal, dass eine Prognose eine Entscheidung änderte, und die Drift, die Sie sahen, seit die aktuelle Verpflichtung gesetzt wurde. Die konkurrierende Überlegung ist Prognosemüdigkeit, denn zu lärmig neu zu prognostizieren lädt Hin-und-her ein und erodiert Vertrauen, einigen Sie sich also auf ein vernünftiges Intervall und eine Schwelle, die Eskalation auslöst, statt auf jedes Wackeln zu reagieren. In Unternehmens- und Behördenkontexten, binden Sie das an Aufsicht: briefen Sie Governance-Gremien mit dem aktualisierten Wahrscheinlichkeitsbereich in festem Zeitplan, damit ein Rutscher als verwaltete Neu-Prognose auftaucht, nach der Führungskräfte handeln können, statt eine am Meilenstein enthüllte Überraschung.

Branchenperspektive

Startup. Überspringen Sie die Schätzungszeremonie fast ganz. Zerschneiden Sie Arbeit in Ein-bis-zwei-Tage-Stücke, zählen Sie, was Sie jede Woche fertigstellen, und zitieren Sie Gründerinnen und Investorinnen einen sich verengenden Bereich statt eines heldenhaften Einzeldatums. Ihre Geschichte ist kurz und Ihr Prozess volatil, stützen Sie sich also auf den Unsicherheitskegel als ehrliche Erklärung statt einer Ausrede, und prognostizieren Sie jeden Freitag neu, während sich das Bild schärft.

Kleinunternehmen. Sie haben keine Schätzungsspezialistin und keinen Appetit auf Dimensionierungsmeetings, lassen Sie die Werkzeuge, die Sie bereits betreiben, also die Arbeit tun: die meisten Aufgabenverfolger exponieren Durchsatz kostenlos, und eine leichtgewichtige Prognose daraus schlägt eine erratene Frist. Widerstehen Sie dem Drang, schwergewichtige Planungssoftware zu kaufen, die Sie nicht besetzen können; eine einfache wöchentliche Zählung abgeschlossener Punkte und ein schlichter Bereich beantwortet “wann ist es fertig” gut genug für die Verpflichtungen, die Sie tatsächlich gegenüber Kundinnen eingehen.

Großunternehmen. Das Problem ist Konsistenz über viele Teams, die ein Portfolio gegen einen jährlichen Kapitalzyklus finanzieren (Kapitel 10.1). Standardisieren Sie auf Bereichen mit Zuversichtsniveaus statt Einzeldaten, fordern Sie Referenzklassenvergleiche für große Programme, und richten Sie Flusskennzahlen auf, damit Vermutungen binnen eines Quartals durchsatzbasierten Prognosen weichen. Steuern Sie Schätzung als geteilte Praxis mit klaren Definitionen von Schätzung, Ziel, und Verpflichtung, damit eine in einer Abteilung produzierte Zahl dasselbe bedeutet, wenn sie den Vorstand erreicht.

Behörde. Beschaffungsregeln und öffentliche Rechenschaftspflicht formen alles. Ein verpasstes öffentliches Datum wird zur Schlagzeile und zum Prüfungsbefund, bevorzugen Sie also modulare, inkrementfinanzierte Verträge über eine einzelne festpreis-, umfangsfeste Verpflichtung, an einen entfernten Meilenstein verankert. Briefen Sie Aufsichtsgremien mit probabilistischen Prognosen und Referenzklassenbeleg in klarer Sprache, veröffentlichen Sie Zuversichtsniveaus ehrlich, und lassen Sie demonstrierte funktionierende Inkremente zum Beleg werden, den Öffentlichkeit und Prüferinnen vertrauen, statt der Unterschrift einer Auftragnehmerin auf einem optimistischen Plan.

Beispiele

Startup. Ein neunköpfiges Startup, das seine Series-A-Demo vorbereitet, muss wissen, ob eine Schlüsselintegration bereit sein wird. Statt die Gründerinnen Investorinnen ein Datum versprechen zu lassen, zitiert die Leitung eine Schätzung als Bereich und erklärt den dahinterliegenden Unsicherheitskegel. Das Team hat fünf bis neun Rückstandspunkte pro Woche geschlossen, sie führen also eine schnelle Monte-Carlo-Prognose an der verbleibenden Arbeit durch und berichten “80% wahrscheinlich bis zur dritten Woche des Quartals, gleiche Chancen eine Woche früher.” Sie zerschneiden die Integration in Zwei-Tage-Stücke, damit keine einzelne Schätzung viel zählt, sequenzieren nach Verzögerungskosten, um zuerst den investorinnensichtbaren Pfad zu bauen, und prognostizieren jeden Freitag neu. Investorinnen bekommen eine ehrliche, sich verengende Projektion statt einer zuversichtlichen Zahl, die gerutscht wäre.

Großunternehmen. Ein Einzelhändler, der seine Auftragsverwaltungsplattform ersetzt, muss das Programm durch einen jährlichen Kapitalzyklus finanzieren, der eine Zahl fordert. Das Programmbüro widersteht dem Drang, den ordentlichen Bottom-up-Plan zu verteidigen, und baut stattdessen eine Referenzklasse aus drei vergleichbaren Plattformersetzungen, zwei intern und eine öffentlich dokumentiert, die ihre anfänglichen Schätzungen um 50% bis 80% überzogen. Sie finanzieren gegen die Außensicht-Zahl, drücken den Zeitplan als Wahrscheinlichkeitsbereich statt festen Go-Live aus, und richten Flusskennzahlen vom ersten liefernden Team auf, damit binnen eines Quartals die Vermutung durch eine durchsatzbasierte Prognose ersetzt wird, die monatlich aktualisiert. Wenn ein Strom heiß läuft, zeigt die Neu-Prognose es früh, und Führung balanciert neu, statt den Rutscher an der Frist zu entdecken.

Behörde. Eine Behörde, die ein Leistungssystem modernisiert, operiert unter Bewilligungen und öffentlicher Prüfung, wo ein verpasstes öffentliches Datum eine Schlagzeile ist. Statt eines einzelnen festpreis-, umfangsfesten Vertrags, an einen entfernten Meilenstein verankert, beschafft sie modulare Inkremente und verpflichtet sich öffentlich zu einem wertvollen Kern, früh geliefert, mit späterem Umfang als finanziertem Bereich statt Versprechen ausgedrückt. Programmleitende briefen Aufsichtsgremien mit probabilistischen Prognosen und Referenzklassenvergleichen, Zuversichtsniveaus in klarer Sprache erklärend, damit ein “70% bis September” genau so verstanden wird. Demonstrierte funktionierende Inkremente werden der Beleg, den die Öffentlichkeit vertraut, was solider ist als jede Schätzung, die eine Auftragnehmerin unterschreiben könnte.

Geschäftsnutzen: Motivation, ROI und Gesamtbetriebskosten

Die Rendite auf ehrliche Schätzung und Prognose wird von vermiedener Katastrophe dominiert. Große Softwarebemühungen überziehen oder scheitern weit häufiger, als dass sie einen ursprünglichen festen Plan treffen, und die Verluste verdichten sich: versunkene Kosten, entgangener Wert aus später Lieferung, Notfallausgaben zur Erholung, und die Erosion von Vertrauen, die einer gebrochenen öffentlichen Verpflichtung folgt. Die Praktiken hier (Schätzung von Verpflichtung trennen, aus echtem Durchsatz prognostizieren, die Außensicht bei großen Programmen nehmen) sind jene, die ein Programm von dieser Fehlschlagskurve wegbewegen. Sie kaufen keine genauere Kristallkugel. Sie kaufen frühere, wahrere Information darüber, wo Sie stehen, was Ihnen erlaubt zu korrigieren, während Korrektur noch günstig ist.

Bei Gesamtbetriebskosten senkt der Wechsel von Schätzungszeremonie zu gemessener Prognose üblicherweise Kosten statt sie zu erhöhen. Aufwendige Vorabschätzung ist teuer zu produzieren und verfällt in dem Moment, in dem Arbeit beginnt, während eine durchsatzbasierte Prognose nahezu kostenlos ist, sobald Ihre Lieferpipeline die Daten emittiert. Beide Extreme kosten Geld: Überschätzung (endlose Dimensionierungsmeetings, die Präzision produzieren, die niemand nutzt) und Unter-Prognose (blind verpflichten und später für das Überziehen bezahlen). Um den Fall gegenüber Führung zu machen, stellen Sie die voll geladenen Kosten Ihres letzten größeren Überziehens neben die nahe-null Kosten, Durchsatz zu verfolgen und Bereiche zu zitieren, und zeigen Sie, wie eine Außensicht-Prognose von Anfang an eine finanzierbare Erwartung gesetzt hätte.

Anti-Muster und Fallstricke

  • Einzeldatum-Verpflichtungen: ein zu einer Zahl kollabierter Bereich, dann über den Beleg hinaus verteidigt.
  • Schätzungswäsche: eine hoffnungsvolle Vermutung, die Kette hinauf gereicht, bis sie zu einem vertraglichen Versprechen verhärtet.
  • Geschwindigkeit als Zeitplanmotor: Story-Points mit Geschwindigkeit multiplizieren, um ein präzises Datum zu fabrizieren.
  • Polstern nach Gefühl: eine zweite Vermutung, auf die erste gestapelt, unter Druck weggehandelt.
  • Nur Innensicht: einem frischen Bottom-up-Plan vertrauen, während ignoriert wird, was ähnliche Programme tatsächlich brauchten.
  • Alles schätzen: winzige, einheitliche Scheiben dimensionieren, deren individuelle Schätzungen keine Entscheidung ändern.
  • Eingefrorene Prognosen: eine einmal beim Kickoff gemachte und nie aktualisierte Vorhersage, während Realität ankommt.
  • Präzisionstheater: Stunden auf zwei Dezimalstellen zitieren am weiten Maul des Unsicherheitskegels.

Reifegradmodell

  • Stufe 1, Beginnen: Schätzungen sind Einzeldaten, nach Bauchgefühl produziert und als Versprechen behandelt; keine Unterscheidung zwischen Schätzung, Ziel, und Verpflichtung; Prognose ist reaktiv und Ad-hoc; Überziehungen überraschen alle und werden dem Team angelastet.
  • Stufe 2, Entwickeln: Manche strukturierte Schätzung existiert (Zerlegung, Story-Points, Drei-Punkt-Figuren), aber Praxis variiert Team für Team; Schätzungen sind noch meist Einzelzahlen; Geschwindigkeit wird genutzt, um Daten zu projizieren; Prognosen werden einmal beim Kickoff gemacht und selten überdacht.
  • Stufe 3, Standardisieren: Ein dokumentierter Standard ist über die Organisation durchgesetzt: Schätzungen werden als Bereiche mit erklärter Unsicherheit ausgedrückt, Schätzung, Ziel, und Verpflichtung werden per Definition getrennt gehalten, Teams verfolgen Durchsatz und prognostizieren in gesetzter Kadenz neu, und große Programme werden gefordert, Referenzklassenvergleiche zu nutzen.
  • Stufe 4, Steuern: Die Praxis wird mit Daten gemessen und gesteuert. Prognosegenauigkeit wird gegen tatsächliche Ergebnisse verfolgt und Kalibrierung wird geprüft, damit Sie sagen können, ob Ihre “80% bis”-Daten tatsächlich acht von zehn Mal landen; Durchsatz- und Zykluszeit-Baselines werden gepflegt; Verzögerungskosten werden quantifiziert; Prognosedrift wird gegen Schwellen überwacht und löst Eskalation aus; Verpflichtungen werden gegen Beleg statt Optimismus getroffen.
  • Stufe 5, Orchestrieren: Probabilistische Prognose aus Flussdaten ist kontinuierlich und vertraut, weil Kalibrierungsgeschichte sie als ehrlich bewiesen hat; Verpflichtungen sind absichtliche Entscheidungen, Zuversicht gegen Kosten abwägend; Arbeit wird klein genug geschnitten, dass Schätzung minimal ist und Verzögerungskosten Sequenz treiben; Schätzung ist mit Portfoliofinanzierung und Risikoplanung integriert, und die Organisation grenzt routinemäßig neu ab und balanciert neu, während sich Prognosen bewegen, den Plan an Beleg anpassend statt die ursprüngliche Zahl zu verteidigen.

Diskussionsideen

  1. Was würde sich in Ihrer Organisation ändern, wenn jede Schätzung das Team als Bereich mit Zuversichtsniveau verlassen müsste, und Einzeldaten verboten wären?
  2. Wo verbringen Sie Aufwand darauf, Arbeit zu schätzen, die bereits klein und einheitlich genug ist, um durch Zählen zu prognostizieren?
  3. Wenn Sie Ihre letzten zwei Quartale Durchsatz in eine Monte-Carlo-Simulation füttern würden, würde die Prognose mit den Daten übereinstimmen, zu denen Sie sich tatsächlich verpflichteten?
  4. Für Ihr größtes Programm, was ist die ehrliche Referenzklasse, und wie stark widerspricht die Basisrate Ihrem aktuellen Plan?
  5. Wie entscheidet Ihr Team heute Sequenz, und würde explizites Ordnen nach Verzögerungskosten ändern, was Sie als Nächstes bauen?
  6. Wenn eine Verpflichtung in Ihrer Organisation akzeptiert wird, wird die Unsicherheit als Teil der Entscheidung erfasst, oder verschwindet sie in dem Moment, in dem das Datum aufgeschrieben wird?

Wichtigste Erkenntnisse

  • Halten Sie Schätzung, Ziel, und Verpflichtung getrennt; sie ineinanderfallen zu lassen ist, wie Projekte beginnen, sich selbst zu belügen.
  • Schätzungen sind systematisch falsch in bekannten Richtungen: der Unsicherheitskegel verbreitert frühe Arbeit, und der Planungsfehlschluss macht Optimismus zum Standard.
  • Bevorzugen Sie probabilistische Prognose aus gemessenem Durchsatz über frische Vermutungen; zitieren Sie Bereiche und Zuversichtsniveaus, und prognostizieren Sie kontinuierlich neu.
  • Nehmen Sie die Außensicht mit Referenzklassenprognose bei großen Programmen, wo Optimismus am teuersten ist (Kapitel 10.1).
  • Schneiden Sie klein, damit individuelle Schätzungen aufhören zu zählen, und sequenzieren Sie nach Verzögerungskosten statt Bauchgefühl.
  • Schätzen Sie nur, wenn es eine Entscheidung ändert; sonst ist es Verschwendung. Siehe Kapitel 10.6 (Projektmanagement), 11.2 (Lieferung), 11.3 (Warteschlangentheorie), und 1.5 (Entscheidungsfindung und Governance).

Referenzen und weiterführende Literatur

  • Steve McConnell, Software Estimation: Demystifying the Black Art.
  • Daniel Vacanti, Actionable Agile Metrics for Predictability und When Will It Be Done? (probabilistische Prognose aus Flussdaten).
  • Troy Magennis, Forecasting and Simulating Software Development Projects (Monte-Carlo-Methoden).
  • Bent Flyvbjerg und Dan Gardner, How Big Things Get Done (Referenzklassenprognose und Megaprojekte).
  • Daniel Kahneman, Thinking, Fast and Slow (der Planungsfehlschluss und die Außensicht).
  • Donald Reinertsen, The Principles of Product Development Flow (Verzögerungskosten und Warteschlangenökonomie).
  • Vasco Duarte, NoEstimates: How to Measure Project Progress Without Estimating.
  • Frederick Brooks, The Mythical Man-Month (warum Softwarezeitpläne schiefgehen).
  • Todd Little, “Schedule Estimation and Uncertainty Surrounding the Cone of Uncertainty” (IEEE Software, 2006).