Die Entscheidung, die am teuersten falsch ausfällt
Die Cloud-vs.-On-Premise-Debatte hat um 2024 aufgehört, religiös zu sein. 2026 ist die Frage operativ: Welches Modell gewinnt für diese Workload, in diesem regulatorischen Kontext, bei diesem Wachstumsprofil auf drei Jahre TCO? Das ist eine Finanzfrage in Architektur-Verkleidung — und die meisten Unternehmen beantworten sie schlecht.
Dieser Leitfaden ist die Version, die viele Kunden vor einem 5-Jahres-Cloud-Commit oder einer Million-Euro-Serverraum-Investition hätten lesen sollen. Er deckt ab, wann Cloud gewinnt, wann On-Premise gewinnt, warum Hybrid die einzige ehrliche Antwort ist, den Repatriierungstrend, ein brauchbares TCO-Schema und einen Fünf-Schritte-Entscheidungsprozess.
Gliederung
- Wann Cloud 2026 wirklich gewinnt
- Wann On-Premise 2026 gewinnt
- Warum Hybrid die realistische Default-Antwort ist
- Der Repatriierungstrend und seine Auslöser
- TCO-Schema — die Positionen, die wirklich zählen
- Ein Fünf-Schritte-Entscheidungsprozess
1. Wann Cloud 2026 wirklich gewinnt
- Variable oder spitzenartige Last. Marketing-Kampagnen, Quartalsabschluss-Reporting, saisonaler E-Commerce. Peak als Opex zahlen schlägt Peak als Capex provisionieren.
- Globale Reichweite. Edge-Präsenz in 30+ Regionen in einer Woche — das schafft On-Premise zu keinem vernünftigen Budget.
- Schnelle Time-to-Market. Neue Produkte, MVPs, Kunden-Piloten. Cloud eliminiert das „Rack-and-Stack"-Fenster vollständig.
- Managed Services als Burggraben. Hosted Postgres, Queues, Identity. Wenn Sie sonst zwei Engineers einstellen müssten, ist der Cloud-Preis günstig.
- Disaster Recovery ohne zweites Rechenzentrum. Cross-Region-Failover ersetzt das kalte DR-Datacenter für die meisten Mittelstands-Workloads.
2. Wann On-Premise 2026 gewinnt
- Stetige Workloads mit hoher Auslastung. Eine Datenbank bei 70 % CPU rund um die Uhr ist auf eigener Hardware über drei Jahre bis zu 3× günstiger.
- Datensouveränität und sektorale Regulierung. Gesundheitswesen, Verteidigung, Teile des Finanzsektors, öffentliche Hand — NIS2, DORA oder nationale Klauseln ziehen Workloads zurück.
- GPU- und KI-Training in großem Maßstab. Cloud-GPU-Preise bestrafen 2026 weiterhin lange, planbare Trainingsläufe. Eigene (oder colocated) GPU-Server amortisieren sich bei stetiger Nutzung in 12–18 Monaten.
- Planbare Monatsrechnungen. Manche Vorstände können nicht mit Cloud-Rechnungsvarianz arbeiten. On-Premise liefert eine fixe Abschreibungslinie.
- Latenz-gebundene Workloads. Produktionshallen, Retail-POS, Trading-Desks — physische Nähe gewinnt.
3. Warum Hybrid die realistische Default-Antwort ist
Die meisten Mittelständler entscheiden nicht zwischen Cloud und On-Premise — sie driften in einen Mix und versuchen, ihn nachträglich zu steuern. Die gesündere Variante ist bewusster Hybrid:
- Stabiler Kern (ERP, Fileservices, Hauptdatenbank) on-premise oder in privater Colo.
- Variabler Edge (Web, APIs, kundenorientierte Apps) in der Public Cloud.
- Burst-Kapazität für Spitzen über die Cloud, Kern bei moderater Auslastung.
- DR-Spiegel im jeweils anderen Modell.
Wählen Sie einen Identity Provider, eine Netzwerk-Ebene, einen Observability-Stack über beides. Sonst wird Hybrid „zwei Infrastrukturen, doppelter Personalbedarf".
4. Der Repatriierungstrend und seine Auslöser
Bis 2026 ist Cloud-Repatriierung kein Basecamp-Kuriosum mehr, sondern eine stille Position in vielen CIO-Berichten. Die Auslöser sind konsistent:
- Egress-Gebühren fressen 15 %+ der monatlichen Cloud-Ausgaben.
- GPU-Kosten für lange Inferenz- oder Trainingsläufe.
- Compliance-Neuauslegung unter NIS2 oder sektoralen Regeln.
- Reife stetige Workloads, 3+ Jahre in der Cloud bei >60 % Auslastung.
- M&A erzwingt Konsolidierung auf eine bestehende On-Prem-Landschaft.
Repatriierung ist selten ein voller Rückzug — meist 20–40 % der Ausgaben zurück, der Teil, der nie von Cloud-Elastizität profitiert hat.
5. TCO-Schema — die Positionen, die wirklich zählen
Vergleichen Sie keine Listenpreise. Bauen Sie einen 3-Jahres-TCO mit diesen Zeilen für beide Optionen:
| Position | Cloud | On-Premise |
|---|---|---|
| Compute | Reserved + On-Demand-Mix | Hardware + 3-Jahres-Abschreibung |
| Storage | Pro GB + pro Klasse | Drives + Redundanz + Ersatzteile |
| Egress / WAN | Pro ausgehendem GB | Carrier-Links + MPLS / SD-WAN |
| Lizenzen (DB, OS, Hypervisor) | Oft gebündelt | Oft separat, manchmal günstiger |
| Betriebspersonal | Niedriger für Managed | Höher; On-Call-Last einrechnen |
| Strom, Kühlung, Fläche | Inkludiert | Real und 2026 wachsend |
| Backup und DR | Pro GB + Retrieval | Tape / Zweitstandort / Cloud-Target |
| Risikoprämie | Anbieter-Lock-in | Hardware-Obsoleszenz |
Fügen Sie beiden 15 % Contingency hinzu. Wer einen TCO ohne Contingency liefert, verkauft, berät nicht.
6. Ein Fünf-Schritte-Entscheidungsprozess
- Inventarisierung nach Workload. Entscheiden Sie nicht für „das Unternehmen" — entscheiden Sie für jede Workload-Klasse.
- Auslastung profilieren. Durchschnitt und Peak bei CPU/RAM/IOPS über 90 Tage. Stetige hohe Auslastung spricht für On-Premise.
- Regulatorische Constraints abbilden. Manche Workloads haben eine einzige legale Antwort.
- 3-Jahres-TCO pro Option bauen. Tabelle oben. Exit-Kosten inkludieren.
- Ziel-Mix wählen, dann steuern. Dokumentieren, welche Workload-Klasse wohin gehört, wer Ausnahmen genehmigt, alle 12 Monate prüfen.
Kernaussagen
- Cloud gewinnt bei variabler Last, globaler Reichweite, schneller Time-to-Market, Managed Services und leichter DR.
- On-Premise gewinnt bei stetigen hochausgelasteten Workloads, Souveränität, andauernder GPU-Arbeit und planbarem Billing.
- Bewusster Hybrid ist der realistische 2026-Default — aber nur mit einer Identity-, Netzwerk- und Observability-Ebene.
- Repatriierung ist kein Randthema mehr. Egress, GPU und Compliance sind die üblichen Auslöser.
- Entscheiden Sie pro Workload, mit 3-Jahres-TCO inklusive Exit-Kosten.
Wenn Sie vor einem Mehrjahres-Cloud-Vertrag oder einem neuen Serverraum eine unabhängige TCO-Prüfung wünschen, nehmen Sie Kontakt auf — Sie sprechen mit einem Ingenieur, nicht mit einem Vertriebler.
