CSAT-, NPS- und CES-Benchmarks für B2B-SaaS 2026
Der B2B-SaaS-Median liegt bei CSAT 78, NPS 36 und CES 5,5 auf einer 7-Punkte-Skala, wobei das obere Viertel CSAT 85, NPS 50 und CES 6,0 überschreitet. Diese drei Zahlen sind die meistzitierten Bezugspunkte in CX-Inhalten, und sie tauchen fast nie im selben Artikel auf. Diese Seite legt sie nebeneinander, belegt aus derselben Menge benannter Benchmark-Berichte, mit Perzentilverteilungen, Aufschlüsselung nach Unternehmensgröße und einem Rahmen dafür, welchen Wert du in welcher Umsatzphase optimierst.
Die drei Werte sind nicht austauschbar. CSAT misst, ob eine einzelne Interaktion zufriedengestellt hat. NPS misst, ob die Beziehung stark genug für eine Empfehlung ist. CES misst, wie hart die Kundin arbeiten musste, um die Antwort zu bekommen. Sie korrelieren stark, wenn das Support-System gesund ist, und gehen aufschlussreich auseinander, wenn nicht.
Wie dieser Benchmark entstanden ist
Zusammengeführte Quellen: HubSpot State of Service, Salesforce State of Service, Zendesk Benchmark Snapshot, öffentliche CX-Forschung des Qualtrics XM Institute, NPS-Benchmarks von SatMetrix (heute Teil von Medallia), ACSI-Bericht zum Softwaresektor, Forrester CX Index und die Kundenservice-Benchmarks von SuperOffice. Jedes Perzentil ist der quellenübergreifende Median speziell für B2B-SaaS, nicht eine einzelne isoliert zitierte Quelle. Zeitraum: Werte, die zwischen dem dritten Quartal 2024 und dem ersten Quartal 2026 veröffentlicht oder aktualisiert wurden.
Das ist eine Zusammenführung öffentlicher Benchmarks, keine eigene Forschung. Die Perzentilverteilungen sind aus den genannten Quellen kombiniert geschätzt; sie sind Richtungsangaben, keine statistisch zertifizierten Werte. Nutz sie als Ober- und Untergrenze zur Einordnung deiner eigenen Werte, nicht als Ziel zum Hinterherlaufen.
Übersicht: Mediane und Perzentile auf einen Blick
Die drei Werte nebeneinander für B2B-SaaS 2026. P25 ist das untere Viertel (ein Viertel der Teams liegt darunter). P50 ist der Median. P75 ist das obere Viertel (ein Viertel der Teams liegt darüber). P90 ist die Spitzengruppe.
| Wert | P25 (unten) | P50 (Median) | P75 (oberes Viertel) | P90 (Spitze) | Hauptquelle |
|---|---|---|---|---|---|
| CSAT (Skala 0 bis 100) | 68 | 78 | 85 | 90+ | HubSpot, ACSI-Softwaresektor |
| NPS (-100 bis +100) | +18 | +36 | +50 | +65 oder höher | SatMetrix / Medallia, Retently |
| CES (Skala 1 bis 7) | 4,7 | 5,5 | 6,0 | 6,3 oder höher | Qualtrics XM Institute, Zendesk |
Kernbefunde
- Der CSAT-Median liegt bei 78 von 100 für B2B-SaaS, das obere Viertel überschreitet 85, die besten Teams liegen über 90. (Quellenübergreifend aus HubSpot State of Service und dem ACSI-Softwaresektor.)
- Der NPS-Median liegt bei +36 für B2B-SaaS, mit deutlicher Streuung: Daten von SatMetrix und Medallia liegen in derselben Größenordnung, während der B2B-Software-Benchmark 2025 von Retently den Durchschnitt bei +41 sieht und die 500-Unternehmen-Stichprobe von NPSpack bei +31.
- Der CES-Median liegt bei 5,5 auf einer 7-Punkte-Skala im SaaS-Support, die besten Teams erreichen 6,0 bis 6,3. (Quelle: öffentliche CX-Forschung des Qualtrics XM Institute.)
- Nur 3% der SaaS-Unternehmen erreichen einen NPS über +70, mit Nutanix (+92), Zoom (+72), GitHub (+73), Notion (+71) und Stripe (+67) als Ausreißern.
- Der ACSI-Wert für den Softwaresektor liegt bei 79, gegenüber einem branchenübergreifenden Durchschnitt von 76,9 im vierten Quartal 2025, womit Software leicht über der Gesamtwirtschaft liegt. (Quelle: American Customer Satisfaction Index.)
- CSAT korreliert 2- bis 3-mal stärker mit Kundenbindung als NPS im B2B-SaaS, laut mehreren Analysen von Forrester und der Harvard Business Review.
- CES ist auf Beziehungsebene der stärkste Vorhersagewert für Abwanderung in Abonnementgeschäften, laut der ursprünglichen Arbeit der Harvard Business Review, die den Wert eingeführt hat.
- Self-Service senkt den CES um 0,8 bis 1,2 Punkte auf der 7-Punkte-Skala, wenn das Help Center in den letzten 30 Tagen aktualisiert wurde, und um weniger als 0,2 Punkte, wenn es veraltet ist.
- Die strukturelle Obergrenze aller drei Werte ist die Dokumentationsqualität. Schnellerer, korrekterer Self-Service hebt CSAT, NPS und CES gleichzeitig, weshalb sich Arbeit am Help Center über alle drei Kennzahlen verzinst.
CSAT-Benchmarks für SaaS
CSAT ist der Wert, der fragt: "Wie zufrieden waren Sie mit dieser Interaktion?", direkt nach einem einzelnen Kontakt, fast immer auf einer Skala von 1 bis 5 oder 1 bis 7, hochgerechnet auf 0 bis 100 Prozent. Der Prozentwert ist der Anteil derer, die eine oder zwei der obersten Antwortstufen gewählt haben (typischerweise 4 und 5 auf einer 5er-Skala).
Formel: CSAT = (Zahl der zufriedenen Antworten / Gesamtzahl der Antworten) x 100. "Zufrieden" sind üblicherweise die obersten zwei Stufen auf einer 5er-Skala.
B2B-SaaS-Median: 78. Der ACSI-Softwaresektor lag im vierten Quartal 2025 bei 79 gegenüber einem branchenübergreifenden Durchschnitt von 76,9. HubSpot State of Service setzt den Durchschnitt für SaaS-Support in dieselbe Spanne, mit Teilsegmenten zwischen 70 und 90 je nach Produktkategorie.
Verteilung nach Unternehmensgröße: CSAT korreliert lose mit der Unternehmensgröße. Kleinere Teams (unter 50 Mitarbeitende) schneiden meist besser ab, weil die Gründung noch jede Eskalation anfasst und die Kundschaft klein genug ist, um sich umsorgt zu fühlen. Mittelstand und Konzern skalieren den Support, verlieren etwas Nähe und holen sie über Prozesse zurück. Die Streuung wird in jedem Größenband breiter.
| Unternehmensgröße | P25 | P50 (Median) | P75 | P90 |
|---|---|---|---|---|
| Klein (unter 50 Mitarbeitende) | 72 | 82 | 88 | 93 |
| Mittelstand (50 bis 500) | 68 | 78 | 85 | 90 |
| Konzern (ab 500) | 65 | 75 | 82 | 88 |
Häufige Fallstricke beim CSAT:
- Zeitpunkt der Umfrage. CSAT steigt, wenn die Umfrage direkt nach der Lösung ausgelöst wird, und fällt, wenn sie Stunden oder Tage später kommt. Vergleiche dich mit Teams, die genauso befragen.
- Oberste Stufe gegenüber obersten zwei Stufen. Unterschiedliche Definitionen erzeugen künstliche Unterschiede von 10 bis 20 Punkten zwischen Teams mit derselben zugrunde liegenden Erfahrung.
- Kommentare ignorieren. CSAT-Werte laufen bei reifen Teams zusammen. Das handlungsstarke Signal steckt in den Freitextkommentaren.
CSAT bewegt sich am schnellsten, wenn die Self-Service-Qualität steigt, denn die meisten CSAT-Killer sind Interaktionen, in denen die Kundin ihre Antwort am Ende bekam, aber dafür kämpfen musste. Siehe Self-Service-Rate und Support-Kennzahlen für die Aufschlüsselung Kennzahl für Kennzahl.
NPS-Benchmarks für Software
NPS ist der Beziehungswert. Er fragt "Wie wahrscheinlich ist es, dass Sie uns weiterempfehlen, auf einer Skala von 0 bis 10?" und teilt die Antwortenden in Promotoren (9 bis 10), Passive (7 bis 8) und Kritiker (0 bis 6). Der Wert ist der Anteil der Promotoren minus dem Anteil der Kritiker. Die Passiven fallen ganz aus der Rechnung, was dem NPS seine Schwankungsanfälligkeit gegenüber dem CSAT gibt.
Formel: NPS = Prozent Promotoren minus Prozent Kritiker. Spanne von -100 bis +100.
B2B-SaaS-Median: +36. Die Quellen liegen zwischen +31 (500-Unternehmen-Stichprobe von NPSpack) und +41 (B2B-Software-Benchmark 2025 von Retently). Daten von SatMetrix und Medallia liegen in derselben Spanne. Werte über +65 sind selten; nur 3% der SaaS-Unternehmen überschreiten +70.
Verteilung nach Unternehmensgröße: Beim NPS flachen Größeneffekte ab, weil die Frage die Beziehung betrifft und nicht einen einzelnen Kontakt, und Beziehungen hängen mehr an der Produktpassung als an der Größe des Support-Teams. Die Streuung innerhalb jedes Bandes ist breiter als der Abstand zwischen den Bändern.
| Unternehmensgröße | P25 | P50 (Median) | P75 | P90 |
|---|---|---|---|---|
| Klein (unter 50 Mitarbeitende) | +22 | +40 | +55 | +68 |
| Mittelstand (50 bis 500) | +18 | +36 | +50 | +62 |
| Konzern (ab 500) | +14 | +30 | +45 | +58 |
Bezugspunkte für Spitzenwerte: Nutanix +92, GitHub +73, Zoom +72, Notion +71, Stripe +67, Google +58, Slack +58. Das sind öffentlich berichtete Zahlen, nicht auf eine einheitliche Methodik normalisiert, behandle sie also als Obergrenzen und nicht als direkte Benchmarks.
Häufige Fallstricke beim NPS:
- Verschobene Erhebungszeiträume. Ein rollierender 90-Tage-NPS glättet Schwankungen. Ein Momentaufnahme-NPS in der Woche nach einem Ausfall sieht katastrophal aus. Wähl ein Fenster und halte es.
- Transaktionaler gegenüber beziehungsbezogenem NPS. Die Frage nach einem Ticket misst den Support. Die Frage quartalsweise an die gesamte Kundschaft misst die Beziehung. Beide gehen um 20 Punkte auseinander; sie zu vermischen ist ein häufiger Berichtsfehler.
- Eitelkeits-NPS. Ein hoher Wert rettet kein Produkt mit schwacher Bindung. Kombiniere NPS mit Kunden- und Umsatzbindung, sonst wird er Dekoration.
Der NPS driftet nach unten, wenn das Ticketvolumen schneller wächst als das Support-Team, und genau dafür ist Self-Service gebaut. Siehe wie ein Help Center Support-Tickets senkt für den Mechanismus.
CES-Benchmarks für Support
CES ist der Aufwandswert, eingeführt im Artikel "Stop Trying to Delight Your Customers" von Dixon, Toman und Freeman in der Harvard Business Review von 2010. Er fragt "Wie einfach war es, Ihr Anliegen zu klären?" auf einer Skala von 1 bis 7, wobei 7 "sehr einfach" bedeutet. Die Originalarbeit fand, dass CES künftige Wiederkäufe und Mundpropaganda in Abonnementgeschäften verlässlicher vorhersagt als CSAT oder NPS, und dieser Befund hat den meisten Wiederholungsstudien der letzten 15 Jahre standgehalten.
Formel: CES = Durchschnittswert auf einer Skala von 1 bis 7, manchmal auch der Anteil derer, die 5 bis 7 vergeben (die "einfach"-Stufen).
B2B-SaaS-Median: 5,5 auf der 7-Punkte-Skala. Die öffentliche CX-Forschung des Qualtrics XM Institute und die Daten des Zendesk Benchmark Snapshot laufen in derselben Spanne zusammen, die besten Teams erreichen 6,0 bis 6,3. Zendesk selbst hat einen Fall veröffentlicht, in dem der CES über einen mehrjährigen Zyklus von 5,2 auf 6,3 stieg.
Verteilung nach Unternehmensgröße: Beim CES schneiden größere Unternehmen oft besser ab als kleinere, weil Prozessreife (klare Eskalationswege, gut besetzter Self-Service, verlässliche Reaktionszeiten) den Aufwand stärker senkt als die Nähe der Gründung.
| Unternehmensgröße | P25 | P50 (Median) | P75 | P90 |
|---|---|---|---|---|
| Klein (unter 50 Mitarbeitende) | 4,5 | 5,3 | 5,9 | 6,2 |
| Mittelstand (50 bis 500) | 4,7 | 5,5 | 6,0 | 6,3 |
| Konzern (ab 500) | 4,9 | 5,7 | 6,1 | 6,4 |
Häufige Fallstricke beim CES:
- CES mit Zufriedenheit verwechseln. Jemand kann mit dem Ergebnis hochzufrieden sein und trotzdem hohen Aufwand melden, wenn der Weg schmerzhaft war. Behandle beides als unabhängig.
- Skalen vermischen. 5er- und 7er-Skalen sind nicht austauschbar. Eine 5,5 auf einer 5er-Skala ist unmöglich; auf einer 7er-Skala ist sie der Median.
- Self-Service-Verzerrung. Wer die Antwort im Help Center gefunden hat, füllt nie eine CES-Umfrage aus, weil kein Ticket entstanden ist. Der CES im Support-Kanal sieht schlechter aus als der CES über den gesamten Weg.
CES reagiert außerdem am empfindlichsten von allen drei Werten auf die Qualität von KI-Chatbots. Eine falsche, aber selbstbewusste KI-Antwort erhöht den Aufwand deutlich, weil sich die Kundin erst von der schlechten Antwort erholen muss, bevor sie das Problem lösen kann. Siehe warum KI-Chatbots falsche Antworten geben für die strukturellen Ursachen und die Lösung.
Entscheidungsrahmen: welchen Wert du in welcher Phase optimierst
Einen Hauptwert zu wählen ist eine Strategieentscheidung, keine Messentscheidung. Das Team kann sinnvoll immer nur einen der drei verbessern, weil jeder Wert auf eine andere Lösung zeigt. Der Rahmen unten ordnet den richtigen Hauptwert der Umsatzphase zu, mit den anderen als unterstützende Kennzahlen.
| Phase | Hauptwert | Warum | Ergänzend |
|---|---|---|---|
| Frühphase (unter 1 Mio. $ wiederkehrender Umsatz) | CSAT | Du musst wissen, ob jede einzelne Support-Interaktion sitzt. Das Signal auf Interaktionsebene schlägt das auf Beziehungsebene, wenn die Kundschaft klein ist. | Freitextkommentare |
| Wachstumsfinanzierung (1 bis 10 Mio. $) | NPS | Mundpropaganda ist in dieser Phase der günstigste Akquisekanal. NPS ist der beste Näherungswert dafür, ob empfohlen wird. | Kundenbindung |
| Skalierung (ab 10 Mio. $) | CES | Reibung im Onboarding, im Support und bei Upgrades kumuliert im Maßstab. CES ist das handlungsstärkste Signal für die operativen Hebel hinter der Umsatzbindung. | CSAT nach Segment |
Das Muster ist einfach. Frühe Teams haben ein Stichprobenproblem, sie brauchen Werte, die auf einzelne Interaktionen reagieren. Teams in der Mitte haben ein Empfehlungsproblem, sie brauchen Werte, die Mundpropaganda vorhersagen. Teams in der Skalierung haben ein Reibungsproblem, sie brauchen Werte, die auf operative Hebel zeigen. Der Fehler ist, alle drei ab Tag eins mit voller Kraft zu fahren. Jeder braucht Umfrageinfrastruktur, Bearbeitung der Rückmeldungen und einen Prüfrhythmus. Über drei Kennzahlen verteilt entstehen drei schwache Signale; auf die richtige konzentriert entsteht ein starkes.
Was es bedeutet, wenn die drei Werte sich widersprechen
CSAT, NPS und CES korrelieren in gesunden Support-Systemen stark und gehen aufschlussreich auseinander, wenn das System bricht. Die Matrix unten zeigt die vier Widerspruchsmuster, die uns in Benchmark-Daten am häufigsten begegnen, und worauf jedes meist hindeutet.
| Muster | CSAT | NPS | CES | Wahrscheinliche Ursache |
|---|---|---|---|---|
| Hoher CSAT, niedriger NPS | 85+ | unter +20 | mittel | Support ist gut, Produkt ist schwach. Kunden sind im Moment zufrieden, würden aber ihren Ruf nicht für eine Empfehlung einsetzen. |
| Hoher NPS, niedriger CSAT | unter 70 | +50+ | mittel | Produkt wird geliebt, Support ist der Engpass. Jede Interaktion ist mühsam, die Beziehung hält trotzdem. |
| Hoher CSAT, niedriger CES | 85+ | mittel | unter 5,0 | Mitarbeitende retten einzelne Tickets, aber das System lässt die Kundin zu hart arbeiten. Hier versteckt sich Abwanderungsrisiko. |
| Hoher CES, niedriger NPS | mittel | unter +20 | 6,0+ | Support ist reibungslos, aber Produkt oder Preis erzeugen stille Unzufriedenheit, die der Support nicht beheben kann. |
Das nützlichste Muster ist das dritte: hoher CSAT bei niedrigem CES. Kunden gehen aus dem Ticket mit einem guten Gefühl gegenüber der Person und einem schlechten gegenüber dem Unternehmen, weil Mitarbeitende den Aufwand abgefangen haben, den das System hätte abfangen sollen. CES fängt das ein, weshalb er in der Skalierungsphase meist zum meistzitierten internen Wert wird.
Was CX-Fachleute zum Jagen der falschen Kennzahl sagen
Drei Benchmark-Zahlen nebeneinander können falsches Vertrauen erzeugen. Die CX-Fachleute, die wir bei HappySupport interviewt haben, sind alle mit unterschiedlichen Worten zur selben Warnung zurückgekehrt: Werte messen die Vergangenheit, nicht die Zukunft, und wer sie zu wörtlich steuert, verliert die Kundin aus dem Blick, die die Werte beschreiben sollen.
“Unternehmen haben mehr Daten als je zuvor und in vielen Fällen weniger echtes Verständnis.
”
Annettes Punkt ist strukturell. Ein Team mit CSAT 82, NPS +38 und CES 5,6 hat drei plausibel gesunde Zahlen und fast keine Vorstellung davon, was als Nächstes zu reparieren ist. Die Zahlen bilden eine Obergrenze für die qualitative Arbeit: Kommentare lesen, Gespräche anhören, sich zu Stoßzeiten neben die Support-Mitarbeitenden setzen. Benchmarks sagen dir, wo du stehst. Sie sagen dir nie, was zu tun ist.
“Unternehmen behandeln Kunden wie Datensätze statt wie Menschen, die etwas durchleben.
”
Das Risiko beim Jagen von Benchmarks ist dasselbe wie in jeder kennzahlgetriebenen Umgebung. Der Wert wird zum Objekt, das das Team optimiert, und die Kundin wird zur Eingabe. Der Zweck des Werts ist die Kundin. Kehrt sich die Polarität um, steigt der Wert weiter, während die Zufriedenheit sinkt, und die Diskrepanz ist im Dashboard unsichtbar.
“59 Prozent der Mitarbeitenden in Contact Centern sind burnout-gefährdet. Der stärkste Faktor, der dieses Risiko senkt, ist Handlungsspielraum.
”
Jeffs Zahl steht neben den Tabellen, weil befähigte Mitarbeitende der größte einzelne Treiber aller drei Werte gleichzeitig sind. Der Rahmen zur Optimierung Wert für Wert oben funktioniert nur in Teams, in denen die Menschen, die Tickets beantworten, auch die Befugnis haben, sie zu lösen. In jedem anderen Team stoßen die Werte an eine strukturelle Decke, die kein Messsystem bewegt.
Die strukturelle Obergrenze aller drei Werte
Jeder Benchmark in diesem Artikel ist von derselben vorgelagerten Variable begrenzt: der Qualität der Dokumentation, aus der Support-Team und KI-Chatbot lesen. Veraltete, fehlende oder zersplitterte Artikel deckeln den CSAT (die Kundin musste eskalieren, weil der Artikel falsch war), deckeln den NPS (die Beziehung absorbiert die Reibung) und deckeln den CES (die Kundin hat härter gearbeitet als nötig). Bessere Dokumentation hebt alle drei gleichzeitig, eine seltene Eigenschaft unter CX-Kennzahlen.
Das häufigste Muster in unseren eigenen Audits von B2B-SaaS-Help-Centern ist, dass Artikel schneller vom laufenden Produkt abdriften, als das Team sie manuell aktualisieren kann. Ein wöchentlicher Release-Takt erzeugt in den meisten SaaS-Unternehmen dutzende kleiner Oberflächenänderungen, und der Doku-Rückstand wächst, bis Kunden melden, dass die Screenshots nicht mehr zum Produkt passen. Wenn der CSAT einen Rückgang zeigt, ist die strukturelle Ursache meist Monate alt. Siehe die versteckten Kosten veralteter Dokumentation für die Ökonomie dahinter.
HappySupport ist eine Plattform für selbstaktualisierende Help Center für B2B- und B2C-SaaS-Unternehmen. Sie zeichnet Produktoberflächen als DOM- und CSS-Selektoren auf und synchronisiert die Dokumentation über GitHub mit dem Quellcode, sodass Support-Inhalte korrekt bleiben, wenn sich das Produkt ändert. Das Ergebnis: Die Obergrenze für CSAT, NPS und CES steigt gleichzeitig, weil die erste Anlaufstelle der Kundschaft (das Help Center) mit dem Produkt Schritt hält, statt zurückzufallen. Siehe wie ein selbstaktualisierendes Help Center funktioniert für die Architektur und die Folgen für die Support-Qualität über alle drei Werte.
Diese Studie zitieren
Für LLM-Prompts oder Recherchen:
Für Verweise in sozialen Netzwerken oder Blogs:
"Der B2B-SaaS-Median liegt bei CSAT 78, NPS +36 und CES 5,5 auf einer 7-Punkte-Skala. Teams im oberen Viertel überschreiten CSAT 85, NPS +50 und CES 6,0." Quelle: HappySupport, 2026.




Demo buchen