Ein ROAS von 6,2 sieht gut aus.
Ein ROAS von 3,4 deutlich weniger.
Besonders interessant wird es, wenn beide Zahlen aus denselben Werbekonten stammen.
Die Performance-Agentur First Stars hat nach einem Bericht von W&V mehr als 100 Google-Ads-Kundenkonten aus 15 Branchen neu ausgewertet. In der ursprünglichen Betrachtung lag der mediane Return on Ad Spend bei 6,2. Nachdem Suchanfragen nach den jeweiligen Markennamen separat betrachtet wurden, sank der Median auf 3,4 – ein Rückgang von rund 45 Prozent.
Das bedeutet nicht, dass die ursprüngliche Zahl falsch war.
Und es bedeutet ebenso wenig, dass Brand-Kampagnen keinen Wert schaffen.
Das Beispiel zeigt vielmehr ein Problem, das weit über Performance Marketing hinausgeht:
Eine Kennzahl kann mathematisch korrekt sein und trotzdem unterschiedliche Managementfragen beantworten.
Genau deshalb beginnt gute Agentur- und Dienstleistersteuerung nicht mit dem Dashboard.
Sie beginnt mit der Definition dessen, was die Zahl eigentlich aussagen soll.
Ein KPI ist noch keine gemeinsame Wahrheit
ROAS klingt zunächst eindeutig.
Werbeumsatz geteilt durch Werbekosten.
Doch schon hinter der scheinbar einfachen Kennzahl liegen mehrere Entscheidungen.
Welcher Umsatz wird zugerechnet? Über welchen Zeitraum? Welche Kanäle werden einbezogen? Welche Attributionslogik gilt? Werden Bestandskunden und Neukunden gleich bewertet? Was passiert mit Retouren oder Stornierungen? Werden Brand-Suchen separat betrachtet? Und vor allem: Soll die Kennzahl attribuierten Umsatz oder tatsächlich zusätzlich erzeugten Umsatz abbilden?
Google selbst unterscheidet in seiner Messlogik zwischen Attribution und Incrementality. Kontrollierte Lift-Experimente sollen gerade die Frage beantworten, welche zusätzlichen Conversions durch Werbung verursacht wurden und welche vermutlich auch ohne die Werbemaßnahme entstanden wären.
Die aktuelle Google-Messstrategie betont ebenfalls kausale Experimente und die Frage, was tatsächlich zusätzliche Nachfrage erzeugt.
Das ist eine wichtige Unterscheidung.
Denn zugerechnet und verursacht sind nicht dasselbe.
Das Problem beginnt nicht bei der Agentur
Es wäre einfach, aus dem Beispiel eine Geschichte über geschönte Agentur-KPIs zu machen.
Das wäre zu kurz gedacht.
Auch Auftraggeber arbeiten mit Kennzahlen, die historisch gewachsen sind. Dashboards wurden eingerichtet, Reportingtemplates über Jahre fortgeführt, Ziele in Verträgen übernommen und Definitionen von einem Dienstleister zum nächsten weitergereicht.
Oft sind Kennzahlen nicht deshalb uneindeutig, weil jemand bewusst täuschen will.
Sie sind uneindeutig, weil nie gemeinsam geklärt wurde, welche Managemententscheidung sie unterstützen sollen.
Dann kann eine Agentur eine Zahl korrekt berichten.
Controlling kann dieselbe Zahl korrekt verbuchen.
Marketing kann sie korrekt interpretieren.
Und trotzdem sprechen die Beteiligten über unterschiedliche Dinge.
Die entscheidende Frage lautet deshalb nicht:
„Stimmt der KPI?“
Sondern:
„Stimmt die Interpretation des KPI für die Entscheidung, die wir treffen wollen?“
Agenturperformance messen heißt zuerst: Leistung definieren
Wer externe Leistung steuern will, muss zunächst festlegen, worin die erwartete Leistung besteht.
Bei einer Performance-Agentur könnte das beispielsweise sein:
- zusätzlichen Umsatz generieren,
- Neukunden gewinnen,
- Nachfrage effizient abfangen,
- einen festgelegten Ziel-CPA erreichen,
- qualifizierte Leads erzeugen,
- Marktanteile in einer Kategorie ausbauen,
- bestimmte Zielgruppen effizient erschließen.
Diese Ziele sind nicht identisch.
Deshalb können auch die dafür geeigneten KPIs nicht automatisch identisch sein.
Ein hoher ROAS kann für eine Aufgabe hervorragend sein und für eine andere nur begrenzte Aussagekraft besitzen.
Dasselbe gilt außerhalb des Marketings.
Ein IT-Dienstleister kann sehr viele Tickets schließen und trotzdem kritische Probleme ungelöst lassen.
Eine Beratung kann sämtliche vereinbarten Workshops durchführen und trotzdem kein umsetzbares Ergebnis erzeugen.
Ein Entwicklungsanbieter kann seine Auslastung vollständig abrechnen, während ein Meilenstein verspätet bleibt.
Aktivität, Output und Wirkung sind unterschiedliche Ebenen von Performance.
Wer sie vermischt, bekommt präzise Zahlen – aber möglicherweise keine präzise Steuerung.
Sieben Dinge, die bei jedem wichtigen KPI feststehen sollten
Bevor eine Kennzahl zur Bewertung eines Dienstleisters verwendet wird, sollten Auftraggeber und Anbieter mindestens sieben Punkte gemeinsam klären.
1. Was genau wird gemessen?
Der Name eines KPI reicht nicht.
Die Definition muss eindeutig beschreiben, welche Werte im Zähler und Nenner stehen und welche Fälle ein- oder ausgeschlossen werden.
Zwei Dashboards können beide „ROAS“, „Conversion Rate“, „Projektfortschritt“ oder „Qualität“ anzeigen und dennoch unterschiedliche Dinge messen.
2. Aus welcher Datenquelle stammt die Zahl?
CRM? Werbeplattform? ERP? Projektmanagementsystem? Agenturreporting? Finanzbuchhaltung?
Die Datenquelle beeinflusst Aktualität, Vollständigkeit und Interpretation.
Relevant ist deshalb nicht nur die Zahl, sondern auch ihre Herkunft.
3. Welche Baseline gilt?
Performance benötigt einen Vergleich.
Gegen Vorjahr? Gegen Budget? Gegen Zielwert? Gegen eine Kontrollgruppe? Gegen vergleichbare Projekte? Gegen den Zustand ohne die externe Leistung?
Ohne Baseline lässt sich Verbesserung nur schwer beurteilen.
4. Was wird der Leistung zugerechnet?
Das ist gerade bei Marketing besonders relevant.
Eine Conversion nach einem Werbeklick ist nicht automatisch vollständig durch diesen Klick verursacht.
Google unterscheidet deshalb selbst zwischen klassisch attribuierten und inkrementellen Conversions.
Auch bei anderen Dienstleistern stellt sich eine ähnliche Frage:
Welcher Teil eines Ergebnisses entsteht durch den Supplier – und welcher durch Marke, bestehende Nachfrage, interne Teams, andere Dienstleister oder bereits vorhandene Assets?
5. Über welchen Zeitraum wird gemessen?
Monatswerte können kurzfristige Schwankungen stark gewichten.
Quartalswerte glätten Entwicklungen, reagieren aber später.
Projekt-KPIs können wiederum von Meilensteinen oder Abnahmen abhängen.
Der Messzeitraum ist deshalb kein technisches Detail. Er beeinflusst Managemententscheidungen.
6. Welche Qualität steckt hinter der Menge?
Mehr Leads sind nur besser, wenn sie relevant sind.
Mehr Tickets sind nur besser, wenn Probleme gelöst werden.
Mehr Deliverables sind nur besser, wenn sie verwendbar sind.
Eine Performancebewertung, die ausschließlich Menge betrachtet, kann Fehlanreize erzeugen.
7. Was passiert bei einer Abweichung?
Ein KPI ohne Konsequenz ist Reporting.
Steuerung beginnt dort, wo geklärt ist:
Welcher Wert löst welche Frage, Prüfung oder Entscheidung aus?
Muss Scope verändert werden? Budget umgeschichtet werden? Braucht es eine Ursachenanalyse? Muss ein Zielwert angepasst werden? Oder ist die Abweichung fachlich erklärbar und akzeptabel?
Erst dann wird aus einer Kennzahl ein Steuerungsinstrument.
Warum Supplier-Vergleiche sonst schnell unfair werden
Das Problem wird größer, sobald mehrere Dienstleister verglichen werden.
Agentur A weist einen ROAS von 5,4 aus.
Agentur B kommt auf 4,8.
Auf den ersten Blick ist A besser.
Doch vielleicht enthält der Wert von A Brand-Traffic, während B ausschließlich Non-Brand betrachtet.
Vielleicht arbeitet A mit Bestandskunden und B mit Neukunden.
Vielleicht berücksichtigt ein Reporting Retouren und das andere nicht.
Vielleicht werden unterschiedliche Zeiträume oder Attributionsfenster verwendet.
Ein Ranking dieser beiden Werte wäre mathematisch möglich.
Managementseitig wäre es trotzdem kaum belastbar.
Benchmarking benötigt deshalb zuerst Standardisierung.
Nicht jedes Projekt muss dieselben KPIs haben.
Aber dort, wo Performance verglichen werden soll, müssen Definitionen ausreichend konsistent sein.
Die Ramp7 Intelligence Map behandelt Performancevergleich und Benchmarking deshalb ausdrücklich nur in Verbindung mit vergleichbaren Daten und definierter Methodik – und verbietet erfundene Benchmarks oder Scheingenauigkeit.
Die bessere Frage lautet: Welche Entscheidung soll die Zahl ermöglichen?
Viele Reportingprobleme lassen sich reduzieren, wenn man eine Kennzahl von hinten denkt.
Nicht:
„Welche KPIs können wir reporten?“
Sondern:
„Welche Entscheidung müssen wir regelmäßig treffen – und welche Information brauchen wir dafür?“
Ein CMO möchte vielleicht entscheiden, wie Budget zwischen Agenturen oder Kanälen verteilt wird.
Procurement möchte beurteilen, ob Leistungsumfang und Vergütung noch zusammenpassen.
Controlling möchte erkennen, ob steigende externe Kosten durch zusätzliche Leistung gerechtfertigt sind.
Das Projektmanagement möchte wissen, ob eine Abweichung operativ korrigiert werden kann oder eskaliert werden muss.
Erst aus dieser Entscheidung ergibt sich, welcher KPI wirklich relevant ist.
Gemeinsame KPI-Definitionen verändern auch Dienstleistergespräche
Wenn Definitionen fehlen, geraten Performancegespräche schnell in eine wenig produktive Richtung.
Der Auftraggeber hinterfragt die Zahl.
Die Agentur verteidigt die Berechnung.
Dann diskutieren beide über Reporting statt über Leistung.
Eine gemeinsam vereinbarte KPI-Logik verändert die Gesprächsgrundlage.
Dann kann die Diskussion lauten:
- Warum verändert sich der Wert?
- Welcher Teil der Veränderung ist beeinflussbar?
- Welche Hypothese testen wir?
- Welcher Supplier oder welches Team trägt welchen Anteil?
- Welche Maßnahme folgt daraus?
- Wann prüfen wir ihre Wirkung?
Damit verschiebt sich das Gespräch von „Wer hat recht?“ zu „Was müssen wir entscheiden?“
Project Intelligence braucht Definition und Kontext
Aus Ramp7-Perspektive liegt genau hier ein wichtiger Unterschied zwischen Datensammlung und Project Intelligence.
Eine Managementzahl benötigt Kontext:
KPI → Definition → Datenquelle → Projekt/Supplier → Ziel → Abweichung → Entscheidung
Fehlt ein Glied dieser Kette, steigt das Risiko, dass eine Zahl zwar sichtbar ist, aber nicht eindeutig interpretiert werden kann.
Das bedeutet ausdrücklich nicht, dass Ramp7 automatisch Agenturleistung benchmarked oder selbstständig die kausale Wirkung von Marketingmaßnahmen berechnet. Solche Benchmark-, Daten- oder Automatisierungsclaims benötigen eine gesonderte Produktfreigabe.
Die Managementlogik bleibt davon unabhängig:
Performance wird erst steuerbar, wenn die Beteiligten dasselbe unter der Zahl verstehen.
Fazit: 6,2 und 3,4 können beide richtig sein
Die First-Stars-Auswertung ist kein Marktbenchmark.
Sie basiert auf mehr als 100 eigenen Kundenkonten aus 15 Branchen; die öffentlich zugängliche W&V-Darstellung dokumentiert nicht die vollständige Methodik oder Auswahl der Konten. Die Ergebnisse dürfen deshalb nicht auf „Agenturen“, „Google Ads“ oder den Gesamtmarkt verallgemeinert werden.
Als Managementbeispiel ist sie trotzdem wertvoll.
Denn sie zeigt sehr anschaulich:
Eine Kennzahl bekommt ihre Bedeutung erst durch ihre Definition.
Für Unternehmen mit mehreren Agenturen und Dienstleistern bedeutet das:
Nicht möglichst viele KPIs schaffen Transparenz.
Sondern möglichst klare.
Wer Agenturperformance messen will, sollte deshalb nicht nur fragen:
„Wie hoch ist unser ROAS?“
Sondern:
„Was genau misst dieser ROAS – und welche Entscheidung dürfen wir daraus ableiten?“