Die meisten Inkrementalitätstests sind Autopsien. Wenn das Ergebnis vorliegt, ist der Ausgang meist schon besiegelt – nicht durch den Test selbst, sondern durch Ort und Art der Anzeigenschaltung. Marketingverantwortliche betrachten Inkrementalität oft als eine Art Zeugnis am Ende des Quartals. Dabei ist sie eher eine Entscheidung, die sie bereits zu Beginn getroffen haben, als sie festlegten, wo die Anzeige ausgespielt wird.
Diese Neuausrichtung ist wichtig, denn Inkrementalität ist zum KPI geworden, den jeder will, dem aber kaum jemand vertraut. Branchenweite Messstudien zeigen: Die meisten Werbetreibenden geben an, dass ihr Stack aus Attribution, MMM und Inkrementalität in puncto Genauigkeit, Geschwindigkeit und Vertrauenswürdigkeit nicht ausreicht (IAB, State of Data 2026). Wir sind der Meinung, dass die Lücke kein Messproblem ist, sondern ein Medienproblem.
Was ein Lift-Test tatsächlich misst
Jeder Lift-Test stellt eine einzige Frage: Hat diese Anzeige jemanden erreicht, der nicht ohnehin konvertiert wäre? Dieses „ohnehin“ ist der entscheidende Punkt. Inkrementalität ist das, was passiert ist, abzüglich dessen, was ohne die Anzeige passiert wäre – das Kontrafaktische. Die Größe dieser Lücke wird weniger durch den Test bestimmt als durch die Platzierung, die Sie gewählt haben.
Das führt zu einer unangenehmen Erkenntnis: Die Kanäle, denen Marketingverantwortliche am meisten vertrauen, sind oft am wenigsten inkrementell. Markenspezifische Suche und Retargeting konvertieren hervorragend und sehen im Dashboard gut aus, gerade weil sie Nachfrage abgreifen, die ohnehin schon auf dem Weg zum Warenkorb war. Über 225 DTC-Geo-Tests hinweg erzielte die Markensuche einen mittleren inkrementellen ROAS von 0,70x, während der Spitzenreiter, Tatari CTV, 3,30x erreichte (Stella). Eine hohe Conversion-Rate kann also ein Symptom für geringe Inkrementalität sein, nicht der Beweis für eine hohe.
Nennen wir es den Unterschied zwischen Nachfrageerntung und Nachfragegenerierung. Erntung sammelt Absichten ein, die bereits existieren. Generierung schafft einen Verkauf, der sonst nicht stattgefunden hätte. Beides gehört in einen Mediaplan. Nur eines ist inkrementell.
Und die Auswertung ist nur so vertrauenswürdig wie die Kontrollgruppe, auf der sie basiert. Plattform-Experimente können den Effekt einer Anzeige unbemerkt mit dem Targeting des Algorithmus vermischen, da die Plattform jede Variante an eine eigene optimierte Nutzerschaft ausspielt – ein Bias, der in einer Studie des Journal of Marketing (Braun & Schwartz, 2025) dokumentiert wurde und sich mit intelligenteren Algorithmen noch verstärkt. Die Lösung ist ein echtes, randomisiertes kontrafaktisches Szenario: dieselbe Population, abzüglich der Anzeige. Das unterscheidet eine kausale Auswertung von einer schmeichelhaften Korrelation.
Wo Inkrementalität im Stack verortet ist
Kein einzelnes Modell ist die alleinige Quelle der Wahrheit. Attribution ist schnell und granular für die tägliche Optimierung. MMM liefert das strategische Gesamtbild. Inkrementalität ist der kausale Check, der beides kalibriert, die Annahmen des MMM schärft und die Attributionsdaten validiert. Die stärksten Programme nutzen alle drei und betrachten Diskrepanzen als Signal, nicht als Rauschen.
Doch die Ausrichtung auf Inkrementalität ist nur die halbe Miete. Der eigentliche Zweck des Tests ist nicht, Lift zu erzeugen, sondern aufzudecken, welche Platzierungen ihn verdient haben, damit Sie Budgets dorthin verlagern können. Hier scheitern die meisten Programme. 71 % der Werbetreibenden bezeichnen Inkrementalität als ihren wichtigsten Retail-Media-KPI, doch nur 15 % stufen sich selbst als sehr oder extrem effektiv bei der Messung ein (Skai, 2026). Die Lücke liegt meist nicht an der Methodik, sondern an der Disziplin, Gelder zu verschieben, sobald die Zahlen eine Position infrage stellen, die auf dem Papier gut aussah. Der von Plattformen gemeldete ROAS kann den wahren inkrementellen Einfluss bei Erntungskanälen wie Paid Social und Retargeting um 30 bis 60 % überbewerten (Measured). Das bedeutet: Die effizientesten Platzierungen sind oft diejenigen, die stillschweigend überfinanziert werden.
Warum Rokt für die Nachfragegenerierung gebaut ist
Rokt agiert im Transaction Moment, dem Zeitfenster zwischen Checkout und Bestätigung, wenn sich jemand gerade für einen Kauf entschieden hat. Strukturell ist das Nachfragegenerierung per Design. Der Käufer hat sich für einen Kauf entschieden, daher erreicht ein relevantes Angebot eines anderen Werbetreibenden jemanden, der gar nicht nach dieser Marke gesucht hat. Die Absicht des Käufers galt einem völlig anderen Produkt, daher gibt es für den Werbetreibenden, den wir einführen, keine bestehende Nachfrage, die man ernten könnte. Wir schaffen einen Moment der Überlegung, der sonst nicht existiert hätte.
Das Engagement ist dort hoch, mit einer durchschnittlichen CTR von 4,03 % (10x Google Display, 4x Facebook) und einer CVR von 6,32 %. Aber eine hohe Conversion ist genau die oben beschriebene Falle, daher behandeln wir sie als Symptom zum Testen, nicht als Beweis, dem man blind vertrauen sollte. Die strukturelle Position verschafft günstige Voraussetzungen, aber keinen Freifahrtschein – deshalb wird jede Platzierung gemessen. Und wir messen mit mehr als einer rigorosen Methode. Ghost Ads bieten eine Holdout-Gruppe auf Nutzerebene, bei der die Kontrollgruppe aus Personen besteht, die das Angebot gesehen hätten, das Targeting erfüllten, die Unterdrückung passierten und die Auktion gewonnen hätten, aber im letzten Schritt zufällig zurückgehalten wurden. So stammen Treatment- und Kontrollgruppe aus derselben berechtigten Population. Geo-basierte Lift-Tests, einschließlich der von Partnern wie Haus durchgeführten Matched-Market- und Synthetic-Control-Designs, vergleichen ganze Regionen und erfassen Offline- sowie Omnichannel-Effekte, die ein Test auf Nutzerebene übersehen kann. Unterschiedliche Designs, unterschiedliche Stärken. Was sie gemeinsam haben, ist eine echte, randomisierte Kontrolle – und wir nutzen beides.
Inkrementalität war nie ein Zeugnis, das am Ende des Quartals wartet. Es ist eine Entscheidung, die Sie jedes Mal treffen, wenn Sie festlegen, wo der nächste Dollar investiert wird.
Quellen
ANA Retail Media KPI Survey (2024); IAB x BWG Global State of Data 2026; Braun & Schwartz, „Where A/B Testing Goes Wrong“, Journal of Marketing (2025); Stella 2025 DTC Incrementality Benchmarks (225 Geo-Tests); Skai 2026 State of Retail Media Measurement; Measured (iROAS-Überbewertung); Rokt by the Numbers (2026).

.jpg)




