Dein Shop soll mehr Umsatz machen, nicht dein Team mehr Arbeit.
Ich betreibe dein A/B-Testing vollständig und mache aus dem Traffic, den du bereits hast, messbares Wachstum. Du gibst Ziele und Markenwissen vor. Ich finde die Umsatzhebel, baue die Tests und rolle aus, was sich bewiesen hat. Für qualifizierte Shops mit 10-%-ARPU-Garantie.
30 Minuten für Testvolumen, Stack und Garantie-Fit. Ein internes CRO-Team brauchst du dafür nicht.
A/B-Testing scheitert selten an den Ideen. Es scheitert daran, dass das Tagesgeschäft dazwischenkommt.
Research wird verschoben, Varianten warten auf Entwicklung, Tests laufen ohne sauberen Messplan, und Gewinner bleiben als Snippet live oder werden nie richtig ausgerollt. Jeder einzelne Bruch kostet erstmal nur Zeit. Zusammen kosten sie Umsatz.
Managed Testing gibt dem gesamten Prozess einen Verantwortlichen, nicht nur dem Test-Setup.
Ich halte den Betrieb am Laufen, du gibst die Richtung vor.
Bei mir
Bei mir liegen laufendes Research, das priorisierte Backlog, Testplanung, Entwicklung, QA, Launch, Monitoring, Auswertung, Rollout und das Learnings-Archiv.
Bei dir
Von dir kommen Geschäftsziele, wirtschaftliche Guardrails, Markenwissen, Zugänge und zeitnahe Freigaben.
Bevor der erste Test startet, steht fest, woran wir ihn messen.
Welche Datenquelle gilt, hängt von deinem Stack ab und wird vorher festgelegt. Voraussetzung ist, dass sie verlässlich misst. Deshalb steht am Anfang ein Tracking-Audit: Ein externer Partner nimmt dein GA4-Setup einmal komplett auseinander, bevor wir mit dem Testen anfangen. Auf einer kaputten Messung zu testen heißt, für Rauschen zu bezahlen.
Gemessen wird auf Bruttoumsatz. Retouren fließen nicht in die Garantie ein, und dafür gibt es einen technischen Grund: Um einen Retoureneffekt statistisch sauber zu messen, brauchst du deutlich mehr Traffic, als Shops in dieser Größenordnung haben. Wenn dein Volumen es hergibt, messe ich Retouren mit und zeige dir das Ergebnis. Für die 10 % zählt es nicht.
Der Uplift kommt nicht aus einem Vorher-Nachher-Vergleich deines Monatsumsatzes. Jeder Test hat sein eigenes Ergebnis, gemessen gegen seine eigene Kontrollvariante. Diese Einzelergebnisse multipliziere ich miteinander, und daraus ergibt sich der Gesamteffekt. Deshalb verzerren Saison, Sales oder ein neues Sortiment das Ergebnis nicht: Beide Varianten laufen zur selben Zeit unter denselben Bedingungen.
+10 % ARPU. Sonst arbeite ich ohne weitere Vergütung weiter.
Das Ziel steht nicht nur in einer Präsentation. Für qualifizierte Shops legen wir vor dem Start Baseline, Datenquelle und Messlogik fest. Kommen die ausgerollten Testgewinner im vereinbarten Zeitraum zusammen nicht auf mindestens 10 % ARPU-Uplift, führe ich den Testing-Betrieb im vereinbarten Umfang weiter, ohne dass du dafür bezahlst.
Vorher kläre ich, ob dein Testvolumen real ist, ob das Tracking verlässlich misst und wie Freigaben bei euch laufen. Dauerhaft ausgerollt wird nur, was sich als belastbarer Gewinner erwiesen hat. KPI, Baseline, Messzeitraum, Ausnahmen und der Umfang der Weiterarbeit stehen vorher schriftlich fest.
Die Garantie gilt ausschließlich im vollständig übernommenen Dienstleistungsmodell und für Shops, die alle vereinbarten Voraussetzungen erfüllen.
Vom Umsatzleck zum dauerhaft ausgerollten Gewinner
Finden
Ich verbinde Funnel-Daten, Kundenstimmen und Verhaltenssignale zu Hypothesen, sortiert nach erwartetem Umsatzeffekt.
- Funnel-Daten, Session-Recordings, Heatmaps und qualitative Signale
- KI-gestützte Analyse als Ergänzung zu Funnel-Daten und Kundenstimmen
- Fixierung der größten Umsatz-Lecks
- Beobachtung, Erwartung, Messgröße, jedes Mal
- Priorisierung nach geschätztem Uplift und technischem Aufwand
- Backlog in deinem Tool, damit du jederzeit den Überblick hast
Ein Backlog, das sagt, welche Tests als Nächstes laufen und warum.
Beweisen
Jeder Test startet mit Zielmetrik, Stichprobe, Laufzeit und Entscheidungsregel. Danach baue, prüfe und überwache ich die Varianten.
- Statistische Planung nach deinen echten Shop-Zahlen
- Zielmetrik, Guardrails und Mindesteffekt stehen vor dem Start fest, meist ARPU oder Deckungsbeitrag
- Abbruchkriterien, bevor der Test startet
- Varianten in deinem Theme, Testing-Tool oder Repo
- QA-Checkliste: Flicker, Mobile, Edge Cases, Datenqualität
- Kein Test startet, bevor Funktion, Darstellung und Messung geprüft sind
- Launch-Routine mit Smoke-Test und Datenqualitäts-Kontrolle
- Monitoring auf SRM, Ausreißer und kaputte Varianten
- Regelmäßige Updates über Test-Status
Ein Testaufbau, der bei deinem Traffic und deiner Zielmetrik funktioniert und sauber überwacht wird.
Sichern
Gewinner implementiere ich sauber, und alle Ergebnisse fließen in die nächsten Tests ein.
- Klare Empfehlung: Rollout, Iteration oder Verwerfen
- Übergabe-Dokumentation für jeden Schritt
- Neutrale und negative Ergebnisse werden zu dokumentierten Learnings, nicht zu stillen Abbrüchen
Ein wachsendes System, aus Ergebnissen und Wissen, nicht nur einzelne Tests.
Mehr valide Umsatzentscheidungen, weniger operative Last
Dein bestehender Traffic wird effizienter monetarisiert, dein Umsatz pro Besucher steigt.
Relevante Änderungen zeigen ihre Wirkung, bevor sie vollständig live gehen.
Research, Entwicklung, Statistik und Auswertung kommen aus einer Hand. Du musst dafür niemanden einstellen.
Hypothese, Setup, Ergebnis und Entscheidung bleiben jederzeit nachvollziehbar. Keine Blackbox.
Research, Code und Auswertung kommen von derselben Person.
Kurz dazu, was du hier einkaufst: meine Arbeitszeit und mein Urteil. Es gibt keine vier Ansprechpartner dazwischen.
Du sprichst direkt mit Nicolai. Kein Sales-Handover, keine Übersetzungsschleife zwischen Strategie, Entwicklung und Auswertung.
- Wer den Test plant, baut ihn auch und wertet ihn aus.
- Ziele und Freigaben bleiben bei dir, der laufende Betrieb liegt bei mir.

Der Service passt, wenn dein Shop genug Daten liefert und dein Team schnell genug entscheiden kann.
Konkret heißt das: Shopify-D2C, genug Sessions und Conversions für laufende Tests, verlässliche Umsatzmessung, Zugang zu Shop und Analytics, feste Freigabewege und Shopflächen, auf denen sich Tests überhaupt lohnen.
Reicht das Volumen nicht, empfehle ich kein A/B-Testing auf Verdacht.
Lass uns prüfen, ob dein Traffic den Service trägt.
Du bekommst eine klare Einschätzung zu Testvolumen, größtem sichtbaren Hebel, realistischer Startgeschwindigkeit und Garantiebedingungen.
Häufig gestellte Fragen.
Übernimmst du das Testing wirklich vollständig?+
Ja. Research, Priorisierung, Testdesign, Entwicklung, QA, Monitoring, Auswertung und Rollout laufen bei mir. Du gibst Ziele, Zugänge und Freigaben. Nur wenn du externe Durchführung grundsätzlich ausschließt, implementiere ich den Prozess stattdessen in deinem Team.
Ich habe noch nie A/B-Testing gemacht. Passt das trotzdem?+
Ja, das ist genau der Ausgangspunkt, für den ich den Service aufgebaut habe. Ich plane das System so, dass es zu deinem Traffic, deinem Team und deinem Stack passt, und betreibe es dauerhaft für dich.
Was passiert, wenn ich später alles intern machen will?+
Das ist bewusst vorgesehen. Jeder Schritt wird dokumentiert, und du kannst Module einzeln übernehmen: Research, Umsetzung oder Auswertung getrennt.
Reicht mein Traffic für Managed A/B-Testing?+
Als schnellen Filter nutze ich 200.000 € Monatsumsatz. Das eigentliche Kriterium ist aber das Testvolumen: Sessions, Conversions, Baseline, gewünschter Mindesteffekt, Testfläche und realistische Laufzeit. Diese Werte rechne ich vor einer Zusammenarbeit mit deinen Zahlen durch. Reicht das Volumen nicht, sage ich es klar, auch wenn dein Umsatz über der Schwelle liegt.
Was kostet der Managed Service?+
Es gibt keine öffentlichen Preise, weil jedes Setup unterschiedlich komplex ist. Im Erstgespräch bekommst du eine transparente Einschätzung, ohne versteckte Kosten.
Wie lange dauert es, bis der erste Test läuft?+
Das hängt an Tracking, Zugängen und Freigabewegen. Im Erstgespräch rechne ich dir eine realistische Startgeschwindigkeit für deinen Shop vor, statt eine Standardzahl zu nennen.
Was passiert mit Tests, die verlieren?+
Sie werden zurückgebaut und ausgewertet. Ein Verlierer sagt dir, was deine Kunden nicht bewegt, und macht die nächste Hypothese präziser. Live geht nur, was sich als Gewinner erwiesen hat.
Müssen wir neue Tools kaufen?+
Nur wenn dein bestehender Stack eine relevante Lücke hat. Zuerst prüfe ich Auslieferung, Analytics, Umsatzmessung, Consent und Dokumentation. Die Toolwahl folgt dem Bedarf.
Was passiert mit laufenden Tests, wenn die Hochsaison beginnt?+
Sie laufen weiter. Ein Test misst den relativen Unterschied zwischen zwei Varianten, und der bleibt aussagekräftig, auch wenn insgesamt mehr Leute im Shop sind. Es gibt bei mir keine Deadline, ab der vor Q4 nichts Neues mehr startet. Im Gegenteil: Wenn der Traffic es hergibt, fahren wir während Sales und Aktionen zusätzliche Tests, die genau auf diese Situation zugeschnitten sind.
Wer bekommt Zugriff auf meinen Shop?+
Ich brauche Zugang zu den Systemen, aus denen die Entscheidung kommt: Shopify, dein Analytics, das Testing-Tool und, falls vorhanden, Session-Recording. Welche das genau sind, hängt von deinem Stack ab. Am Shop arbeite ich selbst. Für das Tracking-Audit arbeite ich mit einem festen externen Partner zusammen. Kommen weitere Dienstleister dazu, findest du sie in der Liste der Unterauftragsverarbeiter. Einen Auftragsverarbeitungsvertrag gibt es, und wenn du ein NDA vorlegst, unterschreibe ich es.
Was passiert mit den Gewinnern, wenn wir die Zusammenarbeit beenden?+
Sie bleiben. Ausgerollte Gewinner liegen als wartbarer Code in deinem Theme und gehören dir, nicht einem Testing-Tool und nicht mir. Auf das Dashboard mit allen Tests, Ergebnissen und Learnings behältst du weiterhin Zugriff. Was ich behalte, sind die methodischen Erkenntnisse für meine eigene Arbeit, also was in dieser Art von Shop funktioniert. Deine Zahlen und deine Umsetzung bleiben bei dir.
Ich bin nicht der Geschäftsführer. Was brauche ich, um das intern durchzubekommen?+
Du bekommst monatlich einen Bericht und dauerhaft Zugriff auf ein Dashboard, in dem jeder Test, jedes Ergebnis und jede Entscheidung dokumentiert ist. Beides ist so aufbereitet, dass du es weiterreichen kannst, ohne es vorher übersetzen zu müssen. Wenn es hilft, komme ich in ein Gespräch mit Geschäftsführung oder Finanzverantwortlichen dazu. Was ich von euch brauche, ist ein fester Ansprechpartner, sonst hängen Freigaben und der Testing-Rhythmus bricht.
Was, wenn ich mit einem Ergebnis nicht einverstanden bin?+
Dann wird nicht ausgerollt. Die Entscheidung liegt bei dir, ohne Diskussion. In der Praxis kommt das selten vor, weil die Entscheidung an den Zahlen hängt und nicht am Geschmack. Genau dafür ist Testing da: weg vom Bauchgefühl, hin zu einer Entscheidung, die du begründen kannst.