Kurz gesagt: Der Test von fünf Diensten zur Suche nach Social-Media-Werbung zeigt, wie stark die Anbindung eines KI-Agenten das Ergebnis beeinflusst. Im August 2026 ließ „Yellow Web“ einen Agenten iGaming-Werbung – Online-Casinos, Sportwetten und Lotterien – für Spanien suchen: für den 01.08.2026 und für die Woche vom 26.07. bis zum 01.08.2026. Der Agent sollte bei Spytrend, Tyver, AdWall, Gamler und MTWSPY jeweils die ersten hundert Anzeigen pro Zeitraum holen und vergleichen. Der Autor hat seine Werkzeuge veröffentlicht; der Test lässt sich damit wiederholen. Originaltest: „Fünf Spy-Tools aus Sicht eines KI-Agenten“.

Wir sind das Team von Spytrend, einem der fünf getesteten Dienste. Wir haben dieselben Anzeigenstichproben mit derselben Suche geprüft und zeigen beide Durchläufe: das Ergebnis des Agenten im Test und das Ergebnis mit den regulären Filtern des Dienstes. Einen Teil der Zahlen bestätigen wir. Andere Abweichungen liegen daran, wie der Agent die Daten abgefragt hat, und nicht am Umfang der Datenbank. Für die Arbeit mit KI-Suche ist das der zentrale Befund: Entscheidend ist die Anbindung des Agenten an die Daten. Skript und beide Exporte liegen offen, sodass Sie die Zahlen selbst prüfen können.

Gennadi, CEO von Spytrend · veröffentlicht am 12. September 2026 · Grundlage der Nachprüfung: Karten des Autors, Serverlogs und erneute Abfrage

Welche Dienste wurden verglichen?

  • Spytrend (das sind wir) – Plattform für Wettbewerbsanalyse von Facebook- und TikTok-Werbung: rund 1,8 Milliarden Anzeigen, rund 280 Millionen neue pro Monat, Einordnung in 33 Kategorien und 342 Unterkategorien sowie eine offizielle Anbindung für KI-Agenten. Der Pro-Tarif kostet 79 USD pro Monat.
  • Tyver – Spy-Tool mit Einordnung in mehrere breite Verticals und Sortierung nach Aufrufen; im Test lieferte es für die Woche 11.497 Anzeigen.
  • AdWall – Spy-Tool mit 30 Tagen kostenlosem Zugang; im Test lieferte es für die Woche 16.369 Anzeigen. Von den ersten hundert Dateien waren 73 themenfremd.
  • Gamler – spezialisierter Dienst mit eigenem Klassifikator und Zähler für erneute Uploads; als einziger lieferte er im Test keine themenfremden Anzeigen, allerdings eine deutlich kleinere Ergebnismenge.
  • MTWSPY – spezialisierter Dienst mit eigenem Klassifikator und Sortierung nach Aufrufen; in der Wochenausgabe waren 13 % themenfremd. Beschreibungen der Dienste anhand ihrer Websites mit Stand September 2026 abgeglichen (Tyver, AdWall, Gamler, MTWSPY); die Zahlen stammen aus dem Test von „Gelbes Web“ (August 2026).

Wer in dieser Auswertung welche Rolle hat

  • Autor – der Autor von „Yellow Web“, der den Test entworfen und durchgeführt hat.
  • Agent – der KI-Agent, dem der Autor die Aufgabe übergab, statt selbst zu suchen. Das Programm stellte eigenständig Anfragen an alle fünf Dienste und sammelte die Ergebnisse.
  • Zwischenschicht – eine selbst gebaute Kommandozeilen-Anwendung zwischen Agent und Diensten. Sie nahm Befehle des Agenten entgegen und machte daraus Anfragen. Was sie nicht weitergab, konnte der Agent nicht sehen.
  • Messung – die Zahlen, die der Agent im Test erhielt.
  • Erneuter Durchlauf – dieselbe Suche, die wir auf denselben Daten mit den regulären Einstellungen des Dienstes wiederholt haben.
  • Reguläre Einstellungen – die Funktionsweise des Dienstes mit den Filtern, die im Test ausgeschaltet blieben.
  • Karten des Autors – genau die Anzeigenstichproben, die der Agent im Test geholt hat. Wir haben mit denselben Karten gearbeitet, damit die Zahlen vergleichbar sind.

So haben wir nachgeprüft

Eine Messung ist belastbar, wenn sie sich wiederholen lässt. Wir haben dieselbe Suche auf denselben Karten des Autors ausgeführt. Wo die Bedingungen übereinstimmten, übernehmen wir seine Zahlen. Wo sie von den regulären Einstellungen abwichen, stellen wir beide Durchläufe gegenüber und nennen die Änderung. Jeder Punkt folgt demselben Ablauf: Ergebnis der Messung → Ursache → Ergebnis des erneuten Durchlaufs.

Was diese Nachprüfung nicht zeigt.

  • Der Test verglich jeweils die ersten hundert Suchergebnisse. Das sind 3,2 % unseres Tagesvolumens und 0,4 % unseres Wochenvolumens. Daraus lässt sich die Überschneidung ganzer Datenbanken nicht beurteilen.
  • Der Autor bestimmte den Anteil relevanter Werbung anhand von hundert Karten. Die Übertragung dieses Anteils auf das Gesamtvolumen ist eine Schätzung.

Das Wichtigste

Drei der sechs Abweichungen erklären sich durch die Abfragen des Agenten, nicht durch den Inhalt der Datenbank. Den Quotenverbrauch bestätigen wir. Beim Funktionsumfang der Suche fällt der Vergleich nach der Matrix des Tests zu unseren Gunsten aus.

  • Umfang der Ergebnisse. Der Agent holte für den 1. August 996 Anzeigen aus Spytrend, für die Woche 9.526. Zum selben Suchauftrag lagen 3.112 beziehungsweise 24.985 in der Datenbank. → Details
  • Duplikate. Im Test blieb der Schalter „Nur eindeutige“ aus. Er fasst Kopien desselben Creatives – desselben Bildes oder Videos einer Anzeige – in einer Zeile zusammen. Ohne ihn blieben unter hundert Karten 55 verschiedene Dateien. Mit ihm ergeben dieselben Daten 100 verschiedene Creatives aus 100. → Details
  • Anbindung des KI-Agenten. Im Test kam unser Agentenserver über MCP (Model Context Protocol, die offizielle direkte Anbindung eines KI-Agenten an den Dienst) auf 0 erfolgreiche Aufrufe von 8 und 179 Sekunden Antwortzeit. Unsere Logs für dieselbe Sitzung des Autors am 3. August zeigen 43 erfolgreiche Aufrufe von 43, keine Fehler und durchschnittlich 1,6 Sekunden. Die selbst gebaute Zwischenschicht startete für jede Anfrage eine neue Agentensitzung. → Details
  • Suchfunktionen. Im Test von „Gelbes Web“ (August 2026) ist die Suche nach visueller Ähnlichkeit des Creatives und nach Facebook-Pixel – einem Zähler, den Werbetreibende auf ihrer Website einbinden – nur bei Spytrend vermerkt; eine Suche nach einem Ausschnitt des Tracking-Links und nach dem Netzwerk eines Webmasters mit allen Domains, Seiten und Pixeln eines Players ist in der Vergleichstabelle des Tests nicht aufgeführt. → Details
  • Kosten des Tests. Der gesamte Test verbrauchte 201 Token. Das sind interne Quoteneinheiten von Spytrend, keine Token eines Sprachmodells. Bei 40.000 Einheiten Monatsquote im Pro-Tarif ist das ein halbes Prozent. → Details
  • Geo-Filter. Fast drei Viertel der Ergebnisse für Spanien waren Multi-Geo-Anzeigen: Sie liefen in mehreren Ländern, darunter Spanien. Der Agent des Autors wertete sie als Treffer außerhalb Spaniens, obwohl sie im Spanien-Filter richtig stehen. In einer neuen Abfrage desselben Ausschnitts gab es keine Fehlzuordnungen.

Wir danken dem Autor von „Yellow Web“ für den ausführlichen Test und die offenen Werkzeuge. Es folgen alle acht Punkte: die Messung, ihre Ursache und der erneute Durchlauf mit regulären Einstellungen.

Fünf zentrale Aussagen des Tests – und das Ergebnis der Nachprüfung

Aussage des Tests Nachprüfung
MCP funktioniert nicht: 0 von 8 43/43; Ø 1,6 s → 6
Von hundert blieben 55 verschiedene Dateien 55; mit Filter 100 → 4
Die Datenbanken überschneiden sich kaum Nur erste 100 → 5
996 Anzeigen an einem Tag Datenbank: 3.112 → 2
Fünf Lücken in der Filtermatrix Zwei Kreuze falsch; im Test (August 2026) ist die Suche nach visueller Ähnlichkeit und nach Pixel nur bei Spytrend vermerkt → 1

Acht strittige Punkte des Tests und das Ergebnis der Nachprüfung

Punkt Ergebnis
1. Filter und Creative-Suche Im Test (August 2026) ist die Suche nach visueller Ähnlichkeit des Creatives und nach Pixel nur bei Spytrend vermerkt
2. Datenumfang für dieselben Daten Agent: 996; DB: 3.112
3. Relevanz der Ergebnisse 96 % laut Autor
4. Hundert Creatives ohne Wiederholung Sammel-Einstellung
5. Überschneidung der Datenbanken So nicht messbar
6. Anbindung des KI-Agenten Ein Server, zwei Namen
7. Quotenverbrauch 201 Token; 0,5 %
8. Ergebnis für Media Buyer Mehr relevante Anzeigen

So lief der Test – und was an der Methode gut war

Ein öffentlicher Vergleich von fünf Diensten mit derselben Aufgabe ist selten. Dieser Test war sorgfältiger angelegt als viele Reviews der Branche.

Der Aufbau: derselbe Suchauftrag nach iGaming-Werbung in Spanien an alle fünf Dienste, jeweils für den 1. August und die Woche vom 26. Juli bis zum 1. August. Der Agent holte pro Dienst und Zeitraum die ersten hundert Karten und lud die Mediendateien herunter. Strittige Anzeigen prüfte er durch vollständiges Ansehen; Dateiüberschneidungen zwischen Diensten zählte er mit zwei Arten von Hashes. Diese Teile der Methode sind besonders stark:

  • Zwei Hash-Verfahren statt eines. Übereinstimmungen wurden per SHA-256, der Prüfsumme einer Datei, und zusätzlich per PDQ und vPDQ als wahrnehmungsbasierten Hashes für Bilder und Videos ermittelt. Der zweite Schritt erkennt komprimierte oder beschnittene Kopien, die ein Bytevergleich übersieht.
  • Getrennte Zählung. Karten, heruntergeladene Dateien und visuelle Versionen eines Creatives wurden getrennt gezählt. So wurde überhaupt sichtbar, dass „hundert Karten“ und „hundert Creatives“ verschiedene Zahlen sind.
  • Strittige Videos sah der Agent vollständig an. Die Relevanz wurde durch Anschauen geprüft, weder anhand des Dateinamens noch anhand des Anzeigentextes. Jede eindeutige Datei ordnete der KI-Agent des Autors als relevant, irrelevant oder strittig ein. In unserer Wochenstichprobe waren vier Dateien themenfremd. Daraus stammen die 4 %: aus der Sichtprüfung, nicht aus einer groben Einschätzung.
  • Offene Werkzeuge und ein klarer Rahmen. Der Autor veröffentlichte seine Zwischenschicht zwischen Agent und Diensten und schrieb ausdrücklich, dass es in diesem Test keinen universellen Sieger gebe. Ein Suchauftrag, dieselben Daten und dasselbe Land für alle fünf Dienste machen eine Neuberechnung möglich. Wir haben sie durchgeführt – und sie ergibt ein anderes Bild als die Abschlusstabelle des Tests.

Was sich bestätigt hat

Was der Test bestätigt hat

Zuerst die Ergebnisse, die wir wiederholt und mit denselben Zahlen erhalten haben. Sie sind keine Einschränkung vor unseren Einwänden, sondern reproduzierbare Befunde.

  • Multi-Geo in den Ergebnissen. Anzeigen laufen häufig in mehreren Ländern zugleich, darunter Spanien. Der Agent des Autors ordnete solche Karten als nicht zu Spanien gehörig ein. In einer aktuellen Abfrage desselben Ausschnitts gibt es keine Fehlzuordnungen.
  • 55 verschiedene Dateien aus hundert stimmen bei der Sortierung nach Aufrufen, mit der der Agent die Ergebnisse holte. Auf den Karten des Autors kamen wir ebenfalls auf 55 für die Woche und 87 für den Tag. Der Filter für eindeutige Creatives war im Test ausgeschaltet; ohne ihn ist das Ergebnis genau so.
  • Der Test verbrauchte mehr Quote. 201 Einheiten gegenüber 42 bei Tyver. Damals berechneten wir das Herunterladen von Medien; der Agent lud 200 Dateien herunter.
  • Themenfremde Ergebnisse gibt es. Die 4 % irrelevanten Karten für die Woche stammen aus der Kennzeichnung im Test: Der Agent des Autors sah jede Datei an.
  • Über die selbst gebaute Zwischenschicht funktionierte MCP tatsächlich nicht. Acht Aufrufe, acht Fehler. Was zugleich in den Serverlogs stand, folgt in Punkt 6.

1. Filter und Suche

Zwei Lücken in der Matrix waren falsch; die besonderen Filter der Konkurrenz gab es bei uns schon im Test: vom Creative zum Webmaster-Netzwerk

Aus dem Test von „Yellow Web“

„Filternamen erzeugen manchmal ein falsches Gefühl von Einheitlichkeit. Die Kategorie bei Spytrend, das Vertical bei Tyver und die Nische bei Gamler und MTWSPY beruhen jeweils auf eigenen Klassifikatoren.“

In der Matrix fehlen Spytrend fünf Einträge. Cloaking, erneute Uploads und die Trennung von Gambling und Betting hebt der Autor als Funktionen anderer Dienste hervor.

Ausschnitt aus der Untersuchung von „Yellow Web“

Ausschnitt aus dem Artikel von „Yellow Web“ · Originaluntersuchung öffnen

Was die Messung zeigte. In der Vergleichstabelle der Suchfunktionen haben wir fünf leere Felder: letzte Aktivität, App-ID und Store, Geschlecht und Alter, Impressions / Reach / Views sowie Lead-Formulare. Cloaking, erneute Uploads und die getrennte Suche nach Gambling und Betting führte die Tabelle als Besonderheiten anderer Dienste auf. Sie waren zur Testzeit auch in Spytrend vorhanden, nur anders benannt: Eine Cloaking-Seite lässt sich über den Tab „Cloaked“ und den Schalter „Nur maskierte“ auswählen. Die Schaltfläche „Am häufigsten neu hochgeladen“ zeigt wiederholt gestartete Creatives; ihr Umfang steht auf der Karte. Für Gambling und Betting gibt es acht getrennte Unterkategorien.

Warum das geschah. Zwei der fünf leeren Felder waren falsch: Den Filter für die letzte Aktivität gab es während des Tests, ebenso die App-Suche. Ein eigenes Feld nimmt App-ID, Namen oder Link entgegen; daneben wird der Store gewählt. Der Agent sah sie aus demselben Grund nicht wie „Nur eindeutige“: Der Server liefert das Filterschema, doch die selbst gebaute Zwischenschicht gab diese Ebene nicht weiter. Geschlecht und Alter zeigen wir bewusst nicht als Filter: Facebook liefert dazu eigene Schätzwerte. Impressions für kommerzielle Werbung stellt Facebook nicht bereit. Einen Filter für Lead-Form-Anzeigen haben wir tatsächlich nicht. Die acht Unterkategorien heißen Online Casino Slots, Sportsbook, Crash and Plinko, Poker, Lottery, Esports Betting, Fantasy Sports und State Restricted Operators.

Was der Autor erwähnte, aber nicht in die Matrix aufnahm. Die Suche nach visueller Ähnlichkeit eines Creatives und nach einem Facebook-Pixel erwähnte er in der Untersuchung; beides ist auch in der Grafik zu sehen. Zwei weitere Funktionen fehlen in der Matrix ganz: die Suche nach einem Ausschnitt des Tracking-Links und der Wechsel zum Webmaster-Netzwerk. Von einem Creative aus lassen sich dort Domains, Pixel und Fanpages – Facebook-Seiten, in deren Namen Werbung läuft – eines Players aufrufen. Dieser Arbeitsschritt eines Media Buyers steht nicht in der Vergleichstabelle.

Was Spytrend-Filter finden können Im Suchtest geprüft: Filter gelten auch für die TrefferBei SpytrendIn Studie markiertCloaking-IndizienAnzahl Creative-ReuploadsGambling und Betting separatAnzahl Seiten-LikesApp ID über Hubs & TrendsSuche nach ähnlichen CreativesSuche nach Facebook-PixelSuche nach Tracking-URL-FragmentWebmaster-NetzeIm Yellow-Web-Test (August 2026) ist die Suche nach visueller Ähnlichkeit und nach Pixel nur bei Spytrend vermerkt.

Was unverändert bleibt. Geschlecht, Alter und ein Impressions-Bereich lassen sich in Spytrend nicht filtern. Die Datenlage zu Impressions kommerzieller Werbung erläutern wir in Punkt 4.

Neu im September

Die echte Seite hinter dem Cloaking lässt sich für 1 $ aufdecken

Früher endete die Prüfung beim weißen Landingpage-Inhalt: Er war sichtbar, doch was der Wettbewerber dahinter tatsächlich ausspielte, blieb offen. Jetzt gibt es auf der Creative-Karte im Bereich „Ads“ eine Schaltfläche. Spytrend ruft die schwarze Version der Seite auf, durchläuft den Funnel samt Weiterleitungen, installiert und startet eine App, falls der Funnel zu einer PWA oder APK führt – einer Web-App oder einer Android-Installationsdatei – und ermittelt die Marke des Betreibers, etwa eines Casinos oder Buchmachers.

Im Account erscheint ein Bericht über die gesamte Kette: Bilder jedes Schritts, das Ziel und das Ergebnis. Die gewünschte Landingpage lässt sich als ein Archiv herunterladen. Was Sie anschließend mit Landingpages von Wettbewerbern machen können, steht in der Analyse von Websites und Landingpages in Spytrend. Der Preis beträgt 1 $ pro Start in jedem Tarif. Wenn es nicht funktioniert, wird das Geld zurückerstattet.

Ergebnis des erneuten Durchlaufs: Im Test von „Gelbes Web“ (August 2026) ist die Suche nach visueller Ähnlichkeit des Creatives und nach Facebook-Pixel nur bei Spytrend vermerkt; eine Suche nach einem Ausschnitt des Tracking-Links und nach dem Webmaster-Netzwerk ist in der Testmatrix nicht aufgeführt. Drei der fünf vermeintlichen Lücken waren während des Tests bereits unter anderen Namen im Dienst vorhanden. Seit September lässt sich außerdem die Marke hinter dem Cloaking aufdecken – für 1 $ pro Start in jedem Tarif.

2. Datenumfang

996 Anzeigen waren die Stichprobe des Agenten: Für denselben Tag lagen 3.112 in der Datenbank

Aus dem Test von „Yellow Web“

„Spytrend, Tyver und AdWall hatten deutlich mehr Anzeigen. Eine große Zahl sagt für sich genommen aber wenig über die Qualität.“

Die Grafik zeigt für Spytrend 996 am 1. August und 9.526 für die Woche.

Ausschnitt aus der Untersuchung von „Yellow Web“

Ausschnitt aus dem Artikel von „Yellow Web“ · Originaluntersuchung öffnen

Was die Messung zeigte. Für den 1. August holte der Agent 996 Anzeigen aus Spytrend; für die Woche vom 26. Juli bis zum 1. August waren es 9.526.

Warum das geschah. Zum Zeitpunkt des Tests lagen für dieselbe Suchanfrage 3.112 beziehungsweise 24.985 Anzeigen in der Datenbank. Die Differenz entstand durch die Abfrage, nicht durch den Datenumfang. Das Sammeln stoppte bei hundert Karten pro Zeitraum und ging nicht weiter. Für diese Anfragen zeigen unsere Serverlogs weder Fehler noch Ablehnungen oder eine erschöpfte Quote.

Wie viele Ads blieben außerhalb der Messung? Logarithmische Skala1k5k10k20k1. Aug.9963 1124 07226. Jul – 1. Aug.9 52624 98529 150Agent im Test fanddamals im BestandaktuellErfassung stoppte vor der Bestandsgrenze: Für dieselben Daten hatten wir dreimal so viele Ads. Seitdem haben wirdie Historie weiter erfasst – heute sind es mehr.

Erneuter Durchlauf. Wir ergänzen laufend Werbung für vergangene Daten: Wenn wir eine weitere Fanpage, Domain oder ein Webmaster-Netzwerk finden, kommen deren Anzeigen zu den Ergebnissen hinzu. Deshalb wächst selbst eine vergangene Woche noch einen Monat später. Bei der Messung am 11. September 2026 enthielt die Datenbank 4.072 Anzeigen für den 1. August und 29.150 für dieselbe Woche.

Was das für Ihre Arbeit bedeutet. Angenommen, Sie haben vor einem Monat eine laufende Kombination aus Creative, Seite und Domain gefunden. Wenn Sie sie jetzt erneut prüfen, können für dieselben Daten weitere Anzeigen und Verbindungen in der Datenbank stehen. So sehen Sie, wie der Player die Kombination gestartet und skaliert hat.

Ergebnis des erneuten Durchlaufs: Der Agent holte 996 Anzeigen für den Tag; für dasselbe Datum lagen 3.112 in der Datenbank. Die Differenz entstand durch die Sammel-Einstellung, die bei hundert Karten pro Zeitraum stoppte.

3. Relevanz der Ergebnisse

96 % der Wochenergebnisse von Spytrend betrafen iGaming – gemessen vom Autor selbst

Aus dem Test von „Yellow Web“

„Die Tagesstichproben von Spytrend und MTWSPY waren ebenfalls sauber. Für die Woche kamen bei MTWSPY 13 % Ausschuss heraus, bei Spytrend 4 %.“

„Bei Tyver hängt die Qualität stark von Zeitraum und Sortierung ab. An einem Tag gab es nur 3 % Ausschuss, für die Woche schon 44 %.“ „AdWall lieferte 73 irrelevante Dateien von 100.“

Ausschnitt aus der Untersuchung von „Yellow Web“

Ausschnitt aus dem Artikel von „Yellow Web“ · Originaluntersuchung öffnen

Was die Messung zeigte. Der Autor prüfte, welcher Anteil der Karten tatsächlich zu iGaming gehörte. Sein KI-Agent ordnete jede eindeutige Datei als relevant, irrelevant oder strittig ein und sah strittige Videos vollständig an. Bei uns waren für die Woche 4 % irrelevant; die Tagesstichprobe war sauber.

Was daraus folgt. Je weniger themenfremde Treffer in den Ergebnissen stehen, desto mehr Zeit bleibt für die Analyse der Creatives. Wir übertragen den Anteil relevanter Karten aus der Stichprobe des Autors auf die Anzeigenmengen und vergleichen die so geschätzte Zahl relevanter Anzeigen pro Dienst.

Wie viele iGaming-Ads nach dem Filtern? Schätzung 26.07–01.08: Volumen nach Test-Ausschuss010k20k30kSpytrend27 984Tyver6 438AdWall4 420Gamler849MTWSPY435Ausschuss im Test: Spytrend 4%, Tyver 44%, AdWall 73%, Gamler 0%, MTWSPY 13%. Spytrend-Bestand am 11.09.2026: 27 984;bei den anderen: Zahlen aus dem Artikel. Zum Vergleich am Testtag: 23 986.

Bei MTWSPY stoppte der Agent das Sammeln im Test nach mehr als 500 Karten, um die Quote nicht aufzubrauchen. Die Zahl 435 bezieht sich auf diese Stichprobe, nicht auf die Datenbank.

So wurde gerechnet. Bei AdWall setzen wir 27 % relevante Karten für 16.369 Karten an, bei Tyver 56 % für 11.497. Beide Mengen stammen aus der Grafik von „Yellow Web“; wir haben sie nicht neu gezählt. Bei Gamler fand sich kein Ausschuss, doch die Ergebnismenge war um eine Größenordnung kleiner. Spytrend hatte zum Testzeitpunkt 24.985 Anzeigen für diese Woche in der Datenbank. 96 % davon ergeben 23.986 relevante Anzeigen – eine mit den anderen Diensten vergleichbare Zahl. Die Grafik oben nutzt den Umfang der erneuten Messung vom 11. September 2026: 29.150 Anzeigen und geschätzte 27.984 relevante. Das ist eine Schätzung, keine vollständige Neuauszählung. Der relevante Anteil wurde an hundert Karten gemessen und auf die Gesamtmenge übertragen. Eine exakte Zahl würde die Prüfung aller Anzeigen verlangen.

Ergebnis des erneuten Durchlaufs: 96 % der Wochenergebnisse von Spytrend betrafen iGaming; diesen Anteil maß der Autor selbst. Nach dieser Rechnung gab es bei uns für die Woche mehr relevante Werbung als bei den vier anderen Diensten zusammen.

4. Duplikate und eindeutige Creatives

Die Duplikate kamen durch die Sammel-Einstellung zustande: Mit Filter sind 100 von 100 Creatives verschieden

Aus dem Test von „Yellow Web“

„Die meisten Duplikate fand ich bei Spytrend für die Woche: Eine Datei kam in 28 Karten vor, von hundert blieben 55 verschiedene Dateien.“

Gemessen wurde mit einer Sortierung nach Aufrufen: „Tyver, Spytrend und MTWSPY können Ergebnisse nach Aufrufen sortieren.“

Ausschnitt aus der Untersuchung von „Yellow Web“

Ausschnitt aus dem Artikel von „Yellow Web“ · Originaluntersuchung öffnen

Was die Messung zeigte. Auf den Karten des Autors erhielten wir ebenfalls 55 eindeutige Dateien für die Woche und 87 für den Tag. Das Ergebnis ist reproduzierbar.

Warum das geschah. Der Agent sammelte nach Aufrufen sortierte Ergebnisse und schaltete den Filter für eindeutige Creatives nicht ein. Die Sortierung brachte Anzeigen aus den frühesten Tagen der Woche nach vorn. Bis dahin waren sie bereits von verschiedenen Fanpages aus neu gestartet worden; ein Creative belegte 28 der hundert Karten.

Welche Tage in den ersten 100? Woche 26.07–01.08: Startdaten der ersten 100 Ads025507510026. Jul327. Jul97228. Jul2929. Jul3330. Jul2031. Jul11. Aug.10015nach Views (wie im Test)DatumSpytrend-PopularitätsrankingNach Datum: neue Ads. Nach Views: nur die zwei ältesten Tage im Test. Unser Ranking deckt verschiedeneWochentage.

Analyse des Spytrend-Teams

Die Sortierung „nach Aufrufen“ liefert keine Topliste für Gambling – die Daten fehlen

In der Dokumentation der Ad Library API, der Programmierschnittstelle der Facebook-Werbebibliothek, ist das Feld impressions mit „Available only for POLITICAL_AND_ISSUE_ADS“ gekennzeichnet. Es ist also nur für politische und gesellschaftliche Werbung verfügbar – und dort lediglich in Bereichen von „unter 1.000“ bis „über 1 Million“. Das lässt sich in der offiziellen Beschreibung des Anzeigenobjekts bei Facebook prüfen.

Für europäische Werbung gibt es eu_total_reach, einen geschätzten Wert dafür, wie viele Menschen eine Anzeige während ihrer gesamten Laufzeit in Europa gesehen haben. Auch dieser Gesamtwert weist aber nicht das beste Creative aus: Eine länger laufende Anzeige hatte schlicht mehr Zeit, Reichweite zu sammeln.

Entscheidend ist außerdem, dass Facebook jeden Start getrennt zählt. Läuft dasselbe Creative über fünf verschiedene Accounts, sind das für Facebook fünf verschiedene Creatives mit jeweils eigenen Werten. Die Plattform erkennt dabei nicht, dass das Bild identisch ist.

Spytrend führt solche Uploads anhand der Ähnlichkeit des Bildes oder Videos zusammen. Dadurch wird sichtbar, wie oft dasselbe Creative tatsächlich erneut hochgeladen wurde. Die Zahl der erneuten Uploads wird weder zu einem Bereich gerundet noch geht sie beim nächsten Upload verloren. Die Zahl erneuter Uploads ist deshalb ein Signal: Meist wird das häufig erneut hochgeladen, was sich rechnet. Wie sich damit ein anziehender Trend erkennen lässt, zeigt die Analyse von Trends und erneut hochgeladenen Creatives.

Erneuter Durchlauf am 11. September 2026. Der Schalter „Nur eindeutige“ in der ersten Filterzeile fasst alle Kopien eines Creatives in einer Zeile zusammen. Auf denselben Karten erhalten wir hundert verschiedene Creatives aus hundert. Sie müssen die Ergebnisse dafür nicht selbst bereinigen und Hashes neu berechnen.

So: 100 Creatives ohne Duplikate Woche 26.07–01.08: verschiedene Dateien nach SHA-2560255075100nach Views(wie im Test)55Datum88„Nur eindeutige“100Gleiches Ergebnis in unserem Skript und im CLI-Tool des Autors mit „Nur eindeutige“.

Die 88 in der Grafik stammen aus unserem nach Datum sortierten Durchlauf. So viele verschiedene Dateien ergeben sich sowohl im Tages- als auch im Wochenfenster, weil bei dieser Sortierung dieselben hundert Anzeigen vorne stehen. Die 87 weiter oben sind eine andere Messung: die nach Aufrufen sortierte Tagesstichprobe des Autors.

So funktioniert der Vergleich. Verglichen werden die Bilder und Videos selbst, weder Dateinamen noch Links. Deshalb verhindern ein erneuter Upload, Komprimierung, Zuschnitt oder geänderte Untertitel nicht, dass dasselbe Creative erkannt wird. Neben jedem Creative steht, in wie vielen Anzeigen es vorkam. Damit ist direkt zu sehen, was am häufigsten erneut hochgeladen wird.

Und noch etwas. Wiederholungen sind nicht automatisch Ausschuss. Wenn ein Creative in 28 Karten steht, wird die Kombination skaliert. Das ist ein Anlass, genauer hinzusehen, wie der Player sie ausrollt.

Ergebnis des erneuten Durchlaufs: Die Duplikate entstanden durch die Sammel-Einstellung, nicht durch den Datenbestand. „Nur eindeutige“ war ausgeschaltet; mit dem Filter sind hundert Creatives aus hundert Karten verschieden. Für kommerzielle Werbung eignet sich eine Sortierung nach Impressions grundsätzlich nicht: Facebook liefert diese Werte nur für politische Werbung.

5. Überschneidung der Datenbanken

Verglichen wurden die ersten hundert Suchergebnisse, nicht die vollständigen Datenbanken

Aus dem Test von „Yellow Web“

„Übereinstimmungen zwischen den Ergebnissen der Dienste habe ich mit SHA-256 und zusätzlich mit PDQ gezählt.“

„Für die Woche tauchten bei jeder Quelle 92–100 % der Dateien nicht unter den ersten hundert der anderen Dienste auf. Selbst die ähnlich ausgerichteten Gamler und MTWSPY überschnitten sich nur bei sieben Dateien.“

Ausschnitt aus der Untersuchung von „Yellow Web“

Ausschnitt aus dem Artikel von „Yellow Web“ · Originaluntersuchung öffnen

Was die Messung zeigte. Bei jedem Dienst fanden sich 92–100 % der Dateien nicht unter den ersten hundert Ergebnissen der anderen. Bei uns waren es nach Berücksichtigung erneuter Uploads 98,1 %.

Der Wert lag bei allen fünf Diensten ähnlich – damit beschreibt er nicht die Datenbanken. Er wird aus hundert Karten berechnet, unabhängig davon, was hinter diesen hundert liegt. Für die Testwoche kamen bei Gamler 849 relevante Anzeigen zusammen, bei uns 23.986. Trotzdem lag der Anteil nicht wiedergefundener Dateien bei beiden im Bereich von 92–100 %. Ein Wert, der eine Menge von 849 nicht von einer Menge von 23.986 Anzeigen unterscheidet, beschreibt die Reihenfolge der Ergebnisse statt des Datenbestands.

Hundert Karten sind nur ein Bruchteil des Umfangs. Sie entsprachen 3,2 % der Tagesergebnisse für den 1. August und 0,4 % der Wochenergebnisse. Zwei Datenbanken können zur Hälfte übereinstimmen und trotzdem verschiedene erste hundert Treffer liefern. Dafür genügt eine andere Standardsortierung.

Die wahrnehmungsbasierte Prüfung war richtig. SHA-256 allein hätte nicht gereicht; der Autor ergänzte PDQ und vPDQ. Damit verglich er Bilder und Videos selbst statt nur ihrer Bytes. Das verbessert den Vergleich der Stichproben, macht aus ihnen aber keinen Vergleich der ganzen Datenbanken.

Hinzu kommt ein technisches Detail bei Dateien. Die SHA-256-Prüfsumme stimmt nur überein, wenn dieselbe Dateiversion heruntergeladen wird. Eine API kann für dasselbe Video das Original, eine komprimierte Kopie oder ein Vorschaubild liefern. Die wahrnehmungsbasierte Prüfung erkennt einen Teil davon; ein einzelnes Bild und ein ganzes Video lassen sich dennoch nicht unmittelbar gleichsetzen.

Eine Anzeige, mehrere Medien-URLs Medien-URLs eines Creatives in öffentlichen CLI-Tools und API-Beschreibungen, August 2026024Tyver5Spytrend3Gamler3MTWSPY0AdWall0Wie viele Medien-URLs gibt ein Dienst für dieselbe Anzeige aus? Je mehr, desto öfter gelten beim Vergleich perDateihash gleiche Ads als verschieden. Tyver liefert Original, komprimierte Kopie und zwei Vorschaubilder;Spytrend: Original, Thumbnail und Ersatz-URLs. Null: Im öffentlichen Tool fehlen Links zu Creatives.

So ließe sich die Überschneidung messen. Man müsste die vollständigen Ergebnisse für den Zeitraum anhand der Library ID vergleichen, die Facebook jeder Anzeige zuweist, statt nur die ersten hundert. Dann wird dieselbe Anzeige in zwei Diensten als dieselbe erkannt und der gemeinsame Anteil aus dem Gesamtumfang berechnet.

Fazit zu diesem Punkt: Der Bereich von 92–100 % ergab sich sowohl bei 849 als auch bei 23.986 Anzeigen pro Woche. Er misst die Sortierung der ersten hundert Ergebnisse, nicht die Überschneidung der Datenbanken. Dafür braucht es Library IDs und die vollständigen Ergebnisse des Zeitraums.

6. MCP im Test

Spytrend steht zweimal in der Testtabelle – dahinter steckt derselbe Server mit 43 erfolgreichen Aufrufen von 43

Aus dem Test von „Yellow Web“

„Spytrend MCP über einen separaten Agenten – 0 von 8, 8 Fehler, durchschnittliche Antwortzeit 178,96 s.“

„Spytrend SDK mit direktem API-Zugriff – 15 von 15, 0 Fehler, 1,69 s.“

„Probleme gab es bei Spytrend über MCP. Zuerst störte die Autorisierung, dann startete jeder Aufruf eine eigene Agentensitzung und dauerte etwa drei Minuten.“

„Übrigens haben die Leute MCP kürzlich aktualisiert; möglicherweise ist das Problem bereits behoben.“

Ausschnitt aus der Untersuchung von „Yellow Web“

Ausschnitt aus dem Artikel von „Yellow Web“ · Originaluntersuchung öffnen

Beginnen wir mit dem letzten Zitat. Der Autor vermutete selbst, dass das Problem bereits behoben sei. Die folgenden Serverlogs mit Datum stützen das.

Was die Messung zeigte. In der Tabelle stehen zwei Zeilen zu Spytrend: „0 von 8“ über MCP und „15 von 15“ über ein „SDK mit direktem API-Zugriff“.

Warum das geschah. Beide Zeilen betreffen denselben Server. Ein eigenes SDK von Spytrend gibt es nicht und gab es nicht. Das Testwerkzeug ruft mcp.spytrend.com/mcp über OAuth2 Client Credentials auf – eine übliche Anmeldung mit einem Schlüsselpaar für den Agenten. Die Zeile mit 15 von 15 und 1,69 Sekunden beschreibt also ebenfalls MCP, nur anders aufgerufen.

Der Unterschied zwischen „0 von 8“ und „15 von 15“ lag damit in der Zwischenschicht. Der Autor griff über sein Kommandozeilen-Werkzeug auf unsere Schnittstellen zu. Dieses startete bei jeder Anfrage eine neue Agentensitzung. Die 178,96 Sekunden umfassen deshalb den gesamten Ablauf aus Agentenstart, Anmeldung, Verbindung und anschließender Suche – nicht allein die Antwort unseres Servers.

Spytrend-Suchanfragen im Test Sitzungsergebnis & Calls gesamt im Zeitraum0255075In Studie angegeben0erfolgr. Callsin der Messung43Calls gesamtim Studienzeitraum81Keine Antworten mit 178,96 s gefunden. Auch in 3,2 Mio. Serverlogs: keine.

43 von 43 erfolgreiche Aufrufe in der Sitzung des Autors am 3. August

1,608 s durchschnittliche Antwortzeit; Median 0,163 s

0 Fehler

Erneuter Durchlauf. Unser Log vom 3. August zeigt 43 Aufrufe, 43 Erfolge, durchschnittlich 1,608 Sekunden, einen Median von 0,163 Sekunden und keine Fehler. Antworten von annähernd drei Minuten stehen dort nicht. Bei den erneuten Durchläufen am 11. September 2026 führten wir jeweils zehn Aufrufe hintereinander in einer Sitzung aus. Die Mediane lagen bei 0,77–0,93 Sekunden; Fehler gab es keine.

Eine andere Folge wog schwerer. MCP ist mehr als eine Sammlung von Endpunkten. Der Server beschreibt dem Agenten seine Werkzeuge: Er liefert das Filterschema, die aktuelle Liste der Sortierungen und Anweisungen dazu, wonach gesucht, wie eingegrenzt und welche Schalter verwendet werden können. Die selbst gebaute Zwischenschicht ließ diese Ebene weg. Die Daten kamen an, die Hinweise nicht.

Deshalb suchte der Agent mit Filtern, die für die Aufgabe ungeeignet waren, und fand „Nur eindeutige“ nicht. Dieser Filter steht seit Juni in der Beschreibung unseres Suchwerkzeugs und fasst Wiederholungen mit einer Einstellung zusammen. So erklären sich sowohl die 55 Dateien aus hundert in Punkt 4 als auch ein Teil der Lücken in der Filtermatrix aus Punkt 1. Der Server hielt die Informationen bereit; die Zwischenschicht fragte sie nicht ab.

Was sich nach dem Test änderte. Eine Sortierung nach Impressions wird nicht mehr stillschweigend angenommen. Der Server lehnt die Anfrage ab, nennt verfügbare Varianten und zeigt einen Beispielaufruf: date für das Datum, most_popular für das Popularitätsranking, folder_added für das Hinzufügen zu Ordnern und most_reused_creative für die Zahl erneuter Creative-Uploads. Ein direkt angebundener Agent bekommt damit eine konkrete Korrektur.

Ergebnis des erneuten Durchlaufs: In der Sitzung des Autors am 3. August waren 43 von 43 Aufrufen erfolgreich, bei durchschnittlich 1,608 Sekunden und ohne Fehler. Beide Tabellenzeilen betreffen denselben Server; ein eigenes Spytrend-SDK existiert nicht. Die Zwischenschicht gab Serveranweisungen wie „Nur eindeutige“ nicht an den Agenten weiter.

7. Quotenverbrauch

Der gesamte Test kostete 201 Token – ein halbes Prozent der Monatsquote

Aus dem Test von „Yellow Web“

„Spytrend verbrauchte die Quote überwiegend für das Herunterladen von 200 Dateien.“ Im Test waren es 201 Einheiten beim Pro-Tarif für 79 USD pro Monat.

„Die Dienste berechnen Aufrufe, Datei-Downloads und API-Anfragen unterschiedlich. Ein fairer Preis pro tausend Karten lässt sich daraus leider nicht ableiten.“

Ausschnitt aus der Untersuchung von „Yellow Web“

Ausschnitt aus dem Artikel von „Yellow Web“ · Originaluntersuchung öffnen

Was die Messung zeigte. Der gesamte Test verbrauchte bei uns 201 Token, bei Tyver 42. „Token“ bezeichnet hier eine interne Quoteneinheit von Spytrend und hat nichts mit Token eines Sprachmodells zu tun.

Warum diese Zahlen nicht unmittelbar vergleichbar sind. Jeder Dienst hat eigene Preise und ein eigenes Monatslimit. Dieselbe Einheitensumme beansprucht daher bei verschiedenen Tarifen einen anderen Teil des Abos. Vergleichbar ist hier der Anteil an der jeweiligen Monatsquote.

Wie groß dieser Anteil war. Die Pro-Monatsquote betrug 40.000 Token. Der Test verbrauchte 201, also ein halbes Prozent. Ein solcher Durchlauf wäre mit diesem Tarif ungefähr zweihundertmal im Monat möglich.

Warum dieser Verbrauch entstand. Damals war das Durchsehen der Metadaten kostenlos. Berechnet wurde das Herunterladen von Medien; der Agent lud 200 Dateien herunter.

Was sich geändert hat. Die aktuelle Preislogik ist anders: Berechnet wird, was tatsächlich ausgegeben wurde.

Leistung Token
Zeile im Suchergebnis 1
Mediendatei einer Anzeige 1
Medium eines eindeutigen Creatives – eine Version statt aller erneuten Uploads 10
Zeile aus dem TikTok-Korpus, einer eigenen TikTok-Anzeigendatenbank 100
Pro-Monatsquote 40.000

Bei einer kürzeren Ergebnisseite werden Token automatisch zurückgegeben: Fragen Sie zwanzig Zeilen an und es gibt nur zwölf, werden zwölf berechnet. Derselbe Test würde heute ungefähr 865 Token kosten, also etwas mehr als zwei Prozent der Monatsquote. Die verbleibende Quote kann der Agent kostenlos abfragen.

Fazit zu diesem Punkt: Tokenzahlen verschiedener Dienste lassen sich wegen unterschiedlicher Limits nicht direkt vergleichen. Als Anteil am Abo kostete der gesamte Test ein halbes Prozent der Pro-Monatsquote – 201 von 40.000 Token. Nach dem aktuellen Preis wären es ungefähr 865 Token oder rund zwei Prozent.

8. Ergebnis nach Umfang

In der Testwoche hatte Spytrend 23.986 relevante Anzeigen – fast viermal so viele wie der nächste Dienst

Aus dem Test von „Yellow Web“

„Spytrend ist wegen der integrierten Suche nach Duplikaten (…) und TikTok interessant, wenn man mehrere Traffic-Quellen bespielt. Die Tagesergebnisse waren sauber, für die Woche gab es wenig Ausschuss.“

„Einen universellen Sieger gibt es in diesem Test NICHT, und das ist normal.“

Ausschnitt aus der Untersuchung von „Yellow Web“

Ausschnitt aus dem Artikel von „Yellow Web“ · Originaluntersuchung öffnen

Die Testmethode beschreibt vor allem die Sammel-Einstellungen: Sortiert wurde nach einer Kennzahl, die für kommerzielle Werbung nicht vorliegt. Der Filter für eindeutige Creatives blieb aus. Für den Datenbankvergleich wurden Hashes unterschiedlicher Versionen einer Datei herangezogen. Werden diese drei Punkte berücksichtigt und dieselben Karten neu ausgewertet, ergibt sich ein anderes Bild: Spytrend liegt bei der geschätzten Zahl relevanter Anzeigen deutlich vor jedem der vier anderen Dienste. Hinzu kommen rund 280 Millionen neue Anzeigen pro Monat, 342 Unterkategorien, Duplikatfilter per Schalter, Webmaster-Netzwerke, TikTok und die offizielle KI-Agenten-Anbindung. In diesem Vergleich von fünf Diensten liegt Spytrend bei der geschätzten Zahl relevanter Anzeigen für die Testwoche vorn.

Zuerst zur Vergleichbarkeit. Die Mengen der vier anderen Dienste stammen vom Testzeitpunkt im August 2026. Deshalb verwenden wir auch für Spytrend den damaligen Stand: 24.985 Anzeigen für die Woche vom 26. Juli bis zum 1. August. Bei 96 % relevanten Anzeigen sind das geschätzte 23.986. Daneben nennen wir den späteren Stand: Bei der erneuten Messung am 11. September 2026 war dieselbe Woche auf 29.150 Anzeigen und damit geschätzte 27.984 relevante Anzeigen angewachsen. Mit den August-Mengen der Wettbewerber ist diese zweite Zahl nicht direkt vergleichbar; deren September-Stand haben wir nicht neu erhoben.

Für Media BuyerSpytrendVier andere
Umfang und Qualität der Datenbank
Geschätzte relevante Anzeigen pro Woche23.986 am Testdatum
27.984 am 11. September 2026
Tyver 6.438 · AdWall 4.420 · Gamler 849 · MTWSPY 435 (Sammlung im Test bei 500+ gestoppt)
Ausschuss in Wochenresultaten4 %Tyver 44 % · AdWall 73 % · MTWSPY 13 % · Gamler 0 %
Neue Anzeigenrund 280 Mio./Monat (Facebook: über 170 Mio.)Tyver: 113 Mio. in 30 Tagen (Mai 2026) · andere ohne Angabe
Klassifizierung33 Kategorien, 342 UnterkategorienTyver: einige breite Verticals
Suchfunktionen
Duplikate per Klick bündelnjaim Vergleich nicht vermerkt
Ranking nach Creative-ReuploadsjaNeustartzähler bei Gamler
Suche nach Creative-Ähnlichkeitjaim Test nicht vermerkt; Websites: „ähnliche“ nach Seite, Domain, IP oder Werbetreibendem
Suche nach Facebook-Pixeljaim Test nicht vermerkt; Websites ohne eigenen Filter (Tyver und MTWSPY: Suche nach Linkausschnitt)
Webmaster-Netzwerke: Domains, Pixel, Fanpages, IPsjaauf Websites nicht angegeben
Marke hinter Cloaking aufdecken (neu im September)ja, kostenpflichtigCloaking-Hinweise bei AdWall; MTWSPY nennt Cloaking-Aufdeckung
Zweite Quelle: TikTokjanein
Anbindung und Preis
KI-Agenten anbinden (MCP)ja, OAuth 2.1REST-API bei Tyver, AdWall und MTWSPY; Gamler ohne öffentliche API; kein MCP-Server angegeben
Preis79 USD59 · 70 · 79 USD, AdWall: 30 Tage gratis, danach kostenpflichtig

Für den Vergleich wurden Zahlen des Autors (Test, August 2026) und öffentliche Materialien der Dienste mit Stand September 2026 verwendet – Tyver, AdWall, Gamler, MTWSPY. Die Zahl relevanter Anzeigen ist eine Schätzung: Anteil relevanter Anzeigen in der Stichprobe des Autors × Datenumfang desselben Zeitraums.

Ergebnis des erneuten Durchlaufs: Für den vergleichbaren Testzeitpunkt schätzen wir 23.986 relevante Spytrend-Anzeigen in der Woche gegenüber 6.438 beim nächstplatzierten Dienst; am 11. September 2026 waren es 27.984. Dazu kommen rund 280 Millionen neue Anzeigen pro Monat, 342 Unterkategorien, Duplikate per Schalter zusammenfassen, Webmaster-Netzwerke, TikTok und die offizielle KI-Agenten-Anbindung.

Was bewusst fehlt

Welche Filter bewusst fehlen

Nicht jeder Wert aus Facebooks Anzeigendaten sollte als gemessene Tatsache erscheinen.

  • Geschlecht und Alter des Publikums. Facebook liefert hierfür eigene Schätzungen statt Messwerte. Die Zuordnung beruht auf Annahmen darüber, wer eine Anzeige gesehen hat. Meta stuft solche Metriken selbst als geschätzt und stichprobenbasiert ein. Ein Filter dafür würde eine Sicherheit suggerieren, die die Daten nicht bieten. Deshalb gibt es in Spytrend keine Filter für Geschlecht und Alter. Es liegt nicht daran, dass die Felder unerreichbar wären: Wir geben eine Schätzung nicht als gemessenen Wert aus.

Was wir geändert haben

Was nach dem Test leichter wurde

Der Test zeigte, an welchen Stellen dem KI-Agenten Hinweise fehlten. Seit August hat sich Folgendes geändert:

  • Der Agent bekommt Hinweise zur Sortierung. Zuvor ging eine Anfrage nach Impressions durch, obwohl die Daten für diese Sortierung fehlen. Jetzt erklärt die Suche den Grund und schlägt date, most_popular, folder_added für das Hinzufügen zu Ordnern und most_reused_creative vor. Zur Wahl stehen damit neue Anzeigen, unser Popularitätsranking oder die am häufigsten erneut hochgeladenen Creatives.
  • Eine ganze Anzeigenstichprobe lässt sich analysieren. Hinzugekommen sind Auswertungen nach Werbetreibenden, Ländern, Kategorien und Domains. Dort ist auch ein Reichweitenbereich mit Erklärung zu sehen.
  • Wir haben die Auswahl durch die Filter geprüft. Alle 45 Suchparameter wurden durchgegangen und Fälle festgehalten, in denen Ergebnisse die Bedingungen nicht einhielten.
  • Die Marke hinter einer Cloaking-Seite lässt sich aufdecken – für 1 $ pro Start in jedem Tarif; Einzelheiten stehen in Punkt 1.

„Nur eindeutige“, „Am häufigsten neu hochgeladen“, die Suche nach visueller Creative-Ähnlichkeit, Pixel und Tracking-Link-Ausschnitt, Webmaster-Netzwerke, TikTok sowie die KI-Agenten-Anbindung gab es bei Spytrend bereits während des Tests.

Empfehlung für die Suche mit Agenten

Nutzen Sie die offizielle MCP-Anbindung – so vermeiden Sie die meisten dieser Schwierigkeiten

Dieser Test zeigt, wie sehr das Ergebnis der KI-Suche von der Datenanbindung abhängt. Eine eigene Zwischenschicht über einer fremden API ist ein zusätzlicher Schritt, bei dem Serverhinweise, die aktuelle Sortierungsliste und verständliche Fehlermeldungen verloren gehen können.

Spytrend bietet eine offizielle MCP-Anbindung. Claude, ChatGPT, Cursor, Codex und VS Code arbeiten über OAuth direkt mit der Datenbank. Der Agent sieht das aktuelle Filterschema, bekommt bei einer ungeeigneten Anfrage einen Hinweis und nutzt eine Sitzung, statt sich für jede Anfrage neu zu verbinden. Die Dokumentation steht auf der MCP-Seite von Spytrend; wie der MCP-Assistent von Spytrend arbeitet, erläutert ein eigener Artikel.

FAQ

Wie unterscheidet sich Spytrend von Tyver bei der Suche nach iGaming-Creatives?
Laut Messung des Autors betrafen 96 % der Spytrend-Wochenergebnisse iGaming. Bei Tyver waren für dieselbe Woche 44 % themenfremd. Auch die Einordnung unterscheidet sich: Tyver hat mehrere breite Verticals (Stand September 2026), Spytrend 33 Kategorien und 342 Unterkategorien, darunter acht getrennt für Gambling und Betting. Hinzu kommen die Suche nach dem Creative selbst, nach Pixeln und nach Webmaster-Netzwerken.

Warum hatte Spytrend mehr Duplikate als MTWSPY?
Die Ergebnisse wurden nach Aufrufen sortiert und ohne Filter für eindeutige Creatives gesammelt. In dieser Hunderterstichprobe belegte ein Creative 28 Karten; 55 verschiedene Dateien blieben übrig. Auf den Karten des Autors erhielten wir dasselbe Ergebnis. Mit „Nur eindeutige“ ergeben hundert Karten hundert verschiedene Creatives.

Warum zeigte der MCP-Server von Spytrend im Test 0 von 8 erfolgreichen Aufrufen?
Der Autor nutzte eine eigene Zwischenschicht, die bei jeder Anfrage eine neue Agentensitzung startete. Daher kamen durchschnittlich 178,96 Sekunden für den gesamten Ablauf zustande. Unser Log zur Sitzung des Autors am 3. August zeigt 43 Aufrufe, 43 Erfolge, durchschnittlich 1,608 Sekunden, einen Median von 0,163 Sekunden und keine Fehler.

Wie viele iGaming-Anzeigen für Spanien liefert Spytrend für einen Tag?
Für den 1. August holte der Agent 996 Anzeigen; das Sammeln stoppte bei hundert Karten pro Zeitraum. Für denselben Tag und dieselbe Suchanfrage lagen 3.112 Anzeigen in der Datenbank. Als der vergangene Zeitraum weiter ergänzt worden war, ergab die Messung am 11. September 2026 für diesen Tag 4.072 Anzeigen und für die Woche vom 26. Juli bis zum 1. August 29.150.

Lässt sich die Überschneidung zweier Spy-Tool-Datenbanken aus den ersten hundert Ergebnissen messen?
Nein. Der Test verglich die ersten hundert Ergebnisse einer Anfrage; das sind 0,4 % unseres Wochenvolumens. Unterschiedliche Standardsortierungen können selbst bei Datenbanken, die zur Hälfte übereinstimmen, verschiedene erste hundert Treffer liefern. Für die Überschneidung müssen Library IDs und die vollständigen Ergebnisse des Zeitraums verglichen werden.

Wie viel Spytrend-Quote verbraucht ein solcher Test?
Der Test des Autors kostete 201 Token bei einer Pro-Monatsquote von 40.000 – ein halbes Prozent. Damals war das Durchsehen von Metadaten kostenlos; berechnet wurde das Herunterladen von Medien. Nach dem aktuellen Preis würde derselbe Test ungefähr 865 Token oder etwas mehr als zwei Prozent der Monatsquote kosten.

Welche der vom Autor geprüften Funktionen hat Spytrend nicht?
Geschlecht und Alter fehlen bewusst als Filter: Facebook liefert dafür Schätzungen statt Messwerte – Meta stuft solche Metriken selbst als geschätzt und stichprobenbasiert ein. Der Geo-Filter wählt korrekt aus; ein großer Teil der Ergebnisse ist Multi-Geo-Werbung mit Spanien als einem Zielmarkt. Eine Sortierung nach tatsächlichen Impressions kommerzieller Werbung gibt es nicht, weil Facebook Impressions nur für politische Werbung bereitstellt.

Selbst nachprüfen

So prüfen Sie die Ergebnisse selbst

Das Skript wiederholt die Messung in Ihrem Account und zeigt eine Tabelle mit „Behauptung → Messwert → Urteil“. Sie brauchen Python und Zugangsschlüssel aus Ihrem Spytrend-Account. Zusätzliche Bibliotheken sind nicht nötig:

export SPYTREND_CLIENT_ID=... # Einstellungen → KI → Agentenzugang erstellen
export SPYTREND_CLIENT_SECRET=...
python3 verify.py

Repository mit den Daten: https://github.com/Spytrend/yellowweb-test-verify

Es enthält das Skript, die Rohdaten beider Durchläufe – Test und reguläre Einstellungen –, die genauen Befehle, Ausführungsdaten und Werkzeugversionen. Sie können unsere Zahlen damit aus den Exporten neu berechnen.

Der Durchlauf verbraucht ungefähr zwei Prozent der Monatsquote. Wenn Ihre Ergebnisse von unseren abweichen, schreiben Sie uns. Wir prüfen die Differenz und erläutern sie öffentlich, wie es der Autor des Tests getan hat.

Ergebnisse

Fünf Aussagen des Tests und das Ergebnis der Nachprüfung

Aussage der Untersuchung Ergebnis der Nachprüfung Punkt
MCP funktioniert nicht: 0 von 8, 179 Sekunden 43 von 43 erfolgreich, Ø 1,6 s. Beide Zeilen betreffen denselben Server Punkt 6
Von hundert blieben 55 verschiedene Dateien Bei derselben Sortierung ebenfalls 55; mit „Nur eindeutige“ 100 von 100 Punkt 4
Die Datenbanken überschneiden sich kaum Verglichen wurden erste hundert Treffer, nur 0,4 % des Wochenvolumens. Nach wahrnehmungsbasiertem Vergleich des Autors tauchten 98,1 % unserer Dateien bei den anderen nicht auf Punkt 5
Spytrend fand 996 Anzeigen an einem Tag So viele holte der Agent. In der Datenbank lagen damals 3.112, beim späteren Stand 4.072 Punkt 2
Spytrend hat fünf Lücken in der Filtermatrix Im Test (August 2026) war die Suche nach Creative-Ähnlichkeit und Pixel nur bei Spytrend vermerkt; Tracking-Link und Webmaster-Netzwerk sind in der Testmatrix nicht aufgeführt Punkt 1

Was bleibt: Drei Sammel-Bedingungen prägten das Testergebnis. Sortiert wurde nach einer Kennzahl, die für kommerzielle Werbung fehlt; der Filter für eindeutige Creatives blieb aus; und für den Datenbankvergleich wurden Hashes verschiedener Versionen einer Datei verwendet. Der Agent nutzte damit einen großen Teil dessen nicht, was in Spytrend schon vorhanden war. Mit denselben Karten und korrigierten Bedingungen ergeben sich andere Zahlen: geschätzte 23.986 relevante Anzeigen für die Woche gegenüber 6.438 beim nächsten der vier Dienste – beide zum Testzeitpunkt –, 100 verschiedene Creatives aus 100 und 43 erfolgreiche MCP-Aufrufe von 43.

Sie müssen uns diese Zahlen nicht einfach glauben. Nehmen Sie das Skript, Ihre Schlüssel und Ihre eigene Kombination; der Durchlauf dauert fünf Minuten. Falls die Zahlen abweichen, prüfen wir die Differenz ebenso öffentlich.

Die Datenbank lässt sich auch ohne Bezahlung ansehen: Im kostenlosen Starter-Tarif ist das Archiv von Anzeigen, die älter als 90 Tage sind, ohne Karte im eingeschränkten Modus verfügbar – auf der deutschen Spytrend-Seite.

Spytrend ist eine Plattform für Wettbewerbsanalyse von Facebook- und TikTok-Werbung. Sie umfasst eine Anzeigenbasis ab 2018 (der Großteil stammt aus 2025–2026), ordnet Anzeigen mithilfe von KI in 33 Geschäftskategorien ein und bündelt jeden Werbetreibenden in einer Karte: alle Anzeigen, Seiten, Domains und Länder an einem Ort.

Rund 1,8 Milliarden Anzeigen, rund 280 Millionen neue pro Monat, 342 Unterkategorien und ein offizieller MCP-Server für Claude, ChatGPT, Cursor und Codex.

Die Grafiken aus der Untersuchung werden zum Vergleich zitiert; die Rechte daran liegen beim Autor. Grundlage der Nachprüfung waren seine Karten, Serverlogs und eine erneute Abfrage.