Buzzmatic
Folge 2

Willkommen im KI-Crawling-Wildwest

HostsOguzhan, Raoul, Sebastjan
Veröffentlicht
Dauer33 Min.
Buzzsozial Podcast-Cover

Folge anhören

Audio · Riverside
00:00 / 32:57
Zurück zur Podcast-Übersicht

Kurz gesagt

Worum es in dieser Folge geht

570 Millionen Requests pro Monat allein vom GPTBot, beim ClaudeBot rund 370 Millionen, und in einem Jahr ein Plus von 300 Prozent. Kommt da 2026 etwas Größeres auf uns zu? Genau der Frage gehen Raoul, Oguzhan und Sebastjan nach, mit Beispielen aus ihren eigenen Kundenprojekten. Es geht um JavaScript, das zwei Drittel der Bots nicht lesen, um Firewalls, die Crawler aus Versehen aussperren, und um die Frage, ob Blocken überhaupt noch ein Weg ist. Am Ende gibt jeder eine strategische Empfehlung ab, die du direkt mitnehmen kannst.

  • 570 Millionen Requests im Monat allein vom GPTBot, beim ClaudeBot rund 370 Millionen, Wachstum 300 Prozent im Jahr. Die ehrliche Gegenfrage in der Runde lautet, wer in den letzten drei Monaten überhaupt mal in die Serverlogs geschaut hat.
  • Mehr als zwei Drittel aller Bot-Zugriffe können kein JavaScript lesen, und das verbleibende Drittel ist im Kern Googlebot. Wer stark clientseitig rendert, verschwindet damit bei knapp 70 Prozent der KI-Bots.
  • Ein Kunde stand bei Perplexity auf null, und zwar nicht wegen schwacher Inhalte, sondern weil die Firewall den Crawler für einen Scraper hielt. Nach der Korrektur war die Sichtbarkeit binnen Tagen oben.
  • OpenAI trennt den Bot fürs Training vom Bot für die Suche, bei Claude, Gemini und Perplexity gibt es diese Wahl bisher nicht. Für Informationsseiten, die gerade von KI aufgefressen werden, ist genau diese Trennung der interessante Hebel.
  • Sebastjan sieht die Vertrauensbasis kippen, wenn die großen Medienhäuser aussperren und dubiose Quellen nachrücken. Oguzhan dreht das Thema sofort weiter auf die Chance für kleine Marken und erinnert an die Zeiten mit 200 bis 400 selbst aufgebauten Domains.

Folge ansehen oder anhören

Jetzt abspielen

33 Min. · Auch auf YouTube

Kapitel

Direkt zur Stelle springen

Shownotes

Links und Erwähnungen aus der Folge

Die Bots, Tools und Begriffe aus dieser Folge zum Nachschlagen.

Du hast eine Frage oder ein Thema für eine kommende Folge? Nutze das Formular am Ende der Seite.

Transkript

Zum Nachlesen

Vollständiges Transkript der Folge33 Min. · Automatisch erstelltes Transkript, kann kleine Fehler enthalten.
Hallo zusammen, herzlich willkommen zu Buzzsozial, dem Podcast über GEO, SEO und AI. In Buzzsozial stellen wir euch jede Woche ein Thema vor, das wir gemeinsam diskutieren. Und zwei der Teilnehmenden wissen nicht, um welches Thema es geht. Letzte Woche hat Sebastjan uns das Thema E-E-A-T im Zeitalter von AI mitgebracht. Sehr spannendes Thema. Diese Woche ist Oguzhan dran. Ich bin sehr gespannt, was du für uns mitgebracht hast und was wir heute diskutieren. Heute wird es um das Thema gehen. AI-Crawler, die unsichtbare Revolution. Fragezeichen, Ausrufezeichen. Letzte Woche, hast du ja gesagt, haben wir über das Thema E-E-A-T gesprochen, also wie Google Content bewertet, welche KPIs angewandt werden, welche Strategien es dort geben kann. Und heute will ich mal ein bisschen mehr auf das Thema AI und die Crawler von den LLMs drauf gucken, weil wir letzte Woche oder bisher die letzten 14, 15, 20 Jahre ganz stark auf die Google Crawler geguckt haben oder die Search Crawler.
Ich habe mir ein paar Statistiken mitgebracht. Wusstet ihr, dass aktuell 570 Millionen Request pro Monat alleine vom GPTBot ausgehen? Oder dass ClaudeBot ca. 370 Millionen Request pro Monat rausballert, Perplexity ein bisschen weniger und dass das Wachstum vom GPTBot auf die Server innerhalb eines Jahres um 300 Prozent gewachsen ist. Da gibt es diverse Statistiken, die da draußen sind. Das heißt, wir sehen einen massiven Anstieg dieser Anfragen, die von diesen LLM Bots kommen. Und da fragt man sich natürlich, what the fuck, was ist da los? Kommt da jetzt 2026 etwas größeres auf uns zu?
Und nochmal Hand aufs Herz, wer von euch hat in den letzten drei, vier Monaten mal sich Serverlogs angeguckt? Sei es bei Kunden oder eigene Projekte. Also ich jetzt in den letzten drei Monaten echt zu sein nicht. Obwohl ich weiß, dass das Thema AI und LLM-Bots relevant ist und relevanter wird, weil es natürlich auch Unternehmen gibt, Verlage gibt, die da schon hantieren mit ich möchte nicht, dass er crawlt, ich möchte, dass er crawlt, ich möchte meine Daten freigeben, nicht freigeben etc. Da wäre meine erste Frage Richtung Sebastjan, vielleicht auch für die Community dann relevant. Was ist aus deiner Sicht so der entscheidende Unterschied zwischen dem Googlebot und dem GPTBot beispielsweise?
Jo, wenn wir auch direkt auf das Thema eingehen, was sind die größten Unterschiede ist erstmal, dass Googlebot da einen sehr großen Vorteil hat von GPT und allen anderen. Da habe ich auch eine Statistik vor kurzem gesehen, dass mehr als zwei Drittel aller robots Zugriffe können kein JavaScript lesen. Da kann man sich nur fragen, was macht jetzt jetzt den letzten Drittel aus der doch JavaScript lesen kann. Ja, das ist unser unser Googlebot, der das nicht unterscheidet, die beiden Welten. Man weiß nie mit welchem mit welcher Agenda der auf unserer Webseite ist für SEO-Rankings oder ist eher für AI-Overviews, für Google-Knowledge-Graph, whatever und da hat Google einen riesen Vorteil. Das heißt aber auch, wenn man eine stark JavaScript-basierte Seite hat, dann verpasst man alles von allen anderen knapp 70 Prozent der AI-Bots, die das halt nicht können.
Bin ich genau bei dir. Das ist genau das Thema. GPTBot und meines Erachtens Claude kommen mit JavaScript nicht gut klar. Genau wie du gesagt hast, Googlebot ist dort unterwegs und Gemini nutzt meines Wissens nach die Quellen, die halt Googlebot hat, die Ressourcen auch. Korrigiert mich, wenn ich ja falsch liege, so tief stecke ich im thema nicht drin, aber dafür habe ich ja meine zwei Experten hier an Bord und da hat Gemini so ein bisschen den Vorteil. Jetzt muss man sich mal vorstellen, wir haben ja auch einige Kunden, die halt vor Jahren schon irgendwie auf React umgestellt haben, vieles mit JavaScript machen, ihre Inhalte ausliefern, Client-Side-Rendering machen, teilweise aus Performance-Sicht, teilweise aus historischer Gegebenheit, wie die jetzt dort performen und wie die jetzt damit umgehen wollen.
Das wird natürlich sehr, sehr spannend. Wenn wir jetzt noch weitergehen, dann fängt ja dann damit verbunden auch schon so ein bisschen die Blockierdebatte an. Es gibt ja Leute, die sagen, okay, ich nutze dieses JavaScript und spiele das explizit auch so aus, um halt vor allen Dingen GPTBot oder ClaudeBot etc. noch besser noch einfacher effektiver auszuschließen. Die Frage ist, was machen die Leute mit Gemini und welche Möglichkeiten seht ihr dort? Also diese Ausschluss nicht ausschließen Debatte, die würde ich jetzt gerne mal eröffnen und mit euch mal kurz diskutieren, wie sinnvoll ihr das haltet, welche Möglichkeiten es da aus eurer Sicht gibt.
Du musst differenzieren. Also einmal das bewusste Ausschließen von irgendwas, was heißt du davon? Bewusst ausschließen und das Unbewusste. Was mir jetzt in letzter Zeit bei zwei Kundenprojekten konkret aufgefallen ist, ist das aus Versehen. Bots ausgeschlossen wurden oder blockiert wurden, weil sie fälschlicherweise für Scraper gehalten wurden oder nicht Bekannte waren. Das heißt dann wir sind ja aktuell noch dabei BuzzView zu entwickeln. Haben wir eine Analyse gemacht. Angesehen warum kommt Kunde X auf Perplexity nicht vor? Warum ist der ist der überall 0,0,0. Und dann schaust du genauer rein und dann merkst du, der wird einfach 0,0 zitiert. Selbst wenn du sagst, besucht diese Seite, dann fängt er an irgendwelche allgemeinen Seiten sich anzuschauen. Wenn du dann genauer reinschaust, dann kriegst du mit, dass der durch die Firewall blockiert wird. Also gar keine bewusste Entscheidung, sondern was, was dann relativ schnell geändert werden kann.
Interessanterweise schnappt das dann ein Tool wie Perplexity auch sehr, sehr schnell auf. Das heißt, diese Änderung, die gemacht wurde, hat dann sehr schnell zu einer sehr hohen Sichtbarkeit auf Perplexity geführt. Das ging irgendwie ein paar Tage, dann wurde das schon wieder ganz normal ausgespielt. Und dann hat das zweite die Debatte, wollen wir das absichtlich blocken? Und da habe ich auch ein paar Kunden, die zu mir gekommen sind und gesagt, ja klar, wir blocken ChatGPT, weil wir nicht wollen, dass sie unsere Daten nutzen oder das wurde irgendwann mal so entschieden und das hat mittlerweile gravierende Auswirkungen, dass sie in solchen LLMs quasi gar nicht vorkommen. Und ich glaube, es ist auch schwer zu differenzieren, welche Requests werden für den Training verwendet und welche Requests werden für den Retrieval verwendet. Ich glaube, manchen ist es recht, im Retrieval ausgespielt zu werden. Quasi alles, was indexierbar ist, kann auch im Retrieval genutzt werden. Aber das Thema unsere gesamte Webseite zum Training verwendet, ist dann halt wieder was, was gewisse Kunden nicht möchten. Raoul,
magst du Retrieval vielleicht noch ein bisschen erklären für die, die jetzt mit dem Terminus nicht so umgehen können? Ja, sehr guter Hinweis. Und es dann schnell in der Fachsprache drin. Retrieval bedeutet, wenn jemand was in einem Chatbot sucht. Im Hintergrund wird eine Websuche gefeuert. Das heißt, der Chatbot oder das LLM zieht sich aktuelle Informationen als Quelle, die er nutzen kann, zieht das rein, analysiert das und generiert daraus die Antwort. Das ist Retrieval und Training ist quasi das Training, das längerfristige Training der Modelle, was in die großen Sprachmodelle quasi reinwandert in die sogenannten Foundation Models.
Ich habe hier eine Info, ich müsste die auch nochmal checken. Es gibt wohl die Möglichkeit, zumindest für OpenAI bei ChatGPT, das zu differenzieren, sofern diese Informationen dann auch von OpenAI stimmen, den User Agent GPT Bot und dann noch den User Agent AI Search Bot. Der Search Bot für die Suche und der GPT Bot dann quasi, der die Information auch fürs Training verwendet. Für wie sinnvoll haltet ihr das, das zu differenzieren, zu sagen, okay, ich lasse den Bot, der das Training nutzt, raus und lass nur den rein, der quasi für Search gedacht ist und gebe meine Daten nicht für Training her. Ist das ein Weg, den man gehen kann? Glaubt ihr, dass es solide und vertrauenswürdig ist oder sollte man da vorsichtig sein mit so etwas?
Ich glaube schon, dass das der richtige Weg ist. Das ist noch nicht die Ende der Stange. Aber dass man überhaupt eine Option hat zwischen den beiden Welten auszuwählen, weil was die auch ganz häufig sehen, insbesondere Informationswebseiten, Webseiten, die sehr stark auf Informationsgrundlagen den Rankings durch Jahre aufgebaut haben, die werden von AI komplett aufgefressen. Die haben gegebenenfalls, wenn die überhaupt neues Wissen noch anbieten können, jetzt kein großes Interesse damit, die Large Language Models in den Trainingsdaten zu futtern und sich damit obsolet zu machen. Für die ist es interessanter, nur beim Retrieval direkt online sich über zu sein und davon zu profitieren. Ob man denen da so vertrauen kann, was ChatGPT da macht, das ist auch so eine Grundsatz-USA-Frage, wo man sich ganz stark fragt, was kann man dem Markt und den Trainer da überhaupt noch zu trauen. Aber das ist erstmal das, womit wir leben müssen.
Was ich auch so spannend finde, ist, dass es soweit ich weiß aktuell nur OpenAI anbietet, diese zwei Bot-Varianten dann auszuschließen. Von Claude habe ich bisher so etwas nicht gelesen oder gesehen. Und bei Gemini oder Perplexity, da habe ich sowas auch nicht gesehen oder gelesen. Das heißt, bisher beten die noch gar keine Unterscheidung dieser zwei Varianten an, man jetzt ausschließen könnte. Rein theoretisch würde es ja dann bedeuten, du sperrst sie komplett aus und arbeitest dann quasi nur mit OpenAI, was aber glaube ich dann auch wieder nicht so sonderlich förderlich für den Traffic der Feinliches ist. Sebastjan, du hast eben das Thema JavaScript angesprochen, ne? Würde das jetzt bedeuten, wir raten jetzt allen Kunden oder Projekten, in denen wir drin sind, die auch kleine Teile vielleicht nur mit JavaScript ausspielen? Leute, lauft los und macht jetzt alles auf Server-Side-Rendering, stellt es um und spielt das komplette HTML aus?
Nein. Man muss sich das schon anschauen. Also es gibt noch ganz wenige Webseiten, die kritische, sehr relevante Themen immer noch über JavaScript ausführen, um da jetzt auf operativen Ebene zu bleiben, um den Zuschauern Aufweis an die Hand geben zu können. Es gibt wunderbare Plugins für Browser, wo du JavaScripts on off ausschalten kannst und dir dann deine Webseite anschauen kannst und wenn du JavaScript ausgeschaltet hast und deine Webseite immer noch alle wichtige Informationen für einen Sehbehinderten oder für einen Bot anbietet, dann ist alles fein. Wenn du aber da merkst, oh, jetzt verschwindet aber mein H1 oder eine Hälfte von meines Textes ist so überhaupt nicht da oder irgendwelche FAQs und Blöcke verschwinden, dann hast du ein anderes Thema, dann solltest du dich darum kümmern und dafür gibt es auch für E-Commerce Lösungen.
Das, was Browser macht, ist eigentlich eine ausgesuchte kleine Server, über den du jetzt keine Hand drüber hast, aber der führt JavaScript direkt im Browser aus. Es gibt Lösungen, wo du das unterbindest und die Sache bei dir auf dem Server auflöst und dann fertiges Paket an den Browser ausliefst, ohne dass Browser überhaupt mit JavaScript was zu tun haben muss und wenn ich über Browser rede, da sind auch die Headless-Scroller von Bots so, dass die dann vorgefertigte Inhalte, die alle schön aufgelöst sind, von dir bekommen. Ich weiß nicht, ob wir jetzt technisch da reinsteigen sollen. Ich bin ja auch kein Programmierer, aber ich glaube, es ist mehr als 90 Prozent von allen Lösungen, wo ein E-Commerce Unternehmen doch JavaScript prerendern muss, werden mit Next.js gelöst. Da ist auch kein Geheimnis.
Ja, ich glaube, was ein viel relevanteres Thema noch ist als das Rendering, Das Rendering-Thema wird irgendwann auch gelöst werden von den KI-Bots. Da ist das Thema, welcher Inhalt wie ausgelesen wird. Das heißt, die KI zieht ja Themen ins Kontextfenster rein. Das ist, wie wir alle wissen, relativ begrenzt. Je nach KI größer oder kleiner. Das heißt, wir haben ja sowieso das Thema Chunking. Welche Chunks aus den Inhalten ziehen Sie sich raus, die Sie dann nutzen, um die Antwort zu generieren? Das fängt aber schon mal an, mit welchen Inhalt sehen oder sieht die KI überhaupt.
Wir kennen das ja selber mit Crawling, Scraping. Es gibt diverse Möglichkeiten, den sogenannten Main Content zu erkennen. Also, wie klammern die Navigation, die ja sehr, sehr groß sein kann, den Footer, die Sidebar aus. Ich glaube, dass man sich das genauer angucken muss. Wie liest die KI tatsächlich den eigenen Content aus, Wenn der wichtigste Content dann aus irgendwelchen Gründen ausgeschlossen ist, dann braucht man sich auch nicht wundern, dass irgendwas nicht zitiert wird. Und da gibt es jetzt auch schon Bewegungen hin, dass Webseiten versuchen, jeden Artikel nochmal als Markdown zur Verfügung zu stellen.
Also einfach, dass KI das noch einfacher zitieren kann. Das geht bis bis zu dem Cloaking-Thema, wo ich jetzt einige Sachen gesehen habe, in der letzten Zeit. Dass wirklich versucht wird, strukturierter Inhalt an die KI zu füttern außerhalb von dem typischen HTML. Da geht es dann darum, die KI dazu zu kriegen, gewissen API-Request zu machen und so was. Da gibt es einige ganz relevante Artikel dazu. Und ich glaube eher, dass das die Richtung ist, in die man denken sollte. Also nicht Cloaking, sondern dass man sich wirklich anguckt, wie wird der eigene Inhalt von der KI wahrgenommen und was wird gesehen und was wird nicht gesehen. Ganz unabhängig von JavaScript, non-JavaScript.
Ja, danke nochmal dafür. Es geht ja darum, Daten anzuliefern, wie es bei Google auch geht. Es geht immer darum, Daten im besten Fall strukturiert, klar strukturiert, einfach schnell auszuliefern. Das ist ja das Game, das wir die letzten 20, 25 Jahre, 30 Jahre mit Google hatten. Das Game überträgt sich jetzt quasi auf das Thema AI. Google hat auch am Anfang seine Schwierigkeiten mit JavaScript gehabt, hat es teilweise immer noch. Hat es dann gelöst bekommen. Wie gehen davon aus, dass es die AI, die LLMs und die Bots, die da unterwegs sind, das wahrscheinlich auch lösen werden. Das ist immer eine Frage der Kapazitäten natürlich auch in dem Bereich.
Was mich zum nächsten Thema bringt, wenn jetzt so große Plattformen, Beispiel CNN, New York Times etc., die ja ganz stark auch auf diesen Traffic angewiesen sind, der da rein kommt. Wenn die das komplett aussperren und sagen, was sie tun, wir sperren die LLMs erstmal aus, wir wollen erstmal nicht, dass sie unsere Daten haben, da gibt es auch noch andere Newsportale, die das machen. In Deutschland gibt es ja auch eine Diskussion. Und dann hast du immer die andere Seite der Medaille. Das heißt, wenn Information nicht von dort kommt, dann muss sie ja von woanders kommen. Das heißt, Ist das dann wiederum eine Möglichkeit der Einflussnahme, Manipulation, Netzwerke, die das ganze Internet wieder überfluten können mit Inhalten, die sie dann eben optimiert, strukturiert, so wie Raoul eben gesagt hat, hineinbringen können? Und wie seht ihr das? Also seht ihr da eine große Möglichkeit? Ist das eine Chance für kleine Brands? Ist das eine Chance für große Brands? Schneiden sich Brands, die sich da komplett rausnehmen aus dem ganzen AI-Game und das mit Vorsicht betrachten so ein bisschen ins eigene Fleisch. Was wäre eure Meinung dazu?
Ja, interessante Frage, die du stellst. Ich glaube, wenn es jetzt um so dieses ganze New York Times verklagt, OpenAI und so geht, da geht es um grundlegendere Themen ja auch. Da geht es um Themen wie werden Daten überhaupt genutzt und verarbeitet und zum Training herangezogen, weil das dann schon ganz schöne Datenmengen sind, die auch historisches Wissen abbilden und gar nicht so die täglichen News. Auf der anderen Seite eben, wenn es um tägliche News geht, glaube ich nicht, dass du als Website so ein riesen Incentive hast, das alles von KI crawlen zu lassen, weil dann halt die KI dir vielleicht irgendwann mal deine News of the day zeigt und dann hast du halt absolut kein Interesse mehr auf diese Seite zu gehen, sie können keine Ads verkaufen. Auf der anderen Seite, wenn du halt nach konkreten News suchst, irgendwie, was hat Person X heute gemacht, da gibt es halt einen New York Times Artikel, das CNN Artikel dazu, den KI nicht crawlen kann, die sieht vielleicht, dass es den gibt, weil da in irgendwelchen Suchresultaten auftaucht, kann aber da nicht drauf.
Natürlich wird es weitergehen und weitersuchen und die nächste beste Seite nehmen. Und dann sagen wir schauen uns das an und zitieren diese Informationen und nehmen diese Informationen auch als Wahrheit dann. Was heißt, was halt dann auf der New York Times-Seite entsteht, wird dann halt ignoriert und ein kleinerer Player hat die Chance reingezogen zu werden. Das gilt für ziemlich alle Bereiche. Das heißt, wenn du nicht da bist, dann wird dann es halt jemand anders da. Von dem her entstehen aus meiner Sicht schon Chancen, aber es ist auch kein gangbarer Weg für die meisten Webseiten mehr, einfach real zu blockieren. Ich glaube, das ist so ein bisschen gerade eine unklare Phase, aber so meine Empfehlung wäre schon, lass alles crawlen außer irgendwie rechtlich kritischen Themen, irgendwelche Themen, die wirklich hinter Paywalls sind und so, die du einfach nicht anbieten aber ansonsten würde ich alles, alles, alles crawlen lassen. Und die Welt ist ja auch schon so vernetzt, alles was hinter einem Paywall ist, ist dann nächsten zwei Minuten auf X, auf irgendwelchen anderen Plattformen, die dann doch crawlbar sind.
Somit bin ich auch voll dabei und ich bin auch, ihr seht das ja auch, dass LLMs sind Too big to fail und ich rede jetzt nicht über ein Unternehmen wie ChatGPT, sondern generell. Den Weg zurück gibt es nicht mehr. Und entweder adapt or die. Und adapt ist meiner Meinung nach nicht sie zu blockieren. Ich habe jetzt ein paar Ansätze gesehen, die kennen sie alle, mit 403 pay to fetch Sachen zu arbeiten. Aber das ist noch nicht ausgereift. Nicht durchgesetzt. Man weiß jetzt nicht, ob das überhaupt kommt.
Was du, Oguzhan, aber angemerkt hast, das sind dann aber, das ist schon soziale auch, Implikation ist, dass ich die Basis von den vertrauenswürdigen Medien zu wenig vertrauenswürdigen Medien auf so eine Art und Weise sehr schnell kippen kann. Wenn so ein großer Player mit 100 Jahren oder 50 Jahren Erfahrung und Trust jetzt ausschließen und dann verschiebt sich das automatisch. Das ist also technisch gesehen. Auf andere Quellen, die dubios sind, das ist ein Punkt. Da geht die Qualität nach unten auf jeden Fall. Der andere Punkt ist in dieser agentic-Ära, wo man mit Agents, Bots, skalierbaren Inhalten, Prozessen, Netz mit beliebigen Informationen, die deine Agenda unterstützen futtern kann und wenn man noch ein bisschen Wissen hat wie die LLMs arbeiten ist das nicht so schwer, wird das Thema noch noch geschärft, wird das Thema noch kritischer. Das sind aber eher dann soziale Auswirkungen, die bisher noch keiner so...
Ja, bin ich bei dir. Also es muss ja nicht immer soziale Auswirkungen, ich denke immer aus dem Bereich der Suchmaschinenoptimierung, Das heißt, welche Chancen ergeben sich auch für kleine Brands, für Enterprises vielleicht zu sagen, okay, ganz früher gab es mal diese Netzwerke, die aufgebaut wurden, um Backlinks zu generieren, ob quasi so eine Ära gerade wieder zurückkommt. Ich erinnere mich an dunkle Zeiten, wo es mal 200, 300, 400 Domains gab, die man aufgebaut hat und Sachen gemacht hat, um Autorität zu erzeugen. Ist das nicht auch wieder so ein Tor, was man da aufstößt?
Das wird dann wieder Zukunftsthema sein, weil die AIs werden natürlich auch wieder Wege finden, wie es Google gefunden hat in der Vergangenheit, das zu unterbinden. Aber ich sehe da schon das eine oder andere, was da aufgeht. Habt ihr da schon Sachen gesehen, entdeckt? Ich glaube Raoul, du hast letztens noch mal ein paar Sachen geshared, da ging es um, du hast eine, ich glaube Suchanfrage, ich weiß gar nicht mehr, ob es im Financial-Bereich war oder im Health-Bereich, dass dann plötzlich ganz weirde Domains gerankt haben, obwohl dort erwartungsgemäß eigentlich starke Enterprise Brands hätten sein müssen?
Ich muss erstmal lachen, man hat diese Seiten aufgebaut. Der Mann war der Mann. Ich habe auch keine Ahnung, wer sowas gemacht hat. Ja ich mein also so ich glaube da haben wir letzten Podcast auch schon darüber geredet. Aktueller ist es halt so ein bisschen eine Wildwestphase, eine Phase wo halt auch viel ausprobiert wird. Eine Phase wo die LLMs auch nicht so richtig hinterher kommen, wo dann halt Sachen im Hintergrund passieren, dass hat diese Fan-out, also diese Suchanfragen, die die AI stellt, um ihre Informationen reinzuziehen, teilweise auf Englisch formuliert sind, teilweise so formuliert sind, dass es halt extrem in Longtail reingeht.
Und das wissen ja alle, im Longtail kannst du halt auch mit kleineren Seiten ranken. Das heißt, die Seiten, die dann halt dort für den Longtail irgendwo eine Suchanfrage bedienen können, können dann auch reingezogen werden. Also ich glaube wir werden da ganz viel sehen. Das wird sich noch extrem extrem wandeln. Leute werden Wissens auszunutzen. KI wird dann irgendwann merken, sie müssen was dagegen tun. Ich glaube generell ist es eher so, die spannende Frage ist, wie pendelt sich das ein? Weil aktuell ist die KI darauf angewiesen, Quellen reinzuziehen, um ihre Lerndaten zu untermauern, um Halluzinationen, was ein Riesenproblem gerade im Anfang von kommerzieller KI war, das versuchen die damit zu vermeiden, dass sie sagen, wir haben das von den und den Quellen, die auch zitieren, sich da auch so ein bisschen aus der Verantwortung nehmen damit.
Aber irgendwann wirst du das Problem haben, dass es kaum mehr Incentives gibt, diese Informationen zu erstellen. Sebastjan hat ja gerade über den Informationbereich gesprochen. Wenn da kein Traffic mehr aufgebaut wird, wenn da auch keine relevantes Branding mehr drüber aufgebaut wird, ja warum soll man dann überhaupt diese Inhalte erstellen? SEO war immer ein sehr starkes Argument. Google hat auch sehr viel getan, dass die Leute vom Gedankengang sehr viel in Richtung Trust gemacht haben. Fact-Checking, weil auch gesagt hat, das sind uns wichtige Themen. Wenn das nicht mehr da ist, wenn du da nicht mehr dran gewinnen kannst, wird das halt irgendwann auch niemand mehr machen.
Insbesondere wird das niemand mehr händisch machen, also jemanden hinsetzen, der das wirklich recherchiert, der das alles factcheckt. Sondern die Leute werden das mit KI machen. Und dann hat irgendwann auch die KI ein Problem. Weil diese, die können dann halt oder auch auch News, wenn du Du sagst, es gibt kein Incentive News zu machen, die du KI zur Verfügung stellst, außer halt irgendwie als der ein, der zehnte Spam-Anbieter reinzukommen, weil die anderen keinen Bock haben. Dann hat irgendwann die KI Probleme. Das heißt, das wird sich schon irgendwo einpendeln, denke ich.
Sehe das ähnlich wie damals in unseren Zeiten auch als eine Chance für die, ein bisschen in diesem Graubereich auch spielen wollen, aber nicht zu stark. Die Chance auch zu nutzen und diesen Zug aufzuspringen, wenn du eine kleine Marke bist oder ein Startup der irgendwo Traction braucht und überhaupt den ersten Nutzern die erste Conversion sucht, aber sich davon nicht abhängig zu machen, weil früher oder später kommt die Rechnung. Bis diese Rechnung gekommen ist, solltest du aber aus dem Umsatz doch qualitativ hochwertige Marke aufbauen und nicht davon abhängig werden.
Das war die Zusammenfassung von 25-jährigen SEO-Karriere. Heute würde ich das anders machen als damals. Ich war ein Junkie für Black Hat. Aber es gab sehr viele Unternehmen, die dann gestartet sind und die das schlauer gemacht haben und dann Megabrands aufgebaut haben und nie Penalties bekommen haben und dass diese Welle richtig gut gesurft haben. Da gibt es auch andere, die auf die Fresse gefallen sind. Da kennen wir ja auch. Da haben wir nichts mehr zu tun.
Also wir haben jetzt eine gute halbe Stunde voll gemacht. Was haben wir heute besprochen? Heute ging es um das Thema AI wieder einmal und da vor allen Dingen um das Thema Crawling und wie stark diese AI-Bots auch schon unterwegs sind. Wir haben kurz angerissen das Thema JavaScript, Rendering, nicht Rendering, welche Kapazitäten haben die LLMs gerade, die Bots, die gerade unterwegs sind und auch kurz einen Blick da rein geworfen, wie viele Suchanfragen mittlerweile diese LLMs schon stellen, weil vom Traffic her gefühlt ist es immer noch im sehr kleinen einstelligen Prozentbereich. Ich würde sagen bis zu fünf Prozent je nachdem was für eine Plattform man gerade ist. Das wächst zwar relativ stark auch, aber im Verhältnis zu den Crawling-Anfragen, die da rausgehen, ist das natürlich nichts von dem was da gerade ankommt und das ist auch das was Sebastjan auch gerade gesagt hat. Du deliverst, du deliverst und am Ende muss man gucken was dann Traffic auch bei dir ankommt und wie lange du noch deliveren willst und kannst, wenn da nichts ankommt.
Ich glaube auch, dass die LLMs dort eine Art Umdenken einleiten müssen. Aber das ist alles Zukunftsmusik. Im Augenblick fühlt es sich für mich eher an nach Evolution. Der nächste Step ist es wieder das Thema Search. Es sind wieder die SEOs, die mit als erstes aufspringen. Es sind aus meiner Sicht immer noch sehr, sehr ähnliche Spielregeln, wie wir bisher gehabt haben. Ich habe das Gefühl, dass die Community sehr gut versteht, was da gerade passiert, im Gegensatz zu anderen Communities vielleicht und dass das eine Chance ist für viele. Würdet ihr damit eingehen? Passt das so für euch? Du kriegst immer mein Ja, Oguzhan, ist ein gutes Endwort.
Wir wollten, glaube ich, mit dem Learning immer noch das Ganze oder mit einem strategischen Take-Away, dass wir wirklich was draus machen, ganz mit rausgehen aus diesen Podcasts. Was wäre eure strategische Empfehlung, die für viele Gültigkeit besitzen würde? Wir wissen immer, es gibt immer nicht immer spezielle Themen, aber was kann man hier mitnehmen?
Also ich würde erstmal sagen, block nichts, außer was du halt auch wirklich auf noindex setzen würdest. Und mein anderes Take-Away, was ich vorhin erwähnt habe, versucht zu verstehen, was KI an deinem Content sieht und was sie nicht sehen und was du machen kannst, um diesen Content so zu optimieren, dass sie den KI entsprechend richtig interpretieren rausziehen kann. Aber das hilft dir auch für alles, was kommt, unabhängig von dem, was wir heute sehen.
Ja und das ist mein Mantra, schon seit immer gewesen, passt auch heute dazu, baut eure Marke auf. Marke schützt euch vor allen großen Ereignissen in dieser KI-Welt. Und was sich jetzt, meine Meinung nach geändert hat, ist früher haben SEOs Inhalte geschrieben, über die mal auch die Marke profitiert hat. Heute in AI-Welt versuchen wir direkt Marke zu positionieren, von dem dann SEOs profitiert. Also Marke, Marke, Marke und da werden die SEOs überleben, die das verinnerlicht haben und den Kunden da auch helfen können. Und das nimmt alles zusammen, was wir auch heute besprochen haben. Ich finde das wichtig. Dann danke ich für den heutigen Podcast. Danke für euren Inputs. Ich bin gespannt auf das nächste Thema. Der Ball liegt dann glaube ich bei Raoul. Ich bin gespannt was um die Ecke kommt und was wir in der Dreierrunde Runde wieder zusammen bekommen.
Nee, das ist das Wichtigste natürlich, was man am Ende von so einem Podcast sagt, vergessen. Die Leute so überall auf die Daumen nach oben drücken, auf die fünf Sterne drücken, Kommentare lassen, teilen, folgen, Jünger werden von diesem Podcast, dass wir weiter diese Predigt fortführen. Das ist mein Wort des Tages. Ich glaube wir sharen auch gerne unsere Black Hat Vergangenheit mit euch, falls euch das interessiert. Dann sind wir am nächsten Tag. Dafür werden wir auch die eine oder andere Folge noch machen, nämlich an. Ich glaube auch. Also meine Lieben, macht es gut und bis zur nächsten Folge. Danke. Tschau. Bye bye.

Dranbleiben

Neue Folgen gibt es jede Woche. Wir kündigen sie auf LinkedIn an.

Auf LinkedIn folgen

Weitere Folgen

Folge 18

28. September 2026 · 37 Min.

Citation Building vs. Linkbuilding: Die neue Königsdisziplin im KI-Marketing

Rund 85 Prozent aller Markennennungen in KI-Antworten stammen laut einer aktuellen Studie nicht von der eigenen Website, sondern aus Drittquellen. Ist die eigene Seite damit überhaupt noch etwas wert, und ist Citation Building die neue Königsdisziplin oder nur Linkbuilding im neuen Gewand? Genau diesen Fragen gehen Raoul, Oguzhan und Sebastjan nach, mit Zahlen aus ihren eigenen Projekten. Es geht um Vergleichstabellen, Reddit und YouTube als Fundorte der Modelle, um Sentiment-Lücken, die sich per Citation schließen lassen, und um Freshness als Hebel, der innerhalb von Stunden wirkt. Am Ende sortiert das Spiel „Tot, Zombie oder quicklebendig“, welche Taktiken 2026 noch tragen.

Folge 17

21. September 2026 · 32 Min.

AI im E-Commerce: Diese Automatisierungen laufen wirklich

89 Prozent aller Retailer sagen, dass sie KI einsetzen. Wie viel davon im Alltag wirklich läuft, ist eine andere Frage. Genau der gehen Raoul, Oguzhan und Sebastjan in dieser Folge nach, mit Beispielen aus ihren eigenen Projekten. Sie sprechen über Monitoring, Produktfeeds, automatisch erzeugte Kategorieseiten und KI-Bilder und zeigen, wo die Technik heute noch abreißt. Am Ende klärt das Spiel „Prompt oder Praktikant?“, welche Arbeit beim Menschen bleibt.

Folge 16

14. September 2026 · 33 Min.

KI im E-Commerce: Sichtbar sein reicht nicht mehr

64 Prozent der Online-Shopper nutzen KI beim Einkaufen. In den Analytics vieler Shops kommt trotzdem weniger als ein Prozent Traffic daraus. Wie beides gleichzeitig stimmen kann, klären Raoul, Oguzhan und Sebastjan in dieser Folge. Sie sprechen über Sichtbarkeit, Citations und Sentiment und zeigen, was das für Messung und Budget bedeutet. Am Ende sortiert das Spiel „Ship it oder Skip it“, welche Maßnahmen sich jetzt lohnen.

Drei Männer stehen nebeneinander vor einer weißen Wand

Buzzsozial // Jede Woche eine neue Folge

Mitmachen

Gast werden oder Thema vorschlagen

Du hast eine Meinung zu KI im Marketing oder ein Thema, das wir besprechen sollten? Schreib uns, wir lesen alles.