Onpage reicht nicht für KI-Sichtbarkeit: SEO im Ohr - Folge 420

Show notes

Auch wenn SEO eine wichtige Grundlage für die KI-Optimierung ist, reicht Onpage häufig nicht aus, um die Sichtbarkeit einer Website in der KI-Suche spürbar zu steigern. Das gilt insbesondere für Bereiche wie News.

Der Abruf externer Ressourcen zählt für Google nicht zum Crawl-Budget einer Website.

Cloudflare kann unter Umständen den Zugang des Googlebots zu einer Website blockieren. Grund ist eine neue Funktion zur Handhabung von KI-Bots.

Es gibt Anzeichen dafür, dass Google bald nur noch im eingeloggten Zustand nutzbar sein könnte.

In vielen KI-Suchen gibt es ein Problem, Spam zuverlässig zu erkennen. Google scheint solche Probleme dagegen kaum zu haben.

Show transcript

00:00:00: Hallo und herzlich willkommen zu einer neuen Ausgabe von SEO im Ohr, eurem SEO-Podcast hier auf SEO Südwest wie immer mit den aktuellsten SEO News der Woche.

00:00:25: In dieser Woche dreht sich einiges um Scrawlen.

00:00:29: Da bin ich auf ein paar interessante Meldungen gestoßen, die ich euch nicht vorenthalten möchte und wir beschäftigen uns außerdem mit der Frage warum On-Page-SEO oftmals nicht ausreicht, um mehr Sichtbarkeit in der KI Suche zu bekommen?

00:00:45: Ja das und mehr!

00:00:46: In diese Ausgabe von SEO im Ohr.

00:00:48: schön dass ihr dabei seid und fangen wir gleich mal an.

00:00:53: Und da bin ich mal wieder auf eine interessante Antwort von John Müller gestoßen.

00:00:59: Es ging um das CrawlBudget bzw.

00:01:03: um die Frage, ob der Abruf von externen Ressourcen auf einer Website zum Crawlbudget der Website zählt?

00:01:12: Gerade für große Websites mit vielen Tausenden von URLs kann das Crawlerbudget von Google ja eine Rolle spielen und es kommt darauf an, das Crawl so zu steuern.

00:01:21: Dass Google die wichtigsten URLs abrufen kann und dass Änderungen und neue Inhalte möglichst schnell erkannt werden.

00:01:28: Und wenn auf einer Website Ressourcen von Drittanbieter genutzt werden wie zum Beispiel Grafiken, Bewertungen andere Inhalten in Iframes

00:01:36: usw.,

00:01:38: dann zählt das nicht zum Crawl Budget der Website.

00:01:40: Das bestätigte jetzt John Müller auf BlueSky Das Crawling werde spezifisch für die abgefragte Ressource gerechnet, unabhängig davon wo sie eingebunden ist und das Ziel sei es dass die Zahl der Request an den Server für diesen keine Probleme erzeugen.

00:01:58: Und das ist eine wichtige Information bei der Berechnung des Crawl Budgets und möglicher Maßnahmen zum reduzierende Abrufe kann man sich damit auf die Ressourcen konzentrieren die auf dem eigenen Server gehostet werden.

00:02:11: Ja und noch eine Meldung und zwar gibt es Meldungen darüber, dass Cloudflare den Zugriff des Googlebots auf Webseiten blockieren kann.

00:02:20: Eine mögliche Ursache dafür sind die neuen Einstellungen zum Blockieren von KI-Bots.

00:02:26: Auf Reddit hat dazu ein Nutzer geschrieben, er habe das neue Cloudflare-Feature für KI-Bots getestet und dabei sei etwas Unerwartetes passiert.

00:02:34: Wenn er die Einstellungen für Bots, die zum Trainieren von KI Modellen genutzt werden auf Blog setzt dann würden sowohl der Googlebot als auch der Bingbott fournul drei Antworten erhalten wenn sie versuchen die SideMap abzurufen.

00:02:49: Nach dem deaktivieren diese Einstellung funktioniert Abruf aber wieder normal.

00:02:55: Zum Hintergrund Cloudflare hat er Anfang Juli angekündigt ab dem fünften September bei Crawlern, die für verschiedene Zwecke eingesetzt werden standardmäßig die welt jeweils strikteste Einstellung zu verwenden.

00:03:08: wenn ein Bot zum Beispiel zum Indexieren für die Suche aber auch für das Training von KI Modellen eingesetzt wird kann Dann erhält dieser zukünftig keinen Zugriff mehr auf Webseiten, auf denen es Werbung gibt.

00:03:20: Es sei denn man wählt selbst eine andere Einstellung und der Autor des Beitrags auf Reddit fügte hinzu dass sich dabei nicht um ein Test mit einem imitierten Googlebot gehandelt habe.

00:03:31: das Dashboard in Cloudflare selbst habe angezeigt dass Googlebot und Bingbot blockiert seien und der Google Search Konsole sein für den entsprechenden Zeitraum auch die Fehlermeldungen aufgetaucht.

00:03:43: Von Cloudflare gibt es dazu bisher keine Reaktion weder im Thread of Reddit noch in Form einer Pressemitteilung.

00:03:52: Ja, etwas was auch bemerkenswert ist auf das verschiedene Nutzerinnen und Nutzern dieser Woche gestoßen sind – das ist ein Hinweis!

00:04:00: In der Google Suche, und zwar fordert Google in manchen Sitzungen dazu auf sich anzumelden um die Suche zu nutzen.

00:04:07: Und damit sollen offenbar KI Scraper ausgesperrt werden.

00:04:11: Das führt zur Frage ob die Google-Suche bald nur noch im eingelockten Zustand verfügbar ist?

00:04:16: In dieser Meldung heißt es Man solle sich zum Fortfahren anmelden und damit bestätigen dass man ein Mensch ist um dann auch weitere Ergebnisse sehen zu können.

00:04:30: Und schon bisher war es ja möglich, dass Google während einer Session geprüft hat ob ein Mensch vor dem Rechner sitzt.

00:04:35: Das fand allerdings in Form eines Captures statt also... eine Art von Bilderrätsel, dass man lösen und dann das Ergebnis eintragen musste.

00:04:43: Ein Log-in war dabei aber nicht notwendig.

00:04:46: Und Google sieht sich in letzter Zeit verstärkten Zugriffen durch Scraper ausgesetzt die Suchergebnisse abgreifen um sie zum Beispiel für KI-Plattform zur Verfügung zu stellen.

00:04:56: erst zuletzt war Google mit einer Klage gegen das Unternehmen's Serb API gescheitert und gut möglich, dass die Abfrage eine direkte Reaktion darauf ist.

00:05:04: also es ist durchaus denkbar dass wir zukünftig, wenn wir die Google-Suche nutzen wollen uns dazu anmelden müssen.

00:05:14: Ja zum Thema KI Suche auch noch eine weitere Meldung, die interessant ist und es gibt da eine aktuelle Untersuchung, diese Ergebnisse kamen das viele KI Suchen ein Spam Problem haben Google allerdings nicht.

00:05:29: Spam-Websites sind insbesondere für KI-Plattformen wie ChatGPT oder Microsoft Co.

00:05:34: Pilot ein großes Problem und das zeigen auch aktuelle Untersuchungen von AHRFs.

00:05:40: ChatGPPT zitierte dabei im vergangenen Monat achtzig Spam Websites bei Perplexity waren es dreihunddreißig, beim Microsoft Co.-Pilot sogar hundertzweiundzwanzig und Google zeigte dagegen in den AI Overviews keine einzige Spam Webseite an.

00:05:57: Und um diese Zahlen zu ermitteln, wurden mithilfe des Ahrefs Brandradar die tausend am häufigsten zitierten Websites je Plattform innerhalb der letzten sechs Monate untersucht.

00:06:09: Eine weitere Erkenntnis, die dabei entstand war das unter den am häufigst zitierten Webseiten sich bei ChatGPT Microsoft Co-Pilot und Perplexity viele komplett ohne traditionellen Suche Traffic befunden haben.

00:06:27: Und unter den tausend häufigsten Domains waren das bei ChatGPT-Fünfzig, ungefähr beim Co-Pilot rund neunzig und bei Perplexity um die vierzig.

00:06:37: Auch hier lag der Wert bei Google zuletzt bei Null Auch wenn der fehlende Suche-Traffic für sich genommen noch kein Beleg für Spam ist, ist es immerhin ein starkes Indiz.

00:06:46: Um den Spam-Charakter zu prüfen, schauten sich die Autoren dann weitere Merkmale der betreffenden Websites an und haben dann Eigenschaften gefunden wie Fake-Autoren oder fehlender Autorenangaben Tausende von KI-generierte Artikel, ohne klar umrisches Thema oder auch Online-Shops die mit mehr als hunderttausend Produkten beladen waren.

00:07:09: Und die Ergebnisse zeigten auch man muss nicht zwingend in der klassischen Suche präsent sein um in ChatGPT per Plexity und Code zu ranken.

00:07:17: für Google selbst also die AI Overviews und den AI Mode da gilt das nicht.

00:07:22: Nur weil eine Website vorübergehend in den KI-Ergebnissen erwähnt wird, heißt das aber auch nicht dass es so bleiben muss.

00:07:28: Es wäre also fahrlässig für eine kurzfristige Sichtbarkeit in der KI Suche bestehende SEO Best Practices to vernachlässigen haben wir auch schon öfter darüber gesprochen.

00:07:40: ja und noch zum Thema Sichtbarkeits suche.

00:07:45: da gibt es eine neue, naja so neu ist die Erkenntnis nicht.

00:07:48: Aber es gibt eine Erkenntnis, die jetzt nochmal sich auch bestätigt hat nämlich dass oftmals on-page SEO nicht ausreicht um eine breite Sichtbarkeit in der KI Suche zu haben und das muss man ein bisschen aufdröseln.

00:08:07: also was natürlich stimmt ist, dass gute SEO auch die Basis für mehr Sichtbarkeit KI-Suche ist.

00:08:15: Allerdings ist das nur eine notwendige, aber keine hinreichende Bedingung wenn man diese Empfehlungen auf OnPage SEO begrenzt.

00:08:25: Oftmals braucht es nämlich mehr um von Chatchapity und Co erwähnt und zitiert zu werden.

00:08:29: der Grund dafür ist anders als Google fehlt den meisten KI-Plattformen ein Mechanismus mit dem sie Vertrauenswürdigkeit der Quellen zuverlässig bestimmen können.

00:08:40: Um zu vermeiden, dass Fake News und Spam ihren Weg in die Antworten finden greifen.

00:08:45: Die KI-Plattform zu einem naheliegendem Mittel.

00:08:48: statt nämlich Spamquellen auszuschließen und das Blacklisting Prinzip anzuwenden begrenzen sie von vornherein den Kreis der zitierten Quellen auf einen festen auf eine feste Auswahl von Websites und legen damit eher ein White Listing-Prinzip an.

00:09:05: Das kann man zum Beispiel bei ChatGPT beobachten, hier werden beim Query Fanout je nach Suchanfrage gezielt die Suchergebnisse von bestimmten Websites per Site Operator abgefragt.

00:09:17: Insbesondere bei Newsrelevanten suchabfragen werden fast ausschließlich große und bekannte Websites abgefragt.

00:09:24: Das hat eine aktuelle Untersuchung ergeben.

00:09:27: Bei ChatGPT ist das Verhalten besonders stark ausgeprägt, während zB Perplexity eine wesentlich größere Bandbreite an Quellen nutzt.

00:09:36: Dort scheint man bei der Bewertung der Vertrauenswürdigkeit von Quellen auch einen Schritt weiter zu sein Denn in Perplexty wird für die genutzten Quellen eine von vier Trust-Stufen angegeben.

00:09:47: Darüber hatte ich euch ja auch schon berichtet Und die Konsequenz daraus ist, eine Website hat wenn sie nicht sehr bekannt ist kaum Chancen für bestimmte Themen beim Query Fan-Out abgefragt zu werden selbst dann wenn sie komplett on page optimiert ist.

00:10:04: Die einzige Möglichkeit besteht darin auf anderen Websites erwähnt und verlinkt zu sein die sich im Kreis der von der KI gewählten Quellen befinden.

00:10:13: Das können Vor- und Beiträge auf Reddit sein, Gastbeiträge auf wissenschaftlichen Websites.

00:10:18: Erwähnungen in den Testberichten und Produktzergleichen oder auch Einträge in Verzeichnissen – je nach Thema.

00:10:24: Mittelfristig ist es wichtig an der Bekanntheit der eigenen Website bzw.

00:10:29: der eigenen Marke zu arbeiten und das gilt vor allem insensiblen Bereichen, in denen die KI-Systeme besonders sorgfältig auf ihre Quellen achten wie z.B.

00:10:37: News.

00:10:38: Eine höhere Markenbekanntheit verbessert außerdem die Chanceneingang in die Trainingsdaten der KI-Modelle zu erhalten und dann auf diesem Weg in den Antworten genannt zu werden.

00:10:49: Ja, damit sind wir auch schon wieder am Ende dieser Ausgabe von SEO im Ohr und ich freue mich sehr dass ihr wieder dabei gewesen seid und ich hoffe es war für euch wieder was Interessantes dabei!

00:11:01: In etwa einer Woche gibt's dann wieder die nächste Ausgaben von SEO Im Ohr.

00:11:05: Und nicht vergessen, täglich hier auf Seeo Südwest gibt es für euch auch die aktuellsten Seeo News.

00:11:11: Auch am Wochenende wenn etwas Wichtiges ansteht.

00:11:15: und ja dann würde ich mich freuen wenn ihr das nächste Mal auch wieder dabei seid und sage bis dann Tschüss, euer Christian.

New comment

Your name or nickname, will be shown publicly
At least 10 characters long
By submitting your comment you agree that the content of the field "Name or nickname" will be stored and shown publicly next to your comment. Using your real name is optional.