OBENAN RESEARCH · EXPLORATIVE ERSTAUSGABE

Sichtbarkeit in der Suche ist nicht Sichtbarkeit in der KI

An einem Tag verglichen wir die Google-Maps-Vergleichsgruppe für eine Restaurantfrage in Amsterdam, Berlin und Barcelona mit den Empfehlungen von ChatGPT und Claude zur gleichen Frage.

Wie viele der ersten drei Restaurants jeder Google-Maps-Vergleichsgruppe erschienen auch unter den ersten drei von ChatGPT und Claude

0 von 3

Amsterdam

0 von 3

Berlin

1 von 3

Barcelona

Ihre Gäste suchen inzwischen an zwei Stellen, und jede antwortet aus einer anderen Liste. Leicht auffindbar zu sein ist nicht dasselbe wie empfohlen zu werden.

Wir haben Google Maps und zwei KI-Assistenten, ChatGPT und Claude, am selben Tag nach den besten Restaurants in drei europäischen Städten gefragt und jeden zurückgegebenen Namen verglichen.

Der Befund

Die Restaurants, die Google Maps zuerst nannte, waren größtenteils nicht die, die die Assistenten empfahlen

Dieselbe Frage, dieselbe Stadt, derselbe Tag. Wir haben die ersten drei Restaurants von Google Maps mit den ersten drei jedes Assistenten verglichen.

Amsterdam

0 von 3 stimmten überein

Weder ChatGPT noch Claude nahmen eines der ersten drei Google-Maps-Ergebnisse in die eigenen ersten drei auf.

Berlin

0 von 3 stimmten überein

Beide Assistenten nannten dieselben drei Restaurants in derselben Reihenfolge; keines davon stand unter den ersten drei von Google Maps.

Barcelona

1 von 3 stimmte überein

Ein Restaurant erschien unter den ersten drei von Google Maps und zugleich unter den ersten drei beider Assistenten. Es war bei beiden dasselbe.

Eine Suche pro Stadt und Assistent, an einem einzigen Tag. Genug, um zu zeigen, was wir gefunden haben. Nicht genug, um daraus eine Regel zu machen. Dies ist kein Test dafür, ob die Antworten bei wiederholten Durchläufen stabil bleiben.

Wie ein solcher Vergleich gezählt wird

Eine Suche, zwei verschiedene Listen

Illustration, keine Studienergebnisse

Restaurants, die auf Google Maps erschienen

Beispielvergleich: eine Suche, zwei verschiedene ListenEine Illustration, wie der Vergleich funktioniert, keine Studienergebnisse. Die obere Reihe zeigt Restaurants, die auf Google Maps erschienen, gekennzeichnet mit A bis F. Die untere Reihe zeigt Restaurants, die KI-Assistenten wie ChatGPT und Claude empfohlen haben, gekennzeichnet mit G, B, H, D, J und F. Eine violette Linie verbindet ein Restaurant, das in beiden Listen steht, zum Beispiel Restaurant B. Ein Restaurant ohne Linie steht nur in einer Liste.

Von KI empfohlene Restaurants (ChatGPT und Claude)

  • Violette Linie = dasselbe Restaurant steht in beiden Listen
  • Keine Linie = das Restaurant steht nur in einer Liste

Restaurant B erschien sowohl auf Google Maps als auch in der KI-Liste.

Dieses Beispiel zeigt nur, wie der Vergleich funktioniert. Die gemessenen Stadtergebnisse stehen darüber.

Was sich dadurch ändert

KI-Sichtbarkeit ist nicht Suchsichtbarkeit unter neuem Namen

Die beiden Systeme lieferten auf dieselbe Frage nicht dieselben Restaurants. Ein Betrieb, den eine Kartensuche nach vorne stellt, ist nicht automatisch ein Betrieb, den ein Assistent empfiehlt. Das sind zwei verschiedene Ergebnisse, und diese Studie hat beide gemessen.

Das ist keine Behauptung, dass die Arbeit hinter Suchergebnissen nicht mehr zählt. Das haben wir nicht getestet. Sagen können wir, dass die beiden Ergebnisse auseinandergingen; sie als eine einzige Messgröße zu behandeln hätte die Lücke vollständig verdeckt.

Die Belege, die sie zeigten

Die beiden Assistenten verwiesen auf völlig unterschiedliche Arten von Belegen

ChatGPT verlinkte die eigenen Websites der Restaurants in 46 seiner 60 Empfehlungen. Claude tat das in keiner seiner 60, in keiner Stadt.

Was jeder Assistent anzeigte

Empfehlungspositionen von jeweils 60 pro Assistent.

Verlinkte die Website des Restaurants

ChatGPT46
Claude0

Verlinkte einen Guide oder eine Auszeichnung

ChatGPT47
Claude14

Verlinkte unabhängige redaktionelle Berichte

ChatGPT18
Claude55

Verlinkte mindestens zwei verschiedene Drittseiten

ChatGPT17
Claude42
Zwei weitere Vergleiche, im selben Maßstab

Verlinkte den Guide Michelin selbst

ChatGPT42
Claude3

Verlinkte Michelin oder World's 50 Best

ChatGPT45
Claude5
Die Zeilen schließen sich nicht aus. Eine Position kann in mehreren Zeilen zählen; deshalb ergeben sie zusammen nicht 60.Beide Assistenten zeigten zusammen 238 Links zu 88 verschiedenen Websites.Das sind die Quellen, die neben den Antworten angezeigt wurden. Sie zeigen nicht alles, was die Systeme gelesen, als verlässlich bewertet oder gewichtet haben.

Das Gegenbeispiel

In Berlin waren sie sich völlig einig und zeigten trotzdem andere Belege

In Berlin nannten beide Assistenten dieselben ersten drei Restaurants in derselben Reihenfolge. Keines dieser drei Restaurants stand unter den ersten drei von Google Maps.

Claude zeigte in allen 20 Berliner Positionen keine Guide- oder Award-Quelle. ChatGPT zeigte eine bei 13 von 20.

Zwei Assistenten kamen mit unterschiedlich sichtbaren Belegen zum selben Ergebnis. Das Angezeigte ist nicht die vollständige Erklärung.

Ein Eintrag in einem Guide ist hier also nicht das Ziel. Zwei Assistenten kamen über sichtbar unterschiedliche Wege zu einer Antwort, und genau deshalb dürfen die angezeigten Links nicht als Grund für die Antwort gelesen werden.

Die beiden Assistenten kennen dieselben Restaurants. Uneinig sind sie darüber, wer zuerst kommt.

Vergleicht man ChatGPT mit Claude, und nicht einen von beiden mit Google Maps, nannten beide 12 derselben Restaurants in Amsterdam, 13 in Berlin und 10 in Barcelona, von jeweils rund dreißig genannten pro Stadt.

Auf dem Podium trennten sie sich. Berlin: 3 von 3, in derselben Reihenfolge. Barcelona: 2 von 3. Amsterdam: 0 von 3.

Bekannt zu sein ist nicht dasselbe wie gewählt zu werden. Beide Assistenten haben Ihr Restaurant vielleicht längst auf der Liste. Das ist nicht dasselbe, wie von einem der beiden zuerst genannt zu werden.

Sind sich die beiden Assistenten untereinander einig?

Berlin

Dieselben Top 3, in derselben Reihenfolge

ChatGPT und Claude im direkten Vergleich, und in derselben Reihenfolge

Beide Assistenten begannen mit denselben drei Restaurants auf Platz eins, zwei und drei.

Gegenüber den ersten drei von Google Maps stimmten in derselben Stadt 0 von 3 überein.

Alle 20 Positionen für Berlin anzeigen

Eine gerade Linie bedeutet, dass beide Assistenten dasselbe Restaurant auf dieselbe Position gesetzt haben. Eine kreuzende Linie bedeutet, dass sie sich beim Restaurant einig waren, es aber unterschiedlich eingeordnet haben.

ChatGPT

Claude

11020
13 von beiden Assistenten genannte Restaurants; 27 Restaurants in beiden Listen zusammen.

Barcelona

2 der ersten 3 stimmten überein

ChatGPT und Claude im direkten Vergleich, dieselbe erste Wahl

Bei der ersten Wahl waren sie sich einig, darunter ging die Reihenfolge auseinander.

Gegenüber den ersten drei von Google Maps stimmten in derselben Stadt 1 von 3 überein.

Alle 20 Positionen für Barcelona anzeigen

Eine gerade Linie bedeutet, dass beide Assistenten dasselbe Restaurant auf dieselbe Position gesetzt haben. Eine kreuzende Linie bedeutet, dass sie sich beim Restaurant einig waren, es aber unterschiedlich eingeordnet haben.

ChatGPT

Claude

11020
10 von beiden Assistenten genannte Restaurants; 30 Restaurants in beiden Listen zusammen.

Amsterdam

0 der ersten 3 stimmten überein

ChatGPT und Claude im direkten Vergleich, keine Übereinstimmung

Keiner der Assistenten setzte eines der Top-3-Restaurants des anderen in die eigenen Top 3.

Gegenüber den ersten drei von Google Maps stimmten in derselben Stadt 0 von 3 überein.

Alle 20 Positionen für Amsterdam anzeigen

Eine gerade Linie bedeutet, dass beide Assistenten dasselbe Restaurant auf dieselbe Position gesetzt haben. Eine kreuzende Linie bedeutet, dass sie sich beim Restaurant einig waren, es aber unterschiedlich eingeordnet haben.

ChatGPT

Claude

11020
12 von beiden Assistenten genannte Restaurants; 28 Restaurants in beiden Listen zusammen.

Was das für Sie bedeutet

Unsere Interpretation: zwei verschiedene Entdeckungsaufgaben

Das Folgende ist unsere Interpretation, keine Messung. Gemessen haben wir abweichende Listen und unterschiedlich angezeigte Belege. Warum sie abweichen, ist eine Lesart dieser Belege; andere sind möglich.

Ihre eigene Website ist eine Quelle. Alles andere, was ein Assistent über Sie sehen kann, liegt ganz woanders.

Google Maps

Ist dies ein relevantes, nahes und bekanntes lokales Unternehmen?

Die Listen konzentrierten sich in jeder Stadt auf ein zentrales Viertel. Innerhalb der Listen erklärte nichts im Unternehmensprofil die Reihenfolge.

Seien Sie der klarste lokale Treffer: korrekte Angaben, passende Kategorie und echte Präsenz im bedienten Gebiet.

ChatGPT und Claude

Ist dies eine bemerkenswerte Empfehlung, die sich öffentlich belegen lässt?

Hinter ihren ersten Empfehlungen zeigten die Assistenten Guides, Awards, Presse und Stadtquellen. Claude zeigte in keiner Stadt die Restaurant-Website.

Machen Sie sich leicht überprüfbar: klare Website, konsistente Identität und unabhängige Berichte mit derselben Aussage.

Was die Belege ausschlossen

Bringen mehr Fotos, Antworten oder Bewertungen Sie nach oben?

In elf Prüfungen erklärte nichts, welche Restaurants zuerst erschienen; mehrere Signale wechselten je nach Stadt die Richtung.

Tun Sie es weiter, wenn es Kunden hilft. Erwarten Sie nicht, dass es die Position bestimmt.

Gute Auffindbarkeit auf einer Oberfläche übertrug sich nicht auf die andere. Es sind zwei verwandte Aufgaben, nicht eine.

Wo die Google-Maps-Listen lagen

Amsterdam

14 von 20

im Gebiet Amsterdam-Centrum

Berlin

18 von 20

im Gebiet Mitte

Barcelona

12 von 20

im Gebiet Ciutat Vella

Diese Viertel haben zugleich die meisten Restaurants, und wir erfassten keine Vergleichsgruppe nie erschienener Betriebe. Das zeigt, wo die Listen lagen, nicht dass ein Viertel ausgewählt wurde.

Was die Assistenten hinter ihren ersten Empfehlungen zeigten

8 of 9

ChatGPT zeigte eine Guide- oder Award-Quelle

bei seinen ersten Auswahlplätzen, darunter bei 7 eine Michelin-Quelle.

9 of 9

Claude zeigte mindestens zwei unabhängige Quellen

bei jeder seiner ersten Auswahlpositionen.

13 of 15

Guide- oder Award-Anerkennung in den Erklärungen der Assistenten

verfügbare Erklärungen zu den ersten Auswahlplätzen nannten Guide- oder Award-Anerkennung als Faktor.

Das ist, was jeder Assistent anzeigte, nicht was er verwendete. Berlin ist die Erinnerung daran: Claude zeigte in der ganzen Stadt keine Guide- oder Auszeichnungsquelle und nannte trotzdem dieselben drei Restaurants, in derselben Reihenfolge, wie ChatGPT.

Was wir ausgeschlossen haben

Was das Ergebnis nicht erklärte

Wir haben geprüft, was alle annehmen. Gäbe es eine einfache Erklärung, hätten drei Städte sie zeigen müssen. Haben sie nicht.

Jede Stadt lieferte 20 Restaurants. Jede Zeile vergleicht die Top 3 mit den übrigen 17.
Was wir geprüft habenAmsterdamBerlinBarcelonaWas es uns sagt
Bewertungen insgesamtTop 3 gegenüber den übrigen 17, gemessen in Bewertungen2,472 Bewertungen wenigerals die übrigen 171,331 Bewertungen mehrals die übrigen 174,252 Bewertungen wenigerals die übrigen 17Keine einheitliche Richtung
Bewertung über alle RezensionenTop 3 gegenüber den übrigen 17, gemessen in Sterne0.04 Sterne höherals die übrigen 170.04 Sterne niedrigerals die übrigen 170.10 Sterne höherals die übrigen 17Keine einheitliche Richtung
Bewertungen in den letzten 30 TagenTop 3 gegenüber den übrigen 17, gemessen in Bewertungen8 Bewertungen wenigerals die übrigen 1729 Bewertungen mehrals die übrigen 1720 Bewertungen wenigerals die übrigen 17Keine einheitliche Richtung

Jeder dieser Punkte zeigte in einer Stadt in die eine und in einer anderen in die entgegengesetzte Richtung. Preis und Kategorie zeigten gar nichts. Keiner davon erklärt also, welche Restaurants zuerst kamen.

Wir haben fünf weitere Erklärungen getestet. Keine hielt über drei Städte hinweg.

Mehr Fotos?

Die ersten drei hatten in Amsterdam weniger und in den beiden anderen Städten mehr.

Amsterdam: erste drei 1,221, übrige siebzehn 2,128 · Berlin: erste drei 3,841, übrige siebzehn 1,262 · Barcelona: erste drei 7,124, übrige siebzehn 3,073

Fotos, typisches Unternehmen

Mehr Fotoarten?

Kein einheitliches Muster.

Amsterdam: erste drei 11, übrige siebzehn 14 · Berlin: erste drei 12, übrige siebzehn 13 · Barcelona: erste drei 17, übrige siebzehn 15

Fotokategorien, typisches Unternehmen

Mehr Antworten auf Bewertungen?

Stark in Amsterdam, nicht vorhanden in Barcelona.

Amsterdam: erste drei 97 von 100, übrige siebzehn 53 von 100 · Berlin: erste drei 41 von 100, übrige siebzehn keine · Barcelona: erste drei 1 von 100, übrige siebzehn 3 von 100

Bewertungen mit einer Antwort des Inhabers

Mehr Bewertungen von Local Guides?

Nirgendwo eine aussagekräftige Trennung.

Amsterdam: erste drei 49 von 100, übrige siebzehn 51 von 100 · Berlin: erste drei 63 von 100, übrige siebzehn 58 von 100 · Barcelona: erste drei 42 von 100, übrige siebzehn 44 von 100

von Local Guides verfasste Bewertungen

Andere Themen in den Bewertungen?

Wir ordneten jedes Bewertungsstichwort elf Themen zu. Keines trennte die ersten drei in allen Städten von den übrigen siebzehn.

Verglichen zwischen den ersten drei und den übrigen siebzehn in jeder Stadt.

elf Themen, 412 verschiedene Bewertungsstichwörter

Fotos hinzuzufügen oder auf Bewertungen zu antworten kann für Ihre Gäste weiterhin sinnvoll sein. Diese Studie fand nicht, dass eines von beidem erklärt, welche Restaurants zuerst zurückkamen.

Warum wir eine Prüfung entfernt haben

Wir konnten die jüngsten 100 Bewertungen je Restaurant lesen. Alle 60 erreichten dieses Limit. Eine feste Zeitspanne maß daher vor allem, wie schnell sich diese 100 füllten. Wir entfernten die Prüfung, statt eine missverständliche Zahl stehen zu lassen.

Der Fall, der sich nicht drehte

Ein Hinweis hielt in allen drei Städten

In allen drei Städten hatten die ersten drei über ihre letzten 20 Bewertungen hinweg leicht bessere Wertungen. Das ist ein interessanter Hinweis, keine bewiesene Regel.

Amsterdam

Top 3
4.9 Sterne
Übrige 17
4.7 Sterne
Unterschied
+0.2 Sterne

Berlin

Top 3
4.7 Sterne
Übrige 17
4.6 Sterne
Unterschied
+0.1 Sterne

Barcelona

Top 3
4.8 Sterne
Übrige 17
4.7 Sterne
Unterschied
+0.1 Sterne

Vielversprechend, aber die Stichprobe ist zu klein für eine Regel.

Jede dieser Spitzengruppen umfasst nur drei Restaurants. Es ist das Einzige, das sich über drei Städte hinweg nicht selbst widersprach, und genau das prüfen wir als Nächstes.

Was wir weiterhin nicht sagen können
  • Jede Spitzengruppe umfasst drei Restaurants, keiner der drei Unterschiede trägt also für sich allein.
  • Wir konnten nur die jüngsten 100 Bewertungen je Restaurant lesen. War dieses Limit erreicht, lagen ältere Bewertungen außerhalb der Messung. Deshalb ist auch die 90-Tage-Zahl die schwächste der vier Prüfungen: Fast die Hälfte erreichte das Limit innerhalb von 90 Tagen.
  • Die Reihenfolge, in der diese Restaurants zurückkamen, ist noch nicht unabhängig bestätigt.

Zwei Stellen, die Sie prüfen sollten

Zwei Prüfungen, nicht eine

Gäste nutzen beide Stellen, also lohnt sich ein Blick auf beide. Jede Prüfung betrachtet nur eine davon, und keine wiederholt diese Studie.

KI-Assistenten

Sehen Sie, wie die KI Ihr Unternehmen beschreibt

Prüfen Sie, was KI-Assistenten heute über Sie finden. Diese Prüfung sagt Ihnen nicht, wo Sie auf Google Maps erscheinen.

KI-Präsenz prüfen

Google Maps

Prüfen Sie, wo Sie auf Google Maps erscheinen

Prüfen Sie, wo Ihr Betrieb bei einer Suche zu einem Zeitpunkt steht. Es betrachtet nur Ihren Betrieb und wiederholt nicht den Drei-Städte-Vergleich auf dieser Seite.

Google-Maps-Sichtbarkeit prüfen

Wie wir vorgegangen sind

Wie der Vergleich funktioniert hat

1

Dieselbe Frage stellen

Wir haben Google Maps und den KI-Assistenten in jeder Stadt dieselbe Restaurantfrage gestellt.

2

Beide Listen erfassen

Wir haben jedes zurückgegebene Restaurant gespeichert, genau so, wie es kam.

3

Sehen, welche in beiden stehen

Wir haben beide Listen verglichen, um die Restaurants zu finden, die in beiden genannt wurden.

Das technische Detail, für alle, die es wollen
Isolierte Sitzungen
Jeder Assistent wurde pro Stadt einmal befragt, in einer frischen, abgemeldeten Sitzung.
Wiederholung
Dies ist eine explorative Momentaufnahme eines Tages und kein Test, ob die Antworten über wiederholte Durchläufe stabil bleiben.
Herkunft
Herkunft bedeutet, woher die Daten stammen. Für jede Liste sind die exakte Anfrage, die Einstellungen, der Standortkontext und der Erhebungszeitpunkt festgehalten.
Identitätsauflösung
Identitätsauflösung heißt zu bestätigen, dass zwei Namen dasselbe Unternehmen meinen. Wo das nicht bestätigt werden konnte, bleibt das Paar getrennt und wird als mehrdeutig ausgewiesen.
Unsicherheit und fehlende Belege
Alles, was nicht verifiziert werden konnte, wird als nicht verfügbar ausgewiesen, statt mit einer Annahme gefüllt zu werden.

Diese Methode kann nicht zeigen, warum ein Restaurant erschien, kann für keine der beiden Stellen ein dauerhaftes Muster belegen und kann keine stadtweite Google-Maps-Position ausweisen.

Die Arbeit dahinter

Was wir tatsächlich ausgewertet haben

Das war kein Ein-Prompt-Experiment. Wir haben zwei KI-Assistenten in drei Städten dieselbe Frage gestellt, jede gerankte Empfehlung erfasst statt nur der Gewinner, jeden Assistenten um eine Erklärung gebeten und diese Antworten behalten, die Restaurants über alle Listen hinweg anhand von Adresse und offizieller Domain abgeglichen und das öffentliche Unternehmensprofil dahinter gelesen.

Insgesamt

120,548

analysierte Datenwerte

Jedes befüllte Feld aus 60 Standorten, aus 253 verschiedenen Datenfeldern: 215 im Unternehmensprofil und 38 in jeder Bewertung. Rund 2.009 Werte je Standort.

Was wir fragten

3

Städte

Amsterdam, Berlin, Barcelona

2

AI-Assistenten

bekamen dieselbe Frage

6

vollständige Ranglisten

vollständig erfasst, keine Stichprobe

Was wir erfassten

120

geordnete Empfehlungen

jede Position, nicht nur die Gewinner

5

nachträgliche Erklärungen

wir fragten beide Assistenten nach dem Warum und speicherten die Antworten

60

öffentliche Unternehmensprofile

Bewertung, Standort, Kategorie, Preis, Bewertungshistorie

Was wir lasen

6,000

einzelne Bewertungen

über alle 60 Profile einzeln gelesen

2,009

Datenwerte je Standort

im Mittel über jedes befüllte Feld

253

verschiedene Datenfelder

215 im Profil und 38 in jeder Bewertung

Was wir prüften

238

Quellenlinks

jeder von den Assistenten angezeigte Link

88

verschiedene Quellwebsites

Guides, Stadtseiten, Presse, offizielle Seiten

5

bestätigte Listenüberschneidungen

und 3 unsichere, die wir nicht zusammenführten

Was wir dafür geöffnet haben

249,557

Fotos in 60 Unternehmen gezählt

178

verschiedene Fotokategorien

412

Bewertungsstichwörter, in 11 Themen gruppiert

60

Unternehmensprofile Feld für Feld gelesen

Das alles hatte einen Grund. Nicht herauszufinden, welche Restaurants erschienen, sondern was die sichtbaren gemeinsam hatten, worin sich KI-Empfehlungen von dem unterschieden, was eine Kartensuche zurückgab, und welche Erklärungen nach drei Städten statt einer noch standen.

Bevor Sie das verwenden

Wie diese Studie zu lesen ist

Was diese Studie belegt und was nicht

  • Dies ist eine explorative Momentaufnahme eines Tages in drei Städten.
  • Sie zeigt beobachtete Muster, keine Ursache und keine garantierte Rankingformel.
  • Künftige Ausgaben wiederholen die AI- und Maps-Prüfungen; die Schlussfolgerungen können sich ändern.
Wie jede Aussage gekennzeichnet ist
Jede veröffentlichte Aussage trägt eine dieser Kennzeichnungen
KennzeichnungWas sie bedeutet
GemessenDirekt aus den geprüften Belegen gezählt
BeobachtetIn einer Quelle gesehen, keine allgemeine Regel
ModellangabeWas ein KI-Assistent über seine eigene Antwort gesagt hat
AbgeleitetUnsere Lesart, mit Nennung anderer Erklärungen
Nicht verfügbarWir haben danach gefragt und konnten es nicht verifizieren

Wie es weitergeht

Wir führen sie erneut durch

Ein Tag ist eine Momentaufnahme. Die nächste Ausgabe wiederholt dieselbe Frage in denselben Städten, mehrfach, damit wir ein Muster von einem Zufall unterscheiden können. Restaurants sind die erste Ausgabe.