Obenan BriefingHoofdbriefing
Op de lijst staan is niet hetzelfde als gekozen worden
Genoemd worden, als eerste genoemd worden en juist beschreven worden zijn aparte problemen. Een zevendaagse studie op Bali meet ze apart, zonder rankingrecept.
De kern in één zin
Verschillende problemen vragen om verschillende oplossingen. Eén antwoord kan je niet vertellen welk probleem je hebt. Het is één uitkomst van één systeem, één vraag, één plaats, één taal en één moment.
De onderbouwing
85,6%minstens
van die zaken werd door geen van de vier systemen ooit aanbevolen.
BronVolledig artikel in HTML op arXivVolledig arXiv-artikel, resultaten. Gecontroleerd op 30 augustus 2026 en opnieuw op 2 september 2026.
- Gepubliceerd
- 5 september 2026
- Formaat
- Hoofdbriefing
- Bronnen
- 2 primaire, openbare bronnen
- Onderbouwing
- Vooraf geregistreerd observationeel onderzoek, openbare voorpublicatie over twee deelmarkten op Bali
In twee deelmarkten op Bali werd het merendeel van de zaken door geen van de vier onderzochte AI-systemen genoemd. Sommige antwoorden verwezen nog naar gesloten bedrijven. Dat zijn verschillende problemen, en geen van beide verdwijnt met een truc om hoger te komen.
01De situatie
Een antwoord dat je overslaat laat geen spoor achter
Denkbeeldige situatieEen verzonnen situatie om uit te leggen hoe het werkt. Er wordt geen echt bedrijf, echte klant of werkelijk antwoord beschreven.
Stel je een bezoeker voor die twee straten verderop beslist waar hij of zij gaat eten. In plaats van over een kaart te scrollen, stelt de bezoeker de vraag aan een AI-assistent en leest een kort antwoord met vier zaken. Staat jouw zaak er niet bij, dan gebeurt er niets wat je kunt zien: geen verloren klik, geen afgebroken reservering, geen klacht. De situatie is denkbeeldig, maar de verandering erachter is meetbaar. Een antwoord is een korte lijst met ruimte voor een handvol namen. Ontbreekt een zaak, dan krijgt de ondernemer daar geen signaal van.
02De onderbouwing
Achter één kort antwoord gaan drie soorten fouten schuil
Als je zaak niet in een antwoord staat, of wel wordt genoemd maar verkeerd wordt beschreven, kunnen er minstens drie verschillende dingen zijn misgegaan:
- 01
Opname
Werd de zaak überhaupt genoemd?
- 02
Positie
Als die werd genoemd, waar stond die tussen de andere namen?
- 03
Actualiteit
Klopten de bijbehorende gegevens nog?
Verschillende problemen vragen om verschillende oplossingen. Eén antwoord kan je niet vertellen welk probleem je hebt. Het is één uitkomst van één systeem, één vraag, één plaats, één taal en één moment.
03De onderbouwing
De meeste zaken werden nooit genoemd
In een openbare voorpublicatie werd een volledige lijst opgesteld van 4.776 cafés, restaurants en bars in Canggu en omstreken en in Ubud, twee deelmarkten op Bali. Daarna werd aan vier AI-systemen gevraagd waar je daar kon eten en drinken. Binnen die markt en met die meetopzet werd minstens 85,6% van die 4.776 zaken door geen van de vier systemen aanbevolen. Onder zaken met minstens 50 beoordelingen werd 72,6% nooit aanbevolen.
Beide cijfers beschrijven dit register, in deze twee deelmarkten, in het Engels en via de interfaces met webzoekfuncties van deze vier systemen. Het zijn geen maatstaven voor een andere stad, taal, categorie of app.
De meeste zaken werden nooit genoemd
- cafés, restaurants en bars in het register voor Canggu en omstreken, en voor Ubud.
- 4.776
- van die zaken werd door geen van de vier systemen ooit aanbevolen.
- 85,6%minstens
- nooit aanbevolen, onder zaken met minstens 50 beoordelingen.
- 72,6%
Dit register, deze twee deelmarkten, Engelstalige vragen, vier systemen via interfaces met webzoekfuncties en één periode van zeven dagen. Geen maatstaf voor een andere stad, taal, categorie of app.
BronVolledig artikel in HTML op arXivVolledig arXiv-artikel, resultaten. Gecontroleerd op 30 augustus 2026 en opnieuw op 2 september 2026.
04De onderbouwing
Genoemd worden en bovenaan komen zijn niet hetzelfde
In dit onderzoek hing opname in een antwoord samen met de beschikbare informatie: een eigen website, het aantal reviews, een vermelde prijs en vermeldingen elders op het web. De sterrenbeoordeling liet bij die eerste stap geen verband zien. Bij zaken die al in een antwoord stonden, hing de sterrenbeoordeling wel samen met de eerste positie. Het aantal reviews bleef daar ook van belang.
Lees dit niet ruimer dan het is: opname en positie gedroegen zich als twee verschillende uitkomsten en moeten afzonderlijk worden gemeten. Geen van deze verbanden laat zien dat een wijziging in een gegeven een aanbeveling veroorzaakt.
In een antwoord komen en bovenaan staan hingen met verschillende dingen samen
Oddsratio's uit het geschatte model. Boven 1 betekent hogere odds binnen dat model. Samenhang, geen oorzaak. Bij zaken die al in een antwoord stonden, hing de beoordeling samen met een eerste positie. Het aantal reviews bleef daar ook van belang.
Überhaupt in een antwoord komen
- Eigen website1,92
- Aantal reviews1,64
- Vermelde prijs1,54
- Vermeldingen op websites van derden1,44
- Sterrenbeoordelingbij deze stap geïnterpreteerd als geen verband0,89
Eerste positie, onder zaken die al genoemd zijn
- Sterrenbeoordeling1,17
1,0 betekent geen verband
BronVolledig artikel in HTML op arXivVolledig arXiv-artikel, modellen voor opname en positie. De auteur interpreteert 0,89 voor de beoordeling als geen verband met opname. Gecontroleerd op 2 september 2026.
05De onderbouwing
Verouderde gegevens kwamen vaker voor dan verzonnen gegevens
In 12.439 geldige vermeldingen van zaken bevalen de systemen 93 keer een permanent gesloten zaak aan. Dat ging om 14 zaken waarvan de sluiting was bevestigd. Los daarvan bleef na controle één naam over die waarschijnlijk verzonnen was. Die verscheen in 10 vermeldingen, ofwel 0,08% van alle geldige vermeldingen.
De auteur leidt uit dat contrast af dat in deze gegevensverzameling verouderde informatie het praktische probleem was, niet verzonnen informatie. Zorgvuldig gelezen is het een vergelijking tussen twee aantallen binnen één periode van zeven dagen, geen rangschikking van schade. Beide aantallen zijn klein en geen van beide werd verder gevolgd. Dit onderzoek observeerde wat de systemen zeiden, niet wat iemand daarna deed. Het kan dus niet laten zien wat elk van die fouten een bedrijf kost.
De praktische betekenis is bescheiden. Openingstijden, adres, prijzen, beschikbaarheid en sluitingsstatus correct houden is op zichzelf de moeite waard. Dit onderzoek laat niet zien dat corrigeren ervoor zorgt dat een zaak in een antwoord komt, naar de eerste plaats stijgt of iemand door de deur krijgt.
Verouderde gegevens tegenover verzonnen gegevens
geldige vermeldingen van zaken in 2.208 uitvoeringen tijdens de bevestigende onderzoeksfase
12.439
93
vermeldingen van permanent gesloten zaken14 zaken waarvan de sluiting is bevestigd
10
vermeldingen van één zaaknaam die als waarschijnlijk verzonnen werd beoordeeld0,08% van de geldige vermeldingen
Een vergelijking van twee aantallen binnen één periode van zeven dagen, geen rangorde van schade. Bij geen van beide werd gevolgd wat er daarna gebeurde. Het onderzoek kan dus niet laten zien wat elk soort fout een bedrijf kost.
BronVolledig artikel in HTML op arXivVolledig arXiv-artikel, validatie en foutenanalyse. Gecontroleerd op 2 september 2026.
06De grens
Waar deze onderbouwing geen uitsluitsel over geeft
Het is een observationeel onderzoek. Het kan niet vaststellen dat een website, een aantal reviews, een prijsveld, een beoordeling of een correctie van gegevens opname of positie veroorzaakt. Het gaat om twee deelmarkten op Bali, niet heel Bali of een andere markt; alleen Engelstalige vragen; en vier systemen met een vaste configuratie, benaderd via interfaces met webzoekfuncties, niet via de consumentenapps die mensen openen. De gegevens zijn in één periode van zeven dagen verzameld. Een aanbeveling is bovendien geen bezoek, reservering, bestelling of betalende klant. Niets hiervan meet of iemand binnenliep.
07Wat je kunt doen
Wat een ondernemer er nu mee kan doen
- 01Meet opname, positie en actualiteit afzonderlijk. Eén gecombineerde zichtbaarheidsscore verbergt welke van de drie veranderde.
- 02Leg de meetopzet vast: systeem, interface, instellingen, vraag, taal, plaats, datum, het antwoord en de volgorde van de namen.
- 03Herhaal de meting voordat je conclusies trekt. Gebruik meer dan één uitvoering, formulering en systeem, en noem kleine steekproeven wat ze zijn: momentopnamen.
- 04Houd openbare gegevens actueel omdat klanten ze gebruiken, niet omdat dit onderzoek ze tot een middel voor een hogere positie maakt.
- 05Toon klantresultaten ergens anders aan. In een antwoord verschijnen is geen bewijs van een verkoop.
08In meer detail
De onderliggende gegevens in meer detail
Het artikel is een openbare voorpublicatie en is niet door vakgenoten beoordeeld. De bevestigende meetronde omvatte 2.208 uitvoeringen over zeven dagen en leverde 12.439 geldige vermeldingen van zaken op. Er werden 96 Engelstalige vragen gebruikt, afgestemd op gebruikersprofielen en gesteld aan ChatGPT, Claude, Gemini en Perplexity via API's die webzoekresultaten gebruiken, niet via hun consumentenapps. De opzet, hypotheses en het analyseplan waren openbaar vooraf geregistreerd voordat de bevestigende gegevens werden verzameld. Daardoor zijn geplande toetsen beter te onderscheiden van verklaringen die na het zien van de resultaten zijn gekozen.
De verbanden met opname zijn gerapporteerd als oddsratio's uit een geschat model: aantal reviews 1,64, een eigen website 1,92, een vermelde prijs 1,54, vermeldingen op websites van derden 1,44 en sterrenbeoordeling 0,89. Dat laatste leest de auteur als geen verband bij die stap. Binnen antwoorden hing de sterrenbeoordeling samen met de eerste positie, met een oddsratio van 1,17. Een oddsratio boven 1 betekent een hogere kansverhouding binnen dat model. Het is geen winst in procentpunten en geen bewijs van oorzaak en gevolg.
Ook herhaalbaarheid werd gemeten, en die cijfers zijn gemakkelijk verkeerd te lezen. Dezelfde vraag opnieuw aan hetzelfde systeem stellen leverde een duidelijk andere verzameling zaken op: de gemiddelde Jaccard-gelijkenis tussen herhaalde uitvoeringen liep van 0,22 voor Claude tot 0,45 voor Gemini. Jaccard-gelijkenis is het aandeel zaken dat twee lijsten gemeen hebben ten opzichte van alle verschillende zaken die op een van beide lijsten staan. Een waarde van 1 betekent dat de lijsten identiek zijn; 0 betekent dat ze niets gemeen hebben. Een gemiddelde van 0,30 zegt dus dat een doorsnee paar uitvoeringen ongeveer een derde van de betrokken namen deelde. Het zegt niet dat in 30% van de gevallen hetzelfde antwoord terugkwam. Op dezelfde manier gemeten liep de overlap tussen de eerste 20 zaken van verschillende systemen van 0,33 tot 0,54. Een hertest twee weken later liet vergelijkbare wisselingen zien als herhalingen binnen de oorspronkelijke periode. De auteur schrijft dat toe aan steekproefvariatie, niet aan verandering in de tijd.
De meetopzet had eigen beperkingen. Het aantal herhalingen verschilde per systeem: Perplexity werd 10 keer per vraag uitgevoerd, ChatGPT en Gemini 5 keer, en Claude 3 keer. Bij Claude gold een limiet van twee zoekacties per uitvoering. Na herstelmaatregelen voldeed 91,5% van de uitvoeringen aan de strenge geldigheidscriteria. Het koppelen van namen aan de juiste zaken was ongeveer 98% tot 99% nauwkeurig, niet foutloos.
Norly financierde het onderzoek en voerde het uit. Norly verkoopt software voor reviewbeheer en AI-zichtbaarheid aan horecabedrijven. De auteur meldt dat commerciële belang en beschrijft de voorafgaande registratie en validatiestappen die het onderzoek daartegen moeten beschermen. Die stappen laten het commerciële belangenconflict niet verdwijnen. Obenan werkt in dezelfde categorie. Daarom verdient deze onderbouwing, inclusief onze lezing ervan, dezelfde zorgvuldigheid.
Eerste uitvoering
Tweede uitvoering
- In beide uitvoeringen genoemd
- In maar één uitvoering genoemd
2 / 6= 0.33
- Hetzelfde systeem, dezelfde vraag, opnieuw gesteldgemiddelde Jaccard-gelijkenis, van Claude tot Gemini
- 0,22 tot 0,45
- De eerste 20 zaken van verschillende systemenop dezelfde manier gemeten
- 0,33 tot 0,54
BronVolledig artikel in HTML op arXivVolledig arXiv-artikel, resultaten voor herhaalbaarheid. Gecontroleerd op 2 september 2026.
09Bronnen
Bronnen
Alleen primaire, openbare bronnen. Publicatiedata en controledatums blijven gescheiden, zodat de volgorde van gebeurtenissen te controleren is.
- 01Samenvatting en indieningsgegevens op arXiv, ingediend op 7 augustus 2026; gecontroleerd op 30 augustus 2026.
- 02Volledig artikel in HTML op arXiv, methoden, voorafgaande registratie, resultaten, validatie, beperkingen, financiering en verklaring van commerciële belangen; gecontroleerd op 30 augustus 2026 en opnieuw op 2 september 2026.