GEO-Glossar: Begriffe der KI-Sichtbarkeit, erklärt und eingeordnet
Von GEO bis Query Fan-out, von GPTBot bis Share of Voice: Jeder Eintrag erklärt einen Begriff in einem Absatz, sagt, was daran belegt ist und was nicht, und zeigt, wie du es an deiner eigenen Website prüfst. Zahlen stehen nur mit Quelle.
Disziplinen und Grundbegriffe
- Answer Engine Optimization (AEO)
Answer Engine Optimization (AEO) ist die Optimierung von Inhalten dafür, dass Antwortsysteme sie als direkte Antwort auf eine Frage übernehmen. Gemeint sind Sprachassistenten, hervorgehobene Suchergebnisse und heute vor allem KI-Chats und KI-Suchen, die eine Antwort formulieren, statt Links aufzulisten.
- Generative Engine Optimization (GEO)
Generative Engine Optimization (GEO) bezeichnet alle Massnahmen, mit denen eine Website oder Marke häufiger in den Antworten generativer Suchsysteme wie ChatGPT, Perplexity, Gemini oder Google AI Overviews genannt oder als Quelle zitiert wird. Ziel ist nicht ein Platz in einer Ergebnisliste, sondern ein Platz im Antworttext.
- GEO-Audit
Ein GEO-Audit ist die Prüfung einer Website darauf, ob KI-Suchen sie lesen, verstehen und bei passenden Fragen nennen können. Ein gutes Audit trennt technische Voraussetzungen von der eigentlichen Messung, ob die Marke in echten Antworten vorkommt, und belegt beides.
- KI-Sichtbarkeit
KI-Sichtbarkeit beschreibt, ob und wie oft eine Marke oder Website in den Antworten von KI-Assistenten und KI-Suchsystemen vorkommt, entweder namentlich genannt oder als verlinkte Quelle. Sie ist keine einzelne Zahl, sondern ein Bündel von Messgrössen, die je nach Frage, System und Zeitpunkt schwanken.
- LLM Optimization (LLMO)
LLM Optimization (LLMO) ist ein Sammelbegriff für Massnahmen, die darauf zielen, dass grosse Sprachmodelle eine Marke, ein Produkt oder eine Website kennen, korrekt beschreiben und in Antworten empfehlen. Der Begriff wird weitgehend gleichbedeutend mit GEO und AEO verwendet.
- Zero-Click-Suche
Eine Zero-Click-Suche ist eine Suchanfrage, nach der der Nutzer keine Website anklickt, weil die Antwort bereits auf der Suchergebnisseite oder im KI-Chat steht. Beispiele sind Wetterangaben, Umrechnungen, Featured Snippets, AI Overviews und Antworten von KI-Assistenten ohne anschliessenden Klick auf eine Quelle.
KI-Suchsysteme
- AI Mode
AI Mode ist ein Suchmodus der Google-Suche, in dem Nutzer Fragen im Gesprächsstil stellen und eine ausführliche KI-generierte Antwort mit Links zu Webquellen bekommen. Anders als AI Overviews ist AI Mode eine eigene Ansicht, in der Rückfragen zum selben Thema möglich sind.
- AI Overviews
AI Overviews sind KI-generierte Zusammenfassungen, die Google bei manchen Suchanfragen oberhalb oder innerhalb der normalen Suchergebnisse anzeigt. Sie beantworten die Anfrage in einem kurzen Text und verlinken die Webseiten, aus denen die Informationen stammen. Die Funktion ist Teil der Google-Suche, kein eigenes Produkt.
- Answer Engine
Eine Answer Engine ist ein Suchsystem, das auf eine Frage mit einem formulierten Antworttext reagiert statt mit einer Liste von Links. Beispiele sind ChatGPT mit Websuche, Perplexity, Microsoft Copilot und die KI-Funktionen der Google-Suche. Quellen erscheinen dort als Verweise innerhalb oder unter der Antwort.
Messgrössen
- AI-Visibility-Score
Ein AI-Visibility-Score ist eine vom Anbieter berechnete Kennzahl, die die Sichtbarkeit einer Marke in KI-Antworten zu einem einzigen Wert verdichtet. Es gibt keinen gemeinsamen Standard: Formel, Fragenliste und Gewichtung legt jedes Werkzeug selbst fest, meist ohne sie offenzulegen.
- Antwortvarianz
Antwortvarianz bezeichnet die Tatsache, dass ein Sprachmodell auf dieselbe Frage bei wiederholter Abfrage unterschiedliche Antworten gibt, mit anderen Formulierungen, anderen Quellen und anderen genannten Marken. Sie ist der Grund, warum eine einzelne Abfrage keine stabile Aussage über Sichtbarkeit trägt.
- Buyer-Query
Eine Buyer-Query ist eine Frage mit Kaufabsicht, wie sie ein potenzieller Kunde einer Suchmaschine oder einem KI-Assistenten stellt, etwa nach dem besten Anbieter, einer Empfehlung oder einem Vergleich in einer Kategorie. Sie ist die Messfrage, an der sich zeigt, ob eine KI eine Marke empfiehlt.
- Citation Rate
Die Citation Rate ist der Anteil der KI-Antworten auf eine festgelegte Fragenmenge, in denen eine Marke genannt oder ihre Website als Quelle zitiert wird. Sie ist eine Quote über viele Läufe und damit nur so belastbar wie die Zahl der Fragen und Wiederholungen dahinter.
- KI-Referral-Traffic
KI-Referral-Traffic sind Besuche auf einer Website, die über einen Link in einer KI-Antwort entstehen, etwa aus ChatGPT, Perplexity, Copilot oder Gemini. Er ist die einzige Sichtbarkeitsgrösse, die sich direkt in der eigenen Webanalyse messen lässt, erfasst aber nur Klicks, nicht Nennungen.
- KI-Sentiment
KI-Sentiment beschreibt, in welchem Ton eine KI-Antwort über eine Marke spricht: empfehlend, neutral aufzählend oder mit Vorbehalten und Kritik. Die Kennzahl ergänzt die reine Nennung, weil eine Erwähnung als Negativbeispiel für die Sichtbarkeit zählt, für den Kauf aber schadet.
- Konfidenzintervall
Ein Konfidenzintervall gibt den Bereich an, in dem der wahre Wert einer gemessenen Quote mit einer festgelegten Sicherheit liegt. Bei KI-Sichtbarkeit zeigt es, wie weit eine Citation Rate wegen schwankender Antworten und begrenzter Stichprobe danebenliegen kann.
- Lokale KI-Sichtbarkeit
Lokale KI-Sichtbarkeit beschreibt, ob ein Betrieb genannt wird, wenn jemand eine KI nach einem Angebot an einem bestimmten Ort fragt, etwa nach einer Zahnarztpraxis in einer Stadt. Sie hängt stärker an Verzeichnissen, Bewertungen und Kartendiensten als an der eigenen Website.
- Markennennung
Eine Markennennung liegt vor, wenn eine KI-Antwort den Namen eines Anbieters, Produkts oder einer Marke ausdrücklich im Text ausspricht. Sie ist eine andere Grösse als die Quellenzitation, bei der die Engine eine Seite einer Domain als Beleg heranzieht, ohne den Namen zwingend zu nennen.
- Momentaufnahme
Eine Momentaufnahme ist eine einzelne Abfrage einer KI-Suchmaschine zu einem bestimmten Zeitpunkt. Sie belegt verlässlich, was in genau dieser Antwort stand, erlaubt aber keine Aussage darüber, wie oft eine Marke genannt wird oder ob sie grundsätzlich fehlt.
- Nennungsposition
Die Nennungsposition gibt an, an welcher Stelle eine Marke in einer KI-Antwort zum ersten Mal genannt wird, gezählt in der Reihenfolge aller genannten Anbieter. Sie ist das KI-Gegenstück zur Rangposition in klassischen Suchergebnissen, aber deutlich instabiler.
- Prompt-Tracking
Prompt-Tracking ist das wiederholte Stellen derselben Fragen an KI-Assistenten über einen Zeitraum, um zu beobachten, welche Marken genannt und welche Quellen zitiert werden. Es ist die Messmethode hinter den meisten KI-Sichtbarkeits-Tools und liefert Verläufe statt einer einzelnen Momentaufnahme.
- Share of Voice
Share of Voice in KI-Antworten ist der Anteil, den eine Marke an allen Markennennungen innerhalb einer Fragenmenge hat. Anders als die Citation Rate vergleicht die Kennzahl nicht mit den Antworten, sondern mit den Wettbewerbern, die in denselben Antworten auftauchen.
- Zitationsquelle
Eine Zitationsquelle ist eine Webseite, die eine KI-Suchmaschine beim Beantworten einer Frage abgerufen und als Beleg ausgewiesen hat, meist als Link oder Fussnote. Sie zeigt, woher die Engine ihr Wissen bezieht, nicht, welchen Anbieter sie empfiehlt.
Crawler und Tokens
- Applebot-Extended
Applebot-Extended ist ein robots.txt-Token von Apple, mit dem Website-Betreiber widersprechen können, dass von Applebot gecrawlte Inhalte zum Training von Apples generativen Grundmodellen genutzt werden. Es ist kein eigener Crawler, der Seiten abruft.
- CCBot
CCBot ist der Crawler der gemeinnützigen Common Crawl Foundation, die ein frei verfügbares Archiv grosser Teile des öffentlichen Webs aufbaut. Dieses Archiv ist eine verbreitete Rohdatenquelle für die Forschung und für das Training von Sprachmodellen.
- ChatGPT-User
ChatGPT-User ist der User-Agent, mit dem OpenAI Webseiten abruft, wenn eine Person in ChatGPT eine Aktion auslöst, etwa eine Seite öffnen lässt. Er ist kein automatischer Crawler für Suche oder Training, sondern ein Abruf im Auftrag eines konkreten Nutzers.
- Claude-SearchBot
Claude-SearchBot ist ein Crawler von Anthropic, der Webseiten durchsucht, um die Qualität der Suchergebnisse in Claude zu verbessern. Wird er in der robots.txt gesperrt, kann Anthropic die Inhalte nicht für die Suche indexieren, was laut Anthropic die Sichtbarkeit in Suchergebnissen verringern kann.
- ClaudeBot
ClaudeBot ist der Webcrawler von Anthropic, der öffentliche Webinhalte sammelt, die laut Anthropic zum Training der Claude-Modelle beitragen können. Wer ClaudeBot in der robots.txt sperrt, signalisiert damit, dass künftige Inhalte der Website nicht in Trainingsdaten landen sollen.
- Google-Extended
Google-Extended ist kein eigener Crawler, sondern ein robots.txt-Token, mit dem Website-Betreiber steuern, ob von Google gecrawlte Inhalte für das Training künftiger Gemini-Modelle und für Grounding in Gemini Apps und Vertex AI genutzt werden dürfen. Die Aufnahme in die Google-Suche beeinflusst es laut Google nicht.
- Googlebot
Googlebot ist der Crawler, mit dem Google Webseiten abruft und für den Suchindex erfasst. Dieser Index ist auch die Grundlage für die KI-Funktionen in der Google-Suche wie AI Overviews und AI Mode. Wer Googlebot sperrt, fehlt in der Suche und damit auch dort.
- GPTBot
GPTBot ist der Webcrawler von OpenAI, der öffentlich zugängliche Seiten abruft, um Inhalte für das Training künftiger Modelle zu sammeln. Website-Betreiber können ihn über das User-Agent-Token GPTBot in der robots.txt ausschliessen, getrennt von den anderen OpenAI-Crawlern.
- OAI-SearchBot
OAI-SearchBot ist der Crawler von OpenAI, der Websites für die Suchfunktionen in ChatGPT erfasst. Laut OpenAI werden Seiten, die OAI-SearchBot in der robots.txt ausschliessen, nicht in ChatGPT-Suchantworten angezeigt; er dient nicht dem Training von Modellen.
- Perplexity-User
Perplexity-User ist der Abrufer, mit dem Perplexity eine Webseite besucht, wenn ein Nutzer eine Frage stellt, um die Antwort zu belegen und die Seite zu verlinken. Er crawlt laut Perplexity nicht das Web und sammelt keine Trainingsdaten.
- PerplexityBot
PerplexityBot ist der Crawler von Perplexity, der Websites findet und in den Suchergebnissen von Perplexity verlinkt. Laut Perplexity wird er nicht eingesetzt, um Inhalte für das Training von KI-Grundmodellen zu sammeln.
Technik
- ai.txt
ai.txt ist eine vorgeschlagene Textdatei im Stammverzeichnis einer Website, die festhalten soll, ob und wie KI-Systeme die Inhalte nutzen dürfen. Sie ist kein anerkannter Standard, wird von den großen KI-Crawlern nicht als verbindlich dokumentiert und hat keine belegte Wirkung auf Zitationen.
- FAQ-Schema (FAQPage)
FAQ-Schema bezeichnet das Schema.org-Markup FAQPage, das Fragen und Antworten einer Seite maschinenlesbar auszeichnet. Google hat die zugehörige Darstellung als Rich Result aus der Suche entfernt; der Typ selbst existiert weiter und muss nicht gelöscht werden.
- Grounding
Grounding bezeichnet das Verankern einer KI-Antwort in externen Quellen, die zum Zeitpunkt der Anfrage abgerufen werden, meist über eine Websuche. Das Modell stützt seine Aussagen auf diese Quellen und kann sie als Verweise anzeigen, statt nur aus seinen Trainingsdaten zu antworten.
- Halluzination
Eine Halluzination ist eine Aussage eines KI-Modells, die flüssig und überzeugend klingt, aber sachlich falsch oder durch keine Quelle gedeckt ist. Beispiele sind erfundene Produkteigenschaften, falsche Preise, nicht existierende Studien oder Zitate, die einer Quelle zugeschrieben werden, in der sie nicht stehen.
- HTTP 403
HTTP 403 Forbidden ist ein Statuscode, mit dem ein Server mitteilt, dass er die Anfrage verstanden hat, sie aber verweigert. Bekommt ein KI-Crawler diesen Code, kann er den Inhalt der Seite nicht lesen, egal was in der robots.txt steht.
- Indexierung
Indexierung ist der Schritt, in dem eine Suchmaschine eine gecrawlte Seite analysiert und in ihren Suchindex aufnimmt. Nur indexierte Seiten können in klassischen Ergebnissen erscheinen, und bei Google auch in AI Overviews und AI Mode, die auf denselben Index zugreifen.
- JavaScript-Rendering
JavaScript-Rendering bezeichnet das Ausführen von JavaScript, um den sichtbaren Inhalt einer Seite erst im Browser aufzubauen. Crawler, die kein JavaScript ausführen, sehen dann nur das ausgelieferte HTML und damit oft eine fast leere Seite.
- JSON-LD
JSON-LD ist ein vom W3C standardisiertes Format, mit dem strukturierte Daten als eigener Skriptblock in eine Webseite eingebettet werden, getrennt vom sichtbaren HTML. Google empfiehlt es als bevorzugte Form für Schema.org-Markup.
- llms.txt
llms.txt ist ein vorgeschlagenes Dateiformat, bei dem eine Website unter /llms.txt eine Markdown-Übersicht ihrer wichtigsten Inhalte für Sprachmodelle ablegt. Es ist kein Standard, und dass KI-Crawler die Datei nutzen, ist nicht belegt.
- Logfile-Analyse
Logfile-Analyse ist die Auswertung der Serverprotokolle einer Website, um zu sehen, welche Crawler tatsächlich welche Seiten abgerufen haben und welche Statuscodes sie bekamen. Für KI-Sichtbarkeit zeigt sie, ob GPTBot, ClaudeBot oder PerplexityBot überhaupt vorbeikommen.
- Query Fan-out
Query Fan-out ist ein Verfahren von KI-Suchsystemen, bei dem eine Nutzerfrage in mehrere verwandte Teilanfragen zerlegt wird, die parallel gesucht werden. Die Ergebnisse aller Teilanfragen fliessen in eine gemeinsame Antwort ein. Google beschreibt das Verfahren für AI Overviews und AI Mode.
- Retrieval-Augmented Generation (RAG)
Retrieval-Augmented Generation (RAG) ist ein Verfahren, bei dem ein Sprachmodell vor dem Formulieren einer Antwort passende Textstücke aus einer Dokumentensammlung oder dem Web abruft und diese als Grundlage nutzt. So kann das Modell mit Informationen antworten, die nicht in seinen Trainingsdaten stehen.
- robots.txt
Die robots.txt ist eine Textdatei im Wurzelverzeichnis einer Website, in der Betreiber festlegen, welche Crawler welche Bereiche abrufen dürfen. Das Format ist als Robots Exclusion Protocol bei der IETF standardisiert. Die Regeln sind eine Bitte an Crawler, keine technische Zugangssperre.
- Serverseitiges Rendering (SSR)
Serverseitiges Rendering, kurz SSR, bedeutet, dass der Server die fertige HTML-Seite mit allen Inhalten erzeugt und ausliefert, statt sie erst im Browser per JavaScript zusammenzusetzen. Crawler erhalten den Inhalt dadurch direkt, ohne JavaScript ausführen zu müssen.
- Strukturierte Daten
Strukturierte Daten sind maschinenlesbare Angaben im Quelltext einer Seite, meist nach dem Vokabular von Schema.org, die beschreiben, was die Seite enthält: ein Produkt, eine Organisation, einen Artikel. Suchmaschinen nutzen sie für Rich Results; als Hebel für Zitate in KI-Antworten sind sie nicht belegt.
- Trainingsdaten
Trainingsdaten sind die Texte, aus denen ein Sprachmodell vor seiner Veröffentlichung gelernt hat, etwa Webseiten, Bücher und lizenzierte Quellen. Sie bestimmen, was das Modell ohne Websuche über eine Marke weiss. Das Wissen endet an einem Stichtag und wird erst mit einem neuen Modell aktualisiert.
- User-Agent
Ein User-Agent ist die Kennung, mit der sich ein Browser, Crawler oder anderes Programm bei jeder Anfrage an einen Webserver vorstellt. In der robots.txt bezeichnet der Begriff ausserdem das Token, für das eine Gruppe von Regeln gilt, etwa GPTBot.
- WAF und Bot-Schutz
Ein WAF- oder Bot-Schutz-Block entsteht, wenn eine Web Application Firewall, ein CDN oder der Bot-Schutz eines Hosters Anfragen von Crawlern abweist, bevor sie die Website erreichen. Die robots.txt kann dabei alles erlauben; der Crawler bekommt trotzdem nur eine Fehlerseite.
Inhalt und Autorität
- Aktualität von Inhalten
Aktualität von Inhalten beschreibt, wie neu und auf dem aktuellen Stand eine Seite ist und ob das für Leser und Maschinen erkennbar wird. Für KI-Suchen mit Live-Abruf kann sie beeinflussen, welche Quelle zu einer zeitkritischen Frage gewählt wird.
- E-E-A-T
E-E-A-T steht für Experience, Expertise, Authoritativeness und Trustworthiness, also Erfahrung, Fachwissen, Autorität und Vertrauenswürdigkeit. Google nutzt das Konzept in den Richtlinien für menschliche Qualitätsbewerter; es ist kein einzelner Rankingfaktor und kein messbarer Wert.
- Entität
Eine Entität ist ein eindeutig identifizierbares Ding, etwa eine Firma, eine Person, ein Ort oder ein Produkt, das eine Suchmaschine oder ein Sprachmodell von gleichnamigen Dingen unterscheiden kann. Wer als Entität erkannt wird, wird seltener verwechselt.
- Erwähnungen Dritter
Erwähnungen Dritter sind Nennungen einer Marke auf fremden Seiten, etwa in Fachartikeln, Vergleichslisten, Foren oder Bewertungsportalen, unabhängig davon, ob ein Link gesetzt ist. Sie gelten als wichtiger Einfluss darauf, ob KI-Suchen eine Marke empfehlen.
- Knowledge Graph
Der Knowledge Graph ist Googles Datenbank von Entitäten und ihren Beziehungen, etwa welche Person eine Firma gegründet hat oder wo ein Unternehmen sitzt. Er speist Wissensfelder in der Suche und hilft, Suchanfragen dem richtigen Ding zuzuordnen.
- Listicle
Ein Listicle ist ein Artikel in Listenform, etwa „Die besten zehn CRM-Programme“. In KI-Suchen gehören solche Ranglisten zu den häufig zitierten Quellen, weshalb die Aufnahme in fremde Listen ein wichtiger Weg zu Nennungen in KI-Antworten sein kann.
- Wikidata
Wikidata ist eine freie, gemeinschaftlich gepflegte Wissensdatenbank der Wikimedia-Stiftung, in der Dinge als Datensätze mit eindeutiger Kennung und verknüpften Eigenschaften stehen. Suchmaschinen und viele KI-Systeme nutzen sie als Quelle für Fakten über Entitäten.
- Zitierfähige Passage
Eine zitierfähige Passage ist ein kurzer Textabschnitt, der eine Frage vollständig und ohne Bezug auf den Rest der Seite beantwortet. KI-Suchen lösen oft einzelne Abschnitte heraus; ein in sich geschlossener Abschnitt lässt sich eher korrekt übernehmen als ein verstreuter Gedanke.