GEO & KI-Suche

KI-Agenten und Websites: Was belegbar ist

Unter „KI-Agenten" fallen drei verschiedene Dinge: Antwortsysteme, nutzerausgelöste Abrufsysteme und tatsächlich handelnde Systeme. Die ersten beiden sind dokumentiert und verbreitet, bei den dritten lässt sich die Verbreitung derzeit nicht seriös beziffern. Für alle drei gilt dieselbe Vorbereitung: sauberes HTML, echte Links, beschriftete Formulare und Angaben im Text.

Das Wichtigste in Kürze

  • Es gibt keine Agenten-Optimierung – es gibt sauberes HTML, und das ist dieselbe Arbeit wie für Barrierefreiheit.
  • ChatGPT-User und Claude-User sind dokumentierte Kennungen für nutzerausgelöste Abrufe, kein automatisches Durchsuchen.
  • Der häufigste Fehler ist keine falsche Entscheidung, sondern gar keine – etwa eine Sicherheitserweiterung, die pauschal sperrt.
  • Die einzige belastbare eigene Datenquelle zum Thema sind die Serverprotokolle.

Was gemeint ist, wenn von KI-Agenten geredet wird

Der Begriff wird für sehr Verschiedenes verwendet, und das erklärt einen Großteil der Verwirrung. Drei Dinge lassen sich unterscheiden:

WasWas es tutStand heute
AntwortsystemeLesen Websites und fassen zusammenVerbreitet, belegbar
Abrufende SystemeRufen eine Seite auf Nutzerwunsch abVerbreitet, dokumentiert
Handelnde SystemeKlicken, füllen Formulare aus, kaufen einExistiert, Verbreitung unklar

Die ersten beiden Zeilen sind die, um die es bei GEO ohnehin geht. Die dritte ist die, über die geschrieben wird – und bei der die Faktenlage am dünnsten ist.

Zur Einordnung vorweg: Wie viel Geschäft heute über handelnde Systeme läuft, lässt sich nicht seriös beziffern. Wer eine Zahl nennt, hat sie geschätzt. Dieser Artikel unterscheidet deshalb ausdrücklich zwischen dem, was dokumentiert ist, und dem, was Vermutung bleibt.

Was belegbar ist

Die Anbieter dokumentieren ihre Zugriffssysteme, und daraus lässt sich Konkretes ableiten.

Nutzerausgelöste Abrufe gibt es und sie sind benannt. OpenAI beschreibt ChatGPT-User als Kennung für Abrufe, die eine Person ausgelöst hat – ausdrücklich nicht als automatisches Durchsuchen des Netzes. Anthropic beschreibt Claude-User entsprechend.

Das ist der Vorgang, der einem Klick am nächsten kommt: Jemand fragt etwas, das System ruft deine Seite ab. Wer diese Kennungen sperrt, hält einem interessierten Menschen die Tür zu. Siehe robots.txt für KI-Crawler.

Diese Systeme lesen HTML. Kein Sonderformat, keine eigene Schnittstelle. Was für Suchmaschinen gilt, gilt auch hier: Was nicht im ausgelieferten HTML steht, existiert nicht.

Was daraus praktisch folgt

Bemerkenswerterweise nichts Neues. Die Anforderungen handelnder Systeme überschneiden sich fast vollständig mit dem, was für Menschen ohnehin gilt:

  • Echte Links mit href. Ein Knopf, der per JavaScript navigiert, ist für ein automatisiertes System genauso wenig ein Link wie für Googlebot. Siehe JavaScript-SEO.
  • Beschriftete Formularfelder. Ein Feld ohne label ist für ein System nicht zuzuordnen – dieselbe Anforderung wie bei der Barrierefreiheit.
  • Semantisches HTML. Überschriften als Überschriften, Tabellen als Tabellen, Listen als Listen.
  • Preise und Verfügbarkeit im Text. Nicht nur im Bild, nicht nur nach Klick.
  • Erreichbare Inhalte ohne Interaktion. Was erst nach einem Klick nachgeladen wird, ist unsichtbar.

Das ist die eigentliche Erkenntnis dieses Themas: Es gibt keine Agenten-Optimierung. Es gibt sauberes HTML, und das ist dieselbe Arbeit wie für Barrierefreiheit, für Suchmaschinen und für Menschen mit schlechter Verbindung.

Wo es tatsächlich neu wird

Zwei Punkte sind neu, und beide sind eher organisatorisch als technisch.

Die Frage, wen du hereinlässt

Ein System, das im Auftrag eines Menschen deine Seite abruft, ist etwas anderes als eines, das Trainingsmaterial sammelt. Die Anbieter trennen das über verschiedene Kennungen – die Entscheidung liegt bei dir.

Der häufigste Fehler ist hier keine falsche Entscheidung, sondern gar keine: eine Sicherheitserweiterung, die pauschal alles sperrt, was nicht Googlebot heißt.

Die Frage, was passiert, wenn etwas schiefgeht

Wenn ein System im Auftrag eines Kunden ein Formular ausfüllt und dabei etwas falsch überträgt – wer haftet? Wenn es einen Preis aus einer veralteten Cache-Fassung nennt und der Kunde darauf besteht?

Das sind offene Fragen, auf die es heute keine belastbaren Antworten gibt. Was sich daraus ableiten lässt, ist bescheiden, aber nicht nichts: Verbindliche Angaben gehören aktuell und maschinenlesbar auf die Seite, und Bestätigungen gehören schriftlich an den Menschen, nicht nur an das System.

Was ich nicht empfehle

  • Eine „Agenten-Strategie“. Es gibt nichts zu optimieren, was nicht ohnehin auf der Liste steht.
  • Spezielle Dateien oder Formate. Dieselbe Diskussion wie bei llms.txt – ohne Beleg, dass sie ausgewertet werden.
  • Werkzeuge, die „Agent-Readiness“ messen. Ohne offengelegte Methodik ist das eine Zahl ohne Bezug.
  • Panik oder Abwehr. Wer alles aussperrt, was automatisiert zugreift, sperrt auch die Abrufe aus, die von echten Interessenten ausgelöst wurden.

Was sinnvoll ist

  1. robots.txt einmal ansehen und bewusst entscheiden, welche Kennungen zugelassen sind.
  2. Die eigene Seite ohne Maus bedienen. Der Tabulator-Test aus der Barrierefreiheit deckt genau die Probleme auf, an denen auch automatisierte Systeme scheitern.
  3. Preise, Verfügbarkeiten und Fristen im Text führen, nicht in Bildern.
  4. Serverprotokolle gelegentlich ansehen. Dort steht, welche Kennungen tatsächlich zugreifen – die einzige belastbare Datenquelle, die du zu diesem Thema selbst hast.
  5. Einmal im Quartal nachlesen, was die Anbieter dokumentieren. Das Feld bewegt sich, die Dokumentationen werden aktualisiert.

Punkt vier ist der ehrlichste Ratschlag zum Thema: Statt Prognosen zu lesen, kannst du in deinen eigenen Protokollen nachsehen, was bei dir ankommt.

Fazit

Von den drei Dingen, die „KI-Agent“ heißen, sind zwei längst Alltag und gut dokumentiert – und für sie gilt dieselbe Arbeit wie für GEO. Das dritte, tatsächlich handelnde Systeme, existiert, aber seine Verbreitung lässt sich derzeit nicht seriös beziffern.

Die gute Nachricht dabei: Es gibt nichts Eigenes vorzubereiten. Sauberes HTML, echte Links, beschriftete Formulare und Angaben im Text – das ist dieselbe Liste wie für Barrierefreiheit und Suchmaschinen. Wer sie abgearbeitet hat, ist vorbereitet, ohne etwas für Agenten getan zu haben.

Häufige Fragen

Es gibt dafür nichts Eigenes zu tun. Die Anforderungen – echte Links mit href, beschriftete Formularfelder, semantisches HTML, Angaben im Text statt im Bild – decken sich vollständig mit dem, was für Barrierefreiheit und Suchmaschinen ohnehin gilt.

Das lässt sich nicht seriös beziffern. Wer eine Zahl nennt, hat sie geschätzt. Belastbar ist nur, was in den eigenen Serverprotokollen steht – dort siehst du, welche Kennungen tatsächlich auf deine Seite zugreifen.

Dabei ist zwischen den Kennungen zu unterscheiden. Wer pauschal alles sperrt, was automatisiert zugreift, sperrt auch die Abrufe aus, die ein echter Interessent gerade ausgelöst hat. Trainings-Crawler sind davon getrennt steuerbar.

Nach dem heutigen Stand nicht. Dieselbe Diskussion wie bei llms.txt: Es gibt keinen Beleg, dass solche Formate ausgewertet werden. Systeme lesen HTML – was dort nicht steht, existiert für sie nicht.

Quellen

  1. OpenAI: Overview of OpenAI Crawlers (abgerufen am 24.09.2026)
  2. Anthropic: Does Anthropic crawl data from the web? (abgerufen am 24.09.2026)
  3. Google Search Central: Understand JavaScript SEO basics (abgerufen am 24.09.2026)

Lass uns dreißig Minuten über deine Sichtbarkeit sprechen

Kostenlos, unverbindlich, und mit einer ehrlichen Einschätzung - auch wenn die lautet, dass du mich gerade nicht brauchst.

Erstgespräch vereinbaren