Server-gerendertes HTML
Viele Agenten führen kein JavaScript aus. Was erst im Browser entsteht, existiert für sie nicht.
Ein wachsender Teil der Zugriffe kommt nicht mehr von Menschen und nicht von klassischen Crawlern, sondern von Agenten, die im Auftrag einer Person nachsehen.
Einordnung
Der klassische Crawler indexiert regelmäßig und breit. Er sammelt für später und interessiert sich nicht für eine einzelne Frage.
Der Trainingssammler holt Inhalte für den Aufbau von Modellen. Sein Besuch wirkt erst Monate später und lässt sich in der Wirkung kaum messen.
Der Agent im Auftrag ruft genau jetzt genau eine Seite ab, weil jemand gerade etwas wissen will. Sein Besuch ist der wertvollste, und er ist der ungeduldigste: Was langsam lädt oder erst nach Skriptausführung erscheint, fällt aus der Antwort.
In der robots.txt lassen sich diese drei getrennt behandeln, und genau das empfehlen wir. Eine pauschale Regel behandelt den Besuch, der dir Kund:innen bringt, wie den, der dich trainiert.
Anforderungen
Viele Agenten führen kein JavaScript aus. Was erst im Browser entsteht, existiert für sie nicht.
Zeitlimits sind knapp. Eine langsame Seite wird verworfen, nicht abgewartet.
Preis, Verfügbarkeit, Öffnungszeiten. Ein Agent extrahiert, er interpretiert nicht wohlwollend.
Bot-Abwehr, Zustimmungsbanner und Anmeldeschranken beenden den Besuch. Oft unbemerkt.
Praxis
Der einfachste Test ist der Abruf ohne Browser. Wenn im Rohtext deiner Seite die wesentlichen Angaben fehlen, fehlen sie auch dem Agenten.
Der zweite Test läuft im Serverprotokoll. Die bekannten Kennungen der KI-Anbieter tauchen dort auf, und ihr Verhältnis zu den menschlichen Zugriffen ist eine Kennzahl, die kaum jemand ansieht.
Der dritte Test ist die Antwort selbst: Fragen stellen, Quellen ansehen, prüfen, ob die zitierte Angabe stimmt. Das ist die Arbeit, die wir im Audit systematisch machen.
Häufige Fragen
Nächster Schritt
Ein Gespräch, 30 Minuten, ohne Verkaufsdruck. Du bekommst danach eine ehrliche Einschätzung, ob sich der Aufwand für dich lohnt.