bettersorted Logo
Laptop mit Website-Code – Symbolbild für technische Optimierung
KI Beratung

llms.txt, Schema.org & Co.: So wird Ihre Website von KI-Suchsystemen zitiert

AutorMuhamed Alahmed
Veröffentlicht am
Lesezeit5 Min.
Kurz erklärt

Damit ChatGPT, Perplexity oder Google AI Overviews Ihre Website zitieren, braucht es vor allem drei Dinge: crawlbare, schnelle Seiten, klar strukturierte Inhalte mit direkten Antworten und saubere strukturierte Daten (Schema.org). Eine llms.txt kann ergänzen, ist aber kein offizieller Standard – Google nutzt sie nach eigener Aussage nicht.

Das Wichtigste in Kürze

  • KI-Suchsysteme zitieren Seiten, die sie erreichen, verstehen und als vertrauenswürdig einordnen.
  • Drei Ebenen: Crawlbarkeit, Antwort-zuerst-Inhalte, Schema.org-Daten.
  • llms.txt ist kein Standard; Google nutzt sie nach eigener Aussage nicht.
  • Strukturierte Daten müssen zum sichtbaren Inhalt passen – sonst gibt es Fehler.

KI-Suchsysteme wie ChatGPT, Perplexity oder Google AI Overviews zitieren Websites, die sie technisch erreichen, inhaltlich verstehen und als vertrauenswürdig einordnen können. Dafür zählen drei Ebenen: Crawlbarkeit und Geschwindigkeit, klar strukturierte Inhalte mit direkten Antworten und strukturierte Daten nach Schema.org. Eine llms.txt kann ergänzen, ist aber kein offizieller Standard – und Google hat erklärt, sie nicht zu nutzen.

Dieser Beitrag ist der technische Begleiter zu GEO statt SEO und dem GEO-Praxisleitfaden. Was GEO grundsätzlich bedeutet, erklärt der Glossareintrag Generative Engine Optimization.

Ebene 1: Erreichbarkeit für KI-Crawler

Bevor ein KI-System Ihre Inhalte zitieren kann, muss es sie lesen dürfen und können. Prüfen Sie drei Punkte:

  • robots.txt: Werden Crawler wie GPTBot (OpenAI), ClaudeBot (Anthropic), PerplexityBot oder Google-Extended ausgesperrt? Viele Websites blockieren sie unbewusst über pauschale Regeln.
  • Serverseitiges Rendering: Inhalte, die erst per JavaScript im Browser entstehen, sehen viele Crawler nicht. Wichtige Texte gehören direkt ins ausgelieferte HTML.
  • Geschwindigkeit und Erreichbarkeit: Langsame oder fehlerhafte Seiten werden seltener und unvollständiger erfasst.

Ein Beispiel aus unserer eigenen Website: Aufklappbare FAQ-Antworten wurden früher erst per JavaScript eingeblendet – Crawler sahen dadurch nur einen Bruchteil der Antworten. Seit der Umstellung auf native HTML-Elemente stehen alle Antworten direkt im Quelltext.

Person recherchiert am Laptop

Ebene 2: Inhalte, die sich zitieren lassen

KI-Systeme übernehmen bevorzugt Passagen, die eine Frage direkt und in sich geschlossen beantworten. Daraus ergeben sich einfache Schreibregeln:

  • Antwort zuerst: Die Kernfrage wird in den ersten zwei, drei Sätzen beantwortet, danach folgt die Vertiefung.
  • Fragen als Zwischenüberschriften: So, wie Menschen sie einem Chatbot stellen würden.
  • Konkrete Fakten mit Quelle: Zahlen, Fristen, Bedingungen – belegt und mit Stand-Datum.
  • Listen und Tabellen: Vergleiche und Schritte strukturiert statt im Fließtext versteckt.
  • Klare Begriffe: Fachbegriffe einmal erklären, dann einheitlich verwenden.
  • Erkennbare Autorschaft: Wer schreibt, mit welcher Erfahrung? Das ist ein Vertrauenssignal.

Ebene 3: Strukturierte Daten nach Schema.org

Strukturierte Daten beschreiben Inhalte maschinenlesbar im JSON-LD-Format. Sie helfen Suchmaschinen zu verstehen, wer etwas anbietet, was eine Seite ist und welche Fragen sie beantwortet. Wichtige Typen für Unternehmenswebsites:

  • Organization / LocalBusiness: Name, Adresse, Kontakt, Profile in anderen Netzwerken (sameAs).
  • Person: Autorinnen und Autoren mit Qualifikationen.
  • Service: Leistungen mit Anbieter und Einsatzgebiet.
  • Article / BlogPosting: Beiträge mit Autor, Datum und Aktualisierung.
  • FAQPage: Fragen und Antworten.
  • BreadcrumbList: die Einordnung einer Seite in die Website-Struktur.

Wichtig: Strukturierte Daten müssen zum sichtbaren Inhalt passen und vollständig sein. Ein Produkt-Markup ohne Preis etwa erzeugt in der Google Search Console Fehler – wer keine Preise veröffentlicht, beschreibt seine Angebote besser als Service.

Und die llms.txt?

Die llms.txt ist eine 2024 vorgeschlagene Textdatei im Stammverzeichnis einer Website, die KI-Systemen in kompakter Form erklärt, worum es auf der Website geht und welche Seiten die wichtigsten sind – mehr im Glossar unter llms.txt. Sie ist kein offizieller Standard. Vertreter von Google haben öffentlich erklärt, dass Google Search sie nicht nutzt; ob und wie andere KI-Anbieter sie auswerten, ist nicht verlässlich dokumentiert.

Unsere Einschätzung: Eine llms.txt schadet nicht und ist schnell erstellt, sollte aber nicht die erste Maßnahme sein. Crawlbarkeit, gute Inhalte und korrekte strukturierte Daten wirken nachweislich – die llms.txt ist ein kleiner Zusatz.

Checkliste in sieben Punkten

  1. robots.txt auf ausgesperrte KI-Crawler prüfen.
  2. Wichtige Inhalte im ausgelieferten HTML statt nur per JavaScript.
  3. Pro Seite eine klare H1 und Fragen als Zwischenüberschriften.
  4. Antwort zuerst in den ersten Sätzen.
  5. Organization-, Service-, Article- und FAQPage-Schema prüfen und Fehler in der Search Console beheben.
  6. Autorinnen und Autoren sichtbar machen, Datum und Aktualisierung angeben.
  7. Optional: llms.txt mit den wichtigsten Seiten anlegen.

Wie gut Ihre eigene Website für KI-Suchsysteme aufgestellt ist, zeigt der kostenlose SEO-/GEO-Check in wenigen Minuten.

Wie eine llms.txt aufgebaut ist

Der Vorschlag sieht eine einfache Markdown-Datei unter /llms.txt vor:

  • eine Überschrift mit dem Namen der Website oder des Unternehmens
  • eine kurze Zusammenfassung in einem Absatz
  • Abschnitte mit Listen der wichtigsten Seiten, jeweils mit Link und einem Satz Beschreibung
  • optional eine ausführlichere Fassung (llms-full.txt) mit mehr Inhalt

Wer eine llms.txt anlegt, sollte sie aktuell halten – veraltete Links und Beschreibungen sind schlimmer als keine Datei. bettersorted.de stellt eine solche Datei bereit, betrachtet sie aber als Ergänzung, nicht als Kern der Optimierung.

E-E-A-T: warum Vertrauenssignale zählen

Google beschreibt mit E-E-A-T (Experience, Expertise, Authoritativeness, Trustworthiness) die Signale, an denen sich die Qualität von Inhalten bemessen lässt. Für KI-Suche gelten ähnliche Maßstäbe: Systeme zitieren bevorzugt Quellen, denen sie vertrauen. Konkret helfen:

  • Erkennbare Autorinnen und Autoren mit Profil und Qualifikationen
  • Praxisbezug: eigene Erfahrungen, Beispiele, Referenzen
  • Belege: Quellen und Stand-Datum bei Fakten
  • Impressum, Kontakt, Datenschutz vollständig und leicht auffindbar
  • Erwähnungen auf anderen Websites: Verzeichnisse, Fachportale, Presse, Netzwerke

Wie Sie messen, ob KI-Systeme Ihre Seite zitieren

  1. Typische Fragen Ihrer Zielgruppe in ChatGPT, Perplexity und Google stellen und prüfen, welche Quellen genannt werden.
  2. In der Webanalyse Besuche aus KI-Diensten (Verweis-Domains) beobachten.
  3. In der Google Search Console Impressionen für Fragen-Suchanfragen verfolgen.
  4. Die Prüfung in regelmäßigen Abständen wiederholen, weil sich Antworten ändern.

Häufige technische Fehler

  • KI-Crawler versehentlich per robots.txt oder Firewall gesperrt
  • Wichtige Inhalte nur in Bildern oder PDFs
  • Antworten in aufklappbaren Elementen, die erst per JavaScript geladen werden
  • Fehlerhafte oder unvollständige strukturierte Daten
  • Doppelte Seiten ohne Canonical-Angabe

Häufig gestellte Fragen

Was ist eine llms.txt?

Eine Textdatei im Stammverzeichnis einer Website, die KI-Systemen in kompakter Form erklärt, worum es auf der Website geht und welche Seiten wichtig sind. Sie wurde 2024 vorgeschlagen und ist kein offizieller Standard.

Nutzt Google die llms.txt?

Nein. Vertreter von Google haben erklärt, dass Google Search die llms.txt nicht nutzt. Für Google zählen Crawlbarkeit, Inhalte und strukturierte Daten.

Welche strukturierten Daten sind für KI-Suche am wichtigsten?

Organization bzw. LocalBusiness für das Unternehmen, Person für Autoren, Service für Leistungen, Article für Beiträge, FAQPage für Fragen und BreadcrumbList für die Seitenstruktur.

Sollte ich KI-Crawler in der robots.txt erlauben?

Wenn Ihre Inhalte in KI-Antworten erscheinen sollen, ja. Wer GPTBot, ClaudeBot oder PerplexityBot aussperrt, kann von diesen Systemen nicht zitiert werden. Die Entscheidung ist eine Abwägung zwischen Sichtbarkeit und Kontrolle über die eigenen Inhalte.

Stand: Oktober 2026.

Portrait von Muhamed Alahmed, Gründer von bettersorted
Über den Autor

Muhamed Alahmed

Mit über 10 Jahren IT-Erfahrung entwickle ich Lösungen, die nicht nur technisch funktionieren, sondern echten Mehrwert schaffen und Freiräume eröffnen.

Mehr über bettersorted →

Weitere Beiträge

Newsletter

Bleiben Sie auf dem Laufenden zu KI-Themen

Kurze Updates zu KI-Automatisierung, Förderungen und neuen Beiträgen — kein Spam, jederzeit abbestellbar.

Wir verwenden Brevo als Marketing-Plattform. Mit dem Absenden stimmst du der Übertragung deiner Daten gemäß der Datenschutzerklärung von Brevo zu.

AnrufenSchreibenKontaktformular
llms.txt, Schema.org & Co.: von KI zitiert werden