Der Stand der Zitierbarkeit im Web
Jeden Monat veröffentlichen wir, was Primafonte auf den analysierten Websites findet: wie viele bereit sind, von einem Modell zitiert zu werden, wie viele nicht, und woran es genau am häufigsten scheitert.
Das sind aggregierte Zahlen aus echten Scans. Keine einzelne Website und keine einzelne Punktzahl taucht auf: Veröffentlicht wird, was für die Gesamtheit gilt, nicht was für jemanden im Besonderen gilt.
Stichprobe
11 im September 2026 analysierte Websites, gemessen mit der Methodik 0.15.0 · vorläufige Schwellenwerte.
Die Stichprobe dieses Monats ist klein: 11 Websites. Die Zahlen stammen aus echten Scans, geschätzt wird nichts, aber sie sind als das zu lesen, was sie sind — eine kleine Zählung — und nicht als der Zustand der Branche.
Die Zahlen sind nach Version der Methodik gruppiert. Die Kriterien haben sich im Lauf der Zeit geändert, deshalb wäre ein Vergleich über Versionen hinweg ohne Aussage.
Wie verteilen sich die Punktzahlen?
Die Punktzahlen werden nicht in Zehnerschritten gruppiert, sondern danach, was sie bedeuten: ob ein Modell die Website als Quelle nutzen kann, ob es sie findet, aber nicht verlässlich zitiert, ob sie mit klar benennbaren blinden Flecken funktioniert, oder ob ihr nichts strukturell im Weg steht. Die Bandbreite wiegt schwerer als die genaue Zahl.
- Bereit — keine strukturellen Hindernisse
- 7 · 64%
- Zitierfähig mit Lücken — es funktioniert, mit konkreten blinden Flecken
- 1 · 9%
- Teilweise lesbar — sie finden Sie, können Sie aber nicht verlässlich zitieren
- 2 · 18%
- Nicht zitierfähig — Modelle können diese Website nicht als Quelle nutzen
- 1 · 9%
Woran es am häufigsten scheitert
Anteil der Websites, die die jeweilige Prüfung nicht bestehen, berechnet nur über die, die sich messen ließen. Prüfungen ohne Ergebnis bleiben außen vor, genau wie bei der Punktzahl.
- Einheitliche Beschreibung
- 100% · 10/10
- Lesbare Kontaktdaten
- 73% · 8/11
- Daten im Inhalt
- 70% · 7/10
- Als Frage formulierte Überschriften
- 60% · 6/10
- Externe Profile über sameAs deklariert
- 55% · 6/11
- Links auf externe Quellen
- 55% · 6/11
- Deklarierte Urheberschaft
- 55% · 6/11
- Listen und Tabellen
- 36% · 4/11
- Inhaltsaushandlung für Markdown
- 36% · 4/11
- Veröffentlichungs- und Änderungsdatum
- 36% · 4/11
Was macht fast jeder richtig?
Diese fünf bestehen die meisten, und sie zu sehen ist so wichtig wie die Fehlschläge zu sehen: Eine Prüfung, die alle bestehen, unterscheidet niemanden, und bleibt eine lange dort, muss entschieden werden, ob sie noch etwas beiträgt oder nur Gewicht bindet, das einer anderen besser stünde.
- Hauptinhalt ohne JavaScript
- 100% · 11/11
- Die Crawler, die Sie zitieren, sind nicht gesperrt
- 100% · 11/11
- Überschriftenhierarchie
- 100% · 11/11
- Einheitlicher Markenname
- 100% · 10/10
- Gleicher Inhalt für Bots und für Menschen
- 100% · 11/11
Zu welchen anderen Monaten gibt es Daten?
Jeder Monat wird getrennt veröffentlicht, mit der Methodikversion, unter der gemessen wurde. Versionen werden nie vermischt: Die Kriterien haben sich mehrfach geändert, und Monate mit unterschiedlichen Regeln zusammenzulegen ergäbe eine Reihe, die nichts bedeutet, so ordentlich sie auch aussähe.
Woher stammen diese Zahlen?
Die Zahlen dieser Seite stammen aus echten Scans, ausgeführt von der Engine, die in der Methodik dokumentiert ist. Die Normen und Studien, auf denen diese Prüfungen aufbauen, sind die folgenden, und jeder kann sie selbst nachprüfen.
- GEO: Generative Engine Optimization
Die Studie, die die Wirkung des Zitierens von Quellen, des Angebens von Daten und des Ergänzens von Zitaten gemessen hat: bis zu 40 % mehr Sichtbarkeit in Antworten.
- schema.org
Das Vokabular, gegen das strukturierte Daten geprüft werden, aus dem zwei der hier gezählten Prüfungen stammen.
- RFC 9309
Die robots.txt-Norm, aus der die drei Crawler-Prüfungen stammen.
- llms.txt
Die Konvention der Indexdatei für Agenten, noch ohne verabschiedete Spezifikation.
Kalibrierungsstudie
Neben den Scans, die Menschen anfordern, haben wir eine eigene Stichprobe gemessen, um die Schwellenwerte der Methodik zu kalibrieren. Diese Zahlen stammen daraus und werden getrennt veröffentlicht, weil wir die Websites selbst ausgewählt haben und sich damit ändert, was die Zahlen bedeuten.
321 Domains aus Spanien, dem Vereinigten Königreich, den Vereinigten Staaten und dem übrigen Europa, von Marken über Dienstleister bis zum Mittelstand, gemessen am 4. August 2026 mit der Methodik 0.7.0 · vorläufige Schwellenwerte. Die Zahlen beziehen sich auf die 226, die sich vollständig messen ließen.
Bei 51 kamen wir nicht durch: Ihre Firewall hat die Analyse blockiert. Das sind 18 % der Versuche, die überhaupt irgendwo ankamen. Weitere 41 antworteten nicht oder hatten nichts zu analysieren.
61
Durchschnittswert der Stichprobe
Wie verteilen sich die Punktzahlen der Stichprobe?
Die Stichprobe wurde von Hand zusammengestellt, Branche für Branche, also beschreibt diese Verteilung genau diese Gruppe von Websites und keine andere. Sie ist keine Momentaufnahme des Webs, sondern eine der Websites, die wir zum Kalibrieren ausgewählt haben — und das ist etwas ziemlich anderes.
- Bereit — keine strukturellen Hindernisse
- 9 · 4%
- Zitierfähig mit Lücken — es funktioniert, mit konkreten blinden Flecken
- 124 · 55%
- Teilweise lesbar — sie finden Sie, können Sie aber nicht verlässlich zitieren
- 80 · 35%
- Nicht zitierfähig — Modelle können diese Website nicht als Quelle nutzen
- 13 · 6%
Woran es am häufigsten scheitert
Anteil der Websites, die die jeweilige Prüfung nicht bestehen, bezogen auf die messbaren. Daneben steht, wie viele Websites dieser Anteil umfasst.
- Erklärte Haltung gegenüber den Crawlern, die Sie zitieren
- 97% · 215/222
- Inhaltsaushandlung für Markdown
- 96% · 217/226
- Direkte Antworten nach jeder Überschrift
- 95% · 194/204
- Strukturierte häufige Fragen
- 94% · 212/226
- Entitäts- und Geschäftstyp deklariert
- 91% · 206/226
- Link-Header zur Auffindbarkeit
- 85% · 192/226
- Datei llms.txt
- 82% · 182/222
- Absätze, die außerhalb ihres Zusammenhangs bestehen
- 66% · 149/226
Was macht fast die ganze Stichprobe richtig?
Das sind die Prüfungen, an denen fast niemand scheitert. Sie sind das Gegengewicht zur Liste darüber: Nur zu veröffentlichen, was scheitert, zeichnete ein dunkleres Bild als die Wirklichkeit, und eine Methodik, die nur schlechte Nachrichten zeigt, ähnelt zu sehr einem Verkaufsargument.
- Der Crawler wird nicht gesperrt
- 100% · 226/226
- Zeit bis zum ersten Byte
- 95% · 215/226
- Die Crawler, die Sie zitieren, sind nicht gesperrt
- 94% · 209/222
- robots.txt erreichbar und lesbar
- 91% · 202/222
- Gleicher Inhalt für Bots und für Menschen
- 88% · 172/195
- Einheitlicher Markenname
- 85% · 160/188
- Erkennbare Unternehmens- oder Autorenseite
- 80% · 181/226
- Saubere Weiterleitungskette
- 79% · 179/226
Die Stichprobe wurde von Hand zusammengestellt, Branche für Branche, und ist deshalb nicht repräsentativ für das Web insgesamt: Sie beschreibt genau diese Websites und keine anderen. Die Liste der Domains ist im Repository des Projekts veröffentlicht, und keine Domain erscheint hier mit ihrer Punktzahl.