Primafonte

Der Stand der Zitierbarkeit im Web

Jeden Monat veröffentlichen wir, was Primafonte auf den analysierten Websites findet: wie viele bereit sind, von einem Modell zitiert zu werden, wie viele nicht, und woran es genau am häufigsten scheitert.

Das sind aggregierte Zahlen aus echten Scans. Keine einzelne Website und keine einzelne Punktzahl taucht auf: Veröffentlicht wird, was für die Gesamtheit gilt, nicht was für jemanden im Besonderen gilt.

Stichprobe

11 im September 2026 analysierte Websites, gemessen mit der Methodik 0.15.0 · vorläufige Schwellenwerte.

Die Stichprobe dieses Monats ist klein: 11 Websites. Die Zahlen stammen aus echten Scans, geschätzt wird nichts, aber sie sind als das zu lesen, was sie sind — eine kleine Zählung — und nicht als der Zustand der Branche.

Die Zahlen sind nach Version der Methodik gruppiert. Die Kriterien haben sich im Lauf der Zeit geändert, deshalb wäre ein Vergleich über Versionen hinweg ohne Aussage.

Wie verteilen sich die Punktzahlen?

Die Punktzahlen werden nicht in Zehnerschritten gruppiert, sondern danach, was sie bedeuten: ob ein Modell die Website als Quelle nutzen kann, ob es sie findet, aber nicht verlässlich zitiert, ob sie mit klar benennbaren blinden Flecken funktioniert, oder ob ihr nichts strukturell im Weg steht. Die Bandbreite wiegt schwerer als die genaue Zahl.

Bereit — keine strukturellen Hindernisse
7 · 64%
Zitierfähig mit Lücken — es funktioniert, mit konkreten blinden Flecken
1 · 9%
Teilweise lesbar — sie finden Sie, können Sie aber nicht verlässlich zitieren
2 · 18%
Nicht zitierfähig — Modelle können diese Website nicht als Quelle nutzen
1 · 9%

Woran es am häufigsten scheitert

Anteil der Websites, die die jeweilige Prüfung nicht bestehen, berechnet nur über die, die sich messen ließen. Prüfungen ohne Ergebnis bleiben außen vor, genau wie bei der Punktzahl.

Einheitliche Beschreibung
100% · 10/10
Lesbare Kontaktdaten
73% · 8/11
Daten im Inhalt
70% · 7/10
Als Frage formulierte Überschriften
60% · 6/10
Externe Profile über sameAs deklariert
55% · 6/11
Links auf externe Quellen
55% · 6/11
Deklarierte Urheberschaft
55% · 6/11
Listen und Tabellen
36% · 4/11
Inhaltsaushandlung für Markdown
36% · 4/11
Veröffentlichungs- und Änderungsdatum
36% · 4/11

Was macht fast jeder richtig?

Diese fünf bestehen die meisten, und sie zu sehen ist so wichtig wie die Fehlschläge zu sehen: Eine Prüfung, die alle bestehen, unterscheidet niemanden, und bleibt eine lange dort, muss entschieden werden, ob sie noch etwas beiträgt oder nur Gewicht bindet, das einer anderen besser stünde.

Hauptinhalt ohne JavaScript
100% · 11/11
Die Crawler, die Sie zitieren, sind nicht gesperrt
100% · 11/11
Überschriftenhierarchie
100% · 11/11
Einheitlicher Markenname
100% · 10/10
Gleicher Inhalt für Bots und für Menschen
100% · 11/11

Zu welchen anderen Monaten gibt es Daten?

Jeder Monat wird getrennt veröffentlicht, mit der Methodikversion, unter der gemessen wurde. Versionen werden nie vermischt: Die Kriterien haben sich mehrfach geändert, und Monate mit unterschiedlichen Regeln zusammenzulegen ergäbe eine Reihe, die nichts bedeutet, so ordentlich sie auch aussähe.

Woher stammen diese Zahlen?

Die Zahlen dieser Seite stammen aus echten Scans, ausgeführt von der Engine, die in der Methodik dokumentiert ist. Die Normen und Studien, auf denen diese Prüfungen aufbauen, sind die folgenden, und jeder kann sie selbst nachprüfen.

  • GEO: Generative Engine Optimization

    Die Studie, die die Wirkung des Zitierens von Quellen, des Angebens von Daten und des Ergänzens von Zitaten gemessen hat: bis zu 40 % mehr Sichtbarkeit in Antworten.

  • schema.org

    Das Vokabular, gegen das strukturierte Daten geprüft werden, aus dem zwei der hier gezählten Prüfungen stammen.

  • RFC 9309

    Die robots.txt-Norm, aus der die drei Crawler-Prüfungen stammen.

  • llms.txt

    Die Konvention der Indexdatei für Agenten, noch ohne verabschiedete Spezifikation.

Kalibrierungsstudie

Neben den Scans, die Menschen anfordern, haben wir eine eigene Stichprobe gemessen, um die Schwellenwerte der Methodik zu kalibrieren. Diese Zahlen stammen daraus und werden getrennt veröffentlicht, weil wir die Websites selbst ausgewählt haben und sich damit ändert, was die Zahlen bedeuten.

321 Domains aus Spanien, dem Vereinigten Königreich, den Vereinigten Staaten und dem übrigen Europa, von Marken über Dienstleister bis zum Mittelstand, gemessen am 4. August 2026 mit der Methodik 0.7.0 · vorläufige Schwellenwerte. Die Zahlen beziehen sich auf die 226, die sich vollständig messen ließen.

Bei 51 kamen wir nicht durch: Ihre Firewall hat die Analyse blockiert. Das sind 18 % der Versuche, die überhaupt irgendwo ankamen. Weitere 41 antworteten nicht oder hatten nichts zu analysieren.

61

Durchschnittswert der Stichprobe

Wie verteilen sich die Punktzahlen der Stichprobe?

Die Stichprobe wurde von Hand zusammengestellt, Branche für Branche, also beschreibt diese Verteilung genau diese Gruppe von Websites und keine andere. Sie ist keine Momentaufnahme des Webs, sondern eine der Websites, die wir zum Kalibrieren ausgewählt haben — und das ist etwas ziemlich anderes.

Bereit — keine strukturellen Hindernisse
9 · 4%
Zitierfähig mit Lücken — es funktioniert, mit konkreten blinden Flecken
124 · 55%
Teilweise lesbar — sie finden Sie, können Sie aber nicht verlässlich zitieren
80 · 35%
Nicht zitierfähig — Modelle können diese Website nicht als Quelle nutzen
13 · 6%

Woran es am häufigsten scheitert

Anteil der Websites, die die jeweilige Prüfung nicht bestehen, bezogen auf die messbaren. Daneben steht, wie viele Websites dieser Anteil umfasst.

Erklärte Haltung gegenüber den Crawlern, die Sie zitieren
97% · 215/222
Inhaltsaushandlung für Markdown
96% · 217/226
Direkte Antworten nach jeder Überschrift
95% · 194/204
Strukturierte häufige Fragen
94% · 212/226
Entitäts- und Geschäftstyp deklariert
91% · 206/226
Link-Header zur Auffindbarkeit
85% · 192/226
Datei llms.txt
82% · 182/222
Absätze, die außerhalb ihres Zusammenhangs bestehen
66% · 149/226

Was macht fast die ganze Stichprobe richtig?

Das sind die Prüfungen, an denen fast niemand scheitert. Sie sind das Gegengewicht zur Liste darüber: Nur zu veröffentlichen, was scheitert, zeichnete ein dunkleres Bild als die Wirklichkeit, und eine Methodik, die nur schlechte Nachrichten zeigt, ähnelt zu sehr einem Verkaufsargument.

Der Crawler wird nicht gesperrt
100% · 226/226
Zeit bis zum ersten Byte
95% · 215/226
Die Crawler, die Sie zitieren, sind nicht gesperrt
94% · 209/222
robots.txt erreichbar und lesbar
91% · 202/222
Gleicher Inhalt für Bots und für Menschen
88% · 172/195
Einheitlicher Markenname
85% · 160/188
Erkennbare Unternehmens- oder Autorenseite
80% · 181/226
Saubere Weiterleitungskette
79% · 179/226

Die Stichprobe wurde von Hand zusammengestellt, Branche für Branche, und ist deshalb nicht repräsentativ für das Web insgesamt: Sie beschreibt genau diese Websites und keine anderen. Die Liste der Domains ist im Repository des Projekts veröffentlicht, und keine Domain erscheint hier mit ihrer Punktzahl.