Deindexierte PDFs finden: Search Console API, URL Inspection & Analytics Edge

Veröffentlicht: 2026-10-08
Autor: Thomas Hintz | Seoholics
Lesezeit: 4 min

Was ist passiert?

Google hat in einem weitreichenden Update begonnen, PDF-Dateien aus dem Index zu entfernen. Viele dieser Dateien werden in der Search Console nun als „Gecrawlt, aber nicht indexiert“ geführt. Es handelt sich nicht um isolierte Vorfälle einzelner Websites, sondern um eine systemische Änderung in der Art und Weise, wie Google PDF-Inhalte bewertet und indexiert.

2

Limit der URL Inspection API

Diese Beschränkung gilt pro Property und Tag bei der Abfrage des Indexierungsstatus.

Die Fakten

  • PDF-Dateien wurden in einem großen Umfang aus dem Google-Index entfernt, was zu Rückgängen bei Impressionen und Klicks führte.
  • Ein Großteil der betroffenen Dateien wird im Indexierungsbericht der Search Console unter dem Status „Gecrawlt, aber nicht indexiert“ geführt.
  • Es gibt Beobachtungen über eine teilweise Wiederaufnahme von PDFs in den Index, was zu einem erneuten Anstieg der Sichtbarkeit bei einigen Seiten führte.
  • Die URL Inspection API liefert über das Feld coverageState den exakten Grund für die Nicht-Indexierung (z. B. „Google hat eine andere kanonische Seite gewählt“).
  • Die URL Inspection API ist auf 2.000 URLs pro Property und Tag limitiert.

Was bedeutet das für Dich?

Diese Entwicklung betrifft alle Website-Betreiber, die PDF-Dokumente als primäre Inhaltsform nutzen, um in den Suchergebnissen zu ranken. Wer PDFs lediglich als Download-Anhang für bereits existierende HTML-Seiten nutzt, ist von dieser Änderung nicht betroffen.

Für kleine Websites

  1. Nutzen Sie den Performance-Bericht der Search Console und filtern Sie die Seiten mit dem Regex .pdf$ (oder ohne das $ Zeichen, falls Query-Parameter folgen). Sie erkennen den Erfolg daran, dass Sie eine vollständige Liste aller PDFs erhalten, die Impressionen oder Klicks generiert haben. Der Aufwand ist gering und dauert wenige Minuten.
  2. Prüfen Sie die betroffenen URLs manuell über das URL-Inspektions-Tool der Search Console. Die Wirkung ist die Kenntnis des exakten Indexierungsstatus pro Datei. Bei weniger als 1.000 URLs ist dieser manuelle Prozess vertretbar, der Zeitaufwand ist jedoch linear zur Anzahl der Dateien.
  3. Überführen Sie wertvolle PDF-Inhalte in HTML-Seiten. Die Wirkung zeigt sich durch eine stabilere Indexierung und eine bessere mobile Nutzererfahrung. Der Aufwand ist moderat bis hoch, je nach Menge des Contents.

Für große Websites und Agenturen

  1. Exportieren Sie alle rankenden PDF-URLs über die Search Analytics API, um die Limitierung der Benutzeroberfläche von 1.000 Zeilen zu umgehen. Der Erfolg ist ein vollständiger Datensatz aller PDF-URLs inkl. Klicks, Impressionen, CTR und Position. Der Aufwand ist moderat, sofern API-Tools wie Analytics Edge genutzt werden.
  2. Automatisieren Sie die Prüfung des Indexierungsstatus durch die URL Inspection API. Sie erkennen den Erfolg an einer Tabelle, die für jede URL den coverageState ausweist. Der Aufwand ist einmalig in der Einrichtung, danach gering.
  3. Um das Limit von 2.000 URLs pro Tag zu überwinden, verteilen Sie die Abfragen über verschiedene GSC-Properties (Domain-, Verzeichnis- und URL-Präfix-Properties). Die Wirkung ist eine schnellere Analyse großer PDF-Bestände. Der Aufwand ist moderat.

Wer keine Maßnahmen ergreift, riskiert den dauerhaften Verlust der Sichtbarkeit für alle Inhalte, die ausschließlich in PDF-Form vorliegen.

Experten-Meinung

Die Deindexierung von PDFs folgt einem bekannten Muster: Google priorisiert zunehmend Formate, die eine optimale mobile Nutzererfahrung bieten. PDFs sind auf Mobilgeräten oft schwer zu konsumieren und weisen eine hohe Dateigröße auf. Es ist eine logische Konsequenz, dass HTML-Inhalte gegenüber statischen Dokumenten bevorzugt werden. Die Beobachtung, dass einige PDFs wieder in den Index zurückkehren, deutet darauf hin, dass Google die Schwellenwerte für die Qualität oder Relevanz von PDFs noch feinjustiert. Dennoch bleibt die Empfehlung bestehen: PDF-Content sollte als sekundär betrachtet und primär als HTML bereitgestellt werden.

Daten und Zahlen

Die Analyse zeigt, dass die Search Console UI nur bis zu 1.000 Zeilen Daten liefert, was den Einsatz der Search Analytics API für größere Bestände zwingend macht. Ein kritischer Faktor bei der technischen Analyse ist das Limit der URL Inspection API, welches bei 2.000 URLs pro Property und Tag liegt. Durch die Nutzung mehrerer Properties kann dieses Limit technisch umgangen werden, um größere Datenmengen zu prüfen. Die zeitliche Einordnung der Sichtbarkeitsverluste bei betroffenen Seiten wurde beispielhaft um den 25. August herum beobachtet.

Ausblick

Es ist zu erwarten, dass die Volatilität bei PDF-Indexierungen anhält, bis Google ein finales Qualitätslevel für Dokumentformate etabliert hat. SEOs sollten damit rechnen, dass die Hürden für die Indexierung von PDFs weiter steigen. Die Strategie muss weg vom „Dokument-Ranking“ hin zur „Content-Seite“ führen, bei der das PDF lediglich als optionaler Export für den Nutzer dient.

Verwandte Artikel