Wissensbasis›Retrieval-Pipelines›Retrieval-Pipelines (Labrador, Scrape)
pipeline/labradorChatGPT holt Treffer aus mehreren Quellen: einem eigenen Index (intern labrador), gekauften Google-Ergebnissen über Scraping-Dienste (bright, oxylabs), einer eigenen SERP-Quelle und zeitweise bing. Bis 21.07.2026 stand die Quelle je Treffer im Feld result_source. Seitdem fehlt es. Wir erkennen die Pipeline an der Signatur der Treffer: Median der Ausriss-Länge, Anteil ohne Ausriss, Titel über 75 Zeichen. Gemessen 20.–22.08.2026: Lokal-, Produkt-, Entitäts- und Vergleichsfragen liegen stabil bei Median 202 Zeichen (eigener Index); Nachrichten- und Preisfragen bei 131–158 Zeichen mit Titeln unter 60 Zeichen (Google-Scrape).
Die Pipeline bestimmt, was vom Dokument ankommt. Segonzac belegt für den Index: Ausriss ~200 Zeichen ab der H1, Meta-Description ignoriert, JSON-LD entfernt, Seiten über 4 MB verworfen, Reading-Cache 30 Minuten. Für den Google-Scrape gelten Googles Snippet-Regeln. Eine Seite, die auf Meta-Descriptions und Schema setzt, wird im Index-Pfad daran nicht erkannt. Ob eine Frage im Index-Pfad oder im Scrape-Pfad läuft, hängt am Thema (Live-Daten gehen in den Scrape) und laut Mohanadasan an der Account-Kohorte.
result_source am 21.07. entfernt, fünfte Pipe bing.mohanadasan-2026-06-24 · mohanadasan-2026-07-14 · segonzac-2026-08-17 · goodwin-2026-07-08
Kein Ereignis betrifft dieses Objekt bisher.
Query Fan-out open (geöffnete Treffer) Ausriss-Median (Pipeline-Signatur)