murattunalı.

Maschinenlesung.

Die Maschinenlesung ruft eine Adresse vom eigenen Server dieser Website so ab, wie ein Crawler es täte, und zeigt Zeile für Zeile, was die Seite einer Maschine sagt.

Gelesen wird das Markup der Seite: Titel und Beschreibung, kanonische Adresse, Sprache und hreflang-Satz, JSON-LD-Schematypen, was robots.txt KI-Agenten sagt, und ob llms.txt und eine Sitemap vorhanden sind. Das Werkzeug deutet die Seite nicht wie ein Mensch; es schreibt Zeile für Zeile auf, was im Markup steht, und lässt einen Strich, wo nichts ist.

Warum vom Server

Ein Browser kann eine fremde Website nicht selbst lesen: Die Content-Security-Policy und CORS verhindern das. Deshalb geht die Adresse an den eigenen Server dieser Website; der Server ruft sie unter seiner eigenen Kennung ab (im Request-Header stehen Name und Adresse des Werkzeugs), gibt das Ergebnis an Ihren Browser zurück und speichert weder die Adresse noch das Ergebnis. Das unterscheidet es von den übrigen Werkzeugen dieser Website, und die Datenschutzerklärung sagt es gesondert.

Was die Zeilen sagen

Die erste Zeile ist die Anfrage selbst: die erreichte Adresse, der Statuscode und die Dauer. Gibt es eine Weiterleitungskette, werden höchstens vier Schritte verfolgt und die letzte Adresse geschrieben. Die Schema-Zeile listet die aus JSON-LD-Blöcken gelesenen Typen; ein nicht parsbarer Block wird als solcher markiert. Die hreflang-Zeile trägt die Sprachcodes, die die Seite angibt. Die robots.txt-Zeile gibt Agent für Agent wieder, was die Datei KI-Agenten sagt: Hat der Agent eine eigene Gruppe, gilt diese, sonst die allgemeine; gar keine Regel ist ebenfalls eine Antwort.

Die llms.txt-Zeile misst nur das Vorhandensein; eine Datei, die HTML zurückgibt, zählt nicht. Eine Wirkung wird nicht behauptet: Die Datei ist ein Vorschlag, und das Observatorium dieser Website misst ihre Verbreitung gesondert. Der Unterschied zu robots.txt und die Ebene als Ganzes stehen getrennt geschrieben.

Seine Grenzen

Das Werkzeug liest nur öffentliche Adressen: Lokale Adressen, IP-Nummern und diese Website selbst werden abgewiesen. Der Body wird bei 400 KB abgeschnitten, die Anfrage gibt nach sechs Sekunden auf, es werden höchstens vier Weiterleitungen verfolgt, und Lesungen sind auf zwölf pro Minute und IP-Adresse begrenzt. JavaScript wird nicht ausgeführt. Eine Website, die ihre Inhalte im Client aufbaut, kann hier leer wirken; genau das sieht auch die Maschine.

So wird es benutzt

  1. Geben Sie die Adresse der Seite ein, die Sie lesen möchten
  2. Klicken Sie auf Lesen; der Server ruft die Seite, robots.txt, llms.txt und die Sitemap ab
  3. Lesen Sie die Zeilen: Jede steht für etwas, das wirklich im Markup vorhanden ist, nicht für eine Deutung

Dieses Werkzeug sendet die eingegebene Adresse an den eigenen Server dieser Website; der Server liest die Adresse, gibt das Ergebnis an Ihren Browser zurück und speichert nichts.

QUELLEN