murattunalı.

llms.txt-Generator.

Der llms.txt-Generator erzeugt aus einer Sitemap oder einer Adressliste eine Datei im Format von llmstxt.org.

llms.txt ist eine reine Textdatei, die Modell-Crawlern sagt, was eine Website ist und wo zu suchen ist. Das Format ist Markdown: eine Überschrift, eine Zusammenfassung und verlinkte Abschnitte. Von einer Sitemap unterscheidet sie ihre Leserschaft — die Sitemap nennt einem Crawler die vorhandenen Adressen, llms.txt sagt einem Modell, wozu jede einzelne dient.

Eingabe in zwei Formen

Wird Sitemap-XML eingefügt, liest das Werkzeug die Adressen und leitet die Titel aus dem Adresspfad ab. Das ist ein schneller Einstieg, aber abgeleitete Titel bleiben grob. Die zweite Form liefert bessere Ergebnisse: eine Adresse pro Zeile, Titel und Zusammenfassung durch einen senkrechten Strich getrennt. Die Zusammenfassung ist der Teil, der einem Modell erlaubt, eine Seite zu verstehen, ohne sie zu öffnen — sie lohnt die Handarbeit.

Die erzeugte Datei ist nichts Einmaliges. Erscheint eine neue Seite, muss die Liste mitwachsen; eine Datei, die von Hand gepflegt wird, veraltet binnen weniger Monate. Die richtige Lösung ist, die Datei an den Build zu binden — auf dieser Website wird llms.txt aus den Sammlungen erzeugt: Der Index trägt 25 Adressen, das vollständige Verzeichnis 146.

Warum die Datei nicht an einen Server geht

Das Werkzeug arbeitet vollständig im Browser: Weder die eingefügte Liste noch die erzeugte Ausgabe wird irgendwohin gesendet. Ein Grund ist die Datenschutzerklärung dieser Website, der andere ihre Content-Security-Policy — externe Anfragen sind ohnehin blockiert. Für die Nutzerin ist das Ergebnis besser: Auch eine noch nicht veröffentlichte Sitemap lässt sich prüfen.

Die Ausgabe wird in die Zwischenablage kopiert; ein Dateidownload kommt nicht zum Einsatz, und in den Browser wird nichts geschrieben. Der kopierte Text gehört unter dem Namen `llms.txt` in das Stammverzeichnis der Website und wird als reiner Text ausgeliefert.

Seine Grenzen

llms.txt ist ein Vorschlag, kein Standard; keine Suchmaschine muss sie lesen, und Google sagt ausdrücklich, sie auf der Suchseite nicht zu verwenden. Die Datei abzulegen garantiert keine Sichtbarkeit — sie bietet einem Modell, das sie liest, eine aufgeräumte Karte. Der Unterschied zu robots.txt und die Ebene als Ganzes stehen getrennt geschrieben.

So wird es benutzt

  1. Schreiben Sie den Namen der Website und eine Zusammenfassung in einem Satz
  2. Fügen Sie die Sitemap-XML ein oder eine Liste aus Zeilen der Form „Adresse | Titel | Zusammenfassung“
  3. Klicken Sie auf Erzeugen, kopieren Sie die Ausgabe und legen Sie sie als llms.txt in das Stammverzeichnis

Das Werkzeug läuft vollständig in Ihrem Browser — es werden keine Daten gesendet und keine Cookies gesetzt.

QUELLEN