Der (vielleicht) aufkommende llms.txt-Standard entbehrt ja gerade nicht wenig Ironie, stellt doch die llms.txt-Datei am Ende nichts anderes als Nachhilfe für künstliche Intelligenzen dar.
Large language models increasingly rely on website information, but face a critical limitation: context windows are too small to handle most websites in their entirety. Converting complex HTML pages with navigation, ads, and JavaScript into LLM-friendly plain text is both difficult and imprecise.
While websites serve both human readers and LLMs, the latter benefit from more concise, expert-level information gathered in a single, accessible location. This is particularly important for use cases like development environments, where LLMs need quick access to programming documentation and APIs.
llmstxt.org
Etliche Jahrhunderte an menschlicher Leistung unter enormem Einsatz von finanziellen und natürlichen Ressourcen an Trainingsdaten verbraucht, aber zu blöd, um Inhalt von Werbung trennen zu können.
Wisst ihr, was mir gefallen würde? Wenn solche Dateien für Leserinnen und Leser bereitgestellt würden. Dateien, in denen aufs Wesentliche zusammengefasste Informationen auf gutem Niveau auf einer einzigen, leicht erreichbaren Page ohne überbordende Navigation, Werbung und sonstigem Crap, der das Lesen zur Qual macht, präsentiert würden. Stattdessen drehen wir den Spieß um, belassen den vermüllten Inhalt der Verarbeitung durch Menschen, und stellen den KI-Bots eine saubere, von Müll befreite Version unserer Inhalte zur Verfügung.
Es geht immer so oder so. Wenn aber eine der beiden Optionen Menschen dient, die andere zusätzliche Aufwände und Erschwernis mit sich bringt, aber einer KI dienst, dann ist es fast schon ein Naturgesetz, dass man sich für die zweite Variante entscheidet.
Schreibe einen Kommentar