Product Svana Ai Files 1544

AI-Files

Svana AI-Files — maschinenlesbare Site-Dateien und KI-Crawler-Kontrolle

Svana AI-Files liefert die maschinenlesbare Repräsentation deiner WordPress-Website: llms.txt, ai.txt und llm-full.txt als virtuelle Dateien — plus ein robots.txt-Cockpit, mit dem du KI-Crawler und kommerzielle Datensammler gezielt steuerst. Ohne physische Dateien, ohne externe Dienste — als Teil der Svana Suite.

Zur Svana Suite

Wofür wurde Svana AI-Files entwickelt — und für wen?

KI-Systeme lesen Websites anders als Menschen — und anders als klassische Suchmaschinen. Zwei Dinge brauchen sie dafür: klare Regeln, welche Crawler was dürfen (robots.txt), und idealerweise eine strukturierte Selbstbeschreibung der Website in Textform. Für Letzteres etabliert sich mit llms.txt gerade eine junge Konvention. Svana AI-Files deckt beide Ebenen ab — und zwar so, wie wir es selbst haben wollten: ohne physische Dateien im Web-Root, die bei jedem Umzug verloren gehen, und ohne Wartungsaufwand, weil sich die Inhalte automatisch aus der Website erzeugen.

Eines vorweg, weil uns Ehrlichkeit wichtiger ist als ein flotter Werbespruch: Svana AI-Files ist Infrastruktur, kein Sichtbarkeits-Booster. Die robots.txt-Regeln wirken real — seriöse KI-Crawler wie GPTBot, ClaudeBot oder Google-Extended halten sich daran. Der Nutzen von llms.txt bei den großen Endkunden-KI-Suchen ist heute dagegen noch nicht belegt; seinen konkreten Wert hat das Format vor allem in Entwickler- und Agenten-Kontexten — und als risikofreie Zukunftsvorsorge. Gebaut ist das Plugin für Agenturen und Website-Betreiber, die ihre KI-Grundlagen sauber und wartungsfrei aufstellen wollen, statt später hinterherzurüsten.

Drei Bausteine, ein Plugin

📄

llms.txt & ai.txt

Die Site-Übersicht nach der llms.txt-Spezifikation: Titel, Beschreibung, Seiten, Themen, Beiträge mit Auszug und Verweise — dazu ai.txt als knappe Info- und Verweisdatei für KI-Modelle. Beide werden virtuell ausgeliefert und bei Inhaltsänderungen automatisch aktualisiert.

📚

llm-full.txt — der Volltext

Der vollständige Text ausgewählter Inhalte unter /llm-full.txt — echter Volltext mit erhaltenen Überschriften, bereinigt um Bausteine und Shortcodes. Eine Deckelung schützt große Websites: pro Beitrag und insgesamt begrenzt, bei Erreichen sichtbar gekürzt.

🚦

robots.txt-Cockpit

KI-Crawler einzeln erlauben oder aussperren, kommerzielle Datensammler gezielt blockieren — mit einer Vorschau-Kachel, die exakt zeigt, was Svana AI-Files an deine robots.txt anhängt. Auch hier: alles virtuell, keine Datei im Web-Root.

Welche Arbeitserleichterung bietet Svana AI-Files?

Der Kernvorteil ist das Prinzip „virtuell statt physisch“: Alle Dateien werden zur Laufzeit erzeugt und ausgeliefert — nichts wird ins Dateisystem geschrieben. Das heißt: kein FTP-Zugriff, keine Datei, die beim Hoster-Umzug oder Website-Relaunch vergessen wird, keine llms.txt, die noch Inhalte von vor zwei Jahren beschreibt. Neue Beiträge, geänderte Seiten, gelöschte Inhalte — die Dateien ziehen automatisch nach, ein Cache sorgt dafür, dass das ohne Last passiert.

Zweiter Zeitgewinn: die Crawler-Steuerung ohne Handarbeit. Statt User-Agent-Namen zu recherchieren und robots.txt-Syntax zu pflegen, setzt du Häkchen: 12 relevante KI-Crawler (von GPTBot über ClaudeBot bis Perplexity) stehen zur Einzelsteuerung bereit, dazu eine zweistufige Blockliste mit 25 kommerziellen Crawlern — etwa Ahrefs oder Semrush, die deine Website nur durchsuchen, um SEO-Daten zu sammeln und weiterzuverkaufen, oft an deine Wettbewerber. Standardmäßig ist nichts blockiert; du entscheidest pro Crawler oder gruppenweise. Und drittens: Die Vorschau je Datei zeigt jederzeit den tatsächlich ausgelieferten Inhalt — kein Rätselraten, was draußen ankommt.

Wie funktioniert Svana AI-Files?

Das Plugin klinkt sich in die URL-Verarbeitung von WordPress ein und beantwortet Anfragen an /llms.txt, /ai.txt und /llm-full.txt direkt — außerdem ergänzt es die von WordPress generierte robots.txt um deinen Regelblock. Die wichtigsten Mechanismen:

  • Generatoren mit Cache: Jede Datei hat ihren eigenen Generator; die Ergebnisse werden zwischengespeichert und bei Inhaltsänderungen automatisch neu erzeugt. Besucher- und Crawler-Anfragen treffen also auf fertige Inhalte, nicht auf laufende Berechnungen.
  • Saubere Text-Aufbereitung: llm-full.txt liefert echten Volltext — Überschriften bleiben erhalten, Gutenberg-Bausteine und Shortcodes werden entfernt, Sonderzeichen erscheinen als Klartext. Passwortgeschützte Beiträge und Seiten bleiben grundsätzlich außen vor.
  • Deckelung für große Websites: Die Volltext-Ausgabe ist begrenzt — standardmäßig 20.000 Zeichen pro Beitrag und 500.000 insgesamt, beides einstellbar. Wird ein Limit erreicht, kürzt das Plugin sichtbar statt still.
  • Intelligenter Sitemap-Verweis: Der Sitemap-Verweis in llms.txt übernimmt die Sitemap-Zeile direkt aus deiner tatsächlichen robots.txt — er stimmt also auch dann, wenn dein SEO-Plugin (Rank Math, Yoast, AIOSEO) einen eigenen Sitemap-Namen verwendet. Gibt es keine Sitemap, entfällt die Zeile: kein toter Link.
  • Kollisions-Wächter: Liegt eine physische robots.txt, llms.txt oder ai.txt im Web-Root oder hat ein anderes Plugin die Route übernommen, warnt das Plugin deutlich — samt vollständigem Dateipfad, damit sofort klar ist, was zu tun ist.

Wie bediene ich Svana AI-Files?

Das Plugin bringt zwei Bereichsseiten mit. Auf der Seite „Dateien“ schaltest du llms.txt, ai.txt und llm-full.txt einzeln aktiv, prüfst per Vorschau den ausgelieferten Inhalt (mit Kopier-Schaltfläche) und siehst in der Vorschau-Kachel exakt den Block, den das Plugin an deine robots.txt anhängt — mit direktem Link zur kompletten robots.txt. Wer volle Kontrolle will, aktiviert je Datei „manuell pflegen“: Der hinterlegte Text wird dann unverändert ausgeliefert, der Generator ist aus — die Aktualität liegt dann in deiner Verantwortung, und auch dabei wird keine physische Datei geschrieben.

Einstellungen, die du kennen solltest

  • KI-Crawler in robots.txt: Standardmäßig sind alle KI-Crawler erlaubt; Häkchen entfernen bedeutet Disallow für diesen Crawler. Zur Auswahl stehen unter anderem GPTBot, OpenAI Search, ChatGPT-User, Google-Extended (Gemini), ClaudeBot, Perplexity, Common Crawl, Bytespider, Amazonbot, Apple Extended und Meta.
  • Kommerzielle Crawler aussperren: zweistufige Opt-in-Blockliste — „Aggressive SEO-/Analyse-Crawler“ (empfohlen, z. B. Ahrefs und Semrush, sofern du die Dienste nicht selbst nutzt) und eine erweiterte Liste mit weiteren Daten- und Markenbeobachtungs-Crawlern. Einzeln oder gruppenweise blockierbar, standardmäßig alles offen.
  • Deckelung llm-full.txt: Zeichen-Limits pro Beitrag und gesamt, anpassbar an die Größe deiner Website.
  • Lizenz: Mit dem Svana Suite Hub ist hier nichts zu tun — der Schlüssel wird zentral übernommen; Verbindungstest und manuelle Prüfung stehen bereit.

Welche Einschränkungen gibt es?

Gerade bei einem Thema voller Hype gehört die ehrliche Einordnung doppelt dazu:

  • llms.txt ist eine junge Konvention. Ein belegter Sichtbarkeits-Effekt bei den großen Endkunden-KI-Suchen existiert heute nicht — wer dir das Gegenteil verspricht, verkauft Hoffnung. Konkret nützlich ist das Format vor allem dort, wo KI-Agenten und Entwickler-Werkzeuge Websites gezielt einlesen; darüber hinaus ist es risikofreie Zukunftsvorsorge mit Minuten-Aufwand.
  • Eine robots.txt ist eine höfliche Bitte, keine technische Sperre. Seriöse Crawler halten sich daran — bösartige Scraper ignorieren sie. Gegen die hilft nur eine Firewall oder WAF, nicht diese Einstellung. Genau das sagt dir das Plugin übrigens auch selbst, direkt in den Einstellungen.
  • Der echte KI-Sichtbarkeits-Hebel bleibt der Inhalt. Sauberes HTML, klare Struktur, strukturierte Daten — dafür stehen in der Suite der SEO/GEO/AIO Checker und GEO-Schema. AI-Files liefert die Infrastruktur drumherum, ersetzt aber keine Content-Arbeit.
  • Physische Dateien haben Vorrang. Liegt eine echte robots.txt oder llms.txt im Web-Root, liefert der Server diese aus und die virtuelle Ausgabe greift nicht — das Plugin warnt dann deutlich, entfernen musst du die Datei selbst.
  • „Pretty“-Permalinks vorausgesetzt. Mit der einfachen Permalink-Struktur greifen die virtuellen Datei-Routen nicht; auch hierauf weist das Plugin im Backend hin.

Wie steht es um den Datenschutz in Deutschland?

Svana AI-Files arbeitet vollständig auf deinem eigenen Server: Die Dateien werden lokal aus deinen ohnehin veröffentlichten Inhalten erzeugt und ausgeliefert — keine externen Dienste, keine KI-Schnittstellen, keine Datenweitergabe. Besucherdaten verarbeitet das Plugin nicht. Wichtig zu verstehen: llms.txt und llm-full.txt machen nichts zugänglich, was nicht schon öffentlich wäre — sie bereiten veröffentlichte Inhalte nur maschinenfreundlich auf. Passwortgeschützte Beiträge bleiben konsequent draußen. Eher ist das Gegenteil der Fall: Über die Crawler-Steuerung gewinnst du Kontrolle darüber, wer deine Inhalte maschinell einsammeln darf — auch das ist Datensouveränität.

Die Lizenz- und Update-Kommunikation folgt dem Suite-Standard: ausschließlich Lizenzschlüssel, Domain, Produktkennung und Plugin-Version an unseren eigenen Server auf blaueblume.net — keine Inhalte, keine personenbezogenen Daten. Bei der Deinstallation räumt das Plugin seine eigenen Daten vollständig auf; der zentrale Suite-Schlüssel bleibt für die übrigen Suite-Plugins erhalten. Eine Rechtsberatung ersetzt das nicht — aber ein Plugin, das nur Öffentliches neu anordnet und nichts nach außen sendet, ist datenschutzrechtlich denkbar unkompliziert.

Wie aktualisiere ich Svana AI-Files?

Wie bei allen Svana-Suite-Plugins: Updates laufen über den nativen WordPress-Update-Mechanismus — Versions-Hinweis auf der Plugin-Seite, Änderungsübersicht, ein Klick. Den Lizenzschlüssel verwaltet der Svana Suite Hub zentral. Und auch hier: Ohne gültige Lizenz funktioniert das Plugin uneingeschränkt weiter — deine virtuellen Dateien und Crawler-Regeln bleiben aktiv, es werden lediglich keine Updates mehr ausgeliefert.

Wie sicher ist Svana AI-Files?

  • Nichts wird ins Dateisystem geschrieben: Alle Dateien sind virtuell — es gibt keine Schreibzugriffe auf den Web-Root und damit eine ganze Klasse von Risiken schlicht nicht.
  • Nur Veröffentlichtes: Die Generatoren arbeiten ausschließlich mit öffentlichen Inhalten; passwortgeschützte Beiträge sind ausgeschlossen, alle Ausgaben werden sauber aufbereitet.
  • Deckelung als Überlast-Schutz: Die Volltext-Limits verhindern, dass sehr große Websites unkontrolliert riesige Antworten ausliefern.
  • Berechtigungs- und Nonce-Prüfung: Alle Admin-Aktionen verlangen gültige Sicherheits-Token und ausreichende Nutzerrechte.
  • Transparenz statt Blindflug: Vorschau je Datei, Vorschau-Kachel für den robots.txt-Block, deutliche Kollisions- und Permalink-Hinweise — du siehst jederzeit, was das Plugin tut.
  • Verschlüsselte Update-Auslieferung: Lizenz- und Update-Kommunikation läuft TLS-gesichert gegen unseren eigenen Server; die Auslieferung ist an Produkt und Domain gebunden.

Systemvoraussetzungen

Aktuelle Version1.4.0
WordPressab 6.9, getestet bis 7.0
PHPab 7.4
Permalinks„Pretty“-Permalinks erforderlich (Standard bei fast allen Installationen)
BezugAusschließlich als Teil der Svana Suite, nicht im wp.org-Verzeichnis

Häufige Fragen zu Svana AI-Files

Verbessert llms.txt meine Sichtbarkeit in ChatGPT und Co.?

Ehrliche Antwort: Ein belegter Effekt bei den großen Endkunden-KI-Suchen existiert heute nicht. llms.txt ist eine junge Konvention mit konkretem Nutzen in Entwickler- und Agenten-Kontexten — und eine risikofreie Zukunftsvorsorge. Der wirksame Hebel für KI-Sichtbarkeit bleibt der Inhalt selbst: Struktur, Klarheit, strukturierte Daten.

Halten sich KI-Crawler wirklich an die robots.txt-Regeln?

Die seriösen ja: GPTBot, ClaudeBot, Google-Extended und vergleichbare Crawler respektieren robots.txt-Anweisungen. Eine robots.txt bleibt aber eine höfliche Bitte, keine technische Sperre — gegen Scraper, die sie ignorieren, hilft nur eine Firewall oder WAF.

Macht llm-full.txt Inhalte öffentlich, die es nicht sein sollten?

Nein. Ausgeliefert wird nur, was ohnehin veröffentlicht ist — passwortgeschützte Beiträge und Seiten sind konsequent ausgeschlossen. Die Datei bereitet öffentliche Inhalte lediglich maschinenfreundlich auf, gedeckelt und mit sichtbarer Kürzung bei Erreichen der Limits.

Warum sollte ich Ahrefs oder Semrush aussperren?

Diese Crawler sammeln SEO- und Backlink-Daten deiner Website und verkaufen sie weiter — oft an deine Wettbewerber, während sie deine Serverleistung kosten. Nutzt du die Dienste nicht selbst, kannst du sie bedenkenlos blockieren. Nutzt du sie, lässt du die entsprechenden Crawler einfach zu — die Blockliste ist komplett opt-in.

Was passiert, wenn meine Lizenz abläuft?

Das Plugin arbeitet uneingeschränkt weiter — virtuelle Dateien und Crawler-Regeln bleiben aktiv. Es werden lediglich keine neuen Updates mehr ausgeliefert.

Kann ich Svana AI-Files einzeln kaufen?

Nein, Svana AI-Files ist Bestandteil der Svana Suite. Jeder Suite-Schlüssel schaltet alle Suite-Plugins frei — du entscheidest selbst, welche du auf welcher Website einsetzt.

Wie KI-bereit ist deine Website?

Im kostenlosen Profi-Check analysieren wir eine deiner Websites persönlich — von der Crawler-Steuerung bis zur inhaltlichen Struktur. Unverbindlich und ohne Software-Installation.

Zur Svana Suite & Profi-Check