Svana AI-Files: robots.txt & llms.txt für die KI-Suche

svana-ai-files

Verfasst von

in

8 Min. Lesezeit

Die Art, wie Menschen Informationen finden, verschiebt sich. Neben der klassischen Google-Suche beantworten heute ChatGPT, Perplexity, Google AI Overviews und Claude Fragen direkt — und sie lesen Websites teils anders als ein klassischer Suchmaschinen-Crawler. Für Agenturen entsteht damit eine neue Aufgabe: die eigenen Kundenseiten so bereitzustellen, dass KI-Systeme sie sauber verarbeiten können, ohne dabei falsche Versprechen zu machen.

Svana AI-Files: Deine Website für KI-Crawler lesbar machen — ehrlich eingeordnet

Genau dafür haben wir die Svana Suite um ein sechstes Plugin erweitert: Svana AI-Files. Es liefert die maschinenlesbare Repräsentation deiner Website für KI-Crawler und generative Suche. In diesem Artikel gehen wir ins Detail — was das Plugin tut, warum die technischen Entscheidungen dahinter sinnvoll sind, und ganz bewusst auch: was diese Dateien nicht leisten. Denn genau diese Ehrlichkeit unterscheidet ein Werkzeug für Profis von den Wunderversprechen, die dir gerade an jeder Ecke verkauft werden.

Was sich in der Suite getan hat

Die Svana Suite ist das Werkzeug-Dach für WordPress-Agenturen: sechs Plugins für klassisches SEO, generative Suche (GEO/AIO), strukturierte Daten, KI-Crawler-Dateien und technische Sauberkeit — eine Lizenz, alle Werkzeuge enthalten. Der jüngste Zuwachs ist Svana AI-Files in Version 1.4.0, das seit dem 2. Juli 2026 ausgeliefert wird. Es reiht sich sauber neben die bestehenden Werkzeuge ein und übernimmt genau eine Aufgabe: die schreibende Ausgabeschicht für KI und Agenten.

Was Svana AI-Files ausliefert

Das Plugin erzeugt vier Dateien, die KI-Crawler und generative Systeme an bekannten Stellen erwarten. Jede lässt sich einzeln an- und abschalten, und jede läuft ohne Konfiguration sinnvoll.

robots.txt-Regeln pro KI-Bot

Kuratierte, einzeln schaltbare Regeln für GPTBot, ClaudeBot, Google-Extended, PerplexityBot, Amazonbot und weitere. Du entscheidest je Crawler, ob er deine Inhalte nutzen darf.

llms.txt

Eine strukturierte Übersicht deiner Website nach der llms.txt-Konvention: Titel, Beschreibung, wichtige Seiten, Beiträge und Ressourcen — in schlankem Markdown.

ai.txt

Eine kompakte Info- und Verweisdatei, die KI-Modellen den Einstieg erleichtert und auf die anderen Dateien verweist. Datenschutzbewusst: der Kontakt zeigt auf die Startseite, nicht auf eine Mailadresse.

llm-full.txt

Ein echter, sauber gedeckelter Volltext-Export ausgewählter Inhaltstypen — mit Obergrenze pro Beitrag und insgesamt, für Kontexte, die den kompletten Text brauchen (etwa Dokumentations-Agenten).

Die eine Architekturentscheidung: rein virtuell, keine Dateien im Web-Root

Übliche Lösungen schreiben diese Dateien physisch ins Wurzelverzeichnis deiner Website. Das klingt harmlos, bringt aber vier Probleme mit: Der Server braucht Schreibrechte aufs Root, der Inhalt veraltet, sobald sich deine Seiten ändern, bei Multisite kollidieren die Dateien, und nach der Deinstallation bleiben Reste liegen.

Svana AI-Files schreibt keine physische Datei. Alle Ausgaben werden virtuell über WordPress erzeugt und live gehalten — mit einem Cache, der bei Änderungen an deinen Inhalten automatisch neu aufbaut. Das bedeutet konkret: kein Schreibzugriff aufs Root nötig (angenehm auf Hostern mit strenger Rechtevergabe), keine veralteten Artefakte, ein sauberer Uninstall und volle Multisite-Verträglichkeit. Änderst du deine Inhalte, ist die Ausgabe sofort aktuell.

Liegt bereits eine physische robots.txt oder llms.txt im Root, serviert WordPress diese und die virtuelle Ausgabe greift nicht. Das Plugin überschreibt oder löscht dann nichts eigenmächtig, sondern erkennt die Situation und zeigt dir einen klaren Hinweis im Backend. Erkennen, informieren, dich entscheiden lassen — statt still im Hintergrund an deiner Konfiguration zu drehen.

Das robots.txt-Cockpit

Mit Version 1.4.0 bekommst du zwei praktische Werkzeuge dazu. Erstens eine Vorschau, die dir jederzeit exakt den Block zeigt, den Svana AI-Files an deine robots.txt anhängt — die allgemeinen Regeln und den Sitemap-Verweis von WordPress oder deinem SEO-Plugin lassen wir dabei bewusst außen vor, damit du siehst, was von uns kommt.

Zweitens eine Blockliste für kommerzielle Crawler. Das sind Bots, die deine Website durchsuchen, um SEO- und Backlink-Daten zu sammeln und weiterzuverkaufen — oft an deine Wettbewerber, ohne Gegenwert für dich, aber auf Kosten deiner Serverleistung. Die Liste ist zweistufig aufgebaut: 12 aggressive Datensammler als empfohlene Auswahl, dazu 13 weitere in einer optionalen erweiterten Liste. Standardmäßig ist nichts blockiert — du entscheidest bewusst per Schalter, wer draußen bleibt, einzeln oder gruppenweise.

Ein ehrlicher Hinweis dazu, der auch direkt im Plugin steht: Eine robots.txt ist eine höfliche Bitte, keine technische Sperre. Die seriösen Crawler halten sich daran — gegen bösartige Scraper, die die Datei ignorieren, hilft nur eine Firewall bzw. eine Web Application Firewall, nicht diese Einstellung. Und wenn du selbst ein Tool wie Ahrefs oder Semrush für die Kundenseite nutzt, sperr dessen Bot natürlich nicht aus.

Ehrlich eingeordnet: Was diese Dateien leisten — und was nicht

Hier trennen sich seriöse Werkzeuge von Wunderversprechen. Die vier Dateien liegen auf unterschiedlichen Wirkungsstufen, und das solltest du wissen, bevor du deinen Kunden etwas verkaufst.

Die robots.txt-Regeln wirken sofort und real. GPTBot, OAI-SearchBot, ClaudeBot und Google-Extended werten robots.txt aus und respektieren sie. Sperrst du GPTBot, signalisiert OpenAI, dass deine Inhalte nicht ins Training gehen sollen; sperrst du OAI-SearchBot, taucht die Seite nicht mehr in den ChatGPT-Suchantworten auf. Das ist keine Theorie, sondern dokumentiertes Verhalten der Anbieter. Die Steuerung, welche KI deine Inhalte nutzen darf, funktioniert also.

Bei llms.txt und llm-full.txt musst du ehrlich bleiben. Das ist ein 2024 vorgeschlagener Entwurf von Jeremy Howard (llmstxt.org), kein verabschiedeter Standard. Kein großer Anbieter — weder OpenAI noch Google, Anthropic, Meta oder Mistral — nutzt die Datei in seiner Produktions-Suche als Ranking- oder Zitiersignal. Google hat in seinem Leitfaden zur generativen Suche vom 15. Mai 2026 in einem Abschnitt mit dem Titel „Mythbusting“ ausdrücklich festgehalten, dass llms.txt für AI Overviews und den AI Mode nicht nötig ist; die KI-Funktionen laufen über dieselben Ranking-Systeme wie die klassische Suche. Auch die Praxis bestätigt das: Eine Ahrefs-Auswertung fand, dass rund 97 % der untersuchten Domains mit einer llms.txt im Messzeitraum null Abrufe dieser Datei durch die Antwort-Bots erhielten (Ahrefs).

Wer dir also erzählt, eine llms.txt hebe morgen deine Sichtbarkeit bei ChatGPT oder in den Google-Antworten — der verkauft Hoffnung, keine Fakten. Der echte Hebel für KI-Sichtbarkeit bleibt guter, klar strukturierter Inhalt, sauberes semantisches HTML und strukturierte Daten. Content first, KI-Dateien second.

Warum die Dateien trotzdem sinnvoll sind. Ihr belegter Nutzen liegt woanders: im Agenten- und Entwicklerkontext. KI-Coding-Werkzeuge wie Cursor, Claude Code und GitHub Copilot rufen llms.txt und llm-full.txt routinemäßig ab, um sich gezielt Inhalte zu holen, statt eine ganze Seite zu crawlen. Anthropic empfiehlt die Datei in seiner Agenten-Dokumentation, OpenAI und andere Plattformen pflegen sie für ihre Docs, und Chrome Lighthouse prüft seit Mai 2026 in einer eigenen Kategorie, ob eine Seite die Datei bereitstellt. Das ist die aufkommende Schicht des „agentic web“: Websites, auf denen KI-Agenten navigieren und Aufgaben erledigen. Svana AI-Files gibt dir diese Infrastruktur an die Hand — als günstige Zukunftsabsicherung und Agenten-Freundlichkeit, nicht als Sichtbarkeits-Booster für heute.

Wie AI-Files in die Suite passt

Svana AI-Files bleibt bewusst in seiner Spur und überschneidet sich nicht mit den anderen Werkzeugen. Genau diese Trennung hält die Suite sauber:

Strukturierte Daten macht GEO-Schema

JSON-LD und schema.org-Auszeichnung gehören ins GEO-Schema-Plugin. AI-Files schreibt reinen Text, kein Schema.

Messen macht der Checker

Analysieren und Bewerten der SEO-, GEO- und AIO-Signale ist Sache des SEO/GEO/AIO-Checkers. AI-Files bewertet nicht, es liefert aus.

Inhalts-Anzeige macht die Toolbox

Lesezeit, Fortschrittsbalken und Inhaltsverzeichnis liefert die Svana Toolbox. AI-Files kümmert sich nicht um die Darstellung im Frontend.

Datenschutz ist dabei durchgängig mitgedacht: An den Lizenzserver gehen ausschließlich Schlüssel, Domain, Produkt und Version — keine Telemetrie, kein Tracking. Den Lizenzschlüssel gibst du einmal zentral im Suite-Hub ein, alle Komponenten lesen ihn mit.

Für wen sich die Suite lohnt

Die Svana Suite richtet sich an Agenturen und Unternehmen, die WordPress-Seiten professionell betreuen und ihren Kunden mehr als klassisches SEO bieten wollen. Wenn du Kundenseiten für die KI-Suche vorbereiten, technische Sauberkeit (defekte Links, fehlende Alt-Texte) im Griff behalten und strukturierte Daten sauber ausspielen willst — alles zentral verwaltet statt als Schlüssel-Chaos pro Plugin und pro Kundenseite —, dann passt die Suite. Kein Freemium, keine Werbung im Backend deiner Kunden, keine Upsell-Hinweise.

Alle Tarife enthalten die komplette Suite mit allen sechs Plugins und allen Updates über das Lizenzjahr. Der einzige Unterschied ist die Zahl der Domains:

TarifDomainsPreis pro Jahr
Solo1 Domain349 €
Studiobis 10 Domains699 €
Agenturbis 50 Domains1.499 €
Enterpriseab 50 Domainsindividuell

Alle Preise verstehen sich zzgl. der gesetzlichen Umsatzsteuer und richten sich ausschließlich an Unternehmer (B2B). Wenn du wissen willst, wo deine Kundenseiten in Sachen KI-Sichtbarkeit gerade stehen, machen wir vorab einen kostenlosen Profi-Check — eine manuelle Experten-Durchsicht der Seite, damit du eine belastbare Grundlage hast statt eines Bauchgefühls.

Häufige Fragen zu Svana AI-Files

Steigert Svana AI-Files meine Sichtbarkeit bei ChatGPT oder in den Google-Antworten?

Die robots.txt-Regeln steuern real, welche KI-Crawler deine Inhalte nutzen dürfen — das funktioniert nachweislich. llms.txt und llm-full.txt sind dagegen eine junge Konvention ohne belegten Effekt auf die heutige Sichtbarkeit in großen KI-Suchmaschinen; Google selbst sagt, die Datei sei für AI Overviews nicht nötig. Ihr Nutzen liegt in Agenten- und Entwicklerkontexten und in der Zukunftsabsicherung. Der echte Hebel für KI-Sichtbarkeit bleibt guter, strukturierter Inhalt.

Schreibt das Plugin Dateien auf meinen Server?

Nein. Alle Ausgaben werden virtuell über WordPress erzeugt und live gehalten. Es liegt keine physische robots.txt, llms.txt, ai.txt oder llm-full.txt im Web-Root. Das bedeutet keine Schreibrechte aufs Wurzelverzeichnis, keine veralteten Dateien und einen sauberen Uninstall.

Was passiert, wenn schon eine physische robots.txt existiert?

Dann serviert WordPress die physische Datei und die virtuelle Ausgabe greift nicht. Svana AI-Files erkennt das, überschreibt aber nichts eigenmächtig, sondern zeigt dir einen klaren Hinweis im Backend. Du entscheidest, wie du vorgehst.

Hält die Blockliste kommerzielle Crawler wirklich fern?

Die gelisteten, seriösen Crawler wie AhrefsBot oder SemrushBot respektieren robots.txt und bleiben dann fern. Eine robots.txt ist aber eine Bitte, keine technische Sperre — gegen bösartige Scraper, die sie ignorieren, hilft nur eine Firewall bzw. WAF. Standardmäßig ist nichts blockiert; du wählst bewusst aus.

Brauche ich für AI-Files eine eigene Lizenz?

Nein. Svana AI-Files ist in jedem Tarif der Svana Suite enthalten — schon ab 349 € pro Jahr für eine Domain. Eine Lizenz deckt alle sechs Plugins ab, den Schlüssel gibst du einmal zentral im Hub ein.

Welche Daten sendet das Plugin nach außen?

Nur die für Lizenz und Update nötigen: Schlüssel, Domain, Produkt und Version — an den eigenen Lizenzserver. Keine Telemetrie, kein Tracking, keine Nutzerdaten. Die KI-Dateien werden lokal aus deinen Inhalten erzeugt.

Waren diese Informationen hilfreich?