惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
WordPress大学
WordPress大学
人人都是产品经理
人人都是产品经理
Engineering at Meta
Engineering at Meta
小众软件
小众软件
I
InfoQ
有赞技术团队
有赞技术团队
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Martin Fowler
Martin Fowler
月光博客
月光博客
雷峰网
雷峰网
aimingoo的专栏
aimingoo的专栏
云风的 BLOG
云风的 BLOG
Last Week in AI
Last Week in AI
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
S
SegmentFault 最新的问题
The GitHub Blog
The GitHub Blog
Y
Y Combinator Blog
V
Visual Studio Blog
博客园 - 叶小钗
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
GbyAI
GbyAI
P
Proofpoint News Feed
Apple Machine Learning Research
Apple Machine Learning Research

DEV Community

Authentication Security Deep Dive: From Brute Force to Salted Hashing (With Java Examples) Why AI Systems Don’t Fail — They Drift Spilling beans for how i learn for exam😁"Reinforcement Learning Cheat Sheet" I Replaced Chrome with Safari for AI Browser Automation. Here's What Broke (and What Finally Worked) How Python Borrows Other People's Work The $40 Architecture: Processing 1 Billion API Requests with 99.99% Uptime Vibe Coding: A Workflow Guide (From Zero to SaaS) Most webhook security guides protect the wrong side. The scary part is delivery. Headless CMS for TanStack Start: Build a Blog with Cosmic EU Age Verification App "Hacked in 2 Minutes" — What Actually Happened Comfy Cloud’s delete function does not actually remove files Running AI Models on GPU Cloud Servers: A Beginner Guide Event-driven media intelligence with AWS Step Functions and Bedrock I scored 500 AI prompts across 8 quality dimensions — here's what broke How to Call Google Gemini API from Next.js (Free Tier, No Backend Needed) The Portal Protocol: Reclaiming Human Connection in the Age of AI How to Fix Your Team's Scattered Knowledge Problem With a Self-Hosted Forum Intro to tc Cloud Functors: A Graph-First Mental Model for the Modern Cloud Designing Multi-Tenant Backends With Both Ownership and Team Access I Built a Neumorphic CSS Library with 77+ Components — Here's What I Learned PostgreSQL Performance Optimization: Why Connection Pooling Is Critical at Scale Cómo construí un SaaS multi-rubro para gestionar expensas en Argentina con FastAPI + Vue 3 🚀 I Built an Ethical Hacking Scanner Tool – Open Source Project I Replaced /usage and /context in Claude Code With a Single Statusline A Pythonic Way to Handle Emails (IMAP/SMTP) with Auto-Discovery and AI-Ready Design I Collected 8.9 Million Polymarket Price Points — Here's What I Found About How Markets Really Move EcoTrack AI — Carbon Footprint Tracker & Dashboard Everyone's Using AI. No One Agrees How. 5 self-hosted ebook managers worth trying in 2026 Building Your First AI Agent with LangChain: From Chatbot to Autonomous Assistant
GEO: Wie du dafür sorgst, dass ChatGPT & Co. deine Seite ...
Slawa · 2026-06-24 · via DEV Community

Dein bestes Google-Ranking ist wertlos, wenn die Antwort schon vor dem Klick gegeben wurde. Genau das passiert gerade: Nutzer fragen ChatGPT, Claude oder Perplexity – und bekommen eine fertige Antwort mit drei, vier zitierten Quellen. Bist du nicht darunter, existierst du in diesem Moment nicht. Kein Ranking, kein Klick, keine zweite Chance.

Die Disziplin, die das adressiert, heißt Generative Engine Optimization (GEO). Und sie ist – anders als der Marketing-Lärm vermuten lässt – zu großen Teilen ein Engineering-Problem. Crawler-Zugang, Rendering, strukturierte Daten. Lauter Dinge, über die ein Entwickler entscheidet, nicht das Content-Team.

SEO optimiert auf den Klick. GEO optimiert auf das Zitat.

Der Unterschied ist nicht kosmetisch. Klassisches SEO will, dass du auf Platz eins rankst, damit jemand klickt. GEO will, dass ein Sprachmodell deinen Absatz wörtlich in seine Antwort übernimmt – inklusive Quellenangabe. Der Klick ist nur noch Bonus.

Daraus folgt ein anderer Tech-Stack an Signalen:

Aspekt Klassisches SEO GEO / KI-Sichtbarkeit
Ziel Top-10 in Google Zitat in ChatGPT, Claude, Perplexity
Relevante Bots Googlebot, Bingbot GPTBot, ClaudeBot, PerplexityBot
Index-Hinweis sitemap.xml llms.txt + sitemap.xml
Strukturierte Daten Rich Snippets Entity-Linking (Organization, sameAs, @graph)
Rendering Google rendert JS (verzögert) viele KI-Bots rendern kein JS → SSR Pflicht
Erfolgskontrolle Search Console, Rank-Tracker Citation- & Mention-Tracking in LLMs

Die Hebel überschneiden sich – sauberes HTML, schnelle Antwortzeiten, valides Markup helfen beidem. Aber die Bots, die Index-Signale und die Erfolgskontrolle sind eigenständig. Wer GEO als „SEO mit neuem Namen" abtut, übersieht genau die Stellen, an denen es klemmt.

Schritt 1: Lass die Bots überhaupt rein

Bevor du über Content-Qualität nachdenkst, klär die banale Frage: Kommt der Crawler durch? Erstaunlich oft lautet die Antwort nein – und niemand merkt es, weil ein Browser die Seite ja problemlos lädt.

Die drei User-Agents, die zählen, sind GPTBot, ClaudeBot und PerplexityBot. Eine robots.txt, die sie durchlässt, sieht so aus:

User-agent: GPTBot
Allow: /

User-agent: OAI-SearchBot
Allow: /

User-agent: ClaudeBot
Allow: /

User-agent: PerplexityBot
Allow: /

Ein Detail, das viele falsch machen: GPTBot und OAI-SearchBot sind nicht dasselbe. GPTBot füttert die Trainingsdaten, OAI-SearchBot ist für Citations in der ChatGPT-Suche zuständig. Wer aus Datenschutzgründen das Training ausschließen will, sollte nicht pauschal alles von OpenAI sperren – sonst kappt er sich versehentlich die Sichtbarkeit. Training raus, Suche rein:

User-agent: GPTBot
Disallow: /

User-agent: OAI-SearchBot
Allow: /

Der gemeinste Fall ist aber nicht die robots.txt, sondern die Schicht davor. Cloudflare Bot Fight Mode, eine ModSecurity-Regel, ein nginx-User-Agent-Filter oder ein überambitioniertes Shopware-Plugin weisen unbekannte User-Agents pauschal als Scraper ab. Der Browser sieht davon nie etwas, der KI-Bot bekommt ein 403 oder eine Captcha-Seite. Prüf das im Zweifel direkt:

curl -A "GPTBot" -I https://deine-domain.de

Kommt da kein sauberes 200 zurück, hast du dein erstes Problem gefunden, bevor du eine Zeile Content angefasst hast. Und Achtung: Cloudflare-Defaults setzen sich bei Updates gern zurück – also nach jedem größeren Release erneut testen.

Schritt 2: Liefere Text, kein JavaScript-Versprechen

Hier wird es für moderne Frontends unbequem. Viele KI-Crawler rendern kein JavaScript. Was bei einer reinen Client-Side-React-App im initialen HTML steht, ist oft ein leeres <div id="root"> – und genau das liest der Bot. Dein schöner Content existiert für ihn nicht.

Die Lösung ist kein Geheimnis, sie kostet nur Disziplin: Server-Side Rendering oder Static Generation, damit die Hauptinhalte schon im ausgelieferten HTML stehen. In Next.js heißt das, die Finger von reinem Client-Fetching für indexierbaren Content zu lassen:

// Server Component – Inhalt steht im initialen HTML, lesbar ohne JS
export default async function ProductPage({ params }) {
  const product = await getProduct(params.id);

  return (
    <article>
      <h1>{product.name}</h1>
      <p>{product.description}</p>
    </article>
  );
}

Kurz gesagt: Wenn der Inhalt erst nach dem Hydration-Schritt im DOM auftaucht, ist er für einen erheblichen Teil der KI-Crawler unsichtbar. SSR ist bei GEO keine Performance-Kür mehr, sondern Voraussetzung.

Schritt 3: Mach deine Entität eindeutig

Ein Sprachmodell zitiert lieber, was es eindeutig zuordnen kann. Strukturierte Daten sind dafür das stärkste Signal – nicht als SEO-Deko, sondern als maschinenlesbare Aussage darüber, wer du bist. Das Minimum ist ein Organization-Schema mit sameAs-Verknüpfungen, die deine Marke mit ihren bekannten Profilen verbinden:

<script type="application/ld+json">
{
  "@context": "https://schema.org",
  "@type": "Organization",
  "name": "Beispiel GmbH",
  "url": "https://beispiel.de",
  "sameAs": [
    "https://www.linkedin.com/company/beispiel",
    "https://de.wikipedia.org/wiki/Beispiel_GmbH",
    "https://www.crunchbase.com/organization/beispiel"
  ]
}
</script>

Die sameAs-Links sind der eigentliche Trick: Sie verankern deine Entität in Quellen, denen das Modell ohnehin vertraut. Darüber hinaus lohnen sich je nach Seitentyp FAQPage (gut für Frage-Antwort-Formate), Product + Offer (Shops) sowie Article + Author (Blogs) – am besten gebündelt in einem gemeinsamen @graph.

Schritt 4: llms.txt – kleiner Aufwand, klare Aufwärtschance

llms.txt ist eine vorgeschlagene Konvention (llmstxt.org), kein offizieller Standard. Die Idee: eine Markdown-Datei unter /llms.txt, die KI-Systemen eine kuratierte Liste deiner wichtigsten Inhalte nennt – konzeptionell wie eine sitemap.xml, nur für LLMs.

# Beispiel GmbH

> Digitalagentur für E-Commerce, Software und KI-Beratung.

## Wichtige Seiten
- [Leistungen](https://beispiel.de/leistungen): Überblick über alle Services
- [Blog](https://beispiel.de/blog): Fachartikel zu E-Commerce und KI
- [Kontakt](https://beispiel.de/kontakt): Ansprechpartner und Standorte

Ehrlich bleiben: Noch lesen längst nicht alle Crawler die Datei aus, einige Recherche-Agents tun es bereits. Der Aufwand ist minimal, das Risiko null – das ist eine der wenigen GEO-Maßnahmen, bei denen sich die Kosten-Nutzen-Rechnung nicht lange diskutieren lässt.

Und der Content? Schreib so, dass man dich zitieren kann

Die Technik schafft den Zugang, aber zitiert wird am Ende eine Textpassage. Und Modelle haben eine klare Präferenz: kurze, eigenständige Absätze, klare Definitionen, Zahlen, Listen, saubere Überschriften-Hierarchie. Die Princeton-Forschung hinter dem Begriff GEO (KDD 2024) zeigt, dass Zitate, Statistiken und konkrete Quellenangaben die Wahrscheinlichkeit, in einer KI-Antwort aufzutauchen, um bis zu 30–40 % erhöhen.

Werblicher Fließtext ohne Substanz ist das Gegenteil davon. Ein Absatz, der eine Frage in zwei klaren Sätzen beantwortet, wird zitiert. Ein Absatz voller „innovativer, ganzheitlicher Lösungen" wird übersprungen.

Wo stehst du gerade?

Das Unangenehme an GEO: Die meisten dieser Probleme sieht man der Seite im Browser nicht an. Die robots.txt blockt lautlos, die WAF antwortet Bots anders als dir, das JSON-LD hat ein fehlendes Pflichtfeld. Bevor du anfängst zu optimieren, lohnt sich deshalb eine Bestandsaufnahme aus Bot-Perspektive.

Dafür haben wir bei nextlevels einen kostenlosen KI-Sichtbarkeits-Check gebaut: Er simuliert die wichtigsten KI-Crawler, liest robots.txt, llms.txt und Sitemap, prüft das ausgelieferte HTML auf SSR und strukturierte Daten und erkennt Bot-Blocker auf WAF-Ebene. Ergebnis in unter 30 Sekunden, ohne E-Mail, und jeder Einzelbefund kommt mit den Rohdaten, die du selbst per curl nachprüfen kannst. Genau das macht ihn für Entwickler brauchbar – es ist kein Score zum Glauben, sondern eine Checkliste zum Nachvollziehen.

Fazit

GEO ist kein neues Marketing-Buzzword, das man dem Content-Team überlassen kann. Die Stellen, an denen Sichtbarkeit in KI-Antworten entsteht oder stirbt, liegen im Code: in der robots.txt, in der Render-Strategie, im Schema-Markup, in der WAF-Konfiguration. Die gute Nachricht für uns Entwickler ist, dass das alles überprüfbar und fixbar ist – kein Raten, kein Black-Box-Algorithmus. Fang bei der banalsten Frage an: Kommt der Bot überhaupt durch? Den Rest baust du darauf auf.