Dokumentation

Methodik des AI Search Citation Optimizer

Was bewertet wird

Der Citation Optimizer bewertet eine Seite gegen ein Set von Suchanfragen auf bis zu vier KI-Assistenten: ChatGPT, Google AI Overviews, Google AI Mode und Claude. Die Seite kann eine Live-URL, ein eingefügter Entwurf oder eine Earned-Media-Platzierung sein.

Das Suchset besteht aus einer Hauptsuche und den verwandten Suchanfragen dazu. KI-Assistenten führen Ihren Prompt nicht wörtlich aus; sie schreiben sich eigene Suchanfragen und führen die Ergebnisse zusammen. Die Seite wird deshalb über das ganze Set bewertet und nicht gegen ein einzelnes Keyword. Jede Suchanfrage trägt ein Label, woher sie stammt: in Ihren getrackten Daten beobachtet, von Ihnen eingegeben oder von uns vorgeschlagen. Eine Suchanfrage, die auf eine einzelne Domain zielt, bleibt als Beleg erhalten und fließt nicht in den Score ein, weil keine Seite dafür ranken kann.

Die vier Assistenten finden und lesen Seiten unterschiedlich, jeder führt deshalb seine eigenen Prüfungen aus. Eine Prüfung ist eine Entscheidung über bestanden, Warnung oder nicht bestanden, mit den Belegen dahinter und einer Empfehlung, wenn sie nicht besteht.

Die Prüfungen der einzelnen Assistenten

Jede Prüfung trägt ein Label dafür, was sie bewegen kann.

LabelBedeutet
ÜberarbeitungDie Worte auf der Seite können es ändern.
MetadatenTitel, Beschreibung, Datumsangaben oder Snippet-Direktiven.
TechnischWie die Seite ausgeliefert wird: Rendering, Robots-Regeln, Quellreihenfolge.
Off-PageNichts auf der Seite bewegt es.
Nicht bewertetZur Einordnung berichtet, bleibt aus der Zahl heraus.

Prüfungen mit Nicht bewertet bleiben bewusst außen vor: etwas zu bewerten, das die Autorin nicht ändern kann, würde eine unbehebbare Strafe in die Zahl einbauen.

ChatGPT

PrüfungWas sie betrachtetWas es bewegen kann
Löst eine Suche ausOb diese Suchanfrage ChatGPT überhaupt ins Web schickt.Nicht bewertet
Research-RouteOb sie in die zitierende Antwort-Pipeline führt statt zu Shopping oder News.Nicht bewertet
In Suchanfragen genanntWie oft ChatGPT Ihre Marke oder Domain in seine eigenen Suchanfragen schreibt.Nicht bewertet
ZugriffOb ChatGPT die Seite öffnen und ihren Text lesen kann. Es befolgt robots.txt, führt Ihr JavaScript nicht aus und respektiert die Bitte, nicht zu zitieren.Technisch
SuchabdeckungFür wie viele Suchanfragen aus dem Set die Seite rankt und wie hoch.Off-Page
SucheintragTitel und Beschreibung, die das Öffnen verdienen müssen.Metadaten
LesebudgetChatGPT liest einen begrenzten Abschnitt vom Seitenanfang, in der Reihenfolge, die Ihr Server sendet, und hört dann auf. Ob Ihre beste Antwort darin liegt.Überarbeitung
RelevanzIhre stärkste Passage gegen die stärkste Passage jeder rankenden Seite, nach exaktem Wortlaut, nach Bedeutung und über ein Relevanzmodell.Überarbeitung
AuswahlOb etwas dafür sorgt, dass die Seite nach dem Fund übergangen wird, etwa ein Datum, das veraltet wirkt.Überarbeitung
ZitierbarkeitOb die Passage so, wie sie dasteht, in eine Antwort gehoben werden könnte: eigenständig, Antwort zuerst, konkret.Überarbeitung

In Suchanfragen genannt ist das stärkste Signal, das wir sehen können, und keine Überarbeitung bewegt es. Es wird deshalb neben dem Score berichtet und bleibt aus ihm heraus. Zugriff ist eine harte Prüfung: Kann ChatGPT die Seite nicht lesen, endet der Lauf dort, und die späteren Prüfungen melden nicht bewertet statt nicht bestanden.

Google AI Overviews

Wird gegen die Hauptsuche bewertet, weil AI Overviews aus einem einzelnen Retrieval antwortet.

PrüfungWas sie betrachtetWas es bewegen kann
Kann Google sie verwendenOb die Seite indexiert und für Googlebot erreichbar ist und Text von sich zeigen darf. noindex, nosnippet, data-nosnippet und max-snippet steuern das.Technisch
In Google-Ergebnissen gefundenOb die Seite in den Ergebnissen auftaucht, aus denen das Overview gebaut wird.Off-Page
AI Overview heuteOb für diese Suchanfrage beim Nachsehen ein Overview erschien und welche Quellen es nutzte.Nicht bewertet
Was Google zitieren würdeGoogle hebt einzelne Sätze heraus und fügt sie zusammen. Dies bewertet Ihre Sätze und baut die Antwort, die Google bauen würde.Überarbeitung
Sätze stehen für sichOb ein herausgehobener Satz ohne die Seite ringsum noch Sinn ergibt.Überarbeitung
Bringt etwas NeuesOb die Passage ergänzt, was die anderen Quellen bereits sagen.Überarbeitung
Bereit zum ZitierenDie gemeinsame Schreibprüfung, angewandt auf die Passage, die Google zusammenstellen würde.Überarbeitung

Google AI Mode

Dieselben Prüfungen wie AI Overviews, mit zwei Unterschieden, denn es ist eine eigene Retrieval-Pipeline und nicht eine andere Ansicht derselben. Es wird gegen das gesamte Suchset bewertet, weil AI Mode sich selbst auffächert und über diese Teilsuchen antwortet. Und es hat keine AI-Overview-Prüfung, weil es serverseitig läuft und es auf einer Ergebnisseite nichts zu sehen gibt.

Die Seiten, die beide verwenden, überschneiden sich kaum, weshalb sie zwei Scores tragen statt einen.

Claude

Claude geht seinen eigenen Weg. Es sucht bei Brave statt bei Google, erhält einen kurzen Auszug jeder Seite statt der Seite, filtert die Ergebnisse mit Code, den es selbst schreibt, und zitiert in sehr kurzen Spannen.

PrüfungWas sie betrachtetWas es bewegen kann
Würde Claude suchenOb Claude für diese Frage überhaupt ins Web geht.Nicht bewertet
Von Claudes Suchen gefundenWie viele Suchanfragen aus Ihrem Set die Seite in Braves Ergebnissen zurückgeben.Off-Page
Innerhalb dessen, was Claude liestOb Ihre stärkste Passage in den kurzen Auszug fällt, den Claude erhält.Überarbeitung
Exakte Worte vorhandenClaudes Filter ist Code, und Code gleicht Zeichenketten ab, keine Bedeutungen. Ob die markanten Worte, Produktnamen und Zahlen aus Ihren Suchanfragen auf der Seite stehen.Überarbeitung
Kurz genug zum ZitierenOb Ihre Kernsätze in die kurze Spanne passen, die Claude zitiert, und ob sie ihr eigenes Subjekt benennen.Überarbeitung
Claudes Historie mit Ihrer SiteWie oft Claude Ihre Site in den Antworten, die wir tracken, als Quelle genutzt hat.Nicht bewertet
Bereit zum ZitierenDie gemeinsame Schreibprüfung, angewandt auf sehr kurze Spannen.Überarbeitung

Wie der kombinierte Score entsteht

Jeder Assistent bewertet sich zuerst selbst, als gewichteter Mittelwert über seine eigenen bewerteten Prüfungen: bestanden zählt 100, Warnung 50, nicht bestanden 0.

Der kombinierte Score ist ein gewichteter Mittelwert über die Assistenten. Die Gewichte sind standardmäßig gleich, und Sie können die Mischung im Ergebnisbildschirm ändern; Score, Spanne und Verdikt werden gemeinsam aus bereits erhobenen Ergebnissen neu berechnet.

Ein Assistent, der nicht fertig wurde, wird aus dem Mittelwert genommen, aus der Summe ebenso wie aus dem Zähler. Er zählt nie als Null, denn ein fehlgeschlagener Lauf sagt nichts über die Seite. Es gibt auch keine Untergrenze für den kombinierten Score: eine Seite, die bei drei Assistenten gut abschneidet und beim vierten klar durchfällt, wird als guter Score mit einer Warnung daneben berichtet.

Vorher-Nachher-Vergleiche nutzen einen reinen Inhalts-Score, gebildet auf dieselbe Weise allein über die Prüfungen mit dem Hebel Überarbeitung. Er ist die einzige Zahl, die zwischen einer veröffentlichten Seite, die ein Suchranking hat, und einem Entwurf, der keines hat, vergleichbar bleibt.

Die Spanne

Jeder Score wird als Spanne gezeigt statt als einzelne Zahl, weil diese Pipelines nicht jedes Mal dieselbe Entscheidung treffen, wenn sie dieselbe Seite sehen. Die Spanne wird nie schmaler als ein festes Minimum, und sie weitet sich, wenn die urteilsbasierten Prüfungen zwischen ihren zwei Durchgängen uneins sind.

Eine Bewegung innerhalb der Spanne wird neutral als keine belegbare Veränderung bezeichnet. Sie wird nicht als Verbesserung eingefärbt und kann kein Verdikt "bereit zur Veröffentlichung" auslösen. Hat eine Überarbeitung den Score um weniger als die Spanne bewegt, ist nichts belegt.

Wie Empfehlungen zusammengeführt werden

Vier Assistenten erzeugen vier Listen. Jeder Befund wird auf ein gemeinsames Signal abgebildet, und die Listen werden zu einer zusammengeführt, in drei Arten:

  • Einig. Zwei oder mehr Assistenten verlangen dasselbe. Diese stehen zuerst, weil sie sich überall auszahlen.
  • Ein Assistent. Nur einer hat danach gefragt. Lohnend, gewichtet danach, wie wichtig dieser Assistent für Ihr Publikum ist.
  • Zielkonflikt. Zwei Anforderungen, die sich nicht beide in derselben Textstelle erfüllen lassen.

Ein Zielkonflikt wird nicht durch Mitteln gelöst; zwei unvereinbare Anweisungen zu mitteln ergibt eine Überarbeitung, die keine von beiden erfüllt. Er wird gelöst, indem jede Anforderung einen anderen Teil der Seite bekommt. Wollen die exakte Frage und die längere, konkretere Formulierung denselben Platz, kommt die Frage in die Überschrift und die Spezifika in den Absatz darunter. Die Überarbeitung erhält diese Zuteilungen direkt, der Entwurf bedient also beide Seiten und nicht die zuletzt gelesene Anweisung.

Was eine Überarbeitung ändert

Sie wird die Antwort nach vorn ziehen, Passagen zu eigenständigen Einheiten straffen, die Spezifika und exakten Begriffe in den Teil tragen, den jeder Assistent liest, zu lange Sätze für das Zitieren teilen, die Antwort in das Lesebudget schieben und einen überarbeiteten Titel, eine Meta-Beschreibung und strukturierte Daten liefern. Dazu kommt ein Änderungsprotokoll, das jede Bearbeitung auf den Befund dahinter zurückführt.

Sie wird nicht Fakten, Statistiken, Qualifikationen, Kundennamen oder Daten erfinden, und sie wird keine Behauptungen wie "beste", "führende" oder ähnliche ergänzen, die die Seite nicht belegen kann. Die Überarbeitung ist bedeutungserhaltend. Enthält die Seite die Zahl nicht, nach der eine Prüfung verlangt, sagt sie Ihnen, dass Sie sie ergänzen sollen, statt eine zu erfinden.

Off-Page-Befunde werden nie überarbeitet. Sie erscheinen klar markiert als Kontext in der Liste und liegen außerhalb des Ziels der Überarbeitung. Eine Überarbeitung kann nicht ändern, was Brave zurückgibt oder ob ChatGPT Ihre Marke nennt.

Verdikte zur Veröffentlichungsreife

Nach jedem Score sagt der Optimizer, was als Nächstes zu tun ist. Das Verdikt folgt den aktuellen Gewichten, eine geänderte Mischung berechnet es also gemeinsam mit dem Score neu.

VerdiktBedeutet
Nochmals überarbeitenEs ist Luft nach oben. Mindestens ein Assistent hat eine Auswahlprüfung, die nicht besteht.
Bereit zur VeröffentlichungJeder Assistent, der fertig wurde, besteht seine Auswahlprüfungen, und der kombinierte Score liegt über der Veröffentlichungsschwelle.
Plateau erreichtDer letzte Durchgang hat den Score nicht über seine Spanne hinaus bewegt. Nehmen Sie die bisher beste Fassung.
ZurückgehaltenDie Überarbeitung hat mindestens einen Assistenten belegbar verschlechtert, obwohl der kombinierte Score hielt.
AusstehendEs ist noch keine Bewertung fertig.

Eine Überarbeitung soll den kombinierten Score heben, ohne einen Assistenten zu verschlechtern. Eine Fassung, bei der Claude fällt, während der Mittelwert steigt, wird deshalb zurückgehalten und die vorherige Fassung angeboten. Nichts geht verloren: die Live-Seite bleibt unberührt, und der Entwurf ist weiter da, falls Sie anderer Meinung sind.

Woraus die Outline gebaut wird

Bewerten beantwortet, warum eine Seite nicht zitiert wurde. Die Outline beantwortet, was eine Seite sagen sollte, bevor es sie gibt.

Aus einem Keyword und einem Seitentyp löst die Outline auf, für welche Suchanfragen geschrieben wird, liest, was die rankenden Seiten abdecken und was keine von ihnen beantwortet, und füllt eine Seitentyp-Vorlage zu einem Briefing Abschnitt für Abschnitt. Jeder Abschnitt trägt seine Zielsuchanfragen, ein Wortbudget, die Begriffe, die vorkommen müssen, und die Regeln, die entscheiden, ob eine Passage zitierbar ist. Bewerten Sie den Entwurf, sobald er geschrieben ist; er läuft gegen dieselben Suchanfragen, aus denen die Outline gebaut wurde.

Scoring-Versionen

Jeder Lauf hält die Scoring-Version fest, die ihn erzeugt hat, und zeigt sie neben dem Score. Scores aus verschiedenen Versionen sind nicht vergleichbar, und nichts im Produkt vergleicht sie. Ein Lauf wird weiterhin mit den Prüfungen dargestellt, die ihn erzeugt haben, und wenn sich eine Prüfung oder ein Schwellenwert wesentlich ändert, steigt die Version, statt alte Läufe neu zu etikettieren.

Grenzen

All das nähert Systeme an, deren Quellcode wir nicht haben. Die echten Reranker sind proprietär; wir nutzen ein Open-Source-Modell, das sich vergleichbar verhält, die von ihm erzeugte Reihenfolge ist also der nützliche Teil und nicht die absolute Zahl. Suchergebnisse bewegen sich täglich, und Google entscheidet pro Suchanfrage, ob überhaupt ein AI Overview erscheint; ein fehlendes Overview heißt also, die Prüfung wurde übersprungen, nicht dass sie nicht bestanden wurde. Wir rufen Seiten selbst als SpyglassesBot ab und nicht als ChatGPT, Googlebot oder Claude; wir prüfen Robots-Regeln für die echten Crawler-Namen, aber eine Site, die diese Crawler anders behandelt, sieht für uns anders aus als für sie. Auszugsgrößen und Snippet-Längen messen Systeme, die sich ohne Ankündigung ändern, und Schwellenwerte und Gewichte sind Startwerte, die mit wachsender Zahl echter Läufe neu kalibriert werden.

Alle Prüfungen zu bestehen garantiert keine Zitierung. Es heißt, dass die Faktoren, die wir sehen und messen können, stimmen. Die Antworten selbst bleiben nicht deterministisch.

Dokumentation für Spyglasses KI-Traffic-Tracking