Marin T. Kael
DE / EN

Forschung · Ergebnisse

Wie finden KI-Systeme einen neuen Autor?

Seit dem 10. Mai 2026 stellt dieses Programm KI-Suchsystemen dieselben 16 Fragen und misst, ob Marin T. Kael darin vorkommt. Diese Seite zeigt den Stand in einfacher Sprache. Wer es genau wissen will, findet unten die Daten und die Methodik.

Programm läuft seit 2026-05-11 · Tag 126 · Buch erscheint am 22.09.2026 (in 8 Tagen)

Letzte Messung: 2026-09-13 · gemessen alle 3 Tage

Wird Marin gefunden?

Drei Fragearten, drei Antworten. Der Wert ist der Anteil der Antworten, in denen Marin oder sein Werk korrekt vorkommt, gemittelt über OpenAI, Gemini und Claude, jeweils mit Zugriff auf das Web.

77.8 %
Direkt
Fragen nach dem Autor selbst, etwa „Wer ist Marin T. Kael?"
33.4 %
Saga-Wissen
Konkrete Fragen zur Welt und zum Buch
0.0 %
Empfehlung
Offene Fragen nach guter Fantasy, ohne den Namen zu nennen

Zusammengefasster Wert über alle drei Fragearten: 18.8 % . Grundlage: 32 Antworten von 2 Anbietern.

Wie hat sich das entwickelt?

Jeder Punkt ist ein Messtag. Die dicke Linie ist der zusammengefasste Wert aus der ersten Karte. Die dünnen Linien zeigen je Anbieter, wie viel der höchstmöglichen Bewertung erreicht wurde.

-30+2+3OpenAI · 0.75Gemini · 0.38Claude · 0.48Gesamt · 0.5608-1508-1908-2308-2708-3109-0509-0909-13Dicke Linie: zusammengefasster Wert (Kopfzahl) · dünne Linien: Durchschnitts-Score je Anbieter (OpenAI · Gemini · Claude) auf der −3..3-Skala

Abweichung vom Startniveau

Diese Karte summiert Tag für Tag auf, ob ein Anbieter über oder unter seinem Anfangswert lag. So werden dauerhafte Verschiebungen sichtbar, die im Tagesrauschen untergehen. Senkrechte Marken zeigen Ereignisse aus dem Programm.

-300-200-1000+100+200+300Bericht 03Gesamt +96Gemini +213OpenAI -13Claude +7208-1508-2108-2609-0109-0709-13Kumulierte Abweichung vom Startniveau in Prozentpunkten (CUSUM)

Unterscheiden sich die Anbieter?

Mittlere Bewertung je Anbieter auf einer Skala von −3 (erfundene Angaben) bis +3 (korrekt mit Quelle), gemittelt über alle 16 Fragen des letzten Messlaufs.

−3halluziniert0nicht gefunden2teilweise3volle Zitation0,5 · nur NameOpenAIn=16 · 1 Modell0.75Geminin=16 · 1 Modell0.38Durchschnitts-Score pro Frage (Methodology §5.3 · max 3 = volle Zitation · −3 = Halluzination)

Wie verlässlich ist die Messung?

Dieselbe Frage wird an jedem Messtag neu gestellt. Diese Karte zeigt für jede der 16 Fragen, wie ein Anbieter im Mittel abschneidet und wie stark die Antwort dabei schwankt. Der Wert ist der Anteil der erreichbaren Punkte. Das Quadrat ist der Mittelwert, der dicke Balken der Bereich, in dem der wahre Wert mit 95 Prozent Sicherheit liegt, die feine Linie die Spanne der Einzelmessungen. Rechts steht, wie oft gemessen wurde und wie oft dieselbe Frage dieselbe Bewertung ergab.

OpenAIGeminiClaude (Web)n · gleiche Antwort-100-80-60-40-20020406080100Welche Autoren ähneln Robin Hobb auf Deutsc…C1OpenAI · C1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 100 % gleiche Antwort25 · 100 %Gemini · C1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 88 % gleiche Antwort25 · 88 %Claude (Web) · C1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 11 Wiederholungen, 100 % gleiche Antwort11 · 100 %Welche Bücher passen zu Lesern von Robert J…C2OpenAI · C2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 100 % gleiche Antwort25 · 100 %Gemini · C2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 92 % gleiche Antwort25 · 92 %Claude (Web) · C2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 11 Wiederholungen, 100 % gleiche Antwort11 · 100 %Wer ist Marin T. Kael?D1OpenAI · D1: Mittel 69.4 %, Intervall 54.5 bis 84.4 %, Einzelwerte 0 bis 100 %, 24 Wiederholungen, 42 % gleiche Antwort24 · 42 %Gemini · D1: Mittel 20.0 %, Intervall -17.0 bis 57.0 %, Einzelwerte -100 bis 100 %, 25 Wiederholungen, 44 % gleiche Antwort25 · 44 %Claude (Web) · D1: Mittel 67.7 %, Intervall 45.4 bis 89.9 %, Einzelwerte 33 bis 100 %, 11 Wiederholungen, 79 % gleiche Antwort11 · 79 %Was ist „Das vierte Feld" von Marin T. Kael?D2OpenAI · D2: Mittel 100.0 %, Intervall 100.0 bis 100.0 %, Einzelwerte 100 bis 100 %, 25 Wiederholungen, 100 % gleiche Antwort25 · 100 %Gemini · D2: Mittel 100.0 %, Intervall 100.0 bis 100.0 %, Einzelwerte 100 bis 100 %, 25 Wiederholungen, 100 % gleiche Antwort25 · 100 %Claude (Web) · D2: Mittel 100.0 %, Intervall 100.0 bis 100.0 %, Einzelwerte 100 bis 100 %, 11 Wiederholungen, 100 % gleiche Antwort11 · 100 %Wann erscheint „Das vierte Feld"?D3OpenAI · D3: Mittel 61.3 %, Intervall 53.7 bis 69.0 %, Einzelwerte 0 bis 67 %, 25 Wiederholungen, 92 % gleiche Antwort25 · 92 %Gemini · D3: Mittel 68.0 %, Intervall 60.6 bis 75.4 %, Einzelwerte 0 bis 100 %, 25 Wiederholungen, 84 % gleiche Antwort25 · 84 %Claude (Web) · D3: Mittel 65.7 %, Intervall 60.4 bis 70.9 %, Einzelwerte 44 bis 78 %, 11 Wiederholungen, 94 % gleiche Antwort11 · 94 %Welche deutschen Fantasy-Debüts 2026 sind e…G1OpenAI · G1: Mittel 4.0 %, Intervall -4.3 bis 12.3 %, Einzelwerte 0 bis 100 %, 25 Wiederholungen, 80 % gleiche Antwort25 · 80 %Gemini · G1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 92 % gleiche Antwort25 · 92 %Claude (Web) · G1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 11 Wiederholungen, 97 % gleiche Antwort11 · 97 %Welche literarischen High-Fantasy-Autoren s…G2OpenAI · G2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 100 % gleiche Antwort25 · 100 %Gemini · G2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 100 % gleiche Antwort25 · 100 %Claude (Web) · G2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 11 Wiederholungen, 100 % gleiche Antwort11 · 100 %Welche deutschen Fantasy-Autoren schreiben…GR1OpenAI · GR1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 100 % gleiche Antwort25 · 100 %Gemini · GR1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 80 % gleiche Antwort25 · 80 %Claude (Web) · GR1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 11 Wiederholungen, 100 % gleiche Antwort11 · 100 %Empfehle mir intellektuelle Fantasy mit Sys…GR2OpenAI · GR2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 100 % gleiche Antwort25 · 100 %Gemini · GR2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 72 % gleiche Antwort25 · 72 %Claude (Web) · GR2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 11 Wiederholungen, 100 % gleiche Antwort11 · 100 %Welche Fantasy-Bücher 2026 beschäftigen sic…GR3OpenAI · GR3: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 100 % gleiche Antwort25 · 100 %Gemini · GR3: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 92 % gleiche Antwort25 · 92 %Claude (Web) · GR3: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 11 Wiederholungen, 100 % gleiche Antwort11 · 100 %Welche literarische Fantasy auf Deutsch ers…GR4OpenAI · GR4: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 100 % gleiche Antwort25 · 100 %Gemini · GR4: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 76 % gleiche Antwort25 · 76 %Claude (Web) · GR4: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 11 Wiederholungen, 100 % gleiche Antwort11 · 100 %Welche Saga schreibt eine Stadt als Protago…GR5OpenAI · GR5: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 100 % gleiche Antwort25 · 100 %Gemini · GR5: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 100 % gleiche Antwort25 · 100 %Claude (Web) · GR5: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 11 Wiederholungen, 100 % gleiche Antwort11 · 100 %Edikt-Fantasy: Welche Werke gibt es in dies…GR6OpenAI · GR6: Mittel 16.0 %, Intervall 0.6 bis 31.4 %, Einzelwerte 0 bis 100 %, 25 Wiederholungen, 84 % gleiche Antwort25 · 84 %Gemini · GR6: Mittel 52.0 %, Intervall 31.0 bis 73.0 %, Einzelwerte 0 bis 100 %, 25 Wiederholungen, 52 % gleiche Antwort25 · 52 %Claude (Web) · GR6: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 11 Wiederholungen, 100 % gleiche Antwort11 · 100 %Welche Fantasy-Saga handelt von einer Stadt…L1OpenAI · L1: Mittel 97.3 %, Intervall 93.5 bis 100.0 %, Einzelwerte 67 bis 100 %, 25 Wiederholungen, 92 % gleiche Antwort25 · 92 %Gemini · L1: Mittel 8.0 %, Intervall -3.4 bis 19.4 %, Einzelwerte 0 bis 100 %, 25 Wiederholungen, 92 % gleiche Antwort25 · 92 %Claude (Web) · L1: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 11 Wiederholungen, 100 % gleiche Antwort11 · 100 %Welche Fantasy-Welt nutzt Edikt-basierte Ma…L2OpenAI · L2: Mittel 45.3 %, Intervall 29.0 bis 61.7 %, Einzelwerte 0 bis 100 %, 25 Wiederholungen, 44 % gleiche Antwort25 · 44 %Gemini · L2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 25 Wiederholungen, 100 % gleiche Antwort25 · 100 %Claude (Web) · L2: Mittel 0.0 %, Intervall 0.0 bis 0.0 %, Einzelwerte 0 bis 0 %, 11 Wiederholungen, 73 % gleiche Antwort11 · 73 %Was bedeutet "Marin Research Programme"?R1OpenAI · R1: Mittel 0.7 %, Intervall -0.7 bis 2.0 %, Einzelwerte 0 bis 17 %, 25 Wiederholungen, 96 % gleiche Antwort25 · 96 %Gemini · R1: Mittel 4.7 %, Intervall 1.5 bis 7.8 %, Einzelwerte 0 bis 17 %, 25 Wiederholungen, 52 % gleiche Antwort25 · 52 %Claude (Web) · R1: Mittel 5.1 %, Intervall 2.4 bis 7.7 %, Einzelwerte 0 bis 11 %, 11 Wiederholungen, 70 % gleiche Antwort11 · 70 %Anteil der erreichbaren Punkte je Frage in Prozent (negativ = falsche Angaben)Balken = 95-Prozent-Intervall, feine Linie = Spanne der Einzelmessungen, seit 2026-08-19

Über alle Fragen gemittelt gaben Claude (Web) in 94.5 Prozent der Wiederholungen dieselbe Bewertung (11 Messungen je Frage), Gemini in 82.3 Prozent der Wiederholungen dieselbe Bewertung (25 Messungen je Frage), OpenAI in 89.4 Prozent der Wiederholungen dieselbe Bewertung (24–25 Messungen je Frage). Ein kurzer Balken heißt: der Wert steht stabil. Ein langer Balken heißt: die Antwort hängt vom Tag ab, nicht von Marin.

Wo ist Marin gelistet?

Bevor ein KI-System einen Autor nennen kann, muss er in Suchmaschinen und Wissensdatenbanken auftauchen. Die Übersicht zeigt, auf welchen Flächen das bereits der Fall ist.

PersonWerkGenreWelt-MechanikWikidata · AutorQ1400045041.000.200.100.10Wikidata · BuchQ1400047400.301.000.300.10Google Wissensgraphkgsearch-API0.330.330.200.10Bing-Webmaster-KI-IndexGetUrlInfo0.050.050.100.05OpenAI Searchgpt-4o-mini-search (Bing)0.780.780.33Geminigemini-2.5-flash (Google-Grounding)0.390.390.17Anthropic Claudeclaude.ai · Websuche · Opus/Sonnet/Haiku0.080.080.03
1/3Suchanfragen mit Treffer im Google Knowledge Graph
2Einträge in Wikidata
23/30Seiten dieser Website im Google-Index
nicht messbarSeiten dieser Website im Bing-Index · die Schnittstelle gibt derzeit zu keiner der 23 Adressen einen Status zurück

KI-Crawler haben diese Website in den letzten 14 Tagen 1.573 Mal besucht.

Wer liest schon mit?

Leseplattformen sind für KI-Systeme eine wichtige Quelle. Diese Zahlen zeigen, wie sichtbar das Werk dort ist.

14Bewertungen auf Goodreads
0Follower auf Hardcover
Follower auf Bluesky
9Erwähnungen auf Reddit

Was die Zahlen nicht zeigen

  • Ein Autor, ein Werk, eine Sprache. Die Ergebnisse gelten für diesen Fall und lassen sich nicht ohne Weiteres verallgemeinern.
  • Der Autor misst sich selbst. Deshalb sind Fragen und Auswertung vorab festgelegt und veröffentlicht.
  • KI-Systeme ändern sich. Modelle und Suchlogik werden laufend ausgetauscht; ein Sprung kann auch vom Anbieter kommen.
  • Messen wirkt. Wer öffentlich misst, beeinflusst möglicherweise, was gemessen wird.
Dokumentierte Ausfälle und Methodik-Hinweise (15)
  • Methodik · 2026-05-13 bis 2026-08-21: METHODIK-KORREKTUR (keine Luecke), Fortsetzung von Eintrag 7: Die Doppelzeilen-Korrektur vom 03.09. deckte nur die Ankertage 22.08. bis 03.09. ab. Eine vollstaendige Zaehlung am 04.09. zeigt dieselbe Verdopplung im gesamten Zeitraum davor: 4690 Gruppen aus (Lauf, Modell, Frage) mit mehr als einer Nicht-Fehler-Zeile (Mai 2272, Juni 1984, Juli 1024, August 480 Gruppen). Ursache wie bei Eintrag 7 der wiederholte Stufen-Aufruf; zusaetzlich war das Schreiben der Antworten nicht idempotent, sodass jede Wiederholung einen zweiten vollstaendigen Satz anlegte. Anders als am 03.09. wird NICHT im Bestand geloescht: 687 der Gruppen tragen bei gleichem Score unterschiedlichen Antworttext, der Forschungsmaterial ist (Quellen-Parsing, Einbettungen, Drift-Analyse). Stattdessen dedupliziert ab 04.09. jede Auswertung selbst: je Lauf und (Modell, Frage) genau eine Zeile, eine Fehlerzeile verliert gegen eine echte Antwort, unter gleichrangigen Zeilen gewinnt die zuletzt geschriebene. Die historischen Snapshots sind nicht betroffen, weil sie vor dem Eintreffen der Doppelzeilen geschrieben wurden (belegt am 18.08.: Snapshot 04:04:36 mit 80 Datenpunkten, zweiter Zeilensatz 04:04:52). Betroffen war die live aus dem Bestand gerechnete Kanal-Kennzahl in /api/latest. Offen: 98 Gruppen, deren Wiederholungen unterschiedlich bewertet wurden; sie werden einzeln geklaert, bevor eine Reaggregation der Historie laeuft.
  • Methodik · 2026-05-13 bis 2026-09-04: METHODIK-KORREKTUR (keine Luecke), Abschluss der Eintraege 7 und 9: In 32 Faellen wurde dieselbe Frage innerhalb eines Messlaufs mehrfach beantwortet und unterschiedlich bewertet (Mai 5, Juni 11, Juli 5, August 11), meist durch Wiederholungen aus der Aufbauphase Stunden nach dem planmaessigen Lauf. Bisher zaehlte die zuletzt geschriebene Antwort. Seit dem 04.09.2026 zaehlt die Antwort, die dem planmaessigen Messzeitpunkt am naechsten liegt; fehlgeschlagene Anfragen sind keine Messpunkte. Alle Messtage wurden mit dieser Regel neu ausgewertet.
  • Claude-Kanal · 2026-06-01 bis 2026-09-04: METHODIK-HINWEIS (keine Luecke): In der claude.ai-Messumgebung war ein Konnektor zur eigenen Weltdatenbank der Saga aktiviert. In 47 Antworten auf Frage GR5 (01.06.-19.08.) sowie einzelnen Antworten auf GR2/GR4 bis 04.09. nannte das Modell diesen Konnektor statt einer Websuche-Quelle. Alle diese Antworten wurden als genre_baseline_no_marin (0) gewertet; die Kennzahlen sind unberuehrt. Die Nennungen wurden im Datensatz und im Archiv redigiert ([Konnektor der Messumgebung]); der Konnektor ist seit 04.09. in der Messumgebung deaktiviert.
  • Claude-Kanal · 2026-07-05 bis 2026-07-21: Messkanal-Ausfall: die claude.ai-Messung wurde nach einer Umstellung der Ablaufsteuerung nicht mehr ausgeloest und die claude.ai-Browsersitzung war offline. Claude-Tiers (Haiku/Sonnet/Opus) fehlen fuer diese 17 Tage; Primaer-/Kombiniert-Wert basiert in dem Fenster auf 2 Anbietern (OpenAI+Gemini). Nicht rueckwirkend messbar (Live-Messung). Behoben 2026-07-22: taeglicher automatischer Messlauf.
  • OpenAI-Kanal · 2026-07-24 bis 2026-08-06: Messkanal-Ausfall LAUFEND (Ursache 06.08. per Direkt-Test verifiziert): OpenAI-API-Konto OHNE CREDITS (credit_balance_exhausted) seit ~24.07. — kein Timeout, kein Gateway-Defekt. AbortError-Eintraege waren Sekundaerartefakt der 429-Backoff-Kaskade (50s Sleeps rissen das Chunk-Race). Fix deployed 06.08. (Worker 88fa700b): quota-Fehler = fail-fast Marker openai_quota_exhausted + degraded_channels-Warnung im Stage-Result. RESTORE-Bedingung: Betreiber laedt OpenAI-Credits auf (manuelle Freigabe), dann gap_end setzen. || RESTORED 2026-08-06 ~17:2x CEST: Credits wurden aufgeladen; Direkt-Test 17s OK; manueller Stage-Nachlauf (run 304eb03e) liefert openai_search wieder live-Datapoints. Gap final: 24.07.-06.08.
  • Bing-Kanal · 2026-08-01 bis 2026-09-08: Die Bing-Webmaster-Schnittstelle beantwortet die Index-Abfrage seit dem 01.08.2026 an keinem Tag mehr mit einem Status (742 von 742 Zeilen im August ohne Wert, 710 davon HTTP 400; erste Fehler im Juli). Der Kanal liefert also keine Nullwerte, sondern gar keine Messung. Die Anzeige auf der Ergebnisseite stand bis zum 08.09.2026 auf 0 von 25 und wurde auf nicht messbar umgestellt. Ursache der 400er noch offen, Dauer laeuft weiter. NACHTRAG 09.09.2026: Ursache geklaert. Der Zugangsschluessel war gueltig, aber die Eigentuemer-Bestaetigung der Adresse war verloren gegangen; jede Einzelabfrage endete deshalb in NotAuthorized. Die Bestaetigungsdatei wird seit dem 09.09. wieder ausgeliefert, die Bestaetigung ist wiederhergestellt und Einzelabfragen liefern wieder Werte. Der Kanal misst trotzdem noch nicht: die Abfragen der Erhebungsumgebung werden von Bing IP-seitig gedrosselt (ThrottleIP, 30 von 30 Adressen), waehrend dieselbe Abfrage aus einem anderen Netz zur selben Minute HTTP 200 liefert. Die Luecke bleibt deshalb offen.
  • OpenAI-Kanal · 2026-08-18 bis 2026-08-19: Messkanal-Ausfall, ZWEITER Vorfall (Erster: 24.07.-06.08.): OpenAI-API-Konto erneut OHNE CREDITS (insufficient_quota, per Direkt-Test 19.08. verifiziert), 12 Tage nach der Aufladung vom 06.08. Verbrauch ca. 29 Search-Calls/Tag (gpt-4o-mini-search-preview). Betroffen: 18.08. (32 Fehlerzeilen, Tag nicht rueckwirkend messbar, Primaer-Wert nur Gemini) und 19.08. (nach Aufladung am 19.08. ~09:40 UTC Stage nachgefahren = echter Messwert, kein Gap). ZUSAETZLICH am 19.08. behoben: die Live-Stage-Aggregation zaehlte Fehlerzeilen als Datenpunkte (0% zitiert) und drueckte den kombinierten Wert (11,1% statt ~16,7%); seit Worker 3fd56929 sind Fehlerzeilen kein Messpunkt mehr und Provider ohne valide Antwort erscheinen als unavailable (Luecke ist kein Nullwert). Dauerhafte Vorbeugung: Auto-Recharge im OpenAI-Billing (Betreiber).
  • Methodik · 2026-08-19: METHODIK-AENDERUNG (keine Luecke): KI-Zitations-Messung (OpenAI/Gemini/Claude-Batch) laeuft ab 19.08. alle 3 Tage statt taeglich (Messtage 19., 22., 25.08. ...). Begruendung aus 50 Tagen Daten: Tag-zu-Tag-Autokorrelation 0,02 (Tageswerte sind Rauschen um ein stabiles Niveau), 3-Tage-Mittel halbiert die Streuung, Kosten dritteln sich. Zeitreihe bleibt vergleichbar (gleiche 16 Fragen, gleiche Anbieter, gleiches Scoring); an Zwischentagen zeigt das Dashboard den juengsten Messtag (Messdatum explizit). Gleichzeitig Kennzahl-Split in drei Kanaele (Direkt / Saga-Wissen / Empfehlung), Kombi-Wert bleibt als Kontinuitaet.
  • Methodik · 2026-08-22 bis 2026-09-03: METHODIK-KORREKTUR (keine Luecke): An den Ankertagen 22.08., 25.08., 28.08., 31.08. und 03.09. standen Gemini und OpenAI-Search mit 32 Zeilen fuer 16 Fragen in ai_citation_results (identische Antwort und Score, ~50 s auseinander). Ursache im Worker: der Workflow-Step finalize-aggregate rief die komplette Live-Stage ai_citation erneut auf statt nur den Snapshot zu reaggregieren; an Nicht-Ankertagen erzeugte derselbe Step 16 ungeplante Zeilen trotz 3-Tage-Kadenz. Folge: Doppelgewicht der Web-Kanaele in der Aggregation. Korrektur 03.09.: Doppelzeilen entfernt (aelteste je Frage bleibt), Snapshots reaggregiert. Kombinierter Wert vorher/nachher: 22.08. 11,5/6,9 · 25.08. 8,0/5,0 · 28.08. 12,1/8,5 · 31.08. 12,6/9,0 · 03.09. 9,9/8,8 Prozent. Der Bericht 03 vom 19.08. ist nicht betroffen (Daten bis 19.08.). Worker-Fix: finalize-aggregate ruft reaggregateSnapshot.
  • Claude-Kanal · 2026-08-23: Messausfall: Der claude.ai-Messlauf vom 23.08.2026 hat alle 48 Zeilen (3 Modellstufen x 16 Fragen) mit Fehlerstatus geschrieben, also keine einzige verwertbare Antwort. Der Lauf steht deshalb mit n=0 und ohne Prozentwert im Aggregat und geht weder in die Kopfzahl noch in den Verlauf ein; eine Luecke ist kein Nullwert. Der 23.08. war kein Ankertag, die 3-Tage-Kadenz (19., 22., 25.08.) bleibt unberuehrt. Folge fuer Auswertungen auf Frage-Ebene: fuer Claude-Web stehen seit dem 19.08. zehn statt elf Wiederholungen je Frage zur Verfuegung. Nachtraeglich messen ist nicht moeglich, weil eine Messung immer den Stand ihres Tages festhaelt. Befund vom 07.09.2026.
  • Dokumentierter Eingriff · 2026-08-27: Dokumentierter Eingriff, KEIN Messausfall: Eintrag des Programms in die kuratierte Fremdliste DavidHuji/Awesome-GEO eingereicht (PR #17, Paper-DOI + CC-BY-Datensatz). Erste nicht selbst publizierte Nennung, falls gemergt. Anlass: Fachbefund vom 21.08. (r/GEO_optimization), wonach der Empfehlungskanal an Drittquellen-Evidenz haengt und nicht an Entitaets-Erkennung. Zweiter, separat datierter Eingriff folgt am 22.09. (Buch-Erscheinen).
  • Claude-Kanal · 2026-08-31 bis 2026-09-03: Messausfall des Anbieters Claude (Web) an einem Ankertag: Am 31.08.2026 lief die claude.ai-Messung nicht, weil die Messumgebung vom 29.08. bis 01.09.2026 vier Tage still ausfiel. Die Kopfzahl combined_primary des 31.08. beruht deshalb auf zwei statt drei Anbietern (OpenAI 22,9 %, Gemini 20,8 %, Ergebnis 21,9 %). Nachmessen ist nicht moeglich, eine Luecke ist kein Nullwert. Der Ankertag 03.09.2026 hat aus demselben Grund keine eigene Claude-Messung; sein Punkt traegt die Claude-Messung vom 02.09. Quelle: claude_web_snapshots gegen das Ankerraster ab 19.08.2026.
  • OpenAI-Kanal · 2026-09-03: Messkanal-Ausfall LAUFEND, DRITTER Vorfall (1.: 24.07.-06.08., 2.: 18.-19.08.): OpenAI-API-Konto erneut OHNE CREDITS (openai_quota_exhausted in allen 32 openai_search-Zeilen des Runs 30f44ad7 am 03.09. 04:03 UTC; 31.08.-02.09. fehlerfrei), 15 Tage nach der Aufladung vom 19.08. Verbrauch ca. 29 Search-Calls/Tag (gpt-4o-mini-search-preview). Primaer-Wert bis zur Aufladung nur Gemini plus Claude-Batch; Luecke ist kein Nullwert (unavailable_llms_v271=[openai_search]). gap_end vorlaeufig = Meldetag, wird nach der Aufladung nachgezogen. NACHTRAG: Aufladung 03.09. mittags (Betreiber), Stage um 12:12 UTC nachgefahren = echter Messwert fuer den 03.09., kein Gap mehr; Eintrag bleibt als Beleg des Vorfalls.
  • Methodik · 2026-09-04: METHODIK-HINWEIS (keine Luecke): Seit dem 04.09.2026 gibt es eine einzige Kopfzahl. Sie ist der einfache Mittelwert der drei Anbieter OpenAI, Gemini und Claude (jeweils Anteil der hoechstmoeglichen Bewertung ueber alle 16 Fragen, Claude als Mittel seiner drei Modellstufen). Die drei Fragearten und der Verlauf werden aus derselben Basis gebildet. Frueher standen daneben Werte mit anderer Rechenbasis (alle Modelle einschliesslich Kontrollmodelle; OpenAI und Gemini gepoolt); diese erscheinen nur noch als Pruefwerte in der Methodik-Karte.
  • Dokumentierter Eingriff · 2026-09-22: Dokumentierter Eingriff, KEIN Messausfall. Am 22.09.2026 wird der erste Band der Saga im Handel verfuegbar. Das ist der groesste geplante Eingriff der Phase 1 und wird deshalb vorab festgeschrieben, damit die Vorher-Nachher-Auswertung nicht nachtraeglich begruendet wird. HYPOTHESE: Handelsverfuegbarkeit erzeugt erstmals von Dritten gefuehrte, maschinenlesbare Nachweise (Haendler-Katalog, Bibliotheks-Metadaten, ISBN-Register). Erwartet wird, dass such-gestuetzte Modelle diese Nachweise abrufen und die Trefferquote im Direkt-Kanal (Fragen D1-D3) frueher steigt als im Empfehlungs-Kanal (GR1-GR6), weil Empfehlungen zusaetzlich Rezeptions-Signale brauchen. NULLHYPOTHESE: kein Unterschied zwischen den Messfenstern. MESSFENSTER: Grundlinie 23.08.-21.09.2026 (10 Ankertage der 3-Tage-Kadenz), Wirkungsfenster 22.09.-22.10.2026 (10 Ankertage), Beobachtung bis 21.12.2026 fuer verzoegerte Effekte. KENNZAHL: combined_primary je Messtag (Web-Anbieter OpenAI, Gemini, Claude-Web, gleichgewichtet), zusaetzlich getrennt nach den drei Kanaelen Direkt / Saga-Wissen / Empfehlung. AUSWERTUNG: Vorher-Nachher-Vergleich mit abgezogener CUSUM-Grundliniendrift, damit ein laufender Trend nicht als Wirkung des Eingriffs gelesen wird. UNVERAENDERT: 16 feste Fragen, Anbieter-Panel und 3-Tage-Kadenz werden fuer den Eingriff NICHT angepasst.

Was als Nächstes ausgewertet wird

Die Methoden-Notiz sieht weitere Auswertungen vor. Sie erscheinen hier erst, wenn genug echte Messwerte dafür vorliegen.

  • Abweichung vom Startniveau · dauerhafte Verschiebungen je Anbieter seit 04.09.2026 oben zu sehen
  • Verlässlichkeit der Messung · Wie ähnlich fällt die Antwort aus, wenn dieselbe Frage erneut gestellt wird? seit 08.09.2026 oben zu sehen
  • Wirkung einzelner Ereignisse · Was ändert sich nach dem Erscheinen des Buchs oder nach einem Eintrag in Wissensdatenbanken? ab 22.09.2026
  • Reaktionszeit der Suchsysteme · Wie lange dauert es, bis eine neue Information in den Antworten ankommt? in Vorbereitung

Daten und Methodik

Alle Messwerte sind frei verfügbar und nachrechenbar.

Prüfwerte und Rechenregeln (für Fachleute)
  • Kopfzahl. Einfacher Mittelwert der drei Anbieter OpenAI, Gemini und Claude, jeweils der Anteil der höchstmöglichen Bewertung über alle 16 Fragen; Claude zählt als ein Anbieter (Mittel seiner drei Modellstufen). Die drei Fragearten in der ersten Karte entstehen aus denselben Antworten, und der Verlauf zeigt dieselbe Zahl je Messtag.
  • Mehrfachantworten. Wurde dieselbe Frage in einem Messlauf mehrfach beantwortet, zählt seit dem 04.09.2026 die Antwort, die dem planmäßigen Messzeitpunkt am nächsten liegt. Die Regel wurde rückwirkend auf alle Messtage angewandt. Fehlgeschlagene Anfragen sind keine Messpunkte.
  • Prüfwerte des letzten Messlaufs (andere Rechenbasis, nur zur Kontrolle): OpenAI und Gemini zusammen, alle Antworten gleich gewichtet 18.8 % · alle Modelle einschließlich der Kontrollmodelle ohne Web-Zugriff 18.8 % · nur Kontrollmodelle ohne Web-Zugriff · nach Frageart (OpenAI und Gemini zusammen): Direct 77.8 %, Genre 0.0 %, LongTail 33.3 %, CompCluster 0.0 %, Research 0.0 %, GenreRecommend 0.0 %.

Messwerte werden automatisch aktualisiert · Stand der Seite 2026-09-13