Seit dem 11. Mai 2026 beantworten drei Antwortmaschinen
mit Websuche – OpenAI, Gemini und Claude – dieselben 16 Fragen
zu einem neuen Autor. Dazu werden Wissensgraphen, Suchindizes und
Lese-Plattformen täglich beprobt. Gemessen wird, ob und wie
zuverlässig die Maschinen den Autor finden, und wie stabil die
Messung selbst ist. Phase 1 endet mit dem Buch-Launch am
8. Oktober 2026; ab dann misst Phase 2 die Wirkung
des erschienenen Buches.
Methoden werden vor-registriert, Quellcode und Roh-Daten sind
offen, Failure-Logs zählen gleichgewichtig mit Befunden.
Adressiert sind Autorinnen und Autoren mit Sichtbarkeits-Frage —
und Praktiker:innen der Such- und Antwort-Maschinen-Optimierung
(SEO, AEO, GEO), die nach einer validierten Mess-Grundlage
statt Anekdoten suchen.
Programmleitung
Marin T. Kael
Aktiv seit
2026-05-11
Kadenz
Messung alle 3 Tage · Berichte quartalsweise
Lizenz
CC BY 4.0 · MIT · CC0
Untersuchungslinien · Aktives 3-Phasen-Design
Aktives Programm in drei zeitlich überlappenden Phasen.
Marin T. Kael’s Forschungsprogramm operiert in drei
zeitlich überlappenden Phasen. Phase 1 (Mai bis Oktober 2026)
verbindet sieben vor-registrierte Eingriffe Q0–Q6 mit der Prüfung der
Mess-Instrumente. Phase 2 (ab dem Buch-Launch am 8. Oktober 2026
bis Q3 / 2027) misst die Wirkung des erschienenen Buches.
Phase 3 (ab Q3 / 2027) führt Langzeit-Kontrollexperimente
auf der geprüften Apparatur. Wirkungsaussagen in Phase 2 stehen
unter dem Vorbehalt der Instrument-Validierung, die bis Q1 / 2027
parallel weiterläuft.
Linie 01
Zitations-Inventur
Was zeigt jedes Mess-Instrument heute überhaupt? Acht Mess-Flächen
werden täglich beprobt und die Sichtbarkeit der Autor-Identität
pro Identitäts-Cluster — Person, Werk, Genre, Welt-Mechanik —
als Abdeckungs-Matrix dokumentiert. In Phase 1 ohne
Wirkungs-Interpretation: zuerst zählen, was die Instrumente
überhaupt abbilden.
Kern ist die Zitations-Messung: 16 feste Fragen in vier Gruppen
(direkt nach Autor und Werk, nach Begriffen aus dem Werk, nach
Genre-Empfehlungen, nach dem Forschungsprogramm) an drei
Antwortmaschinen mit Websuche – OpenAI, Gemini und Claude
(claude.ai, drei Modellstufen) – alle drei Tage. Daneben täglich:
Wikidata, Wikipedia, Google Knowledge Graph, Bing,
Google Search Console, Common Crawl, Goodreads,
Hardcover, Reddit und Bluesky. Jede Antwort wird nach festem
Schema von −3 (Halluzination) bis +3 (vollständige, belegte
Zitation) bewertet; Kopfzahl ist der Anteil zitierender Antworten
je Anbieter (deskriptiv).
Linie 02
Mess-Instrument-Validierung
Reliabel ist ein Instrument, wenn es bei wiederholter Messung
gleicher Realität gleiche Werte liefert. Phase 1 prüft jedes
Mess-Fläche auf Wiederhol-Reliabilität, intra-Set-Konsistenz und
Modell-Drift — und stellt fest, welche Mess-Flächen überhaupt für
spätere Wirkungs-Messungen geeignet sind.
Wiederhol-Korrelation r über 24-h-Wiederholungs-Proben
(Schwelle r ≥ 0,9 für API-Quellen,
≥ 0,7 für Sprachmodell-Proben). Cronbach’s α
intra-Query-Set ≥ 0,7 als Vorbedingung. CUSUM-Karten auf
Hit-Rate über 90-Tage-Fenster mit Alarm-Schwelle h = 5.
Modell-Versions-Logs werden separat protokolliert; Driftereignisse
werden mit Drift-Profilen pro Mess-Fläche ausgewiesen.
Linie 03
Codebuch-Iteration
Was zählt überhaupt als „korrekte Citation"? Welche Antwort gilt
als Halluzination, welche als korrekt-aber-unvollständig?
Phase 1 versioniert das Annotations-Schema öffentlich,
dokumentiert Grenzfälle und holt öffentliche Rückmeldungen ein — als
Voraussetzung dafür, dass spätere Wirkungs-Aussagen auf einem
eindeutigen Mess-Schema beruhen.
Codebuch v0.x → v1.0 als publizierter Meilenstein; bis zur
Freigabe von v1.0 (geplant Q1 / 2027) gelten Ergebnisse
als deskriptiv. Jede neue Schema-Version erscheint mit
Beispiel-Annotationen, Grenzfall-Diskussion und Differenz zur
Vorgänger-Version. Inter-Rater-Übereinstimmung (Cohen’s κ) wird
ab Q4 / 2026 mit externen Annotator:innen erhoben;
Schwelle κ ≥ 0,7 als Bedingung für die
Codebuch-Versions-Freigabe.
Linie 04
Offene Materialien
Alles, was das Programm produziert, ist offen: Methoden-Notizen,
Vor-Registrierungen, Mess-Quellcode, Roh-Daten, Quartalsberichte,
Fehlschlag-Logs, Codebuch-Versionen. Methodik-Reviewer:innen
mit Python-Umgebung und Internet-Zugang können jede Auswertung
nachvollziehen — das ist der einzige Audit-Mechanismus, den
eine Einzelfall-Studie hat.
Methoden-Notizen und Quartalsberichte unter CC BY 4.0,
Quellcode auf GitHub unter MIT,
Roh-Daten unter CC0 (sofern Plattform-AGB konform). Berichte und
Methoden-Notizen erhalten eine Zenodo-DOI. Pro Quartalsbericht ein
Replikations-Archiv mit eingefrorenen Versions-Pins,
environment.yml, User-Agent-Strings und
Endpunkt-Schnappschüsse.
Beispiel-Auswertung · Phase 1
So sieht ein Validierungs-Befund aus.
Phase 1 misst nicht Wirkungen, sondern Mess-Eigenschaften.
Wiederhol-Reliabilität r sagt, ob ein Mess-Fläche bei
wiederholter Probe gleicher Realität gleiche Werte liefert.
Schwelle r ≥ 0,9 wird für API-Quellen angesetzt,
r ≥ 0,7 für sprachmodellbasierte
Browser-Schnappschüsse.
Die Auswertung steht im Validierungs-Bericht Q3 / 2026. Laufend zeigt die Ergebnisseite die laufenden Messwerte und je Frage, wie oft wiederholte Messungen dieselbe Bewertung ergeben.
Publikationen
Veröffentlicht und in Vorbereitung.
Berichte, Working Papers, Methodenpapiere und Vor-Registrierungen,
neueste zuerst. Jede Publikation hat eine stabile URL und ein Zitierschema;
Berichte und Methoden-Notizen zusätzlich eine Zenodo-DOI.
Zweiter Validierungs-Bericht: Inter-Rater-Übereinstimmung (Cohen’s κ) mit externen Annotator:innen, Codebuch-Versions-Differenz von v0.1 zu v0.2, fortschreibende Drift-Statistiken pro Mess-Fläche, erste Aussagen zu Inter-Mess-Flächen-Übereinstimmung (welche Mess-Flächen sind redundant, welche orthogonal?).
Validierungs-Bericht · Q1 / 2027Forthcoming
Konsolidierung der Mess-Apparatur
Dritter Validierungs-Bericht: zusammengeführte Reliabilitäts-, Drift- und Inter-Rater-Befunde aus drei Quartalen. Entscheidung über Codebuch v1.0, auf dem belastbare Wirkungsaussagen zu Phase 2 beruhen. Falls einzelne Mess-Flächen die Validierungs-Schwellen nicht erreichen, werden sie für Phase 2 ausgeschlossen oder durch Alternativen ersetzt.
Übergangs-NotizForthcoming
Abschluss der Instrument-Validierung · Phase-3-Vor-Registrierungen
Methoden-Notiz mit dem Schluss der Instrument-Validierung und den ersten vor-registrierten Hypothesen für Phase-3-Long-Term-Kontrollexperimente ab Q3 / 2027 auf der validierten Apparatur.
Offene Materialien
Replikation und Auditierbarkeit.
Style-Sheet (kanonische Wahrheit)
Das gegen jede Erhebung verglichene Referenzdokument wird versioniert
gepflegt. Der aktuelle Stand ist auf Anfrage erhältlich.
Mess-Pipeline (Quellcode)
Erhebungs- und Linter-Skripte sind öffentlich auf GitHub:
github.com/marintkael/marin-research-tools
(Python, MIT-Lizenz). Mit jedem Quartalsbericht erscheint zusätzlich
ein Replikations-Archiv mit eingefrorenen Versions-Pins.
Pre-Registrierungen
Jede Erhebung wird vor Datenerfassung mit Hypothese, Mess-Operationalisierung
und Stopp-Kriterium veröffentlicht. Spätere Änderungen werden kenntlich
gemacht.
Fehlschlag-Protokoll
Jedes durch den Linter blockierte Material wird mit Grund und Datum
geloggt. Aggregierte Auszüge sind Teil der Quartalsberichte. Die
Politik-Grenze der Pipeline bleibt von außen prüfbar.
Über das Programm
Marin T. Kael ist Autor — und führt parallel ein offen dokumentiertes
Feldlabor zur Frage, wie Sprachmodell-basierte Suchsysteme und
KI-Antwortmaschinen eine literarische Autor-Identität aufnehmen,
verstehen und zitieren. Phase 1 (Mai bis Oktober 2026):
vor-registrierte Eingriffe Q0–Q6 vor dem Launch und Prüfung der
Mess-Instrumente. Phase 2 (ab dem Buch-Launch am
8. Oktober 2026): Wirkung des erschienenen Buches.
Phase 3 (ab Q3 / 2027): Langzeit-Kontrollexperimente
auf der geprüften Apparatur.
Adressiert sind Autor:innen, die ihre Sichtbarkeit in der KI-Suche
verstehen wollen, sowie Praktiker:innen der Such- und Antwort-
Maschinen-Optimierung (SEO / AEO / GEO), die nach einer
reproduzierbaren Mess-Grundlage statt anekdotischer Behauptungen
suchen. Die Arbeit ist eigenfinanziert und nicht an eine
akademische Einrichtung angebunden.
Eine ausführliche Beschreibung — Mission, Methodik, Ethik,
Veröffentlichungsplan — steht unter
/research/programme.
Kontakt
Anfragen zu Methodik, Replikation oder Auditierung:
research@marin-t-kael.de.
Quellcode und Replikations-Archive auf
GitHub.