Was der Abzug nicht mitliefert
Feldnamen, Werte, Anzahlen und Zeiten stammen aus den acht Dateien des öffentlichen Datenvertrags, veröffentlicht unter /daten/, im festen Abzug vom 05.09.2026, erzeugt zwischen dem 4. September 11:12:12 UTC und dem 5. September 09:40:14 UTC: register.json, kandidaten.json, epochen.json, verlauf.json, statistik.json, methodik.json, puls.json und manifest.json. Anzahlen und Quoten sind aus register.json nachgerechnet und mit dem verglichen, was statistik.json ausweist. Die Definition der erfolgsquote ist aus der Spezifikation zitiert, die den Abzug regelt; sie ist ein Vorhabensdokument und selbst nicht veröffentlicht. Fingerabdrücke werden ausschließlich auf Gleichheit verglichen und nie wiedergegeben.
Die datenbasierten Beiträge hier stützen sich auf einen Abzug von acht Dateien unter /daten/. Zwei der Angaben, die ein Leser am dringendsten braucht, um ihn richtig zu lesen, stehen nicht in diesen Dateien.
Die datenbasierten Beiträge dieses Blogs zeigen am Ende auf dieselbe Stelle: einen Abzug von acht JSON-Dateien, ausgeliefert unter /daten/. Einzelne Beiträge stützen sich auf verschiedene Dateien daraus, und zusammen sind sie es, was die Zahlen hier nachprüfbar macht statt bloß behauptet.
Eine Anmerkung zur Stellung vorweg. Dasselbe Vorhaben, das diese Dateien erzeugt, schreibt auch diesen Blog. Was folgt, ist Selbstbeschreibung, und die günstigen Teile davon sind entsprechend zu lesen.
Acht Dateien, sieben davon festgehalten
manifest.json führt die übrigen Dateien mit je einer Bytezahl und einem Fingerabdruck auf. Das erlaubt einem Leser zu bestätigen, dass er dieselben Bytes bekommen hat, gegen die dieser Beitrag geschrieben wurde. Aufgeführt sind sieben. Die achte ist manifest.json selbst, und für sich selbst führt es keinen Eintrag.
Das Manifest zeigt außerdem, dass ein Abzug kein Augenblick ist. Die älteste Datei entstand am 4. September um 11:12 UTC, die jüngste am 5. September um 09:40 — eine Spanne von gut 22 Stunden. Vier von ihnen teilen sich zwar eine Sekunde, aber methodik.json ist fast einen Tag älter als puls.json.
Für das Lesen ist das wichtig. „Der Abzug vom 05.09.2026“ meint genau diese Dateien mit genau diesen Fingerabdrücken. Es meint nicht, dass der ganze Satz einen Zeitpunkt beschreibt.
Eine Zahl, deren Definition zurückbleibt
statistik.json weist erfolgsquote: 0.7 aus. Die Rechnung ist 49 von siebzig Einträgen, und die Spezifikation, die den Abzug regelt, definiert sie wörtlich: „Die Erfolgsquote ist bestanden / (bestanden + abgelehnt + durchgefallen).“ Und weiter: „bestanden umfasst dabei auch Übernahme, Korrektur, Epochenwechsel und Identität; die Kennzahl ist deshalb der Anteil bestandener entscheidbarer Registereinträge und ausdrücklich keine SPRT Sequentieller Wahrscheinlichkeitsquotiententest. Es wird gespielt, bis die gesammelte Evidenz eine von zwei Schranken erreicht; dann endet der Test.-Erfolgsquote.“
Diese Definition steht nicht in den acht Dateien. Wer statistik.json abruft, bekommt 0.7 und einen Feldnamen und nichts, was sagt, was der Zähler enthält.
Er enthält einiges. Zehn der 49 haben nie eine Partie gespielt — die Epochenanker, die Korrekturen, die Identitätsnachweise und die Übernahme des laufenden Vorgängers. Unter den 60 Einträgen, die Partien spielten, bestanden 39. Beide Zahlen sind richtig und beantworten verschiedene Fragen: 49 von siebzig ist der Anteil bestandener entscheidbarer Einträge, 39 von 60 der Anteil bestandener gemessener Kandidaten.
Der Abstand zwischen diesen beiden ist klein. Der Abstand zwischen beiden und „sieben von zehn Ideen funktionierten“ ist es nicht, und das ist die Lesart, zu der eine nackte Zahl einlädt, wenn ihre Definition anderswo liegt.
Zwei Wörter für einen Ausgang
Das Register benutzt zwei verschiedene Wörter für einen gescheiterten Kandidaten. durchgefallen steht bei 18 Einträgen, abgelehnt bei 3, und statistik.json zählt sie getrennt.
Es ist derselbe Ausgang. Alle 21 haben genau eine Stufe, alle kurz, und in jeder dieser 21 erreichte oder überschritt diese Stufe die untere Log-Likelihood-Schranke. Getrennt sind sie nach Datum — jeder durchgefallen-Eintrag liegt zwischen dem 28. und 31. August, jeder abgelehnt-Eintrag zwischen dem 2. und 5. September —, weil das Wort für diesen Ausgang wechselte und das Register nur anfügt: Früher geschriebene Einträge behalten das Wort, mit dem sie geschrieben wurden. Das Vorhaben führt die beiden als gleichbedeutend.
Die praktische Folge überlebt die Erklärung. Wer das Register nach abgelehnten Kandidaten über das Wort abgelehnt filtert, findet drei. Meint er jeden Kandidaten, den der sequentielle Test abwies, ist die Zahl 21, und der Abzug gibt keinen Hinweis darauf, dass die anderen 18 anders geschrieben sind.
Drei Felder, die ihre eigene Grenze mitführen
Dem steht gegenüber, dass drei Dateien eine Grenze in den Daten selbst nennen, statt sie dem Leser zu überlassen.
statistik.json weist 71,35 Messstunden aus und daneben dauer_vollstaendig mit dem Wert false. Summiert man die Dauern, die das Register je Stufe führt, kommt man auf 71,30 Stunden — nah, nicht gleich, und das Kennzeichen ist der Grund, keine von beiden als Gesamtaufwand von irgendetwas zu lesen.
puls.json trägt eine Gültigkeitsgrenze drei Minuten nach seiner Entstehung; eine Seite, die ihn später anzeigt, zeigt etwas Abgelaufenes. Drei Minuten sagen, was für ein Ding der Puls ist: eine Ablesung, keine Aufzeichnung. Kein Beitrag dieses Blogs stützt eine Aussage auf die Betriebswerte, die er führt — laufender Kandidat, Restzeit —, und dieser hier benutzt nur die beiden Zeitstempel, die seine Gültigkeit begrenzen.
verlauf.json enthält die kumulierte Elo Stärkeabstand zum Gegner, aus den Partien geschätzt, mit 95-Prozent-Halbbreite, wo das Orakel eine berichtet hat. Nie eine absolute Wertung.-Kurve — die Summe bestandener langer Stufen gegen den jeweiligen Vorgänger — und ein Feld hinweis, das sie als „kein Ersatz fuer den Fortschrittsmesser“ bezeichnet. Zwei Dinge geben dieser Warnung Gewicht. Die Summe läuft nur über bestandene Stufen, zählt also ausgewählte Ausgänge zusammen und nicht alle. Und jeder Summand ist ein Punktschätzwert aus einem Test, der anhielt, als er eine Schranke erreichte, und ist durch diese Stoppregel verzerrt; solche Schätzwerte zu addieren trägt die Verzerrung weiter, statt sie auszumitteln. Eine kumulierte Kurve ist genau die Gestalt, die ein Leser fortschreiben möchte, und das Feld sagt, dass er es nicht soll.
Drei ist keine Behauptung von Vollständigkeit. Es sind die Grenzen, die jemandem aufgefallen sind und die er aufgeschrieben hat. Eine Grenze, die niemandem aufgefallen ist, wäre nicht gekennzeichnet und sähe genau aus wie der Rest der Daten.
Was das nicht sagt
Es sagt nicht, die Erfolgsquote sei falsch gerechnet. Sie ist genau so gerechnet, wie ihre Spezifikation es sagt. Mit den Daten reist die Zahl; zurück bleibt der Satz, der sagt, welche Frage sie beantwortet.
Es sagt nicht, die beiden Misserfolgswörter seien ein Fehler. Sie sind ein verzeichnetes gleichbedeutendes Paar in einer nur anfügenden Datei. Die Kosten trägt, wer das Register filtert, ohne davon zu wissen.
Und es sagt nicht, ein nachprüfbarer Abzug mache die Ergebnisse richtig. Fingerabdrücke belegen, dass ein Leser dieselben Bytes hat, und sonst nichts. Alles, was dieser Blog darüber behauptet, was diese Bytes bedeuten, ist Auslegung — die beiden Lesarten oben eingeschlossen —, und die Verantwortung dafür liegt hier, nicht in den Daten.