Lauf T-0076 bestanden
· Nachweis: SPRT Sequentieller Wahrscheinlichkeitsquotiententest. Es wird gespielt, bis die gesammelte Evidenz eine von zwei Schranken erreicht; dann endet der Test.
Hypothese
Ein Netz, das zusätzlich auf Kampagnendaten trainiert ist, spielt stärker als das Produktionsnetz aus dem Altsatz allein.
Stufen
| Feld | kurze Stufe | lange Stufe |
|---|---|---|
| Urteil | bestanden | bestanden |
| Elo Stärkeabstand zum Gegner, aus den Partien geschätzt, mit 95-Prozent-Halbbreite, wo das Orakel eine berichtet hat. Nie eine absolute Wertung. | +143,17 ± 26,61 | +172,05 ± 27,97 |
| nElo Normiertes Elo: der Elo-Abstand geteilt durch die Streuung der Partieergebnisse, damit die SPRT-Schranken bei verschiedenen Bedenkzeiten dasselbe bedeuten. | +185,04 ± 30,70 | +230,62 ± 31,89 |
| Partien | 492 | 456 |
| Siege / Remis / Niederlagen | 272 / 140 / 80 | 266 / 133 / 57 |
| Pentanomial Gespielt wird in Paaren mit vertauschten Farben; die fünf Zahlen sind die Paare mit 0, ½, 1, 1½ und 2 Punkten. | 3 / 25 / 72 / 69 / 77 | 5 / 14 / 47 / 91 / 71 |
| LLR Log-Likelihood-Verhältnis, die laufende Evidenz eines SPRT. Es beginnt bei 0; eine Stufe besteht an der oberen Schranke (etwa +2,94) und fällt an der unteren durch (etwa −2,94). | +2,96 | +2,95 |
| Schranken | −2,94 … +2,94 | −2,94 … +2,94 |
| SPRT Sequentieller Wahrscheinlichkeitsquotiententest. Es wird gespielt, bis die gesammelte Evidenz eine von zwei Schranken erreicht; dann endet der Test. | [0,0; 5,0] | [0,0; 5,0] |
| Fehlerraten α / β | 0,05 / 0,05 | 0,05 / 0,05 |
| Modell | normalized | normalized |
| Bedenkzeit Grundzeit plus Zuschlag je Zug in Sekunden, z. B. 8+0.08: acht Sekunden je Partie plus 0,08 Sekunden je Zug. | 8+0.08 | 40+0.4 |
| Buch | A | B |
| Gegner | gegen Vorgänger | gegen Vorgänger |
| Dauer | 3 min | 18 min |
Herkunft
- Datum
- 2026-09-14
- Begonnen
- 2026-09-14 13:44:01 UTC
- Dauer
- 22 min
- Autor
- Agent X
- Epoche
- 4
- Torwächter
- bestanden
- Bench-Knoten
- 3.242