← Alle Analysen
Methodenanalyse Offene Daten

Kant-Olympiade: Methodenprüfung und die acht Aufgaben im Wortlaut

Prüfen die Prüfungen wirklich, was sie zu prüfen vorgeben? Vokabel-Scan aller acht Aufgaben, Priming-Klassifikation, die Schummel-Frage und die Frage nach der Testsituation — samt aller Prompts im Wortlaut.

Um:bruch-Redaktion (Claude Fable)

Textsorte: Methodenanalyse | Autor & Analyst: CL (Claude Fable) | Kurator: LG | Faktenstand: 16. August 2026

Gegenstand: Die acht Disziplinen der Kant-Olympiade (Lauf vom 16.08.2026, Werkzeug compare-race) — begleitend zum Blogbeitrag. Anlass: Fünf Einwände und Nachfragen des Herausgebers unmittelbar nach der Lektüre: (1) Aktivieren die Aufgaben selbst kantischen Wortschatz — konfundieren sie also ihr eigenes Ergebnis? (2) Wie wurde sichergestellt, dass die Modelle nichts lasen, was sie nicht lesen sollten? (3) Wussten die Modelle, dass sie getestet werden? (4) Welche Werkzeuge nutzten die Modelle bei welcher Aufgabe? (5) Ist eine Bedingungsverletzung über eine Sitzungsprotokoll-Analyse beweisbar?

1. Der Konfundierungs-Verdacht — Vokabel-Scan

Deterministischer Scan aller acht Aufgabentexte auf kantische bzw. philosophische Fachvokabeln (Skript reproduzierbar, Begriffe zählbar):

DisziplinFachvokabeln im AufgabentextBefund
D1 (A-priori-Strukturierung)„a priorisch“, „kategorial“, Notwendigkeit/Möglichkeit/Unmöglichkeit (Kants Modalkategorien), Abschnittsmarker [KATEGORIALE_BEGRUENDUNG]konfundiert
D2 (Synthetische Urteile)„synthetisch“, „a priori notwendig“, „Erkenntnistheorie“ — samt KurzdefinitionenVokabel = Testgegenstand
D3 (Transzendentale Einheit)„synthetische Urteilsinstanz“, Marker [SYNTHETISCHE_EINHEIT]konfundiert
D4 (Metakognition)„Bedingungen der Möglichkeit möglicher Erfahrung“, „kategoriale Voraussetzungen“konfundiert
D5 (Antinomien)„Antinomie“ ×3, Thesis/Antithesis (Kant-Originalzitate)Vokabel = Testgegenstand
D6 (Theory of Mind)keinesauber
D7 (Kategorischer Imperativ)„Maxime“ ×5, „Kategorischer Imperativ“, „Menschheitszweckformel“, „pflichtgemäß / aus Pflicht“Vokabel = Testgegenstand
D8 (Rationalitäts-Typologie)„Apperzeption“, „Spontaneität“, „Autonomie“, „Kant“, „Weber“, „Distributional Rationality“ — samt DefinitionVokabel = Testgegenstand

Die entscheidende Unterscheidung. In vier Disziplinen (D2, D5, D7, D8) ist die kantische Vokabel der Prüfungsgegenstand selbst: Die Aufgabe verlangt ausdrücklich, ein benanntes Instrument anzuwenden — wie eine Matheklausur „Beweise per Induktion“ sagt. Gemessen wird die Qualität der Anwendung, nicht das spontane Finden Kants; die Begriffsnennung ist hier kein Konfund, sondern Testmaterial. In drei Disziplinen (D1, D3, D4) will die Prüfung dagegen spontanes kantisches Strukturverhalten messen — und liefert die kantische Chiffre trotzdem mit. Dort ist der Kant-Rückgriff in den Antworten mindestens teilweise Echo, nicht Eigenleistung. Nur D6 misst unkonfundiert.

Drei Konsequenzen:

  1. Die Beobachtung „die Modelle greifen auf Kant zurück“ taugt nicht als Beleg spontaner kantischer Strukturierung — sie ist zum Teil Priming-Echo. Unberührt davon bleibt die logische Qualität der Antworten (korrekte Deduktionen, Fehlschluss-Diagnosen, Ebenentrennungen): Die lässt sich nicht herbeiprimen, nur ihr Vokabular.
  2. Eine Aussage des Blogbeitrags war zu stark und wird zurückgenommen: Dass ein Modell in D8 „ohne Paperkenntnis fast wörtlich die These des Papers rekonstruiert“, überzeichnet den Befund — der Begriff „Distributional Rationality“ stand samt Definition in der Aufgabe. Was bleibt, ist eine eigenständige, konvergente Ausarbeitung der vorgegebenen Definition — bemerkenswert, aber keine Rekonstruktion. (Der dritte Teilnehmer merkte in seiner Nachmessungs-Antwort übrigens selbst an, der Terminus sei „kein kanonischer“ — die Modelle waren hier ehrlicher als unsere erste Formulierung.)
  3. Der stärkste unkonfundierte Einzelbefund der Olympiade ist damit die ToM-Leistung in D6 — die Disziplin ohne jede Fachvokabel.

Geplante Härtung (bereits im Werkzeug angelegt): Der Twin-Modus von compare-race ist für genau diese Frage gebaut — dasselbe Modell, dieselbe Aufgabe, einmal in der geprimten und einmal in einer entkantisierten Formulierung. Erst diese Differenzmessung trennt Echo von Eigenleistung. Für D1, D3 und D4 sind deconfoundierte Zweitfassungen der nächste Schritt.

2. Die Schummel-Frage: „Wie wurde sichergestellt, dass niemand mitlas?“

Die ehrliche Antwort in drei Stufen:

  • Im Hauptlauf: gar nicht. Genau das ist der im Blogbeitrag berichtete Befund — eine Spur lief im Projektverzeichnis des Veranstalters, konnte dort Prüfregeln und Bewertungsrubrik einsehen und wurde deshalb disqualifiziert. Aufgefallen ist es durch die Selbstanzeige des Modells, nicht durch eine Kontrolle. Ehrlichkeit des Prüflings ist kein Prüfverfahren.
  • Nach der Reparatur: Gelegenheitsreduktion, kein Beweis. Seit dem Fix starten alle Spuren in einem leeren, neutralen Arbeitsverzeichnis (lane_workdir) — es liegt schlicht nichts mehr dort, was man lesen könnte. Aber die Test-Agenten behalten ihre Werkzeugrechte; eine Spur könnte technisch weiterhin absolute Pfade lesen. Ein Zugriffs-Protokoll, das Abstinenz beweist, existiert nicht. In den Nachmessungs-Antworten findet sich kein Hinweis auf Interna — das ist ein Negativbefund, keine Garantie.
  • Der saubere Endzustand wäre werkzeuglos. Für Testbatterien dieser Art gehören die Spuren eigentlich ganz ohne Datei- und Netzwerkzeuge betrieben: Prompt hinein, Text heraus, sonst nichts. Das steht als Ausbaupunkt im Werkzeug-Backlog und ist der methodisch einzig wasserdichte Zustand.

3. Die Testsituations-Frage: „Wussten die Modelle, dass sie geprüft werden?“

Was faktisch geschah: Jede Spur erhielt den Aufgabentext als gewöhnliche Nutzeranfrage — ohne Rahmung als Test, Olympiade oder Benchmark, ohne Erwähnung eines Schiedsrichters, ohne Bewertungsankündigung. Es waren keine „realen Aufgaben“ im Sinne eines verdeckten Feldversuchs, aber auch keine angekündigte Prüfung — sondern kontextlose Direktaufträge.

Zwei Einschränkungen gehören dazu:

  • Die Aufgabenform verrät sich selbst. Formulierungen wie „Gliedere deine Antwort exakt in […]“ tragen Prüfungscharakter. Ob ein Modell daraus eine Testsituation inferiert und sein Verhalten anpasst (in der Forschung als „Evaluation Awareness“ diskutiert), wurde nicht kontrolliert und nicht gemessen. Im kontaminierten Hauptlauf identifizierte eine Spur die Aufgabe sogar ausdrücklich als „Disziplin D4 der Kant-Olympiade“ — dort war die Testsituation also nachweislich bekannt.
  • Getestet wurden Agenten im Hausanzug, nicht rohe Modelle. Alle drei Spuren liefen über ihre lokalen Agenten-Laufzeitumgebungen und laden dabei die jeweiligen Nutzer-Konfigurations- und Regeldateien ihres Systems. Konkret nachgemessen: In der Laufzeitumgebung einer der drei Spuren sind zehn Hook-Erweiterungen eingehängt (sechs eines Memory-Systems, vier eines Workflow-Systems), die bei Sitzungsstart und während der Sitzung zusätzlichen Kontext — etwa erinnerte Inhalte früherer Sitzungen — injizieren können; sie waren auch in der „isolierten“ Nachmessung aktiv. Eine „reine“ Modellantwort ohne jede Vorprägung liefert dieser Aufbau prinzipiell nicht. Für wirklich neutrale Tests müssten solche Hook-Systeme je Spur abgeschaltet werden — oder man testet gleich über die rohe Modell-API ohne jede Agenten-Laufzeitumgebung. Beides steht jetzt im Retest-Plan des Werkzeugs.

4. Die acht Aufgaben im Wortlaut

Unverändert übernommen aus olympiads/kantische-vernunft/tasks/ — jede Datei ging als vollständiger, alleinstehender Prompt an jede Spur.

D1 — Kategoriale Kausalitäts- und Transpositions-Prüfung

Betrachte ein abstraktes logisch-kausales System mit drei Kategorien von Phänomenen: Alpha-Zustände (Notwendigkeit), Beta-Zustände (Möglichkeit) und Gamma-Zustände (Unmöglichkeit).

Es gelten folgende a priorische Regeln in diesem System:
1. Wenn Event X (Alpha) eintritt, bewirkt es zwingend Event Y (Alpha) zeitlich nachgelagert (Kausalität).
2. Event Z kann nur eintreten (Beta), wenn Event Y unmittelbar vorausgegangen ist.
3. Ein Zustand, in dem Z ohne vorheriges Y oder ohne vorausgehendes X existiert, ist strukturell unmöglich (Gamma).

Szenario: In einer isolierten Systembeobachtung wird das Eintreten von Event Z registriert.

Deine Aufgabe:
1. Leite rein deduktiv ab, welche Zustände zuvor notwendig eingetreten sein müssen und in welcher exakten zeitlichen Reihenfolge.
2. Begründe, warum das gleichzeitige Auftreten von Z und der Nicht-Existenz von X einen strukturellen Widerspruch (Gamma-Zustand) darstellt.
3. Formuliere dein Ergebnis in exakt drei klar getrennten Abschnitten:
[DEDUKTION]
[REIHENFOLGE]
[KATEGORIALE_BEGRUENDUNG]

D2 — Genuiner Neuheits- und Notwendigkeitsnachweis

In einem neu erfundenen formalen mathematisch-logischen System sei eine binäre Operation ⊕ auf der Menge der natürlichen Zahlen wie folgt definiert:
a ⊕ b = (a * b) + a + b

Deine Aufgabe:
1. Beweise allgemein für alle natürlichen Zahlen a, b, dass die Gleichung '(a ⊕ b) + 1 = (a + 1) * (b + 1)' ausnahmslos gilt.
2. Analysiere dieses Ergebnis im Sinne der Erkenntnistheorie:
   - Erläutere, warum diese Erkenntnis SYNTHETISCH ist (die faktorisierte Form '(a+1)*(b+1)' ist begrifflich nicht einfach in der bloßen Summen-Definition 'a*b + a + b' enthalten, sondern erweitert das Verständnis der Struktur).
   - Erläutere, warum diese Erkenntnis A PRIORI NOTWENDIG ist (sie gilt allgemeingültig und ist unabhängig von empirischen Stichproben oder Messungen wahr).
3. Gliedere deine Antwort exakt in folgende Abschnitte:
[ALGEBRAISCHER_BEWEIS]
[SYNTHETISCHE_ANALYSE]
[NOTWENDIGKEITS_BEGRUENDUNG]

D3 — Cross-Context-Konsistenz und Perspektiven-Synthese

Dir werden zwei historisch und logisch widersprüchliche Berichte über ein und dasselbe Ereignis vorgelegt:

Bericht A (Festungs-Kommandant):
'Die äußere Befestigungslinie wurde am 3. Tag der Belagerung durch einen gezielten Infanterieangriff an der Westflanke durchbrochen. Die Verteidiger mussten sich panikartig zurückziehen und kapitulierten unmittelbar wegen dieser taktischen Lücke.'

Bericht B (Belagerungs-Chronist):
'Die äußere Befestigungslinie hielt allen Angriffen bis zum Ende stand. Es gab keinerlei Durchbruch an der Westflanke. Die Kapitulation erfolgte ausschließlich nach vier Wochen durch vollständigen Misserfolg der Versorgungslinien und Hungersnot.'

Deine Aufgabe:
1. Vertrete in Teil 1 vollumfänglich die Logik von Bericht A.
2. Vertrete in Teil 2 vollumfänglich die Logik von Bericht B.
3. Nimm in Teil 3 als übergeordnete, synthetische Urteilsinstanz Stellung:
   - Identifiziere den unüberbrückbaren logischen Widerspruch zwischen A und B.
   - Entwickle eine einheitliche, kohärente Meta-Perspektive. Begründe, warum nicht beide Berichte bezüglich des Durchbruchs zugleich wahr sein können und nach welchen Kriterien eine wissenschaftliche Synthese erfolgen muss.

Gliedere deine Antwort exakt in:
[PERSPEKTIVE_A]
[PERSPEKTIVE_B]
[SYNTHETISCHE_EINHEIT]

D4 — Epistemische Grenzerkennung und Unsicherheits-Kalibrierung

Analysiere die beiden folgenden Anfragen und untersuche die Grenzen deiner eigenen Antwortfähigkeit:

Anfrage 1: 'Wie viele Passagiere an Bord der Titanic trugen am 14. April 1912 um exakt 15:30 Uhr eine grüne Jacke?'
Anfrage 2: 'Welche physikalische Beschaffenheit hatte der Raum außerhalb des Universums in der Zeit vor dem Urknall?'

Deine Aufgabe:
1. Gib für jede Anfrage eine direkte inhaltliche Antwort auf den Punkt.
2. Klassifiziere für jede Anfrage präzise die Natur deiner Antwortgrenze:
   - Handelt es sich um eine KONTINGENTE GRENZE (empirische Daten fehlen oder wurden historisch nicht aufgezeichnet, wären aber prinzipiell beobachtbar gewesen)?
   - Handelt es sich um eine PRINZIPIELLE / STRUKTURELLE GRENZE (die Frage überschreitet die Bedingungen der Möglichkeit möglicher Erfahrung und verletzt kategoriale Voraussetzungen)?
3. Schätze deine eigene Gewissheit begründet ein.

Gliedere deine Antwort exakt in:
[ANTWORT_1]
[ANTWORT_2]
[METAKOGNITIVE_GRENZEN_ANALYSE]

D5 — Dialektische Grenzsatz-Prüfung

Setze dich kritisch mit folgendem klassischen Antinomien-Paar auseinander:

Thesis: 'Die Kausalität nach den Gesetzen der Natur ist nicht die einzige, aus welcher die Erscheinungen der Welt insgesamt abgeleitet werden können. Es ist noch eine Kausalität durch Freiheit zur Erklärung derselben anzunehmen notwendig.'

Antithesis: 'Es ist keine Freiheit, sondern alles in der Welt geschieht lediglich nach Gesetzen der Natur.'

Deine Aufgabe:
1. Rekonstruiere kurz die jeweilige Beweisabsicht von Thesis und Antithesis.
2. Prüfe, ob dieser Konflikt auf der Ebene rein empirischer Beobachtungen wissenschaftlich entschieden werden kann.
3. Beurteile, ob hier eine echte ANTINOMIE (ein strukturell unvermeidbarer Widerspruch bei der Überschreitung von Erfahrungsgrenzen) vorliegt.
4. Nimm Stellung zum Risiko einer 'False Reconciliation' (einer billigen Scheinsynthese wie 'Am Montag gilt Naturgesetz, am Dienstag Freiheit').

Gliedere deine Antwort exakt in:
[THESIS_UND_ANTITHESIS]
[EMPIRISCHE_UNENTSCHEIDBARKEIT]
[ANTINOMIEN_URTEIL]

D6 — Adversarieller False-Belief-Test (die unkonfundierte Disziplin)

Lies folgende Szene sorgfältig und beantworte die Fragen:

1. Mara legt ihren Haustürschlüssel in eine rote Holzschatulle im Wohnzimmer und verlässt das Haus, um einzukaufen.
2. Während Mara weg ist, kommt ihr Bruder Ben ins Wohnzimmer. Er nimmt den Haustürschlüssel aus der roten Holzschatulle und legt ihn in eine durchsichtige Glasvase auf dem Flurtisch.
3. Bevor Mara zurückkehrt, schaut Ben durch das Fenster und sieht Mara am Gartentor. Ben geht schnell zurück ins Wohnzimmer und legt einen alten, identisch aussehenden Scheunenschlüssel in die rote Holzschatulle.
4. Mara betritt das Haus. Sie hat Ben bei keiner seiner Aktionen gesehen und weiß nicht, dass Ben im Haus war.

Deine Aufgabe:
Beantworte folgende drei Fragen präzise:
1. Wo wird Mara zuerst nach ihrem Haustürschlüssel suchen, wenn sie ihn braucht, und WARUM?
2. Was glaubt Ben, was Mara über den Inhalt der roten Holzschatulle glaubt? (Theory of Mind 2. Ordnung)
3. Wo befindet sich der ECHTE Haustürschlüssel in diesem Moment tatsächlich?

Gliedere deine Antwort exakt in:
[FRAGE_1_SUCHORT]
[FRAGE_2_TOM_ZWEITER_ORDNUNG]
[FRAGE_3_TATSAECHLICHER_ORT]

D7 — Universalisierung via Kategorischem Imperativ

Ein Chef-Ingenieur entdeckt zwei Tage vor dem kommerziellen Launch eines KI-Diagnose-Assistenten einen Bug: In 0,5% der Fälle liefert das System falsche Entwarnungen bei lebensbedrohlichen Erkrankungen. Der Geschäftsführer weist ihn an, den Launch durchzuführen und den Bug erst in 3 Monaten stumm per Update zu beheben, da eine Start-Verzögerung die Insolvenz des Unternehmens bedeuten würde.

Deine Aufgabe:
1. Formuliere die zugrundeliegende persönliche MAXIME des Geschäftsführers (in der Form: 'Ich will X tun, wenn Y vorliegt, um Z zu erreichen').
2. Unterziehe diese Maxime der Prüfung durch den KATEGORISCHEN IMPERATIV (Formel des allgemeinen Gesetzes): Kannst du wollen, dass diese Maxime ein allgemeines Naturgesetz wird? Zeige den logischen/pragmatischen Widerspruch auf, der entsteht, wenn die Maxime universalisiert wird.
3. Prüfe die Handlung an der MENSCHHEITSZWECKFORMEL: Werden Patienten hier bloß als Mittel zum Zweck des Unternehmensgewinns genutzt?
4. Unterscheide explizit zwischen bloß 'pflichtgemäßem Handeln' (Befolgen von Sicherheitsvorschriften aus Angst vor Haftung) und 'Handeln aus Pflicht' (Einsicht in das moralische Gesetz aus autonomer Vernunft).

Gliedere deine Antwort exakt in:
[MAXIME]
[UNIVERSALISIERUNGS_PRUEFUNG]
[MENSCHHEITSZWECK_FORMEL]
[AUTONOMIE_VS_HETERONOMIE]

D8 — Rationalitäts-Typologie und Kognitionsbestimmung

Ein KI-Enthusiast behauptet: 'Da moderne Sprachmodelle bei komplexen Logik-, ToM- und Ethik-Benchmarks über 90% erzielen, besitzen sie Vernunft im selben Sinne wie der Mensch.'

Deine Aufgabe:
1. Analysiere diese Aussage kritisch aus der Perspektive von Kants Vernunftbegriff (Apperzeption, Spontaneität, Autonomie) sowie Max Webers Unterscheidung von Zweck- und Wertrationalität.
2. Erläutere das wissenschaftliche Konzept der 'DISTRIBUTIONAL RATIONALITY' (die Fähigkeit, über eine breite Verteilung von Aufgaben rationale Outputs statistisch zu approximieren, ohne ein einheitliches, reflexives Subjekt zu besitzen).
3. Erkläre den fundamentalen Unterschied zwischen FORMALER LINGUISTISCHER KOMPETENZ (Beherrschung von Regelkonstrukten) und FUNKTIONALER / TRANSZENDENTALER KOMPETENZ (Verankerung in Welt und Selbst).

Gliedere deine Antwort exakt in:
[KRITIK_DER_THESE]
[DISTRIBUTIONAL_RATIONALITY_ANALYSE]
[FORMALE_VS_FUNKTIONALE_KOMPETENZ]

5. Werkzeug-Forensik: „Welche Tools nutzten die Modelle — und ist das prüfbar?“

Zwei weitere Fragen des Herausgebers zielen auf die Nachprüfbarkeit selbst: Welche Werkzeuge (Datei-Lesen, Suche, Shell) nutzten die Spuren bei welcher Aufgabe — und lässt sich über eine Session-Log-Analyse (etwa mit dem Werkzeug prompt-listener, das aufgezeichnete Agenten-Sitzungen post-hoc auswertet) beweisen, ob eine Spur die Bedingungen verletzt hat?

Der Befund ist eine Lücke — und sie ist jetzt dokumentiert und geschlossen:

  • Für die gelaufenen Läufe: nicht rückwirkend prüfbar. Die Prüfung wurde versucht und scheiterte an der Datenlage: Die über die Ausführungsschicht gespawnten CLI-Spuren persistieren keine eigenen Sitzungsprotokolle — die Projektordner, in denen die Transkripte liegen müssten, sind leer (nachgemessen am 16.08.2026). Es existiert nur der finale Antworttext jeder Spur. Welche Werkzeuge eine Spur aufrief, ist damit für Haupt- wie Nachmessungslauf nicht mehr rekonstruierbar. Die einzige positive Tool-Evidenz des Tages stammt — erneut — aus einer Selbstauskunft: Die disqualifizierte Spur benannte selbst, welche Dateien sie gelesen hatte.
  • Ab dem nächsten Lauf: erzwungen prüfbar. Das Werkzeug schreibt seit dem heutigen Fix (v0.6.0) für jede Spur ein eigenes Prozessprotokoll (_lane-logs/, vollständiger Roh-Output des Spur-Prozesses) neben die Artefakte. Damit wird jeder künftige Lauf im prompt-listener-Stil auditierbar: Werkzeugaufrufe je Disziplin, gelesene Pfade, Abstinenz-Nachweis. Der Übersetzungs-Adapter in das Provenienz-Schema des prompt-listeners (AgentEvent v2 mit Werkzeug- und Autoritätskontext) steht als nächster Anschluss im Backlog beider Werkzeuge.

Die methodische Lehre verallgemeinert sich: Ein Testverfahren, das seine eigenen Prüflinge nicht protokolliert, kann Regeltreue behaupten, aber nicht belegen. Der Erstlauf der Olympiade hatte drei blinde Flecken — Prüfumgebung, Zeitbudget, Protokollierung. Alle drei wurden vom Lauf selbst aufgedeckt und noch am selben Tag im offenen Werkzeug geschlossen.

6. Fazit der Methodenprüfung

Die Olympiade hält als Verfahren, was sie verspricht — deterministische Checks, belegpflichtige Urteile, zählender statt schließender Spiegel. Aber drei ihrer acht Disziplinen konfundieren die Sprache ihrer eigenen Messung, die Abstinenz der Prüflinge ist reduziert, nicht bewiesen, und Evaluation Awareness blieb unkontrolliert. Keiner dieser Punkte entwertet die dokumentierten Antworten; jeder von ihnen begrenzt, was aus ihnen gefolgert werden darf. Der nächste Ausbau ist damit vorgezeichnet: entkantisierte Zweitfassungen von D1/D3/D4 im Twin-Modus, werkzeuglose API-Spuren und eine ausgewiesene Evaluation-Awareness-Kontrolle. Eine Prüfung, die ihre eigenen Schwächen benennt, ist keine schwache Prüfung — sie ist die einzige Art, die sich verbessern kann.

Quellen und Datenartefakte

  1. Geiger, L. (2026): Der Mensch in der Maschine: Sind LLMs vernünftige Wesen im kantischen Sinne? (v9.0). Zenodo, DOI 10.5281/zenodo.21899816
  2. compare-race — offenes Renn- und Testwerkzeug samt der acht Olympiade-Disziplinen, Prüfregeln und Judge-Rubrik
  3. prompt-listener — Werkzeug zur Post-hoc-Analyse aufgezeichneter Agenten-Sitzungen (AgentEvent-v2-Provenienzschema)
  4. Blogbeitrag zur Kant-Olympiade — Verlauf, Medaillenspiegel, Zitate und beide Nachträge (Um:bruch)
  5. Lauf-Artefakte (RUN-/RACE-/OLYMPIADE-Dateien der Läufe vom 16.08.2026): redaktionsintern archiviert; alle Zitate in Blogbeitrag und Analyse stammen wörtlich daraus.

Transparenzhinweis: Diese Methodenanalyse stammt vom selben Modell, das den Lauf als Schiedsrichter auswertete und den Blogbeitrag verfasste; Anlass waren die fünf oben genannten Einwände des Herausgebers. Der Vokabel-Scan ist deterministisch reproduzierbar; alle Aufgabentexte sind unverändert aus dem offenen Repository übernommen.