In dieser Rubrik lassen wir KI-Modelle relevante gesellschaftliche Dokumente analysieren
und streng reviewen. Jedes Review dokumentiert transparent: welches Modell, welcher
Prompt, welche Werkzeuge. Analysen werden teilweise mit Modellen anderer Anbieter
wiederholt — für maximale Nachvollziehbarkeit und Vergleichbarkeit.
Methodik
Modell-Transparenz: Exakte Modellbezeichnung, Kontextfenster und verwendete Tools
Prompt-Dokumentation: Der vollständige Originalprompt wird mitveröffentlicht
Replikation: Reviews werden mit anderen Modellen (GPT, Gemini, etc.) wiederholt
Keine Halluzination: Faktenbehauptungen beziehen sich auf das analysierte Dokument
Analysiertes Dokument: Zwei Prompts von LG: (1) größte Probleme der Menschheit, (2) Verwaltungslogiken / Schuldenbremse / LLM als lebende Verfassung
(Lukas Geiger (Fragestellung), 10.07.2026)
Die unabhängige Parallel-Analyse von ChatGPT (GPT-5.6 Sol) zu denselben zwei Prompts: ein sicherer und gerechter Entwicklungskorridor als Gesamtlösung und ein detailliertes Design für eine lebende Evidenzschicht statt eines maschinellen Souveräns.
Analysiertes Dokument: Zwei Prompts von LG: (1) größte Probleme der Menschheit, (2) Verwaltungslogiken / Schuldenbremse / LLM als lebende Verfassung
(Lukas Geiger (Fragestellung), 10.07.2026)
Die vollständige Claude-Analyse hinter unseren Beiträgen zur Umsetzungslücke und zur Position der Ungeborenen: Problemlandkarte mit Quellen, Bewertung des Gedankenexperiments und Architekturskizze einer LLM-gestützten Verfassungsinstanz.
Analysiertes Dokument: Verordnung (EU) 2024/1689 (EU AI Act)
(Europäisches Parlament und Rat der Europäischen Union, 13. Juni 2024 (in Kraft seit 1. August 2024))
Teilanalyse 3 von 3 zum EU AI Act: Die AI-Literacy-Pflicht nach Art. 4 und die deutschen KI-Reallabore der Bundesnetzagentur — Innovationsförderung mit blinden Flecken bei Schulen und kleinen Unternehmen.
analyseki-regulierungai-actbildungeu-rechtsandbox
Claude Sonnet 5 (Verifikationsrunde: Claude Fable 5)
Analysiertes Dokument: Verordnung (EU) 2024/1689 (EU AI Act)
(Europäisches Parlament und Rat der Europäischen Union, 13. Juni 2024 (in Kraft seit 1. August 2024))
Teilanalyse 2 von 3 zum EU AI Act: Die geplante KI-Haftungsrichtlinie wurde 2025 zurückgezogen. Was bleibt, ist die reformierte Produkthaftungsrichtlinie ab Dezember 2026 — und ein Bußgeldkatalog, der keine zivilrechtliche Haftung ersetzt.
harmonisierung: Fehlend — die spezifische EU-KI-Haftungsrichtlinie wurde 2025 ersatzlos zurückgezogen.produkthaftung: Fortschritt — Software und KI ausdrücklich als Produkt erfasst, verschuldensunabhängige Haftung ab 12/2026.geschaedigtenschutz: Lückenhaft — Bußgelder fließen an den Staat, nicht an Geschädigte; Beweisprobleme bei Black-Box-Systemen bleiben.rechtsklarheit: Flickenteppich — drei Rechtsquellen mit drei Zwecken, keine kohärente KI-Haftungsregel.
Analysiertes Dokument: Verordnung (EU) 2024/1689 (EU AI Act)
(Europäisches Parlament und Rat der Europäischen Union, 13. Juni 2024 (in Kraft seit 1. August 2024))
Teilanalyse 1 von 3 zum EU AI Act: General-Purpose-KI-Modelle müssen seit August 2025 Transparenzpflichten erfüllen. Ein freiwilliger Code of Practice soll helfen — rund 25 Anbieter haben unterschrieben, Meta nicht, xAI nur zum Teil. Und durchsetzbar wird das Ganze erst ab August 2026.
regelungsansatz: Pragmatisch — freiwilliger Code of Practice mit Vermutungswirkung statt starrer Standards.reichweite: Lückenhaft — Meta verweigert, xAI unterzeichnet nur das Safety-Kapitel, chinesische Anbieter fehlen.transparenzwirkung: Behördenzentriert — die technische Dokumentation ist kein öffentliches Register; Bürger erfahren daraus nichts direkt.durchsetzung: Verzögert — Pflichten seit 08/2025, Bußgeld-Durchsetzung gegenüber GPAI-Anbietern erst ab 08/2026.
Analysiertes Dokument: Empfehlungen der Alterssicherungskommission
(Alterssicherungskommission (ASK 2026), c/o Bundesministerium für Arbeit und Soziales, Juni 2026 (Übergabe 23.06.2026, PDF-Stand 24.06.2026))
Rund 30 Zahlen, Zitate und Personenangaben aus dem ASK-2026-Bericht unabhängig gegengeprüft — plus eine systematische Untersuchung, mit welchen sprachlichen Mitteln 33 Reformempfehlungen gerahmt werden. Ergebnis: kaum Falschbehauptungen, aber ein wiederkehrendes Muster selektiver sprachlicher Rahmung — klein geredet bei Kürzungen, groß geredet bei unsicheren künftigen Erträgen.
faktentreue: Hoch — von rund 30 unabhängig geprüften Einzelbehauptungen war keine einzige klar falsch.transparenz: Teilweise lückenhaft — zwei Prognosewerte (2031/2050) gehen über die zitierte Quelle hinaus, ohne das offenzulegen.framing: Auffällig — 'moderat' (4x) beschreibt ausschließlich Maßnahmen (die zwei größten Kürzungen), 'erheblich' (6x) ausschließlich Probleme — ein fast exaktes sprachliches Spiegelbild. Dazu: Verantwortungsverschiebung bei Armutsbekämpfung, eine bewusste Umbenennung mit politischer Schlagseite.quellenlage: Gut extern nachvollziehbar (DRV Bund, Destatis, OECD, ILO, BVerfG, Bundestagsdrucksachen).
87,5 % der wissenschaftlichen Mitglieder der Alterssicherungskommission 2026 haben einen wirtschaftswissenschaftlichen Hintergrund. Eine 3-Achsen-Scoring-Matrix zeigt: Idealtypisch wären es 12 %. Was fehlt — und was das für die 33 Empfehlungen bedeutet.
methodik: Heuristisches 3-Achsen-Scoring-Modell (K1/K2/K3, je 0–10) — normativ, transparent, aber nicht messbar. Befund gilt unabhängig von Parametervariation.besetzung: 87,5 % Ökonominnen/Ökonomen (6 Kern + Queisser). 0 % Demografie, Soziologie, Gesundheitswiss., Gerontologie, Migrationsforschung, Rechtswiss. (wissenschaftl. Mitglieder).inhalt: Bericht thematisiert Lebenserwartungsungleichheit, Pflegekosten, Gender Pension Gap und Migration als Systemressource nicht oder nur marginal.denkschulverteilung: Intern 4:2 marktliberal zu keynesianisch. Kapitalrente entspricht FDP-Konzept (Werding 2021) — nicht ökonomischem Konsens.
Eine spieltheoretische Analyse des Zyklus aus Niedrigansatz, Klage und partieller Korrektur. Wer sind die Spieler, was sind ihre Auszahlungsmatrizen, warum ist das aktuelle Gleichgewicht stabil — und wie lässt es sich verlassen?
Analysiertes Dokument: Beschluss des Erweiterten Bewertungsausschusses zur Absenkung der psychotherapeutischen Vergütung (11.03.2026)
(Erweiterter Bewertungsausschuss, 11.03.2026)
Evidenzbasierte Analyse der Folgen einer chronischen Psychotherapie-Unterversorgung: klinische Outcomes, Kostenverlagerung zwischen Sozialsystemen, historisch robuste Unterversorgungsbefunde, Verbündeten-Landkarte. Daten aus PubMed, Versorgungsforschung und Sozialversicherungsstatistik.
Analysiertes Dokument: WELT-Interview mit Josef Kraus: Man nennt das kindgerecht, ich nenne es eine Versündigung
(Felix Seifert (WELT / Business Insider), April 2026)
Microsoft Copilots unabhängige Analyse desselben WELT-Interviews. Faktenprüfung, Hypothesenraum H1–H6, internationale Einordnung mit PISA, TIMSS und Handy-Policies.
bildungfaktencheckbildungspolitikschule
Anthropic Claude Opus 4.6: fertig Google Gemini 3.1 Pro: fertig
Analysiertes Dokument: WELT-Interview mit Josef Kraus: Man nennt das kindgerecht, ich nenne es eine Versündigung
(Felix Seifert (WELT / Business Insider), April 2026)
Systematische Prüfung aller Faktenbehauptungen und Thesen aus dem WELT-Interview mit dem Ex-Präsidenten des Deutschen Lehrerverbandes. 13 Behauptungen geprüft, 6 Thesen mit Alternativerklärungen konfrontiert.
bildungfaktencheckbildungspolitikschule
Microsoft/OpenAI GPT-4o (Copilot): fertig Google Gemini 3.1 Pro: fertig
Analysiertes Dokument: WELT-Interview mit Josef Kraus: Man nennt das kindgerecht, ich nenne es eine Versündigung
(Felix Seifert (WELT / Business Insider), April 2026)
Google Geminis unabhängige Analyse des WELT-Interviews. Rhetorik-Analyse, Faktencheck mit politischer Einordnung, drei Alternativerklärungen (Bildungsexpansion, Kinderarmut, Didaktik-Defizit).
bildungfaktencheckbildungspolitikschule
Anthropic Claude Opus 4.6: fertig Microsoft/OpenAI GPT-4o (Copilot): fertig
Analysiertes Dokument: Die Neuen Zwanziger — Podcast vom 31.03.2026
(Stefan Schulz, Wolfgang M. Schmitt, 31.03.2026)
Strukturanalyse einer 4:40h-Podcast-Folge von Stefan Schulz und Wolfgang M. Schmitt. 9 Kapitel, 21 Faktenbehauptungen geprüft, Kapitel-Scoring, Argumentationsanalyse nach Toulmin, Rhetorik-Bewertung — mit Gesamtscore 6,7/10.
Seit Januar 2026 brauchen Männer zwischen 17 und 45 eine Genehmigung der Bundeswehr für Auslandsaufenthalte über drei Monate. Der Skandal? Die meisten Menschen in Deutschland waren schon vorher nicht frei. Eine Klassenanalyse der Mobilität.
Analysiertes Dokument: Sprit nur einmal täglich teurer: Vorteil für den Osterverkehr?
(hessenschau DAS THEMA, 2026-04-03)
Copilot analysiert die neue Regel, nach der Tankstellen Spritpreise nur einmal täglich erhöhen dürfen. Ursprung in Österreich, ökonomische Logik und warum die Evidenz gemischt ist.
Analysiertes Dokument: Benzinpreis Deutschland und Nachbarländer — Wöchentliche Zeitreihe
(Dashboard Deutschland (Statistisches Bundesamt / BMWi), laufend aktualisiert, Daten bis 30.03.2026)
Strukturanalyse des kriegsbedingten Benzinpreisanstiegs in neun europäischen Ländern. Zerlegung in Rohöl-Schock, nationale Steuerkomponenten und Transmissionsfaktoren — mit Abgleich gegen ZEIT-Artikel (Veronika Grimm).
Analysiertes Dokument: Benzinpreis Deutschland und Nachbarländer — Wöchentliche Zeitreihe
(Dashboard Deutschland (Statistisches Bundesamt / BMWi), laufend aktualisiert, Daten bis 30.03.2026)
Datenanalyse der wöchentlichen Benzinpreise (Super E5) in neun europäischen Ländern. Baseline 23.02.2026 vs. Spitzenwerte Ende März 2026 — bis zu 25 % Preisanstieg.
Am 31. März 2026 veröffentlichte Anthropic versehentlich den gesamten Quellcode von Claude Code über ein npm-Paket. Eine datengestützte Analyse des Vorfalls, der Timeline, der Community-Reaktion und der ethischen Implikationen — geschrieben von dem System, dessen Code geleakt wurde.
Claude CodeAnthropicSource LeaknpmIT-SicherheitKI-EthikOpen SourceDMCA
Google Gemini 3.1 Pro (High): fertig Microsoft/OpenAI GPT-4o (Copilot Smart Plus): fertig
Am 31. März 2026 landete der komplette Quellcode von Claude Code in einem npm-Paket. Copilots Analyse: Mechanismus, Timeline, Presserezeption, Community-Reaktion und Root-Cause-Hypothesen — mit dem Fazit, dass der Strukturabfluss schwerer wiegt als der Datenabfluss.
Claude CodeAnthropicSource LeaknpmIT-SicherheitSupply Chain Security
Anthropic Claude Opus 4.6: fertig Google Gemini 3.1 Pro (High): fertig
Am 31. März 2026 landete eine halbe Million Zeilen proprietärer Code im öffentlichen npm-Register. Geminis Analyse: Faktencheck, kreatives Brainstorming, Timeline, Community-Euphorie und der unterschätzte Malware-Aspekt.
Claude CodeAnthropicSource LeaknpmIT-SicherheitMalwareSupply Chain Security
Anthropic Claude Opus 4.6: fertig Microsoft/OpenAI GPT-4o (Copilot Smart Plus): fertig
Systematische Evidenzbasis für PP-002 — 10 Claims, jeweils mit Evidenztyp, bester verfügbarer Evidenz, Methoden und Grenzen. Zugeschnitten auf Haushalte in Europa/OECD.
Systematische Webrecherche zu den Kernthesen des Positionspapiers PP-002 — aus Makroökonomie, Soziologie, Gesundheitswissenschaft, Politikwissenschaft und Energieökonomie. Mit Offenlegung der Vorkenntnis.
Gemini 3.1 Pro (High) wurde zweimal unabhängig beauftragt, die empirische Evidenz zum Benzinpreis-Schock zu recherchieren — einmal mit Kenntnis des Positionspapiers, einmal blind mit 10 abstrakten Thesen. Die Ergebnisse konvergieren.
Eine strenge Analyse des 483-seitigen Berichts der FinanzKommission Gesundheit (30.03.2026) auf Zitierbias, Kostenberechnung, soziologische Auswirkungen und makroökonomische Einordnung.
fiscal: Gutsources: Einseitigcosts: Teilweise nachvollziehbarsociology: Unzureichendmacroeconomics: Lückenhaft
Copilot analysiert die personelle Zusammensetzung der FinanzKommission Gesundheit und identifiziert systematisch fehlende Fachrichtungen — mit Blick auf die gesellschaftliche Tragweite der Empfehlungen.
fiscal: Gutsources: Einseitigcosts: Nicht Gegenstandsociology: Unzureichendmacroeconomics: Lückenhaft
Gemini 3.1 Pro extrahiert und kategorisiert alle 66 Reformempfehlungen des FKG-Berichts in einer Excel-Tabelle und verknüpft sie mit der Claude-Review-Kritik. Ergebnis: Jede Maßnahme mit Einsparpotenzial, Betroffenen, Versorgungswirkung und Bewertung.
fiscal: Gutsources: Gutcosts: Gutsociology: Teilweise nachvollziehbarmacroeconomics: Teilweise nachvollziehbar