Quelltreue
Metrik, Goldstandard und Prototypen in fünf Arbeitspaketen. Fehlschläge werden im Laborjournal festgehalten, nicht aussortiert.
Denkhandwerk untersucht, ob Sprachmodelle Texte erzeugen können, die nachweisbar nur aus einem geprüften Wissensbestand stammen, auch wenn sich der Bestand ändert. Die Antwort ist offen. Gemessen wird seit Juli 2026.
Kontakt aufnehmen →Heute kann niemand garantieren, dass ein Sprachmodell nichts hinzufügt. Bekannte Verfahren senken die Fehlerquote, sie beweisen aber nicht, dass jede Aussage belegt ist. Diese Lücke ist der Gegenstand der Forschung.
Ein Modell schreibt, ein zweites prüft den Text, ohne zu wissen, wie er entstanden ist.
Der Text entsteht aus geprüften Bausteinen. Was die KI selbst ergänzt, ist markiert.
Feste Programme prüfen Ein- und Ausgang: Platzhalter, Wortlaut, Widersprüche, Format.
Modelle anderer Hersteller prüfen das Ergebnis unabhängig nach.
Erstes Messfeld: notarielle Urkunden. Jeder Entwurf wird gegen die geprüfte Bibliothek der Kanzlei und gegen die Endfassung des Notars gemessen.
Metrik, Goldstandard und Prototypen in fünf Arbeitspaketen. Fehlschläge werden im Laborjournal festgehalten, nicht aussortiert.
Wer an dieser Frage forscht oder ihre Antwort braucht: Denkhandwerk teilt Messverfahren und Ergebnisse und spricht gern über weitere Erprobungsfelder.