- Repo umbenannt weberanalyse -> sokrates-qs (QS/Bericht-Eval-Lab) - Weber-Bericht + Toolcalls nach weber/ verschoben (pro-Bericht-Struktur) - weber/abweichungs-analyse.md: Faktentreue-Befunde (CDU-Fehler, Datum, Zitat-Integrität; Typ+Konfidenz) + Kernbefund Retrieval-Monotonie (6x identische Query) + A/B alt vs. production0726 (1 vs. 5 eindeutige Queries) - weber/korrekturen/: Ablage für Modell-Korrekturen (kimi/claude/grok) - README als Lab-README (Struktur + Methode) Co-Authored-By: Claude Fable 5 <noreply@anthropic.com> |
||
|---|---|---|
| .. | ||
| README.md | ||
Modell-Korrekturen — Weber-Bericht
Hier liegen die Korrektur-/Faktencheck-Fassungen des Berichts durch mehrere
unabhängige Modelle. Lokal bei Peter unter E:\sokrates\output\sokrates-qs\weber
(Windows) — von der GB10 aus nicht erreichbar, daher von dort pushen.
Erwartete Dateien (Namen anpassen nach Bedarf):
claude-fable.md— Korrektur durch Claude Fablekimi-k3.md— Korrektur durch Kimi K3grok-4.5.md— Korrektur durch Grok 4.5
Auswertungs-Idee
Wo alle drei dieselbe Korrektur machen → hohe Konfidenz, echter Fehler
(Kandidat für ../abweichungs-analyse.md + späteren Regressionsfall). Wo sie
sich uneinig sind → strittiger/ambiger Fakt, NICHT „schärfen". Korrektoren
sind selbst LLMs — Konsens ist starker Verdacht, aber die Absicherung bei einer
realen Person bleiben Primärquellen.