d156da205d
Alle 5 Kandidaten auf dem Goldset (35 Fragen, Antwortmodus) gemessen. Protokoll Zitier-Praezision > Verweigerungskorrektheit > Latenz: qwen3.8:27b 100% / 94,3% / 80,6% 32s -> Sieger, fixiert gemma4:26b 100% / 91,4% / 67,7% 7,9s -> Latenz-Kandidat (4x schneller) gemma4:12B 94,3% / 91,4% / 77,4% 21s qwen3.6:27B 94,3% / 85,7% / 80,6% 43s mistral-small3.1:24b 100% / 71,4% / 58,1% 20s mistral-Deutsch-Hypothese praktisch widerlegt (71,4% Verweigerungs- korrektheit). q-008/q-031 verweigern beide Finalisten -> Prompt-/ Retrieval-Tuning, nicht modellspezifisch. Tabelle in planung.md 13, README und MEMORY aktualisiert.