Bake-off M3: qwen3.8 vs qwen3.6 gemessen; Topologie korrigiert (Remote-GPU-Maschine)
Zwischenstand Bake-off (Antwortmodus, 35 Goldset-Fragen): qwen3.8:27b 100% Zitier-Praezision / 94,3% Verweigerung korrekt / 32s; qwen3.6:27B 94,3% / 85,7% / 43s (10 Regenerierungen) - klar schwächer. Topologie korrigiert: 100.103.83.12:11435 ist die Remote-GPU-Maschine (Tailscale, R9700), NICHT dieselbe wie die Dev-Maschine (deren localhost: 11434 ist ein eigener, fast leerer Ollama; URL-Nicht-auf-11434-Korrigieren in Skill/README/Config präzisiert). bge-m3 auf der GPU-Maschine gepullt. gemma4:26b-Lauf brach ab: auf der GPU-Maschine sterben seit dem Crash alle llama-server-Loads (API 500 'exit status 1'), auch bge-m3. Neustart dort noetig: sudo systemctl restart ollama. Danach mistral-small3.1:24b und gemma4:12B ausstehen.
This commit is contained in:
+4
-3
@@ -37,9 +37,10 @@ class Config:
|
||||
kb_dir: str = "wissensbasis"
|
||||
db_path: str = "data/index.db"
|
||||
|
||||
# Ollama — Ziel-Instanz ist Port 11435 (Custom-Port, mit Modell-Zoo).
|
||||
# Auf demselben Host läuft auch eine Instanz auf 11434 (fast leer) —
|
||||
# NICHT auf 11434 "korrigieren", s. Skill.
|
||||
# Ollama — Ziel-Instanz ist die Remote-GPU-Maschine im Tailscale-Netz
|
||||
# (Entwicklungsumgebung, Radeon AI Pro R9700). Nicht auf localhost bzw.
|
||||
# Port 11434 "korrigieren" — 11434 ist ggf. ein lokaler Ollama auf der
|
||||
# Dev-Maschine, nicht die Ziel-Instanz.
|
||||
ollama_url: str = "http://100.103.83.12:11435"
|
||||
embed_model: str = "bge-m3"
|
||||
answer_model: str = "qwen3.8:27b" # provisorisch bis Bake-off (M3)
|
||||
|
||||
Reference in New Issue
Block a user