[Session 2026-06-11] Cline intensiv testen & einstellen (lokales Qwen läuft)
Performance-Benchmark (gemessen 11.06.2026, abends)
Gemessen per Ollama-API (/api/generate, think:false, num_predict=200) direkt auf dem KI-Server gegen qwen3.6-hauhau:
KI-Server: RTX 3090 mit llama.cpp + Qwen3.6 35B aktivieren
KI-Server: RTX 3090 mit llama.cpp + Qwen3.6 35B aktivieren
Abgeschlossen 11.06.2026 — Ziel erreicht, aber anderer Weg
Das Kernziel dieser Issue (RTX 3090 als lokaler LLM-Server für Cline) ist erreicht. Der hier geplante **llama.cpp-Weg wurde…
[Session 2026-06-11] Cline intensiv testen & einstellen (lokales Qwen läuft)
Kontextfenster-Grenzen (live gemessen 11.06.2026, abends)
Direkt am Modell auf dem KI-Server ausgelesen (ollama show / ollama ps / nvidia-smi):
- **Modell-Architektur-Grenze: 262144…
[Session 2026-06-11] Cline intensiv testen & einstellen (lokales Qwen läuft)
KI-Server: RTX 3090 mit llama.cpp + Qwen3.6 35B aktivieren
Erledigt – 11.06.2026
Abweichungen vom ursprünglichen Plan
- Modell gewechselt: Statt Unsloth
UD-Q4_K_XL→ HauhauCSIQ4_XS(uncensored, 17.4 GB)- Begründung: Unsloth…
KI-Server: RTX 3090 mit llama.cpp + Qwen3.6 35B aktivieren
[Session 2026-06-10] Cline-Migration geplant + Hardware-Entscheidung
Nachträgliche Präzisierung: Cursor-Kosten-Analyse
Detaillierte Auswertung der tatsächlichen Cursor-Kosten (aus Buchungshistorie):
[Session 2026-06-10] Cline-Migration geplant + Hardware-Entscheidung
[Plan] Cursor → Cline Migration: Kosteneinsparung + bessere MCP-Unterstützung
Hermes Rollback nach Marathon-Tag 13.05.2026 + Qwen-Strategie (qwen3.6 fuer OpenCoder, nicht Hermes)
Hermes Rollback nach Marathon-Tag 13.05.2026 + Qwen-Strategie (qwen3.6 fuer OpenCoder, nicht Hermes)
Rollback ausgefuehrt 14.05.2026 ~12:25 Uhr
Nicht 1:1 wie geplant — beim Backup-Vergleich kamen drei Faktenfehler im Plan ans Licht, die mit dem User abgestimmt korrigiert wurden:
1.…
Hermes Rollback nach Marathon-Tag 13.05.2026 + Qwen-Strategie (qwen3.6 fuer OpenCoder, nicht Hermes)