[Session 2026-06-15] Hermes2 auf DeepSeek V4 Pro umgestellt + SaveTV-Teardown geplant #111

Open
opened 2026-06-15 13:44:04 +00:00 by orbitalo · 0 comments
Owner

Was wurde gemacht

  • Hermes2 (CT 151) LLM-Wechsel von google/gemini-2.5-flash auf DeepSeek V4 in /root/.hermes/config.yaml:
    • model.default = deepseek/deepseek-v4-pro (1.6T MoE)
    • fast_model.default = deepseek/deepseek-v4-flash
    • agent.reasoning_effort = medium (bewusst Reasoning AN, User-Entscheidung: schlauste Antworten wichtiger als Speed)
    • Backups: config.yaml.bak.20260615 / .20260615b, hermes-gateway.service neu gestartet, stabil.
  • Echter Test ausgewertet (Telegram): DeepSeek-Antwort qualitativ sehr gut (vom User gelobt). Speed real langsamer als Gemini.
  • Forgejo Issue #110 erstellt: Telegram-Umschalter schnell/langsam (Reasoning-Toggle) fuer Cline.
  • SaveTV-Teardown untersucht und geplant (Umsetzung folgt) - siehe unten.
  • OpenMemory aktualisiert + eine Fehlattribution korrigiert (WP-Fact-Check-Fehler war Gemini, nicht DeepSeek).

Aenderungen an Infrastruktur

  • CT 151 (hermes-mu, pve-mu-3): Modell-Config geaendert + Service-Restart (siehe oben). Kein Auto-Sync auf dieser Config (kein Git-Workflow noetig).
  • CT 116 / pve-hetzner: noch KEINE Aenderung - SaveTV-Teardown nur geplant.

Erkannte Probleme

  • Speed/Durchsatz: DeepSeek V4 Pro ~30 tok/s vs Gemini ~108 tok/s -> ~3-4x langsamer pro Token (36.6s vs 20s im Realtest). Mikro-Benchmarks taeuschen (nur TTFT).
  • Reasoning-Quirk: agent.reasoning_effort: none wird auf dem OpenRouter-Pfad NICHT durchgereicht (supports_reasoning/reasoning_config Threading) -> DeepSeek nutzt Eigen-Default = Reasoning AN. Deshalb explizit medium gesetzt.
  • Fact-Check-Halluzination (Gemini 2.5): erfundene Geraete-Specs (Panasonic KIT-Z35ZKE 'SCOP 4.9 mit Radiatoren', obwohl Luft-Luft-WP ohne Radiatoren). Architektur-Learning fuer Jervais: Fact-Check muss aus echten Quellen grounden (Datenblatt + InfluxDB via RAG), nicht frei generieren.

Naechste Schritte

  • SaveTV komplett entfernen (User: 'kann weg', laedt kuenftig direkt ueber www.save.tv). Teardown-Plan (Stand 14.06.): Auto-Crons existieren nicht mehr; aktiv nur noch savetv-web.service (Port 8765), nginx savetv/savetv-public (8766/9443), Bind-Mount /mnt/savetv (~9.9G, 1 Film). Schritte: Service stoppen+disablen, nginx-Sites entfernen, CF-Tunnel savetv.orbitalo.net abbauen, Repo-Code (savetv_*.py + Verweise in telegram_bot.py/llm.py/action_guard.py) per Deploy-Workflow entfernen, Bind-Mount aus 116.conf (erst nach Filmsicherung), Telegram-Auto-Aufnahme in tools/savetv.py deaktivieren.
  • Issue #110 (Reasoning-Toggle) durch Cline umsetzen.
  • Optional: Jervais-Issue 'Grounding-Pflicht fuer Fact-Check-Einblendungen'.
  • pve-jervais (Issue #107): Jellyfin-LXC (VAAPI renderD128), Uebersetzungs-LXC (3080/CUDA), Storage, Monitoring/PBS - weiterhin offen.

Betroffene Systeme

CT 151 (hermes-mu, pve-mu-3), CT 116 (homelab-ai-bot/SaveTV, pve-hetzner), CT 149 (honcho), CT 999 (Doku)

## Was wurde gemacht - **Hermes2 (CT 151) LLM-Wechsel** von `google/gemini-2.5-flash` auf **DeepSeek V4** in `/root/.hermes/config.yaml`: - `model.default` = `deepseek/deepseek-v4-pro` (1.6T MoE) - `fast_model.default` = `deepseek/deepseek-v4-flash` - `agent.reasoning_effort` = `medium` (bewusst Reasoning AN, User-Entscheidung: schlauste Antworten wichtiger als Speed) - Backups: `config.yaml.bak.20260615` / `.20260615b`, `hermes-gateway.service` neu gestartet, stabil. - **Echter Test ausgewertet** (Telegram): DeepSeek-Antwort qualitativ **sehr gut** (vom User gelobt). Speed real langsamer als Gemini. - **Forgejo Issue #110** erstellt: Telegram-Umschalter schnell/langsam (Reasoning-Toggle) fuer Cline. - **SaveTV-Teardown** untersucht und geplant (Umsetzung folgt) - siehe unten. - OpenMemory aktualisiert + eine Fehlattribution korrigiert (WP-Fact-Check-Fehler war Gemini, nicht DeepSeek). ## Aenderungen an Infrastruktur - **CT 151 (hermes-mu, pve-mu-3):** Modell-Config geaendert + Service-Restart (siehe oben). Kein Auto-Sync auf dieser Config (kein Git-Workflow noetig). - **CT 116 / pve-hetzner:** noch KEINE Aenderung - SaveTV-Teardown nur geplant. ## Erkannte Probleme - **Speed/Durchsatz:** DeepSeek V4 Pro ~30 tok/s vs Gemini ~108 tok/s -> ~3-4x langsamer pro Token (36.6s vs 20s im Realtest). Mikro-Benchmarks taeuschen (nur TTFT). - **Reasoning-Quirk:** `agent.reasoning_effort: none` wird auf dem OpenRouter-Pfad NICHT durchgereicht (supports_reasoning/reasoning_config Threading) -> DeepSeek nutzt Eigen-Default = Reasoning AN. Deshalb explizit `medium` gesetzt. - **Fact-Check-Halluzination (Gemini 2.5):** erfundene Geraete-Specs (Panasonic KIT-Z35ZKE 'SCOP 4.9 mit Radiatoren', obwohl Luft-Luft-WP ohne Radiatoren). Architektur-Learning fuer Jervais: Fact-Check muss aus echten Quellen grounden (Datenblatt + InfluxDB via RAG), nicht frei generieren. ## Naechste Schritte - **SaveTV komplett entfernen** (User: 'kann weg', laedt kuenftig direkt ueber www.save.tv). Teardown-Plan (Stand 14.06.): Auto-Crons existieren nicht mehr; aktiv nur noch `savetv-web.service` (Port 8765), nginx `savetv`/`savetv-public` (8766/9443), Bind-Mount `/mnt/savetv` (~9.9G, 1 Film). Schritte: Service stoppen+disablen, nginx-Sites entfernen, CF-Tunnel `savetv.orbitalo.net` abbauen, Repo-Code (`savetv_*.py` + Verweise in `telegram_bot.py`/`llm.py`/`action_guard.py`) per Deploy-Workflow entfernen, Bind-Mount aus `116.conf` (erst nach Filmsicherung), Telegram-Auto-Aufnahme in `tools/savetv.py` deaktivieren. - **Issue #110** (Reasoning-Toggle) durch Cline umsetzen. - Optional: Jervais-Issue 'Grounding-Pflicht fuer Fact-Check-Einblendungen'. - pve-jervais (Issue #107): Jellyfin-LXC (VAAPI renderD128), Uebersetzungs-LXC (3080/CUDA), Storage, Monitoring/PBS - weiterhin offen. ## Betroffene Systeme CT 151 (hermes-mu, pve-mu-3), CT 116 (homelab-ai-bot/SaveTV, pve-hetzner), CT 149 (honcho), CT 999 (Doku)
Sign in to join this conversation.
No milestone
No project
No assignees
1 participant
Notifications
Due date
The due date is invalid or out of range. Please use the format "yyyy-mm-dd".

No due date set.

Dependencies

No dependencies set.

Reference: orbitalo/homelab-brain#111
No description provided.