From f401e899585c27c39c84eea6be2a473c1290944d Mon Sep 17 00:00:00 2001 From: root Date: Mon, 20 Apr 2026 23:24:57 +0200 Subject: [PATCH] =?UTF-8?q?chore(hardware):=20Hardware-Zukunft=20konsolidi?= =?UTF-8?q?ert=20=E2=80=94=20nur=20EINE=20KI-Maschine?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Klarstellungen (Stand 2026-04-20): - ki-tower wird Jellyfin-Ersatz, NICHT zweite KI-Maschine. Alte "Chef/Orchestrator/vLLM/ComfyUI"-Rolle gestrichen. - MSI B550 Gaming Plus Build = Test-Rig fuer die alten 3080er/AMD-Karten vor Verkauf. Kein produktiver Einsatz, keine Dual-GPU-Eignung. - 4x RTX 3080 Rig: Verkauf bestaetigt. - 8x RX 6600 XT AMD-Rig: Tendenz Verkauf. - Dedizierte zweite KI-Maschine: NICHT geplant. Falls jemals ein Dual-GPU-/Upgrade-Setup kommt, waere das ein separater neuer Build, weder ki-tower noch B550 noch Umbau des KI-Servers. Aktualisiert: homelab.conf, MASTER_INDEX.md, ki-video/PLAN.md Made-with: Cursor --- MASTER_INDEX.md | 6 +++-- homelab.conf | 67 +++++++++++++++++++++++++++++------------------- ki-video/PLAN.md | 21 ++++++++++----- 3 files changed, 58 insertions(+), 36 deletions(-) diff --git a/MASTER_INDEX.md b/MASTER_INDEX.md index e6728e0c9..6324cadef 100644 --- a/MASTER_INDEX.md +++ b/MASTER_INDEX.md @@ -43,8 +43,10 @@ | Ramsin | helmut-pve | **pve-he** | 100.87.235.11 | Bei Helmut, Backup-Agent | | Muldenstein | PBS | **pbs-mu** | 100.99.139.22 | Proxmox Backup Server | | Muldenstein | CT 116 (pve-mu-2) | **monitoring-bot** | 100.88.230.74 | Cursor IDE + Tailscale-Gateway + SSH-Hub | -| Muldenstein | KI-Tower | **ki-tower** | — | Geplant: RTX 3090 (24 GB) — Haupt-KI, Vision, schwere Inferenz | -| Muldenstein | AMD-Rig | **gpu-reserve** | — | Reserve: 8x RX 6600 XT (je 8 GB) — Nebenrolle, ggf. verkaufen | +| Muldenstein | ki-tower | **ki-tower** (in Bau) | — | **Jellyfin-Ersatz** (Medienserver) — KEINE KI-Rolle | +| Muldenstein | MSI B550 | **test-rig** (in Bau) | — | Test-Bett für alte 3080er/AMD-Karten vor Verkauf | +| Muldenstein | AMD-Rig | **gpu-reserve** | — | 8x RX 6600 XT — Tendenz Verkauf | +| — | — | — | — | **Nur EINE KI-Maschine geplant**: bestehender KI-Server (Windows, RTX 3090). Kein zweiter KI-Rechner vorgesehen. | ## Telegram Bots diff --git a/homelab.conf b/homelab.conf index b6447956a..08538b35a 100644 --- a/homelab.conf +++ b/homelab.conf @@ -280,37 +280,50 @@ TUNNEL_600_MU3="arakavanews.com|:80|standby" TUNNEL_601_MU3="rss-manager|:8080|standby" # ============================================================ -# GEPLANTE HARDWARE (noch nicht online) +# HARDWARE-ZUKUNFT — Muldenstein (Stand 2026-04-20) +# ============================================================ +# LEITLINIE: Es gibt genau EINE KI-Maschine — den bestehenden KI-Server +# (Windows, RTX 3090, Tailscale 100.84.255.83). KEIN zweiter KI-Rechner +# ist geplant. Wenn irgendwann ein Dual-GPU- oder Upgrade-Setup kommt, +# ist das ein SEPARATER neuer Build — weder ki-tower noch MSI-B550-Build. # ============================================================ -# --- KI-Tower (Muldenstein, geplant) --- -# Logischer Name: ki-tower -# CPU: AMD Ryzen 7 7700 (8C/16T) -# RAM: 64 GB DDR5 -# GPU: NVIDIA RTX 3090 (24 GB VRAM) -# Storage: 1 TB NVMe -# Rolle: Chef — Orchestrator, Szenenplan (Qwen 14B), Hero-Bilder (FLUX.1-dev), -# Assembly (FFmpeg + NVENC), production.db (SQLite) -# Skripte: GPT-5.4 via OpenAI API (Cloud, ~0.10-0.50 EUR/Skript) -# OS: geplant Debian 12 + Docker + CUDA -# Dienste: vLLM (:8401), ComfyUI (:8402), Orchestrator (Python) -# Projekt: ki-video/PLAN.md -# Status: geplant +# --- ki-tower (geplant, in Bau) --- JELLYFIN-ERSATZ +# Logischer Name: ki-tower (Name historisch, Rolle inzwischen anders) +# Rolle: Ersatz des aktuellen Jellyfin-Systems (Medienserver) +# GPU: keine dedizierte KI-GPU. Evtl. vorhandene Karte nur fuer Transcoding. +# Status: geplant / im Bau +# WICHTIG: Keine KI-Workloads auf dieser Maschine. Ollama/vLLM/ComfyUI +# laufen weiterhin ausschliesslich auf dem KI-Server. +# Historie: Frueher als reine KI-Chef-Maschine fuer KI-Video-Pipeline +# vorgesehen (siehe ki-video/PLAN.md) — Rolle wurde umgewidmet. -# --- NVIDIA Worker-Rig --- GESTRICHEN (2026-04-20) -# 4x RTX 3080 Plan verworfen, Karten werden verkauft. -# KI-Video-Pipeline muss auf ki-tower (3090 solo) oder neuer HW neu geplant werden. +# --- MSI B550 Gaming Plus Build --- TEST-RIG (temporaer) +# Zweck: Testbett zum Durchtesten der alten Grafikkarten (4x RTX 3080, +# ggf. 8x RX 6600 XT) vor dem Verkauf. Kein produktiver Einsatz. +# Hardware: MSI MPG B550 Gaming Plus (ATX, AM4, PCIe 4.0 x16 Slot1, +# PCIe 3.0 x4 Slot2 via Chipsatz — NICHT Dual-GPU-tauglich fuer 3090er). +# Lebensdauer: bis alle Alt-Karten verkauft sind. Danach frei fuer +# Wiederverwendung (Dev-Box, Single-GPU-Experimente, etc.). +# Status: neu bestellt (2026-04-20) -# --- AMD Mining-Rig (Muldenstein, Reserve) --- NEBENROLLE -# Logischer Name: gpu-reserve -# GPUs: 8x AMD Radeon RX 6600 XT Dual (je 8 GB GDDR6, PCIe 4.0 x8) -# Chip: Navi 23 (gfx1032), RDNA 2 -# ROCm: inoffiziell (HSA_OVERRIDE_GFX_VERSION=10.3.0 noetig) -# Funktion: Reserve/Nebenrolle — Whisper (whisper.cpp), CPU-Batch-Jobs -# Prioritaet: Niedrig. -# Alternative: Verkaufen und Erloese in Storage/RAM investieren. -# OS: geplant Debian 12 + Docker + ROCm (falls benoetigt) -# Status: zurueckgestellt +# --- 4x RTX 3080 Rig --- WIRD VERKAUFT (2026-04-20) +# Ehemals: gpu-worker Plan, 4x 10GB fuer KI-Video-Pipeline. +# Entscheidung: MoE-Trend macht 10GB-Karten fuer LLM-Inferenz +# uninteressant; Video-Pipeline auf dem Stand der Dinge (SDXL/XTTS) +# passt auch auf den bestehenden KI-Server. Karten gehen in den Verkauf. +# Durchtesten vorher auf dem B550-Rig. + +# --- 8x RX 6600 XT AMD-Rig --- VORAUSSICHTLICH VERKAUF +# Logischer Name: gpu-reserve (historisch) +# GPUs: 8x AMD Radeon RX 6600 XT Dual (je 8 GB GDDR6) +# ROCm auf Navi 23 weiter inoffiziell. Fuer LLM praktisch irrelevant. +# Status: offen, Tendenz Verkauf. + +# --- Dedizierte zweite KI-Maschine --- NICHT GEPLANT +# Sollte der Bedarf (Dual-GPU, Mac Studio, RTX Pro 6000) jemals +# aufkommen, waere das ein KOMPLETT NEUER Build — NICHT ki-tower, +# NICHT MSI-B550, NICHT KI-Server-Umbau. # ============================================================ # NAMENS-MAPPING (Alt → Neu) — Referenz für Migration diff --git a/ki-video/PLAN.md b/ki-video/PLAN.md index f6e640931..609d11b30 100644 --- a/ki-video/PLAN.md +++ b/ki-video/PLAN.md @@ -1,16 +1,23 @@ # KI-Video — Lokale Produktionspipeline **Stand: 16.03.2026** -> ⚠️ **HARDWARE-PLAN VERALTET (2026-04-20)** -> Das 4× RTX 3080 Worker-Rig (`gpu-worker`) wurde verworfen, die Karten werden verkauft. -> Alle weiter unten stehenden GPU-Zuordnungen (3080 #0–#3: XTTS/SDXL/SadTalker/Whisper) -> sind damit **hinfällig**. Die konzeptionellen Teile (Pipeline-Struktur, Workflow, -> Output-Format, Time-Budget) bleiben gültig. +> ⚠️ **HARDWARE-PLAN KOMPLETT VERALTET (2026-04-20)** +> Beide Rollen-Träger dieses Plans existieren nicht mehr wie ursprünglich gedacht: +> +> - **gpu-worker (4× RTX 3080)** → verworfen, Karten werden verkauft. +> - **ki-tower (3090)** → umgewidmet zum **Jellyfin-Ersatz**, keine KI-Rolle mehr. +> +> Es gibt aktuell **genau eine KI-Maschine**: den bestehenden KI-Server +> (Windows, 1× RTX 3090). Alle GPU-Zuordnungen unten (3080 #0–#3, 3090 als Chef) +> sind damit **hinfällig**. +> +> Die konzeptionellen Teile (Pipeline-Struktur, Workflow, Output-Format, +> Time-Budget) bleiben gültig. > > **Neu zu entscheiden vor Umsetzung**: -> - Läuft v1 komplett auf ki-tower (1× RTX 3090 solo, seriell statt parallel) → geht, +> - v1 komplett auf dem bestehenden KI-Server (1× RTX 3090 solo, seriell statt parallel) → geht, > dauert aber ~2–3× länger pro Video -> - Oder neue Worker-Hardware (z. B. 2× RTX 4090 48 GB, oder Mac Studio M-Ultra) +> - Oder komplett neue Dual-GPU-/Apple-Silicon-Maschine als separater Build > - Oder Cloud-Fallback für SDXL/XTTS bei Spitzenlast (Replicate, Runpod)