hermes-erkenntnisse/DIAGNOSE-VM302-RDP-2026-07-19.md

45 lines
2.8 KiB
Markdown
Raw Permalink Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

# Diagnose VM302 RDP-Trägheit + Tailscale-IP-Klärung — 2026-07-19
## Kontext
Bär meldet RDP-Session zu VM302 (WIN11-Work) ist träge, auch Claude-Eingaben verzögert.
Untersuchung ergab: (1) falsche Annahme über Tailscale-IP, (2) UDP-Transport für RDP war deaktiviert, (3) direkte Verbindung DE→USA statt Tailscale, (4) Modell-Konfusion zwischen gpu1-Host und VM302.
## Tailscale-Identitäten geklärt
| Node | Tailscale-IP | Status | Rolle |
|------|------------|--------|-------|
| **rdp-go-ki-eu** (VM302, wo Claude läuft) | **100.104.5.57** | Online | WIN11-Work VM, A40 GPU durchgereicht |
| gpu-pc | 100.82.179.51 | **Offline seit 3 Tagen** | Separate Windows-Maschine, nicht relevant |
| Hub (jump) | 100.87.20.94 | Aktiv, direct 103.241.51.192:41641 | Zentraler Router |
| gpu1 (Proxmox-Host) | 100.108.247.79 | Online | Proxmox mit A40 GPU (vfio-pci → VM302) |
`tailscale ip` auf VM302 gibt eindeutig `100.104.5.57` zurück. Vorherige Memory-Notizen mit `100.82.179.51 = gpu-pc` als "hier" waren FALSCH.
## RDP-Trägheit — Root Causes
### 1. UDP-Transport war deaktiviert (FIX ANGEWENDET)
`HKLM:\SYSTEM\CurrentControlSet\Control\Terminal Server\WinStations\RDP-Tcp\SelectTransport` stand auf `2` (nur TCP).
Fix: auf `0` gesetzt (UDP+TCP). Policy-Ebene ebenfalls `0`. Firewall UDP 3389 ist offen.
**Wirkung nach nächstem RDP-Reconnect**: FEC + kein Head-of-Line Blocking → spürbar flüssigere Eingabe.
### 2. Verbindungsweg umgeht Tailscale
Bär verbindet sich von öffentlicher IP `9.246.41.123` direkt auf die Public-IP der VM302 (via ColoCrossing Buffalo NY, ~100ms Latenz DE→USA). Tailscale-DERP wird NICHT genutzt weil Bär kein Tailscale auf seinem Endgerät hat.
**Fix**: RDP-Datei auf Tailscale-IP `100.104.5.57` gestellt (setzt Tailscale-Client voraus).
### 3. Duplicate-Prozesse gekillt
- LiteLLM: PID 8440 (duplikat) beendet, 8476 behalten
- Windows-MCP: PID 6132 (duplikat) beendet, 16300 behalten
## RDP Wrapper — FUNKTIONIERT
`query session` zeigt zwei parallele aktive Sessions: mcp (ID 2) + matthias (ID 3). Kein Handlungsbedarf.
## gpu1 Modelle — GPU ist an VM302 durchgereicht
- A40 auf gpu1 (PCI 82:00.0) ist via `vfio-pci` an VM 302 gebunden
- gpu1-Host hat KEIN nvidia-smi, kann selbst keine Modelle laden
- Modelle in `/srv/models/gguf/` auf gpu1-Host (2× Wan2.2-I2V, je 11GB) sind vom Host-OS aus nutzlos
- **Korrekter Ort**: Modelle müssen auf VM302 unter `M:\` liegen (ComfyUI, Ollama, ACE-Step sind dort bereits eingerichtet, 614 GB frei)
## VM302 GPU-Status
NVIDIA A40, 46 GB VRAM, Treiber 596.36, 0 MB genutzt → einsatzbereit.
## Nachtplan-Eintrag
**Netcup-USA-Server als RDP-Gateway** wenn KASM dort installiert wird — gleiche Lokation wie gpu1 (ColoCrossing), minimiert letzte Meile für Bär's Verbindung. Bär → Netcup-USA → lokales Netz → VM302.