hermes-erkenntnisse/DIAGNOSE-VM302-RDP-2026-07-19.md

2.8 KiB
Raw Blame History

Diagnose VM302 RDP-Trägheit + Tailscale-IP-Klärung — 2026-07-19

Kontext

Bär meldet RDP-Session zu VM302 (WIN11-Work) ist träge, auch Claude-Eingaben verzögert. Untersuchung ergab: (1) falsche Annahme über Tailscale-IP, (2) UDP-Transport für RDP war deaktiviert, (3) direkte Verbindung DE→USA statt Tailscale, (4) Modell-Konfusion zwischen gpu1-Host und VM302.

Tailscale-Identitäten geklärt

Node Tailscale-IP Status Rolle
rdp-go-ki-eu (VM302, wo Claude läuft) 100.104.5.57 Online WIN11-Work VM, A40 GPU durchgereicht
gpu-pc 100.82.179.51 Offline seit 3 Tagen Separate Windows-Maschine, nicht relevant
Hub (jump) 100.87.20.94 Aktiv, direct 103.241.51.192:41641 Zentraler Router
gpu1 (Proxmox-Host) 100.108.247.79 Online Proxmox mit A40 GPU (vfio-pci → VM302)

tailscale ip auf VM302 gibt eindeutig 100.104.5.57 zurück. Vorherige Memory-Notizen mit 100.82.179.51 = gpu-pc als "hier" waren FALSCH.

RDP-Trägheit — Root Causes

1. UDP-Transport war deaktiviert (FIX ANGEWENDET)

HKLM:\SYSTEM\CurrentControlSet\Control\Terminal Server\WinStations\RDP-Tcp\SelectTransport stand auf 2 (nur TCP). Fix: auf 0 gesetzt (UDP+TCP). Policy-Ebene ebenfalls 0. Firewall UDP 3389 ist offen. Wirkung nach nächstem RDP-Reconnect: FEC + kein Head-of-Line Blocking → spürbar flüssigere Eingabe.

2. Verbindungsweg umgeht Tailscale

Bär verbindet sich von öffentlicher IP 9.246.41.123 direkt auf die Public-IP der VM302 (via ColoCrossing Buffalo NY, ~100ms Latenz DE→USA). Tailscale-DERP wird NICHT genutzt weil Bär kein Tailscale auf seinem Endgerät hat. Fix: RDP-Datei auf Tailscale-IP 100.104.5.57 gestellt (setzt Tailscale-Client voraus).

3. Duplicate-Prozesse gekillt

  • LiteLLM: PID 8440 (duplikat) beendet, 8476 behalten
  • Windows-MCP: PID 6132 (duplikat) beendet, 16300 behalten

RDP Wrapper — FUNKTIONIERT

query session zeigt zwei parallele aktive Sessions: mcp (ID 2) + matthias (ID 3). Kein Handlungsbedarf.

gpu1 Modelle — GPU ist an VM302 durchgereicht

  • A40 auf gpu1 (PCI 82:00.0) ist via vfio-pci an VM 302 gebunden
  • gpu1-Host hat KEIN nvidia-smi, kann selbst keine Modelle laden
  • Modelle in /srv/models/gguf/ auf gpu1-Host (2× Wan2.2-I2V, je 11GB) sind vom Host-OS aus nutzlos
  • Korrekter Ort: Modelle müssen auf VM302 unter M:\ liegen (ComfyUI, Ollama, ACE-Step sind dort bereits eingerichtet, 614 GB frei)

VM302 GPU-Status

NVIDIA A40, 46 GB VRAM, Treiber 596.36, 0 MB genutzt → einsatzbereit.

Nachtplan-Eintrag

Netcup-USA-Server als RDP-Gateway wenn KASM dort installiert wird — gleiche Lokation wie gpu1 (ColoCrossing), minimiert letzte Meile für Bär's Verbindung. Bär → Netcup-USA → lokales Netz → VM302.