2.1 KiB
2.1 KiB
Wan2.2 CPU+GPU-Beweislauf (lokal, A40) — Nachtplan #6
Datum: 2026-07-22 ~21:32 CEST · Host: VM302 (A40, Kansas City) · Engine: lokal, keine Cloud
Ziel
Nachweisen, dass die Video-Generierung (Wan2.2 I2V) tatsaechlich lokal auf der A40 laeuft und dabei CPU und GPU gleichzeitig ausgelastet werden — nicht Cloud, nicht nur CPU, nicht nur GPU.
Aufbau
- Orchestrator VM302:8197 (
main_v3_portal.py), EndpointPOST /generate - Request:
{"prompt":"Christina Fischer ... Ganzkoerper","typ":"video","video_dauer_sekunden":3,"seed":424242} - Job
df788e2dac, Plan: 4x text2img (realisticVision) -> 1 Wan2.2-I2V-Segment, 49 Frames @ 16fps - Modell: Wan2.2-I2V-A14B High+LowNoise Q5_K_M GGUF (je 10 GB) aus
M:\ComfyUI\models\unet, VAEwan_2.1_vae(MoE-2-Experten) - Sampler: alle 2s parallel
nvidia-smi(util+mem) UNDWin32_Processor.LoadPercentage-> CSV (als SYSTEM-Scheduled-Task, session-fest)
Ergebnis (Beleg)
71 Messpunkte ueber 180s. Peak: GPU 100% / VRAM 31234 MiB / CPU 100% — beide gleichzeitig unter Volllast.
Kurvenverlauf (dreiphasig, typisch fuer die Kette):
- text2img (4 Bilder): GPU-Spikes bis 33%, CPU 87-100% (VAE-Decode CPU-lastig)
- Wan-Modell-Load: VRAM steigt 10,7 -> 24 -> 31 GB (beide GGUF-Experten resident), CPU 73-93%
- Wan2.2-Sampling: GPU-Peaks 100% (21:28:28, 21:31:01-42 mehrfach), CPU durchgehend 78-97%
CPU faellt ueber den gesamten Lauf nie unter ~66%, meist 80-97%; GPU erreicht wiederholt 100% bei 31 GB residentem Modell. -> CPU+GPU nachweislich parallel, Lauf vollstaendig lokal auf der A40.
Rohdaten: wan22-beweis.csv (dieses Verzeichnis).
Reproduktion
POST http://127.0.0.1:8197/generate (VM302)
Body: {"prompt":"...","typ":"video","video_dauer_sekunden":3,"seed":424242}
Sampler: M:\wan22-sampler.ps1 (nvidia-smi + Win32_Processor alle 2s -> CSV)
Hinweise
- Erster detached Sampler (
Start-Process) wurde beim WinRM-Session-Ende gekillt (nur 1 Zeile) -> Lehre: Langlaeufer als Scheduled Task (SYSTEM), nicht als WinRM-Kindprozess. - Kein Reboot durchgefuehrt (Nachtplan-Regel).