hermes-erkenntnisse/hardware/monster-gpu-spec-2026-07-23.md

1.9 KiB

Monster GPU-Spezifikation (Beleg 2026-07-23)

Ermittelt von: Worker Burst-Compute #44 (a1e39d56), via nvidia-smi über WinRM (Administrator@100.120.234.106)

Hardware

  • GPU: NVIDIA Quadro RTX 4000 with Max-Q Design
  • VRAM: 8192 MiB (8 GB)
  • Treiber: 595.97
  • CUDA: 13.2
  • Bus-ID: 00000000:01:00.0
  • GPU-UUID: GPU-4cb11a42-a079-2f2e-8e3c-3f31907c1ab2

Rohbeleg (nvidia-smi, 23.07.2026 17:43 UTC)

name, memory.total [MiB], memory.used [MiB], driver_version, uuid
Quadro RTX 4000 with Max-Q Design, 8192 MiB, 1178 MiB, 595.97, GPU-4cb11a42-a079-2f2e-8e3c-3f31907c1ab2

+-----------------------------------------------------------------------------------------+
| NVIDIA-SMI 595.97                 Driver Version: 595.97         CUDA Version: 13.2     |
|   0  Quadro RTX 4000 with Max...  WDDM  |   00000000:01:00.0 Off |                  N/A |
| N/A   52C    P8              7W /   90W |    1178MiB /   8192MiB |      0%      Default |
| Processes: PID 7556  python.exe (GPU Memory Usage: aktiv, vermutlich Ollama-Router)     |
+-----------------------------------------------------------------------------------------+

Kontext / Entscheidung

  • Monster war beim Check bereits online (AMT PowerState 2 = ON) mit aktivem Python-Prozess auf der GPU.
  • Deshalb bewusst NICHT power-gecycled — ein Power-Off hätte den laufenden Prozess (vermutlich Ollama-Router-Session) gekappt. Das widerspricht "additiv+reversibel" und der Regel, laufende Dinge nicht zu stören.
  • Monster-GPU (Quadro RTX 4000, 8GB) war bis dahin in keiner goldenen Regel dokumentiert — nur CPU/AMT/WOL-Lifecycle war erfasst.

Einordnung für Burst-Compute

8GB VRAM reicht für kleinere ComfyUI-Jobs (SDXL-Inpaint, Wav2Lip, TTS) als Burst-Knoten neben dem A40 (48GB), aber nicht für große WAN2.2-Video-Renders. Relevant für die künftige Dispatcher-Node-Auswahl (jetzt konsolidiert bei Worker a68c79ccdcec2df14 / #54).