GPU / Grafikkarte

KAPITEL 02 · HARDWARE

GPU / Grafikkarte

Die GPU (Graphics Processing Unit) ist weit mehr als nur eine Grafikkarte. Erfahren Sie alles über GPU-Architektur, VRAM, NVIDIA vs AMD, Raytracing, DLSS/FSR und den Einsatz in Gaming, KI und Rendering.

Architektur VRAM NVIDIA vs AMD Raytracing KI / Compute

Inhaltsverzeichnis

Schnellübersicht

  • Definition: Was ist eine GPU und wofür wird sie eingesetzt?
  • GPU vs CPU: Die grundlegenden Unterschiede
  • GPU-Komponenten: Cores, VRAM, Takt, TDP, Bus
  • Hersteller: NVIDIA, AMD, Intel im Vergleich
  • VRAM-Typen: GDDR6, GDDR6X, HBM
  • Technologien: Raytracing, DLSS, FSR, XeSS
  • Einsatzgebiete: Gaming, KI, Rendering, Video
  • Kaufberatung: Welches Segment für welchen Zweck?
  • FAQ: Häufige Fragen und Antworten

1. Was ist eine GPU?

Definition

Eine GPU (Graphics Processing Unit) ist ein spezialisierter Prozessor, der ursprünglich für die Berechnung von Grafiken und Bildern entwickelt wurde. Im Gegensatz zur CPU, die wenige Aufgaben nacheinander schnell ausführt, kann eine GPU tausende kleiner Berechnungen gleichzeitig (parallel) durchführen.

Heute wird die GPU weit über die Grafikdarstellung hinaus eingesetzt: Künstliche Intelligenz (Deep Learning), wissenschaftliche Simulationen, Videobearbeitung, 3D-Rendering und sogar Kryptowährungs-Mining. Die parallele Architektur macht sie für alle Aufgaben ideal, bei denen viele gleiche Berechnungen gleichzeitig ausgeführt werden müssen.

Wichtig: Man unterscheidet zwischen integrierten GPUs (iGPU, im Prozessor eingebaut) und dedizierten GPUs (dGPU, separate Grafikkarte mit eigenem VRAM). Für anspruchsvolle Aufgaben wie Gaming, KI oder 3D-Rendering ist eine dedizierte GPU unerlässlich.

2. GPU vs CPU – Der Unterschied

CPU und GPU ergänzen sich. Die CPU ist der "Generalist", die GPU der "Spezialist" für parallele Aufgaben.

CPU

  • 4–64 leistungsstarke Kerne
  • Sequentielle Verarbeitung (wenige Aufgaben schnell)
  • Hoher Takt (bis 6+ GHz)
  • Komplexe Verzweigungslogik
  • Großes Cache-System (L1/L2/L3)
  • Steuert das Betriebssystem
VS

GPU

  • Tausende einfache Kerne (CUDA/Stream)
  • Massive Parallelverarbeitung
  • Moderater Takt (1–3 GHz)
  • Optimiert für gleiche Berechnungen
  • Hohe Speicherbandbreite (VRAM)
  • Ideal für Matrix/Tensor-Operationen

Einfache Analogie

CPU: Ein Mathematik-Professor, der schwierige Aufgaben schnell einzeln löst.
GPU: Tausende Schüler, die einfache Rechenaufgaben gleichzeitig lösen.
Für ein komplexes Integral ist die CPU besser. Für 10.000 einfache Additionen ist die GPU unschlagbar.

3. GPU-Komponenten und Kenngrößen

Die wichtigsten technischen Eigenschaften einer Grafikkarte im Überblick:

Shader-Cores

CUDA Cores / Stream Processors

Die Recheneinheiten der GPU. Mehr Cores = höhere parallele Rechenleistung. NVIDIA nennt sie CUDA Cores, AMD nennt sie Stream Processors.

Beispiel: RTX 4090 = 16.384 CUDA Cores
RX 7900 XTX = 6.144 Stream Processors

VRAM

Video Random Access Memory

Eigener Grafikspeicher für Texturen, Framebuffer und KI-Modelle. Menge und Bandbreite sind entscheidend.

Typen: GDDR6, GDDR6X, GDDR7, HBM2e
Kapazität: 4 GB – 24 GB (Consumer)

GPU-Takt

Base Clock / Boost Clock

Die Taktfrequenz der GPU. Base Clock ist die Standardfrequenz, Boost Clock die maximale unter Last (abhängig von Temperatur und Strom).

Beispiel: Base 2.2 GHz / Boost 2.5 GHz
Overclocking möglich (MSI Afterburner)

TDP / TGP

Thermal Design Power

Maximale Verlustleistung in Watt. Bestimmt Kühlanforderung und Netzteil-Dimensionierung.

Entry: 75–150W | Mid: 200–250W
High-End: 300–450W (RTX 4090: 450W)

PCIe-Interface

PCI Express Slot

Verbindung zum Mainboard. PCIe 4.0 x16 oder PCIe 5.0 x16 für maximale Bandbreite.

PCIe 4.0 x16: ~32 GB/s
PCIe 5.0 x16: ~64 GB/s

Anschlüsse

Display-Ausgänge

Ausgänge für Monitore. Moderne GPUs bieten HDMI 2.1 und DisplayPort 2.0/2.1.

HDMI 2.1: 4K@120Hz, 8K@60Hz
DP 2.1: 4K@240Hz, 8K@60Hz (DSC)

4. GPU-Hersteller im Vergleich

Drei große Hersteller dominieren den GPU-Markt – jeder mit eigenen Stärken und Architekturen.

NVIDIA GeForce

Marktführer bei Gaming & KI
  • CUDA-Plattform (KI, Deep Learning)
  • DLSS (KI-Upscaling)
  • Raytracing-Hardware (RT Cores)
  • NVENC (Hardware-Videokodierung)
  • Reflex (Latenzreduzierung)
  • CUDA-Ökosystem (Standard für KI)
Aktuelle Modelle:
RTX 4060, 4070 Super, 4080 Super, 4090
Architektur: Ada Lovelace

AMD Radeon

Preis-Leistung & Open Source
  • FSR (Open-Source-Upscaling)
  • Raytracing (Ray Accelerators)
  • Mehr VRAM pro Preisklasse
  • Offene Treiber (Linux)
  • Smart Access Memory (SAM)
  • Gutes Preis-Leistungs-Verhältnis
Aktuelle Modelle:
RX 7600, 7700 XT, 7800 XT, 7900 XTX
Architektur: RDNA 3

Intel Arc

Der neue Herausforderer
  • XeSS (KI-Upscaling)
  • Hardware-Raytracing
  • AV1 Hardware-Encoding
  • Günstiger Einstieg
  • Quick Sync Video
  • Stetig wachsendes Treiber-Ökosystem
Aktuelle Modelle:
Arc A580, A750, A770
Architektur: Alchemist (Xe-HPG)

5. VRAM-Typen im Vergleich

Der VRAM (Video RAM) ist der Arbeitsspeicher der GPU. Typ, Menge und Bandbreite bestimmen, wie gut die Karte mit hohen Auflösungen und komplexen Texturen umgehen kann.

VRAM-Typ Bandbreite Energieeffizienz Einsatz
GDDR6 14–18 Gbps Gut Mid-Range GPUs (RTX 4060, RX 7600)
GDDR6X 19–24 Gbps Mittel High-End NVIDIA (RTX 4070 Ti, 4080)
GDDR7 28–36 Gbps Sehr gut Nächste Generation (RTX 50xx)
HBM2e ~2 TB/s Exzellent Enterprise/KI (NVIDIA H100, AMD MI300)
HBM3 ~3,3 TB/s Exzellent Top-KI-Beschleuniger (H200, MI300X)

Wie viel VRAM brauche ich?

  • 4–6 GB: 1080p Gaming (Einstieg), Office
  • 8 GB: 1080p–1440p Gaming, leichtes Video-Editing
  • 12 GB: 1440p Gaming, moderate KI-Workloads
  • 16 GB: 4K Gaming, anspruchsvolles 3D-Rendering
  • 24 GB: 4K Gaming + Raytracing, KI-Modelle, professionelles Rendering
  • 48–80 GB (HBM): Enterprise-KI (Large Language Models, Training)

6. Moderne GPU-Technologien

Raytracing

Physikalisch korrekte Lichtsimulation in Echtzeit. Berechnet Reflexionen, Schatten und Brechungen realistisch. Hardware-beschleunigt durch RT Cores (NVIDIA) bzw. Ray Accelerators (AMD).

DLSS (NVIDIA)

Deep Learning Super Sampling. KI-basiertes Upscaling: Rendert in niedriger Auflösung, skaliert per Tensor Cores hoch. DLSS 3.5 mit Frame Generation und Ray Reconstruction.

FSR (AMD)

FidelityFX Super Resolution. Open-Source-Upscaling, funktioniert auch auf NVIDIA- und Intel-GPUs. FSR 3 mit Frame Generation. Keine spezielle Hardware nötig.

Hardware-Encoding

NVENC (NVIDIA), AMF (AMD), Quick Sync (Intel). Dedizierte Hardware für Videokodierung (H.264, H.265, AV1) ohne CPU-Belastung. Wichtig für Streaming und Video-Editing.

7. Einsatzgebiete

GPUs werden heute in vielen Bereichen eingesetzt – weit über das Gaming hinaus.

Gaming

Der klassische Einsatzzweck. Hohe Framerate, Raytracing und Upscaling für flüssiges Gameplay in hohen Auflösungen.

RTX 4070 Super / RX 7800 XT

KI / Deep Learning

Training und Inference von KI-Modellen. NVIDIA CUDA ist der De-facto-Standard. Hoher VRAM (24 GB+) und Tensor Cores nötig.

RTX 4090 / A100 / H100

3D-Rendering

Blender, Maya, Cinema 4D, V-Ray. GPU-Rendering ist um ein Vielfaches schneller als CPU-Rendering.

RTX 4080 Super / RTX 4090

Video-Editing

Premiere Pro, DaVinci Resolve, Final Cut Pro. GPU-beschleunigte Effekte, Color Grading und Export.

RTX 4070 / RX 7800 XT

Crypto-Mining

Proof-of-Work-Berechnungen. Heute weniger relevant durch Umstieg auf Proof-of-Stake (Ethereum Merge).

RX 7900 XTX (Effizienz)

Wissenschaft & HPC

Molekulardynamik, Klimamodelle, Finanzsimulationen. GPGPU-Computing (CUDA, OpenCL, ROCm).

NVIDIA A100 / H100 / MI300X

8. Kaufberatung nach Segment

Welche GPU passt zu welchem Budget und Einsatzzweck?

Einstieg

~200–300 €
  • 1080p Gaming mit guten Einstellungen
  • Office und Multimedia
  • Leichtes Video-Editing
  • Beispiele: RTX 4060, RX 7600, Arc A750
  • VRAM: 8 GB
  • Netzteil: 450–550W

Mittelklasse

~400–600 €
  • 1440p Gaming mit hohen Einstellungen
  • Raytracing in 1080p
  • Video-Editing und 3D-Rendering
  • Beispiele: RTX 4070 Super, RX 7800 XT
  • VRAM: 12–16 GB
  • Netzteil: 650–750W

High-End

~800–1.200 €
  • 4K Gaming mit Raytracing
  • Professionelles 3D-Rendering
  • KI-Inference und Training
  • Beispiele: RTX 4080 Super, RX 7900 XTX
  • VRAM: 16–24 GB
  • Netzteil: 750–850W

Enthusiast / Enterprise

~1.800–4.000+ €
  • 4K Gaming bei maximalen Einstellungen
  • KI-Training (LLMs, Stable Diffusion)
  • Professionelles Rendering & Simulation
  • Beispiele: RTX 4090, RTX A6000, H100
  • VRAM: 24–80 GB
  • Netzteil: 850–1.000+W

9. FAQ – Häufige Fragen & Antworten

Häufige Fragen zu GPUs

Brauche ich eine dedizierte GPU oder reicht eine integrierte?

Integrierte GPU (iGPU) reicht für: Office, Web-Browsing, Video-Wiedergabe, leichte Bildbearbeitung, Casual Gaming (ältere Titel, niedrige Einstellungen).

Dedizierte GPU (dGPU) ist nötig für: Modernes Gaming (1080p+), 3D-Rendering, Video-Editing, KI/Deep Learning, CAD-Anwendungen.

Moderne iGPUs (z.B. AMD Radeon 780M, Intel Arc iGPU) sind überraschend leistungsfähig, können aber eine dedizierte GPU nicht ersetzen.

NVIDIA oder AMD – was ist besser?

Das hängt vom Einsatzzweck ab:

  • NVIDIA: Besser für KI/Deep Learning (CUDA), Raytracing, DLSS, Streaming (NVENC), professionelles Rendering
  • AMD: Besseres Preis-Leistungs-Verhältnis, mehr VRAM pro Preisklasse, offene Treiber (Linux), FSR funktioniert überall
  • Gaming: In der Mittelklasse oft AMD (Preis-Leistung), im High-End oft NVIDIA (Features)

Für KI-Entwicklung ist NVIDIA derzeit alternativlos (CUDA-Ökosystem). Für reines Gaming ist AMD in vielen Preisklassen die bessere Wahl.

Wie viel VRAM brauche ich für KI / Deep Learning?
  • Inference (Nutzung): 8–12 GB für kleine Modelle (z.B. Stable Diffusion, kleine LLMs)
  • Fine-Tuning: 16–24 GB für Anpassung bestehender Modelle
  • Training: 24–80+ GB für Training großer Modelle (LLMs)
  • Enterprise: NVIDIA H100 (80 GB HBM3) oder Multi-GPU-Setups

Für den Einstieg in KI: RTX 4090 (24 GB) ist die beste Consumer-Option. Für Produktion: NVIDIA A100/H100.

Was ist der Unterschied zwischen DLSS und FSR?

DLSS (NVIDIA): Nutzt Tensor Cores (KI-Hardware) für Upscaling. Bessere Bildqualität, aber nur auf NVIDIA-GPUs verfügbar. DLSS 3 bietet Frame Generation.

FSR (AMD): Open-Source, funktioniert auf allen GPUs (AMD, NVIDIA, Intel). FSR 3 bietet ebenfalls Frame Generation. Keine spezielle Hardware nötig, aber leicht geringere Bildqualität als DLSS.

Beide Technologien können die Framerate um 30–100% steigern, indem sie in niedrigerer Auflösung rendern und das Bild hochskalieren.

Welches Netzteil brauche ich für meine GPU?

Die GPU ist der größte Stromverbraucher im PC. Faustregel: GPU-TDP + CPU-TDP + 150W Reserve.

  • RTX 4060 (115W): 450–550W Netzteil
  • RTX 4070 Super (220W): 650W Netzteil
  • RTX 4080 Super (320W): 750–850W Netzteil
  • RTX 4090 (450W): 850–1000W Netzteil

Wichtig: 80 Plus Gold oder besser. Modulares Netzteil für sauberes Kabelmanagement. Marken: Corsair, be quiet!, Seasonic, EVGA.

Was bedeutet "Raytracing" und lohnt es sich?

Raytracing simuliert das Verhalten von Licht physikalisch korrekt: Reflexionen auf Wasser und Glas, realistische Schatten, globale Beleuchtung. Das Ergebnis sieht deutlich realistischer aus als traditionelles Rasterisieren.

Lohnt es sich? Ja, aber es kostet viel Performance. Daher immer in Kombination mit DLSS/FSR verwenden. In Spielen wie Cyberpunk 2077, Alan Wake 2 und Hogwarts Legacy ist Raytracing ein Game-Changer für die visuelle Qualität.

Worauf sollte ich beim GPU-Kauf achten?
  • Ziel-Auflösung: 1080p, 1440p oder 4K?
  • VRAM-Menge: 8 GB Minimum, 12 GB empfohlen
  • Netzteil: Ausreichend Watt und richtige Anschlüsse (12VHPWR bei NVIDIA 4000er)
  • Gehäusegröße: Passt die Karte physisch ins Gehäuse?
  • CPU-Bottleneck: CPU muss stark genug sein, um die GPU nicht auszubremsen
  • Monitor: Hohe Framerate nur mit hoher Refresh-Rate sinnvoll (144Hz+)
  • Preisleistung: Benchmarks vergleichen (TechPowerUp, Tom's Hardware)
Wie wichtig ist die Kühlung der GPU?

Sehr wichtig! Moderne GPUs drosseln ihre Leistung bei zu hohen Temperaturen (Thermal Throttling).

  • Ideal: 60–75°C unter Last
  • Akzeptabel: 75–85°C
  • Kritisch: > 85°C (Throttling beginnt)
  • Gefährlich: > 95°C (Sofortmaßnahme nötig)

Tipps: Gute Gehäuselüftung (Airflow), regelmäßige Reinigung (Staub), Wärmeleitpaste erneuern (alle 2–3 Jahre), Lüfterkurve anpassen.

Zusammenfassung

Die wichtigsten Punkte

  • GPU: Spezialprozessor für parallele Berechnungen – Grafik, KI, Rendering
  • GPU vs CPU: CPU = wenige schnelle Kerne, GPU = tausende parallele Kerne
  • Shader-Cores: CUDA Cores (NVIDIA) / Stream Processors (AMD) – mehr = besser
  • VRAM: 8 GB Minimum, 12–16 GB empfohlen, 24 GB für KI
  • NVIDIA: Marktführer bei KI (CUDA), Raytracing, DLSS
  • AMD: Besseres Preis-Leistungs-Verhältnis, mehr VRAM, offene Treiber
  • Intel Arc: Neuer Herausforderer, günstiger Einstieg, wachsendes Ökosystem
  • Raytracing: Physikalisch korrekte Lichtsimulation – mit DLSS/FSR kombinieren
  • Kühlung: 60–75°C unter Last ideal, > 85°C vermeiden
  • Einsatzgebiete: Gaming, KI, 3D-Rendering, Video, Wissenschaft

Enterprise-Tipps

  • KI/ML: NVIDIA wegen CUDA-Ökosystem alternativlos
  • Multi-GPU: Für Training großer Modelle (NVLink, PCIe)
  • Virtualisierung: NVIDIA vGPU / AMD MxGPU für VDI
  • Monitoring: nvidia-smi, GPU-Z für Echtzeit-Überwachung
  • Treiber: Studio-Treiber (NVIDIA) für professionelle Anwendungen

Weiterführende Themen

Prozessoren (CPU)

CPU-Architekturen, Intel vs AMD, Sockel und Chipsätze im Detail.

Zu Prozessoren
Speichereinheiten

HDD, SSD, NVMe, RAM – Speichertechnologien im Detail.

Zu Speichereinheiten
Hardware-Komponenten

Alle PC-Komponenten im Überblick – CPU, GPU, Mainboard, Netzteil.

Zu Hardware-Komponenten
Netzteile

Netzteil-Dimensionierung, 80 Plus, modulare Netzteile und Anschlüsse.

Zu Netzteilen