GPU-Architekturen, Datenparallelität, Speicherübertragung und Compute-Kernel beschleunigen geeignete Aufgaben. Messungen zeigen, wann Parallelisierung den Overhead tatsächlich überwiegt.