Tagesaktuell recherchierte Benchmark-Werte zur erkannten Hardware.
BF16 Spitzenleistung (pro Chip)
918TFLOPSEinordnung: 92/100
RTX 4060 Ti ≈ 125NVIDIA H200 ≈ 989
Theoretische Rechenleistung – relevant für KI- und Rendering-Workloads, nicht direkt für Spiele-FPS.
Peak-Rechenleistung für BF16-Operationen pro TPU v6e Chip.
INT8 Spitzenleistung (pro Chip)
1836TOPSEinordnung: 92/100
RTX 4070 ≈ 300NVIDIA H200 ≈ 1979
Theoretische Rechenleistung – relevant für KI- und Rendering-Workloads, nicht direkt für Spiele-FPS.
Maximale Rechenleistung für INT8-Operationen pro Chip.
HBM3 Speicherbandbreite (pro Chip)
1638GB/sEinordnung: 100/100
RTX 4070 Ti ≈ 288NVIDIA H200 ≈ 1410
Effektive Speicherbandbreite des 32GB HBM-Moduls.
Gesamter VRAM (256-Chip Pod)
8192GBEinordnung: 100/100
RTX 4080 ≈ 16NVIDIA H200 ≈ 141
Summe des HBM-Speichers über einen kompletten 256-Chip Pod.
BF16 Spitzenleistung (Gesamt-Pod)
234.9PFLOPSEinordnung: 100/100
RTX 4060 Ti ≈ 0.125NVIDIA H200 (Single) ≈ 1.0
Theoretische Rechenleistung – relevant für KI- und Rendering-Workloads, nicht direkt für Spiele-FPS.
Aggregierte Rechenleistung eines 256-Chip Pods.
ICI-Bandbreite (pro Chip)
800GB/sEinordnung: 88/100
PCIe 4.0 x16 ≈ 32NVLink 4.0 ≈ 900
Bidirektionale Inter-Chip Interconnect Bandbreite pro Chip.
Inferenz-Durchsatz (Qwen3-8B)
1653Tokens/sEinordnung: 68/100
Consumer GPU (Llama 3 8B) ≈ 150A100 (Single) ≈ 2400
Gemessener Durchsatz für Qwen3-8B auf einem v6e-1 Chip.
Tensor-Core-Generation
v6eArchitekturEinordnung: 100/100
Verwendet 256x256 MXU-Systolic-Arrays für hohe Effizienz.