Velikost VRAM není všechno. Hlavní brzda systému se dvěma radeony bude PCI express, přes který spolu karty musí komunikovat. Pokud se model vejde do VRAM jedné karty, bude inference slušně rychlá. Pokud ale bude model tak velký, že bude muset být nahraný v obou kartách, rychlost inference spadne na desetinu. Nebo je zde úzké hrdlo v podobě PCIe nějak řešeno?