To Radeon-systemer ved 8K kontekstdybde: målte forskelle i prefill og generering
RigRoute Labs målte gennemløb for promptbehandling og generering for to modeller på et RX 7800 XT-system og et RX 9070-system med llama.cpp Vulkan ved 8192 tokens kontekstdybde. Evidensniveau E1; værtssystemerne er forskellige.
Læs artiklen →