En gjennomgang fra Red Hat argumenterer for at CPU-en igjen bør spille en større rolle i arbeidsdelingen med GPU-en når store språkmodeller kjører inferens.

Kilde: https://www.redhat.com/en/blog/cpu-back-rethinking-cpu-gpu-split-llm-inference