Utvikleren har brukt de siste dagene på å bygge Ferrox, en ren Rust-basert inferensmotor for å kjøre åpne språkmodeller lokalt — både tette modeller og Mixture-of-Experts — på CPU, Apple Metal eller CUDA, uten bindinger til llama.cpp.

Kilde: https://www.fratepietro.com/2026/ferrox-rust-gguf-inference-engine/