En ny forskningsartikkel viser at KI-modellers forklaringer av egen tankegang («chain-of-thought») ikke alltid gjenspeiler hvordan de faktisk kommer frem til svarene sine. Funnene reiser spørsmål om hvor pålitelige slike forklaringer er for å forstå modelladferd.