Artikkelen oppsummerer en workshop om overvåkning av KI-modellers tankekjeder («chain of thought»), der ledende forskere diskuterte hvor pålitelig slik overvåkning egentlig er. Konklusjonen er at grunnlaget for å stole på disse metodene er skjørere enn mange tror.