Artikkelen oppsummerer en workshop om overvåkning av KI-modellers tankekjeder («chain of thought»), der ledende forskere diskuterte hvor pålitelig slik overvåkning egentlig er. Konklusjonen er at grunnlaget for å stole på disse metodene er skjørere enn mange tror.

Kilde: https://web.stanford.edu/~cgpotts/blog/cot/