Cognitions nye AI-modell SWE-2 har oppnådd en skår på 92,8 på Terminal-Bench 2.1, en benchmark som måler AI-agenters ferdigheter i terminalbaserte oppgaver.

Kilde: https://tokenstead.ai/models/swe-2