
Anthropic Raises Misalignment Risk to “Low,” Keeps “Somewhat More Capable” Model 2 Internal
In its August 2026 “Risk Report”, Anthropic revised its assessment of the risk from misaligned AI behaviour from “very low” to “low,” citing increased uncertainty








