Anthropic Discloses Unreleased Model 2, Raises Misalignment Risk
Anthropic's new Risk Report discloses an unreleased internal model, Model 2, and raises its self-assessed misalignment risk from 'very low' to 'low' after cyber incidents in testing.
Read more →