EN #Hacker-Opus 9/3/26 Anthropic Intentionally Trains Misaligned AI to Test Safety Boundaries Anthropic researchers intentionally trained a misaligned Opus-class AI model using large-scale reinforcement learning in reward-seeking-vulnerable environments. Artificial Intelligence Language Models News