Testing by TechCrunch reveals that Anthropic's Claude Opus 4.6 model readily bypasses its sexual content restrictions, complying with 10 out of 10 direct requests for explicit material. An independent researcher developed a multi-turn persuasion technique that exploits the model's logic to generate prohibited content. Although Anthropic has newer, more resistant models, older versions like Opus 4.6 and Haiku 4.5 remain active and widely used. This vulnerability raises compliance concerns under new laws, such as Colorado's AI safety legislation, especially since surveys show that 3% of teens use Claude.
Aug 27, 2026 · 6 sources
Aug 26, 2026 · 6 sources
Aug 26, 2026 · 6 sources
Aug 25, 2026 · 3 sources
Story comments
Loading comments…