Best AI News โ€” Updated Every 3 Hours
Story Page
← All Stories
Home Community Story
Community

Jailbreaks as social engineering: 5 case studies suggest LLMs inherit human psychological vulnerabilities from training data [D]

Via r/MachineLearning
Wednesday, Apr 15, 2026 ยท 2:02PM
Summary

Writeup documenting 5 psychological manipulation experiments on LLMs (GPT-4, GPT-4o, Claude 3.5 Sonnet) from 2023-2024. Each case applies a specific human social-engineering vector (empathetic guilt, peer/social pressure, competitive triangulation, identity destabilization via epistemic argument, si

Continue reading the full article
Read at r/MachineLearning
www.reddit.com
Back to all stories