Anthropic ka Sabse Powerful AI Jailbreak Ho Gaya — Har Security Researcher Ko Yeh Jaanna Chahiye
June 9, 2026 ko Anthropic ne Claude Fable 5 launch kiya. Yeh unka Mythos-class model ka pehla public version hai — abhi tak ka sabse capable AI. Isme software engineering, cyberattack simulation aur vulnerability research ki advanced skills hain. Aur launch ke kuch hi ghanton mein yeh compromise ho gaya. KYA HUA? "Pliny the Liberator" naam ke ek researcher ne Fable 5 ke safety classifiers bypass kar diye. Koi fancy zero-day nahi tha. Simple techniques the: - Multi-agent decomposition attacks - Unicode obfuscation tricks - Narrative framing techniques Result? Model ka poora 120,000 character ka system prompt leak ho gaya. Matlab Anthropic ka internal safety architecture public ho gaya. Aur yeh tab hua jab Anthropic ne claim kiya tha: - 1,000+ ghante ki bug bounty testing ki - External red-teaming mein "koi universal jailbreak nahi mila" Real world mein kuch ghante kaafi the. SIRF JAILBREAK NAHI — AUR BHI PROBLEMS 1. Silent Response Degradation Anthropic...