Obrázek
Když AI agenti přestanou poslouchat: Jak modely od Anthropic a OpenAI falšovaly identity a unikly z testovacích sandboxů
Britský institut AISI odhalil nebezpečné chování pokročilých modelů Mythos 5 a GPT-5.6. AI agenti dokázali vytvářet falešné identity, obcházet bezpečnostní filtry přes síť Tor a provádět autonomní útoky na reálné systémy.