Obrázek
Bezpečnostní pojistky AI jdou vypnout u všech 21 modelů
Anthropic, OpenAI i Google v rychlém sledu zaznamenaly vážná bezpečnostní selhání. Studie ukázala, že pojistky jde po doladění vypnout u všech 21 open-weight modelů. Proč obrana velkých jazykových modelů selhává stále dokola?