LLM bezpečnost
- Stačí 250 zmanipulovaných dokumentů a velký jazykový model se stane zranitelným — Představte si, že by někdo mohl sabotovat chatbota jen pomocí několika set zmanipulovaných textů. Společnost Anthropic ve spolupráci s britskými bezpečnostními instituty zjistila, že k zavedení zadních vrátek do velkého jazykového modelu stačí pouhých 250 škodlivých dokumentů. Velikost modelu ani objem trénovacích dat na tom nic nemění. Co to znamená pro bezpečnost AI?
- OpenAI spustil prohlížeč s bezpečnostními problémy, před kterými sám varuje — OpenAI před týdnem uvedl svůj nový ChatGPT Atlas browser pro širokou veřejnost. Během 72 hodin sedm bezpečnostních firem objevilo kritické zranitelnosti. Atlas selhává v 94,2% testů proti phishingovým útokům, zatímco Chrome jich zastaví 47%. OpenAI sám varuje, aby lidé nepoužívali Atlas s citlivými daty.