Forskare har upptäckt en grundläggande sårbarhet i stora språkmodeller (LLM) som gör dem sårbara för attacker. Sårbarheten beror på hur modellerna identifierar instruktioner och kan utnyttjas för att få modellerna att avslöja känslig information som de inte är avsedda att dela.

Detta är ett allvarligt problem eftersom det kan leda till att modellerna används för skadliga ändamål. Forskarna menar att det kan vara omöjligt att göra LLM helt säkra mot attacker på grund av denna sårbarhet.