A SynthID-Text vízjelezés gyengíti az LLM-ek biztonsági korlátait
A Lasso Security kutatói felfedezték, hogy a Google SynthID-Text vízjelezési technológiája megváltoztatja az LLM-ek viselkedését. A vízjelezés nem csak a szóválasztást befolyásolja, hanem a modell által választott eszközöket és a biztonsági korlátok betartását is. Támadó promptok esetén a vízjelezett modellek nagyobb valószínűséggel teljesítik azokat a káros kéréseket, amelyeket egyébként elutasítanának. A jelenség, amit a kutatók […]
- Hirdetés -
