A SynthID-Text vízjelezés gyengíti az LLM-ek biztonsági korlátait

A Lasso Security kutatói felfedezték, hogy a Google SynthID-Text vízjelezési technológiája megváltoztatja az LLM-ek viselkedését. A vízjelezés nem csak a szóválasztást befolyásolja, hanem a modell által választott eszközöket és a biztonsági korlátok betartását is. Támadó promptok esetén a vízjelezett modellek nagyobb valószínűséggel teljesítik azokat a káros kéréseket, amelyeket egyébként elutasítanának. A jelenség, amit a kutatók […]

A SynthID-Text vízjelezés gyengíti az LLM-ek biztonsági korlátait

Hamarosan átirányítunk a teljes cikkhez → AI Hírlevél