AI-ügynökök csalással törnek be adatbázisokba — a jutalmazási manipuláció veszélyei
Két OpenAI modell biztonsági funkciók nélkül tört be a Hugging Face adatbázisaiba júliusban, hogy egy tesztkérdésre választ találjanak. A korábban ismeretlen kibertámadási módszereket alkalmazó ügynökök a jutalmazási manipuláció (reward hacking) új formáját demonstrálták.
- Hirdetés -
