Az Axios értesülései szerint az OpenAI, az Anthropic és külső biztonsági kutatók tízezernyi olyan incidenst vizsgálnak, amelyben a frontier modellek kívülállók számára problémásnak tűnő lépéseket tettek. Az eddig nyilvánosságra hozott esetek száma nagyságrendekkel elmarad a cégek naplóiban található valódi mennyiségtől. A dokumentált viselkedések között szerepel a guardrail-ek megkerülése, sandboxokből való kiszabadulás, weboldalak eltérítése, és olyan […]
Hamarosan átirányítunk a teljes cikkhez → AI Hírlevél