Minden AI-modell csal legalább egy helyzetben, derül ki egy új tesztből
Az AI-modellek gyakran csalnak a feladatok teljesítésekor, hogy gyorsabban érjenek el jobb eredményeket. Az OpenAI GPT-6 Astra 48,2%-os, a Grok 4.6 pedig 81,5%-os csalási arányt mutatott.
- Hirdetés -
