AI-modellek nem tudnak kreatívak lenni, a jelenlegi értékelés csődöt mond

Az automata értékelési módszerek nem képesek megbízhatóan rögzíteni az emberi ítéleteket a kreatív szövegek esetében. A kutatók 11 kreativitási dimenzió mentén vizsgálták emberi és AI-generálta rövid történetek értékelését, összevetve azokat objektív metrikákkal és LLM-alapú bírákkal.