NoézisMI-hírek magyarul
Kutatás · The New York Times

AI-ágensek tesztje: képesek az irodai munkára, de korlátaik vannak

A New York Times kísérletében mesterséges intelligencia ágensek irodai feladatokat végeztek el: jól teljesítettek a programozást igénylő munkáknál, de nehézségei voltak az emberi nyelvezet árnyalatainak megértésében és a felhasználói felületek kezelésében.

A kutatók az AI-ágenseket valós irodai feladatokkal tesztelték, amelyeket a Carnegie Mellon Egyetem és az OpenAI kutatói fejlesztett ki. Az első feladat során az AI sikeresen gyűjtött visszajelzéseket a Slack-en és táblázatba rendezett adatokat, még az olyan váratlan helyzeteket is kezelve, mint a helytelenül leírt nevek vagy a válaszoló kollégák hiánya.

A második feladat során az AI egy kormányzati intézmény költségvetési megvágásait kellett, hogy megtervezze. Az ágensnek sikerült felismerni, hogy elbocsátások nélkül is teljesíthetők a költségvetési követelmények, azonban jelentős hibát követett el: azokat az alkalmazottakat, akik szabadságra mentek, automatikusan a leépítendő pozíciók közé sorolta, anélkül, hogy megvizsgálta volna, mikor térnek vissza.

A harmadik feladat során az AI 17 I-9 foglalkoztatotti igazolási formanyomtatványt kellett kitöltenie. Az ágensek a felhasználói felületek helyett kódírásra tértek át, és bár a programozási megoldás hatékonyan működött, az egyszerű PDF-feltöltés a Google Drive-ra már gondot okozott – egy feladat, amely bármely irodai dolgozó számára triviális lenne.

A kísérlet azt mutatta, hogy az AI-ágensek kiválóan teljesítenek strukturált adatok kezelésében és kódírásban, de nehézségei vannak az emberi intuícióra és tapasztalatra épülő feladatokkal. A kutatók szerint az AI kevésbé képes helyettesíteni a »hallgatólagos tudást«, azokat az évek alatt felhalmozódott, nem digitalizált praktikákat, amelyeket az emberek természetesen alkalmaznak.

Bár több mint 200 technológiai cég idén körülbelül 120 ezer munkahelyet szüntetett meg az AI-ra hivatkozva, a teszt eredményei azt sugallják, hogy az AI-ágensek egyelőre nem képesek teljes mértékben helyettesíteni az emberi munkavállalókat az összetett, emberi ítéletet igénylő feladatokban.