HR profesionálové se při hodnocení zaměstnanců nemohou zcela spolehnout na nástroje umělé inteligence

Umělá inteligence si dobře poradí se snadno zařaditelnými tématy, ale při hodnocení zpětné vazby od zaměstnanců selhává tam, kde je potřeba postihnout nuance. Vyplývá to z nové studie výzkumné laboratoře PYX Labs, kterou zaštiťuje společnost Perceptyx. Studie zkoumala jak schopnost AI plnit základní úkoly, tak její schopnost prokázat úsudek nutný k přesnému výkladu toho, jak zaměstnanci prožívají svou práci. Ukázalo se, že v případech, kdy byly odpovědi jednoznačné a ověřitelné, modely úspěšně zvládly 76 až 82 procent úkolů. Jakmile ovšem šlo o složitější výsledky vyžadující, aby model interpretoval a pochopil otevřenou zpětnou vazbu zaměstnanců a vytvořil z ní soudržný a přesný závěr, úspěšnost klesla až na 33 procent.

Syntéza je nejslabší disciplínou

Srovnávací studie posuzovala odpovědi sedmi modelů umělé inteligence od společností OpenAI, Google, Anthropic a xAI napříč 84 úkoly zaměřenými na naslouchání zaměstnancům. Odpovědi byly poměřovány kritérii, která vytvořili psychologové a specialisté na organizační chování. Výzkum dospěl k závěru, že stávající modely AI sice zvládnou objektivní práci, ale jsou nespolehlivé, jde-li o interpretaci a syntézu.

„Organizace už umělou inteligenci využívají k interpretaci zpětné vazby zaměstnanců a k tvorbě doporučení, která ovlivňují reálná rozhodnutí o lidech,“ uvedl v prohlášení Joseph Freed, produktový ředitel Perceptyx a vedoucí PYX Labs. „Otázka nezní, zda tyto modely dokáží vytvořit plynulou odpověď — ale zda chápou, jak vypadá to ‚správné‘ v kontextu pracoviště.“

Zkoumané modely měly největší potíže právě tam, kde bylo nutné sestavit ucelený obraz z více zdrojů a nejednoznačných signálů. Syntéza byla u každého z modelů vůbec nejhůře hodnocenou schopností, se skóre pohybujícím se mezi 14 a 57 procenty, což představuje větší rozdíl než u kteréhokoli jiného úkolu. Podle zprávy dochází k selhání přesně ve chvíli, kdy modely musí zvážit neúplné, emočně zabarvené nebo kontextově závislé signály a poskládat je do jednoho jasného závěru.

PYX Labs rovněž zaznamenala vzácné, ale významné případy, kdy modely vytvořily smyšlené statistické výstupy nebo se striktně nedržely omezení daných výchozím souborem dat. Rizika spojená s využíváním modelů AI k interpretaci zpětné vazby zaměstnanců bez lidského dohledu proto studie označila za značná.

Přesto podle zprávy WTW z roku 2025 pouze 20 procent firem uvedlo, že jejich manažeři jsou při poskytování zpětné vazby a nabízení příležitostí ke koučování skutečně efektivní. Firmy tak umělou inteligenci využívají k zaplnění těchto mezer — 37 procent respondentů průzkumu WTW uvedlo, že nástroje AI používají jako součást svého procesu řízení výkonu.

Zdroj: hrdive.com

Zdroj: JOBS NETWORK NEWS  

Napsat komentář