Modely a platformy AI

Nová technologie rozpoznávání obličeje pomocí umělé inteligence jde o krok dále

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Zdá se, že použití umělé inteligence v technologiích rozpoznávání obličeje je jedním z nejrychleji rostoucích trendů. Jak uvádí ZDNet, společnosti jako Microsoft (MSFT ) již vyvinuly technologie rozpoznávání obličeje, které mohou rozpoznat emoční stavy (FR) pomocí nástrojů pro rozpoznávání emocí. Avšak omezujícím faktorem bylo, že tyto nástroje byly omezeny na osm takzvaných základních stavů – hněv, pohrdání, strach, odpor, štěstí, smutek, překvapení nebo neutrální.

Nyní vstupuje japonský technologický vývojář Fujitsu se svou technologií založenou na umělé inteligenci, která rozpoznávání obličeje posouvá o krok dále v sledování vyjádřených emocí.

Stávající technologie FR je založena, jak vysvětluje ZDNet, na “identifikaci různých akčních jednotek (AUs) – tj. určitých pohybů svalů obličeje, které lze spojit s konkrétními emocemi.” V daném příkladu “pokud jsou identifikovány obě AU ‘zvednutí tváře’ a AU ‘tahání rohu úst’, AI může dospět k závěru, že osoba, kterou analyzuje, je šťastná.

Jak vysvětlil mluvčí Fujitsu, “problém s aktuální technologií je, že AI potřebuje být vyškolena na obrovských datech pro každou AU. Musí vědět, jak rozpoznat AU ze všech možných úhlů a pozic. Ale nemáme dostatek obrazů pro to – takže obvykle to není příliš přesné.”

Velké množství dat potřebných pro výcvik AI, aby bylo efektivní v detekci emocí, je velmi obtížné pro stávající technologie FR skutečně rozpoznat, co osoba prožívá. A pokud osoba nesedí před kamerou a nedívá se přímo do ní, úkol se stává ještě obtížnějším. Mnozí odborníci potvrdili tyto problémy v některých nedávných výzkumech.

Fujitsu tvrdí, že našel řešení, jak zvýšit kvalitu výsledků rozpoznávání obličeje při detekci emocí. Místo použití velkého množství obrazů pro výcvik AI má nově vytvořený nástroj za úkol “extrahovat více dat z jednoho obrazu.” Společnost nazývá tento proces “normalizační proces”, který zahrnuje převod obrazů “pořízených z určitého úhlu na obrazy, které připomínají frontální snímek.

Jak vysvětlil mluvčí, “s týmž omezeným datovým souborem můžeme lépe detekovat více AU, dokonce i na obrazech pořízených z úhlu, a s více AU můžeme identifikovat složitější emoce, které jsou jemnější než současné analyzované emoční stavy.

Společnost tvrdí, že nyní může “detekovat emoční změny tak komplexní, jako je nervní smích, s detekční přesností 81%, což bylo určeno pomocí ‘standardních evaluačních metod’.” V porovnání s tím, podle nezávislým výzkumem, nástroje Microsoftu mají detekční přesnost 60% a měly problémy s detekcí emocí, když pracovaly s obrazi pořízenými z více úhlů.

Jako potenciální aplikace Fujitsu zmiňuje, že jeho nové nástroje by mohly být, mezi jinými věcmi, použity pro bezpečnost silničního provozu “detekcí i malých změn v koncentraci řidičů.

Bývalý diplomat a překladatel pro UN, v současné době freelance novinář/ spisovatel/ výzkumník, zaměřující se na moderní technologii, umělou inteligenci a moderní kulturu.