Modele i platformy AI

Sieci neuronowe osiągają ludzką generalizację językową

mm
Dodaj Unite.AI do preferowanych źródeł w Google

W ciągle ewoluującym świecie sztucznej inteligencji (AI) naukowcy ogłosili niedawno znaczący kamień milowy. Stworzyli sieć neuronową, która wykazuje ludzką biegłość w generalizacji językowej. Ten przełomowy rozwój to nie tylko krok, ale olbrzymi skok w kierunku zamykania przepaści między ludzkim poznaniem a możliwościami AI.

Gdy penetrujemy dalej w sferę AI, zdolność tych systemów do zrozumienia i zastosowania języka w różnych kontekstach, podobnie jak ludzie, staje się niezmiernie ważna. Ten ostatni osiągnięcie daje obiecujący wgląd w przyszłość, w której interakcja między człowiekiem a maszyną będzie bardziej organiczna i intuicyjna niż kiedykolwiek wcześniej.

Porównanie z istniejącymi modelami

Świat AI nie jest obcy modelom, które mogą przetwarzać i odpowiadać na język. Jednak nowość tego ostatniego rozwoju leży w jego zwiększonej zdolności do generalizacji językowej. W porównaniu z ustanowionymi modelami, takimi jak te, które leżą u podstaw popularnych chatbotów, ta nowa sieć neuronowa wykazała wyższą zdolność do włączania nowo nauczonych słów do swojego istniejącego słownictwa i używania ich w nieznanych kontekstach.

Chociaż najlepsze obecne modele AI, takie jak ChatGPT, mogą utrzymać się w wielu scenariuszach konwersacyjnych, nadal nie radzą sobie, gdy chodzi o bezproblemową integrację nowych informacji językowych. Ta nowa sieć neuronowa zbliża nas do rzeczywistości, w której maszyny mogą zrozumieć i komunikować się z subtelnością i adaptacyjnością człowieka.

Zrozumienie systematycznej generalizacji

W sercu tego osiągnięcia leży pojęcie systematycznej generalizacji. To umożliwia ludziom bez wysiłku adaptować i używać nowo nabytych słów w różnych sytuacjach. Na przykład, gdy zrozumiemy termin “photobomb”, instynktownie wiemy, jak go użyć w różnych sytuacjach, czy to “photobombing twice” czy “photobombing during a Zoom call”. Podobnie, zrozumienie struktury zdania, takiego jak “cat chases the dog”, pozwala nam łatwo zrozumieć jego odwrotność: “the dog chases the cat”.

Jednak ta wrodzona ludzka zdolność była trudnym frontem dla AI. Tradycyjne sieci neuronowe, które były podstawą badań nad sztuczną inteligencją, nie posiadają naturalnie tej umiejętności. Zmagają się z włączaniem nowego słowa, chyba że zostały obszernie przeszkolone z wieloma przykładami tego słowa w kontekście. To ograniczenie było przedmiotem debaty wśród badaczy AI przez dziesięciolecia, wywołując dyskusje na temat wiarygodności sieci neuronowych jako prawdziwego odzwierciedlenia ludzkich procesów poznawczych.

Badanie szczegółowe

Aby zagłębić się w możliwości sieci neuronowych i ich potencjał do generalizacji językowej, przeprowadzono kompleksowe badanie. Badanie nie ograniczało się do maszyn; 25 uczestników ludzkich było ściśle zaangażowanych, służąc jako punkt odniesienia dla wyników AI.

Doświadczenie wykorzystywało język pseudo, sztucznie stworzony zestaw słów, których uczestnicy nie znali. Zapewniło to, że uczestnicy naprawdę uczyli się tych terminów po raz pierwszy, dając czystą kartę do testowania generalizacji. Ten język pseudo składał się z dwóch odrębnych kategorii słów. Kategoria “podstawowa” zawierała słowa takie jak “dax”, “wif” i “lug”, które symbolizowały podstawowe działania, takie jak “skocz” lub “przeskocz”. Z drugiej strony, bardziej abstrakcyjne słowa “funkcyjne”, takie jak “blicket”, “kiki” i “fep”, nakreślały reguły stosowania i łączenia tych słów podstawowych, prowadząc do sekwencji, takich jak “skocz trzy razy” lub “przeskocz do tyłu”.

Wprowadzono również element wizualny do procesu szkolenia. Każde słowo podstawowe było skojarzone z okręgiem o określonym kolorze. Na przykład, czerwony okrąg mógł reprezentować “dax”, podczas gdy niebieski okrąg oznaczał “lug”. Uczestnicy byli następnie pokazywani kombinacje słów podstawowych i funkcyjnych, wraz z wzorami kolorowych okręgów, które ilustrowały wyniki zastosowania funkcji do słów podstawowych. Przykładem byłoby sparowanie frazy “dax fep” z trzema czerwonymi okręgami, ilustrującym, że “fep” jest abstrakcyjną regułą, aby powtórzyć działanie trzykrotnie.

Aby zmierzyć zrozumienie i zdolność do systematycznej generalizacji uczestników, przedstawiono im złożone kombinacje słów podstawowych i funkcyjnych. Następnie poproszono ich o określenie prawidłowego koloru i liczby okręgów, a także ułożenie ich w odpowiedniej sekwencji.

Wnioski i opinie ekspertów

Wyniki tego badania nie są po prostu kolejnym przyrostem w annałach badań nad AI; reprezentują one zmianę paradygmatu. Wyniki sieci neuronowej, które ściśle naśladowały ludzką systematyczną generalizację, wywołały ekscytację i zainteresowanie wśród uczonych i ekspertów branżowych.

Dr Paul Smolensky, znany naukowiec kognitywny ze specjalizacją w języku na Uniwersytecie Johns Hopkins, określił to jako “przełom w możliwości szkolenia sieci, aby były systematyczne”. Jego oświadczenie podkreśla wagę tego osiągnięcia. Jeśli sieci neuronowe mogą być szkolone, aby generalizować systematycznie, mogą potencjalnie rewolucjonizować wiele aplikacji, od chatbotów po wirtualnych asystentów i dalej.

Jednak ten rozwój to więcej niż tylko postęp technologiczny. Dotyka długotrwałej debaty w społeczności AI: Czy sieci neuronowe mogą służyć jako dokładny model ludzkiej percepcji? Przez prawie cztery dekady ten temat widział badaczy AI w sprzeczności. Podczas gdy niektórzy wierzyli w potencjał sieci neuronowych do naśladowania ludzkich procesów myślowych, inni pozostawali sceptyczni ze względu na ich wrodzone ograniczenia, szczególnie w dziedzinie generalizacji językowej.

To badanie, z jego obiecującymi wynikami, przechyla szalę na korzyść optymizmu. Jak zauważył Brenden Lake, naukowiec kognitywny z Uniwersytetu Nowojorskiego i współautor badania, sieci neuronowe mogły mieć trudności w przeszłości, ale z odpowiednim podejściem mogą być ukształtowane, aby odzwierciedlać aspekty ludzkiej percepcji.

Ku przyszłości bezproblemowej synergii człowieka i maszyny

Podróż AI, od jej wczesnych etapów do obecnej potęgi, była naznaczona ciągłym rozwojem i przełomami. To ostatnie osiągnięcie w szkoleniu sieci neuronowych do systematycznej generalizacji języka jest kolejnym świadectwem nieograniczonego potencjału AI. Gdy stoimy na tym rozdrożu, istotne jest, aby uznać szersze implikacje takich postępów. Zbliżamy się ku przyszłości, w której maszyny nie tylko zrozumieją nasze słowa, ale także pojmą subtelności i konteksty, tworząc bardziej bezproblemową i intuicyjną interakcję między człowiekiem a maszyną.

Alex McFarland jest dziennikarzem i pisarzem zajmującym się sztuczną inteligencją, który bada najnowsze rozwoje w dziedzinie sztucznej inteligencji. Współpracował z licznymi startupami i wydawnictwami związanymi z sztuczną inteligencją na całym świecie.