Modele i platformy AI
Bitwa między modelami językowymi open source a closed source: Analiza techniczna
Duże modele językowe (LLM) od kilku lat fascynują społeczność AI, przewodząc przełomom w przetwarzaniu języka naturalnego. Za tym zainteresowaniem kryje się złożona debata – czy te potężne modele powinny być open source czy closed source?
W tym poście analizujemy techniczną różnicę między tymi podejściami, aby zrozumieć możliwości i ograniczenia, jakie każde z nich przedstawia. Omówimy następujące kluczowe aspekty:
- Definiowanie modeli językowych open source i closed source
- Przezroczystość architektury i dostosowywanie
- Pomiar wydajności
- Wymagania obliczeniowe
- Wielofunkcyjność aplikacji
- Dostępność i licencjonowanie
- Prywatność danych i poufność
- Wsparcie komercyjne
Na końcu będziesz miał świadomą perspektywę na temat technicznych kompromisów między modelami językowymi open source i closed source, co pomoże Ci w wyborze własnej strategii AI. Zanurzmy się!
Definiowanie modeli językowych open source i closed source
Modele językowe open source mają publicznie dostępne architektury modeli, kod źródłowy i parametry wag. Pozwala to badaczom na inspekcję wnętrza, ocenę jakości, odtwarzanie wyników i tworzenie niestandardowych wariantów. Przykłady to ConstitutionalAI od Anthropic, LLaMA od Meta i GPT-NeoX od EleutherAI.
W przeciwieństwie do tego, modele językowe closed source traktują architekturę modelu i wagi jako własność prywatną. Podmioty komercyjne, takie jak Anthropic, DeepMind i OpenAI, rozwijają je wewnętrznie. Bez dostępu do kodu lub szczegółów projektu, powtarzalność i dostosowywanie są ograniczone.
Przezroczystość architektury i dostosowywanie
Dostęp do wnętrza modeli językowych open source odblokowuje możliwości dostosowywania, które są po prostu niemożliwe w przypadku modeli closed source.
Poprzez modyfikację architektury modelu, badacze mogą eksperymentować z technikami, takimi jak wprowadzanie połączeń między warstwami lub dodawanie specjalnych tokenów klasyfikacji, aby poprawić wydajność w wąskich zadaniach. Dostęp do parametrów wag pozwala deweloperom na przeniesienie istniejących reprezentacji lub zainicjowanie wariantów z pre-trenowanymi budulcami, takimi jak T5 i BERT.
To dostosowywanie pozwala modelom językowym open source lepiej służyć specjalistycznym dziedzinom, takim jak badania biomedyczne, generowanie kodu i edukacja. Jednak wymagana ekspertyza może podnieść barierę dla dostarczania wdrożeń o jakości produkcyjnej.
Modele językowe closed source oferują ograniczone dostosowywanie, ponieważ ich szczegóły techniczne pozostają własnością prywatną. Jednak ich sponsorzy poświęcają ogromne zasoby na wewnętrzne badania i rozwój. Wynikające z tego systemy są w stanie osiągnąć znaczne postępy w dziedzinie ogólnych zadań językowych.
Zatem, chociaż mniej elastyczne, modele językowe closed source wyróżniają się w zadaniach językowych o szerokim zastosowaniu. Ułatwiają również integrację, dostosowując się do ustalonych interfejsów, takich jak standard OpenAPI.
Pomiar wydajności
Pomimo przejrzystości architektury, pomiar wydajności modeli językowych open source wprowadza wyzwania. Ich elastyczność umożliwia niezliczoną ilość możliwych konfiguracji i strategii dostrajania. Pozwala również na modyfikację modeli, które są określane jako „open source”, aby zawierały techniki własnościowe, co może zniekształcać porównania.
Modele językowe closed source mają bardziej wyraźnie zdefiniowane cele wydajności, ponieważ ich sponsorzy mierzą i reklamują określone progi metryk. Na przykład, Anthropic ogłasza dokładność ConstitutionalAI w zestawach problemów NLU. Microsoft (MSFT ) podkreśla, jak GPT-4 przewyższa ludzkie podstawy w zestawie narzędzi SuperGLUE do zrozumienia języka.
Jednak te wąsko zdefiniowane punkty odniesienia spotkały się z krytyką za przeszacowanie wydajności w zadaniach rzeczywistych i zaniżenie niepowodzeń. Prawdziwa, bezstronna ocena modeli językowych pozostaje otwartym pytaniem badawczym – zarówno dla podejść open source, jak i closed source.
Wymagania obliczeniowe
Trenowanie dużych modeli językowych wymaga ogromnych zasobów obliczeniowych. OpenAI wydał miliony na trenowanie GPT-3 na infrastrukturze chmurowej, podczas gdy Anthropic zużył ponad 10 milionów dolarów wartości procesorów GPU na ConstitutionalAI.
Koszt takich modeli wyklucza większość osób i małych zespołów z społeczności open source. W rzeczywistości, EleutherAI musiał usunąć model GPT-J z publicznego dostępu z powodu rosnących kosztów hostingu.
Bez głębokich kieszeni, historie sukcesu modeli językowych open source opierają się na darowanych zasobach obliczeniowych. LAION opracował swój model LAION-5B, wykorzystując crowdsourcing danych. Projekt ConstitutionalAI od Anthropic wykorzystał obliczenia wolontariuszy.
Wsparcie dużych firm, takich jak Google (GOOGL ), Meta i Baidu, zapewnia wysiłkom closed source niezbędny paliwo finansowe do uprzemysłowienia rozwoju modeli językowych. Umożliwia to skalowanie do rozmiarów nie do pomyślenia dla inicjatyw grassroots – jak model Gopher o 280 miliardach parametrów od DeepMind.
Wielofunkcyjność aplikacji
Dostosowywanie modeli językowych open source umożliwia podejmowanie się wyspecjalizowanych zadań. Badacze mogą agresywnie modyfikować wnętrze modelu, aby poprawić wydajność w wąskich zadaniach, takich jak przewidywanie struktury białek, generowanie dokumentacji kodu i weryfikacja matematycznych dowodów.
Jednak zdolność dostępu i edycji kodu nie gwarantuje skutecznego rozwiązania dziedziny specjalistycznej bez odpowiednich danych. Całkowite zestawy danych szkoleniowych dla wąskich aplikacji wymagają znacznego wysiłku, aby je zgromadzić i utrzymać.
Tu modele językowe closed source korzystają z zasobów, aby pozyskać dane szkoleniowe z wewnętrznych repozytoriów i partnerów komercyjnych. Na przykład, DeepMind licencjonuje bazy danych, takie jak ChEMBL dla chemii i UniProt dla białek, aby rozszerzyć zasięg aplikacji. Przemysłowy dostęp do danych pozwala modelom, takim jak Gopher, osiągnąć zdumiewającą wszechstronność, pomimo nieprzezroczystości architektury.
Dostępność i licencjonowanie
Licencjonowanie modeli językowych open source na zasadach permissivej promuje swobodny dostęp i współpracę. Modele, takie jak GPT-NeoX, LLaMA i Jurassic-1 Jumbo, wykorzystują umowy, takie jak Creative Commons i Apache 2.0, aby umożliwić niekomercyjne badania i uczciwą komercjalizację.
W przeciwieństwie do tego, modele językowe closed source posiadają ograniczone licencje, które ograniczają dostęp do modelu. Podmioty komercyjne ściśle kontrolują dostęp, aby zabezpieczyć potencjalne strumienie przychodu z API predykcyjnych i partnerstw przedsiębiorstw.
Zrozumiale, organizacje, takie jak Anthropic i Cohere, pobierają opłaty za dostęp do interfejsów ConstitutionalAI i Cohere-512. Jednak to ryzykuje wykluczenie ważnych dziedzin badawczych, skierowując rozwój ku dobrze finansowanym branżom.
Otwarte licencjonowanie również stwarza wyzwania, zwłaszcza w kwestiach atrybucji i odpowiedzialności. Dla przypadków użycia w badaniach, swobody przyznane przez dostępność open source oferują wyraźne korzyści.
Prywatność danych i poufność
Zestawy danych szkoleniowych dla modeli językowych zazwyczaj agregują treści z różnych źródeł online, takich jak strony internetowe, artykuły naukowe i fora dyskusyjne. To ryzykuje ujawnienie danych osobowych lub innych wrażliwych informacji w danych wyjściowych modelu.
Dla modeli językowych open source, staranne sprawdzanie składu zestawu danych zapewnia najlepszą ochronę przed problemami z poufnością. Ocena źródeł danych, procedur filtrowania i dokumentowanie przykładów podczas testowania może pomóc w identyfikacji słabości.
Niestety, modele językowe closed source uniemożliwiają taką publiczną kontrolę. Zamiast tego, konsumenci muszą polegać na rygorze wewnętrznych procesów przeglądu opartych na ogłoszonych politykach. Na przykład, Azure Cognitive Services obiecuje filtrować dane osobowe, podczas gdy Google określa formalne przeglądy prywatności i etykietowanie danych.
Ogólnie, modele językowe open source umożliwiają bardziej proaktywne identyfikowanie ryzyk związanych z poufnością w systemach AI przed tym, jak te słabości ujawnią się na dużą skalę. Ich odpowiedniki closed source oferują relatywnie ograniczoną przejrzystość w zakresie praktyk dotyczących danych.
Wsparcie komercyjne
Potencjał komercjalizacji modeli językowych closed source zachęca do znacznego inwestowania komercyjnego w rozwój i utrzymanie. Na przykład, w oczekiwaniu lukratywnych zwrotów z portfolio Azure AI, Microsoft zgodził się na wielomiliardowe partnerstwa z OpenAI wokół modeli GPT.
W przeciwieństwie do tego, modele językowe open source opierają się na wolontariuszach, którzy poświęcają swój czas na konserwację lub grantach, które zapewniają ograniczone finansowanie na określony czas. To asymetria zasobów ryzykuje ciągłość i długowieczność projektów open source.
Jednak bariery komercjalizacji również uwalniają społeczności open source, aby skoncentrować się na postępie naukowym zamiast zysku. I zdecentralizowana natura ekosystemów open source łagodzi nadmierne uzależnienie od utrzymanego zainteresowania któregokolwiek z indywidualnych sponsorów.
Ostatecznie każde podejście niesie kompromisy wokół zasobów i motywacji. Modele językowe closed source cieszą się większą bezpieczeństwem finansowym, ale koncentrują wpływ. Ekosystemy open promują różnorodność, ale cierpią na podwyższone niepewność.
Poruszanie się po krajobrazie modeli językowych open source i closed source
Decyzja między modelami językowymi open source a closed source wymaga dopasowania priorytetów organizacyjnych, takich jak dostosowywanie, dostępność i skalowalność, do możliwości modelu.
Dla badaczy i startupów, modele open source zapewniają większą kontrolę nad dostosowaniem modeli do konkretnych zadań. Licencjonowanie również ułatwia bezpłatne dzielenie się wglądami między współpracownikami. Jednak ciężar pozyskiwania danych szkoleniowych i infrastruktury może podważyć realną wykonalność.
Odwracając, modele językowe closed source obiecują znaczne poprawy jakości dzięki ogromnemu finansowaniu i danym. Jednak ograniczenia wokół dostępu i modyfikacji ograniczają przejrzystość naukową, a wdrożenia są związane z mapą drogową dostawcy.
W praktyce, otwarte standardy wokół specyfikacji architektury, punktów kontrolnych modelu i danych oceny mogą pomóc w zniwelowaniu wad obu podejść. Wspólne podstawy, takie jak Transformer od Google lub REALTO od Oxford, poprawiają odtwarzalność. Standardy interoperacyjności, takie jak ONNX, pozwalają na łączenie komponentów z źródeł open i closed.
Ostatecznie to, co się liczy, to wybranie odpowiedniego narzędzia – open source czy closed source – do zadania. Podmioty komercyjne wspierające modele językowe closed source mają niezaprzeczalny wpływ. Ale pasja i zasady społeczności open science będą nadal odgrywać kluczową rolę w napędzaniu postępu AI.












