
Firma Nvidia ostro gra w świecie AI dzięki sprzętowi najnowszej generacji, ale teraz dodaje także oprogramowanie z NVLM. będzie konkurować GPT-4o oraz Wzywa za pośrednictwem LLM typu open source w celu przyłączenia się do modeli multimodalnych (obraz, tekst).
Nvidia dominuje sprzęt dla sztucznej inteligencji z procesorami graficznymi centralizacji danych, przy czym modele H100 i B200 są najbardziej reprezentatywne. Jednak wraz z NVLM pojawia się nowe rozwiązanie dla sektora dużych modeli językowych (LLM). Propozycja Nvidii ma na celu walkę w sektorze zdominowanym przez OpenAI i jego GPT-4°. Istnieją jednak również inni konkurenci, na przykład Gemini firmy Google, Llama firmy Meta i Claude 3.5 firmy Anhtropic.
Co NVLM od Nvidii proponuje zrewolucjonizować świat AI?
NVLM 1.0 od Nvidii to nowy konkurent w świecie dużych modeli językowych dla AI. Twórcy opublikowali opracowanie szczegółowo opisujące, jak to działa i na co pozwoli nowa propozycja, która ma konkurować w segmencie oprogramowania ze sztuczną inteligencją.
Krótko mówiąc, NVLM to cała rodzina multimodalnych LLM, które według Nvidii zapewniają niezwykłe wyniki w zakresie obrazu i języka. Badanie wskazuje na możliwości analityczne i rozwojowe bardzo podobne do innych popularnych już modeli, takich jak GPT-4o.
W NVLM znajdziemy model z 72.000 miliardami parametrów, jak dotąd najbardziej ambitnego i skutecznego zagadnienia. Według Nvidii jego zachowanie i rodzaj reakcji są lepsze niż Llama 3 405B, znacznie większy model według testów wydajności.
Kolejną zaletą propozycji Nvidii jest to, że NVLM oferuje model AI o otwartym kodzie źródłowym z otwartymi wagami. Odpowiedzialni obiecują opublikować kod używany do uczenia modelu, co jest niezwykle przydatne. Programiści będą mogli wykorzystać go we własnych projektach i forkach.
Co NVLM zaoferuje światu AI?
Dzięki NVLM możesz analizować dane wejściowe wizualne i tekstowe. Przekłada się to na zdolność sztucznej inteligencji do interpretowania memów i analizowania zdjęć. Ponadto możesz także użyć tego modelu językowego stworzonego przez Nvidię do rozwiązywania problemów matematycznych krok po kroku.
Działanie tego układu łączy w sobie OCR, lokalizację, zdrowy rozsądek, wiedzę o świecie i umiejętności programowania. Wszystko to razem pozwala firmie NVLM reagować na różne żądania i sytuacje z dużą wszechstronnością. Badanie zakresu tego nowego modelu języka AI i porównanie jego wydajności z innymi graczami w branży pozwala nam zrozumieć, w jakim kierunku postępuje technologia.
O przedtreningówce
Osoby odpowiedzialne za szkolenie NVLM wykorzystały ulepszoną architekturę do szkolenia i rozumowania swojego modelu. Jego możliwości są bardzo wszechstronne i jest w stanie przetworzyć 72.000 XNUMX milionów parametrów i bezpośrednio konkuruje GPT-4o, Lama 3-V-70B i Gemini 1.5 Pro. Jego największa wydajność została obecnie udowodniona w rozwiązywaniu problemów matematycznych oraz przetwarzaniu obrazu i tekstu.
Informacje użyte do szkolenia wstępnego i szkolenia zostały starannie dobrane po dokładnych korektach i nadzorze człowieka. Praca służyła weryfikacji jakości zbiorów danych oraz różnorodności kompatybilnych i skalowanych zadań, także na etapie przedszkoleniowym.
El potężny algorytm stworzony przez Nvidię Został wydany jako open source wraz z modelem z instrukcjami i parametrami szkoleniowymi. Można ich używać i modyfikować bezpłatnie, a ich dystrybucja odbywa się za pośrednictwem Megatron-Core, biblioteki programistycznej firmy.
To prawdziwy kamień milowy w branży, ponieważ Nvidia ułatwia innym małym organizacjom lub niezależnym badaczom także przyczynianie się do rozwoju sztucznej inteligencji. On bezpłatny dostęp do narzędzia a jego cechy podobne do innych produktów dużych technologii będą stanowić punkt wyjścia przed i po wyścigu o kontrolę nad sektorem.
Celem tego nowego LLM jest poszerzenie bazy użytkowników i klientów, faworyzując biznes, który już jest dochodowy. Ale teraz doda jeszcze więcej entuzjastów i potencjalnych użytkowników na całym świecie. Doskonały krok dla Nvidii, która oprócz zdominowania sektora AI poprzez sprzęt, teraz celuje bezpośrednio w sektor oprogramowania.
Hybrydowa strategia biznesowa
Wiodąca pozycja, jaką Nvidia zajęła w sektor technologiczny a w rozwoju sztucznej inteligencji odpowiada na hybrydową strategię biznesową. Z jednej strony rozważa rozwój i produkcję chipów oraz sprzedaż zaawansowanych systemów promujących działanie bardzo różnorodnych algorytmów. Przyspieszyło to generowanie dochodów i zyskało akceptację inwestorów. Z drugiej strony trwają prace nad algorytmami AI, dzięki czemu Nvidia pozycjonuje się w segmencie, w którym jest w niekorzystnej sytuacji w porównaniu z OpenAI, Google i Meta. Ale dzięki tej strategii NVLM okazuje się doskonałym narzędziem, zdolnym do walki łeb w łeb z gigantami AI, którzy są już ustawieni.
Dzięki nowym procesorom Nvidia szybkość i możliwości analizy i rozwiązywania problemów matematycznych osiągane przez użytkowników są godne uwagi. Pojawienie się NVLM 1.0 będzie oznaczać okres przed i po dla sektora, generując możliwość pojawienia się nowego aktora z propozycjami Open Source w celu dotarcia do większej liczby użytkowników oraz małych i średnich firm.
Jaka będzie sytuacja na rynku AI teraz, gdy Nvidia wkroczyła z NVLM?
Do tej pory Nvidia oferowała tzw najważniejsze procesory i karty graficzne dla wszystkich typów centrów danych i serwerów, w których realizowane są modele AI. NVLM oznacza jednak bezpośrednie wejście Nvidii do sektora, co może wywołać pewne tarcia z resztą konkurencji. Inicjatywa open source i ambitna moc obliczeniowa sprawiają, że NVLM jest bardzo atrakcyjnym modelem językowym. Pozostaje zobaczyć, jak się dostosowuje i jakie zastosowania społeczność użytkowników zaczyna mu dawać, aby w pełni zrozumieć jego zakres. Prawdopodobnie zaczniemy słyszeć ważne wieści z sektora AI teraz, gdy do gry weszła Nvidia.
