Nebius (NBIS.US) przejmuje izraelski startup Inferize, zwiększając działania w zakresie AI inferencji; wartość transakcji może sięgnąć nawet 150 mln dolarów.
Dostawca usług infrastruktury chmurowej AI, Nebius, ogłosił przejęcie izraelskiego startupu zajmującego się sztuczną inteligencją, Inferize, wzmacniając tym samym swoje możliwości w zakresie infrastruktury do wnioskowania AI.
Z aplikacji Strefy Finansowej Zhiptong dowiadujemy się, że AI-aania chmurowa Nebius (NBIS.US) ogłosiła przejęcie izraelskiego startupu sztucznej inteligencji Inferize, co jeszcze bardziej wzmocni jej możliwości w zakresie infrastruktury AI do przetwarzania wniosków. Inferize koncentruje się na minimalizacji czasu bezczynności procesorów graficznych (GPU) oraz przyspieszaniu wdrażania dużych modeli AI. Według izraelskiego portalu Calcalist wartość tej transakcji szacowana jest na 100–150 milionów dolarów, jednak Nebius nie ujawnił szczegółowych warunków finansowych.
Kluczową ideą tego przejęcia jest poprawa efektywności wykorzystania GPU, szczególnie w sytuacjach dynamicznie zmieniającego się zapotrzebowania na przetwarzanie wniosków AI, co pozwala Nebius szybciej alokować zasoby obliczeniowe i ograniczyć czas bezczynności kosztownego sprzętu.
Cel: Wydajność przetwarzania wniosków AI, ograniczenie bezczynności GPU
Technologie Inferize skupiają się na problemie „zimnego startu” podczas wdrażania modeli AI. Zimny start polega na tym, że zanim model AI zacznie obsługiwać żądania użytkowników, musi być załadowany oraz zainicjalizowane muszą być odpowiednie zasoby. Gdy uruchamiane są nowe instancje przetwarzania wniosków, GPU może czekać na załadowanie modelu, zanim zacznie rzeczywiste obliczenia, co powoduje chwilową bezczynność zasobów.
Problem ten jest szczególnie widoczny przy nagłym wzroście zapotrzebowania na przetwarzanie wniosków AI. Wraz z napływem żądań, dostawcy chmurowi muszą błyskawicznie uruchamiać kolejne instancje, lecz jeśli czas ładowania modelu jest długi, nowo zwiększone zasoby GPU nie mogą być od razu wykorzystane, co odbija się na szybkości odpowiedzi usług i efektywności wykorzystania mocy obliczeniowej.
Technologia Inferize ma skrócić czas oczekiwania, aby nowe zasoby przetwarzania wniosków można było szybciej oddać do pracy, a ekspansja mocy obliczeniowej lepiej odpowiadała rzeczywistym zmianom zapotrzebowania.
Dla Nebius oznacza to, że firma może bardziej elastycznie zaspokajać potrzeby klientów, poprawiając efektywność istniejącej infrastruktury bez konieczności utrzymywania wielu bezczynnych GPU jako zasobów zapasowych.
Danila Shtan, Dyrektor Techniczny w Nebius, wskazuje, że wydajne uruchamianie usług AI wymaga nie tylko szybszych GPU i zoptymalizowanych modeli, ale również, by cały system potrafił reagować na zmiany zapotrzebowania — w tym szybko dostarczać dodatkową moc obliczeniową przy wzroście żądań. Podkreślił także, że Inferize wnosi nie tylko technologię przyspieszającą ten proces, lecz dysponuje zespołem doświadczonych inżynierów od systemów GPU.
Nebius zamierza włączyć inżynierów Inferize do swojego zespołu ds. przetwarzania wniosków, a technologie firmy zintegrować z platformą AI Token Factory, by poprawić jej zdolność do reagowania na potrzeby klientów i zwiększyć ilość rzeczywistych zadań obliczeniowych obsługiwanych przez infrastrukturę.
Shtan zaznaczył jednocześnie, że przyszły wkład zespołu Inferize nie ograniczy się tylko do początkowej integracji technologicznej.
Obniżenie kosztów rezerwowej mocy obliczeniowej i zwiększenie efektywności działania infrastruktury AI
Guy Bortnikov, współzałożyciel oraz CEO Inferize, wyjaśnia, że dla natychmiastowego reagowania na potrzeby klientów dostawcy chmurowi zwykle utrzymują pewną pulę rezerwowych GPU, a urządzenia obliczeniowe pozostające w gotowości generują dodatkowe koszty. Inferize powstało właśnie po to, by te koszty zmniejszać, a współpraca z Nebius pozwala wdrożyć ich technologie bezpośrednio w praktycznie działającej chmurze AI.
W biznesie przetwarzania wniosków AI efektywność zarządzania zasobami obliczeniowymi bezpośrednio przekłada się na koszty działania infrastruktury. Ze względu na wysokie ceny GPU, utrzymywanie dużej liczby bezczynnych GPU w ramach zabezpieczenia przed szczytem zapotrzebowania może obniżyć ogólną stopę zwrotu z inwestycji.
Poprzez skracanie czasu uruchamiania modeli i przyspieszanie aktywacji zasobów obliczeniowych, Nebius ma szansę zwiększyć elastyczność usług, jednocześnie ograniczając zależność od zapasowych GPU.
Warto też zaznaczyć, że Bortnikov był wcześniej współzałożycielem firmy Granulate zajmującej się optymalizacją infrastruktury obliczeniowej. Spółka ta opracowywała technologie poprawiające efektywność wykorzystania zasobów i w 2022 została przejęta przez Intel (INTC.US). Ten kontekst pokazuje, że zespół Inferize ma doświadczenie w obszarze optymalizacji infrastruktury obliczeniowej.
Kolejne przejęcia firm technologicznych — Nebius wzmacnia platformę AI do przetwarzania wniosków
Przejęcie Inferize to jedno z kilku działań Nebius podejmowanych ostatnio w obszarze optymalizacji modeli AI i usług przetwarzania wniosków. Wcześniej Nebius sfinalizował zakup Eigen AI za 643 miliony dolarów, a ostatnio przejął także firmę Clarifai zajmującą się technologiami AI, jednak nie ujawniono szczegółów wartości transakcji.
Wszystkie te akwizycje mają na celu wzmocnienie zdolności Nebius w zakresie przetwarzania wniosków AI i optymalizacji modeli, a co za tym idzie — rozwój mniej zaawansowanych usług infrastrukturalnych AI.
W przeciwieństwie do inwestycji w infrastrukturę skoncentrowanych na mocy potrzebnej do treningu modeli AI, przetwarzanie wniosków koncentruje się na efektywności używania modelu po wdrożeniu, obejmując szybkość obsługi żądań, zarządzanie zasobami obliczeniowymi, wdrażanie modeli i koszt jednostkowej mocy obliczeniowej.
Wraz z integracją kolejnych technologii, model biznesowy Nebius przesuwa się z dostarczania zasobów GPU w kierunku dostarczania technologii i usług poprawiających praktyczną efektywność operacyjną modeli AI.
Przejęcie Inferize uzupełni techniczne możliwości Nebius w zakresie dynamicznego zarządzania mocą obliczeniową i szybkiego wdrażania modeli. Jednak skala oszczędności kosztów i wzrostu efektywności w wyniku tej integracji będzie wymagała weryfikacji przez praktyczną działalność operacyjną.
Zastrzeżenie: Treść tego artykułu odzwierciedla wyłącznie opinię autora i nie reprezentuje platformy w żadnym charakterze. Niniejszy artykuł nie ma służyć jako punkt odniesienia przy podejmowaniu decyzji inwestycyjnych.
Może Ci się również spodobać
Protokół z posiedzenia Rezerwy Federalnej: wszyscy 19 decydentów popierają podwyżkę stóp procentowych we wrześniu, ale ich motywacje są różne; większość przewiduje kolejne podwyżki w tym roku, sugerując brak pośpiechu w październiku.
Większość urzędników uważa, że podwyżka stóp procentowych we wrześniu jest „ubezpieczeniem” przeciwko uporczywej inflacji; mniejszość sądzi, że to konieczny krok w celu opanowania inflacji; ogólnie nie wykazano chęci do przeprowadzania serii kolejnych podwyżek stóp. „Nowy Komunikator Fed” podkreśla treść protokołu: „Większość uczestników uważa, że ponowne podniesienie stóp procentowych przed końcem roku może być właściwe”. Prawie wszyscy urzędnicy sądzą, że inflacja wciąż utrzymuje się na wysokim poziomie, rynek pracy jest bliski pełnemu zatrudnieniu. Wielu urzędników twierdzi, że pomimo wzrostu dochodowości amerykańskich obligacji długoterminowych, warunki finansowe nadal sprzyjają wzrostowi gospodarczemu. Niektórzy urzędnicy uważają, że AI poszerzy inwestycje, podniesie produktywność, ale może także napędzać inflację. Z protokołu wynika, że w lipcu zinterwencjonowane wspólnie działania USA i Japonii wsparły jena, będąc inicjatywą Departamentu Skarbu USA, bez użycia środków Fed.
Znaczne zmniejszenie o 100 milionów baryłek? Według raportów, Unia Europejska uważa, że plan uwolnienia rezerw ropy jest głównie realizacją wcześniejszych zobowiązań, a nie nowym udziałem
Państwa członkowskie G7 zgodziły się w zeszły piątek na uwolnienie do 100 milionów baryłek ropy naftowej i oleju napędowego z rezerw. IEA ogłosiła w marcu plan uwolnienia 400 milionów baryłek, z czego do zeszłego piątku około 75 milionów baryłek wciąż nie zostało uwolnionych. Kraje członkowskie Unii Europejskiej uważają, że ta akcja jest jedynie realizacją wcześniejszych zobowiązań, a nie przydzieleniem nowych kwot. Jeśli chodzi o wcześniejsze uwolnienie rezerw oleju napędowego, na czym szczególnie skupiono się w porozumieniu G7 w zeszłym tygodniu, państwa Unii Europejskiej uważają, że jest to możliwe do wdrożenia, ale skala może być ograniczona.
Wysoki urzędnik Iranu deklaruje „nigdy nie zrezygnujemy” z prawa do wzbogacania uranu; między USA a Iranem „nie prowadzi się negocjacji”; nielegalny szlak przez cieśninę Ormuz zostanie wkrótce zablokowany.
Według doniesień, wysoki rangą urzędnik Iranu oświadczył w środę, że przed rozpoczęciem rozmów na temat kwestii nuklearnych Stany Zjednoczone muszą najpierw spełnić warunki postawione przez Iran, a obecne propozycje USA dotyczące programu nuklearnego są sprzeczne z żądaniami Iranu. Niedawna koncepcja przedstawiona przez Vance’a reprezentuje jedynie żądania strony amerykańskiej. Vance powiedział w poniedziałek, że Iran musi "znacząco" zredukować swoje zdolności wzbogacania uranu, aby spełnić wymagania USA. W środę cena ropy Brent chwilowo przekroczyła 102 USD za baryłkę.
Odporność gospodarki USA wzmacnia perspektywy małych spółek, Wall Street przewiduje nadchodzącą okazję do odbicia
Bank Amerykański wskazuje, że dla akcji o małej kapitalizacji, które są mocno uzależnione od krajowej gospodarki USA, przemysł wytwórczy jest najważniejszym wskaźnikiem makroekonomicznym wpływającym na ich względne wyniki. Najnowsze dane pokazują, że amerykański sektor produkcyjny rozszerza się już dziewiąty miesiąc z rzędu, co stanowi najdłuższy okres ekspansji od 2022 roku.
