Rynki na żywo.
(3)Bezpieczeństwo AI uderza w mnożniki, ale nie w popyt na compute
Po weekendzie pojawiło się kilka komentarzy analityków do wątku, który opisywałem rano w komentarzu rynkowym, i wnioski są generalnie bardzo zbliżone do moich. Przejdźmy przez nie po kolei.
Po weekendzie pojawiło się kilka komentarzy analityków do wątku, który opisywałem rano w komentarzu rynkowym, i wnioski są generalnie bardzo zbliżone do moich. Przejdźmy przez nie po kolei.
Mniej pamięci, więcej GPU? Wnioski z raportu Mizuho
Nowa notka Mizuho, oparta między innymi na rozmowach z SemiAnalysis, pokazuje ciekawy znak zapytania wokół pamięci. Nvidia może w generacji Feynman próbować ograniczyć ilość HBM względem wcześniejszych planów, a potencjalna skala takiego "de-specu" może być duża.
Chodzi między innymi o to, że zamiast przechodzić szybko na HBM z 16 czy 20 warstwami pamięci, producenci mogą dłużej zostać przy prostszych i tańszych rozwiązaniach. Niepewne pozostaje też przez to tempo wejścia hybrid bondingu, czyli nowego sposobu łączenia tych warstw.
Google już pokazało podobny kierunek. TPU v8 ma korzystać z ośmiu warstw pamięci, zamiast automatycznie przechodzić na coraz większe i bardziej zaawansowane stosy. Innymi słowy, kolejna generacja akceleratora nie musi oznaczać kolejnego dużego skoku ilości HBM. Na pierwszy rzut oka brzmi to źle dla producentów pamięci.
Nowa notka Mizuho, oparta między innymi na rozmowach z SemiAnalysis, pokazuje ciekawy znak zapytania wokół pamięci. Nvidia może w generacji Feynman próbować ograniczyć ilość HBM względem wcześniejszych planów, a potencjalna skala takiego "de-specu" może być duża.
Chodzi między innymi o to, że zamiast przechodzić szybko na HBM z 16 czy 20 warstwami pamięci, producenci mogą dłużej zostać przy prostszych i tańszych rozwiązaniach. Niepewne pozostaje też przez to tempo wejścia hybrid bondingu, czyli nowego sposobu łączenia tych warstw.
Google już pokazało podobny kierunek. TPU v8 ma korzystać z ośmiu warstw pamięci, zamiast automatycznie przechodzić na coraz większe i bardziej zaawansowane stosy. Innymi słowy, kolejna generacja akceleratora nie musi oznaczać kolejnego dużego skoku ilości HBM. Na pierwszy rzut oka brzmi to źle dla producentów pamięci.
Ciekawe wnioski z wywiadu Dylana Patela na temat infrastruktury AI
Dylan Patel z SemiAnalysis udzielił ostatnio wywiadu, w którym przeszedł przez cały stack infrastruktury AI, od modeli i pamięci, przez CPU i sieci, po energię i centra danych. To szeroki, techniczny przegląd tego, gdzie w łańcuchu dostaw jest dziś popyt i gdzie robią się wąskie gardła. Najciekawszy wniosek po przesłuchaniu dotyczył moim zdaniem CPO, ponieważ
Wszystko, co najważniejsze o rynkach na Twoją skrzynkę!
Każda niedziela o 19:00. Zero spamu.