OpenAI wchodzi w biznes układów scalonych
OpenAI zaprezentowało w środę swój pierwszy zaprojektowany na zamówienie półprzewodnik, opracowany we współpracy z Broadcom, sygnalizując zamiar zmniejszenia zależności od procesorów graficznych Nvidii do obsługi obciążeń wnioskowania AI. Układ jest zoptymalizowany specjalnie pod kątem architektur sieci neuronowych opartych na transformatorach, które napędzają ChatGPT i inne produkty AI firmy.
Strategiczne przejście w kierunku integracji pionowej
Niestandardowy układ reprezentuje szersze strategiczne dążenie OpenAI do kontrolowania większej części swojego stosu technologicznego. Projektując własne krzemowe układy, firma może zoptymalizować wydajność i efektywność energetyczną dla swoich specyficznych modeli, zamiast polegać na ogólnego przeznaczenia procesorach graficznych zaprojektowanych dla szerszego rynku. Analitycy branżowi szacują, że niestandardowe układy mogą zapewnić 2-4 razy lepszą wydajność na wat dla wnioskowania w porównaniu z gotowymi alternatywami.
Trend w całej branży przyspiesza
OpenAI dołącza do rosnącej listy firm technologicznych projektujących niestandardowe układy AI, w tym Google TPU, Amazon Trainium i Inferentia oraz Microsoft Maia. Trend odzwierciedla ogromne wymagania obliczeniowe nowoczesnych systemów AI i oszczędności kosztów dostępne dzięki integracji pionowej. Udział Broadcom zapewnia dostęp do zaawansowanych technologii pakowania i łączenia potrzebnych do budowy wysokowydajnych akceleratorów AI na dużą skalę.