OpenAI ma własny chip. NVIDIA dostała poważnego rywala
OpenAI nie zamierza wiecznie polegać na sprzęcie innych producentów. Firma pokazała pierwsze konkretne wyniki własnego układu i wygląda to dobrze.
Jalapeño to pierwszy autorski akcelerator AI zaprojektowany przez zespół Sama Altmana we współpracy z Broadcomem. Jest to wyspecjalizowany układ przeznaczony do inferencji, czyli obsługi już wytrenowanych modeli i agentów AI. Nie zastąpi więc chipów używanych do treningu kolejnych generacji GPT, ale może przejąć sporą część codziennych zapytań użytkowników ChatGPT, Codexa czy API.
OpenAI chwali się nawet x3,6 niższymi opóźnieniami
Amerykanie przetestowali Jalapeño przy użyciu sprawdzonego, publicznego benchmarku InferenceX od SemiAnalysis. Układ sprawdzono z GPT-OSS 120B, DeepSeek R1 670B oraz ogromnym Kimi K2.5 1T. Punktami odniesienia były systemy korzystające z NVIDIA GB200 oraz GB300.
W zależności od modelu Jalapeño oferowało od 1,5 do 1,9 raza więcej pracy AI per wat przy maksymalnej przepustowości. Jeszcze większa różnica pojawiła się w przypadku czasu odpowiedzi, gdzie opóźnienie end-to-end było od 1,7 do 3,6 raza niższe. W najbardziej interaktywnych zastosowaniach przewaga wydajności sięgała nawet 4,1 raza.
Co ciekawe, Jalapeño ma deklarowane TDP na poziomie 700 W, ale podczas badanych obciążeń długotrwały pobór mocy nie przekraczał 550 W. OpenAI przekonuje, że to dlatego, gdyż ich zespół jednocześnie zoptymalizował pamięć, sieć i oprogramowanie, dzięki czemu udało się ograniczyć opóźnienia i poprawić wydajność całej platformy.
Na masową zmianę infrastruktury trzeba jednak poczekać
Jalapeño zacznie trafiać do centrów danych OpenAI pod koniec 2026 roku, początkowo w bardzo niewielkich ilościach. Richard Ho zapowiedział znacznie większą skalę wdrożeń w 2027 roku. Firma nie zamierza przy tym rezygnować z akceleratorów NVIDII, a Jalapeño jest dopiero pierwszą generacją większej rodziny - druga jest już w zaawansowanej fazie rozwoju, a trzecia zaczyna nabierać kształtów.