OpenAI už nie je iba firma, ktorá vyvíja modely a produkty nad nimi. Predstavením čipu Jalapeño ukazuje ambíciu kontrolovať väčšiu časť technologického reťazca: od architektúry modelov cez softvér až po hardvér, na ktorom sa AI reálne vykonáva.
OpenAI vstupuje hlbšie do infraštruktúry AI
OpenAI predstavilo Jalapeño ako svoj prvý vlastný Intelligence Processor, teda akcelerátor navrhnutý predovšetkým pre inferenciu veľkých jazykových modelov. Čip vznikol v spolupráci s Broadcomom a je súčasťou širšej snahy budovať výpočtovú platformu, ktorá nebude závislá iba od bežne dostupných univerzálnych GPU riešení. Čoraz jasnejšie sa ukazuje, že ďalšia fáza konkurencie sa bude odohrávať aj v infraštruktúre.
Pri generatívnej AI je inferencia moment, keď model odpovedá na požiadavku používateľa. Ide o každodennú prevádzku služieb ako ChatGPT, Codex alebo API. Práve inferencia je to, čo používateľ vníma priamo: ako rýchlo príde odpoveď, koľko krokov dokáže agent vykonať, či služba zvláda špičku dopytu a aká drahá je jej prevádzka.
Nestačí iba viac GPU
Doterajší rast AI bol silno naviazaný na dostupnosť výkonných GPU. Tie sú flexibilné a mimoriadne výkonné, no nie vždy ideálne optimalizované na konkrétny typ prevádzky. OpenAI preto pri Jalapeño zdôrazňuje, že nejde o všeobecný akcelerátor upravený pre AI, ale o návrh od začiatku premyslený pre LLM inferenciu. To znamená, že architektúra vychádza z reálnych potrieb veľkých jazykových modelov: z práce s pamäťou, pohybu dát, typických výpočtových jadier, sieťovania a spôsobu, akým sa modely servujú miliónom používateľov.
OpenAI sa snaží navrhnúť výkon, ktorý lepšie sedí na konkrétny problém. Pri LLM inferencii ide často o to, ako efektívne sa presúvajú dáta medzi pamäťou, výpočtom a sieťou. Každý zbytočný presun zvyšuje spotrebu, cenu aj latenciu. Ak sa tieto vrstvy navrhnú spoločne, výsledkom môže byť lepšie využitie teoretického výkonu hardvéru.
AI navrhla čip pre AI
Jalapeño je výnimočný aj tým, ako vznikol. OpenAI pri jeho návrhu použilo vlastné modely umelej inteligencie, ktoré pomáhali s časťami návrhu a optimalizácie. Greg Brockman, prezident OpenAI, tento prístup označil za strategický krok, ktorý pomôže sprístupniť a zefektívniť umelú inteligenciu. Ide o rekurzívnu slučku: AI modely, ktoré dnes spracúvajú dotazy používateľov, pomáhali navrhnúť čip, na ktorom budú ďalšie generácie modelov bežať.
Full-stack prístup k AI
OpenAI pri oznámení hovorí o full-stack stratégii. Modely, kernely, plánovanie úloh, sieťovanie, dátové centrá a používateľské produkty majú byť navrhované tak, aby sa vzájomne podporovali. Takýto prístup poznáme napríklad zo sveta veľkých spotrebiteľských platforiem, kde vlastný hardvér umožnil lepšie zladiť zariadenia, operačný systém a služby .
Zaujímavý je aj deväťmesačný vývojový cyklus od návrhu po tape-out, teda fázu, keď je návrh čipu pripravený na výrobu. Bežne takýto proces trvá 18 až 24 mesiacov. OpenAI tvrdí, že vývoj urýchlili aj vlastné modely, ktoré pomáhali pri častiach návrhu a optimalizácie .
Broadcom ako priemyselný partner
Úloha Broadcomu je pri tomto projekte podstatná. OpenAI prináša znalosti modelov, pracovných záťaží a produktových potrieb, no výroba a škálovanie čipovej platformy si vyžadujú skúsenosti zo sveta polovodičov, sieťovania a dátových centier. Broadcom má v tejto oblasti silné postavenie, najmä pri sieťových technológiách a integrácii do veľkých systémov. Do platformy vstupuje aj Celestica, ktorá má pomáhať s doskami, rackmi a systémovou integráciou.
Jalapeño je najmä strategický krok . OpenAI ním ukazuje, že ďalší vývoj AI nebude závisieť iba od väčších modelov, ale aj od schopnosti prevádzkovať ich efektívnejšie. Ak sa sľuby o výkone na watt a veľkom nasadení potvrdia, vlastný inferenčný hardvér môže byť jednou z kľúčových výhod celej platformy .



