
Společnost OpenAI učinila významný krok ve své strategii technologické nezávislosti prezentací prvních výsledků svého vlastního procesoru pro umělou inteligenci s názvem Jalapeño. Tento čip zaměřený na inferenci, vyvinutý ve spolupráci se společností Broadcom, překonal akcelerátory Nvidia GB200 a GB300 ve dvou klíčových metrikách: výpočetní výkon na watt a rychlost odezvy. Data zveřejněná na konferenci Hot Chips a o nichž informovaly servery jako Bloomberg a The Verge, staví OpenAI do bezprecedentního postavení v závodě hardwaru umělé inteligence.
To není malé oznámení. Až doposud se OpenAI pro běh svých modelů téměř výhradně spoléhala na procesory Nvidia, a to jak ve fázi trénování, tak i inference – tedy když systém reaguje na dotazy uživatelů. S čipem Jalapeño si společnost klade za cíl snížit provozní náklady a získat kontrolu nad svou infrastrukturou, aniž by se však Nvidie zcela vzdala. Podle Richarda Ho, vedoucího hardwaru OpenAI, čip nabízí to, co nazývá „to nejlepší z obou světů“: vysokou kapacitu pro současný provoz mnoha klientů a nízkou latenci pro interaktivní aplikace.
Co je Jalapeño a jak to funguje?
Jalapeño je aplikačně specifický integrovaný obvod (ASIC), navržený od základu pro jediný úkol: spouštění předtrénovaných jazykových modelů. Na rozdíl od grafických procesorů Nvidia, které jsou univerzálními procesory, je tento čip optimalizován pro fázi inference, kde systém zpracovává požadavek a generuje odpověď. Není určen pro trénování modelů, což je úkol, který zůstává doménou grafických procesorů Nvidia a který bude OpenAI i nadále pro tento účel používat.
Konstrukce čipu se zaměřuje na snížení úzkých míst, ke kterým obvykle dochází během inference, jako je například přesun dat mezi pamětí a výpočetními jednotkami. Podle společnosti Jalapeño integruje velkou výpočetní sekci spolu se šesti bloky paměti s vysokou šířkou pásma (HBM), což umožňuje uchovávat data lokálně a zabránit zbytečným přenosům. Čip navíc dokáže aktivovat vhodnou kombinaci zdrojů pro každou fázi zpracování, čímž se zlepšuje jak výkon, tak energetická účinnost umělé inteligence.
Výsledky benchmarků proti Nvidii
Testy byly provedeny s využitím veřejné platformy InferenceX od společnosti SemiAnalysis, která měří výkon systémů umělé inteligence v reálných podmínkách. OpenAI porovnala Jalapeño s nejlepšími výsledky dosaženými superčipy Nvidia GB200 a GB300, což byly v době testování dostupné benchmarky. Výsledky ukázaly, že Jalapeño dosahuje 1,5 až 1,9krát více práce umělé inteligence na watt a latence mezi konci je 1,7 až 3,6krát nižší. V testovací sadě byly použity modely GPT-OSS 120B, DeepSeek R1 a Kimi K3 , což je mix modelů od otevřených až po modely na hranici možností.
Tato čísla jsou obzvláště relevantní, protože energetická účinnost se stala jednou z hlavních výzev v tomto odvětví. Datová centra s umělou inteligencí spotřebovávají obrovské množství elektřiny a snížení spotřeby na jednotku práce může vést k významným úsporám. Podle Richarda Hoa pracuje Jalapeño s příkonem kolem 700 wattů, což je pro inferenční akcelerátor relativně nízká hodnota, a podle generálního ředitele společnosti Broadcom Hocka Tana by mohl snížit provozní náklady přibližně o 50 % ve srovnání s konvenčními GPU.
Spolupráce se společností Broadcom a plán
Vývoj čipu Jalapeño je výsledkem strategické aliance mezi OpenAI a Broadcomem, oznámené v říjnu 2025. Broadcom přispívá svými odbornými znalostmi v oblasti návrhu, sítí a výroby křemíkových čipů, zatímco OpenAI využila vlastní modely umělé inteligence k urychlení procesu návrhu. Čip prošel od počátečního návrhu k výrobě, tedy finální fázi před výrobou, za pouhých devět měsíců – rekordní čas pro pokročilý polovodič.
OpenAI již pracuje na druhé generaci procesoru a třetí je ve vývoji. Společnost plánuje nasadit první systémy s Jalapeño ve velmi malých objemech do konce roku 2026 a výrazně rozšířit jeho využití během roku 2027. Podle agentury Bloomberg bude nasazení probíhat v datových centrech společnosti Microsoft a dalších partnerů a očekává se, že do roku 2029 dosáhne rozsahu 10 gigawattů výpočetního výkonu. Prezentované výsledky jsou však předběžné a dosud nebyly ověřeny ve velkém produkčním prostředí.
Důsledky pro trh a uživatele
Příchod Jalapeña neznamená, že OpenAI opouští Nvidii. Společnost trvá na tom, že Nvidia zůstává klíčovým partnerem, zejména pro trénování modelů, a že poptávka po výpočetním výkonu je tak vysoká, že potřebuje více dodavatelů. OpenAI ve skutečnosti spolupracuje také se společnostmi AMD a Cerebras a její strategie zahrnuje budování heterogenní infrastruktury, kde je každá úloha přiřazena nejefektivnějšímu hardwaru.
Pro uživatele a vývojáře má tato zpráva přímé důsledky. Pokud Jalapeño splní své sliby, cena za inferenční token by mohla v příštích 18 měsících klesnout o 30 % až 50 %, což by startupům a společnostem umožnilo nabízet dostupnější služby umělé inteligence s nižší latencí. Konkurence na trhu s čipy umělé inteligence se navíc zintenzivňuje, což by se mohlo promítnout do lepších cen a více možností pro koncové uživatele.
Konečně stojí za zmínku, že testy nezahrnovaly srovnání s novou architekturou Vera Rubin od Nvidie, která se začala dodávat teprve nedávno. Výhoda Jalapeño by se proto mohla s vydáním další generace od Nvidie zmenšit. Pokrok OpenAI však ukazuje, že odvětví umělé inteligence vstupuje do nové fáze, kde bude hrát stále důležitější roli zakázkový hardware. Závod o efektivitu a rychlost teprve začal.


