OpenAI představuje Jalapeño, svůj čip pro umělou inteligenci, který v efektivitě a rychlosti překonává Nvidii

  • Procesor Jalapeño, vyvinutý ve spolupráci se společností Broadcom, dosahuje v inferenčních testech 1,5 až 1,9krát vyššího výkonu na watt a až 3,6krát nižší latence než Nvidia GB200 a GB300.
  • Čip je navržen výhradně pro spouštění předtrénovaných modelů, nikoli pro jejich trénování, a spotřebovává přibližně 700 wattů, což by mohlo snížit provozní náklady datových center.
  • OpenAI plánuje nasadit první systémy s Jalapeño do konce roku 2026 a rozšířit jeho využití během roku 2027, přičemž již pracuje na druhé a třetí generaci.
  • Společnost si udržuje spojenectví s Nvidií pro modelový trénink, ale snaží se diverzifikovat svou infrastrukturu a snížit závislost na jediném poskytovateli.

OpenAI Jalapeño Chip

Společnost OpenAI učinila významný krok ve své strategii technologické nezávislosti prezentací prvních výsledků svého vlastního procesoru pro umělou inteligenci s názvem Jalapeño. Tento čip zaměřený na inferenci, vyvinutý ve spolupráci se společností Broadcom, překonal akcelerátory Nvidia GB200 a GB300 ve dvou klíčových metrikách: výpočetní výkon na watt a rychlost odezvy. Data zveřejněná na konferenci Hot Chips a o nichž informovaly servery jako Bloomberg a The Verge, staví OpenAI do bezprecedentního postavení v závodě hardwaru umělé inteligence.

To není malé oznámení. Až doposud se OpenAI pro běh svých modelů téměř výhradně spoléhala na procesory Nvidia, a to jak ve fázi trénování, tak i inference – tedy když systém reaguje na dotazy uživatelů. S čipem Jalapeño si společnost klade za cíl snížit provozní náklady a získat kontrolu nad svou infrastrukturou, aniž by se však Nvidie zcela vzdala. Podle Richarda Ho, vedoucího hardwaru OpenAI, čip nabízí to, co nazývá „to nejlepší z obou světů“: vysokou kapacitu pro současný provoz mnoha klientů a nízkou latenci pro interaktivní aplikace.

OpenAI a Broadcom
Související článek:
OpenAI a Broadcom spolupracují na zakázkových čipech pro umělou inteligenci

Co je Jalapeño a jak to funguje?

Jalapeño je aplikačně specifický integrovaný obvod (ASIC), navržený od základu pro jediný úkol: spouštění předtrénovaných jazykových modelů. Na rozdíl od grafických procesorů Nvidia, které jsou univerzálními procesory, je tento čip optimalizován pro fázi inference, kde systém zpracovává požadavek a generuje odpověď. Není určen pro trénování modelů, což je úkol, který zůstává doménou grafických procesorů Nvidia a který bude OpenAI i nadále pro tento účel používat.

Konstrukce čipu se zaměřuje na snížení úzkých míst, ke kterým obvykle dochází během inference, jako je například přesun dat mezi pamětí a výpočetními jednotkami. Podle společnosti Jalapeño integruje velkou výpočetní sekci spolu se šesti bloky paměti s vysokou šířkou pásma (HBM), což umožňuje uchovávat data lokálně a zabránit zbytečným přenosům. Čip navíc dokáže aktivovat vhodnou kombinaci zdrojů pro každou fázi zpracování, čímž se zlepšuje jak výkon, tak energetická účinnost umělé inteligence.

Anthropic a vlastní čip umělé inteligence od Samsungu
Související článek:
Společnosti Anthropic a Samsung jednají o vytvoření vlastního čipu s umělou inteligencí, aby zpochybnily dominanci Nvidie.

Výsledky benchmarků proti Nvidii

Testy byly provedeny s využitím veřejné platformy InferenceX od společnosti SemiAnalysis, která měří výkon systémů umělé inteligence v reálných podmínkách. OpenAI porovnala Jalapeño s nejlepšími výsledky dosaženými superčipy Nvidia GB200 a GB300, což byly v době testování dostupné benchmarky. Výsledky ukázaly, že Jalapeño dosahuje 1,5 až 1,9krát více práce umělé inteligence na watt a latence mezi konci je 1,7 až 3,6krát nižší. V testovací sadě byly použity modely GPT-OSS 120B, DeepSeek R1 a Kimi K3 , což je mix modelů od otevřených až po modely na hranici možností.

Tato čísla jsou obzvláště relevantní, protože energetická účinnost se stala jednou z hlavních výzev v tomto odvětví. Datová centra s umělou inteligencí spotřebovávají obrovské množství elektřiny a snížení spotřeby na jednotku práce může vést k významným úsporám. Podle Richarda Hoa pracuje Jalapeño s příkonem kolem 700 wattů, což je pro inferenční akcelerátor relativně nízká hodnota, a podle generálního ředitele společnosti Broadcom Hocka Tana by mohl snížit provozní náklady přibližně o 50 % ve srovnání s konvenčními GPU.

nedostatek čipů pro umělou inteligenci
Související článek:
Dokonalá bouře křemíku: proč tu nedostatek čipů pro umělou inteligenci přetrvává

Spolupráce se společností Broadcom a plán

Vývoj čipu Jalapeño je výsledkem strategické aliance mezi OpenAI a Broadcomem, oznámené v říjnu 2025. Broadcom přispívá svými odbornými znalostmi v oblasti návrhu, sítí a výroby křemíkových čipů, zatímco OpenAI využila vlastní modely umělé inteligence k urychlení procesu návrhu. Čip prošel od počátečního návrhu k výrobě, tedy finální fázi před výrobou, za pouhých devět měsíců – rekordní čas pro pokročilý polovodič.

OpenAI již pracuje na druhé generaci procesoru a třetí je ve vývoji. Společnost plánuje nasadit první systémy s Jalapeño ve velmi malých objemech do konce roku 2026 a výrazně rozšířit jeho využití během roku 2027. Podle agentury Bloomberg bude nasazení probíhat v datových centrech společnosti Microsoft a dalších partnerů a očekává se, že do roku 2029 dosáhne rozsahu 10 gigawattů výpočetního výkonu. Prezentované výsledky jsou však předběžné a dosud nebyly ověřeny ve velkém produkčním prostředí.

Důsledky pro trh a uživatele

Příchod Jalapeña neznamená, že OpenAI opouští Nvidii. Společnost trvá na tom, že Nvidia zůstává klíčovým partnerem, zejména pro trénování modelů, a že poptávka po výpočetním výkonu je tak vysoká, že potřebuje více dodavatelů. OpenAI ve skutečnosti spolupracuje také se společnostmi AMD a Cerebras a její strategie zahrnuje budování heterogenní infrastruktury, kde je každá úloha přiřazena nejefektivnějšímu hardwaru.

Pro uživatele a vývojáře má tato zpráva přímé důsledky. Pokud Jalapeño splní své sliby, cena za inferenční token by mohla v příštích 18 měsících klesnout o 30 % až 50 %, což by startupům a společnostem umožnilo nabízet dostupnější služby umělé inteligence s nižší latencí. Konkurence na trhu s čipy umělé inteligence se navíc zintenzivňuje, což by se mohlo promítnout do lepších cen a více možností pro koncové uživatele.

Konečně stojí za zmínku, že testy nezahrnovaly srovnání s novou architekturou Vera Rubin od Nvidie, která se začala dodávat teprve nedávno. Výhoda Jalapeño by se proto mohla s vydáním další generace od Nvidie zmenšit. Pokrok OpenAI však ukazuje, že odvětví umělé inteligence vstupuje do nové fáze, kde bude hrát stále důležitější roli zakázkový hardware. Závod o efektivitu a rychlost teprve začal.

Amazon integruje technologii Nvidia do čipů s umělou inteligencí a spustí nové servery
Související článek:
Amazon integruje technologii Nvidia do svých čipů s umělou inteligencí a uvede na trh nové servery Trainium

Přidat jako preferovaný zdroj v Googlu