OpenAI uvádí u čipu Jalapeño až 1,9krát více práce na watt
První vlastní čip OpenAI pro běh modelů má podle výsledků výrobce zvládnout 1,5 až 1,9krát více práce na watt než srovnávané systémy Nvidia. Při stejné práci by to znamenalo o 33 až 47 procent méně energie. Jalapeño zároveň dosáhlo nižší latence, čísla však zatím nikdo nezopakoval nezávisle.

OpenAI zveřejnilo 25. srpna 2026 první výsledky čipu Jalapeño, který navrhlo s Broadcomem pro běh velkých jazykových modelů. V benchmarku InferenceX má proti srovnávaným systémům Nvidia zvládnout 1,5 až 1,9krát více práce na watt. Tohle číslo pochází od výrobce čipu, nikoli od nezávislé laboratoře.
Jalapeño je první vlastní inferenční čip OpenAI. Neučí modely, ale počítá jejich odpovědi poté, co už jsou natrénované. Firma ho na konferenci Hot Chips postavila proti systémům s akcelerátory Nvidia GB200 a GB300 a měřila tři otevřeně dostupné modely: GPT-OSS 120B, DeepSeek R1 670B a Kimi K2.5 1T. Podle TechCrunch jde o čip zaměřený na rychlou odezvu ve velkém provozu, ne o univerzální náhradu všech akcelerátorů.
Stejná práce by spotřebovala o třetinu až polovinu méně
Údaj „práce na watt“ říká, kolik výpočtu systém provede z každé jednotky energie. Pokud Jalapeño při stejné zátěži skutečně dosahuje 1,5násobné účinnosti, potřebuje na tutéž práci dvě třetiny energie, tedy o 33 procent méně. Při 1,9násobku je to přibližně 53 procent původní spotřeby, úspora skoro 47 procent. Jde o náš přepočet z poměrů OpenAI, ne o další měření.
Samotný příkon čipu má jmenovitou hodnotu 700 wattů. OpenAI uvádí, že při testech Jalapeño trvale nepřekročilo 550 wattů. To není totéž jako spotřeba celého serveru: paměti, procesory, síť a chlazení si berou další energii. Zveřejněný poměr je proto užitečný pro srovnání testovaných sestav, ale z jednoho čísla nelze spočítat účet za celé datové centrum.
Výrobce naměřil také kratší čekání na odpověď
Druhým výsledkem je koncová latence, tedy čas od přijetí požadavku po dokončení odpovědi. OpenAI hlásí 1,7 až 3,6krát nižší latenci a u interaktivní zátěže 2,1 až 4,1krát vyšší výkon. Právě spojení obou veličin je důležité. Server může vyrobit hodně tokenů za sekundu tím, že požadavky spojí do velkých dávek, ale jednotlivý člověk pak čeká. Jalapeño má podle zveřejněných grafů zvýšit propustnost bez stejné daně v podobě čekání.
Srovnání má několik pevných bodů: testované modely jsou pojmenované, InferenceX je veřejný benchmark a protihráči nejsou neurčitá „běžná GPU“, nýbrž systémy GB200 a GB300. Chybí však úplné zopakování někým, kdo čip nevyrábí ani nenasazuje. Také The Verge výsledky popisuje jako benchmarky zveřejněné OpenAI. Veřejná metodika tedy usnadňuje kontrolu podmínek, sama z firemního testu nezávislý test neudělá.
První kusy mají přijít letos
OpenAI počítá s nasazením malých objemů do konce roku 2026 a s větším rozšířením v roce 2027. Současně vyvíjí druhou generaci a připravuje třetí. Firma výslovně neříká, že akcelerátory Nvidia opustí. Vlastní čip jí dává další zdroj výpočetního výkonu pro jednu přesně vymezenou úlohu, zatímco trénování a ostatní zátěže mohou dál běžet na jiném hardwaru.
Do návrhu se zapojila i umělá inteligence. OpenAI uvádí, že se čip dostal od začátku návrhu k odeslání výrobních podkladů za devět měsíců. U vybraných bloků pro GPT-OSS byly implementace vytvořené s pomocí AI 1,5 až 1,8krát rychlejší než dřívější ruční varianty. Výrok se vztahuje jen k těmto blokům, ne k celému modelu ani k celému čipu.
Nejpřesnější závěr z prvních výsledků proto není, že Jalapeño „porazilo Nvidii“. OpenAI ukázalo, že jeho čip ve zvolených testech slibuje méně energie a kratší čekání při obsluze velkých modelů. Jestli se stejný náskok udrží v běžném provozu a v cizím měření, se ukáže až s dostupností skutečných systémů.