OpenAI onthult eerste resultaten van Jalapeño-chip

OpenAI heeft de eerste resultaten van zijn Jalapeño-AI-chip gepubliceerd. Die chip is specifiek bedoeld voor inferentie. Volgens het AI-bedrijf heeft Jalapeño 1,5 tot 1,9 keer meer rekenkracht per kilowatt dan Nvidia's Blackwell-chips. Ook de latency zou lager zijn dan bij bestaande systemen.

OpenAI-ceo Sam Altman (links) bij de aankondiging van Jalapeño.
OpenAI-ceo Sam Altman (links)
bij de aankondiging van Jalapeño.

OpenAI heeft Jalapeño getest op InferenceX, een benchmark van SemiAnalysis die meet hoe snel en efficiënt AI-chips taken uitvoeren. Volgens het bedrijf levert Jalapeño bij verschillende opensourcemodellen 1,5 tot 1,9 keer meer throughput per kilowatt. De chip heeft een maximaal vermogen van 700W, maar zou in de tests niet meer dan 550W hebben aangetikt.

Volgens OpenAI is de end-to-endlatency van de chip 1,7 tot 3,6 keer lager dan die van Nvidia's Blackwell-chips. De maximale interactiviteit, die meet hoe snel een chip tokens kan genereren, is 2,7 tot 4,1 keer hoger dan die van Blackwell-chips.

Jalapeño benchmark. Bron: Semi Analysis
Benchmarkresultaten van de Jalapeño-chip. Bron: Semi Analysis

De chip van OpenAI gebruikt tijdens de benchmarks geen 'trucjes' om betere resultaten te boeken, zoals multi token prediction of speculatieve decodering. Jalapeño minimaliseert het transport van data onder meer door de KV-cache helemaal lokaal te houden. Dat zorgt voor een veel lagere latency per token.

Kanttekeningen

Semi Analysis plaatst wel een aantal kanttekeningen bij de resultaten. Zo zijn de cijfers volledig afkomstig van OpenAI. Het onderzoeksbedrijf heeft bepaalde InferenceX-runs wel onafhankelijk geverifieerd, maar niet de volledige benchmark uitgevoerd.

Verder vergelijkt OpenAI zijn chip vooral met Blackwell-chips. Dat is niet helemaal eerlijk, omdat Jalapeño HBM4 gebruikt, terwijl Blackwell HBM3E gebruikt. Verder gebruikt OpenAI niet de AgentX-benchmark. Die krijgt de voorkeur van Semi Analysis, omdat de tests meer realistische gebruiksscenario's nabootsen.

OpenAI wil tegen het eind van het jaar zijn Jalapeño-chips gaan gebruiken. De tweede generatie van de AI-chip is volgens het bedrijf al 'vol in ontwikkeling', terwijl de derde generatie 'steeds meer vorm krijgt'. Het bedrijf benadrukt dat het Nvidia-chips blijft inzetten voor training en inferentie van AI-modellen.

Door Imre Himmelbauer

Redacteur

26-08-2026 • 12:39

24

Submitter: Joelsuperstar

Reacties (24)

Sorteer op:

Weergave:

Het bedrijf benadrukt dat het Nvidia-chips blijft inzetten voor training en inferentie van AI-modellen.
Waarom zouden ze die “trage” NVIDEA chips hiervoor blijven gebruiken als hun eigen chip zoveel sneller is..? Of moeten we toch nog maar even wachten op onafhankelijke testresultaten?
Met name de leveringen zijn het probleem nu, er zijn niet genoeg van dit soort chips en het gaat nog wel even duren voordat hun eigen productie op gang is. tegen die tijd heeft NVIDIA vast wel weer een alternatief wat net zo snel zoniet sneller is.

Ze vergelijken hier met Blackwell en die chip is al van maart 2024...

De opvolger van NVIDIA met ook HBM4 is al in productie..

[Reactie gewijzigd door Navi op 26 augustus 2026 12:53]

Het zijn eigenlijk, niet echt chips maar ASIC’s. En bijna elke custom ASIC is sneller of voordeliger dan die breder toepasbare chips van NVidia. En iedereen heeft ze, Google, Meta, OpenAI en nog een aantal

Ik vind daarom datacenters uitgedrukt in GW erg raar. Dit soort ASICS zijn bijna twee keer sneller per watt in wat ze moeten doen.
Een datacentrum heeft een maximum vermogen qua koeling; dat is waarop gedoeld wordt.

Als chips efficiënter worden, dus meer berekeningen per Watt, dan kan het zijn dat een datacentrum als geheel minder stroom trekt na vervanging van oudere chips met meer efficiënte. Maar er kunnen dan ook gewoon meer chips/servers geplaatst worden, om het vermogen ongeveer hetzelfde te houden maar meer gedaan te krijgen. Want de koelinstallatie kon dat toch al aan, en bedrijven zullen hun productiemiddelen graag volledig inzetten als het gebouw er toch eenmaal staat. Zie ook: Jevon's Paradox.

Hoe dan ook houdt een datacentrum een bepaald maximum vermogen, tenzij ook de koelinstallatie in de toekomst efficiënter kan en opnieuw wordt uitgevoerd. De stroomvoorziening naar het datacentrum zal dat maximumvermogen moeten kunnen leveren, dus dat is waar de infrastructuurbouwers rekening mee moeten houden. Het gebruikte vermogen van moment tot moment hangt af van welke chips er aanwezig zijn en wat het datacentrum allemaal doet, inclusief hoe hoog de vraag is naar rekenkracht.

We zien in de ontwikkeling van chips regelmatig stappen naar minder stroomverbruik, maar ook naar meer. Vooral als de rek eruit is qua optimalisatie dan wordt de extra performance geregeld door juist meer vermogen te trekken: grotere chips, meer chips gestapeld, of hogere frequenties over soortgelijke chips. Dus over de langere tijd weet je niet of chips altijd zuiniger worden, en als dat zo is dan weet je niet of het datacentrum als geheel ook werkelijk zuiniger wordt.

[Reactie gewijzigd door geert1 op 26 augustus 2026 13:31]

Blijft toch een dingetje met die AI bedrijven. Vergelijkingen via de non standaard manieren uitvoeren of eigen metrics gaan verzinnen om vervolgens te zeggen dat ze er beter uitkomen. De toekomst zal wederom weer moeten uitwijzen hoeveel marketing het verhaal bevat.
Waarom is dat een ding? Dit is hun hardware voor hun dienstverlening. Het doel is een lagere kostprijs en een betrouwbare supplychain voor hun dienstverlening. Hoe het werkelijk performed heeft voor particulieren nul waarde
Ja da klopt, vraag me alleen af waarom je als fabrikant dan wil afwijken van de normale testprocedures. Dat doe je mijn inziens alleen omdat de normale procedure waarmee je producten gelijk gemeten zijn met andere producten niet het gewenste marketing resultaat gaf.

Kan verkeerd zijn natuurlijk maar als je eerlijk wil vergelijken gebruik je toch de normale testen?

Anthropic kwam bijvoorbeeld met die “corrected ebita” verwoording. Geen kat ik de financiële wereld die daar ooit al van gehoord had. Dat terwijl het nu toch wel al jaren de standaard is op bedrijfsresultaten onderling te vergelijken op ebita en winst. Vandaar dus dat ik vind dat het bij die AI bedrijven wel allemaal wat op dezelfde manier gaat.
Je kunt niet 123 alle bestaande Nvidia chips vervangen. En Q4 dit jaar komt Nvidia met de opvolger van Blackwell, namelijk Rubin.
Twee dingen: ze moeten ze nog maken... waar is de capaciteit daarvoor? Ten tweede: door het cirkelvormig geld rondpompen is openAI zwaar afhankelijk van het succes en de perceptie omtrent nvidia en andersom; een grote instorting van bijvoorbeeld de nvidia koers zou wel eens het einde van de hele ai bubbel en openai kunnen zijn. "They're walking on egg shells"
Omdat ze geld krijgen van Nvidia om Nvidia chips te kopen :+
Ik weet zelf niet heel veel van de jalapeno chip, maar als die qua hardware puur bedoeld is voor het draaien van modellen dan kan hij een stuk efficiënter zijn, maar zijn er alsnog nvidia kaarten nodig om te trainen. En laatst was er ook nieuws over model specifieke hardware. Enorm snel, maar zodra je een nieuw model wilt gebruiken heb je nieuwe hardware nodig. De benchmark lijkt operaties op hardware niveau te benchmarken, dus dat laatste zal denk ik niet het geval zijn.
Omdat Nvidia een schaalvoordeel heeft waar je U tegen zegt en bewezen technologie is. Deze "Jalapeno" chip is een nieuw ontwerp, dat (nog) niet op schaal geproduceerd wordt en nog niet op schaal getest is.

Dat de chip het goed doet op een benchmark is 1 ding, maar hoe gedraagt het ding zich straks in het datacentrum, zowel op performance als betrouwbaarheid? Dat is de volgende stap, en in de tussentijd leun je ook nog gewoon op Nvidia.
Contracten, verplichte afname .. noem maar eens wat.
Fijne timing van OpenAI met vanavond rond de klok van 22:00u de kwartaalcijfers van Nvidia op het programma 8-)

Kunnen ze benadrukken dat ze Nvidia-chips in blijven zetten, maar er wordt her en der door de grote partijen wel aan de stoelpoten van het 'monopolie' van Nvidia gezaagd.
Goed voor development van zuiniger (of efficiëntere) AI-chips.
Cruciale ontwikkeling, denk ik. Nvidia heeft een bijzonder dominante en naar mijn mening ongezonde marktpositie. Het bedrijf wordt bovendien al langer bekritiseerd vanwege hoge prijzen, vendor lock-in en stevige commerciële praktijken, ook al komt Jensen zelf best sympathiek over.

OpenAI’s chip istrouwens nog geen directe vervanger voor Nvidia’s volledige aanbod, zeker niet voor training. Nvidia’s moat bestaat daarnaast niet alleen uit de chips, maar vooral ook uit CUDA, networking en het complete software-ecosysteem. Dit laat overigens wel echt zien dat grote klanten actief proberen hun afhankelijkheid van Nvidia te verminderen. Dat lijkt me op zijn minst een reden om de extreem hoge verwachtingen rond het aandeel Nvidia opnieuw tegen het licht te houden (lees: SELL).
Dat vind ik uitstekend, want OpenAI en eigenlijk alle andere grote jongens zijn met eigen silicon bezig. Dit lijkt weer op de situatie met Bitcoins destijds: eerst CPU-based, daarna GPU, en daarna komen de ASICs in beeld. Toen eenmaal de eerste redelijk werkende bitcoin-miners met ASICs landden ging de GPU-markt weer naar normaal, want die losse chipjes waren veel sterker.

Ergens vind ik het vreemd dat het zo lang moet duren, Google heeft al 12(!) jaar hun Tensor-dingen, ik geloof dat mijn werklaptop ook een extra NPU heeft, die je toen al absoluut nodig zou moeten gaan hebben (voor onbekende toepassingen die helemaal schitterend zouden zijn, maar nooit gekomen zijn), en zelfs m'n ESP-32 had al zo'n tensor-ding aan boord.

Dusss mooi kerstcadeautje: een nieuwe videokaart :) Voor een redelijke prijs dan.
Voor degenen die het ook niet wisten: HBM staat voor High Bandwidth Memory en de 3/4 zijn de generaties. Een techniek om ram chips te stacken, zo te zien, om meer geheugenbandbreedte te krijgen. Voor llms is geheugenbandbreedte de voornaamste factor voor de prestaties.

[Reactie gewijzigd door brama op 26 augustus 2026 12:55]

Dat valt tegen die cijfers. Aangezien ze namelijk vanuit OpenAI zelf komen, kan je er vanuit gaan dat ze het meest optimistische scenario gebruikt hebben. In de praktijk zal er dus nog wel wat vanaf gaan.

Volgens mij is het ook niet eens zo belangrijk hoeveel sneller ze zijn, veel belangrijker is, hoeveel kunnen ze er produceren? Al zijn ze 2x zo snel en je kunt nog maar een paar procent van de productie van Nvidia evenaren, dan zet het nog steeds niet echt zoden aan de dijk.
Dan zullen ze bij TSMC ruimte moeten kopen, net zoals Nvidia. Ik vermoed dat die volgeboekt zitten, al kan het zijn dat ze liever niet al hun eieren in één mand leggen en dus toch wat ruimte opzij houden voor andere spelers.

Het is onduidelijk wat de impact van het gebruik van HBM 4 -geheugen is op deze resultaten, als ze vergelijken met Blackwell-chips die uit HBM 3 bestaan. Als je kind op deze manier iets "spectaculair" komt vertellen, dan weet je dat je moet doorvragen :-).
Dat valt tegen die cijfers. Aangezien ze namelijk vanuit OpenAI zelf komen, kan je er vanuit gaan dat ze het meest optimistische scenario gebruikt hebben. In de praktijk zal er dus nog wel wat vanaf gaan.
Je kan eigenlijk nergens vanuit gaan als we het niet weten ;)
Al zijn ze 2x zo snel en je kunt nog maar een paar procent van de productie van Nvidia evenaren, dan zet het nog steeds niet echt zoden aan de dijk.
Stel ze maken zelf 3% van wat nvidia maakt en ze nemen nu 50% van alle output van nvidia af, dan gaan ze dus van 50% naar 44% (want 2x zo snel a 3% is 6%), een daling van 12% in de afname van nvidia. Ik vind dat best noemenswaardig, en je moet ook ergens beginnen, je kan moeilijk in een keer volledig afstappen, dus geef het dan nog enkele jaren en nvidia is er niet meer voor nodig.

Vind het erg kortetermijn als je enkel naar deze getallen gaat kijken zonder verder te kijken eigenlijk. Dat ze daadwerkelijk zelf gaan produceren zegt eigenlijk al duidelijk wat de richting is, wat ze ook beloven (voor nu) mbt het blijven gebruiken van nvidia.

[Reactie gewijzigd door watercoolertje op 26 augustus 2026 13:21]

Als de XFX Jalapeño OC uitkomt koop ik 'm meteen, eindelijk gamen op een triple 4k systeem met 300 fps!
Alsof m'n GPUs niet al warm genoeg worden...
Hopelijk wordt het ooit net zo snel als Chat Jimmy. Dat zou toch wat zijn. https://chatjimmy.ai/

Om te kunnen reageren moet je ingelogd zijn