OpenAI heeft de eerste resultaten van zijn Jalapeño-AI-chip gepubliceerd. Die chip is specifiek bedoeld voor inferentie. Volgens het AI-bedrijf heeft Jalapeño 1,5 tot 1,9 keer meer rekenkracht per kilowatt dan Nvidia's Blackwell-chips. Ook de latency zou lager zijn dan bij bestaande systemen.
bij de aankondiging van Jalapeño.
OpenAI heeft Jalapeño getest op InferenceX, een benchmark van SemiAnalysis die meet hoe snel en efficiënt AI-chips taken uitvoeren. Volgens het bedrijf levert Jalapeño bij verschillende opensourcemodellen 1,5 tot 1,9 keer meer throughput per kilowatt. De chip heeft een maximaal vermogen van 700W, maar zou in de tests niet meer dan 550W hebben aangetikt.
Volgens OpenAI is de end-to-endlatency van de chip 1,7 tot 3,6 keer lager dan die van Nvidia's Blackwell-chips. De maximale interactiviteit, die meet hoe snel een chip tokens kan genereren, is 2,7 tot 4,1 keer hoger dan die van Blackwell-chips.
De chip van OpenAI gebruikt tijdens de benchmarks geen 'trucjes' om betere resultaten te boeken, zoals multi token prediction of speculatieve decodering. Jalapeño minimaliseert het transport van data onder meer door de KV-cache helemaal lokaal te houden. Dat zorgt voor een veel lagere latency per token.
Kanttekeningen
Semi Analysis plaatst wel een aantal kanttekeningen bij de resultaten. Zo zijn de cijfers volledig afkomstig van OpenAI. Het onderzoeksbedrijf heeft bepaalde InferenceX-runs wel onafhankelijk geverifieerd, maar niet de volledige benchmark uitgevoerd.
Verder vergelijkt OpenAI zijn chip vooral met Blackwell-chips. Dat is niet helemaal eerlijk, omdat Jalapeño HBM4 gebruikt, terwijl Blackwell HBM3E gebruikt. Verder gebruikt OpenAI niet de AgentX-benchmark. Die krijgt de voorkeur van Semi Analysis, omdat de tests meer realistische gebruiksscenario's nabootsen.
OpenAI wil tegen het eind van het jaar zijn Jalapeño-chips gaan gebruiken. De tweede generatie van de AI-chip is volgens het bedrijf al 'vol in ontwikkeling', terwijl de derde generatie 'steeds meer vorm krijgt'. Het bedrijf benadrukt dat het Nvidia-chips blijft inzetten voor training en inferentie van AI-modellen.
/i/2008326958.png?f=imagenormal)
:strip_icc():strip_exif()/u/177567/crop5f8591cadf088_cropped.jpeg?f=community)
:strip_icc():strip_exif()/u/35767/images.jpg?f=community)
/u/243953/crop56f55a7bcf291.png?f=community)
:strip_icc():strip_exif()/u/71115/plus222.jpg?f=community)
:strip_icc():strip_exif()/u/218/em.jpg?f=community)
:strip_icc():strip_exif()/u/134130/crop656d9955ccc54.jpg?f=community)
:strip_icc():strip_exif()/u/174878/SCKnightMicro.jpg?f=community)
:strip_icc():strip_exif()/u/23149/240px-Basil_Fawlty.jpg?f=community)
:strip_icc():strip_exif()/u/249917/jaapschaap.jpg?f=community)
/u/722808/crop5c59d573bb7ca_cropped.png?f=community)