OpenAI har offentliggjort de første målte resultater fra Jalapeño, virksomhedens egen chip til AI-svar. Ifølge OpenAIs tekniske gennemgang kan chippen udføre mere AI-arbejde per watt og samtidig svare hurtigere end de kommercielle systemer i sammenligningen.
Det er ikke en ny ChatGPT-model. Det er infrastrukturen bag svaret. Hvis tallene holder, når chippen bliver sat i almindelig drift, kan OpenAI levere flere svar med mindre strøm og færre servere. Det kan give lavere omkostninger, kortere ventetid eller mere kapacitet. Det giver ikke automatisk en lavere pris på abonnementet.
Resultaterne kommer fra OpenAI
Jalapeño er testet med den offentlige InferenceX-benchmark på GPT-OSS 120B, DeepSeek R1 og Kimi K2.5. OpenAI oplyser, at chippen på tværs af de tre modeller leverede 1,5 til 1,9 gange mere AI-arbejde per watt ved maksimal belastning og 1,7 til 3,6 gange lavere samlet forsinkelse end de sammenlignede systemer.
Det er konkrete tal, men de er målt og udlagt af virksomheden, der har udviklet chippen. Den egentlige prøve kommer, når Jalapeño kører stabilt i stor skala og kan sammenlignes på pris, oppetid og ydelse under almindelige arbejdsbelastninger.
OpenAI vil kontrollere mere af hele systemet
OpenAI har udviklet chip, hukommelse, netværk og server-software som ét samlet system. Pointen er at undgå unødig flytning af data og holde de forskellige dele af en AI-forespørgsel tættere på hinanden.
Det giver virksomheden mere kontrol over både hastighed og økonomi. Samtidig fortsætter OpenAI med at bruge acceleratorer fra blandt andre Nvidia og andre partnere. Egen chip er derfor ikke et fuldt farvel til leverandørerne, men et ekstra kort på hånden, når kapacitet og priser skal forhandles.
Udrulningen begynder inden årets udgang
OpenAI planlægger at begynde udrulningen i sin egen infrastruktur inden udgangen af 2026. Anden generation er allerede under udvikling, mens en tredje generation er ved at tage form.
For danske virksomheder og udviklere er chipnavnet mindre vigtigt end resultatet. Hvis Jalapeño kan ses i hurtigere API-svar, bedre stabilitet og lavere pris per løst opgave, betyder den noget. Indtil da er det et lovende stykke intern infrastruktur med imponerende tal fra producentens egen målebænk.
Aktører i artiklen








