OpenAI:s första egna AI-chip Jalapeño har testats i skarpt läge och slog konkurrenterna med bred marginal.
I ett nytt benchmark från analysfirman SemiAnalysis levererade det så kallade Jalapeño-chippet mellan 1,5 och 1,9 gånger så mycket AI-arbete per kilowatt som dagens bästa alternativ från Nvidia, och svarstiderna från början till slut var mellan 1,7 och 3,6 gånger lägre. Chippet är byggt tillsammans med Broadcom och är riktat specifikt mot att köra OpenAI:s modeller, inte att träna dem.
För en vanlig ChatGPT-användare är det inte en abstrakt siffra. Jalapeño är designat för det som händer varje gång någon trycker på skicka i chatten: att kroka i modellen och skicka tillbaka ett svar så snabbt och billigt som möjligt.
Nio månader från ritning till fabrik
Chippet presenterades den 24 juni 2026 av OpenAI och Broadcom, och partnerskapet beskrevs redan då som ett flergenerationsprojekt. Enligt VentureBeat gick OpenAI från de första skisserna till fabriksfärdig hårdvara på nio månader, en cykel som normalt mäts i år för avancerad halvledarindustri. OpenAI ska själv ha använt sina egna modeller för att snabba upp designarbetet.
Richard Ho, som leder hårdvaruarbetet på OpenAI, kommenterade de färska mätningarna vid Hot Chips-konferensen den 25 augusti: ”Resultaten visar ett mycket, mycket signifikant prestandalyft jämfört med dagens bästa”, sa han till TechCrunch. Poängen enligt Ho är dubbel: Jalapeño ska klara mer AI-arbete per kilowatt och samtidigt ge snabbare svar per användare.
Ska bära ChatGPT, Codex och kommande agenter
Kärnan i satsningen är att OpenAI vill äga mer av sin egen underliggande hårdvara i stället för att lita helt på inköpta grafikkort. Bolaget har uppgett att produktlinjerna som legat till grund för designen inkluderar ChatGPT, kodmodellen Codex och framtida agentprodukter. Arkitekturen är enligt bolaget optimerad kring det som gör störst skillnad i praktiken: hur data flyttas mellan minne, beräkning och nätverk.
Greg Brockman, medgrundare och president på OpenAI, satte det så här i samband med lanseringen: ”Genom att designa mer av stacken själva kan vi leverera mer intelligens med större effektivitet och fortsätta driva avancerad AI mot bredare tillgång”. OpenAI har samtidigt sagt att målet är att kunna erbjuda billigare tjänster och kortare väntetider när efterfrågan är hög.
Först i små volymer, större utrullning nästa år
Trots benchmark-resultaten ligger den breda utrullningen fortfarande framför. Jalapeño rullar ut i OpenAI:s datacenter i mycket små volymer under slutet av 2026, och först under 2027 väntas betydligt större volymer. Broadcom-vd:n Hock Tan har beskrivit satsningen som starten på ett samarbete i gigawatt-skala. ”Genom att utveckla vårt branschledande kisel direkt med OpenAI möjliggör vi datacenter i gigawatt-skala med Microsoft och andra partners med start 2026”, sa han i samband med lanseringen.
Ramen kring det är att OpenAI och Broadcom i oktober 2025 gick ut med planen om att bygga tillräckligt med chip-rack för tio gigawatts effektbehov, motsvarande hela nationers strömförbrukning.
Nästa hållpunkt är volymproduktionen 2027, då Jalapeño-baserade system för första gången väntas driva delar av OpenAI:s produkter i skarpt läge.