OpenAI har præsenteret de første målte resultater fra Jalapeño, selskabets første specialudviklede chip til inference – den del af AI-driften, hvor en trænet model producerer svar til brugerne.
Ifølge OpenAI blev chippen afprøvet med de åbne modeller GPT-OSS 120B, DeepSeek R1 og Kimi K2.5 på benchmarkplatformen InferenceX. Selskabet oplyser, at Jalapeño på tværs af testene leverede 1,5 til 1,9 gange mere AI-arbejde pr. watt ved maksimal kapacitet og 1,7 til 3,6 gange lavere samlet svartid end sammenligningssystemerne. Resultaterne er offentliggjort af OpenAI selv og bør derfor ses som leverandørens egne benchmarktal.
Bygget til hurtig inference
Jalapeño er udviklet som et samlet system, hvor chip, hukommelse, netværk og software er tilpasset sprogmodellers arbejdsgange. Målet er at begrænse flytning af data og reducere ventetid, især i agentbaserede opgaver med mange trin efter hinanden.
OpenAI fortæller samtidig, at egne AI-modeller blev brugt under udviklingen af chippen og til optimering af software. Selskabet planlægger at begynde udrulningen i sin egen infrastruktur inden udgangen af 2026. Jalapeño er første generation i en planlagt serie, mens både anden og tredje generation allerede er under udvikling.