OpenAI's Jalapeño chip is built for fast inference at scale, benchmarks show
OpenAI released early benchmark results for Jalapeño, its first custom inference chip built with Broadcom. On the SemiAnalysis InferenceX benchmark, Jalapeño-based systems delivered 1.5x-1.9x more throughput and 1.7x-3.6x lower latency than current state-of-the-art GPU systems across models like GPT-OSS-120B and DeepSeek R1, while using significantly less power per rack.
techcrunch.com ↗