OpenAI’s Jalapeño chip is built for fast inference at scale, benchmarks show

Share

OpenAI has developed a custom chip called Jalapeño designed for efficient AI model inference at scale, demonstrating superior performance metrics on industry benchmarks. The chip shows improved tokens per user and throughput per kilowatt compared to existing state-of-the-art solutions.


Source: TechCrunch