OpenAI’s Jalapeño chip is built for fast inference at scale, benchmarks show
中文摘要
OpenAI的Jalapeño芯片在推理速度与能效方面均超越现有顶尖技术。
English Summary
OpenAI’s Jalapeño chip outperforms current state-of-the-art in inference speed and energy efficiency.
Original Excerpt
Tested on Semianalysis’s InferenceX benchmark, Jalapeño registered both more tokens per user and more throughput per kilowatt than the currently available state-of-the art.