OpenAI’s Jalapeño chip is built for fast inference at scale, benchmarks show
中文摘要
OpenAI的Jalapeño芯片在推理速度与能效方面均超越现有顶尖技术。
English Summary
OpenAI’s Jalapeño chip outperforms current state-of-the-art in inference speed and energy efficiency.
原文节选
Tested on Semianalysis’s InferenceX benchmark, Jalapeño registered both more tokens per user and more throughput per kilowatt than the currently available state-of-the art.