Back to news
world·

OpenAI says Jalapeño cuts latency up to 3.6x, targeting the bottleneck that slows agents

OpenAI says Jalapeño cuts latency up to 3.6x, targeting the bottleneck that slows agents

OpenAI said its first custom inference chip, Jalapeño, delivered faster responses and better power efficiency than competing systems in tests across several large language models. The findings could matter for global users, as cheaper, lower-latency AI infras…

OpenAI said its first custom inference chip, Jalapeño, delivered faster responses and better power efficiency than competing systems in tests across several large language models. The findings could matter for global users, as cheaper, lower-latency AI infras…
Read original at Digitimes