OpenAI és Broadcom bemutatta a Jalapeño chipet — kilenc hónap alatt készült el
Az OpenAI első saját tervezésű AI-gyorsítója az LLM-inferencia hatékonyságának növelésére készült, és jövő években nagyvállalati skálán is alkalmazhatóvá válik.

Az OpenAI és a Broadcom bemutatta a Jalapeño nevű, LLM-inferenciára optimalizált chipet. A kilenc hónap alatt kifejlesztett gyorsító állítólag jelentősen jobb teljesítményt nyújt, és gigawattos adatközponti telepítésre készül — közölte az OpenAI.
A Jalapeño az OpenAI első saját tervezésű AI-gyorsítója, amely a cég víziója alapján készült az LLM-inferencia jövőjére. Az új hardver a jelenlegi és a jövőbeli LLM-ek futtatására optimalizált, és nem egy általános célú gyorsító átalakított változata. Az OpenAI célja, hogy a chip a mai vezető AI-gyorsítók erejét és átviteli sebességét ötvözze a leggyorsabb, speciális inferenciarendszerekhez hasonló alacsony késleltetéssel.
Kapcsolódó: chipgyártás finanszírozása
Teljeskörű stratégia
A Jalapeño az OpenAI teljeskörű stratégiájának része, amely magában foglalja a csúcskategóriás modellek fejlesztését, az infrastruktúra tervezését, beleértve a chip architektúrát, a kernelfüggvényeket, a memóriarendszereket, a hálózatkezelést és az ütemezést. Az OpenAI szerint ez a megközelítés lehetővé teszi a modellek gyorsabbá, megbízhatóbbá és megfizethetőbbé tételét a felhasználók számára.
Kapcsolódó: chipellátási partnerség
Gyors fejlesztés és jövőbeli tervek
A chipet mindössze kilenc hónap alatt tervezték meg és gyártották le, ami az OpenAI szerint a leggyorsabb ASIC-fejlesztési ciklus a nagy teljesítményű félvezetőiparban. A fejlesztést az OpenAI modelljei is gyorsították, amelyek segítettek a tervezési és optimalizálási folyamatokban. A Jalapeño egy többgenerációs számítási platform első lépése, amelyet az OpenAI adatközpont-partnereivel közösen kíván telepíteni 2026 végére, és az elkövetkező években tovább bővíteni.
Kapcsolódó: biológiai kutatás AI-val
Az OpenAI szerint a chip fejlesztésének célja, hogy a fejlett AI-t szélesebb körben elérhetővé tegye. Az inferencia az a pont, ahol az AI eléri az embereket, és minden költség-, sebesség- és megbízhatóságbeli javulás gyorsabb ChatGPT-válaszokat, olcsóbb API-termékeket vagy megbízhatóbb hozzáférést jelenthet.
Kapcsolódó: tokenhatékony LLM-stratégia