ÉlőUtoljára: 20 perceMa: 22
Alkalmazásokfrissítve: 17:15

Valós idejű hangalapú AI-t hoz a Hugging Face és a Cerebras a Gemma 4-gyel

A Hugging Face és a Cerebras új, valós idejű hangalapú AI-rendszere drámaian csökkenti a válaszidőt, természetesebb beszélgetéseket téve lehetővé, és már 9000 robotban fut.

Valós idejű hangalapú AI-t hoz a Hugging Face és a Cerebras a Gemma 4-gyel
Fotó: Steve A Johnson / Unsplash
forrás: Hugging Face·AI Forradalom szerk.·
Megosztás

A Hugging Face és a Cerebras bemutatta, hogyan tehető természetesebbé a hangalapú AI kommunikáció. Az új rendszer drámaian csökkenti a válaszidőt, így a beszélgetések emberi interakcióhoz hasonlóan gördülékenyek lehetnek. A megoldás a nyílt forráskódú AI-ökoszisztéma erejét és a Cerebras iparágvezető inferencia sebességét ötvözi.

Moduláris, kaszkádolt beszédfeldolgozó architektúra

A demó egy valós idejű speech-to-speech (beszédfelismerés és szöveggenerálás) folyamatként épül fel. Minden komponens moduláris, nyílt és cserélhető, ami lehetővé teszi a fejlesztők számára, hogy könnyen adaptálják a rendszert különböző asszisztensekhez, robotokhoz vagy termékekhez. Az architektúra a következőkből áll: beszédfelismerés az Nvidia Parakeetjével, Gemma 4 VLM inferencia a Cerebrason, majd szöveg-beszéd átalakítás az Alibaba Qwen3TTS-ével. Ez a nyílt megközelítés lehetővé teszi a fejlesztők számára az egyes rétegek ellenőrzését, módosítását és bővítését — írja a Hugging Face Blog.

Kapcsolódó: Google valós idejű AI

Cerebras és Hugging Face partnerség

A valós idejű rendszerekben a latencia kritikus paraméter. Bár a modellminőség terén hatalmas előrelépések történtek, a felhasználói élményt gyakran a válaszidő korlátozza. A Cerebras jelentősen felgyorsítja és stabilizálja a Gemma 4 inferenciáját, ami kulcsfontosságú a nyelvmodell válaszadási idejének csökkentésében. Ez a sebesség és stabilitás különösen a hosszú beszélgetések során válik fontossá, ahol a váratlan késedelmek megbízhatatlanná tehetik a kommunikációt.

Kapcsolódó: Gemma 3 token generálás

Valós idejű interakcióra építve

Ugyanez a Hugging Face speech-to-speech folyamat már több mint 9000 Reachy Mini robotban működik. A robotok, hangalapú asszisztensek és beágyazott AI rendszerek esetében a gyors válaszadás nem csupán kozmetikai fejlesztés, hanem az interakció „életre keltésének” kulcsa. A Cerebras használatának motivációja nem csak a költségcsökkentés, hanem az alacsony latencia, a kiszámítható teljesítmény és a valós idejű élmények létrehozásának képessége. Ez az együttműködés azt a közös hitet tükrözi, hogy az AI jövője egyszerre lesz nyílt és performáns. A Hugging Face és a Cerebras jelenleg több mint 9000 robotban futtatja a rendszert.

Kapcsolódó: ml-intern Qwen3 optimalizálás

tetszett a cikk? oszd meg →
Megosztás

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom