ÉlőUtoljára: 6 órájaMa: 2
Alkalmazásokfrissítve: 12:29

A SmolLM2-360M modell 74%-kal kevesebb RAM-ot használ a llama.cpp-ban

A SmolLM2-360M modell mindössze 380 MB RAM-ot igényel a llama.cpp-ban — elég kis méretű ahhoz, hogy akár egy Samsung Galaxy Watch 4 okosórán is fusson.

A SmolLM2-360M modell 74%-kal kevesebb RAM-ot használ a llama.cpp-ban
Fotó: Daniel Romero / Unsplash
forrás: Reddit LocalLLaMA·AI Forradalom szerk.·
Megosztás

A SmolLM2-360M modell 74%-kal kevesebb RAM-ot használ a llama.cpp-ben, ami 380 MB memóriát igényel a Samsung Galaxy Watch 4-en. A felhasználó a Reddit LocalLLaMA közösségén keresztül mutatta be a futtatási eredményt, ahol a modellel a csatlakoztatott órán 380 MB RAM-mal működött. llama.cpp a nyílt forráskódú LLM futtató, amelyet a felhasználó módosított a kisméretű eszközre optimalizálva.

Ez a csökkenés jelentősen bővíti a hordható eszközökön történő mesterséges intelligencia alkalmazások hatókörét. A 360 millió paraméteres modell korábban csak asztali gépeken vagy szervereken futott hatékonyan, de a 380 MB RAM-s használat lehetővé teszi a valós idejű, offline beszélgetést a Galaxy Watch 4-en.

Az optimalizálás során a fejlesztő a llama.cpp memóriakezelését finomhangolta, hogy a modell kisebb tömörítési arányt és memóriahasználati profilt kapjon. A Reddit bejegyzésben nem részleteztek további technikai paramétereket, de a 74%-os RAM-redukció már önmagában is figyelemre méltó.

Az ilyen eredmények előrevetítik, hogy a hordható eszközökön is képesek leszünk valós idejű AI-alkalmazásokat futtatni, csökkentve a hálózati függőséget és javítva a felhasználói élményt. A következő lépés az, hogy a fejlesztők tovább optimalizálják a modell méretét és a memóriakezelést, miközben megőrzik a válaszminőséget.

Forrás

Feldolgozott sajtóforrás·Reddit LocalLLaMA

Eredeti cikk megnyitása →

Ez a cikk a fenti sajtóforrás alapján készült AI-összefoglalóval.

tetszett a cikk? oszd meg →
Megosztás

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom