ÉlőUtoljára: 10 órájaMa: 0
Kutatásfrissítve: 17:10

A fizikai AI 2.0 új architektúrája pontosabbá teszi a robotok valóság-érzékelését

A fizikai AI 2.0 új architektúrája a valóság torz adatai alapján is pontosabb képet fest a robotok környezetéről, de a puszta adatnövelés nem elég.

A fizikai AI 2.0 új architektúrája pontosabbá teszi a robotok valóság-érzékelését
Fotó: Declan Sun / Unsplash
forrás: The Robot Report·AI Forradalom szerk.·
Megosztás

A robotok és önvezető autók mesterséges intelligenciája (AI) hatalmas adathalmazokon és szimulációkon alapul, ám továbbra is létezik egy kritikus rés a rendszerek látásmódja és a valóság között. A fizikai állapot-visszaállítás hiánya miatt a robotok nem értik pontosan környezetük fizikai állapotát, ami téves döntésekhez vezethet — írja a The Robot Report.

Physical AI 1.0 vs. 2.0

A jelenlegi, fizikai AI 1.0 fázisban az iparág a hatalmas adatmennyiségre és az NVIDIA Cosmos platformjához hasonló szimulációkra támaszkodik. Ez a „vízió-központú” megközelítés feltételezi, hogy elegendő kamera és számítási kapacitás mellett a robotok képesek pontosan megjósolni a jövőt. Azonban a valóságban a vakító napfény, az árnyékok, a szenzorok zajos adatai mind ezt megnehezítik. A fizikai AI 2.0 bevezet egy új, lényeges réteget: a fizikai állapot-visszaállítást. Ez a különbség azért számít, mert a fizikai AI-ban már nem csak a modell a verseny egysége; a robotoknál a modellnek együtt kell működnie szenzorokkal, szimulációval, képzéssel, vezérléssel és visszajelzésekkel.

Kapcsolódó: Nvidia keretrendszer

Az új architektúra: a valóság megértése

Egy biztonságos rendszernek négy képességre van szüksége: világmodellekre (a múlt tapasztalatai alapján tanult tudás), fizikai állapot-visszaállításra (a torz szenzoradatokból rekonstruálja a valóságot), érvelő rendszerekre (döntéshozatal) és cselekvésre. Az érvelés csak a pontos állapotbecslésen alapulhat; ha az észlelés tökéletlen, a legjobb modell is tévedhet. A fizikai AI nem csupán leír vagy jósol, hanem a döntéseket mozgássá alakítja, ami megváltoztatja a világot és új megfigyeléseket generál.

Kapcsolódó: AI dinamikus viselkedés

Miért nem elég a több adat?

Az end-to-end modellek méretének növelése önmagában nem oldja meg a problémát. Egy dedikált állapot-visszaállító modul hatékonyabb, mivel lehetővé teszi speciális szenzorok (pl. radar, érintés) kihasználását, mielőtt a magasabb szintű „agy” elkezdene gondolkodni. Ez megakadályozza, hogy minden új robotnak a fizika alapjait kelljen újra megtanulnia. A nehéz esetek megkülönböztetése a rosszul megfigyelt esetektől kulcsfontosságú; a több adat nem segít, ha az alapvető megfigyelés sérült. A megoldás egy erősebb visszaállító réteg, amely fizikai korlátokat és gazdagabb szenzoradatokat használ a rejtett állapot láthatóvá tételéhez.

Kapcsolódó: Robotok érzelemfelismerése

Gyakorlati példák és a jövő

Ezt az architektúrát szemlélteti egy humanoid robot ruhát hajtogatva, ahol a modell a gyűrött, árnyékos ruhadarabot is felismeri, vagy egy önvezető autó, amely a parkoló teherautó mögött rejtőző biciklist is követi. Mindkét esetben a rendszer nemcsak a látottakat, hanem a valós fizikai állapotot is pontosan becsüli. A fizikai AI következő határvonala nem csupán az okosabb érvelés, hanem a jobb megfigyelés. Az AI-versenyt az a rendszer nyeri, amely a digitális jóslat és a fizikai valóság közötti szakadékot a legpontosabban tudja áthidalni. Dr. Behrooz Rezvani, az Atomathic vezérigazgatója szerint a jövő robotjai számára a láthatatlan megfigyelése lesz a kulcs — írja a The Robot Report.

Kapcsolódó: Multimodális AI korlátai

Forrás

Feldolgozott sajtóforrás·The Robot Report

Eredeti cikk megnyitása →

Ez a cikk a fenti sajtóforrás alapján készült AI-összefoglalóval.

tetszett a cikk? oszd meg →
Megosztás

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom